Agents, Robotics, and Social Interaction / Embodied Agents, Multimodality, and Affective Visualization

How can virtual museum tour systems achieve multimodal interaction (combining speech, text, virtual characters, etc.) through large language models (LLMs)?

Similar questions

Related papers