当我们走进2026世界人工智能大会魔珐科技的展台,最先看到的是一块大型主屏正在与一台机器人协同完成PPT讲解和互动。这块主屏上呈现的并非传统的视频画面,而是一个能够实时感知观众、理解问题并通过声音、表情和手势做出回应的AI数字人。展台另一侧的全息仓中,一个AI角色只需要一句你好小静的唤醒指令就能开始自主进行展台导览。而在文旅自助终端、酒店HTV终端和AGV小车上,同样的数字人能力被嵌入到不同的硬件形态中,为观展者提供导览和服务。这是魔珐科技首次在WAIC上全线展示其魔珐星云具身交互智能平台和升级版魔珐有言。这些场景中最引人注目的不是某个单一产品的功能强大,而是同一套数字人能力在不同终端上的无缝迁移。从大型主屏到手机平板,从全息仓到服务机器人,AI数字人不再被局限在电脑的一个对话框里,而是被放入真实的场景和物理设备中,真正走到了观众的面前。
魔珐科技将魔珐星云定位为具身交互智能平台。支撑这套能力的是魔珐自研的多项核心技术,包括高质量3D数据、文生多模态3D大模型、端侧实时渲染以及云端与端侧协同能力。魔珐星云将这些技术整合为一套端到端的SDK,供硬件厂商和开发者集成。从技术架构来看,魔珐星云的核心是一条完整的感知-理解-表达-行动链路。当用户与AI数字人交互时,终端首先通过视觉传感器和麦克风感知用户和环境信息。然后底层的大模型、知识库和智能体系统理解用户的意图,判断应该调用哪些知识来回答以及如何组织回应。接着AI生成与语义和情绪相匹配的声音、表情、眼神和肢体动作。如果终端是机器人,AI的输出还会进一步连接物理动作执行,让数字人从屏幕中走出来进入现实世界。这条技术链路的价值在于让AI数字人具备了真正的交互能力。传统的数字人展示更多是单向的内容播放,即使是所谓的实时互动也往往是基于预设的问答脚本。魔珐星云的AI数字人则能够根据用户的实时输入动态调整自己的回应方式。当用户打断它说话时它会停下来的倾听,当用户提问时它参考知识库给出准确的答案,当需要引导用户时它可以做手势指向正确的方向。这种接近真人交互体验的能力让数字人从一个展示工具升级为一个可以真正工作的服务界面。
与魔珐星云同时亮相的还有升级版的魔珐有言。魔珐有言最初是一款面向企业和个人的AI数字人视频创作工具,用户可以通过文字输入快速生成数字人播报视频。升级后的魔珐有言在保持原有视频生成能力的基础上,增加了对跨终端内容生产和管理的能力。升级的关键变化之一是魔珐有言与魔珐星云的深度整合。创作者在魔珐有言中设计的数字人形象和内容脚本可以直接同步到魔珐星云平台,一键部署到各种终端上。这意味着企业不需要为不同终端分别创建和管理数字人内容,一套素材可以在大屏展示、手机互动和机器人服务等多个场景中统一使用。魔珐有言的另一个升级重点是知识库接入。升级后的版本支持企业上传自己的产品手册、FAQ文档和业务知识等私有数据,构建专属的数字人知识库。当用户提出问题后,数字人会自动在知识库中检索相关信息并生成回答。这种知识库接入能力让魔珐有言从内容创作工具扩展到客户服务和知识管理领域。魔珐有言已经服务了数千家企业客户,覆盖零售、金融、教育、文旅等多个行业。魔珐科技表示将魔珐有言和魔珐星云的结合是公司从数字人内容创作到具身交互智能的战略升级。未来魔珐有言将成为内容生产的入口,而魔珐星云则是让内容走向真实世界的基础设施。
在WAIC展台上,魔珐科技展示的不仅是一组技术产品,更是一条AI数字人进入真实世界的完整路径。文旅场景中数字人可以在自助终端上为游客提供景点介绍和路线导览。酒店场景中数字人可以在客房电视上提供酒店服务和周边信息查询。零售场景中数字人可以在店内的屏幕上担任虚拟导购。这些场景有一个共同的特点:它们都是已经有大量用户接触点的高频交互场景,数字人不是替代原有的服务而是补充和增强。魔珐科技将这种能力定义为具身交互智能。具身意味着AI不再只是一个虚拟的对话界面,而是能够以可感知、可交互的方式存在于真实空间中。从展台的演示效果来看,魔珐星云的AI数字人在互动流畅度、表情自然度和响应准确性方面都达到了较高的水平。虽然距离完全替代人类服务人员还有一些距离,但在标准化的信息咨询和导览服务场景中,AI数字人的表现已经能够满足用户的日常需求。魔珐科技表示将继续优化魔珐星云平台的能力,降低集成的技术门槛,让更多企业和开发者能够将AI数字人接入自己的产品和服务中。公司还计划在近期开放魔珐星云平台的开发者套件,提供完善的API文档和示例代码,进一步加速数字人技术的行业普及和应用落地。按照魔珐科技的产品路线图,2026年下半年还将推出面向中小企业的轻量化版本。