科大讯飞发布面向公共服务场景的智能交互新产品-新华网
新华网 > 安徽 > 正文
2026 07/18 16:44:24
来源:科大讯飞

科大讯飞发布面向公共服务场景的智能交互新产品

字体:

  2026世界人工智能大会(WAIC)期间,科大讯飞正式发布面向公共服务场景的智能交互Agent——GuideX。

  区别于传统数字人,GuideX融合“全模态感知、自治理Agent、SkillHub(AI技能社区)”等核心能力,打通“感知、理解、执行、记忆、共情”服务全链路,为公共服务场景提供可复制、可规模化部署Agent解决方案。

  全模态交互,让复杂场景实现高稳瞬交

  GuideX融合声音、人脸、位置、唇形、空间环境等多维信息,让AI能理解完整交互场景。科大讯飞消费者海外产品部总经理卢尧系统展示了GuideX如何打造全模态感知。

  从“听懂一句话”到“理解一个场景”,让复杂场景也能稳定交互。GuideX融合了“人脸唤醒、声源定位、唇形识别、手势识别、空间感知”等多模态技术,可实时感知用户位置、状态及交互意图。在多人同时说话场景下,GuideX丢字率低于 1.3%、串扰率低于 1.7%。即使在-10dB(分贝)噪声环境下,语音识别准确率也能达到 92.1%,满足复杂现场的稳定服务需求。

  跨越语言障碍,才能准确识别用户意图。面向全球服务场景,GuideX 已支持“英语、西班牙语、俄语”等30余种语言交互,英语语音识别率达到97.35%,端到端全场景准确率达到95.12%。这意味着,在机场口岸、国际展会和涉外公共服务等场景中,企业可以更快速地构建多语言智能服务能力。同时,GuideX支持200+数字人形象、100+超拟人音色,让每个场景都有定制专属服务形象。

  发布会现场,搭载体验官数字分身的GuideX,能够用英语、阿拉伯语、泰语等介绍发布会内容,也能够结合定制知识库,实时回答WAIC议程、展品详情等问题。

  交互新体验的背后离不开全模态基座。从语音唤醒、意图识别到Agent执行、数字人表达,GuideX的全链路交互耗时仅0.42秒。同时,支持全双工低延迟通信,用户可以随时打断、连续追问,数字人口型、表情与语音也能保持精准同步,让人与AI的交流更加自然流畅。

  自治理决策与执行,企业级可信能力

  区别于传统问答式数字人,GuideX具备自主理解、决策与执行能力。面对用户模糊表达,GuideX能够自动抽取业务约束、补全缺失信息,并结合行业知识准确理解真实业务意图。

  完成需求理解后,GuideX采用双轨决策机制,根据业务复杂程度自动选择处理路径:标准化业务由确定性策略快速响应,复杂业务则通过自适应策略完成推理决策,并协同多个Agent联动企业业务系统,实现咨询、查询、办理等全流程服务闭环,推动公共服务从“回答问题”升级为“完成业务”。

  同时,GuideX支持企业知识库快速接入,兼容多种文档格式,并支持跨语言知识泛化,帮助企业快速沉淀专业知识。

  持续记忆与主动服务,让交互更自然

  通过数据积累,构建差异化的服务体验,让用户第一次咨询的问题、偏好的方式、过去办理过的事项,都成为下一次服务的基础。

  基于上下文语境,GuideX 能够识别用户情绪,通过领先的语音技术与数字人技术,生成“开心、安抚、关怀”等共情回复,确保服务话术稳定、得体。

  经过用户授权,GuideX还能够结合人脸识别和短期场景记忆,持续记录服务上下文、历史偏好和办理记录。发布会现场,GuideX围绕酒店、地铁、旅游景区等典型场景进行了现场演示。从酒店送机预约、早餐推荐,到地铁路线规划、旅游导览及二维码路线分享,充分展示了公共服务由“被动响应”向“主动服务”的升级。

  开放生态,加速规模化落地

  为满足不同企业需求,GuideX支持数字人形象、声音及交互流程个性化定制,并提供软硬一体化部署方案,可灵活运行于智能终端、一体机、透明屏、网页及移动App等多种载体,同时提供多种、多模态感知模组,适配不同交互场景。

  发布会现场,科大讯飞正式启动GuideX领航者计划,联合软件、硬件、开发者及行业伙伴共建开放生态,并与多家合作伙伴完成现场签约,推动GuideX在交通出行、酒店服务、文化旅游、智慧商业等领域加速落地。

  未来,科大讯飞将持续推进智能交互与Agent技术融合创新,携手生态伙伴探索更多智能服务新模式,推动AI真正理解需求、连接服务、创造价值,助力千行百业实现更加高效、便捷、有温度的智能化升级。(欧阳青青)

【纠错】 【责任编辑:周雨濛】