行业新闻

模思智能在 WAIC 发布实时视频理解与多说话人转写模型

模思智能在 WAIC 展示情境智能:实时视频理解、多人音频转写与生成,让 AI 在动态场景中理解上下文。

模思智能在 WAIC 2026 上展示情境智能,核心是让 AI 理解持续变化的声音和画面,而非静帧或单句话。他们发布了实时视频理解模型 MOSS-VL-Realtime、多说话人转写模型 MOSS-Transcribe-Diarize,并通过声音巴别塔等互动体验,呈现从感知到生成的完整链路。

正文摘录

模思智能亮相 WAIC 2026:用一座声音巴别塔,让情境智能走到台前 - sourcecompany: 机器之心 - bodymarkdown: ![](https://image.jiqizhixin.com/uploads/article/coverimage/f3788109-7da6-4363-80d0-5e9058682416/Screenshot2026-07-18at11(2).13.16.png) 7 月 17 日至 20 日,2026 世界人工智能大会暨人工智能全球治理高级别会议在上海举行。面向下一代情境交互智能的大模型创新企业模思智能首次亮相 WAIC,在上海世博展览馆 H1-C1234 展位,集中展示实时视频理解、复杂音频转写、语音及音视频生成和实时交互等最新进展。 复旦大学教授、上海创智学院全时导师、模思智能首席科学家邱锡鹏受邀出席 2026 世界人工智能大会主论坛圆桌,与 2025 年诺贝尔化学奖得主 Omar M. Yaghi、2025 年图灵奖得主、量子技术先驱 Gilles Brassard 等国际顶尖科学家同台,围绕 AI 驱动科研范式变革、下一代模型演进以及人工智能与量子技术的发展展开交流。 在论坛上,邱锡鹏表示,AI 正在从科研辅助工具演进为科研创新的重要参与者,未来将形成“AI 自主迭代 AI”的闭环研发体系,持续缩短模型研发周期,加速下一代基础模型的发展。

阅读原文(jiqizhixin.com)→

行业新闻新闻资讯2026-07-18原文

相关内容