智象未来发布原生全模态视频模型 HD-V1,图生视频双榜进入全球第一梯队
智象未来发布视频模型 HD-V1,主推原生全模态联合建模,声称在物理规律与音画同步上明显优于现有方案。
智象未来(HiDream.ai)发布原生全模态视频生成模型 HiDream-O1-Video-1.0。它支持文本、图片、视频输入,直接生成 5–20 秒 1080p 视频,在意图理解、物理规律、自主叙事和音画一体化上做了升级,并在 Artificial Analysis 图生视频(含音频)榜排第四、Arena.ai 图生视频盲测榜排第八。
正文摘录
智象未来(HiDream.ai)正式发布首个原生全模态视频生成模型 HiDream-O1-Video-1.0 今天,智象未来(HiDream.ai)正式发布首个原生全模态视频生成模型 HiDream-O1-Video-1.0(模型简称 HD-V1)。HD-V1 采用智象自研原生全模态架构,支持文本、图片、视频等多种模态输入,可一键直出 5–20 秒 1080p 高保真视频,同时在 意图理解、物理规律理解、自主规划叙事、以及音画一体化生成 等维度均全面升级,达到全球领先水平。 发布同期,HD-V1 在两项国际权威评测榜单中,均位居世界前列。在全球领先的独立 AI 基准测试与分析平台 Artificial Analysis Image to Video Leaderboard(With Audio)排行榜上,HD-V1 取得全球排名第四的佳绩。Artificial Analysis 的图生视频榜单以标准化、可复现的基准对全球头部视频生成模型进行系统评测,被视为衡量 AI 视频模型综合实力的重要标尺。 在全球最具影响力的 AI 模型盲测评测平台 Arena.ai Image-to-Video 中,HD-V1 也取得了第 8 的优异成绩。Arena.ai Image-to-Video 是专注于 AI 视频生成模型的盲测评测子平台,是目前评估图生视频模型能力的重要第三方参考,被全球国际主流 AI 厂商广泛引用。 放在全球 AI 竞争格局中看,这一成绩的意义远超名次本身:多模态是当下全球人工智能的核心战场,图生视频则是其中技术密度最高、竞争最激烈的方向之一。HD-V1 以双榜高位成绩完成全球首次亮相,这标志着中国优秀大模型企业已全面领先,形成全球 AI 视频模型第一梯队。