ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

智象未来发布首款物理规律导向视频模型HD-V1

时间:2026-09-15 21:31:56来源:凤凰网科技编辑:快讯

凤凰网科技讯 9月15日,智象未来(HiDream.ai)今日正式发布原生全模态视频生成模型HiDream-O1-Video-1.0(简称HD-V1)。该模型采用智象自研原生全模态架构,支持文本、图片、视频等多种模态输入,可一键直出5至20秒1080p高保真视频,在意图理解、物理规律理解、自主规划叙事及音画一体化生成等维度全面升级。

在全球权威AI评测平台Artificial Analysis的Image to Video Leaderboard(With Audio)榜单中,HD-V1取得全球第四名。在Arena.ai的Image-to-Video盲测榜单中,HD-V1位列全球第八。两项榜单均为评估AI视频模型综合实力的重要第三方参考。

技术层面,HD-V1前置多模态意图理解模块,可对视频内容进行结构化规划,涵盖镜头时长、场景地点、画面内容、角色动作与表情、运镜焦段、台词与背景声等字段。模型还将物理规律纳入生成逻辑,使物体在重力、碰撞、惯性、光影衰减及空间连续性等方面的表现更贴合真实物理。HD-V1采用文本、视频、音频联合建模,实现音画原生一体化生成,镜头切换时环境声与配乐随之过渡,人物开口时口型、气口与情绪同频。

时长决策方面,HD-V1将时长选择与内容情境绑定,模型可根据事件展开逻辑、动作完成周期及叙事推进节奏自行规划生成时长,而非简单填充固定时间窗口。

随着HD-V1发布,智象未来已完成图像生成模型HiDream-O1-Image、交互式世界模型HiDream-O1-World、具身世界模型HiDream-O1-Embodied及视频模型HD-V1的矩阵布局。智象创始人梅涛博士表示,公司致力于构建“一个原生全模态底座、四大模型同源演进”的模型矩阵。

同日,智象未来宣布完成C+轮融资,投资方为新微资本、交子资本、工银资本。

更多热门内容