ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

MiniMax H3正式开源:通用视频模型支持多模态生成,最高2K分辨率带立体声

时间:2026-08-03 16:04:31来源:互联网编辑:快讯

近日,人工智能领域迎来一项重要突破——MiniMax公司宣布其新一代通用视频生成模型MiniMax H3正式面向全球开发者开源。该模型凭借多模态交互能力与高分辨率视频生成特性,迅速引发技术社区与行业关注。

作为全模态生成系统的代表,MiniMax H3突破了传统模型对单一数据类型的依赖。其核心架构支持同时解析文本描述、静态图像、动态视频及音频信号,通过跨模态语义对齐技术实现多维度信息融合。例如,用户输入"夏日海滩的日落"文字描述,并搭配海浪声的音频片段,模型即可生成包含视觉画面与环境音效的完整视频场景。

在生成质量方面,该模型展现出显著技术优势。其支持输出分辨率最高达2048×1080的2K级视频,单段视频时长突破至15秒,并内置原生立体声生成模块。技术团队透露,通过动态帧率优化算法与空间音频渲染技术,生成内容在画面流畅度与声场定位精度上达到行业领先水平。相较于前代模型,H3在复杂场景渲染效率上提升40%,同时将内存占用降低35%。

开源社区对这项技术表现出浓厚兴趣。开发人员可通过GitHub平台获取完整模型代码与训练框架,其模块化设计允许研究者针对特定场景进行微调。有开发者测试显示,在消费级GPU上部署的精简版本,仍能保持每秒3帧的实时生成能力。行业分析师指出,这种开放策略将加速多模态生成技术在影视制作、虚拟现实、数字营销等领域的应用落地。

更多热门内容
微波神经网络新突破:康奈尔团队以物理过程革新传感运算,低功耗开启AI新可能
但近日,康奈尔大学(CornellUniversity)的研究人员设计出一种名为“微波神经网络”(MNN)的新架构,可让雷达信号跳过所有数字化的转换和运算步骤,直接由芯片内部的物理过程完成识别。 2025…

2026-08-03

DeepSeek单日8万亿Token调用量领跑 中国AI大模型逼OpenAI降价应战
DeepSeek V4 Flash在代码开发这一垂直场景中单日消耗8万亿Token,意味着其已经成为大量开发者的默认编程助手。即便OpenAI将Luna价格下调80%,DeepSeek V4 Flash在其…

2026-08-03

天时地理:以“五技融合”赋能智慧城市 深耕垂直领域展现深圳创新力
在深圳龙华区,一家专注于时空智能技术的企业——天时地理(深圳)智能科技有限公司,正以“物联网+大数据+人工智能+北斗网格码+区块链”为技术底座,参与智慧城市建设。 从2020年入库科技型中小企业,到成长为行业…

2026-08-03

微重力三维培养:解锁脑类器官潜能,开启神经科学研究新篇章
在此背景下,微重力模拟培养技术 作为一种革命性的三维培养策略,正以其在构建超低剪切力、高仿生培养环境方面的独特优势,为高效制备成熟、功能完善的脑类器官开辟了新路径。它直击了传统脑类器官制备技术在功能性神经网络…

2026-08-03

英伟达宣布CPO技术量产 未来光通讯市场或迎Scale-up引领的新增长
8月3日,财闻海外资讯消息,英伟达资深副总裁Gilad Shainer宣告,共同封装光学(CPO)步入量产,同时点名未来光通讯市场最 大商机在于垂直扩充(Scale-up),所需频宽效能将会是水平扩充(Sc…

2026-08-03