视觉大模型开源取得重要进展 多模态生成升级支持2K高清音画

视觉大模型开源取得重要进展 多模态生成升级支持2K高清音画

8月3日,MiniMax正式开源新一代通用视频模型MiniMax H3。该全模态生成系统突破传统局限,可深度融合文本、图像、视频与音频的多模态上下文,展现强大任务泛化能力。H3支持4-15秒24FPS视频生成,提供2K高清分辨率、32kHz立体声及11种多语言交互,并推出首尾帧与全模态参考(最多12文件输入)等多种灵活模式。其三模块架构(H3-Context-IR、H3-Base、H3-Regenerate-2K)确保高保真音画输出。该开源模型已在Hugging Face发布,将显著降低多模态视频生成门槛

2026-08-03 21:24
7
0

国产算力生态取得重大突破:摩尔线程闪电适配MiniMax H3多模态大模型

国产算力生态取得重大突破:摩尔线程闪电适配MiniMax H3多模态大模型

MiniMax开源多模态生成模型H3,摩尔线程依托MTT S5000智算卡及MUSA软件栈,当天仅用3小时完成极速适配。H3支持文本、图片、音频、视频多元输入输出,可生成2K分辨率15秒原生音视频,在视频编辑能力上全球领先,价格低至0.8元/秒。其开源属性降低部署门槛,该突破标志国产算力生态在多模态AI领域取得重大进展,将加速AGI技术创新与产业化落地。

2026-08-03 21:19
5
0

MiniMax推出新一代多模态生成模型,定价降至行业同类模型三分之一

MiniMax推出新一代多模态生成模型,定价降至行业同类模型三分之一

MiniMax于7月31日发布新一代多模态生成模型H3,并宣布即将开源。该模型不再局限于单一任务,而是实现文本、图片、音频、视频的多模态统一理解与自然生成,支持2K分辨率、最长15秒音画输出,在指令遵循、文字渲染及V2V动作迁移等方面表现出色,适用于广告、品牌、电商等商业场景。H3视频生成定价仅0.8元/秒,为行业同类旗舰模型的三分之一,通过高压缩Tokenizer等技术创新实现成本优化。此举标志着大模型价格战延伸至多模态领域,有望降低数字内容生产门槛,推动AI商业化落地。

2026-07-31 20:11
17
0

MiniMax正式发布全模态视频模型H3 并承诺开源权重

MiniMax正式发布全模态视频模型H3 并承诺开源权重

MiniMax正式发布全模态生成模型H3,并承诺几天内全面开源模型权重。该模型支持文本、图像、视频、音频任意组合输入,输出带原生双声道的高清视频。采用创新H3-Omni Transformer统一架构,训练吞吐量提升近30%,通过H3-VAE实现高压缩率,大幅降低成本,且兼容国产芯片。在电影片头、游戏动画、广告电商等领域展现强大潜力,文字渲染准确度显著提升,为视听内容创作提供高性价比解决方案。

2026-07-31 11:52
12
0

推荐专栏

爱力方

爱力方

机器人前沿资讯及信息解读
机器人大讲堂

机器人大讲堂

中国顶尖的机器人专业媒体服务平台
关注爱力方,掌握前沿具身智能动态

© 2025 A³·爱力方

https://www.agentren.cn/