TAG:音视频生成

MiniMax发布通用全模态模型H3:15秒2K音视频生成价格不到主流模型三分之一

MiniMax发布通用全模态模型H3:15秒2K音视频生成价格不到主流模型三分之一

MiniMax发布通用全模态模型H3,首次实现文本、图像、视频、音频的统一理解与生成,支持15秒2K双声道音视频输出,并以更低生成成本切入广告、电商、游戏等商业场景。其即将开源权重,也有望推动国产多模态生态与芯片适配加速发展。

2026-07-31 10:44
23
0

黑森林实验室FLUX3多模态模型发布,支持单次生成20秒音视频,性能超越Grok与Seedance

黑森林实验室FLUX3多模态模型发布,支持单次生成20秒音视频,性能超越Grok与Seedance

Black Forest Labs推出FLUX3多模态基础模型,支持单次生成20秒带原生音频的音视频,文生视频、图生视频、视频续写等全场景创作能力。人工评测中对比Grok Imagine Video胜率69%,图像编辑与机器人行为预测领域持续突破,展现统一架构的多模态领先优势。

2026-07-24 17:56
5
0

推荐专栏

爱力方

爱力方

机器人前沿资讯及信息解读
机器人大讲堂

机器人大讲堂

中国顶尖的机器人专业媒体服务平台
关注爱力方,掌握前沿具身智能动态

© 2025 A³·爱力方

https://www.agentren.cn/