• 回答数

    0

  • 浏览数

    45

  • 收藏数

    0

作者:feels 发表于 2026-8-3 13:28:17
跳转到指定楼层
AI 总结
• 8 月 3 日 MiniMax 正式开源多模态生成模型 H3,支持文本、图片、音频和视频多元输入,可直出 2K 分辨率、最长 15 秒原生音画内容。

IT之家 8 月 3 日消息,今日,MiniMax 正式开源多模态生成模型 MiniMax H3 。同日,摩尔线程基于 AI 训推一体智算卡 MTT S5000 及 MUSA 软件栈,率先完成 H3 的极速适配与高效运行。

IT之家从官方介绍获悉,作为 MiniMax 首款开源多模态生成模型,H3 突破了传统单一任务的边界,能在多模态上下文中统一理解创作意图,支持文本、图片、音频和视频的多元输入, 可直出 2K 分辨率、最长 15 秒的原生音画内容 。

在生成表现与性价比上, H3 具备商用级多场景内容生成能力 ,不仅在 Artificial Analysis 视频模型榜单中斩获“ 视频编辑能力全球第一 ”,其 2K 分辨率视频生成价格更低至 0.8 元 / 秒,展现出极高的商业性价比。

此外,H3 的开源属性 显著降低了应用门槛 ,支持企业本地化灵活部署与自有数据定制,在满足安全合规需求的同时,加速多模态生产力的广泛普及。

MiniMax H3 开源当日,摩尔线程团队迅速完成了模型架构拆解、核心技术分析及典型算子梳理, 仅用 3 小时 便打通了从 SGLang-MUSA 推理框架到 MATE、muDNN 高性能算子库的 完整适配路径 ,实现了 H3 在 MTT S5000 上的快速部署与稳定运行。

摩尔线程表示,未来将与 MiniMax 持续深化合作,在多模态领域共同探索更强的上下文理解能力与更大模型规模,加速 AGI 技术的创新与产业化落地。

相关阅读:



《 通用视频模型 MiniMax H3 正式开源,支持多模态上下文、2K 分辨率 》



《 MiniMax H3 全模态生成模型正式发布:最高支持 15 秒 2K 分辨率,超分方案革新 》

[来源链接] https://www.ithome.com/0/984/981.htm
分享:
回复

使用道具

成为第一个回答人

高级模式 评论
您需要登录后才可以回帖 登录 | 立即注册
⚠️

AI客服助手

×
AI
您好!我是AI客服助手,有什么可以帮助您的吗?

请先登录后使用AI客服助手

立即登录
内容由非常AI大模型生成,仅供参考,相关风险需自行承担。

赚钱

会员VIP

留言板

商务合作

联系电话:17308937318

QQ邮箱

QQ:118275

邮箱:118275@qq.com

友情链接