MiniMax 发布全模态模型 H3,将开源权重
7 月 31 日,MiniMax 正式发布通用全模态生成模型 H3,支持对文本、图像、视频、声音的多模态上下文统一理解与生成,可输出原生双声道音视频,最高支持 15 秒 2K 分辨率。该模型在指令遵循、文字呈现及视频动作迁移方面表现突出,适用于广告、电商、游戏等商业场景。
H3 默认提供 2K 分辨率,同分辨率下每秒价格不到主流模型的三分之一。公司计划在未来几天内开放模型权重,以推动开源社区发展并加速国产芯片适配。H3 是继 Hailuo 01、02 后的第三代模型,在预训练阶段即融合多模态数据与任务,追求任务的统一与泛化。
MiniMax 稀宇科技
本站提供的一切软件、教程和内容信息仅限用于学习和研究目的;不得将上述内容用于商业或者非法用途。本站所有信息均来自网络,版权争议与本站无关。您必须在下载后的24个小时之内,从您的电脑或手机中彻底删除上述内容。如果您喜欢该程序,请支持正版,购买注册,得到更好的正版服务。如有侵权不妥之处请致信 E-mail:[email protected] 我们会积极处理。敬请谅解!
|

