新闻
又一国产模型重磅开源!有声视频编辑全球第一,16家芯片及平台首日适配
1 分钟阅读
来源:zhidx.com
智东西 作者 | 杨京丽 编辑 | 李水青 智东西8月3日报道,今日,MiniMax正式开源新一代通用视频模型 MiniMax H3 。 MiniMax H3是一个 通用型全模态生成系统 ,可统一理解文本、图像、视频和音频组成的 多模态上下文 ,生成最长15秒、最高2K分辨率并带有原生立体声音频的视频。 此前7月31日, MiniMax H3发布 。 目前,在Artificial Analysis有声视频编辑榜单中,MiniMax H3以1130分的Elo成绩 位列第一 ,领先Gemini Omni Flash、HappyHorse-1.0、Wan 2.7等国内外视频模型。 ▲MiniMax H3位列有声视频编辑榜单榜首 H3系统由 H3-Context-IR、H3-Base、H3-Regenerate-2K 三个模块组成。开发者可以直接从Hugging Face下载MiniMax H3模型,H3-Base目前支持通过SGLang、vLLM、diffusers和ComfyUI等推理框架和工作流进行部署。 与模型开源同步,华为昇腾、摩尔线程、沐曦、海光信息、昆仑芯、天数智芯、壁仞科技、AMD、Intel等国内外芯片厂商,以及Hugging Face、魔搭ModelScope、ComfyUI、RunningHub、fal等开发社区和云推理平台,另有vLLM-Omni、SGLang等推理框架, 共16家生态伙伴 均完成了相关适配支持。 开源地址: huggingface.co/MiniMaxAI/MiniMax-H3 模型体验地址: H3-2K直出: platform.minimax