↩️ MiniMax 发布全模态模型 H3,将开源权重
MiniMax 发布全模态模型 H3,将开源权重
7 月 31 日,MiniMax 正式发布通用全模态生成模型 H3,支持对文本、图像、视频、声音的多模态上下文统一理解与生成,可输出原生双声道音视频,最高支持 15 秒 2K 分辨率。该模型在指令遵循、文字呈现及视频动作迁移方面表现突出,适用于广告、电商、游戏等商业场景。
H3 默认提供 2K 分辨率,同分辨率下每秒价格不到主流模型的三分之一。公司计划在未来几天内开放模型权重,以推动开源社区发展并加速国产芯片适配。H3 是继 Hailuo 01、02 后的第三代模型,在预训练阶段即融合多模态数据与任务,追求任务的统一与泛化。
MiniMax 稀宇科技
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel
科技圈🎗在花频道📮:
MiniMax 发布 M3 模型:1M 上下文、原生多模态,编程能力领先 MiniMax 正式发布 M3 模型,采用全新 MSA 稀疏注意力架构,支持最高 100 万 token 上下文窗口,可原生处理图片、视频和桌面操作。在编程评测 SWE-Bench Pro 上,M3 得分 59%,超过 GPT-5.5 和 Gemini 3.1 Pro;在多模态 OmniDocBench 和 Agent 评测 Claw-Eval 中也达到领先水平。M3 是国内首个同时具备超长上下文、前沿编程与原生多模态能力且开源的模型。…
MiniMax 发布全模态模型 H3,将开源权重
7 月 31 日,MiniMax 正式发布通用全模态生成模型 H3,支持对文本、图像、视频、声音的多模态上下文统一理解与生成,可输出原生双声道音视频,最高支持 15 秒 2K 分辨率。该模型在指令遵循、文字呈现及视频动作迁移方面表现突出,适用于广告、电商、游戏等商业场景。
H3 默认提供 2K 分辨率,同分辨率下每秒价格不到主流模型的三分之一。公司计划在未来几天内开放模型权重,以推动开源社区发展并加速国产芯片适配。H3 是继 Hailuo 01、02 后的第三代模型,在预训练阶段即融合多模态数据与任务,追求任务的统一与泛化。
MiniMax 稀宇科技
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel