返回资讯列表
ithome
•2026-07-31 10:00MiniMax H3 全模态生成模型正式发布:最高支持 15 秒 2K 分辨率,超分方案革新
IT之家 7 月 31 日消息,稀宇科技今天宣布推出 MiniMax H3 全模态生成模型,支持对文本、图像、视频、声音组成的多模态上下文的统一理解能力、能够输出具备原生双声道的音视频,最高可支持 15s 2K 分辨率。
据前期邀测反馈,MiniMax H3 具备商用级多场景内容生成能力,在指令遵循、文字与品牌信息呈现、V2V Motion Transfer(视频到视频动作迁移)等方面表现出色,号称可精准、可控实现多模态内容编辑与生成,适用于广告、电商、品牌、产品设计、UI / UX 和游戏等场景。
核心技术方面,MiniMax H3 增加了 Caption 能力,定制了专属模型和全模态理解管线,大部分素材需要消耗 100K Token 的推理,最终得到平均约 4K 的 Token。
同时,MiniMax H3 的 2K 视频输出能力并没有使用常规超分模块,而是使用 H3 基础模型对自己的低分辨率结果进行 in-context 的重新生成,可最大程度地复用 H3 基模已经具备的生成能力,还拥有传统超分方案无法靠“猜”还原的信息。
此外,MiniMax H3 将在未来几天内开放模型权重。IT之家将持续关注,第一时间带来最新消息。
最新资讯
国内唯一做多模态长记忆的公司,融资数千万,押注主动智能|涌现新项目
36氪•2026-07-31 23:23
开源鸿蒙 OpenHarmony 6.1 LTS 发布:新增展锐 P7885 开发板
ithome•2026-07-31 22:54
索尼 PlayStation 乐高套装被曝 10 月 1 日发售,同步推出《宇宙机器人》赠品
ithome•2026-07-31 22:28
高德:联合哈啰、海思和开源鸿蒙,推出共享两轮行业首个 AI 原生导航方案
ithome•2026-07-31 22:05
德国法院裁定 AI 音乐生成公司 Suno 侵犯版权,需支付赔偿金
ithome•2026-07-31 21:28