OmniTools 7月31日消息,MiniMax 正式推出全能多模态生成模型 H3,支持文本、图像、视频与音频的联合理解与生成。该模型可生成最高 2K 分辨率、时长 15 秒且带原生立体声的视频。
H3 在指令跟随能力、文字与品牌元素呈现、视频到视频(V2V)动作迁移等任务上表现突出。在定价方面,2K 分辨率下每秒生成成本低于主流模型约三分之一,768p 分辨率下则低于主流 720p 模型约一半。
MiniMax 表示将尽快开源 H3 模型权重,以推动开源社区发展并提升硬件适配效率。
OmniTools 7月31日消息,MiniMax 正式推出全能多模态生成模型 H3,支持文本、图像、视频与音频的联合理解与生成。该模型可生成最高 2K 分辨率、时长 15 秒且带原生立体声的视频。
H3 在指令跟随能力、文字与品牌元素呈现、视频到视频(V2V)动作迁移等任务上表现突出。在定价方面,2K 分辨率下每秒生成成本低于主流模型约三分之一,768p 分辨率下则低于主流 720p 模型约一半。
MiniMax 表示将尽快开源 H3 模型权重,以推动开源社区发展并提升硬件适配效率。
从这条动态出发,继续查看相关分析、产品详情和同主题更新。
刚收录的 AI 工具,适合顺手发现可用产品。