> 数据图表

如何了解MiniMax核心财务预测:年度

2026-8-0
如何了解MiniMax核心财务预测:年度
事件:7 月 31 日,MiniMax 正式发布全模态生成模型 MiniMax H3。模型可统一理解由文本、图像、视频及声音构成的多模态上下文,并生成原生双声道音视频,最高支持 15 秒、2K 分辨率。定价方面,2K 视频生成价格约为 0.53-0.82 元秒,低于主流模型的三分之一。公司同时计划在符合相关法律法规的前提下开放模型权重。 模型具备三大核心能力:1)原生多模态理解与生成:H3 支持文字、图片、音频及视频等多种输入,可理解不同素材间的关联,并将人物、动作、声音、镜头等参考信息自然融合,实现从素材理解到完整视听内容生成的一体化创作2)多模态精准编辑与控制:模型支持对人物、物体、场景、声音及节奏进行多维度编辑,具备较强的复杂指令遵循能力3)商用级多场景内容生成:H3 面向影视、广告、品牌、电商及游戏等商业场景,可帮助创作者及内容团队提升创意验证、视觉提案和内容制作效率。 架构服务于模型定义,H3 围绕理解、生成与效率完成系统性升级。1)Contextual Omni Representation:通过强化多模态 Caption 能力,描述目标内容、参考素材及其相互关系,支撑复杂指令理解2)H3-VAE,通过提升视觉信息压缩效率,降低训练与推理成本,为 2K 视频生成提供支撑3)H3-Omni Transformer:采用理解与生成异构架构并优化负载均衡,使端到端训练吞吐提升近 30%4)In-context Regeneration:生成低分辨率的结果,再结合上下文对其进行高清重生成,提升文字、主体及细节还原能力。 多模态理解能力及模型的 Scaling 仍有提升的空间。展望后续,公司将继续提升多模态上下文理解能力,并推动 H 系列下一代模型与 M 系列文本模型融合。此外,公司还将通过 Scaling,解锁模型完成任务的泛化能力。 重申“买入”评级。我们认为,H3 推出的直接影响是推动 Hailuo 产品收入及用户增长重新加速,更重要的意义在于强化 MiniMax 的全模态模型公司定位。MiniMax 是少数同时在文本(M3 系列)、视频(H3)、语音及音乐(Speech2.8Music3.0)等领域持续投入的大模型厂商,H3 有望进一步验证公司在多模态理解与生成领域的技术与数据积累,完善其全模态能力矩阵,并为未来多模态融合实现 AGI 的演进奠定基础。我们预计 MiniMax 2026-2028 年收入为 5.7、11.4、17.1 亿美元,同比增长 625.9%、99.3%、49.6%Non-GAAP 归母净亏损为 13.0、12.4、6.8 亿美元。重申“买入”评级。 风险提示:模型迭代不及预期的风险、行业竞争激烈的风险、盈利改善不及预期的风险等。