MiniMax 将于 8 月 18 日在旧金山的 ModCon 上展示 H3。

Morgan Suo 将在 Modular 在旧金山为 AI 基础设施开发者举办的会议上讨论 MiniMax 的多模态视频模型。

By · Published

Primary source: MiniMax

Why it matters

MiniMax's planned ModCon appearance puts H3 before U.S. infrastructure practitioners who can evaluate its deployment requirements, published components and self-reported efficiency claims.

An AI model's real-time data output during a presentation. (Infrared / thermal-camera render with scientific instrument readout overlays.)

Founder Junjie Yan's MiniMax says Morgan Suo (@MorganSuoinMM) will present its H3 video model at ModCon in San Francisco on August 18, putting the model before a conference aimed at AI infrastructure developers, engineers and researchers.

MiniMax 在 X 上

截至8月14日,官方 ModCon 页面 列出 MiniMax 全球业务总裁 Linda Sheng 作为演讲者。页面并未指明 Suo 或 H3 的演讲。因此,MiniMax 的公告是 Suo 计划出席和 H3 演讲的来源。

此次亮相为 Yan 提供了又一次将其通用人工智能论点带入美国开发者市场的机会。Yan 在 SenseTime 工作六年多后创立了 MiniMax,在 SenseTime 担任副总裁兼研究院副主任。他在 Southeast University 学习数学,在 Chinese Academy of Sciences 获得人工智能博士学位,并在 Tsinghua University 进行博士后研究。MiniMax 在其官网将他列为创始人、董事长、首席执行官兼首席技术官。(MiniMax Investor Relations

H3 的基础设施受众

此次活动为 MiniMax 最近的 H3 推广增加了一个以基础设施为重点的停靠点。根据 Modular 的会议资料,ModCon 的目标受众是从事 AI 基础设施的开发者、工程师、研究人员和技术负责人。该受众群体有能力审视部署要求、模型集成以及运行 H3 的实际成本,这些议题与以样本为驱动的创作者展示有着不同的利害关系。

MiniMax 已经通过多个分发和演示渠道推进 H3。RuntimeWire 报道称 MiniMax 将 H3 引入 Luma Agents、安排了消费级硬件和 ComfyUI 测试,并概述了发布单独的 2K 再生模型和稀疏注意力参考代码 的计划。MiniMax 与 fal 还安排了围绕该模型的开发者会话,随后在旧金山与 Magnific 举办了展示会

公开的职业资料将 Suo 描述为 MiniMax 的高级市场开拓与重点客户经理,负责领导其 AI 视频和语音产品的美国业务发展。他在 ModCon 出场的角色具有商业相关性:MiniMax 指派了一位面向开发者的代表向美国技术受众解释 H3。(Morgan Suo 的 LinkedIn 资料

Yan 的通用模型赌注

MiniMax 的官方 H3 资料 将该系统描述为一个多模态生成模型,接受文本、图像、视频和声音的组合输入。MiniMax 表示 H3 可生成原生立体声音频、最高 2K 分辨率且长度达 15 秒的片段。

H3 体现了 Yan 致力于构建跨任务及媒体类型模型的努力。MiniMax 表示早期的视频系统将文本到视频、图像到视频、主体参考、动作参考、音频和编辑分成更狭窄的工具。根据 MiniMax,H3 使用自然语言指令来指定多个输入应如何与所请求的输出相关联。

MiniMax 表示 H3 包含重新设计的视频自动编码器、一个全模态变换器以及用于更高分辨率输出的上下文内再生过程。其H3 页面 宣称该自动编码器将序列长度缩短了四倍,MiniMax 的异构训练架构将端到端训练吞吐量提升了近 30%。这些数据为 MiniMax 的测量结果,MiniMax 表示将随后发布详细的技术报告。

基础设施方面的问题超出模型架构本身。评估 H3 的开发者需要确定其已公布的组件如何适配到他们的服务堆栈、哪些更高分辨率工作流部分仍由主办方托管,以及其报告中的训练效率是否能转化为更低的部署成本。ModCon 为 MiniMax 提供了接触代码和系统图读者的机会,这些读者可以将这些主张与生产需求进行检验。

巡展背后的商业压力

MiniMax 的国际业务已占其报告销售额的大部分。于截至2025年12月31日止年度,MiniMax 报告的总收入为 79.038 百万美元,同比增长 158.9%,其中 73.0% 来自中国大陆以外地区。Open Platform 及其他基于 AI 的企业服务产生了 25.963 百万美元收入,而 2024 年为 8.718 百万美元。(MiniMax 2025 年度报告

同一份文件报告 2025 年研发费用为 2.528 亿美元,调整后净亏损为 2.509 亿美元。MiniMax 将调整后净亏损定义为净亏损加上以股份为基础的支付费用、金融负债的公允价值损失及上市费用。

MiniMax 的年报还表示,MiniMax 于 2026 年1月9日在香港上市,并从其全球发售(包括超额配售权的全部行使)中获得约 53.9339 亿港元的净收益。公司声明的分配为 90% 用于研发,10% 用于营运资金和一般公司用途。(MiniMax 2025 年度报告

美国扩张也带来法律风险。Disney、Universal 和 Warner Bros. Discovery 于2025年9月起诉 MiniMax,指控其涉及更广泛的 Hailuo AI 平台的版权侵权。该起诉涉及 Hailuo AI,并未对 H3 提出具体指控。但这仍将权利管理和训练数据问题列为美国客户在 MiniMax 推广其视频系统时可能审查的问题之一。(Reuters

MiniMax 计划在 ModCon 的出场将 H3 的分发活动延伸到一个关注 AI 应用之下系统的会场。对 Yan 而言,现实的考验是开发者是否能够将 MiniMax 的多模态研究和已公布的模型组件转化为他们可以运行、测量和维护的软件。

Reader comments

Conversation for this story loads after sign-in.