Argil 将 MiniMax H3 添加到其 AI 化身社交视频工作流程中
创始人 Laodis Menard 和 Brivael Le Pogam 正在将 MiniMax 的视频模型嵌入 Argil 的制作系统,用于虚拟形象、脚本、字幕、B-roll 和成品社交剪辑。
By Ryan Merket · Published
Primary source: MiniMax
Why it matters
Argil gives H3 a distribution path tied to finished social videos, where generated footage becomes one component in a production process spanning avatars, voices, scripts, captions and rendering.

Argil,这家由 Laodis Menard 和 Brivael Le Pogam 创立的巴黎 AI 视频初创公司,已在其用于 AI 化身社交视频的工作流程中将 MiniMax H3 作为素材生成选项添加进来。
MiniMax 的 7 月 31 日帖子确立了这一狭义新闻:H3 已在 Argil 内上线,但开源权重仍仅被描述为 “即将推出”。
Argil 的这一置入路径与 H3 的模型发布和直接 API 访问不同。MiniMax 的公告将 Argil 指名为把该模型带入创作者工作流程的应用。Argil 负责周边制作工作,包括化身、配音、脚本、字幕、B-roll 和渲染。
Menard 和 Le Pogam 大约十年前在广告技术公司 Teads 工作时相识。Y Combinator 的 Argil 简介 表示他们在 2016 年一起创办的一家初创公司失败了。创始人随后将重点放在降低制作视频的成本和制作工作上,Argil 加入了 Y Combinator 2024 年夏季批次。
H3 进入以化身为主导的制作工作流程
对 Argil 来说,这次集成很重要,因为 H3 成为围绕化身、脚本、字幕、B-roll 和自动渲染构建的产品中的一种素材生成选项,而不是一个独立的模型演示。
Argil 的网站以客户训练的 AI 克隆和现成化身为中心组织产品。其工具涵盖生成语音、字幕、辅助素材、转场和文章转视频制作,并为希望自动化视频创建的客户提供 API 访问。
MiniMax 的平台文档 将 H3 描述为一种通用的多模态视频模型,支持文本到视频、图片到视频、首尾帧生成和基于参考的生成。该模型可生成最高 2K 分辨率的视频。根据 H3 API,其参考输入可以包括图像、视频和音频。
MiniMax 通过其 V2 视频生成端点向进行直接模型调用的开发者提供 H3。Argil 则将该模型打包到一个面向客户的制作系统中,客户从主持人、脚本或文章出发,制作出最终的社交短片。
该公告未说明 Argil 支持哪些 H3 模式或用户如何选择该模型。它也未为承诺的开源权重设定发布日期或许可条款。
Argil 面临的执行挑战是将 H3 生成的素材与其化身和编辑系统整合,同时在可重复的自动化制作中保持视觉一致性。该模型的输出仍需与 Argil 协调的讲者、脚本、字幕和最终渲染相匹配。