OpenAI 让 GPT-5.6 Sol 将繁重的杂务委派给更便宜的 Luna 代理
新的路由可以让 Sol 继续掌控,同时将有界的工作分配给更快、成本更低的 Luna 子代理。
By RuntimeWire Staff · Published
Primary source: X
Why it matters
Cross-model delegation gives Codex a direct cost and latency control: expensive reasoning can stay with the orchestrator while faster models handle clearly bounded work.

OpenAI 已为 Codex 的 Multi Agents v2 系统发布了跨模型委派功能,使模型能够将工作分配给任何受支持的模型(包括 GPT-5.6 Luna),Eric Provencher (@pvncher) 在 X 的一条线程 中于 8月15日 表示。

此发布为 Codex 提供了一个实用的模型层级:像 GPT-5.6 Sol 这样有能力的模型可以保持作为协调者,同时将定义明确的任务发送给更快的执行者。OpenAI 将 Luna 描述为 GPT-5.6 家族中速度最快且成本最低的模型,这使得在以代理为主的编码工作中,通过路由来控制延迟和消耗变得有用。
Provencher 在构建 Repo Prompt(一款用于策划代码库上下文并协调编码代理的原生 macOS 工具)之后加入了 OpenAI 的开发者关系团队。在全职投入 Repo Prompt 之前,他在 Unity 工作了五年。Repo Prompt 于 6月13日 开源,其 Community Edition 作为一个代理编排项目继续存在。
这一背景与 Provencher 在 OpenAI 推出的功能直接对应。Repo Prompt 的构建围绕将规划、上下文收集和实现分配给专门的代理展开。Multi Agents v2 现在也在 OpenAI 的模型阵容内为 Codex 提供了类似的劳动分工。
Sol 指挥,Luna 执行
Provencher 将 Luna 工作器描述为“纯粹的子代理”。它们不会获得与同级代理相同的跨代理协调能力,不能向其他代理发送消息或生成额外代理。Sol 的编排工具仍然可用,父模型仍负责将工作分解、发出指令并收集结果。
这种区分对于可靠性很重要。Provencher 表示,Luna 工作器最适合具有明确起始提示的简单、有限的工作。他建议在工作器不需要父会话时使用 fork_turns: none,并确保其初始指令包含完成任务所需的一切。
这种设置让开发者可以在需要广泛上下文来做决定时使用 Sol,同时将机械实现、搜索或其他孤立工作保留给 Luna。父模型仍然对组装结果负责,而不是允许不断扩展的工作器树自行协调。
Provencher 表示,用户在更新应用后无需额外配置即可使用该功能,尽管 Codex 应用可能在对应的版本号上有所滞后才能收到该功能。目前用户必须提示 Codex 以这种方式路由工作。默认行为仍然会使用父模型、推理强度和上下文分叉设置来生成副本。
该默认设置有助于限制意外的行为变化,但也意味着成本上的好处并非自动实现。除非提示告知协调者选择不同的模型和推理级别,否则 Sol 会话将继续创建 Sol 工作器。
该发布弥补了明显的路由缺口
跨模型委派解决了 Codex 用户在整个七月记录的一个限制。在一条 于 7月22日 提交的 GitHub issue 中,一位运行 Codex CLI 0.145.0 的用户报告称 Multi Agents v2 接受 Sol 和 Terra 子代理,但将 Luna 视为未知模型而拒绝。另一条关于生成架构的 issue 发现运行时可以接受 model 和 reasoning-effort 字段,即使这些控制项在呈现给父代理的工具定义中并不存在。
这些失败削弱了多模型编排的主要经济论点。如果每个工作器都继承最有能力的父模型,简单任务就会消耗与规划和调试相同的模型层级。暴露模型和推理强度选择让协调者可以按任务分配能力。
Provencher 表示,OpenAI 在使路由可靠方面花了额外时间。他还建议不要运行超过六到八个子代理,将实际上限设在常见演示中使用的大规模群体之下。
据 Provencher 所述,Codex 现有的默认配置仍然是 OpenAI 评估中表现更高的选项:父模型会使用相同的模型、推理强度和分叉的上下文来创建工作器。他表示那种配置运行更慢并消耗更多 token。新的路由为开发者提供了第二种运行模式,围绕专业化和明确的预算构建。
适用范围仍限于 OpenAI 支持的 Codex 模型。Provencher 的公告并未建立跨外部模型提供商的一般性路由。不过在 GPT-5.6 家族内,Codex 现在可以将制定计划的模型与执行计划的模型分开,使模型选择成为一种编排决策,而非会话范围的设置。