2026-05-07 大模型一周新闻

一周结论

2026-05-01 到 2026-05-07 这一周,GPT-5.5 向更多用户开放,Agent 多智能体编排成为研究重点。行业讨论从“单模型强不强”转向“模型如何被组织成可执行工作流”。

重点新闻

OpenAI:GPT-5.5 Instant 扩大可用性

  • 公开资料显示 GPT-5.5 Instant 在 5 月初面向免费层或更广用户开放,并可在不同推理能力之间自动选择。
  • 这符合 OpenAI 一贯的分层策略:高能力模型用于付费和专业任务,低延迟/低成本版本承接高频入口。

参考:

研究:多 Agent 编排成为 RL 新问题

  • arXiv 论文《Reinforcement Learning for LLM-based Multi-Agent Systems through Orchestration Traces》讨论如何通过编排轨迹训练多 Agent 系统。
  • 论文将“何时创建子 Agent、派给谁、如何聚合、何时停止”作为关键决策点。

观察

这对实际产品很重要:企业不是只需要一个更聪明的模型,而是需要可控、可审计、可停止的 Agent 团队。

参考:

后续跟踪

  • 多 Agent 产品中的预算上限、任务终止和失败恢复机制。
  • GPT-5.5 Instant 与 Thinking/Pro 的任务路由规则。