2026-04-16 大模型一周新闻
一周结论
2026-04-10 到 2026-04-16 这一周,行业焦点从“更强通用聊天”转向“高风险专用能力”:Anthropic 的 Claude Mythos/Project Glasswing 将前沿模型直接推到网络安全攻防场景,Claude Opus 4.7 则成为更可公开使用的过渡版本。
重点新闻
Anthropic:Claude Mythos 继续发酵,Opus 4.7 公开发布
- Claude Mythos Preview 在 4 月初面向少数安全机构和科技公司开放,重点用于发现和修复关键软件漏洞。
- 2026-04-16,Anthropic 发布 Claude Opus 4.7,媒体称其在软件工程、图像分辨率和内容质量上较 Opus 4.6 有提升,但能力弱于受限的 Mythos。
- Opus 4.7 被视作 Anthropic 为未来“更强 cyber 模型”建立安全防护和真实部署经验的一步。
风险
Mythos 这类模型的核心争议不是“能不能写代码”,而是能否端到端发现、利用或修复复杂漏洞。企业内部使用 Coding Agent 时,需要把权限、审计、数据边界和出网策略纳入采购评估。
参考:
- Barron’s - Anthropic’s New Claude Update Brings Mythos Model Closer to Wider Release
- Claude language model - Wikipedia
开源模型:Gemma 4、GLM-5.1 延续低成本竞争
- Google 在 4 月初发布 Gemma 4,强调推理与 agentic workflow。
- Z.ai/智谱的 GLM-5.1 被多家技术媒体拿来和 Claude、GPT 系列的编码与长任务能力比较,继续强化“中国开源/开放权重模型压低成本”的叙事。
观察
这周开始可以看到两条线并行:闭源头部模型往高风险、高价值任务推进;开源/开放权重模型则继续在成本和部署灵活性上压迫商业闭源模型。
参考: