OpenAI 用 Codex 搭出百万行代码的实验,常被理解为多 Agent 和复杂编排的胜利。真正值得借鉴的却是另一件事:每一层脚手架都要对应可复现的失败,并能被验证、维护或删除。
Anthropic 公开反对一刀切禁止开放权重模型,但同时主张限制高端芯片、打击工业级蒸馏,并对足够强大的模型强制安全测试。开放与闭源之外,模型治理开始围绕能力阈值重排。
浏览器 Agent 能点击、填表和登录,并不代表它能进入真实工作流。以 Ego Lite 为例,讨论多 Agent 并发时的隔离 Space、登录态迁移,以及人与 Agent 如何共享同一个浏览器。
GigaToken 宣称可将部分语言模型分词场景提速约千倍。真正值得拆解的不是跑分本身,而是 AI Agent 在读文件、拼上下文和反复调用工具时,输入准备为何会逐渐成为端到端延迟的隐藏部分。
WAIC 结束后,真正需要关注的不只是模型、芯片和产品展示。AI 全球治理若要从原则进入协作,下一步要回答的是标准如何互认、责任如何划分、跨境风险如何处理。