上周联邦法官刚裁定 Anthropic 黑名单违法,本周五角大楼就把 Starshield 版 Grok 和 ChatGPT Mil 装进了 GenAI.mil 平台,CTO 表态 9 月底完成对 Anthropic 的移除。复盘这次判决与采购现实的时序倒挂,以及军购 AI 市场给供应商留下的新规则。
腾讯 8 月 28 日开源 Hy4 preview,770B 总参数、49B 激活、1M token 上下文,内部盲测以微弱优势领先 GLM 5.3 与 Kimi K3。社区 48 小时内把它从 1.5TB 压到 200GB,还有人翻出它与神秘模型 Ox Alpha 的关联疑云。本文拆解官方成绩单的读法、最值得注意的「模型指挥 Codex 做研究」演示,以及国产开源旗舰的四强格局。
加州联邦法官裁定五角大楼将 Anthropic 列入供应链风险黑名单违反第一修正案,裁决书称国家安全不是报复批评者的空白支票。复盘这场从两条红线、最后通牒到司法翻案的六个月博弈,以及它给 AI 公司与政府关系留下的先例。
同一个模型放进不同的 Agent 运行时,拿到的上下文、工具、权限和验证路径都不一样。模型路由解决“用谁推理”,Harness 路由解决“让它怎样干活”,后者正在成为 AI 编程落地时更容易被忽略的一层。
MCP 官方新路线图罕见承认了协议的规模化失败点:全量暴露上百个工具,模型还没收到任务就要先付上下文成本,工具选择质量还会随列表变长而下降。渐进式发现、长任务事件和委托身份,正在改变企业 Agent 的入口设计。