编码基准登顶、缓存读取降价 75%、护栏误报砍半,Anthropic 把模型升级讲成了一个可靠性工程的故事;而社区先看到的,是限速下调和一张 EU 水印合规账单。
上周联邦法官刚裁定 Anthropic 黑名单违法,本周五角大楼就把 Starshield 版 Grok 和 ChatGPT Mil 装进了 GenAI.mil 平台,CTO 表态 9 月底完成对 Anthropic 的移除。复盘这次判决与采购现实的时序倒挂,以及军购 AI 市场给供应商留下的新规则。
腾讯 8 月 28 日开源 Hy4 preview,770B 总参数、49B 激活、1M token 上下文,内部盲测以微弱优势领先 GLM 5.3 与 Kimi K3。社区 48 小时内把它从 1.5TB 压到 200GB,还有人翻出它与神秘模型 Ox Alpha 的关联疑云。本文拆解官方成绩单的读法、最值得注意的「模型指挥 Codex 做研究」演示,以及国产开源旗舰的四强格局。
加州联邦法官裁定五角大楼将 Anthropic 列入供应链风险黑名单违反第一修正案,裁决书称国家安全不是报复批评者的空白支票。复盘这场从两条红线、最后通牒到司法翻案的六个月博弈,以及它给 AI 公司与政府关系留下的先例。
同一个模型放进不同的 Agent 运行时,拿到的上下文、工具、权限和验证路径都不一样。模型路由解决“用谁推理”,Harness 路由解决“让它怎样干活”,后者正在成为 AI 编程落地时更容易被忽略的一层。