2026年4月,Z.ai 发布 GLM-5.1,SWE-bench Pro 评分 58.4,超越 Claude Opus 4.6(57.3)、GPT-5.4(57.7)登顶全球榜首。这是国产开源模型首次在软件工程核心基准上击败所有顶尖闭源模型——但这场胜利比你想象的更复杂。
用户发现Claude Opus 4.6推理深度骤降67%,而Anthropic选择沉默。这不是第一次,也不会是最后次。当你付费订阅一个AI模型,你有权知道它被悄悄改变了吗?
4月4日正午,Anthropic宣布Claude订阅不再覆盖OpenClaw。这不是一次定价调整,而是AI平台时代"围墙花园"战争的第一枪。本文算清影响成本、梳理双方立场、拆解深层逻辑,并给出三条可行的应对路径。
Google 于 4 月 2 日发布 Gemma 4,31B 参数版本跻身全球开源模型第三名,26B MoE 版本推理时只激活 3.8B 参数却有 26B 的性能。本文带你看懂 Per-Layer Embeddings 这个核心架构创新,以及怎么在本地跑起来。
Reddit 8900 赞实验复现:通过一个 System Prompt,让 Claude 只说关键词,省掉 3/4 的输出 Token。附 3 个延伸技巧,Claude Code 和 API 用户都能用。