Tags
37 个页面
Anthropic
人类只挡住 13.6% 的危险指令,Claude Code 今天起把批准权交给分类器
Anthropic 不支持封杀开放权重:真正的分界线是能力阈值
Claude 真的有“内心独白”吗?Anthropic 这篇论文比你想的更危险
看不见的水印:Claude Code 被发现在请求里悄悄打标记,开发者工具的信任边界在哪
Claude Sonnet 5 不是“更强模型”,而是 Agent 成本层的重新定价
1
2
…
8