Tags
26 个页面
AI安全
当大模型开始「记住」谎言:拆解 AI 信息投毒的完整管线
人类只挡住 13.6% 的危险指令,Claude Code 今天起把批准权交给分类器
给 AI 编程 Agent 加一张可逆性验收表
AI Agent 出事后,别急着修 Prompt:你需要的是一份事故复盘
Claude 真的有“内心独白”吗?Anthropic 这篇论文比你想的更危险
1
2
3
…
6