Tags
18 个页面
AI安全
AI Agent 出事后,别急着修 Prompt:你需要的是一份事故复盘
Claude 真的有“内心独白”吗?Anthropic 这篇论文比你想的更危险
看不见的水印:Claude Code 被发现在请求里悄悄打标记,开发者工具的信任边界在哪
每个 Agent 一个微虚拟机:forkd 把 AI 沙箱从口号做成了基础设施
OpenAI 开始模拟真实部署:模型发布前,先把未来事故演一遍
1
2
…
4