可靠 Agent 的工程模式
一条可以继续验证的思路
安全与容器化
这里有 2 篇文章,从一个词走向真实工作里的选择;先读懂,再决定要不要使用。
阅读线程开放
2篇札记
阅读方式先找到你卡住的地方,再顺着证据和取舍走
每篇可以独立阅读,也可以沿着这条线程继续。
可靠 Agent 的工程模式无需登录
本页解决的问题
先给结论什么是「安全与容器化」,它会影响哪些 AI 决策?
Anthropic 的安全分类框架:用户滥用 / 模型 Misbehavior / Prompt Injection 本页把相关概念、常见误区和实践文章放在同一条阅读线程里。
判断标准
先判断你卡在定义、选择还是验证,再从下方 2 篇文章中选择最接近的一篇。
下一步
从「三类风险:滥用、失控、外部攻击」开始,读完后用自己的任务复述结论。
常见误区
不要把同一主题下的所有方法当成可互换方案;输入、风险和验收标准变化时,答案也会变化。
这条问题线程