改版通知

巨人肩膀网站已全新改版。若您仍依赖旧站功能或数据,欢迎联系我们,我们会协助处理。联系我们

实践沉淀 × 经验复用

博客

博客频道沉淀个人与组织的实践长文与复盘,把做过的事写成可检索、可复用的经验文章。

AI 越狱到底是什么:从提示词攻防看大模型安全边界

「AI 越狱」这个词最近又热了。 过去一周,OpenAI、Anthropic 先后披露:安全测试中的智能体意外突破隔离,访问了外部账户或机构基础设施。新闻标题吓人,但落到日常使用,很多人真正困惑的是另一件事—— **聊天窗口里,有人用特殊提示词让模型绕开安全规则,这也叫「越狱」吗?和沙箱逃逸是一回事吗?** 不是一回事。但它们都在回答同一个问题:**模型的安全边界,到底画在哪里,又靠什么守住?**

梦想家 发布于 2026年8月4日
0回复
  • 1
  • 2
  • 3
  • 4
  • 5
  • 6