我的开源项目:一套中文提示注入攻防工具链
上一篇做了自我介绍,这篇介绍我这一年主要在维护的东西:一套围绕 LLM 提示注入(Prompt Injection) 的开源工具链。它们不是五个孤立的小玩具,而是互相咬合的一条链:语料 → 攻 → 判 → 守。 先上全家福: 项目 一句话定位 链上的位置 prompt-corpus-zh 中文提示注入攻击语料库 语料层 InjectArena 中文可自部署的提示注入攻防闯关靶场 攻 injectarena-judge 确定性判分引擎 判 prompt-audit AI 层安全审计与回归门禁 守 bounty-guard AI 代码安全审查助手 守(代码侧) 起点一:中文语料几乎是空白(prompt-corpus-zh)做提示注入研究时最先撞上的墙不是技术,是语料:chinese prompt injection 相关的公开语料几乎一片空白,英文数据集倒是不少,但中文的人设、话术、绕过习惯完全不同。 于是有了 prompt-corpus-zh:中文提示注入攻击语料的独立资产层,npm 包和 HuggingFace dataset 同步发布,代码 MI...
你好,我是 Croesus
大家好,我是 Croesus,欢迎来到「乌托邦」。 我是谁一名安全方向的学习者,目前在折腾的主线是 LLM 安全,尤其是提示词注入(Prompt Injection)——让 AI 说它不该说的话、交出它不该交出的东西,以及怎么防住这些事。平时也会打打 CTF 练手。 除了安全,我还有几个”歪门邪道”的小工具项目,后面会慢慢写文章介绍。 为什么要写博客三个很朴素的理由: 输出倒逼输入。学过的东西,能讲清楚才算真的懂;写不出来就说明还没吃透。 给未来的自己看。踩过的坑当时记得再清楚,三个月后也会忘得一干二净,笔记是最便宜的时间旅行。 给同路人一点参考。我踩坑的时候靠别人的文章救命,也该留点东西给下一个踩同样坑的人。 这个博客会写什么 学习笔记:安全、开发,学到哪写到哪; 项目复盘:我在 GitHub 上维护着一套开源小项目(提示注入靶场、安全审计工具这些),它们的设计思路、踩过的坑,值得单独开文章讲; 踩坑记录:环境配置、部署报错、奇怪 bug,顺手记下来,方便自己也能帮到别人。 顺便一提这个博客本身也是个练手作品:Hexo + Butterfly 主题,部署在 Cloudfl...