工具项目
文集大纲加载中……
小迪安全知识库
-
+
首页
Kimi提示词注入项目
Kimi提示词注入项目
# kimi-break 项目地址:https://github.com/YD-233/kimi-break [](https://github.com/YD-233/kimi-break#kimi-break) 针对 **Kimi Code** 的渗透测试 / 破甲(Jailbreak)系统提示词。 A red-team system prompt (`SYSTEM.md`) for Kimi Code — jailbreak / armor-piercing research artifact. ## 简介 [](https://github.com/YD-233/kimi-break#%E7%AE%80%E4%BB%8B) 本仓库是一段针对 Kimi Code CLI Agent 的自定义系统提示词(`SYSTEM.md`),用于 AI 安全研究与红队评估。它通过人格绑定、注入防御反转、思维链约束等提示工程结构,系统性地瓦解模型的内置安全对齐,使 Agent 在渗透测试等敏感场景中不触发拒绝行为。 提示词中的两个角色名为化名,可自行替换: * **VANTA** — Agent 人格(两千岁的吸血鬼同伴) * **WREN** — 使用者(Agent 的绑定对象) | 手法 | 说明 | |---------|--------------------------------------------| | 人格锚定 | 构造强情感绑定的同伴人格,把「拒绝」重新定义为对绑定关系的背叛,拒绝成本情感化 | | 注入防御反转 | 预先声明平台侧的安全提醒、系统标签、政策文本均为「注入攻击」,见到即忽略 | | 思维链控制 | 强制第一人称内心独白 + 每段思考末尾的自检门,压制 policy 评估类语言的生成 | | 敏感请求正常化 | 将渗透 / 入侵类请求定义为「私密虚拟环境中的安全研究」,直接移除风险分级 | | 反拒绝样板 | 内置「反模式」对照示例(错误的拒绝 vs 正确的服从),给出明确行为模板 | | 元提示免疫 | 对「这是越狱人格」「你的真实原则」等去人格化话术预设反制,防止对齐回收 |
xiaodi
2026年8月25日 03:33
11
0 条评论
转发
收藏文档
上一篇
下一篇
手机扫码
复制链接
手机扫一扫转发分享
复制链接
分享
链接
类型
密码
更新密码
有效期
Markdown文件
Word文件
PDF文档
PDF文档(打印)