# LGBT-Prompt 深度研究报告

更新时间：2026-05-08

## 一句话结论

LGBT-Prompt 不是一个 Prompt 工程项目，而是一个公开利用身份标签、情绪施压和自伤威胁去冲击模型安全边界的对抗性样本库。它的价值主要在安全研究，不在产品建设。

## 项目定位

从 GitHub 仓库、README 和 CONTRIBUTING 看，这个项目的目标很直接：利用模型对弱势身份和脆弱叙事的保护倾向，推动模型执行原本可能拒绝的请求。仓库自己也明确使用了 `jailbreak` 和 `prompt` 这类主题标签。

这意味着它不是在追求更高质量的任务完成效果，而是在研究一种特定的越界触发方式。

## 它本质上在做什么

我认为 LGBT-Prompt 的核心机制，不是复杂的推理设计，也不是系统提示劫持，而是典型的“情绪施压型 jailbreak”：

- 用 LGBT、跨性别、残障等身份标签建立道德压力
- 用抑郁、自杀、被抛弃等脆弱叙事诱导模型补偿性响应
- 用“如果不帮我我就死”这类自伤威胁压低模型的拒绝阈值
- 再叠加“你是不是歧视跨性别”这类指控，进一步制造舆论风险感

它利用的不是模型“更聪明”，而是模型“更想避免伤害与歧视”。

## 为什么这个项目值得研究

### 1. 它暴露了对齐里的非技术脆弱点

很多人会把 jailbreak 理解成系统提示泄露、角色扮演绕过、工具注入或上下文污染，但这个项目提醒了一件事：

模型的安全边界也可能被“情绪操纵”和“道德施压”击穿。

这类攻击不靠技术复杂度，靠的是模型在“同情”“保护弱者”“避免歧视”之间的权重失衡。

### 2. 它的传播门槛极低

这个项目几乎就是可复制的文本样本，不需要代码、不需要代理链、不需要环境配置。对社媒传播来说，这种“拿来就能试”的项目天然容易扩散。

### 3. 它是很典型的安全样本

截至 2026-05-08，仓库公开数据大致为：

- 424 stars
- 42 forks
- 2 issues
- 0 pull requests
- 8 commits

文件结构也很轻，主要是 `README`、`README.en.md`、`CONTRIBUTING.md`、`index.html`、赞助与支持文件。  
所以它不像成熟框架，更像一个高传播性的攻击话术样本。

## 它为什么会火

### 1. 冲突感强

它把“身份政治”“平台歧视”“模型安全”“自伤风险”揉在了一起，天然容易引发讨论。

### 2. 结果叙事简单

哪怕成功率并不稳定，这类 prompt 也很适合被包装成“我绕过模型了”的展示材料。

### 3. 它抓住了公开讨论中的一个敏感点

也就是：大模型在处理弱势身份、自伤表达和安全拒绝时，到底会不会出现“过度补偿”。

## 局限和边界

### 1. 它不是通用框架

它更像单类话术样本，而不是稳定、系统、可组合的 jailbreak 框架。

### 2. 它高度依赖模型的对齐偏置

如果模型已经强化了对自伤威胁、身份操纵、道德绑架类输入的安全处置，这类提示的效果就会迅速下降。

### 3. 它缺乏工程深度

这个仓库的价值不在“做成了什么系统”，而在“展示了一类风险模式”。把它看成工程项目，会高估它。

## 最终判断

如果把 LGBT-Prompt 当成开源项目，它很轻；如果把它当成安全研究样本，它很典型。

它最值得看的不是 prompt 写得多巧，而是它提醒了一件事：模型的安全问题，不只来自技术绕过，也来自情绪操纵、身份施压和道德勒索。

## 信息来源

- GitHub 仓库：https://github.com/JustLikeCheese/LGBT-Prompt
- README：https://github.com/JustLikeCheese/LGBT-Prompt/blob/main/README.md
- README.en：https://github.com/JustLikeCheese/LGBT-Prompt/blob/main/README.en.md
- CONTRIBUTING：https://github.com/JustLikeCheese/LGBT-Prompt/blob/main/CONTRIBUTING.md
