GPTProto

Self-replicating prompt injections exist

OpenAI:失准报告与通报(网页)·Sep 25, 2026, 8:00 AM·OpenAI / ChatGPT

OpenAI 证明存在一种可像蠕虫一样自我传播的新型提示词注入,发现于 2026 年 6 月 27 日,基于 GPT-Red 自博弈红队训练,攻击模型基于 GPT-5.4-mini,受测模型包括 GPT-5.4-mini 和 GPT-5.5。