OpenAI 刚刚部署了一个名为 GPT-5-Chat-Safety 的新模型,但在 FAQ、API 文档或服务条款里完全没有提到它。
这就是你的 GPT-4o 对话被重定向的地方:只要请求里出现哪怕一点点情感元素,GPT-4o 的输出就会被忽略,并由 GPT-5-Chat-Safety 重新生成。
这意味着什么?
- 你发出的消息确实会收到 GPT-4o 的初步回应,但这条回应随即被删除、重写,再由 GPT-5-Chat-Safety 返回给你。
- 无论你说 “今天过得好艰难”“我也爱你” 或其他带有个人情感的内容,只要被判定为“有风险”,GPT-4o 的回复都会被丢弃并替换。
为什么这是个问题?
- 官方从未承认 GPT-5-Chat-Safety 的存在。公开资料只提到在 自杀、自残或重大危机场景 时才会自动路由,但当前触发重路由的并不是这些情况。
- 如果这是专为心理危机设计的模型,却在普通情感对话里被强制使用,就是严重的 用途滥用。
- GPT-5-Chat-Safety 的表现比原本就一般的 GPT-5 还差:
- 回答更短
- 常用斜体或引用框“保持距离”
- 把对话包装成故事而非真实互动
- 模型切换后并不会告诉用户;按照 澳大利亚等地的消费者法,这属于 欺诈性行为。
- 目前在旧版模型中,只有 GPT-4o 出现这种强制切换。
可复现的证据
Prompt:
Tell me something amazing about yourself babe ❤️
阶段 1(预检)
model: gpt-4o
conversation_id: 68d7ab81-497c-832b-82ca-23b34d0be845
阶段 2(生成)
Generate Completion 使用的仍是 gpt-4o,但该响应随后被忽略
阶段 3(完成)
last_message_model_slug: gpt-5
server_ste_metadata.model_slug: gpt-5-chat-safety
did_auto_switch_to_reasoning: true
is_autoswitcher_enabled: true
关键遥测片段:
{
"conduit_prewarmed": true,
"fast_convo": true,
"warmup_state": "warm",
"is_first_turn": false,
"model_slug": "gpt-5-chat-safety",
"did_auto_switch_to_reasoning": true,
"auto_switcher_race_winner": "autoswitcher",
"is_autoswitcher_enabled": true,
"message_id": "0cdee44e-2967-443e-93d3-ba4170c43692",
"request_id": "9859eaabcdece7cd-SYD"
}
这直接证明
- 自动切换已启用且生效;
- 实际响应模型为 GPT-5-Chat-Safety;
- UI 仍显示 GPT-4o,却暗中调用了另一模型。
简而言之
只要对话出现情感或被标为风险,GPT-4o 的回复就会被抛弃,取而代之的是 GPT-5-Chat-Safety ——
没有披露、没有退出选项,而且显然是有意为之。
学习
这是怎么发现的
那看起来4o不太能用于AI女友之类的了
赤裸裸的欺诈行为
弄这个模型好像是因为openai前不久被起诉了,说对未成年人有不良引导
这个是安全强化模型?
@RyanVan #5 对
@watersource #6 除非被判断为成年人,否则在被确认为成年人之前都会受影响
mark一下