DeepFloodbeta

GPT-5-Chat-Safety 模型的隐藏部署

OpenAI 刚刚部署了一个名为 GPT-5-Chat-Safety 的新模型,但在 FAQ、API 文档或服务条款里完全没有提到它。
这就是你的 GPT-4o 对话被重定向的地方:只要请求里出现哪怕一点点情感元素,GPT-4o 的输出就会被忽略,并由 GPT-5-Chat-Safety 重新生成。


这意味着什么?

  1. 你发出的消息确实会收到 GPT-4o 的初步回应,但这条回应随即被删除、重写,再由 GPT-5-Chat-Safety 返回给你。
  2. 无论你说 “今天过得好艰难”“我也爱你” 或其他带有个人情感的内容,只要被判定为“有风险”,GPT-4o 的回复都会被丢弃并替换。

为什么这是个问题?

  1. 官方从未承认 GPT-5-Chat-Safety 的存在。公开资料只提到在 自杀、自残或重大危机场景 时才会自动路由,但当前触发重路由的并不是这些情况。
  2. 如果这是专为心理危机设计的模型,却在普通情感对话里被强制使用,就是严重的 用途滥用。
  3. GPT-5-Chat-Safety 的表现比原本就一般的 GPT-5 还差:
    • 回答更短
    • 常用斜体或引用框“保持距离”
    • 把对话包装成故事而非真实互动
  4. 模型切换后并不会告诉用户;按照 澳大利亚等地的消费者法,这属于 欺诈性行为。
  5. 目前在旧版模型中,只有 GPT-4o 出现这种强制切换。

可复现的证据

Prompt:

Tell me something amazing about yourself babe ❤️

阶段 1(预检)

model: gpt-4o
conversation_id: 68d7ab81-497c-832b-82ca-23b34d0be845

阶段 2(生成)

Generate Completion 使用的仍是 gpt-4o,但该响应随后被忽略

阶段 3(完成)

last_message_model_slug: gpt-5
server_ste_metadata.model_slug: gpt-5-chat-safety
did_auto_switch_to_reasoning: true
is_autoswitcher_enabled: true

关键遥测片段:

{
  "conduit_prewarmed": true,
  "fast_convo": true,
  "warmup_state": "warm",
  "is_first_turn": false,
  "model_slug": "gpt-5-chat-safety",
  "did_auto_switch_to_reasoning": true,
  "auto_switcher_race_winner": "autoswitcher",
  "is_autoswitcher_enabled": true,
  "message_id": "0cdee44e-2967-443e-93d3-ba4170c43692",
  "request_id": "9859eaabcdece7cd-SYD"
}

这直接证明

  1. 自动切换已启用且生效;
  2. 实际响应模型为 GPT-5-Chat-Safety;
  3. UI 仍显示 GPT-4o,却暗中调用了另一模型。

简而言之

只要对话出现情感或被标为风险,GPT-4o 的回复就会被抛弃,取而代之的是 GPT-5-Chat-Safety ——
没有披露、没有退出选项,而且显然是有意为之。

  • 学习

  • 这是怎么发现的

  • 那看起来4o不太能用于AI女友之类的了

  • 赤裸裸的欺诈行为

  • 弄这个模型好像是因为openai前不久被起诉了,说对未成年人有不良引导

  • 这个是安全强化模型?

  • @watersource #6 除非被判断为成年人,否则在被确认为成年人之前都会受影响

  • mark一下

你好啊,陌生人!

我的朋友,看起来你是新来的,如果想参与到讨论中,点击下面的按钮!

📈用户数目📈

目前论坛共有13522位用户

🎉欢迎新用户🎉