【ChatGPT开始识别“逐渐出现的风险信号”】
5月14日,OpenAI介绍了 ChatGPT 在敏感对话中的安全更新:模型不只看单条消息,还会结合一段对话中逐渐出现的风险线索,特别是自伤和伤害他人场景。内部评估中,长对话里的安全响应在自杀和自伤场景提升50%,在跨多轮对话的 GPT-5.5 Instant 上,自杀和自伤场景提升39%,伤害他人场景提升52%。AI已经从理解单句风险过渡到理解上下文风险。
参考文献:Helping ChatGPT better recognize context in sensitive conversations, OpenAI blog, 2026.5.24
#人工智能##ai创造营#
发布于 重庆
