overfeed.news

From hard refusals to safe-completions: toward output-centric safety training

OpenAI Newsen

1a

Idade

Publicado
Coletado

Discover how OpenAI's new safe-completions approach in GPT-5 improves both safety and helpfulness in AI responses—moving beyond hard refusals to nuanced, output-centric safety training for handling dual-use prompts.

Leia o artigo completo em openai.com

O overfeed.news indexa e aponta. Publicamos um trecho curto — o artigo completo fica em OpenAI News.

Mais de OpenAI News

Entre para seguir esta fonte
From hard refusals to safe-completions: toward output-centric…