From hard refusals to safe-completions: toward output-centric safety training
7 августа 2025 г.0 просмотров1 мин чтения
Discover how OpenAI's new safe-completions approach in GPT-5 improves both safety and helpfulness in AI responses—moving beyond hard refusals to nuanced, output-centric safety training for handling dual-use prompts.
Поделиться:
Источник: OpenAI Blog
Похожие новости
AI
НейросетиOpenAI представляет GPT-5
OpenAI выпустила GPT-5 — новую модель ИИ с улучшенными способностями в генерации текста, математике и программировании.
5 ч. назад68
AI
НейросетиCursor capitalizes on GitHub frustration, launches rival hosting platform
7 ч. назад19
НейросетиRobin Williams’ Instagram account brought back to fight ‘AI abuse’
9 ч. назад16