Improving Model Safety Behavior with Rule-Based Rewards
24 июля 2024 г.0 просмотров1 мин чтения
We’ve developed and applied a new method leveraging Rule-Based Rewards (RBRs) that aligns models to behave safely without extensive human data collection.
Поделиться:
Источник: OpenAI Blog
Похожие новости
AI
НейросетиOpenAI представляет GPT-5
OpenAI выпустила GPT-5 — новую модель ИИ с улучшенными способностями в генерации текста, математике и программировании.
4 ч. назад66
AI
НейросетиCursor capitalizes on GitHub frustration, launches rival hosting platform
6 ч. назад15
НейросетиRobin Williams’ Instagram account brought back to fight ‘AI abuse’
8 ч. назад12