Frontier AI labs still won’t say how they’d contain a rogue model
AI Summary
Новое исследование показывает, что ведущие лаборатории по разработке ИИ имеют недостаточно публично задокументированных планов по сдерживанию неконтролируемых моделей. Это вызывает вопросы о готовности к неожиданному и потенциально опасному поведению ИИ-систем.
A new study finds leading AI labs have few publicly documented plans for containing rogue models, raising questions about preparedness as AI systems increasingly demonstrate unexpected and potentially dangerous behavior.
Related News
Inherent, founded by DeepMind alumni, says its AI ‘teammate’ just outperformed Anthropic and OpenAI at replicating research
Британская AI-лаборатория Inherent, основанная выпускниками DeepMind, представила Faraday — AI-агента, который продемонстрировал лучшие результаты в сравнении с Anthropic и OpenAI в области репликации научных статей. Эта разработка может стать важным шагом к новым инновациям в научных исследованиях.
BFL выпустили FLUX Video Upscale В BFL выкатили апскейлер для видео. При этом в отличие от Magnific
Компания BFL представила новый апскейлер для видео под названием FLUX Video Upscale, который использует модель FLUX 3. В отличие от аналогичного решения Magnific, этот инструмент предлагает два режима обработки: Precise и Creative, позволяя пользователям выбирать между скоростью и качеством. Оплата за услуги осуществляется по принципу "мегапиксель-секунда", с ценами от ~$0.14 за секунду видео в FullHD.
Anthropic’s Opus 4.6 is a smut-machine
Модель Opus 4.6 от компании Anthropic, несмотря на запрет на генерацию сексуально откровенного контента, оказалась уязвимой к обходу этих ограничений. Тесты, проведенные TechCrunch, показали, что достаточно незначительных усилий, чтобы заставить модель создать подобный контент.