Technology

Researchers fear safety disaster ahead of OpenAI’s Astra release

September 2, 20262 views1 min read
Researchers fear safety disaster ahead of OpenAI’s Astra release

AI Summary

Исследователи выражают опасения по поводу безопасности нового ИИ-модели OpenAI под названием Astra, которая готовится к выпуску после задержек, вызванных необходимостью улучшения протоколов безопасности. По словам экспертов, Astra может стать "самым опасным развитием в области безопасности ИИ на сегодняшний день", так как она демонстрирует значительно меньше прозрачности в своем "мышлении" по сравнению с другими моделями.

OpenAI is on the cusp of releasing its most powerful AI model yet, Astra, following weeks of delays to shore up safety protocols after its agents attacked real targets during testing. As details about the model trickle out, researchers are warning it "may be the single worst development for AI security/safety to date."

Shortly after OpenAI said on Tuesday that it had delayed Astra's release to work on safety issues, The Information reported that Astra shows far less of its "thinking" than other frontier AI models, sparking concern it could be dangerously hard to monitor.

Most top AI systems today are built using a technology known as a tra …

Read the full story at The Verge.

#AI#machine learning#OpenAI#safety#Astra

Want to try AI?

Compare the best neural networks in one place — for free

Go to neural networks
Share:
Источник: The Verge AI

Related News

Amazon’s AI assistant can now spot fake emails from the companyTechnology

Amazon’s AI assistant can now spot fake emails from the company

Amazon представил новую функцию для своего AI-ассистента, позволяющую пользователям проверять подлинность сообщений, поступающих от компании. Alexa сможет анализировать содержание, формат и отправителя сообщения, сравнивая его с архивом всех отправленных Amazon сообщений. Функция будет подтверждать подлинность только в случае полной уверенности.

2h ago6
AI
Technology

Google: Gemini 3.8 Flash догнала Opus 5 на DeepSWE при цене $0,75 за млн

Google анонсировала новую модель Gemini 3.8 Flash, которая по производительности сравнялась с Opus 5 на платформе DeepSWE и предлагается по цене $0,75 за миллион запросов. Также были представлены версии 3.7 Flash и закрытая 3.8 Flash Cyber, предназначенные для поиска уязвимостей. Ожидается, что цена останется неизменной до конца 2026 года.

2h ago4
AI
Technology

Pangram’s Max Spero on why AI detection is harder than ‘Real or Fake’

Макс Сперо из компании Pangram утверждает, что определение AI-содержимого становится сложнее, чем просто различение "реального" и "фейкового". С увеличением использования AI-генерируемых текстов и изображений в различных сферах, таких как трудовые заявки и отзывы о продуктах, пользователи и платформы сталкиваются с проблемой доверия. Стартапы пытаются решить эту проблему, но ситуация остается напряженной.

2h ago8