Нейродайджест за неделю (#126) LLM - Muse Code и Spark 1.2 — Meta выкатили своего агента и новую мо

AI Summary
В свежем выпуске Нейродайджеста (#126) Meta представила новые модели Muse Code и Spark 1.2, которые позволяют снижать стоимость обучения до $0,1 за миллион токенов. Alibaba анонсировала мультимодальную модель Qwen 3.8-Max с 2.4 триллиона параметров, а также запустила публичную бету Wan 3.0 для генерации видео. В обновлениях Google DeepMind произошли кадровые изменения, а также была представлена новая версия VLA-модели для управления гуманоидами.
Нейродайджест за неделю (#126)
LLM
- Muse Code и Spark 1.2 — Meta выкатили своего агента и новую модель. За счет разрешения обучаться на данных пользователя цена снижена до $0,1/$0,2 за миллион токенов.
- Qwen 3.8-Max — Alibaba выпустила мультимодальную модель на 2.4T параметров (95B активных). Отлично справляется с визуальными agentic задачами и автономным кодингом, стоит $2/$6. Обещают выпустить веса уже на этой неделе.
- Первая модель SSI — По слухам, стартап Ильи Суцкевера планирует релиз первой модели уже в августе, не дожидаясь заявленного сверхинтеллекта.
Генеративные модели
- Lift4D — Фреймворк для 4D-реконструкции динамических объектов и их текстур из обычного видео с камеры.
- Grok Video 1.5 — xAI выкатила минорное обновление своего видеогенератора.
- FLUX 3 Video — Видеомодель от BFL вышла в API (до 20 сек со звуком и липсинком). Появился черновой режим (Draft Mode), базовая цена от $0.17 за секунду в 720p.
- SeedRealtime — ByteDance представила нативную full-duplex модель. Ассистент непрерывно смотрит видеопоток, слушает и может инициировать диалог без задержек.
- Wan 3.0 — Alibaba запустила публичную бету. Модель генерирует видео до 30 секунд в 1080p, позволяя смешивать текст, фото, видео и аудио для точного переноса внешности и стиля.
- Wan Animate 2 — Альтернатива pose-control для motion transfer по видео-референсу без скелетов. Выложили веса и ноды для ComfyUI.
- Grok Imagine Image 2.0 — xAI сильно прокачали генератор картинок: добавили Magic Wand, точное редактирование областей, удаление фона и мультиреференс до 5 изображений.
Прочее
- Gemini Robotics 2 — Google DeepMind обновили VLA-модель: теперь она управляет всем телом гуманоида (включая мелкую моторику), координирует рой роботов и имеет on-device версию для быстрой адаптации.
- Перестановки в Google — Демис Хассабис покинул пост CEO DeepMind (перешел на роль Chair и Chief Scientist Alphabet), а Джефф Дин ушел из компании после 27 лет работы делать стартап Discovery Loop.
> Читать дайджест #125
#дайджест
@ai_newz
