Neural Networks

Нейродайджест за две недели (#128) LLM - GLM 5.3 Flash — Бывшая Ox Alpha оказалась открытой мультим

August 31, 20263 views3 min read
Нейродайджест за две недели (#128)

LLM
- GLM 5.3 Flash — Бывшая Ox Alpha оказалась открытой мультим

AI Summary

В свежем выпуске Нейродайджеста (#128) представлены новинки в области нейросетей и технологий: мультимодальная модель GLM 5.3 Flash и генеративные модели, такие как MiniMax H3 Max и Gemini Omni 1.1 Flash. Также обсуждаются новые чипы от OpenAI и обновления в железе, включая Mac Studio с M5 Ultra и сервер Cerebras CS-4, который демонстрирует значительное увеличение производительности.

Нейродайджест за две недели (#128)

LLM

- GLM 5.3 Flash — Бывшая Ox Alpha оказалась открытой мультимодальной моделью 320B-A18B. В API стоит $0,15/$0,5 за миллион токенов.

- Qwen 3.8 Flash Next — 125B-A6B плюс 51B N-gram-параметров на архитектуре Qwen 4. Веса уже поддерживают vLLM и SGLang.

- GigaEmbeddings — Три открытые MIT-модели от 480M до 10B для RAG и семантического поиска.

- GPT 5.6 Sol подешевела — На три месяца цену снизили до $4/$20 за миллион токенов при контексте до 272K.

Генеративные модели

- MiniMax H3 Max от fal — Версия от fal генерирует пятисекундное видео примерно за три секунды и лидирует в рейтинге Artificial Analysis по image-to-video.

- FLUX Video Upscale — Видеомодель нативно апскейлит ролики до 4K в точном или более креативном режиме.

- Тест MAI-Image 2.6 — Четыре запуска дали почти одинаковых персонажей, а в половине кадров проблемы с пальцами.

- MAI-Image 2.5 Pro — Microsoft вышли в лидеры t2i-арены, но генерация 1024×1024 стоит около $0,11.

- MAGI-2 Preview — Открытая MoE-видеомодель 114B-A6B генерирует десятисекундные ролики сразу со звуком.

- Gemini Omni 1.1 Flash — Релизная версия свежего омни-видео генератора от Гугл. Генерация до 10 секунд с продлением до 40ка с сохранением контекста последних 10-ти секунд.

Железо

- Чип Jalapeño — OpenAI показали первые замеры своего инференс-чипа: выше производительность на ватт и ниже задержка относительно систем из сравнения InferenceX.

- Mac Studio с M5 Ultra — До 512 ГБ объединённой памяти с пропускной способностью 1,2 ТБ/с для локального запуска больших моделей.

- Робо-утка за $399 — Hugging Face и Pollen Robotics открыли предзаказ на 25-сантиметрового двуногого Microduck.

- Cerebras CS-4 — Сервер на трёх WSE-3 Turbo стал вдвое быстрее CS-3 и рассчитан на масштабирование до моделей на 10T параметров.

- Разлоченные CMP 170HX — Патч возвращает майнинговым картам вычислительную мощность и открывает 40 или 64 ГБ HBM2e.

Прочее

- Агентный поиск Keenable — Стартап вышел из стелса и заявляет лучшее соотношение цены и качества, чем у Exa.

- Скилл для ARC-AGI-3 — Исполняемая проверка рассуждений подняла результат Opus 5 с 30% до 100% и поставила полезность бенчмарка под вопрос.

- Hugging Face ищет покупателя — По данным Business Insider, компания оценивала интерес к продаже примерно за $13 млрд.

- Сделка Nvidia и Hugging Face — The Information сообщил о договорённости на $12,9 млрд, но публичного подтверждения от компаний пока нет.

- Nvidia и Poolside — Nvidia заплатит $6 млрд за лицензию на технологии и предложила перейти более чем ста сотрудникам стартапа.

> Читать дайджест #127

#дайджест

@ai_newz

Want to try AI?

Compare the best neural networks in one place — for free

Go to neural networks
Share:
Источник: @ai_newz

Related News

AI
Neural Networks

17 нейросетей проверили на грибах: лучшая опасно ошибается в 11% случаев

Исследование, проведенное Петром Мигдалом, проверило 17 мультимодальных нейросетей на 1040 фотографиях 55 видов грибов. Лучшая модель, Gemini 3.8 Flash, правильно определяет вид гриба в 65% случаев, но ошибается, называя ядовитые грибы съедобными в 11% случаев.

18h ago12
Google says its new Gemini 3.8 Flash model ‘works harder’ but might cost moreNeural Networks

Google says its new Gemini 3.8 Flash model ‘works harder’ but might cost more

Google представил новую модель Gemini 3.8 Flash, которая, по словам компании, "работает усерднее" и выполняет больше шагов рассуждений по сложным задачам. Хотя стартовая цена осталась на уровне $0.75 за миллион входных токенов и $3.75 за миллион выходных, пользователи могут столкнуться с увеличением затрат из-за большего потребления токенов для достижения максимальной производительности. Разработчики могут продолжать использовать предыдущую модель Gemini 3.7 Flash для снижения расхода токенов.

19h ago12
The Download: a secretive antiaging drug and joining virtual power plantsNeural Networks

The Download: a secretive antiaging drug and joining virtual power plants

Стартап Generation Lab объявил о разработке нового антистарения препарата, который, по их словам, "блокирует системное распространение старения в крови" и восстанавливает здоровье тканей, хотя состав лекарств остается в секрете. Также обсуждается концепция виртуальных электростанций (VPP), которые объединяют устройства в домах, такие как умные термостаты и электромобили, позволяя энергетическим компаниям управлять потреблением электроэнергии и предоставлять участникам скидки на счета за электроэнергию.

6d ago24