Нейросети

Нейродайджест за две недели (#128) LLM - GLM 5.3 Flash — Бывшая Ox Alpha оказалась открытой мультим

31 августа 2026 г.1 просмотров3 мин чтения
Нейродайджест за две недели (#128)

LLM
- GLM 5.3 Flash — Бывшая Ox Alpha оказалась открытой мультим

AI Summary

В свежем выпуске Нейродайджеста (#128) представлены новинки в области нейросетей и технологий: мультимодальная модель GLM 5.3 Flash и генеративные модели, такие как MiniMax H3 Max и Gemini Omni 1.1 Flash. Также обсуждаются новые чипы от OpenAI и обновления в железе, включая Mac Studio с M5 Ultra и сервер Cerebras CS-4, который демонстрирует значительное увеличение производительности.

Нейродайджест за две недели (#128)

LLM

- GLM 5.3 Flash — Бывшая Ox Alpha оказалась открытой мультимодальной моделью 320B-A18B. В API стоит $0,15/$0,5 за миллион токенов.

- Qwen 3.8 Flash Next — 125B-A6B плюс 51B N-gram-параметров на архитектуре Qwen 4. Веса уже поддерживают vLLM и SGLang.

- GigaEmbeddings — Три открытые MIT-модели от 480M до 10B для RAG и семантического поиска.

- GPT 5.6 Sol подешевела — На три месяца цену снизили до $4/$20 за миллион токенов при контексте до 272K.

Генеративные модели

- MiniMax H3 Max от fal — Версия от fal генерирует пятисекундное видео примерно за три секунды и лидирует в рейтинге Artificial Analysis по image-to-video.

- FLUX Video Upscale — Видеомодель нативно апскейлит ролики до 4K в точном или более креативном режиме.

- Тест MAI-Image 2.6 — Четыре запуска дали почти одинаковых персонажей, а в половине кадров проблемы с пальцами.

- MAI-Image 2.5 Pro — Microsoft вышли в лидеры t2i-арены, но генерация 1024×1024 стоит около $0,11.

- MAGI-2 Preview — Открытая MoE-видеомодель 114B-A6B генерирует десятисекундные ролики сразу со звуком.

- Gemini Omni 1.1 Flash — Релизная версия свежего омни-видео генератора от Гугл. Генерация до 10 секунд с продлением до 40ка с сохранением контекста последних 10-ти секунд.

Железо

- Чип Jalapeño — OpenAI показали первые замеры своего инференс-чипа: выше производительность на ватт и ниже задержка относительно систем из сравнения InferenceX.

- Mac Studio с M5 Ultra — До 512 ГБ объединённой памяти с пропускной способностью 1,2 ТБ/с для локального запуска больших моделей.

- Робо-утка за $399 — Hugging Face и Pollen Robotics открыли предзаказ на 25-сантиметрового двуногого Microduck.

- Cerebras CS-4 — Сервер на трёх WSE-3 Turbo стал вдвое быстрее CS-3 и рассчитан на масштабирование до моделей на 10T параметров.

- Разлоченные CMP 170HX — Патч возвращает майнинговым картам вычислительную мощность и открывает 40 или 64 ГБ HBM2e.

Прочее

- Агентный поиск Keenable — Стартап вышел из стелса и заявляет лучшее соотношение цены и качества, чем у Exa.

- Скилл для ARC-AGI-3 — Исполняемая проверка рассуждений подняла результат Opus 5 с 30% до 100% и поставила полезность бенчмарка под вопрос.

- Hugging Face ищет покупателя — По данным Business Insider, компания оценивала интерес к продаже примерно за $13 млрд.

- Сделка Nvidia и Hugging Face — The Information сообщил о договорённости на $12,9 млрд, но публичного подтверждения от компаний пока нет.

- Nvidia и Poolside — Nvidia заплатит $6 млрд за лицензию на технологии и предложила перейти более чем ста сотрудникам стартапа.

> Читать дайджест #127

#дайджест

@ai_newz

Хотите попробовать AI?

Сравните лучшие нейросети в одном месте — бесплатно

Перейти к нейросетям
Поделиться:
Источник: @ai_newz

Похожие новости

AI
Нейросети

17 нейросетей проверили на грибах: лучшая опасно ошибается в 11% случаев

Исследование, проведенное Петром Мигдалом, проверило 17 мультимодальных нейросетей на 1040 фотографиях 55 видов грибов. Лучшая модель, Gemini 3.8 Flash, правильно определяет вид гриба в 65% случаев, но ошибается, называя ядовитые грибы съедобными в 11% случаев.

18 ч. назад12
Google говорит, что новая модель Gemini 3.8 Flash «работает усерднее», но может стоить дороже.Нейросети

Google говорит, что новая модель Gemini 3.8 Flash «работает усерднее», но может стоить дороже.

Google представил новую модель Gemini 3.8 Flash, которая, по словам компании, "работает усерднее" и выполняет больше шагов рассуждений по сложным задачам. Хотя стартовая цена осталась на уровне $0.75 за миллион входных токенов и $3.75 за миллион выходных, пользователи могут столкнуться с увеличением затрат из-за большего потребления токенов для достижения максимальной производительности. Разработчики могут продолжать использовать предыдущую модель Gemini 3.7 Flash для снижения расхода токенов.

19 ч. назад12
Загрузка: секретное антистареющее средство и присоединение к виртуальным электростанциямНейросети

Загрузка: секретное антистареющее средство и присоединение к виртуальным электростанциям

Стартап Generation Lab объявил о разработке нового антистарения препарата, который, по их словам, "блокирует системное распространение старения в крови" и восстанавливает здоровье тканей, хотя состав лекарств остается в секрете. Также обсуждается концепция виртуальных электростанций (VPP), которые объединяют устройства в домах, такие как умные термостаты и электромобили, позволяя энергетическим компаниям управлять потреблением электроэнергии и предоставлять участникам скидки на счета за электроэнергию.

6 дн. назад24