Модели и релизы

NVIDIA представила Alpamayo 2 Super: VLA-модель для автономного вождения MarkTechPost · 05.08.2026 NVIDIA выпустила Alpamayo 2 Super — мультимодальную модель класса Vision-Language-Action (VLA) с 34 млрд параметров, предназначенную для беспилотных такси и систем автономного вождения. Модель распространяется по лицензии OpenMDW-1.1, которая разрешает коммерческое использование, создание производных продуктов и дообучение. Система объединяет возможности рассуждения с генерацией траекторий движения и мета-действий в реальном времени. Релиз Ling 3.0 Flash: открытая модель с архитектурой 124B-A5.1B Hacker News · 05.08.2026 Разработчики представили Ling 3.0 Flash — новую открытую языковую модель с архитектурой 124B-A5.1B. Несмотря на компактный размер активных параметров, модель демонстрирует производительность, сопоставимую с MiniMax M2.7. Релиз ориентирован на создание эффективных решений для задач, требующих баланса между скоростью инференса и качеством генерации текста, расширяя доступный инструментарий для разработчиков высокопроизводительных систем. Китайские разработчики ускоряют выпуск открытых ИИ-моделей Hacker News · 04.08.2026 Китайские технологические компании перешли к агрессивной стратегии выпуска открытых моделей, стремясь сократить технологический разрыв с американскими конкурентами. Массовый релиз высокопроизводительных open-weights решений создает серьезное давление на рынок США, вынуждая западных игроков пересматривать подходы к монетизации и закрытости своих проприетарных систем на фоне растущей доступности мощных альтернатив из КНР. Liquid AI представила компактную модель LFM-2.5 на 2.6 млрд параметров Hacker News · 04.08.2026 Компания Liquid AI выпустила LFM-2.5 — компактную языковую модель с 2.6 млрд параметров, оптимизированную для работы на устройствах с ограниченными ресурсами. Архитектура модели ориентирована на высокую производительность при выполнении агентных задач, обеспечивая баланс между скоростью инференса и качеством генерации текста, что делает её подходящим решением для локального запуска в составе агентных систем. Релиз языковой модели Pokee-Isaac 28B Hacker News · 04.08.2026 Разработчики представили Pokee-Isaac 28B — новую языковую модель с 28 миллиардами параметров, ориентированную на высокую производительность в задачах обработки естественного языка. Модель доступна для тестирования через облачную консоль, предлагая пользователям сбалансированное решение между вычислительными затратами и качеством генерации текста, что делает её конкурентоспособным инструментом для широкого спектра прикладных задач. Liquid AI представила модель LFM 2.5 с 2,6 млрд параметров Hacker News · 04.08.2026 Компания Liquid AI выпустила модель LFM 2.5 с 2,6 млрд параметров, которая демонстрирует производительность, сопоставимую с нейросетями в четыре раза большего размера. Разработчики сфокусировались на эффективности архитектуры, позволяющей достигать высоких результатов в задачах обработки текста и кода при значительно меньших требованиях к вычислительным ресурсам и памяти по сравнению с традиционными трансформерами. Liquid AI представила компактную модель LFM-2.5 с 2.6 млрд параметров Hacker News · 04.08.2026 Компания Liquid AI выпустила LFM-2.5 — новую версию своей архитектуры с 2.6 млрд параметров, оптимизированную для эффективной работы на широком спектре устройств. Модель демонстрирует высокую производительность в задачах логического вывода и обработки данных, превосходя аналогичные по размеру решения за счет использования нетрадиционных подходов к архитектуре нейронных сетей, ориентированных на минимизацию вычислительных затрат. Новая модель OpenAI Astra успешно решила десять сложных математических задач Hacker News · 04.08.2026 Исследователи OpenAI представили результаты тестирования невыпущенной модели Astra, которая продемонстрировала способность решать десять крупных открытых математических проблем. Это достижение знаменует значительный прогресс в области автоматизированного логического вывода и математического доказательства, где ИИ переходит от простых вычислений к выполнению задач, требующих глубокого концептуального понимания и нестандартных стратегий решения, ранее доступных только профессиональным математикам. OpenAI обновила стек голосового взаимодействия для режима реального времени Hacker News · 03.08.2026 OpenAI провела глубокую переработку архитектуры голосового движка ChatGPT, обеспечив полноценный дуплексный режим общения. Теперь модель способна слушать пользователя одновременно с генерацией ответа, что значительно снижает задержки и делает диалог естественным. Обновление направлено на устранение пауз, характерных для классических систем «запрос-ответ», и улучшение качества распознавания прерываний в ходе беседы. Black Forest Labs представила FLUX 3: генерация видео и аудио в одном процессе Replicate's blog · 03.08.2026 Компания Black Forest Labs выпустила FLUX 3 — свою первую мультимодальную модель, способную одновременно генерировать видео и аудио в рамках одного прохода. Разработка отличается высокой точностью следования сложным текстовым инструкциям, позволяя пользователям гибко управлять динамикой сцен и синхронизацией звукового сопровождения, что выделяет её на фоне существующих решений для генерации видеоконтента. OpenAI закрывает специализированный GPT для генерации изображений DALL·E Hacker News · 03.08.2026 OpenAI объявила о прекращении поддержки отдельного специализированного GPT-ассистента, предназначенного для генерации изображений через DALL·E. Теперь функциональность создания визуального контента полностью интегрирована в основной интерфейс ChatGPT. Пользователи могут генерировать изображения напрямую в чате, используя стандартные запросы, без необходимости переключаться на отдельный инструмент или выбирать специфическую версию модели в магазине GPTs. Анализ производительности и стоимости модели Qwen2.5-Max Hacker News · 03.08.2026 Аналитическая платформа Artificial Analysis опубликовала детальный разбор новой модели Qwen2.5-Max от Alibaba. Исследование подтверждает, что модель демонстрирует выдающиеся показатели в тестах на логику и кодинг, конкурируя с лидерами рынка вроде GPT-4o и Claude 3.5 Sonnet, при этом предлагая более выгодную экономическую модель для разработчиков и корпоративных пользователей. Неанонсированная модель OpenAI Astra решила десять сложных математических задач Hacker News · 03.08.2026 Неанонсированная модель OpenAI под кодовым названием Astra продемонстрировала выдающиеся способности в решении сложных математических задач, справившись с десятью проблемами высокого уровня сложности. Этот результат знаменует значительный прогресс в области автоматизированного математического доказательства, где ИИ-системы переходят от простых вычислений к выполнению задач, требующих глубокого логического вывода и абстрактного мышления, ранее доступного только экспертам-математикам. Система Locus для дообучения моделей превосходит показатели Qwen3 Hacker News · 03.08.2026 Исследователи представили систему Locus, предназначенную для пост-тренировки (post-training) языковых моделей. Согласно опубликованным данным, модели, прошедшие оптимизацию через Locus, демонстрируют более высокие результаты в бенчмарках по сравнению с архитектурой Qwen3. Разработка фокусируется на улучшении эффективности обучения и повышении качества ответов моделей в специализированных задачах, что позволяет достигать лучших показателей при меньших вычислительных затратах. Amazon планирует консолидацию линейки моделей Nova Hacker News · 03.08.2026 Amazon пересматривает стратегию развития своего семейства нейросетей Nova, планируя объединить различные версии моделей в единую линейку. Этот шаг направлен на оптимизацию ресурсов и упрощение выбора инструментов для клиентов AWS. Компания стремится повысить эффективность разработки и ускорить внедрение своих ИИ-решений в корпоративный сектор, конкурируя с другими облачными провайдерами. Релиз модели Qwen 3.8 Max на платформе OpenRouter Hacker News · 03.08.2026 Разработчики добавили новую модель Qwen 3.8 Max в библиотеку OpenRouter, предоставив пользователям доступ к актуальным возможностям этой архитектуры через единый API. Релиз расширяет выбор высокопроизводительных LLM для интеграции в сторонние приложения, позволяя разработчикам использовать возможности модели без необходимости самостоятельного развертывания инфраструктуры и управления вычислительными мощностями для инференса. DeepSeek V3 и экономика доступного инференса Hacker News · 03.08.2026 DeepSeek представила модель V3, которая демонстрирует значительный прогресс в соотношении производительности и стоимости инференса. Разработчики сфокусировались на оптимизации архитектуры, что позволило радикально снизить цену за токен по сравнению с аналогами. Это изменение делает внедрение мощных LLM экономически оправданным для широкого спектра задач, где ранее использование топовых моделей было финансово невыгодным. Китайская модель MiniMax H3 возглавила рейтинг видеогенерации The Decoder · 03.08.2026 Китайская компания MiniMax представила модель H3, ставшую первой открытой нейросетью для генерации видео, занявшей лидирующую позицию в профильных бенчмарках. Релиз весов модели знаменует важный сдвиг в индустрии, где доминировали закрытые проприетарные решения, предоставляя разработчикам доступ к инструментам генерации видео высокого качества, способным конкурировать с лучшими мировыми аналогами по уровню реализма и динамики. Релиз AQ: компактная языковая модель на 1 миллиард параметров для академических задач Hacker News · 03.08.2026 Команда из двух разработчиков представила AQ — специализированную языковую модель с 1 миллиардом параметров, обученную с нуля для академических и исследовательских целей. Проект демонстрирует эффективность компактных архитектур, способных работать на ограниченных вычислительных ресурсах, сохраняя при этом высокую точность в специфических задачах обработки текстов и генерации ответов, что делает её доступным инструментом для локального развертывания. Alibaba представила Qwen2.5-Max: новая попытка догнать лидеров рынка ИИ The Verge · 03.08.2026 Китайский технологический гигант Alibaba выпустил Qwen2.5-Max — свою самую мощную и производительную языковую модель на текущий момент. Компания заявляет, что по ключевым метрикам и возможностям новая разработка сопоставима с флагманскими решениями от OpenAI и Anthropic. Модель уже доступна для широкого круга пользователей через облачные платформы и API, что усиливает конкуренцию на глобальном рынке frontier-моделей. Alibaba анонсировала флагманскую модель Qwen3.8-Max с 2,4 трлн параметров The Decoder · 03.08.2026 Alibaba представила Qwen3.8-Max — новую флагманскую модель с 2,4 триллионами параметров, ориентированную на выполнение сложных долгосрочных задач. Система способна автономно работать над проектами в течение нескольких дней, включая воспроизведение научных исследований и проектирование микросхем. Разработчики планируют открыть веса модели для широкого использования уже на следующей неделе. Alibaba представила Qwen3.8-Max: MoE-модель с 2,4 трлн параметров MarkTechPost · 03.08.2026 Alibaba перевела флагманскую модель Qwen3.8-Max из статуса предварительного тестирования в общий доступ. Это мультимодальная архитектура типа Mixture-of-Experts (MoE) с 2,4 трлн параметров, поддерживающая работу с текстом, изображениями и видео. Модель способна обрабатывать контекст объемом до 1 млн токенов, а компания уже опубликовала тарифы на использование API и анонсировала открытие весов в ближайшее время. Cogent AI представила VR-1: специализированную модель для кибербезопасности MarkTechPost · 03.08.2026 Команда Cogent AI анонсировала VR-1 — специализированную модель для кибербезопасности, обученную на задачах построения и верификации векторов атак в корпоративных сетях. В отличие от универсальных LLM, VR-1 сфокусирована на глубоком анализе уязвимостей. Релиз включает бенчмарк IntrusionBench для оценки эффективности агентов и среду Cogent AI Harness для безопасного выполнения операций в защищенных инфраструктурах. Alibaba открывает веса моделей Qwen 3.8-Max и Qwen3.8-27B Hacker News · 03.08.2026 Alibaba официально объявила о переводе своих новейших языковых моделей Qwen 3.8-Max и Qwen3.8-27B в категорию open-weight. Это решение делает высокопроизводительные архитектуры компании доступными для широкого круга разработчиков и исследователей, позволяя использовать их в локальных инфраструктурах и собственных проектах без ограничений, присущих проприетарным API-решениям.