Модели и релизы
NVIDIA представила Alpamayo 2 Super: VLA-модель для автономного вождения
NVIDIA выпустила Alpamayo 2 Super — мультимодальную модель класса Vision-Language-Action (VLA) с 34 млрд параметров, предназначенную для беспилотных такси и систем автономного вождения. Модель распространяется по лицензии OpenMDW-1.1, которая разрешает коммерческое использование, создание производных продуктов и дообучение. Система объединяет возможности рассуждения с генерацией траекторий движения и мета-действий в реальном времени.
Релиз Ling 3.0 Flash: открытая модель с архитектурой 124B-A5.1B
Разработчики представили Ling 3.0 Flash — новую открытую языковую модель с архитектурой 124B-A5.1B. Несмотря на компактный размер активных параметров, модель демонстрирует производительность, сопоставимую с MiniMax M2.7. Релиз ориентирован на создание эффективных решений для задач, требующих баланса между скоростью инференса и качеством генерации текста, расширяя доступный инструментарий для разработчиков высокопроизводительных систем.
Китайские разработчики ускоряют выпуск открытых ИИ-моделей
Китайские технологические компании перешли к агрессивной стратегии выпуска открытых моделей, стремясь сократить технологический разрыв с американскими конкурентами. Массовый релиз высокопроизводительных open-weights решений создает серьезное давление на рынок США, вынуждая западных игроков пересматривать подходы к монетизации и закрытости своих проприетарных систем на фоне растущей доступности мощных альтернатив из КНР.
Liquid AI представила компактную модель LFM-2.5 на 2.6 млрд параметров
Компания Liquid AI выпустила LFM-2.5 — компактную языковую модель с 2.6 млрд параметров, оптимизированную для работы на устройствах с ограниченными ресурсами. Архитектура модели ориентирована на высокую производительность при выполнении агентных задач, обеспечивая баланс между скоростью инференса и качеством генерации текста, что делает её подходящим решением для локального запуска в составе агентных систем.
Релиз языковой модели Pokee-Isaac 28B
Разработчики представили Pokee-Isaac 28B — новую языковую модель с 28 миллиардами параметров, ориентированную на высокую производительность в задачах обработки естественного языка. Модель доступна для тестирования через облачную консоль, предлагая пользователям сбалансированное решение между вычислительными затратами и качеством генерации текста, что делает её конкурентоспособным инструментом для широкого спектра прикладных задач.
Liquid AI представила модель LFM 2.5 с 2,6 млрд параметров
Компания Liquid AI выпустила модель LFM 2.5 с 2,6 млрд параметров, которая демонстрирует производительность, сопоставимую с нейросетями в четыре раза большего размера. Разработчики сфокусировались на эффективности архитектуры, позволяющей достигать высоких результатов в задачах обработки текста и кода при значительно меньших требованиях к вычислительным ресурсам и памяти по сравнению с традиционными трансформерами.
Liquid AI представила компактную модель LFM-2.5 с 2.6 млрд параметров
Компания Liquid AI выпустила LFM-2.5 — новую версию своей архитектуры с 2.6 млрд параметров, оптимизированную для эффективной работы на широком спектре устройств. Модель демонстрирует высокую производительность в задачах логического вывода и обработки данных, превосходя аналогичные по размеру решения за счет использования нетрадиционных подходов к архитектуре нейронных сетей, ориентированных на минимизацию вычислительных затрат.
Новая модель OpenAI Astra успешно решила десять сложных математических задач
Исследователи OpenAI представили результаты тестирования невыпущенной модели Astra, которая продемонстрировала способность решать десять крупных открытых математических проблем. Это достижение знаменует значительный прогресс в области автоматизированного логического вывода и математического доказательства, где ИИ переходит от простых вычислений к выполнению задач, требующих глубокого концептуального понимания и нестандартных стратегий решения, ранее доступных только профессиональным математикам.
OpenAI обновила стек голосового взаимодействия для режима реального времени
OpenAI провела глубокую переработку архитектуры голосового движка ChatGPT, обеспечив полноценный дуплексный режим общения. Теперь модель способна слушать пользователя одновременно с генерацией ответа, что значительно снижает задержки и делает диалог естественным. Обновление направлено на устранение пауз, характерных для классических систем «запрос-ответ», и улучшение качества распознавания прерываний в ходе беседы.
Black Forest Labs представила FLUX 3: генерация видео и аудио в одном процессе
Компания Black Forest Labs выпустила FLUX 3 — свою первую мультимодальную модель, способную одновременно генерировать видео и аудио в рамках одного прохода. Разработка отличается высокой точностью следования сложным текстовым инструкциям, позволяя пользователям гибко управлять динамикой сцен и синхронизацией звукового сопровождения, что выделяет её на фоне существующих решений для генерации видеоконтента.
OpenAI закрывает специализированный GPT для генерации изображений DALL·E
OpenAI объявила о прекращении поддержки отдельного специализированного GPT-ассистента, предназначенного для генерации изображений через DALL·E. Теперь функциональность создания визуального контента полностью интегрирована в основной интерфейс ChatGPT. Пользователи могут генерировать изображения напрямую в чате, используя стандартные запросы, без необходимости переключаться на отдельный инструмент или выбирать специфическую версию модели в магазине GPTs.
Анализ производительности и стоимости модели Qwen2.5-Max
Аналитическая платформа Artificial Analysis опубликовала детальный разбор новой модели Qwen2.5-Max от Alibaba. Исследование подтверждает, что модель демонстрирует выдающиеся показатели в тестах на логику и кодинг, конкурируя с лидерами рынка вроде GPT-4o и Claude 3.5 Sonnet, при этом предлагая более выгодную экономическую модель для разработчиков и корпоративных пользователей.
Неанонсированная модель OpenAI Astra решила десять сложных математических задач
Неанонсированная модель OpenAI под кодовым названием Astra продемонстрировала выдающиеся способности в решении сложных математических задач, справившись с десятью проблемами высокого уровня сложности. Этот результат знаменует значительный прогресс в области автоматизированного математического доказательства, где ИИ-системы переходят от простых вычислений к выполнению задач, требующих глубокого логического вывода и абстрактного мышления, ранее доступного только экспертам-математикам.
Система Locus для дообучения моделей превосходит показатели Qwen3
Исследователи представили систему Locus, предназначенную для пост-тренировки (post-training) языковых моделей. Согласно опубликованным данным, модели, прошедшие оптимизацию через Locus, демонстрируют более высокие результаты в бенчмарках по сравнению с архитектурой Qwen3. Разработка фокусируется на улучшении эффективности обучения и повышении качества ответов моделей в специализированных задачах, что позволяет достигать лучших показателей при меньших вычислительных затратах.
Amazon планирует консолидацию линейки моделей Nova
Amazon пересматривает стратегию развития своего семейства нейросетей Nova, планируя объединить различные версии моделей в единую линейку. Этот шаг направлен на оптимизацию ресурсов и упрощение выбора инструментов для клиентов AWS. Компания стремится повысить эффективность разработки и ускорить внедрение своих ИИ-решений в корпоративный сектор, конкурируя с другими облачными провайдерами.
Релиз модели Qwen 3.8 Max на платформе OpenRouter
Разработчики добавили новую модель Qwen 3.8 Max в библиотеку OpenRouter, предоставив пользователям доступ к актуальным возможностям этой архитектуры через единый API. Релиз расширяет выбор высокопроизводительных LLM для интеграции в сторонние приложения, позволяя разработчикам использовать возможности модели без необходимости самостоятельного развертывания инфраструктуры и управления вычислительными мощностями для инференса.
DeepSeek V3 и экономика доступного инференса
DeepSeek представила модель V3, которая демонстрирует значительный прогресс в соотношении производительности и стоимости инференса. Разработчики сфокусировались на оптимизации архитектуры, что позволило радикально снизить цену за токен по сравнению с аналогами. Это изменение делает внедрение мощных LLM экономически оправданным для широкого спектра задач, где ранее использование топовых моделей было финансово невыгодным.
Китайская модель MiniMax H3 возглавила рейтинг видеогенерации
Китайская компания MiniMax представила модель H3, ставшую первой открытой нейросетью для генерации видео, занявшей лидирующую позицию в профильных бенчмарках. Релиз весов модели знаменует важный сдвиг в индустрии, где доминировали закрытые проприетарные решения, предоставляя разработчикам доступ к инструментам генерации видео высокого качества, способным конкурировать с лучшими мировыми аналогами по уровню реализма и динамики.
Релиз AQ: компактная языковая модель на 1 миллиард параметров для академических задач
Команда из двух разработчиков представила AQ — специализированную языковую модель с 1 миллиардом параметров, обученную с нуля для академических и исследовательских целей. Проект демонстрирует эффективность компактных архитектур, способных работать на ограниченных вычислительных ресурсах, сохраняя при этом высокую точность в специфических задачах обработки текстов и генерации ответов, что делает её доступным инструментом для локального развертывания.
Alibaba представила Qwen2.5-Max: новая попытка догнать лидеров рынка ИИ
Китайский технологический гигант Alibaba выпустил Qwen2.5-Max — свою самую мощную и производительную языковую модель на текущий момент. Компания заявляет, что по ключевым метрикам и возможностям новая разработка сопоставима с флагманскими решениями от OpenAI и Anthropic. Модель уже доступна для широкого круга пользователей через облачные платформы и API, что усиливает конкуренцию на глобальном рынке frontier-моделей.
Alibaba анонсировала флагманскую модель Qwen3.8-Max с 2,4 трлн параметров
Alibaba представила Qwen3.8-Max — новую флагманскую модель с 2,4 триллионами параметров, ориентированную на выполнение сложных долгосрочных задач. Система способна автономно работать над проектами в течение нескольких дней, включая воспроизведение научных исследований и проектирование микросхем. Разработчики планируют открыть веса модели для широкого использования уже на следующей неделе.
Alibaba представила Qwen3.8-Max: MoE-модель с 2,4 трлн параметров
Alibaba перевела флагманскую модель Qwen3.8-Max из статуса предварительного тестирования в общий доступ. Это мультимодальная архитектура типа Mixture-of-Experts (MoE) с 2,4 трлн параметров, поддерживающая работу с текстом, изображениями и видео. Модель способна обрабатывать контекст объемом до 1 млн токенов, а компания уже опубликовала тарифы на использование API и анонсировала открытие весов в ближайшее время.
Cogent AI представила VR-1: специализированную модель для кибербезопасности
Команда Cogent AI анонсировала VR-1 — специализированную модель для кибербезопасности, обученную на задачах построения и верификации векторов атак в корпоративных сетях. В отличие от универсальных LLM, VR-1 сфокусирована на глубоком анализе уязвимостей. Релиз включает бенчмарк IntrusionBench для оценки эффективности агентов и среду Cogent AI Harness для безопасного выполнения операций в защищенных инфраструктурах.
Alibaba открывает веса моделей Qwen 3.8-Max и Qwen3.8-27B
Alibaba официально объявила о переводе своих новейших языковых моделей Qwen 3.8-Max и Qwen3.8-27B в категорию open-weight. Это решение делает высокопроизводительные архитектуры компании доступными для широкого круга разработчиков и исследователей, позволяя использовать их в локальных инфраструктурах и собственных проектах без ограничений, присущих проприетарным API-решениям.