Модели и релизы
Alibaba представила модель Qwen Audio 3.0 TTS Plus для синтеза речи
Компания Alibaba выпустила модель Qwen Audio 3.0 TTS Plus, которая заняла первую строчку в рейтинге Speech Arena от Artificial Analysis. Новинка поддерживает 16 языков и позволяет гибко настраивать эмоциональную окраску речи с помощью текстовых описаний или специальных тегов. Несмотря на лидерство по качеству звучания, модель уступает конкурентам в скорости генерации аудиоконтента.
xAI опубликовала веса модели Grok-1, но закрыла возможность внешних контрибьюций
Компания xAI открыла исходный код и веса своей языковой модели Grok-1, предоставив доступ к архитектуре для широкого сообщества. Несмотря на публикацию под лицензией Apache 2.0, разработчики официально отказались принимать внешние патчи и сторонние улучшения в основной репозиторий. Проект остается инструментом для ознакомления, а не платформой для совместной разработки.
Выход открытой модели Motif 3: южнокорейский конкурент DeepSeek V4
Южнокорейские разработчики представили Motif 3, открытую языковую модель, которая по своим характеристикам и производительности сопоставима с DeepSeek V4. Релиз знаменует собой значимый шаг для локальных ИИ-сообществ, стремящихся к созданию высокоэффективных альтернатив проприетарным и крупным западным архитектурам, предлагая разработчикам доступ к мощным инструментам для локального развертывания и дообучения под специфические задачи.
xAI готовит Grok с 2 триллионами параметров на данных SpaceX
Илон Маск анонсировал разработку новой версии языковой модели Grok, архитектура которой будет насчитывать 2 триллиона параметров. Обучение системы планируется проводить на массиве инженерных данных компании SpaceX. Этот подход направлен на создание специализированного ИИ, способного глубоко анализировать техническую документацию, физические расчеты и сложные производственные процессы в аэрокосмической отрасли.
Релиз открытой модели Motif-3-Beta
Компания Motif Technologies представила Motif-3-Beta — новую языковую модель, доступную для широкого использования на платформе Hugging Face. Релиз ориентирован на расширение возможностей открытых решений в области генеративного ИИ, предлагая разработчикам инструмент с улучшенными характеристиками обработки контекста и точности генерации текста, что делает его пригодным для интеграции в прикладные системы.
MiniMax представила модель M3 с архитектурой разреженного внимания
Компания MiniMax выпустила новую модель M3, ориентированную на работу с длинными контекстами и создание агентных систем. Ключевой особенностью архитектуры стало использование разреженного внимания (sparse attention), что позволяет эффективно обрабатывать огромные объемы данных, сохраняя высокую скорость инференса и точность при выполнении сложных многошаговых задач, требующих удержания контекста на протяжении длительного времени.
Sakana AI представила специализированную модель Fugu-Cyber для кибербезопасности
Японская лаборатория Sakana AI выпустила Fugu-Cyber — специализированную языковую модель, предназначенную для анализа уязвимостей и автоматизации задач в сфере кибербезопасности. Модель базируется на архитектуре Qwen 2.5 и прошла дообучение на обширном массиве данных, связанных с кодом, системным администрированием и поиском эксплойтов, что позволяет ей эффективнее справляться с техническими задачами по сравнению с универсальными LLM.
Alibaba представила Qwen-Audio-3.0-TTS для генерации речи в реальном времени
Лаборатория Tongyi компании Alibaba выпустила Qwen-Audio-3.0-TTS — специализированную систему синтеза речи, доступную через облачную платформу Model Studio. Модель представлена в двух версиях: Flash для задач с минимальной задержкой и Plus для высококачественного озвучивания. Решение поддерживает 16 языков и ориентировано на интеграцию в производственные среды, требующие стабильной работы с аудиоконтентом.
Kimi K3: новый этап в развитии открытых весов
Китайская компания Moonshot AI представила Kimi k3, модель с открытыми весами, которая демонстрирует значительный прогресс в производительности для открытых систем. Релиз знаменует собой усиление конкуренции между проприетарными моделями и открытыми альтернативами, предлагая разработчикам доступ к архитектуре, способной конкурировать с лидерами индустрии по качеству логических рассуждений и обработки длинных контекстов.
Inertia-1: новая фундаментальная модель для генерации движения
Исследователи представили Inertia-1 — открытую фундаментальную модель, предназначенную для генерации и моделирования физически корректного движения. Проект направлен на создание универсального движка, способного предсказывать динамику объектов и персонажей в различных сценариях. Разработка предлагает новый подход к обучению моделей на основе данных о движении, что открывает возможности для более реалистичной анимации и симуляции в ИИ-системах.
Китайская модель Kimi K3 ограничила регистрацию из-за ажиотажного спроса
Разработчик Moonshot AI временно приостановил прием новых пользователей для своей флагманской модели Kimi K3. Решение вызвано резким скачком трафика, который привел к перегрузке вычислительных мощностей. Компания работает над расширением инфраструктуры, чтобы справиться с наплывом аудитории, стремящейся получить доступ к возможностям обработки длинного контекста и продвинутым функциям анализа данных, предлагаемым платформой.
NVIDIA представила Cosmos 3 Edge для генерации видео и аудио
NVIDIA выпустила Cosmos 3 Edge — новую мультимодальную модель, оптимизированную для генерации высококачественного видео и аудио. Система ориентирована на создание контента с высокой степенью контроля над движением и синхронизацией, предлагая разработчикам инструменты для интеграции генеративных возможностей в приложения с ограниченными вычислительными ресурсами, сохраняя при этом высокую точность визуализации и реалистичность звукового сопровождения.
Китайские ИИ-разработчики бросают вызов лидерам рынка
Ведущие китайские технологические компании, включая Alibaba и Moonshot AI, представили новые языковые модели, претендующие на конкуренцию с флагманскими решениями OpenAI и Anthropic. Разработчики заявляют, что их продукты демонстрируют сопоставимую производительность при значительно меньших затратах на инференс. Этот рывок свидетельствует о сокращении технологического разрыва между США и Китаем в сфере генеративного ИИ.
Anthropic представила модель Claude Fable 5
Компания Anthropic официально анонсировала запуск Claude Fable 5, новой итерации своих языковых моделей, доступной пользователям платных тарифных планов. Обновление направлено на повышение точности рассуждений, улучшение работы с контекстом и оптимизацию выполнения сложных многошаговых задач, что делает модель более эффективной для профессионального использования в аналитике и программировании.
Moonshot AI представила Kimi K3: крупнейшую open-weight модель на 2,8 трлн параметров
Китайская компания Moonshot AI выпустила Kimi K3 — крупнейшую на текущий момент open-weight модель, насчитывающую 2,8 триллиона параметров. Разработчики сделали ставку не на увеличение вычислительных мощностей для обучения, а на архитектурные инновации в области управления памятью, что позволяет модели эффективно обрабатывать колоссальные объемы данных при относительно меньших затратах на инференс.
OpenAI планирует выпуск локальной модели уровня GPT-3
OpenAI рассматривает возможность выпуска компактной языковой модели с производительностью, сопоставимой с GPT-3, для запуска на потребительском оборудовании. Компания стремится опередить конкурентов, таких как Stability AI, в сегменте локальных решений. Стратегия направлена на укрепление позиций в экосистеме открытого ПО и создание доступных инструментов для широкого круга пользователей и разработчиков.
Анализ Bonsai 27B: возможности и потери при 1-битной компрессии моделей
Исследователи представили Bonsai 27B — языковую модель, использующую 1-битную квантованную архитектуру, что позволяет запускать тяжелые веса на потребительских устройствах, включая iPhone. Технология радикально снижает требования к памяти, однако сопровождается неизбежной деградацией точности ответов и логических способностей, что ставит вопрос о балансе между компактностью модели и качеством генерации текста в реальных сценариях использования.
Alibaba анонсировала мультимодальную модель Qwen3.8-Max с 2,4 трлн параметров
Alibaba представила предварительную версию мультимодальной модели Qwen3.8-Max, архитектура которой основана на смеси экспертов (MoE) и насчитывает 2,4 триллиона параметров. Разработчики позиционируют новинку как решение, уступающее по своим возможностям только модели Fable 5. Доступ к превью-версии уже открыт на ряде специализированных платформ, где стоимость использования снижена до 10% от стандартных тарифов компании.
Релиз Qwen 2.5 Max: новая флагманская модель от Alibaba
Alibaba представила Qwen 2.5 Max — свою самую мощную на текущий момент языковую модель. Новинка демонстрирует значительный прогресс в решении сложных логических задач, программировании и математических вычислениях, сопоставимый с лидерами индустрии. Модель ориентирована на высокопроизводительные корпоративные сценарии и глубокую аналитическую работу, предлагая расширенные возможности обработки контекста и точности генерации ответов.
Alibaba представила мультимодальную модель Qwen 3.8 с 2,4 трлн параметров
Alibaba выпустила Qwen 3.8 — новую мультимодальную модель с 2,4 триллионами параметров, доступную в формате с открытыми весами. Разработчики заявляют, что по производительности новинка уступает лишь модели Fable 5, составляя прямую конкуренцию Kimi K3. Предварительная версия модели уже открыта для тестирования, что знаменует очередной этап в гонке высокопроизводительных LLM.
Выход предварительной версии модели Qwen 3.8 Max
Alibaba Cloud представила предварительную версию своей новой флагманской модели Qwen 3.8 Max. Релиз направлен на расширение возможностей высокопроизводительных вычислений в облачной экосистеме компании. Модель доступна через API, а разработчики уже могут ознакомиться с актуальными тарифами на использование токенов в рамках обновленной платформы Qwen Cloud.
Alibaba представила Qwen 3.8 с 2,4 трлн параметров
Alibaba анонсировала выход новой языковой модели Qwen 3.8, которая стала одной из крупнейших в индустрии, обладая 2,4 триллионами параметров. Разработчик открыл доступ к модели через собственную платформу токенизации и облачные сервисы, предлагая пользователям новые возможности для масштабируемых вычислений и сложных задач обработки естественного языка в корпоративном секторе.
Kimi K3 от Moonshot лидирует в генерации фронтенд-кода
Китайская модель Kimi K3 от компании Moonshot AI заняла первое место в рейтинге Code Arena: Frontend, опередив такие модели, как Claude Fable 5 и GPT-5.6 Sol. Несмотря на выдающиеся результаты в написании кода, модель демонстрирует значительное отставание в решении сложных математических задач, где её показатели существенно ниже уровня ведущих западных аналогов.
Сравнение флагманских MoE-моделей: Kimi K3, DeepSeek V4 Pro и GLM-5.2
Сравнение трех передовых моделей архитектуры Mixture-of-Experts (MoE) с триллионными параметрами — Kimi K3, DeepSeek V4 Pro и GLM-5.2 — выявило существенные различия в их производительности, лицензионных условиях и стоимости инференса. Анализ охватывает как результаты на стандартных бенчмарках, так и практическую эффективность развертывания этих систем в реальных инфраструктурных задачах.