Модели и релизы
Релиз DeepSeek-V4-Flash-0731: новая итерация эффективной языковой модели
Компания DeepSeek представила DeepSeek-V4-Flash-0731 — обновленную версию своей языковой модели, оптимизированную для высокой скорости работы и сниженных вычислительных затрат. Релиз ориентирован на задачи, требующие быстрого инференса при сохранении высокого качества генерации текста, что делает модель конкурентоспособным решением для масштабируемых агентных систем и приложений реального времени, работающих с большими объемами данных.
Стартап Smallest.ai привлек $13 млн на разработку сверхбыстрых голосовых ИИ-моделей
Стартап Smallest.ai привлек $13 млн инвестиций для создания голосовых ИИ-моделей, ориентированных на сверхнизкую задержку и естественное звучание. Компания стремится преодолеть барьер «эффекта зловещей долины» в телефонных коммуникациях, создавая системы, способные имитировать человеческую речь с высокой точностью и минимальным временем отклика, что критически важно для прохождения теста Тьюринга в реальном времени.
Анализ производительности и стоимости модели DeepSeek-V4-Flash
Аналитическая платформа Artificial Analysis опубликовала детальный разбор новой модели DeepSeek-V4-Flash. Исследование подтверждает высокую эффективность архитектуры, демонстрируя значительный прогресс в соотношении вычислительной мощности и стоимости инференса. Модель показывает конкурентные результаты в бенчмарках, сохраняя при этом низкие задержки, что делает её привлекательным решением для высоконагруженных систем, требующих быстрой обработки данных при ограниченном бюджете на API.
DeepSeek представила обновленную линейку моделей версии V3
Компания DeepSeek выпустила обновление своей флагманской архитектуры, продемонстрировав значительный прирост производительности в задачах кодинга, математики и логического вывода. Новые модели показывают улучшенные результаты на стандартных бенчмарках, подтверждая эффективность оптимизированных методов обучения и архитектурных доработок, направленных на повышение точности ответов при сохранении высокой скорости генерации текста и снижении вычислительных затрат.
Выпущена Genesis-Science-1: специализированная модель для научных исследований
Компания Arcee AI представила Genesis-Science-1 — открытую модель, оптимизированную для работы с научными данными и академическими текстами. Разработчики сфокусировались на повышении точности ответов в узкоспециализированных дисциплинах, предоставив исследователям инструмент с открытыми весами, который можно адаптировать под конкретные задачи анализа литературы, синтеза гипотез и обработки экспериментальных данных без необходимости обращения к закрытым проприетарным API.
Анализ агентных возможностей моделей Nanbeige4.2-3B и Laguna S2.1
Исследователи представили сравнительный анализ двух специализированных языковых моделей: компактной Nanbeige4.2-3B и более мощной Laguna S2.1. Работа фокусируется на способности этих систем выполнять агентные задачи, требующие многошагового планирования и взаимодействия с внешними инструментами. Авторы оценивают эффективность моделей в условиях ограниченных вычислительных ресурсов и их пригодность для интеграции в агентные рабочие процессы.
Google представила обновленную модель Lyria 3.5 для генерации музыки
Google выпустила новую версию музыкальной нейросети Lyria 3.5, значительно улучшив качество генерации вокала, лирических текстов и общую музыкальность композиций. Обновление направлено на создание более сложных и естественных аудиодорожек, расширяя возможности платформы Music AI Sandbox для профессиональных авторов и музыкантов, стремящихся интегрировать генеративные технологии в свой творческий процесс.
WorldDiT: компактная диффузионная модель для симуляции робототехники
Представлена WorldDiT — диффузионная модель с 399 млн параметров, предназначенная для предсказания динамики среды и выполнения задач в робототехнических симуляциях. Модель обучалась на наборах данных с взаимодействиями роботов, позволяя генерировать последовательности состояний и действий, что критически важно для обучения агентов в условиях ограниченных вычислительных ресурсов и необходимости быстрого планирования движений.
Google представила Gemini Robotics 2.0 для управления роботами
Google анонсировала Gemini Robotics 2.0 — специализированную версию своей мультимодальной модели, предназначенную для управления робототехникой. Новая архитектура значительно повышает точность манипуляций и уровень безопасности при взаимодействии с физическими объектами. Решение направлено на интеграцию продвинутого ИИ-мышления в автономные системы, позволяя роботам лучше понимать контекст среды и выполнять сложные задачи с высокой степенью автономности.
Thinking Machines представила Inkling-Small: компактную модель для задач NLP
Компания Thinking Machines выпустила Inkling-Small — специализированную языковую модель, оптимизированную для эффективной обработки естественного языка при ограниченных вычислительных ресурсах. Модель демонстрирует высокую производительность в задачах классификации и извлечения данных, предлагая баланс между скоростью инференса и точностью, что делает её подходящим решением для развертывания в корпоративных средах с жесткими требованиями к задержкам.
Выход компактной языковой модели Inkling-Small
Компания Thinking Machines представила Inkling-Small — новую компактную языковую модель, оптимизированную для эффективной работы в условиях ограниченных вычислительных ресурсов. Релиз ориентирован на задачи, требующие быстрого инференса и низкого потребления памяти, что делает модель подходящим решением для развертывания на периферийных устройствах или в средах с жесткими ограничениями по инфраструктуре.
Google DeepMind представила семейство моделей Gemini Robotics 2 для управления роботами
Google DeepMind выпустила Gemini Robotics 2 — комплексную интеллектуальную платформу для управления робототехникой. Релиз включает три специализированные модели, отвечающие за координацию движений всего тела гуманоидов, логическое планирование задач и адаптацию к различным аппаратным конфигурациям. Технология уже успешно протестирована на промышленных роботах, демонстрируя способность к быстрой настройке под новые физические платформы.
Google DeepMind представила Gemini Robotics 2 для управления всем телом робота
Google DeepMind анонсировала обновление своей специализированной модели Gemini Robotics 2, которая теперь способна управлять движениями всего тела гуманоидных роботов. В отличие от предыдущей версии, сфокусированной на манипуляциях верхней частью корпуса, новая разработка обеспечивает координацию конечностей от стоп до кончиков пальцев, позволяя роботам выполнять сложные перемещения и взаимодействия с окружающим пространством.
Релиз Audio8 TTS: компактная модель для клонирования голоса
Представлена Audio8 TTS Preview 0.6B — новая компактная модель для синтеза речи, поддерживающая мультиязычность и функцию zero-shot клонирования голоса. При объеме параметров всего 0,6 миллиарда модель демонстрирует высокую эффективность в генерации естественного звучания, позволяя воспроизводить тембр и интонации целевого спикера на основе короткого аудиофрагмента без необходимости дополнительного обучения.
Релиз мультимодальной модели MiniMax-H3
Компания MiniMax представила H3 — новую мультимодальную модель, ориентированную на высокую производительность в задачах обработки текста, аудио и визуального контента. Релиз включает в себя архитектурные улучшения, направленные на повышение точности рассуждений и качества генерации в реальном времени, что делает модель конкурентоспособным решением для широкого спектра прикладных задач в области генеративного ИИ.
OpenAI снижает стоимость моделей GPT-5.6 для корпоративных клиентов
OpenAI объявила о снижении цен на свои актуальные модели GPT-5.6, представленные в версиях Luna и Terra. Обновление направлено на повышение экономической эффективности при масштабировании корпоративных ИИ-процессов. Новая тарифная политика позволяет компаниям оптимизировать затраты на инференс, сохраняя при этом высокую производительность систем, что критически важно для внедрения сложных автоматизированных рабочих процессов в промышленном масштабе.
Moonshot AI использовала чипы Nvidia Blackwell для обучения модели Kimi K3
Китайский стартап Moonshot AI задействовал передовые графические процессоры Nvidia Blackwell для обучения своей новой языковой модели Kimi K3. По данным источников, компания получила доступ к ограниченным экспортным технологиям, несмотря на действующие торговые ограничения США. Это событие подчеркивает сложность контроля за цепочками поставок высокопроизводительного оборудования в условиях глобальных санкций и растущей конкуренции в сфере ИИ.
xAI представила Grok 2.0 с улучшенными возможностями голосового взаимодействия
Компания xAI анонсировала обновление своей языковой модели Grok 2.0, сфокусированное на ускорении обработки данных и внедрении продвинутого голосового интерфейса. Новая версия модели демонстрирует значительный прирост скорости «мышления» и отклика, что позволяет пользователям вести более естественный и оперативный диалог в режиме реального времени, минимизируя задержки при генерации сложных ответов и выполнении запросов.
Google прекращает поддержку моделей Gemini 2.5
Google объявила о выводе из эксплуатации и прекращении поддержки линейки моделей Gemini 2.5. Разработчикам и корпоративным клиентам, использующим данные версии в своих продуктах, необходимо в ближайшее время перенести рабочие нагрузки на более актуальные итерации семейства Gemini, чтобы избежать сбоев в работе API и сервисов, интегрированных в облачную инфраструктуру компании.
Релиз компактной языковой модели Him 3B
Команда TeleologyHI представила Him 3B — легковесную языковую модель с 3 миллиардами параметров, ориентированную на эффективную работу в условиях ограниченных вычислительных ресурсов. Модель прошла процесс дистилляции, что позволило сохранить высокую производительность при значительно меньшем потреблении памяти и ускоренном инференсе по сравнению с более крупными аналогами, делая её подходящей для локального развертывания.
Google представила модель Lyria 3.5 для генерации музыки
Google DeepMind анонсировала обновление музыкальной модели Lyria 3.5, интегрированную в сервис Google Flow Music. Новая версия демонстрирует значительный прогресс в качестве вокала, структуре текстов песен и глубине творческого контроля над композициями. Разработчики сфокусировались на улучшении музыкальности и точности исполнения, что позволяет создавать более сложные и эмоционально выразительные треки с помощью генеративного ИИ.
OpenAI выпустила новые модели распознавания речи GPT Transcribe
OpenAI представила GPT Transcribe и GPT Live Transcribe — новые модели для распознавания речи, доступные через API компании. Несмотря на улучшение производительности по сравнению с предыдущими версиями, независимые тесты показывают, что новинки пока уступают конкурентам от Google, ElevenLabs и Mistral по уровню частоты ошибок при транскрибации аудио в текст.
Liquid AI представила компактные двунаправленные энкодеры LFM2.5
Компания Liquid AI выпустила две новые модели-энкодера: LFM2.5-Encoder-230M и LFM2.5-Encoder-350M. Эти модели построены на гибридной архитектуре LFM2 и поддерживают контекстное окно до 8192 токенов. Новинки демонстрируют высокую производительность при работе на центральных процессорах, обеспечивая эффективную обработку данных в задачах классификации и понимания текста без необходимости использования специализированных GPU-ускорителей.
OpenAI представила специализированные модели для транскрибации аудио
OpenAI расширила линейку своих моделей, выпустив GPT-transcribe и GPT-live-transcribe. Новые решения ориентированы на высокоточную обработку аудиоданных: первая модель предназначена для пакетной транскрибации файлов, а вторая обеспечивает потоковую обработку в реальном времени. Инструменты призваны повысить эффективность работы с голосовым контентом в корпоративных приложениях и сервисах автоматизации.