Модели и релизы
DeepMind представила Gemini Omni
DeepMind анонсировала новую модель Gemini Omni, которая позиционируется как универсальное решение для широкого спектра задач. Gemini Omni отличается улучшенной производительностью и способностью работать с мультимодальными данными, включая текст, изображения и видео. Это важный шаг в развитии ИИ, так как модель демонстрирует высокий уровень адаптивности и точности в различных сценариях.
Gemini 3.5 от DeepMind: интеллект с возможностью действия
DeepMind представила новую модель Gemini 3.5, которая отличается от предыдущих версий способностью выполнять сложные, агентские рабочие процессы. Это значительный шаг вперёд, так как модель не только понимает контекст, но и может активно взаимодействовать с окружающей средой для достижения целей. Gemini 3.5 построена на архитектуре, которая позволяет ей интегрироваться с различными инструментами и системами, что делает её полезной для автоматизации сложных задач.
IBM Granite 4.1: новые модели для локального инференса
IBM представила обновлённые модели Granite 4.1, которые демонстрируют значительные улучшения в производительности и эффективности. Эти модели, доступные в различных размерах (7B, 13B, 34B и 115B параметров), оптимизированы для работы на локальных устройствах, что делает их особенно привлекательными для разработчиков ИИ-агентов, стремящихся к автономности и снижению затрат на облачные вычисления.
DeepSeek-V4 Pro доступна на Together AI
Together AI анонсировала доступность модели DeepSeek-V4 Pro. Новая версия поддерживает контекст длиной 512K токенов, что позволяет обрабатывать сложные задачи, такие как анализ кода, документов и синтез исследований.
NVIDIA Nemotron 3 Nano Omni: многомодальная модель для документов аудио и видео
NVIDIA представила новую модель Nemotron 3 Nano Omni, которая поддерживает работу с текстом, аудио и видео. Это важный шаг в развитии многомодальных моделей, которые могут обрабатывать различные типы данных. Модель поддерживает контекст длиной до 128K токенов, что позволяет обрабатывать большие документы и сложные запросы.
QIMMA: новый лидерборд для арабских языковых моделей
Команда из TII UAE представила QIMMA — первый лидерборд, ориентированный на качество арабских языковых моделей. В отличие от традиционных рейтингах, QIMMA фокусируется на оценке качества, а не на количестве параметров или производительности на общих бенчмарках.
Gemma 4: открытые модели для сложных агентских сценариев
DeepMind представила Gemma 4 — новую версию своих открытых моделей, позиционируемых как самые мощные на сегодняшний день. Эти модели специально оптимизированы для сложных задач, включая рассуждения и агентские workflows. Gemma 4 предлагает улучшенные возможности в обработке естественного языка, что делает её перспективной для интеграции в ИИ-агентов, требующих высокого уровня интеллектуальных способностей.
Gemini 3.1 Flash Live улучшает голосовые взаимодействия
DeepMind представила новую версию своей голосовой модели Gemini 3.1 Flash Live, которая обещает более естественные и точные голосовые взаимодействия. Новая модель фокусируется на снижении задержек и повышении точности, что делает её более подходящей для реального времени. Это важно для разработчиков ИИ-агентов, так как голосовые интерфейсы становятся всё более популярными в различных приложениях, от виртуальных ассистентов до клиентских сервисов.
TurboQuant: алгоритмы для сверхкомпактных моделей
Исследователи Google DeepMind представили TurboQuant — набор алгоритмов для экстремальной компрессии нейросетей. Технология позволяет сократить размер модели в 10–100 раз без потери точности, что критически важно для локального развёртывания ИИ-агентов.
Mistral Small 4: компактная модель с улучшенными характеристиками
Mistral представила новую версию своей компактной модели Mistral Small 4. Она поддерживает контекстное окно в 128K токенов, что позволяет обрабатывать более длинные тексты и сложные запросы. Новая модель демонстрирует улучшенные показатели в различных задачах, включая понимание естественного языка и генерацию текста.
Gemini 3.1 Flash-Lite от DeepMind: скорость и эффективность
DeepMind представила новую модель Gemini 3.1 Flash-Lite, которая позиционируется как самая быстрая и экономически выгодная в серии Gemini 3. Эта модель разработана для работы в условиях масштабируемой интеллектуальной обработки, что делает её особенно привлекательной для разработчиков ИИ-агентов и сервисов.
Gemini 3.1 Pro от DeepMind для сложных задач
DeepMind представила новую модель Gemini 3.1 Pro, ориентированную на решение сложных задач, где требуется не просто ответ, а глубокий анализ и понимание контекста. Модель демонстрирует улучшенные способности в обработке сложных запросов, что делает её перспективной для применения в различных областях, включая разработку ИИ-агентов.
Mistral представила модель Mistral 3 с 200+ миллиардами параметров
Mistral анонсировала новую модель Mistral 3, которая включает три версии: Mistral 3 12B, Mistral 3 44B и Mistral 3 200B. Все версии поддерживают работу с 128K контекстными окнами и доступны в режиме инференса на платформе Mistral AI.
Запуск модели Isaac 0.1 для восприятия реального мира
Компания Replicate анонсировала доступ к модели Isaac 0.1 на своей платформе. Это лёгкая визуально-языковая модель, ориентированная на восприятие реального мира. Модель разработана для работы с изображениями и текстом, что позволяет ей анализировать и интерпретировать визуальные данные в контексте реальных сценариев.
IBM выпустила Granite 4.0 на Replicate
IBM представила обновлённую версию своей модели Granite 4.0 на платформе Replicate. Новая версия включает улучшенные возможности обработки текста и изображений, а также повышенную точность и скорость работы.
Mistral представила Codestral 25.08 и полный стек для разработки
Mistral анонсировала новую версию модели Codestral 25.08, а также полный стек инструментов для разработки кода. Обновление включает улучшенные возможности генерации и анализа кода, а также интеграцию с другими продуктами Mistral.
Как оптимизировали FLUX.1 Kontext с помощью Taylor Seer
Команда Replicate подробно рассказала о том, как оптимизировали модель FLUX.1 Kontext с помощью метода Taylor Seer. Этот подход позволил значительно улучшить производительность модели без потери качества.
Новые модели Devstral улучшают кодинговые способности агентов
Компания Mistral анонсировала обновлённые модели Devstral, предназначенные для повышения кодинговых способностей ИИ-агентов. Новые версии моделей демонстрируют улучшенную точность и эффективность при выполнении задач программирования, включая написание, рефакторинг и отладку кода.
FLUX.1 Kontext: сообщество создаёт новые варианты модели
FLUX.1 Kontext — это модель, разработанная сообществом на базе Replicate. Она представляет собой вариацию FLUX.1, адаптированную для различных задач.