Модели и релизы

DeepMind представила Gemini Omni Google DeepMind News · 17.05.2026 DeepMind анонсировала новую модель Gemini Omni, которая позиционируется как универсальное решение для широкого спектра задач. Gemini Omni отличается улучшенной производительностью и способностью работать с мультимодальными данными, включая текст, изображения и видео. Это важный шаг в развитии ИИ, так как модель демонстрирует высокий уровень адаптивности и точности в различных сценариях. Gemini 3.5 от DeepMind: интеллект с возможностью действия Google DeepMind News · 15.05.2026 DeepMind представила новую модель Gemini 3.5, которая отличается от предыдущих версий способностью выполнять сложные, агентские рабочие процессы. Это значительный шаг вперёд, так как модель не только понимает контекст, но и может активно взаимодействовать с окружающей средой для достижения целей. Gemini 3.5 построена на архитектуре, которая позволяет ей интегрироваться с различными инструментами и системами, что делает её полезной для автоматизации сложных задач. IBM Granite 4.1: новые модели для локального инференса Hugging Face - Blog · 29.04.2026 IBM представила обновлённые модели Granite 4.1, которые демонстрируют значительные улучшения в производительности и эффективности. Эти модели, доступные в различных размерах (7B, 13B, 34B и 115B параметров), оптимизированы для работы на локальных устройствах, что делает их особенно привлекательными для разработчиков ИИ-агентов, стремящихся к автономности и снижению затрат на облачные вычисления. DeepSeek-V4 Pro доступна на Together AI Together.ai · 28.04.2026 Together AI анонсировала доступность модели DeepSeek-V4 Pro. Новая версия поддерживает контекст длиной 512K токенов, что позволяет обрабатывать сложные задачи, такие как анализ кода, документов и синтез исследований. NVIDIA Nemotron 3 Nano Omni: многомодальная модель для документов аудио и видео Hugging Face - Blog · 28.04.2026 NVIDIA представила новую модель Nemotron 3 Nano Omni, которая поддерживает работу с текстом, аудио и видео. Это важный шаг в развитии многомодальных моделей, которые могут обрабатывать различные типы данных. Модель поддерживает контекст длиной до 128K токенов, что позволяет обрабатывать большие документы и сложные запросы. QIMMA: новый лидерборд для арабских языковых моделей Hugging Face - Blog · 21.04.2026 Команда из TII UAE представила QIMMA — первый лидерборд, ориентированный на качество арабских языковых моделей. В отличие от традиционных рейтингах, QIMMA фокусируется на оценке качества, а не на количестве параметров или производительности на общих бенчмарках. Gemma 4: открытые модели для сложных агентских сценариев Google DeepMind News · 02.04.2026 DeepMind представила Gemma 4 — новую версию своих открытых моделей, позиционируемых как самые мощные на сегодняшний день. Эти модели специально оптимизированы для сложных задач, включая рассуждения и агентские workflows. Gemma 4 предлагает улучшенные возможности в обработке естественного языка, что делает её перспективной для интеграции в ИИ-агентов, требующих высокого уровня интеллектуальных способностей. Gemini 3.1 Flash Live улучшает голосовые взаимодействия Google DeepMind News · 26.03.2026 DeepMind представила новую версию своей голосовой модели Gemini 3.1 Flash Live, которая обещает более естественные и точные голосовые взаимодействия. Новая модель фокусируется на снижении задержек и повышении точности, что делает её более подходящей для реального времени. Это важно для разработчиков ИИ-агентов, так как голосовые интерфейсы становятся всё более популярными в различных приложениях, от виртуальных ассистентов до клиентских сервисов. TurboQuant: алгоритмы для сверхкомпактных моделей The latest research from Google · 24.03.2026 Исследователи Google DeepMind представили TurboQuant — набор алгоритмов для экстремальной компрессии нейросетей. Технология позволяет сократить размер модели в 10–100 раз без потери точности, что критически важно для локального развёртывания ИИ-агентов. Mistral Small 4: компактная модель с улучшенными характеристиками Mistral AI Blog · 16.03.2026 Mistral представила новую версию своей компактной модели Mistral Small 4. Она поддерживает контекстное окно в 128K токенов, что позволяет обрабатывать более длинные тексты и сложные запросы. Новая модель демонстрирует улучшенные показатели в различных задачах, включая понимание естественного языка и генерацию текста. Gemini 3.1 Flash-Lite от DeepMind: скорость и эффективность Google DeepMind News · 03.03.2026 DeepMind представила новую модель Gemini 3.1 Flash-Lite, которая позиционируется как самая быстрая и экономически выгодная в серии Gemini 3. Эта модель разработана для работы в условиях масштабируемой интеллектуальной обработки, что делает её особенно привлекательной для разработчиков ИИ-агентов и сервисов. Gemini 3.1 Pro от DeepMind для сложных задач Google DeepMind News · 19.02.2026 DeepMind представила новую модель Gemini 3.1 Pro, ориентированную на решение сложных задач, где требуется не просто ответ, а глубокий анализ и понимание контекста. Модель демонстрирует улучшенные способности в обработке сложных запросов, что делает её перспективной для применения в различных областях, включая разработку ИИ-агентов. Mistral представила модель Mistral 3 с 200+ миллиардами параметров Mistral AI Blog · 02.12.2025 Mistral анонсировала новую модель Mistral 3, которая включает три версии: Mistral 3 12B, Mistral 3 44B и Mistral 3 200B. Все версии поддерживают работу с 128K контекстными окнами и доступны в режиме инференса на платформе Mistral AI. Запуск модели Isaac 0.1 для восприятия реального мира Replicate's blog · 25.11.2025 Компания Replicate анонсировала доступ к модели Isaac 0.1 на своей платформе. Это лёгкая визуально-языковая модель, ориентированная на восприятие реального мира. Модель разработана для работы с изображениями и текстом, что позволяет ей анализировать и интерпретировать визуальные данные в контексте реальных сценариев. IBM выпустила Granite 4.0 на Replicate Replicate's blog · 01.10.2025 IBM представила обновлённую версию своей модели Granite 4.0 на платформе Replicate. Новая версия включает улучшенные возможности обработки текста и изображений, а также повышенную точность и скорость работы. Mistral представила Codestral 25.08 и полный стек для разработки Mistral AI Blog · 30.07.2025 Mistral анонсировала новую версию модели Codestral 25.08, а также полный стек инструментов для разработки кода. Обновление включает улучшенные возможности генерации и анализа кода, а также интеграцию с другими продуктами Mistral. Как оптимизировали FLUX.1 Kontext с помощью Taylor Seer Replicate's blog · 15.07.2025 Команда Replicate подробно рассказала о том, как оптимизировали модель FLUX.1 Kontext с помощью метода Taylor Seer. Этот подход позволил значительно улучшить производительность модели без потери качества. Новые модели Devstral улучшают кодинговые способности агентов Mistral AI Blog · 10.07.2025 Компания Mistral анонсировала обновлённые модели Devstral, предназначенные для повышения кодинговых способностей ИИ-агентов. Новые версии моделей демонстрируют улучшенную точность и эффективность при выполнении задач программирования, включая написание, рефакторинг и отладку кода. FLUX.1 Kontext: сообщество создаёт новые варианты модели Replicate's blog · 01.06.2025 FLUX.1 Kontext — это модель, разработанная сообществом на базе Replicate. Она представляет собой вариацию FLUX.1, адаптированную для различных задач.