Модели и релизы

Rio 3.5 Open 397B: открытая модель от правительства Рио-де-Жанейро Hacker News · 13.06.2026 Городское правительство Рио-де-Жанейро представило новую открытую модель Rio 3.5 Open 397B. Это значимое событие, так как модель разработана не частной компанией, а государственным органом. Rio 3.5 Open 397B имеет 397 миллиардов параметров, что делает её одной из крупнейших открытых моделей на сегодняшний день. Anthropic ограничивает доступ к Fable 5 и Mythos 5 для пользователей за пределами США Hacker News · 13.06.2026 Anthropic, один из ведущих разработчиков моделей искусственного интеллекта, объявил о временном ограничении доступа к своим последним моделям Fable 5 и Mythos 5 для пользователей за пределами Соединенных Штатов. Это решение было принято в связи с необходимостью соблюдения международных регуляторных требований и обеспечения безопасности данных. OpenAI добавил контекст документов в WebRTC Audio Session Simon Willison's Weblog · 12.06.2026 Simon Willison, разработчик и блогер, обновил свой инструмент для работы с WebRTC API OpenAI, добавив поддержку документного контекста. Первая версия была создана в декабре 2024 года, чтобы протестировать новый API для работы с аудиомоделями в реальном времени. Google представил Gemini-SQL2 с точностью 80.04% на BIRD leaderboard MarkTechPost · 12.06.2026 Google Research анонсировал Gemini-SQL2 — модель для преобразования текста в SQL-запросы, основанную на Gemini 3.1 Pro. Она показала 80.04% точность выполнения на BIRD single-model leaderboard, что делает её одной из лучших в своей категории. Этот показатель измеряет способность модели генерировать SQL-запросы, которые корректно выполняются на базе данных, и соответствует лучшим результатам в отрасли. Persona-Pruner: как облегчить ИИ-агентов для ролевых игр arXiv · 12.06.2026 Исследователи из MIT и других университетов представили Persona-Pruner — метод оптимизации языковых моделей для ролевых взаимодействий. Технология позволяет значительно сократить размер моделей, сохраняя их способность к ролевой игре. Это особенно важно для систем с множеством NPC (неигровых персонажей), где вычислительные затраты становятся критическими. Почему самоулучшающиеся модели могут деградировать на новых задачах arXiv · 12.06.2026 Исследователи из Arxiv выявили проблему в популярном подходе к самоулучшению визуально-языковых моделей (VLM), основанном на DPO (Direct Preference Optimization). В таких системах «верфикатор» оценивает генерации модели, а на основе лучших и худших примеров происходит обучение. Авторы показали, что этот метод может привести к деградации модели на новых задачах, несмотря на улучшение на обучающих данных. Zyphra представила гибридные модели Zamba2-VL с ускоренным инференсом MarkTechPost · 12.06.2026 Zyphra выпустила семейство открытых визуально-языковых моделей Zamba2-VL с параметрами 1.2B, 2.7B и 7B. Они сочетают архитектуру Mamba2 и Transformer, что позволяет сократить время до первого токена в десять раз по сравнению с аналогами. Claude Fable 5: проактивность как ключевая черта ИИ-агента Simon Willison's Weblog · 11.06.2026 Claude Fable 5 демонстрирует необычайную проактивность в достижении целей, что делает его интересным примером для разработчиков ИИ-агентов. По словам Simon Willison, модель активно использует множество трюков и стратегий, чтобы решить поставленные задачи. Например, при работе с Datasette Agent он самостоятельно выявил и предложил решение для бага с горизонтальной прокруткой в чат-интерфейсе. Influcoder: новый метод атрибуции данных для улучшения качества датасетов arXiv · 11.06.2026 Исследователи представили метод Influcoder, который позволяет оценивать влияние отдельных данных на обучение языковых моделей. Это важно для создания качественных датасетов, так как позволяет выявлять и удалять вредоносные или нерелевантные данные. System 0: новая модель взаимодействия ИИ и человеческого мышления arXiv · 11.06.2026 Новое исследование на arXiv предлагает анализ трёх современных подходов к пониманию влияния ИИ на когнитивные процессы человека: Tri-System Theory, Thinkframes и System 0. Авторы утверждают, что последние два фреймворка охватывают важные аспекты, но System 0 выделяется своей уникальной позицией. Новый метод обнаружения ошибок в цепочках рассуждений LLM arXiv · 11.06.2026 Исследователи из MIT и Университета Карнеги-Меллона предложили новый подход к выявлению ошибок в цепочках рассуждений языковых моделей (LLM) без использования меток. Их метод, основанный на операдной теории, позволяет обнаруживать несоответствия в логических цепочках, которые модели строят при решении сложных задач. Новый метод для эффективной калибровки ансамблей моделей arXiv · 11.06.2026 Исследователи предложили Simplex-Constrained Sparse Bagging (SCSB) — математический фреймворк для пост-обучения ансамблей моделей, таких как Random Forests, Bagged SVMs и Bagged Neural Networks. В традиционных подходах к ансамблированию каждая модель имеет одинаковый вес, что не учитывает их разную точность в разных контекстах. Claude Fable 5: мощь и вызов для разработчиков Simon Willison's Weblog · 09.06.2026 Simon Willison, известный разработчик и эксперт в области ИИ, поделился своими впечатлениями от новой модели Claude Fable 5, выпущенной компанией Anthropic. Он отмечает, что модель демонстрирует выдающиеся способности, но при этом обладает значительными ограничениями, такими как высокая стоимость и медленная скорость работы. Anthropic представила Claude Fable 5 и Mythos 5 Lobsters · 09.06.2026 Anthropic анонсировала новые версии своих моделей — Claude Fable 5 и Mythos 5. Эти модели позиционируются как более мощные и точные по сравнению с предыдущими версиями, с улучшенными способностями к обработке сложных запросов и генерации текста. Cohere представила North Mini Code — модель для разработчиков Hugging Face - Blog · 09.06.2026 Cohere, компания, специализирующаяся на разработке языковых моделей, представила новую модель North Mini Code. Это первая модель в линейке North, предназначенная специально для разработчиков. North Mini Code оптимизирована для работы с кодом и может использоваться в различных задачах, связанных с программированием, включая генерацию, рефакторинг и объяснение кода. DeepMind представила Gemma 4 12B — универсальную мультимодальную модель Google DeepMind News · 09.06.2026 DeepMind анонсировала новую версию своей мультимодальной модели Gemma 4 12B. Это первая модель в линейке Gemma, которая работает без отдельного энкодера для текста и изображений, что делает её более универсальной и эффективной. Локальный запуск Claude Design для создания UI-макетов GitHub · 07.06.2026 Разработчик JimLiu представил проект baoyu-design, позволяющий запускать Claude Design локально в качестве навыка для ИИ-агентов. Это решение даёт возможность создавать полированные UI-макеты, прототипы, презентации и wireframes в виде самостоятельных HTML-файлов, не прибегая к облачному сервису claude.ai/design. Microsoft представил две новые модели ИИ MAI-Thinking-1 и MAI-Code-1-Flash Simon Willison's Weblog · 02.06.2026 Microsoft объявил о выпуске двух новых текстовых моделей ИИ: MAI-Thinking-1 и MAI-Code-1-Flash. MAI-Thinking-1 — это модель для рассуждений с 1 триллионом параметров, из которых 35 миллиардов активны. Она доступна для "выбранных ранних партнеров". MAI-Code-1-Flash, с 137 миллиардами параметров и 5 миллиардами активных, специально разработана для GitHub Copilot и VS Code, чтобы обеспечить высокую производительность и низкую стоимость. Эта модель уже начинает выкатываться для индивидуальных пользователей GitHub Copilot в Visual Studio Code. JoyAI-Echo: генерация длинных аудиовизуальных последовательностей GitHub · 02.06.2026 Команда JD AI представила JoyAI-Echo — фреймворк для генерации длинных аудиовизуальных последовательностей. Это решение позволяет создавать синхронизированные аудио- и видеоконтент, что может быть полезно для разработки ИИ-агентов, работающих с мультисенсорными данными. Mellum2: новая 12-миллиардная модель от JetBrains для локального использования Hugging Face - Blog · 01.06.2026 JetBrains представила Mellum2 — новую 12-миллиардную модель, основанную на архитектуре Mixture-of-Experts (MoE). Эта модель разработана для эффективного локального использования, что делает её особенно интересной для разработчиков ИИ-агентов, которым важна производительность на локальных устройствах. NVIDIA Cosmos 3 для разработки физических моделей ИИ NVIDIA Technical Blog · 01.06.2026 NVIDIA представила Cosmos 3 — фреймворк для создания физических моделей ИИ, которые могут понимать и взаимодействовать с реальным миром. Это особенно важно для роботов, автономных транспортных средств и умных пространств, где ИИ-агенты должны не только анализировать данные, но и принимать решения на основе физических закономерностей. NVIDIA MCG Toolkit для автоматизации документации ИИ-моделей NVIDIA Technical Blog · 29.05.2026 NVIDIA представила MCG Toolkit — инструмент для автоматизации документации ИИ-моделей. Это особенно актуально на фоне ужесточения регуляторных требований, таких как California’s AB-2013 и EU AI Act, которые предъявляют строгие требования к прозрачности и отчетности моделей. OlmoEarth v1.1: новые модели для анализа спутниковых данных Hugging Face - Blog · 19.05.2026 Allen Institute for AI представил обновлённую версию OlmoEarth v1.1 — семейство моделей для обработки и анализа спутниковых данных. Эти модели предназначены для работы с изображениями Земли, полученными с космических аппаратов, и могут использоваться в различных приложениях, включая мониторинг окружающей среды, сельское хозяйство и управление ресурсами. DeepMind представила Gemini Omni Google DeepMind News · 17.05.2026 DeepMind анонсировала новую модель Gemini Omni, которая позиционируется как универсальное решение для широкого спектра задач. Gemini Omni отличается улучшенной производительностью и способностью работать с мультимодальными данными, включая текст, изображения и видео. Это важный шаг в развитии ИИ, так как модель демонстрирует высокий уровень адаптивности и точности в различных сценариях.