Модели и релизы

Sakana AI представила коммерческий продукт Sakana Marlin Hacker News · 15.06.2026 Sakana AI, компания, специализирующаяся на разработке ИИ-агентов, объявила о запуске своего первого коммерческого продукта — Sakana Marlin. Этот шаг является важным для рынка ИИ-агентов, так как демонстрирует готовность компаний выводить свои решения на коммерческий уровень. Новый подход к долгосрочному прогнозированию временных рядов arXiv · 15.06.2026 Исследователи из Arxiv представили новый метод HAMON, который использует пассивное оптическое смешивание последовательностей для долгосрочного прогнозирования временных рядов. Этот подход демонстрирует, что простые линейные и частотные модели могут быть конкурентоспособными в задачах долгосрочного прогнозирования, что ставит под сомнение необходимость использования сложных трансформерных моделей в этом контексте. Локальные модели для кодинга вместо Claude/GPT Hacker News · 15.06.2026 На Hacker News обсуждают возможность замены облачных моделей, таких как Claude и GPT, на локальные аналоги для ежедневной работы с кодом. Пользователи делятся опытом использования локальных моделей, таких как Code Llama, Starcoder и другие, которые могут работать на собственных серверах или мощных ноутбуках. Как улучшить точность небольших моделей кода без переобучения arXiv · 15.06.2026 Исследователи из DeepSeek и других организаций представили новый подход к повышению точности небольших моделей кода без необходимости их переобучения. В работе рассматриваются так называемые «замороженные» модели кода (с параметрами ≤45 миллионов), которые не поддаются стандартным методам улучшения качества вывода. Как NVIDIA ускорила обучение MoE-моделей на 30% NVIDIA Technical Blog · 15.06.2026 NVIDIA представила новые методы оптимизации обучения Mixture-of-Experts (MoE) моделей, которые стали ключевым компонентом современных ИИ-систем. Исследователи компании разработали продвинутые ядра слияния (fusion kernels), которые позволяют значительно ускорить процесс обучения. Natural Language Autoencoders объясняют активации LLM Hacker News · 15.06.2026 Исследователи из Transformer Circuits опубликовали работу, в которой предложили использовать Natural Language Autoencoders (NLA) для интерпретации активаций больших языковых моделей (LLM). NLA — это автоэнкодеры, которые преобразуют активации нейронов в естественный язык, делая их более понятными для разработчиков. Apple представила третье поколение foundation models Hacker News · 15.06.2026 Apple анонсировала третье поколение своих foundation models, которые стали более мощными и универсальными. Новые модели демонстрируют улучшенные возможности в обработке естественного языка, компьютерном зрении и других задачах машинного обучения. Это важный шаг для компании, которая активно развивает свои ИИ-капabilities, особенно в контексте интеграции с устройствами и сервисами Apple. Как выглядит локальная инфраструктура LLM у разработчиков Hacker News · 15.06.2026 На Hacker News обсуждают, как разработчики настраивают локальные LLM для работы. Вопрос задал пользователь, интересующийся, какие модели, оборудование и инструменты используют другие участники сообщества. Это важно для Jarv, так как локальный запуск моделей — ключевой элемент для создания автономных агентов, которые могут работать без облачных сервисов. Gemini 3.5 Flash демонстрирует высокую скорость и качество Hacker News · 15.06.2026 Google представила новую версию своей модели Gemini — Gemini 3.5 Flash. Эта модель отличается не только высокой скоростью работы, но и качеством вывода, что делает её конкурентоспособной на рынке ИИ-решений. Gemini 3.5 Flash оптимизирована для работы на устройствах с ограниченными вычислительными ресурсами, что позволяет использовать её в мобильных и встраиваемых системах. Guardian Angels: персонализация LLM для повышения продуктивности и безопасности Hacker News · 14.06.2026 Проект Guardian Angels представляет собой фреймворк для персонализации больших языковых моделей (LLM) с целью повышения продуктивности и безопасности. Разработчики предлагают использовать индивидуальные настройки и адаптацию моделей под конкретные задачи пользователей, что может быть полезно для создания ИИ-агентов. Brownian Kernel Ladders: новый подход к иерархическим представлениям arXiv · 14.06.2026 Исследователи представили новый метод для построения иерархических представлений в статистическом обучении — Brownian Kernel Ladders (BKLs). Это рекурсивно определённая иерархия интегральных пространств, генерируемых через Brownian-kernel интегральные конструкции. Начиная с линейных функционалов, каждый уровень BKL расширяет пространство функций, сохраняя при этом математически строгую структуру. Knowledge Trap защищает модели от кражи знаний через ловушки arXiv · 14.06.2026 Исследователи из MIT и других университетов предложили новый способ защиты языковых моделей от кражи знаний. В статье, опубликованной на arXiv, они описывают метод Knowledge Trap, который использует "медовые ловушки" для знаний (Honeypot Knowledge Graph, HKG) и хлебные крошки для направления атак на нерелевантные данные. Fusion превзошла Frontier по производительности Hacker News · 14.06.2026 Команда OpenRouter представила модель Fusion, которая превзошла по производительности модель Frontier от Mistral AI. В тестах Fusion показала лучшие результаты в различных задачах, включая понимание контекста и генерацию текста. Это важно для разработчиков ИИ-агентов, так как новые модели могут значительно улучшить качество взаимодействия с пользователями и выполнение сложных задач. Как оптимально обрезать экспертов в моделях MoE arXiv · 14.06.2026 Исследователи предложили унифицированный подход к обрезке экспертов в моделях Mixture-of-Experts (MoE), что может существенно снизить память и вычислительные затраты при развёртывании таких моделей. В статье, опубликованной на arXiv, авторы отмечают, что хотя MoE-модели эффективно распределяют вычисления между экспертами, их развёртывание всё равно требует хранения полного пула экспертов. Это создаёт проблемы с памятью, особенно при использовании в агентных системах, где важна эффективность инференса. Исследование: VLA-модели плохо работают с неанглийскими языками arXiv · 14.06.2026 Недавнее исследование, опубликованное на arXiv, раскрывает значительный пробел в способности Vision-Language-Action (VLA) моделей работать с языками, отличными от английского. Эти модели, которые демонстрируют многообещающие возможности в обучении универсальных политик роботов на основе мультимодальных данных, в основном обучаются и оцениваются на английских инструкциях. Это оставляет их способность понимать и выполнять команды на других языках практически неизученной. Как мировые модели дают ИИ-агентам «первое лицо» Hacker News · 14.06.2026 В новом видео исследователи обсуждают концепцию мировых моделей (World Models) и их роль в формировании «первого лица» у ИИ-агентов. Мировые модели — это подход, при котором ИИ создает внутреннюю репрезентацию окружающего мира, что позволяет ему действовать более автономно и адаптивно. Исследование: динамика развития языковых моделей Hacker News · 14.06.2026 Исследователи из Artificial Analysis провели анализ динамики развития языковых моделей, включая модели от Anthropic и Mistral. В исследовании рассматривается, как меняется интеллект моделей с течением времени, что позволяет лучше понять их эволюцию и потенциал. Rio 3.5 Open 397B: открытая модель от правительства Рио-де-Жанейро Hacker News · 13.06.2026 Городское правительство Рио-де-Жанейро представило новую открытую модель Rio 3.5 Open 397B. Это значимое событие, так как модель разработана не частной компанией, а государственным органом. Rio 3.5 Open 397B имеет 397 миллиардов параметров, что делает её одной из крупнейших открытых моделей на сегодняшний день. Anthropic ограничивает доступ к Fable 5 и Mythos 5 для пользователей за пределами США Hacker News · 13.06.2026 Anthropic, один из ведущих разработчиков моделей искусственного интеллекта, объявил о временном ограничении доступа к своим последним моделям Fable 5 и Mythos 5 для пользователей за пределами Соединенных Штатов. Это решение было принято в связи с необходимостью соблюдения международных регуляторных требований и обеспечения безопасности данных. OpenAI добавил контекст документов в WebRTC Audio Session Simon Willison's Weblog · 12.06.2026 Simon Willison, разработчик и блогер, обновил свой инструмент для работы с WebRTC API OpenAI, добавив поддержку документного контекста. Первая версия была создана в декабре 2024 года, чтобы протестировать новый API для работы с аудиомоделями в реальном времени. Google представил Gemini-SQL2 с точностью 80.04% на BIRD leaderboard MarkTechPost · 12.06.2026 Google Research анонсировал Gemini-SQL2 — модель для преобразования текста в SQL-запросы, основанную на Gemini 3.1 Pro. Она показала 80.04% точность выполнения на BIRD single-model leaderboard, что делает её одной из лучших в своей категории. Этот показатель измеряет способность модели генерировать SQL-запросы, которые корректно выполняются на базе данных, и соответствует лучшим результатам в отрасли. Persona-Pruner: как облегчить ИИ-агентов для ролевых игр arXiv · 12.06.2026 Исследователи из MIT и других университетов представили Persona-Pruner — метод оптимизации языковых моделей для ролевых взаимодействий. Технология позволяет значительно сократить размер моделей, сохраняя их способность к ролевой игре. Это особенно важно для систем с множеством NPC (неигровых персонажей), где вычислительные затраты становятся критическими. Почему самоулучшающиеся модели могут деградировать на новых задачах arXiv · 12.06.2026 Исследователи из Arxiv выявили проблему в популярном подходе к самоулучшению визуально-языковых моделей (VLM), основанном на DPO (Direct Preference Optimization). В таких системах «верфикатор» оценивает генерации модели, а на основе лучших и худших примеров происходит обучение. Авторы показали, что этот метод может привести к деградации модели на новых задачах, несмотря на улучшение на обучающих данных. Zyphra представила гибридные модели Zamba2-VL с ускоренным инференсом MarkTechPost · 12.06.2026 Zyphra выпустила семейство открытых визуально-языковых моделей Zamba2-VL с параметрами 1.2B, 2.7B и 7B. Они сочетают архитектуру Mamba2 и Transformer, что позволяет сократить время до первого токена в десять раз по сравнению с аналогами.