Инфраструктура для агентов
Safetensors в PyTorch Foundation важно для локального инференса
Safetensors, библиотека для безопасного хранения и загрузки моделей машинного обучения, официально присоединилась к PyTorch Foundation. Это важный шаг для экосистемы ИИ, особенно для разработчиков, работающих с локальным инференсом и развертыванием моделей.
Что такое AI Native Cloud и почему это важно
AI Native Cloud — это инфраструктура, специально разработанная для работы с моделями искусственного интеллекта, а не для устаревших нагрузок. В отличие от традиционных облачных решений, она учитывает особенности ИИ, такие как высокая вычислительная мощность и необходимость обработки больших объемов данных.
Уроки разработки Pyre и переход к архитектуре Pyrefly
Разработчики представили Pyrefly — новую систему для анализа кода, созданную на основе опыта работы с инструментом статического анализа Pyre. Основной фокус сместился с монолитных решений на модульную архитектуру, способную эффективно обрабатывать сложные кодовые базы. Система оптимизирует взаимодействие с графами зависимостей, обеспечивая высокую скорость работы при масштабировании на крупные проекты.
Voxtral TTS: быстрый и адаптивный синтез речи для голосовых агентов
Mistral представила Voxtral TTS — открытую модель синтеза речи с открытыми весами. Она предназначена для создания реалистичного голоса для голосовых агентов. Voxtral работает быстро и может адаптироваться к новым голосам за считанные секунды.
Together AI расширяет сервис файн-тунинга
Together AI добавила в свой сервис файн-тунинга поддержку вызовов инструментов, рассуждений и визуально-языковых моделей. Это позволяет пользователям настраивать модели для работы с внешними сервисами, сложными логическими задачами и обработкой изображений.
Mistral представила Forge для создания корпоративных ИИ-моделей
Mistral анонсировала Forge — систему для разработки передовых ИИ-моделей, интегрированных с внутренними данными компаний. Платформа позволяет предприятиям создавать кастомизированные модели, используя их собственные знания и данные.
Together AI представила инфраструктуру для голосовых агентов
Together AI анонсировала платформу для создания голосовых агентов с задержкой менее 500 мс. Решение включает интеграцию распознавания речи (STT), языковых моделей (LLM) и синтеза речи (TTS) в одном месте.
Together GPU Clusters добавили автоскейлинг и самовосстановление
Together GPU Clusters расширили функционал своей платформы для работы с GPU. Теперь в сервисе доступны автоскейлинг, управление доступом на основе ролей (RBAC), полная наблюдаемость стека и самовосстановление узлов.
Weaviate 1.36: новые возможности для работы с векторами
Weaviate выпустила версию 1.36, которая включает несколько значительных обновлений. В частности, появился новый векторный индекс HFresh в режиме предварительного просмотра. Этот индекс оптимизирован для работы с большими объемами данных и обещает улучшенную производительность при поиске и фильтрации векторов.
Weaviate укрепила основу для агентных систем
В 2025 году Weaviate сосредоточилась на укреплении инфраструктуры для поддержки ИИ-агентов. Компания отказалась от добавления новых фич в пользу улучшения надёжности и масштабируемости платформы.
Railway собрала $100 млн для создания облачной инфраструктуры под ИИ
Компания Railway, базирующаяся в Сан-Франциско, объявила о закрытии раунда финансирования Series B на сумму $100 млн. Инвестиции возглавила TQ Ventures при участии FPV Ventures и других инвесторов. Это значительное вливание капитала направлено на развитие облачной платформы, которая уже привлекала 2 млн разработчиков без маркетинговых затрат.
Утечка памяти в vLLM: как её обнаружили и исправили
Команда Mistral AI обнаружила и устранила утечку памяти в vLLM — популярном фреймворке для ускоренного инференса больших языковых моделей. Проблема заключалась в неправильной обработке промежуточных данных, что приводило к накоплению ненужной информации в оперативной памяти.
Вышел клиент Weaviate для C#
Компания Weaviate анонсировала выход клиента для языка программирования C#.
Anthropic запустила Cowork — десктопный агент для работы с файлами без кода
Anthropic представила новый продукт Cowork, который расширяет возможности инструмента Claude Code, делая их доступными для пользователей без технических навыков. Cowork позволяет агентам работать с файлами на рабочем столе, анализировать и обрабатывать данные без необходимости писать код.
Mistral AI запускает инициативу для развития ИИ в Германии
Французская компания Mistral AI объявила о запуске инициативы «KI für Deutschland», направленной на развитие искусственного интеллекта в Германии. В рамках проекта компания планирует инвестировать в местные стартапы, исследовательские центры и образовательные программы.
Replicate объединяется с Cloudflare для ускорения инференса моделей
Компания Replicate, специализирующаяся на развертывании моделей машинного обучения, вливается в Cloudflare. Это позволит ускорить инференс моделей благодаря глобальной инфраструктуре Cloudflare.
Mistral представила AI Studio для разработки моделей
Mistral AI анонсировала AI Studio — платформу для разработки и развёртывания моделей искусственного интеллекта. Сервис предоставляет инструменты для обучения, тестирования и развёртывания моделей, а также интеграцию с облачными сервисами.
Replicate представила API для поиска моделей
Replicate запустила новый API для поиска моделей и коллекций. Сервис позволяет находить подходящие модели с помощью одного запроса, что упрощает интеграцию ИИ в приложения.
Bria выходит на Replicate с моделями для безопасного ИИ
Компания Replicate анонсировала партнёрство с Bria, что позволит интегрировать в платформу набор коммерческих моделей для генерации и редактирования изображений. Все модели Bria созданы на основе лицензированных данных и ориентированы на корпоративных клиентов и разработчиков, которым важна безопасность и соответствие нормам.
Mistral представила API для создания ИИ-агентов
Mistral анонсировала Mistral Agents API — инструмент для разработки ИИ-агентов. API предоставляет доступ к моделям Mistral, включая Mistral Large, и позволяет создавать агентов с поддержкой памяти, RAG и других функций.
Mamba: новая архитектура для обработки длинных последовательностей
Mamba — это новая архитектура нейросетевых моделей, основанная на State Space Models (SSMs). Она позиционируется как серьезная альтернатива Transformer-моделям, которые, несмотря на свою популярность, сталкиваются с проблемами эффективности при обработке длинных последовательностей.