Инфраструктура для агентов

Safetensors в PyTorch Foundation важно для локального инференса Hugging Face - Blog · 07.04.2026 Safetensors, библиотека для безопасного хранения и загрузки моделей машинного обучения, официально присоединилась к PyTorch Foundation. Это важный шаг для экосистемы ИИ, особенно для разработчиков, работающих с локальным инференсом и развертыванием моделей. Что такое AI Native Cloud и почему это важно Together.ai · 06.04.2026 AI Native Cloud — это инфраструктура, специально разработанная для работы с моделями искусственного интеллекта, а не для устаревших нагрузок. В отличие от традиционных облачных решений, она учитывает особенности ИИ, такие как высокая вычислительная мощность и необходимость обработки больших объемов данных. Уроки разработки Pyre и переход к архитектуре Pyrefly Lobsters · 24.03.2026 Разработчики представили Pyrefly — новую систему для анализа кода, созданную на основе опыта работы с инструментом статического анализа Pyre. Основной фокус сместился с монолитных решений на модульную архитектуру, способную эффективно обрабатывать сложные кодовые базы. Система оптимизирует взаимодействие с графами зависимостей, обеспечивая высокую скорость работы при масштабировании на крупные проекты. Voxtral TTS: быстрый и адаптивный синтез речи для голосовых агентов Mistral Blog · 23.03.2026 Mistral представила Voxtral TTS — открытую модель синтеза речи с открытыми весами. Она предназначена для создания реалистичного голоса для голосовых агентов. Voxtral работает быстро и может адаптироваться к новым голосам за считанные секунды. Together AI расширяет сервис файн-тунинга Together.ai · 17.03.2026 Together AI добавила в свой сервис файн-тунинга поддержку вызовов инструментов, рассуждений и визуально-языковых моделей. Это позволяет пользователям настраивать модели для работы с внешними сервисами, сложными логическими задачами и обработкой изображений. Mistral представила Forge для создания корпоративных ИИ-моделей Mistral Blog · 17.03.2026 Mistral анонсировала Forge — систему для разработки передовых ИИ-моделей, интегрированных с внутренними данными компаний. Платформа позволяет предприятиям создавать кастомизированные модели, используя их собственные знания и данные. Together AI представила инфраструктуру для голосовых агентов Together.ai · 11.03.2026 Together AI анонсировала платформу для создания голосовых агентов с задержкой менее 500 мс. Решение включает интеграцию распознавания речи (STT), языковых моделей (LLM) и синтеза речи (TTS) в одном месте. Together GPU Clusters добавили автоскейлинг и самовосстановление Together.ai · 09.03.2026 Together GPU Clusters расширили функционал своей платформы для работы с GPU. Теперь в сервисе доступны автоскейлинг, управление доступом на основе ролей (RBAC), полная наблюдаемость стека и самовосстановление узлов. Weaviate 1.36: новые возможности для работы с векторами Weaviate Blog · 02.03.2026 Weaviate выпустила версию 1.36, которая включает несколько значительных обновлений. В частности, появился новый векторный индекс HFresh в режиме предварительного просмотра. Этот индекс оптимизирован для работы с большими объемами данных и обещает улучшенную производительность при поиске и фильтрации векторов. Weaviate укрепила основу для агентных систем Weaviate Blog · 28.01.2026 В 2025 году Weaviate сосредоточилась на укреплении инфраструктуры для поддержки ИИ-агентов. Компания отказалась от добавления новых фич в пользу улучшения надёжности и масштабируемости платформы. Railway собрала $100 млн для создания облачной инфраструктуры под ИИ AI | VentureBeat · 22.01.2026 Компания Railway, базирующаяся в Сан-Франциско, объявила о закрытии раунда финансирования Series B на сумму $100 млн. Инвестиции возглавила TQ Ventures при участии FPV Ventures и других инвесторов. Это значительное вливание капитала направлено на развитие облачной платформы, которая уже привлекала 2 млн разработчиков без маркетинговых затрат. Утечка памяти в vLLM: как её обнаружили и исправили Mistral Blog · 21.01.2026 Команда Mistral AI обнаружила и устранила утечку памяти в vLLM — популярном фреймворке для ускоренного инференса больших языковых моделей. Проблема заключалась в неправильной обработке промежуточных данных, что приводило к накоплению ненужной информации в оперативной памяти. Вышел клиент Weaviate для C# Weaviate Blog · 14.01.2026 Компания Weaviate анонсировала выход клиента для языка программирования C#. Anthropic запустила Cowork — десктопный агент для работы с файлами без кода AI | VentureBeat · 12.01.2026 Anthropic представила новый продукт Cowork, который расширяет возможности инструмента Claude Code, делая их доступными для пользователей без технических навыков. Cowork позволяет агентам работать с файлами на рабочем столе, анализировать и обрабатывать данные без необходимости писать код. Mistral AI запускает инициативу для развития ИИ в Германии Mistral Blog · 19.11.2025 Французская компания Mistral AI объявила о запуске инициативы «KI für Deutschland», направленной на развитие искусственного интеллекта в Германии. В рамках проекта компания планирует инвестировать в местные стартапы, исследовательские центры и образовательные программы. Replicate объединяется с Cloudflare для ускорения инференса моделей Replicate's blog · 16.11.2025 Компания Replicate, специализирующаяся на развертывании моделей машинного обучения, вливается в Cloudflare. Это позволит ускорить инференс моделей благодаря глобальной инфраструктуре Cloudflare. Mistral представила AI Studio для разработки моделей Mistral Blog · 24.10.2025 Mistral AI анонсировала AI Studio — платформу для разработки и развёртывания моделей искусственного интеллекта. Сервис предоставляет инструменты для обучения, тестирования и развёртывания моделей, а также интеграцию с облачными сервисами. Replicate представила API для поиска моделей Replicate's blog · 16.09.2025 Replicate запустила новый API для поиска моделей и коллекций. Сервис позволяет находить подходящие модели с помощью одного запроса, что упрощает интеграцию ИИ в приложения. Bria выходит на Replicate с моделями для безопасного ИИ Replicate's blog · 17.07.2025 Компания Replicate анонсировала партнёрство с Bria, что позволит интегрировать в платформу набор коммерческих моделей для генерации и редактирования изображений. Все модели Bria созданы на основе лицензированных данных и ориентированы на корпоративных клиентов и разработчиков, которым важна безопасность и соответствие нормам. Mistral представила API для создания ИИ-агентов Mistral Blog · 27.05.2025 Mistral анонсировала Mistral Agents API — инструмент для разработки ИИ-агентов. API предоставляет доступ к моделям Mistral, включая Mistral Large, и позволяет создавать агентов с поддержкой памяти, RAG и других функций. Mamba: новая архитектура для обработки длинных последовательностей The Gradient · 27.03.2024 Mamba — это новая архитектура нейросетевых моделей, основанная на State Space Models (SSMs). Она позиционируется как серьезная альтернатива Transformer-моделям, которые, несмотря на свою популярность, сталкиваются с проблемами эффективности при обработке длинных последовательностей.