Hetzner представил API для запуска LLM в рамках своей новой экспериментальной платформы. Сервис предоставляет доступ к популярным открытым моделям через стандартный интерфейс, совместимый с OpenAI API. Решение ориентировано на разработчиков, которым требуется масштабируемая инфраструктура для инференса без необходимости самостоятельной настройки серверов, управления GPU-контейнерами и сложной оркестрации вычислительных мощностей в облаке.

Платформа позволяет интегрировать современные языковые модели в приложения, используя привычные инструменты разработки. Инфраструктура Hetzner обеспечивает низкие задержки и высокую пропускную способность, что критично для агентных систем и RAG-решений, требующих оперативного ответа от модели. Использование API избавляет от накладных расходов на обслуживание собственного стека для инференса, позволяя сфокусироваться на логике работы агентов.

Экспериментальный подход компании предполагает постепенное расширение списка доступных моделей и оптимизацию производительности под специфические задачи. Разработчики могут подключать сервис к существующим фреймворкам для оркестрации агентов, используя стандартные библиотеки для работы с HTTP-запросами, что упрощает миграцию и тестирование различных конфигураций моделей в продакшн-среде.

Ключевые факты

  • Сервис предоставляет API, совместимый со стандартом OpenAI, для упрощения интеграции.
  • Платформа ориентирована на запуск открытых моделей (open-weights) на мощностях Hetzner.
  • Доступ к API реализован через экспериментальный раздел портала Hetzner.
  • Решение предназначено для снижения порога входа при развертывании ИИ-сервисов в облачной инфраструктуре.