Alibaba представила свою самую мощную модель Qwen3.8-Max, насчитывающую 2,4 триллиона параметров, в то время как DeepSeek привлекает рынок агрессивным снижением цен на инференс своей модели V4-Flash. Эти релизы знаменуют новый этап в китайской гонке ИИ-технологий, где фокус смещается с простого увеличения вычислительных мощностей на оптимизацию архитектуры и радикальное удешевление доступа к нейросетям.

Модель Qwen3.8-Max построена на архитектуре Mixture-of-Experts (MoE). Это позволяет системе эффективно распределять нагрузку: при обработке каждого конкретного запроса активируется лишь малая часть параметров, что значительно снижает затраты на вычисления. Такой подход становится отраслевым стандартом для крупных языковых моделей, стремящихся к высокой производительности без чрезмерного расхода ресурсов.

Параллельно с этим DeepSeek активно демпингует на рынке инференса, предлагая тарифы, которые оказываются ниже, чем у большинства существующих аналогов. Стратегия компании направлена на захват доли рынка за счет доступности API, что заставляет крупных игроков, таких как Alibaba, пересматривать свои модели ценообразования и ускорять внедрение энергоэффективных архитектурных решений.

Ключевые факты

  • Qwen3.8-Max от Alibaba содержит 2,4 триллиона параметров, из которых в процессе работы активируются только 95 миллиардов.
  • Модель использует архитектуру Mixture-of-Experts (MoE) для оптимизации потребления вычислительных ресурсов.
  • DeepSeek V4-Flash позиционируется как решение с одной из самых низких стоимостей инференса на рынке.
  • Китайские разработчики делают ставку на сочетание высокой сложности моделей и снижения барьеров для их коммерческого использования.