Компания Alibaba выпустила обновленную языковую модель Qwen3.8 Max, которая показала значительный прирост производительности в бенчмарках. Модель достигла 56 баллов по шкале Artificial Analysis Intelligence Index, сравнявшись с показателями Claude Opus 4.8. Несмотря на успех, китайская модель Kimi K3 сохраняет лидерство в соотношении цены и качества, опережая новинку по эффективности на 25%.

Обновление Qwen3.8 Max стало существенным скачком для линейки: предыдущая версия, Qwen3.7 Max, оценивалась в 46 баллов. Рост на 10 пунктов демонстрирует ускорение темпов обучения и оптимизации архитектуры моделей Alibaba. Это достижение подтверждает конкурентоспособность китайских разработок на мировом рынке больших языковых моделей, где доминируют американские компании.

Тем не менее, рынок продолжает смещаться в сторону оптимизации затрат на инференс. Kimi K3 остается предпочтительным выбором для задач, требующих высокой производительности при меньших операционных расходах. Разрыв в 25% по стоимости делает выбор между топовыми моделями вопросом не только качества ответов, но и экономической эффективности внедрения в бизнес-процессы.

Ключевые факты

  • Qwen3.8 Max набрала 56 баллов в индексе Artificial Analysis, улучшив результат предшественника на 10 пунктов.
  • Новая модель Alibaba достигла паритета с Claude Opus 4.8 по качественным метрикам.
  • Kimi K3 превосходит Qwen3.8 Max по показателю эффективности, предлагая более высокую производительность при снижении затрат на 25%.
  • Сравнение основано на данных независимого рейтинга Artificial Analysis Intelligence Index.