Компания DeepSeek представила DeepSeek-V4-Flash-0731 — новую модель из серии V4, ориентированную на выполнение сложных агентных задач. При 304 миллиардах параметров модель демонстрирует высокую производительность, превосходя по ряду бенчмарков более крупные аналоги, такие как MiniMax M3. Эффективная архитектура и агрессивная ценовая политика делают её одним из самых конкурентоспособных решений на рынке LLM.
Модель DeepSeek-V4-Flash оптимизирована для работы в агентных сценариях, где требуется высокая точность рассуждений и способность к многошаговому планированию. Несмотря на внушительный размер в 304 млрд параметров, модель показывает высокую скорость инференса, что подтверждается данными независимых аналитических платформ. В тестах Artificial Analysis она опережает модель MiniMax M3, насчитывающую 428 млрд параметров, что указывает на высокую эффективность обучения и архитектурных решений разработчиков.
Ценообразование модели делает её крайне привлекательной для интеграции в высоконагруженные системы. Стоимость обработки входных данных составляет 0,14 доллара за миллион токенов, а выходных — 0,27 доллара. Такое сочетание производительности и доступности позволяет компаниям масштабировать агентные решения с меньшими затратами на инфраструктуру, чем при использовании аналогичных по мощности проприетарных моделей.
Ключевые факты
- Объем параметров модели составляет 304 миллиарда.
- Стоимость входных токенов — 0,14 доллара за 1 млн, выходных — 0,27 доллара за 1 млн.
- Модель превосходит MiniMax M3 (428 млрд параметров) по результатам независимых тестов Artificial Analysis.
- Вес модели в формате для Hugging Face составляет 167 ГБ.
- Основной фокус релиза сделан на существенном расширении агентных возможностей системы.
