Google расширила семейство моделей Gemini, выпустив высокопроизводительную Gemini 3.6 Flash, облегченную версию 3.5 Flash-Lite и специализированную 3.5 Flash Cyber. Новые релизы направлены на оптимизацию баланса между скоростью отклика, вычислительными затратами и качеством генерации, предлагая разработчикам гибкие инструменты для интеграции ИИ в приложения с различными требованиями к задержке и сложности задач.
Флагманская модель Gemini 3.6 Flash получила архитектурные улучшения, которые позволяют обрабатывать длинные контекстные окна с повышенной точностью при сохранении низкой стоимости инференса. Это обновление ориентировано на сценарии, требующие быстрой обработки больших объемов данных в реальном времени, включая сложные агентные системы и аналитические пайплайны.
Версия 3.5 Flash-Lite разработана как наиболее экономичное решение для простых задач, где критически важна минимальная задержка. В свою очередь, модель 3.5 Flash Cyber оптимизирована для специфических задач, связанных с кибербезопасностью и анализом кода, обеспечивая повышенную эффективность при выявлении уязвимостей и автоматизации процессов защиты инфраструктуры.
Ключевые факты
- Gemini 3.6 Flash обеспечивает прирост скорости обработки запросов по сравнению с предыдущим поколением при сохранении точности ответов.
- Gemini 3.5 Flash-Lite позиционируется как наиболее доступная модель в линейке с минимальными требованиями к вычислительным ресурсам.
- Gemini 3.5 Flash Cyber специально обучена для задач анализа безопасности, включая поиск эксплойтов и аудит исходного кода.
- Все новые модели уже доступны для разработчиков через API в Google AI Studio и Vertex AI.