Gemini 3.5 Flash: 83.6% на MCP Atlas, обходит 3.1 Pro и конкурирует с GPT-5.5
Google представила Gemini 3.5 Flash на I/O. Модель показывает 83.6% на агентном бенчмарке MCP Atlas и 76.2% на Terminal-Bench 2.1, обходя предыдущую Pro-версию и конкурируя с GPT-5.5.
Что
Анонсирована новая модель Gemini 3.5 Flash от Google. Презентация состоялась на конференции Google I/O. Модель уже доступна для использования в инструментах разработки Kodacode (VS Code, CLI, JetBrains IDE).
Как
Модель позиционируется как высокопроизводительная и доступная версия для агентных и кодогенерационных задач. Ключевое архитектурное улучшение не раскрыто, но фокус на бенчмарках указывает на оптимизацию под многошаговое выполнение задач в агентных сценариях (MCP Atlas) и работу в терминале (Terminal-Bench).
Цифры
- MCP Atlas (агентные задачи): 83.6%
- Terminal-Bench 2.1: 76.2%
- Finance Agent: 57.9%
В агентных задачах (по показателю MCP Atlas) модель превышает результат Gemini 3.1 Pro и находится на уровне, конкурирующем с GPT-5.5.
Что перенять
Для проектов, где критична производительность в агентных сценариях (многошаговые задачи, взаимодействие с инструментами), Gemini 3.5 Flash стоит рассматривать как вариант с лучшим соотношением цена/производительность по сравнению с Pro-версиями. Бенчмарк MCP Atlas (83.6%) — конкретная цифра для сравнения с другими моделями в вашем стеке.
Для агентных задач (многошаговые, с инструментами) Gemini 3.5 Flash показывает 83.6% на MCP Atlas — это baseline для сравнения с GPT-5.5 и другими моделями при выборе для production-агентов.