🆕 Новые модели 1 мин чтения

Gemini 3.5 Flash: 83.6% на MCP Atlas, обходит 3.1 Pro и конкурирует с GPT-5.5

Google представила Gemini 3.5 Flash на I/O. Модель показывает 83.6% на агентном бенчмарке MCP Atlas и 76.2% на Terminal-Bench 2.1, обходя предыдущую Pro-версию и конкурируя с GPT-5.5.

Что

Анонсирована новая модель Gemini 3.5 Flash от Google. Презентация состоялась на конференции Google I/O. Модель уже доступна для использования в инструментах разработки Kodacode (VS Code, CLI, JetBrains IDE).

Как

Модель позиционируется как высокопроизводительная и доступная версия для агентных и кодогенерационных задач. Ключевое архитектурное улучшение не раскрыто, но фокус на бенчмарках указывает на оптимизацию под многошаговое выполнение задач в агентных сценариях (MCP Atlas) и работу в терминале (Terminal-Bench).

Цифры

  • MCP Atlas (агентные задачи): 83.6%
  • Terminal-Bench 2.1: 76.2%
  • Finance Agent: 57.9%

В агентных задачах (по показателю MCP Atlas) модель превышает результат Gemini 3.1 Pro и находится на уровне, конкурирующем с GPT-5.5.

Что перенять

Для проектов, где критична производительность в агентных сценариях (многошаговые задачи, взаимодействие с инструментами), Gemini 3.5 Flash стоит рассматривать как вариант с лучшим соотношением цена/производительность по сравнению с Pro-версиями. Бенчмарк MCP Atlas (83.6%) — конкретная цифра для сравнения с другими моделями в вашем стеке.

Для агентных задач (многошаговые, с инструментами) Gemini 3.5 Flash показывает 83.6% на MCP Atlas — это baseline для сравнения с GPT-5.5 и другими моделями при выборе для production-агентов.