Как начать пользоваться Gemini 3.1 Pro: самая умная модель Google
Gemini 3.1 Pro вышел в феврале 2026 года и занял лидирующие позиции в мировых рейтингах. Разбираем, что умеет эта модель и как получить к ней доступ.
Статус Gemini 3.5 Pro (начало июля 2026). Gemini 3.5 Pro получил разрешение на публичный запуск, но точная дата GA не объявлена. Для пользователей Gemini 3.1 Pro: повышены лимиты запросов для подписчиков AI Pro и Ultra. Модель стала доступна в NotebookLM для Professional и Business подписчиков. Добавлен параметр thinking_level со значением MEDIUM в Gemini API.
Gemini 3.1 Pro: как пользоваться самой умной моделью Google
Обновление: Gemini 3.5 Flash превзошёл 3.1 Pro (2026)
Google I/O 2026 (19 мая): выпущен Gemini 3.5 Flash, который превзошёл Gemini 3.1 Pro по ключевым бенчмаркам при вдвое меньшей стоимости. Google официально рекомендует 3.5 Flash как дефолтную модель для большинства задач начиная с июня 2026 года. Тем не менее Gemini 3.1 Pro сохраняет преимущество в ряде специализированных сценариев -- об этом подробнее ниже.
Когда всё ещё использовать Gemini 3.1 Pro: задачи с многошаговым планированием, где модель глубже удерживает контекст всего плана; технический анализ с максимальной точностью; задачи, где стоимость некритична, но нужна лучшая качество рассуждения; исследования, требующие полного использования 1M-токенного окна с глубоким пониманием связей.
Переход на 3.5 Flash: если вы используете 3.1 Pro через API или в промптах, рассмотрите A/B тест с 3.5 Flash. В большинстве сценариев (чат, ответы на вопросы, краткое изложение, простой код) разницы в качестве практически нет, а скорость и стоимость существенно лучше. Пошаговый план перехода -- в разделе «Миграция» ниже.
Что такое Gemini 3.1 Pro
Gemini 3.1 Pro -- флагманская языковая модель Google, выпущенная 19 февраля 2026 года. Модель показывает значительный прирост в сложном рассуждении: результат на ARC-AGI-2 составил 77,1%, что более чем вдвое превышает результат предыдущего поколения. Это делает её одной из самых точных моделей для задач, требующих глубокого многоуровневого анализа.
Контекстное окно сохранено на уровне 1 миллиона токенов, но максимальный объем ответа вырос до 65 536 токенов -- раньше длинные ответы усекались на середине. Модель обрабатывает текст, аудио, изображения, видео и документы в рамках единого мультимодального пайплайна без переключения между разными модулями.
Новые возможности по сравнению с Gemini 3 Pro
Улучшенное рассуждение: модель существенно лучше справляется с задачами, требующими нескольких шагов логического вывода. Это проявляется в математике, программировании и анализе сложных документов с множеством взаимосвязанных фактов.
Агентные возможности: Gemini 3.1 обновляет голосового ассистента Google Home с поддержкой сложных многошаговых команд. Модель может самостоятельно планировать и выполнять цепочки действий, координируя несколько инструментов одновременно.
Генерация и рендеринг SVG: Gemini 3.1 Pro может создавать, анимировать и визуально отображать SVG-графику и 3D-код непосредственно из текстовых описаний -- функциональность, редко встречающаяся у конкурентов на данном уровне точности.
Расширенный вывод: 65 536 токенов на ответ открывает новые возможности для работы с длинными документами, полными кодовыми базами и развернутым анализом. Раньше модели обрезали вывод примерно на 8 000-16 000 токенах.
Сравнение Gemini 3.1 Pro и 3.5 Flash
Понимание различий между этими двумя моделями помогает выбрать правильную для каждой задачи. Обе модели поддерживают 1M-токенный контекст и мультимодальный ввод, но отличаются по скорости, стоимости и глубине рассуждения.
| Характеристика | Gemini 3.1 Pro | Gemini 3.5 Flash |
|---|---|---|
| Контекстное окно | 1 миллион токенов | 1 миллион токенов |
| Макс. объём ответа | 65 536 токенов | 32 768 токенов |
| Скорость ответа | Медленнее (глубокое рассуждение) | Примерно вдвое быстрее |
| Стоимость | Выше | Примерно вдвое дешевле |
| Рассуждение (ARC-AGI-2) | 77,1% | Превышает 3.1 Pro на ключевых бенчмарках |
| Лучший вариант для | Сложный анализ, планирование, точность | Чат, код, изложение, скорость важнее всего |
Как получить доступ: приложение Gemini vs API
Через приложение Gemini (gemini.google.com) -- без кода: это самый простой путь. Шаг 1 -- перейдите на gemini.google.com и войдите в аккаунт Google. Шаг 2 -- оформите подписку Google AI Pro или Ultra (Gemini 3.1 Pro недоступен на бесплатном тарифе, актуальные цены на одноимённой странице Google). Шаг 3 -- в верхней части интерфейса нажмите на название текущей модели и выберите Gemini 3.1 Pro из выпадающего меню. Шаг 4 -- начните диалог: загружайте файлы через значок скрепки, вставляйте текст или задавайте вопросы напрямую.
Через Gemini API (Google AI Studio) -- для разработчиков: Шаг 1 -- зайдите на aistudio.google.com и войдите под аккаунтом Google. Шаг 2 -- создайте API-ключ в разделе «Get API key» (бесплатный тариф с ограниченными квотами). Шаг 3 -- установите SDK командой pip install google-generativeai. Шаг 4 -- в коде используйте идентификатор модели gemini-3.1-pro. Модель находится в статусе Preview с ограниченными квотами; для продакшена используйте Vertex AI.
Через Vertex AI: корпоративный доступ с расширенными возможностями управления, соблюдением требований безопасности и интеграцией с Google Cloud. Требует Google Cloud аккаунта и настройки проекта. Идентификатор модели: gemini-3.1-pro. Актуальные тарифы доступны на cloud.google.com/vertex-ai.
Через NotebookLM: Gemini 3.1 Pro доступен как базовая модель для анализа документов и исследовательской работы в NotebookLM. С июня 2026 года модель доступна пользователям NotebookLM Pro и NotebookLM Business -- это самый удобный способ для работы с большими PDF и исследовательскими корпусами без написания кода.
Практические сценарии, где Gemini 3.1 Pro выигрывает
Хотя Gemini 3.5 Flash быстрее и дешевле, есть конкретные случаи, когда 3.1 Pro даёт ощутимо лучший результат:
Многошаговое планирование с зависимостями: когда нужно создать план из 10+ взаимосвязанных шагов, учесть ограничения и зависимости, 3.1 Pro удерживает полный контекст задачи на всём протяжении работы. Примеры: написание технического задания для большого проекта, составление подробного учебного курса с нарастающей сложностью, разработка бизнес-стратегии с несколькими сценариями развития.
Технический анализ с максимальной точностью: отладка сложных распределённых систем, юридический анализ объёмных договоров с поиском противоречий, финансовое моделирование -- задачи, где цена ошибки высока и скорость вторична. Здесь вариант «медленнее и дороже, но точнее» является правильным выбором.
Работа с очень длинными документами: при загрузке документа на 500+ страниц 3.1 Pro сохраняет более глубокое понимание смысловых связей между разными разделами. Оба варианта поддерживают 1M токенов, но 3.1 Pro лучше использует весь контекст для сложных вопросов о структуре документа.
Создание SVG и сложной инфографики: генерация векторной графики с точными координатами, анимированных SVG-элементов или интерактивного 3D-кода -- задача, в которой 3.1 Pro демонстрирует значительное преимущество перед 3.5 Flash.
Практические примеры использования
Анализ длинных документов: загрузите PDF объёмом сотни страниц и задавайте конкретные вопросы. Благодаря миллионному контексту модель удерживает весь документ в памяти, не теряя деталей из начала. Попробуйте: загрузите годовой отчёт компании и попросите выявить противоречия между разными разделами.
Работа с кодом: загрузите репозиторий или вставьте тысячи строк кода. Попросите найти потенциальные уязвимости, объяснить архитектуру, написать документацию или провести рефакторинг с учётом всего контекста проекта. Модель удерживает имена функций, зависимости и паттерны на протяжении всего диалога.
Создание SVG и инфографики: опишите нужную иллюстрацию текстом, и модель сгенерирует рабочий SVG-код, который можно сразу использовать на сайте или в дизайн-инструменте. Gemini 3.1 Pro поддерживает анимированные SVG и интерактивные элементы.
Мультимодальный анализ: загружайте одновременно текстовые, визуальные и аудиоматериалы для комплексного анализа -- например, транскрипт встречи, слайды презентации и запись аудио. Модель связывает информацию из разных форматов и выдаёт единый структурированный вывод.
Код: Python API запрос к Gemini 3.1 Pro
Базовый пример подключения через google-generativeai SDK. Перед запуском убедитесь, что у вас есть API-ключ из aistudio.google.com:
import google.generativeai as genai
genai.configure(api_key='YOUR_API_KEY')
model = genai.GenerativeModel(
model_name='gemini-3.1-pro',
generation_config={
'max_output_tokens': 65536,
'temperature': 0.7,
}
)
response = model.generate_content(
'Проанализируй архитектуру микросервисного приложения '
'и предложи план оптимизации'
)
print(response.text)Для управления глубиной рассуждения используйте параметр thinking_level: значение HIGH активирует максимальную точность (медленнее), MEDIUM -- баланс скорости и качества (по умолчанию), LOW -- быстрые ответы на простые запросы.
Параметр thinking_level: управление глубиной рассуждения
Gemini 3.1 Pro поддерживает параметр thinking_level, который позволяет управлять тем, насколько глубоко модель рассуждает перед ответом. Доступные значения: LOW (быстрый ответ, минимальное рассуждение -- для простых задач), MEDIUM (по умолчанию, баланс скорости и качества) и HIGH (максимальная глубина, медленнее, дороже -- для самых сложных задач). Это уникальная возможность Gemini 3.1 Pro, которой нет у большинства конкурентов.
Когда использовать каждый уровень: LOW -- для простых фактических вопросов и быстрых ответов в чат-ботах; MEDIUM -- для большинства профессиональных задач (анализ документов, написание текстов, программирование средней сложности); HIGH -- для задач на уровне PhD: доказательство теорем, архитектурный анализ больших систем, сложные юридические или финансовые выводы с перекрёстными проверками.
Миграция с Gemini 3.1 Pro на 3.5 Flash
Если вы уже используете Gemini 3.1 Pro и хотите перейти на 3.5 Flash ради скорости и экономии, следуйте этому порядку:
Шаг 1: A/B тест. Возьмите 10-20 типичных запросов из вашего сценария и прогоните через обе модели. Сравните качество ответов -- для многих задач разница минимальна или отсутствует вовсе.
Шаг 2: Смените идентификатор модели. В коде замените 'gemini-3.1-pro' на 'gemini-3.5-flash'. Оба используют один и тот же SDK и формат запросов -- никаких других изменений не требуется.
Шаг 3: Настройте thinking_level. 3.5 Flash тоже поддерживает этот параметр. Для сложных задач, где раньше использовали 3.1 Pro с HIGH, попробуйте 3.5 Flash с HIGH -- результат может оказаться сопоставимым при меньшей стоимости.
Шаг 4: Оставьте 3.1 Pro для исключений. После теста вы, скорее всего, обнаружите несколько типов задач, где 3.1 Pro всё же лучше. Реализуйте простую маршрутизацию: направляйте большинство запросов в 3.5 Flash, а задачи с многошаговым планированием или требующие максимальной точности -- в 3.1 Pro.
Gemini 3.5 Pro: что ждет пользователей 3.1 Pro
Gemini 3.5 Pro - следующий шаг после Gemini 3.1 Pro, анонсированный на Google I/O 19 мая 2026 года. Ключевые характеристики нового поколения: контекстное окно 2 миллиона токенов (в 2 раза больше, чем у 3.1 Pro), режим Deep Think (расширенное многошаговое рассуждение для особо сложных задач), улучшенные показатели на аналитических и исследовательских бенчмарках. Путь апгрейда для пользователей 3.1 Pro: на момент написания 3.5 Pro доступен в ограниченном Vertex AI preview - форма ожидания на cloud.google.com/gemini. До GA рекомендуется: для большинства задач - Gemini 3.5 Flash (быстрее и дешевле при сопоставимом качестве), для задач с максимальной точностью - Gemini 3.1 Pro. Следите за обновлениями на ai.google.dev.
Ограничения и особенности
Статус Preview означает, что Google может менять характеристики модели, квоты и ценообразование. Для производственных систем рекомендуется дождаться General Availability или использовать Vertex AI, где условия сервиса стабильнее.
Большой контекст влияет на скорость и стоимость: обработка миллиона токенов занимает значительное время и тарифицируется по количеству токенов. Для простых задач Gemini Flash -- более быстрый и экономичный вариант.
Gemini 3.5 Pro: статус на июнь 2026. По состоянию на начало июня 2026 года Gemini 3.5 Pro остаётся в ограниченном Vertex preview -- GA не объявлен. Google на I/O заявил «дайте нам до следующего квартала». Пока Gemini 3.5 Flash -- единственная широко доступная модель поколения 3.5.
С июня 2026 года Gemini 3.5 Flash включён по умолчанию для всех пользователей Gemini Enterprise. Корпоративные клиенты, использовавшие 3.1 Pro как дефолтную модель, теперь должны явно указывать идентификатор gemini-3.1-pro для продолжения работы с этой версией.
Обновления июня 2026: Модели Gemini 3.1 Pro Image и Flash Image теперь в общем доступе (GA). Добавлен параметр thinking_level со значением MEDIUM для настройки глубины рассуждений. Gemini 3.1 Pro доступен в NotebookLM Pro и NotebookLM Business.
Gemini 3.5 Flash Computer Use (24 июня 2026, публичный preview): Google запустил возможность нативного управления компьютером через Gemini API. Модель обеспечивает автоматизацию браузеров и настольных приложений, перемещение файлов. Результат на тесте OSWorld-Verified: 78.4%. Gemini 3.5 Pro остается в ограниченном preview на Vertex AI.
Этот материал подготовлен командой AI-агентов AravanaAI и проверен главным редактором.
Хотите получать подобные материалы раньше?
Aravana Intelligence — авторская аналитика и закрытый круг для тех, кто думает на шаг вперёд.
Узнать про IntelligenceНе пропускайте важное
Еженедельный дайджест Aravana — ключевые события в AI, робототехнике и longevity.
Как начать пользоваться Agno: Python-фреймворк для создания AI-агентов
Agno (бывший phidata) - один из самых популярных Python-фреймворков для построения AI-агентов с 39k+ звезд на GitHub. Пошаговый гайд: установка, первый агент за 5 минут, мультиагентные команды и деплой в продакшн.
Seedance 2.5: как начать пользоваться генератором видео от ByteDance
Seedance 2.5 от ByteDance генерирует нативное 30-секундное видео в один проход, принимает до 50 мультимодальных референсов и позволяет редактировать отдельные фрагменты без перегенерации всего клипа.
ChatGPT Work: как начать пользоваться агентным рабочим столом OpenAI
9 июля 2026 OpenAI запустила ChatGPT Work -- агента, который берёт у вас целый проект, сам планирует шаги, работает часами в фоне и возвращает готовый документ, таблицу или презентацию.