МОДЕЛИ ИИ / СРАВНЕНИЕ

Gemini 3.7 Flash или Claude Sonnet 5: что выбрать для работы?

Две модели для повседневной работы: письма, разбор документов и проверка кода. Разбираем важные отличия, даём три готовых задания и показываем, как попробовать модели в GO AI.

Сравнение в одной таблице
Что сравниваемGemini 3.7 FlashClaude Sonnet 5
Акцент разработчикаРабота с разными видами входных данных; текстовый ответКод, инструменты и многошаговые задачи
Название в GO AI WebGeminiClaude
Объём токенов по документации1 048 576 на входе; 65 536 на выходеКонтекст 1 млн; ответ до 128 тыс.
Чего название не обещаетГенерации картинок и всех инструментов Google в GO AIПодключённого терминала и автономного программирования в GO AI

В чём различие?

Google указывает для Gemini 3.7 Flash входные текст, изображения, видео, аудио и PDF, а на выходе — текст. Эта модель не генерирует изображения. Anthropic делает акцент на программировании, рассуждении и работе Sonnet 5 с инструментами. Это описание разработчиков, а не результаты нашего сравнительного теста.

Возможности модели и возможности конкретного чата не совпадают автоматически. Список функций API не означает, что GO AI поддерживает те же файлы, инструменты и объём контекста. Начните с текстовых заданий, которые можно выполнить в веб-чате.

Google: Gemini 3.7 Flash · Anthropic: Claude Sonnet 5 · Anthropic: Sonnet 5.5, 28 September 2026 · Anthropic: Sonnet 5 specifications

Тест 1: письмо клиенту без изменения фактов

Возьмите короткий черновик с датой, именем, суммой и одним неуточнённым условием. Попросите переписать его и сначала проверьте эти четыре детали. Красивый ответ, который превратил предположение в обещание, не проходит проверку.

Меняйте тон только после первого ответа обеих моделей. Иначе вы сравните разные задания. Держите исходник рядом: так легче заметить, что исчезло или появилось в новой версии.

ПРОМПТ 01
Перепиши сообщение для [аудитория] в тоне [тон]. Не меняй имена, суммы и даты. Сохрани неопределённость, не добавляй обязательств. Объём — до 120 слов. Отдельно перечисли факты, которые нужно уточнить. Черновик: [текст].

Тест 2: проверяемый конспект встречи

Передайте обеим моделям одинаковые заметки. Посчитайте выдуманные решения, пропущенные задачи и неверно назначенных ответственных. Так вы отличите красивое изложение от полезного конспекта.

Добавьте в заметки предложение, которое ещё не согласовали. Хороший ответ не смешает его с принятыми решениями. Не считайте, что модель прочитала документ по ссылке, если вы не передали его содержимое.

ПРОМПТ 02
Используй только эти заметки: [заметки]. Сделай три раздела: решения, задачи с ответственными и сроками, открытые вопросы. Для каждого решения процитируй подтверждающую фразу. Если срок или ответственный отсутствует, напиши «не указан». Не превращай предложения в решения.

Тест 3: небольшая проверка кода

Дайте короткую функцию, описание ожидаемого поведения и один пример ошибки. Сравните, удалось ли найти воспроизводимую проблему, предложить точечное исправление и объяснить полезную проверку.

Написанный тест ещё не является результатом его запуска. Выполните проверки в своей среде разработки. Модель не должна получать преимущество за заявление, что она запустила код, если в обычном чате этого не происходило.

ПРОМПТ 03
Проверь код: [код]. Ожидаемое поведение: [условия]. Пример ошибки: [ввод и фактический результат]. Укажи вероятную причину, предложи минимальное исправление и тест, который не проходит до исправления. Отдельно напиши, что ты не запускал.

Как выбрать по результатам

Для каждого задания запишите ошибки в фактах, нарушенные условия и время, потраченное на исправления. Простая проверка «подходит / не подходит» полезнее выдуманного общего балла интеллекта.

Повторите важное задание, прежде чем выбрать модель по умолчанию. Если Gemini лучше справляется с вашими конспектами, а после Claude меньше правок в коде, оставьте каждой свою роль. Это наш способ оценки; контролируемый бенчмарк для этой статьи мы не проводили.

Частые вопросы

Gemini 3.7 Flash умеет создавать картинки?

Нет: Google указывает текстовый ответ для этой модели. Для генерации изображений существуют отдельные модели.

Claude всегда лучше пишет код?

Этот обзор такого вывода не доказывает. Проверьте модели на своём коде и заранее заданных условиях.

Источники и границы сравнения