МОДЕЛИ ИИ / СРАВНЕНИЕ
Gemini 3.7 Flash или Claude Sonnet 5: что выбрать для работы?
Две модели для повседневной работы: письма, разбор документов и проверка кода. Разбираем важные отличия, даём три готовых задания и показываем, как попробовать модели в GO AI.
| Что сравниваем | Gemini 3.7 Flash | Claude Sonnet 5 |
|---|---|---|
| Акцент разработчика | Работа с разными видами входных данных; текстовый ответ | Код, инструменты и многошаговые задачи |
| Название в GO AI Web | Gemini | Claude |
| Объём токенов по документации | 1 048 576 на входе; 65 536 на выходе | Контекст 1 млн; ответ до 128 тыс. |
| Чего название не обещает | Генерации картинок и всех инструментов Google в GO AI | Подключённого терминала и автономного программирования в GO AI |
В чём различие?
Google указывает для Gemini 3.7 Flash входные текст, изображения, видео, аудио и PDF, а на выходе — текст. Эта модель не генерирует изображения. Anthropic делает акцент на программировании, рассуждении и работе Sonnet 5 с инструментами. Это описание разработчиков, а не результаты нашего сравнительного теста.
Возможности модели и возможности конкретного чата не совпадают автоматически. Список функций API не означает, что GO AI поддерживает те же файлы, инструменты и объём контекста. Начните с текстовых заданий, которые можно выполнить в веб-чате.
Google: Gemini 3.7 Flash · Anthropic: Claude Sonnet 5 · Anthropic: Sonnet 5.5, 28 September 2026 · Anthropic: Sonnet 5 specifications
Тест 1: письмо клиенту без изменения фактов
Возьмите короткий черновик с датой, именем, суммой и одним неуточнённым условием. Попросите переписать его и сначала проверьте эти четыре детали. Красивый ответ, который превратил предположение в обещание, не проходит проверку.
Меняйте тон только после первого ответа обеих моделей. Иначе вы сравните разные задания. Держите исходник рядом: так легче заметить, что исчезло или появилось в новой версии.
Перепиши сообщение для [аудитория] в тоне [тон]. Не меняй имена, суммы и даты. Сохрани неопределённость, не добавляй обязательств. Объём — до 120 слов. Отдельно перечисли факты, которые нужно уточнить. Черновик: [текст].Тест 2: проверяемый конспект встречи
Передайте обеим моделям одинаковые заметки. Посчитайте выдуманные решения, пропущенные задачи и неверно назначенных ответственных. Так вы отличите красивое изложение от полезного конспекта.
Добавьте в заметки предложение, которое ещё не согласовали. Хороший ответ не смешает его с принятыми решениями. Не считайте, что модель прочитала документ по ссылке, если вы не передали его содержимое.
Используй только эти заметки: [заметки]. Сделай три раздела: решения, задачи с ответственными и сроками, открытые вопросы. Для каждого решения процитируй подтверждающую фразу. Если срок или ответственный отсутствует, напиши «не указан». Не превращай предложения в решения.Тест 3: небольшая проверка кода
Дайте короткую функцию, описание ожидаемого поведения и один пример ошибки. Сравните, удалось ли найти воспроизводимую проблему, предложить точечное исправление и объяснить полезную проверку.
Написанный тест ещё не является результатом его запуска. Выполните проверки в своей среде разработки. Модель не должна получать преимущество за заявление, что она запустила код, если в обычном чате этого не происходило.
Проверь код: [код]. Ожидаемое поведение: [условия]. Пример ошибки: [ввод и фактический результат]. Укажи вероятную причину, предложи минимальное исправление и тест, который не проходит до исправления. Отдельно напиши, что ты не запускал.Как выбрать по результатам
Для каждого задания запишите ошибки в фактах, нарушенные условия и время, потраченное на исправления. Простая проверка «подходит / не подходит» полезнее выдуманного общего балла интеллекта.
Повторите важное задание, прежде чем выбрать модель по умолчанию. Если Gemini лучше справляется с вашими конспектами, а после Claude меньше правок в коде, оставьте каждой свою роль. Это наш способ оценки; контролируемый бенчмарк для этой статьи мы не проводили.
Частые вопросы
Gemini 3.7 Flash умеет создавать картинки?
Нет: Google указывает текстовый ответ для этой модели. Для генерации изображений существуют отдельные модели.
Claude всегда лучше пишет код?
Этот обзор такого вывода не доказывает. Проверьте модели на своём коде и заранее заданных условиях.