AI 모델 / 비교

Gemini 3.7 Flash vs Claude Sonnet 5: 어떤 것이 귀하의 작업에 적합합니까?

같은 근무일에 두 가지 모델: 초안 작성, 문서 이해 및 코드 검토. 중요한 차이점, 바로 사용할 수 있는 세 가지 비교 프롬프트, GO AI에서 이를 시도하는 경로는 다음과 같습니다.

한눈에 비교하기
질문Gemini 3.7 FlashClaude Sonnet 5
공식 강조다중모달 추론; 텍스트 출력코딩, 도구 사용 및 다단계 작업
GO AI Web로 명명됨GeminiClaude
공급자 토큰 용량1,048,576 입력; 65,536 출력1M 컨텍스트; 128K 출력
이름이 보장하지 않는 것이미지 생성 또는 GO AI의 모든 Google 도구GO AI의 연결된 터미널 또는 자율 코딩

실제로 무엇이 다른가요?

Google은 텍스트 출력과 함께 Gemini 3.7 Flash에 대한 텍스트, 이미지, 비디오, 오디오 및 PDF 입력을 문서화합니다. 이미지 생성 모델이 아닙니다. Anthropic는 코딩, 추론 및 도구 지원 작업에 관한 Sonnet 5를 제공합니다. 이는 제공업체의 역량과 포지셔닝이며 자체적인 직접 테스트 결과가 아닙니다.

채팅 인터페이스는 모델 기능의 일부만 노출합니다. API 기능 목록은 GO AI에서 동일한 파일 형식, 도구 또는 컨텍스트 허용을 사용할 수 있다는 의미는 아닙니다. 이를 비교하려면 웹 채팅이 지원하는 일반 텍스트 작업부터 시작하세요.

Google: Gemini 3.7 Flash · Anthropic: Claude Sonnet 5 · Anthropic: Sonnet 5.5, 28 September 2026 · Anthropic: Sonnet 5 specifications

테스트 1: 고정된 사실이 포함된 클라이언트 메시지

날짜, 이름, 금액, 불확실성 한 가지가 포함된 짧은 초안을 사용하세요. 재작성을 요청한 다음 스타일을 판단하기 전에 네 가지 세부 사항을 확인하세요. 추정을 약속으로 바꾸는 세련된 답변은 테스트에 실패합니다.

두 모델 모두 원래 브리핑에 응답한 후에만 두 번째 신호음을 시도해 보세요. 그렇지 않으면 다른 지침을 비교하는 것입니다. 모든 변경 사항을 확인할 수 있도록 답변 옆에 원본 초안을 보관하세요.

프롬프트 01
[청중]을 대상으로 이 메시지를 [톤] 톤으로 다시 작성하세요. 모든 이름, 금액, 날짜를 변경하지 않고 유지하세요. 불확실성을 유지하십시오. 약속을 추가하지 마십시오. 120단어 이하로 사용하세요. 그런 다음 설명이 필요한 사실을 나열하십시오. 초안: [텍스트].

테스트 2: 확인할 수 있는 요약

각 모델에 동일한 회의록을 제공하세요. 고안된 결정, 누락된 작업 및 잘못 할당된 담당자를 계산합니다. 이는 매력적인 요약과 신뢰할 수 있는 요약을 구별합니다.

해결되지 않은 제안을 메모에 포함하세요. 유용한 답변은 승인된 결정과 별도로 유지됩니다. 실제로 내용을 제공하지 않는 한 두 모델 모두 링크된 문서를 읽었다고 가정하지 마십시오.

프롬프트 02
다음 메모만 사용하세요: [메모]. 결정 사항, 담당자와 기한을 포함한 할 일, 미해결 질문의 세 부분으로 정리하세요. 각 결정의 근거가 되는 원문을 인용하고 담당자나 날짜가 없으면 “명시되지 않음”이라고 쓰세요. 제안을 확정된 결정으로 바꾸지 마세요.

테스트 3: 간단한 코드 검토

짧은 기능, 의도된 동작 및 실패한 예를 제공하세요. 답변이 재현 가능한 문제를 식별하고, 집중적인 수정을 제안하고, 의미 있는 테스트를 설명하는지 비교하십시오.

생성된 테스트는 테스트 결과가 아닙니다. 수정 사항을 수락하기 전에 자체 개발 환경에서 제안된 검사를 실행하십시오. 두 모델 모두 일반 채팅에서 코드를 실행했다고 주장하여 크레딧을 받을 수 없습니다.

프롬프트 03
다음 코드를 검토하세요: [코드]. 예상되는 동작: [요구사항]. 실패한 예: [입력 및 관찰된 출력]. 가능한 원인을 식별하고, 가장 작은 수정 사항을 제안하고, 수정 전에 실패하는 테스트를 제공합니다. 당신이 실행하지 않은 것을 기술하십시오.

비교 후 선택방법

각 작업에 대해 사실적 오류, 누락된 지침 및 답변을 수정하는 데 소요된 시간을 기록하세요. 간단한 합격/불합격 체크리스트는 허위로 만든 전체 지능 점수보다 더 유용합니다.

한 모델을 기본 모델로 만들기 전에 중요한 작업을 반복하세요. Gemini가 요약을 더 잘 처리하고 Claude가 코드 수정이 덜 필요한 경우 두 역할을 모두 유지하세요. 우리가 추천하는 것은 이 테스트 방법입니다. 이 기사에서는 통제된 벤치마크를 실행하지 않았습니다.

자주 묻는 질문

Gemini 3.7 Flash는 사진을 생성하나요?

아니요: Google은 이 모델에 대한 텍스트 출력을 문서화합니다. 이미지 생성에서는 별도의 이미지 모델을 사용합니다.

Claude는 항상 코딩을 더 잘하나요?

이 글에서는 그 사실을 입증하지 않습니다. 귀하에게 중요한 특정 코드와 승인 확인을 테스트하십시오.

출처 및 범위