AI モデル / 比較

Gemini 3.7 FlashとClaude Sonnet 5:仕事に合うのはどちら?

同じ勤務日に 2 つのモデル: 草案作成、文書の意味の理解、コードのレビュー。ここでは、重要な違い、すぐに使用できる 3 つの比較プロンプト、および GO AI でそれらを試すためのパスを示します。

主な違いを比較
質問Gemini 3.7 FlashClaude Sonnet 5
公式強調マルチモーダル推論。テキスト出力コーディング、ツールの使用、複数ステップの作業
GO AI Web で名前が付けられましたGeminiClaude
プロバイダートークンの容量1,048,576 入力; 65,536 出力1M コンテキスト; 128K 出力
名前が保証するものではありません画像生成または GO AI のすべての Google ツールGO AI の接続された端末または自律コーディング

実際は何が違うのでしょうか?

Google は、Gemini 3.7 Flash のテキスト、画像、ビデオ、オーディオ、および PDF 入力とテキスト出力を文書化します。画像生成モデルではありません。 Anthropic は、コーディング、推論、ツール支援作業に関する Sonnet 5 を紹介します。これらはプロバイダーの機能とポジショニングであり、当社独自の直接テストの結果ではありません。

チャット インターフェイスはモデルの機能の一部のみを公開します。 API の機能リストは、同じファイル タイプ、ツール、またはコンテキスト許可が GO AI で使用できることを意味するものではありません。この比較では、Web チャットがサポートする通常のテキスト タスクから始めます。

Google: Gemini 3.7 Flash · Anthropic: Claude Sonnet 5 · Anthropic: Sonnet 5.5, 28 September 2026 · Anthropic: Sonnet 5 specifications

テスト 1: 固定事実を含むクライアント メッセージ

日付、名前、金額、および不確実性を 1 つ含む短い草稿を使用します。リライトを依頼し、スタイルを判断する前にこれら 4 つの詳細を確認してください。見積もりを約束に変える洗練された答えはテストに合格しません。

両方のモデルが元のブリーフィングに応答した後にのみ、2 番目のトーンを試してください。そうしないと、異なる命令を比較することになります。すべての変更を確認できるように、元の草案を回答の隣に保管してください。

プロンプト 01
[視聴者] 向けのこのメッセージを [トーン] トーンで書き直してください。すべての名前、金額、日付は変更しないでください。不確実性を保ちます。コミットメントを追加しないでください。使用する単語は 120 語以内にしてください。次に、説明が必要な事実をリストします。草案: [テキスト]。

テスト 2: 確認できる概要

各モデルに同じ会議メモを渡します。でっち上げられた決定、欠落したアクション、および誤って割り当てられた担当者を数えます。これにより、魅力的な要約と信頼できる要約が区別されます。

未解決の提案をメモに記載します。有用な答えは、承認された決定からそれを切り離します。実際にその内容を指定しない限り、どちらのモデルもリンクされたドキュメントを読み取ったと想定しないでください。

プロンプト 02
次のメモだけを使ってください:[メモ]。決定事項、担当者と期限を含む作業、未解決の質問の3項目に分けてまとめてください。各決定の根拠となる原文を引用し、担当者や期限の記載がなければ「記載なし」と書いてください。提案を決定事項として扱わないでください。

テスト 3: 簡単なコード レビュー

短い関数、意図された動作、および失敗例を 1 つ提供してください。回答が再現可能な問題を特定しているか、焦点を絞った修正を提案しているか、意味のあるテストについて説明しているかどうかを比較します。

生成されたテストはテスト結果ではありません。修正を受け入れる前に、提案されたチェックを独自の開発環境で実行してください。どちらのモデルも、通常のチャットでコードを実行したと主張してもクレジットを受け取るべきではありません。

プロンプト 03
このコードを確認してください: [コード]。予期される動作: [要件]。失敗例: [入力と観察された出力]。考えられる原因を特定し、最小限の修正を提案し、修正の前に失敗するテストを実行します。実行していないことを述べてください。

比較後の選び方

タスクごとに、事実上の誤り、指示の誤り、解答の修正に費やした時間を記録します。単純な合否チェックリストは、発明された全体的な知能スコアよりも役立ちます。

1 つのモデルをデフォルトにする前に、重要なタスクを繰り返してください。 Gemini が要約をより適切に処理し、Claude がコードの修正をあまり必要としない場合は、両方の役割を維持してください。私たちが推奨するのはこのテスト方法です。この記事では管理されたベンチマークを実行していません。

よくある質問

Gemini 3.7 Flash は画像を生成しますか?

いいえ: Google は、このモデルのテキスト出力を文書化します。イメージの作成では別のイメージ モデルを使用します。

Claude はいつもコーディングが上手ですか?

この記事はそれを証明するものではありません。自分にとって重要な特定のコードと受け入れチェックをテストします。

出典と範囲