MODEL AI / PERBANDINGAN

Gemini 3.7 Flash vs Claude Sonnet 5: mana yang sesuai dengan pekerjaan Anda?

Dua model untuk hari kerja yang sama: menyusun, memahami dokumen, dan meninjau kode. Berikut adalah perbedaan yang penting, tiga perintah perbandingan siap pakai, dan jalur untuk mencobanya di GO AI.

Sekilas perbandingan
PertanyaanGemini 3.7 FlashClaude Sonnet 5
Official emphasisMultimodal reasoning; keluaran teksPengkodean, penggunaan alat, dan pekerjaan multi-langkah
Dinamakan dalam GO AI WebGeminiClaude
Provider token capacity1,048,576 input; Keluaran 65,5361M context; Keluaran 128K
What the name does not guaranteePembuatan gambar atau setiap alat Google di GO AITerminal terhubung atau pengkodean otonom di GO AI

What actually differs?

Google mendokumentasikan input teks, gambar, video, audio, dan PDF untuk Gemini 3.7 Flash, dengan output teks. It is not an image-generation model. Anthropic menghadirkan Sonnet 5 seputar pengkodean, penalaran, dan pekerjaan yang dibantu alat. Ini adalah kemampuan dan positioning penyedia, bukan hasil dari pengujian langsung kami.

Antarmuka obrolan hanya memperlihatkan sebagian dari kemampuan model. Daftar fitur API tidak berarti bahwa jenis file, alat, atau tunjangan konteks yang sama tersedia di GO AI. Untuk perbandingan ini, mulailah dengan tugas teks biasa yang didukung oleh obrolan web.

Google: Gemini 3.7 Flash · Anthropic: Claude Sonnet 5 · Anthropic: Sonnet 5.5, 28 September 2026 · Anthropic: Sonnet 5 specifications

Tes 1: pesan klien dengan fakta tetap

Gunakan draf pendek yang berisi tanggal, nama, jumlah dan satu ketidakpastian. Mintalah penulisan ulang, lalu periksa keempat detail tersebut sebelum menilai gaya. Jawaban halus yang mengubah perkiraan menjadi janji gagal dalam ujian.

Coba nada kedua hanya setelah kedua model menjawab ringkasan aslinya. Kalau tidak, Anda membandingkan instruksi yang berbeda. Simpan draf asli di samping jawaban sehingga Anda dapat memverifikasi setiap perubahan.

PROMPT 01
Tulis ulang pesan ini untuk [penonton] dengan nada [nada]. Keep all names, amounts and dates unchanged. Pertahankan ketidakpastian; jangan menambah komitmen. Gunakan tidak lebih dari 120 kata. Then list any facts that need clarification. Draf: [teks].

Tes 2: ringkasan yang dapat diperiksa

Berikan catatan pertemuan yang sama kepada setiap model. Hitung keputusan yang dibuat-buat, tindakan yang hilang, dan penanggung jawab yang salah ditugaskan. Hal ini membedakan ringkasan yang menarik dari ringkasan yang dapat diandalkan.

Cantumkan proposal yang belum terselesaikan dalam catatan. Jawaban yang berguna memisahkannya dari keputusan yang disetujui. Jangan berasumsi bahwa model mana pun telah membaca dokumen tertaut kecuali Anda benar-benar memberikan isinya.

PROMPT 02
Gunakan hanya catatan ini: [catatan]. Susun tiga bagian: keputusan, tindakan beserta penanggung jawab dan tenggatnya, serta pertanyaan yang belum terjawab. Kutip kalimat pendukung untuk setiap keputusan. Tulis “tidak disebutkan” jika penanggung jawab atau tanggal tidak ada. Jangan mengubah usulan menjadi keputusan.

Tes 3: tinjauan kode kecil

Berikan fungsi singkat, perilaku yang diinginkan, dan satu contoh kegagalan. Bandingkan apakah jawabannya mengidentifikasi masalah yang dapat direproduksi, mengusulkan perbaikan terfokus, dan menjelaskan pengujian yang bermakna.

Tes yang dihasilkan bukanlah hasil tes. Jalankan pemeriksaan yang diusulkan di lingkungan pengembangan Anda sendiri sebelum menerima perbaikan. Model mana pun tidak boleh menerima penghargaan karena mengklaim telah mengeksekusi kode dalam obrolan biasa.

PROMPT 03
Tinjau kode ini: [kode]. Perilaku yang diharapkan: [persyaratan]. Contoh gagal: [input dan output yang diamati]. Identifikasi kemungkinan penyebabnya, usulkan perbaikan terkecil dan berikan pengujian yang gagal sebelum perbaikan. Nyatakan apa yang belum Anda jalankan.

Cara memilih setelah perbandingan

Untuk setiap tugas, catat kesalahan faktual, instruksi yang terlewat, dan menit yang Anda habiskan untuk memperbaiki jawaban. Daftar periksa lulus/gagal yang sederhana lebih berguna daripada skor kecerdasan keseluruhan yang dibuat-buat.

Ulangi tugas penting sebelum menjadikan satu model sebagai default Anda. Jika Gemini menangani ringkasan Anda dengan lebih baik dan Claude memerlukan lebih sedikit koreksi pada kode Anda, pertahankan kedua peran tersebut. Rekomendasi kami adalah metode pengujian ini; kami belum menjalankan patokan terkontrol untuk artikel ini.

Pertanyaan umum

Apakah Gemini 3.7 Flash menghasilkan gambar?

Tidak: Google mendokumentasikan keluaran teks untuk model ini. Pembuatan gambar menggunakan model gambar terpisah.

Apakah Claude selalu lebih baik dalam coding?

Artikel ini tidak menjelaskan hal tersebut. Uji kode spesifik dan pemeriksaan penerimaan yang penting bagi Anda.

Sumber dan ruang lingkup