MODEL AI / PERBANDINGAN
Gemini 3.7 Flash vs Claude Sonnet 5: mana yang sesuai dengan pekerjaan Anda?
Dua model untuk hari kerja yang sama: menyusun, memahami dokumen, dan meninjau kode. Berikut adalah perbedaan yang penting, tiga perintah perbandingan siap pakai, dan jalur untuk mencobanya di GO AI.
| Pertanyaan | Gemini 3.7 Flash | Claude Sonnet 5 |
|---|---|---|
| Official emphasis | Multimodal reasoning; keluaran teks | Pengkodean, penggunaan alat, dan pekerjaan multi-langkah |
| Dinamakan dalam GO AI Web | Gemini | Claude |
| Provider token capacity | 1,048,576 input; Keluaran 65,536 | 1M context; Keluaran 128K |
| What the name does not guarantee | Pembuatan gambar atau setiap alat Google di GO AI | Terminal terhubung atau pengkodean otonom di GO AI |
What actually differs?
Google mendokumentasikan input teks, gambar, video, audio, dan PDF untuk Gemini 3.7 Flash, dengan output teks. It is not an image-generation model. Anthropic menghadirkan Sonnet 5 seputar pengkodean, penalaran, dan pekerjaan yang dibantu alat. Ini adalah kemampuan dan positioning penyedia, bukan hasil dari pengujian langsung kami.
Antarmuka obrolan hanya memperlihatkan sebagian dari kemampuan model. Daftar fitur API tidak berarti bahwa jenis file, alat, atau tunjangan konteks yang sama tersedia di GO AI. Untuk perbandingan ini, mulailah dengan tugas teks biasa yang didukung oleh obrolan web.
Google: Gemini 3.7 Flash · Anthropic: Claude Sonnet 5 · Anthropic: Sonnet 5.5, 28 September 2026 · Anthropic: Sonnet 5 specifications
Tes 1: pesan klien dengan fakta tetap
Gunakan draf pendek yang berisi tanggal, nama, jumlah dan satu ketidakpastian. Mintalah penulisan ulang, lalu periksa keempat detail tersebut sebelum menilai gaya. Jawaban halus yang mengubah perkiraan menjadi janji gagal dalam ujian.
Coba nada kedua hanya setelah kedua model menjawab ringkasan aslinya. Kalau tidak, Anda membandingkan instruksi yang berbeda. Simpan draf asli di samping jawaban sehingga Anda dapat memverifikasi setiap perubahan.
Tulis ulang pesan ini untuk [penonton] dengan nada [nada]. Keep all names, amounts and dates unchanged. Pertahankan ketidakpastian; jangan menambah komitmen. Gunakan tidak lebih dari 120 kata. Then list any facts that need clarification. Draf: [teks].Tes 2: ringkasan yang dapat diperiksa
Berikan catatan pertemuan yang sama kepada setiap model. Hitung keputusan yang dibuat-buat, tindakan yang hilang, dan penanggung jawab yang salah ditugaskan. Hal ini membedakan ringkasan yang menarik dari ringkasan yang dapat diandalkan.
Cantumkan proposal yang belum terselesaikan dalam catatan. Jawaban yang berguna memisahkannya dari keputusan yang disetujui. Jangan berasumsi bahwa model mana pun telah membaca dokumen tertaut kecuali Anda benar-benar memberikan isinya.
Gunakan hanya catatan ini: [catatan]. Susun tiga bagian: keputusan, tindakan beserta penanggung jawab dan tenggatnya, serta pertanyaan yang belum terjawab. Kutip kalimat pendukung untuk setiap keputusan. Tulis “tidak disebutkan” jika penanggung jawab atau tanggal tidak ada. Jangan mengubah usulan menjadi keputusan.Tes 3: tinjauan kode kecil
Berikan fungsi singkat, perilaku yang diinginkan, dan satu contoh kegagalan. Bandingkan apakah jawabannya mengidentifikasi masalah yang dapat direproduksi, mengusulkan perbaikan terfokus, dan menjelaskan pengujian yang bermakna.
Tes yang dihasilkan bukanlah hasil tes. Jalankan pemeriksaan yang diusulkan di lingkungan pengembangan Anda sendiri sebelum menerima perbaikan. Model mana pun tidak boleh menerima penghargaan karena mengklaim telah mengeksekusi kode dalam obrolan biasa.
Tinjau kode ini: [kode]. Perilaku yang diharapkan: [persyaratan]. Contoh gagal: [input dan output yang diamati]. Identifikasi kemungkinan penyebabnya, usulkan perbaikan terkecil dan berikan pengujian yang gagal sebelum perbaikan. Nyatakan apa yang belum Anda jalankan.Cara memilih setelah perbandingan
Untuk setiap tugas, catat kesalahan faktual, instruksi yang terlewat, dan menit yang Anda habiskan untuk memperbaiki jawaban. Daftar periksa lulus/gagal yang sederhana lebih berguna daripada skor kecerdasan keseluruhan yang dibuat-buat.
Ulangi tugas penting sebelum menjadikan satu model sebagai default Anda. Jika Gemini menangani ringkasan Anda dengan lebih baik dan Claude memerlukan lebih sedikit koreksi pada kode Anda, pertahankan kedua peran tersebut. Rekomendasi kami adalah metode pengujian ini; kami belum menjalankan patokan terkontrol untuk artikel ini.
Pertanyaan umum
Apakah Gemini 3.7 Flash menghasilkan gambar?
Tidak: Google mendokumentasikan keluaran teks untuk model ini. Pembuatan gambar menggunakan model gambar terpisah.
Apakah Claude selalu lebih baik dalam coding?
Artikel ini tidak menjelaskan hal tersebut. Uji kode spesifik dan pemeriksaan penerimaan yang penting bagi Anda.