نماذج الذكاء الاصطناعي / مقارنة
Gemini 3.7 Flash مقابل Claude Sonnet 5: أيهما يناسب عملك؟
نموذجان لنفس يوم العمل: الصياغة وفهم المستندات ومراجعة التعليمات البرمجية. فيما يلي الاختلافات المهمة، وثلاثة مطالبات مقارنة جاهزة للاستخدام، والطريق إلى تجربتها في GO AI.
| سؤال | Gemini 3.7 Flash | Claude Sonnet 5 |
|---|---|---|
| التأكيد الرسمي | الاستدلال متعدد الوسائط؛ إخراج النص | الترميز واستخدام الأدوات والعمل متعدد الخطوات |
| تمت تسميته في GO AI Web | Gemini | Claude |
| سعة الرمز المميز للموفر | إدخال 1,048,576؛ إخراج 65,536 | سياق 1M؛ إخراج 128K |
| ما لا يضمنه الاسم | إنشاء الصور أو كل أداة Google في GO AI | محطة متصلة أو ترميز مستقل في GO AI |
ما الذي يختلف في الواقع؟
Google يوثق النصوص والصور والفيديو والصوت ومدخلات PDF لـ Gemini 3.7 Flash، مع إخراج النص. إنه ليس نموذجًا لتوليد الصور. يقدم Anthropic Sonnet 5 حول البرمجة والاستدلال والعمل بمساعدة الأدوات. هذه هي قدرات الموفر وتحديد المواقع، وليست نتائج اختبارنا وجهاً لوجه.
تكشف واجهة الدردشة جزءًا فقط من إمكانيات النموذج. لا تعني قائمة ميزات API أن نفس أنواع الملفات أو الأدوات أو السماح بالسياق متوفرة في GO AI. لإجراء هذه المقارنة، ابدأ بالمهام النصية العادية التي تدعمها دردشة الويب.
Google: Gemini 3.7 Flash · Anthropic: Claude Sonnet 5 · Anthropic: Sonnet 5.5, 28 September 2026 · Anthropic: Sonnet 5 specifications
الاختبار 1: رسالة العميل بحقائق ثابتة
استخدم مسودة قصيرة تحتوي على تاريخ واسم ومبلغ وحالة عدم يقين واحدة. اطلب إعادة الكتابة، ثم تحقق من تلك التفاصيل الأربعة قبل الحكم على الأسلوب. الإجابة المصقولة التي تحول التقدير إلى وعد تفشل في الاختبار.
جرب نغمة ثانية فقط بعد أن يجيب كلا العارضين على الموجز الأصلي. وإلا فإنك تقارن تعليمات مختلفة. احتفظ بالمسودة الأصلية بجوار الإجابات حتى تتمكن من التحقق من كل تغيير.
أعد كتابة هذه الرسالة لـ [الجمهور] بنبرة [نغمة]. إبقاء جميع الأسماء والمبالغ والتواريخ دون تغيير. الحفاظ على عدم اليقين؛ لا تضيف الالتزامات. لا تستخدم أكثر من 120 كلمة. ثم قم بإدراج أي حقائق تحتاج إلى توضيح. المسودة: [النص].الاختبار 2: ملخص يمكن التحقق منه
أعط كل نموذج نفس ملاحظات الاجتماع. عد القرارات المخترعة والإجراءات المفقودة والمسؤولين المعينين بشكل غير صحيح. وهذا ما يميز الملخص الجذاب عن الملخص الموثوق.
قم بتضمين الاقتراح الذي لم يتم حله في الملاحظات. الإجابة المفيدة تجعلها منفصلة عن القرارات المعتمدة. لا تفترض أن أيًا من النموذجين قد قرأ مستندًا مرتبطًا إلا إذا قمت بتوفير محتوياته بالفعل.
استخدم هذه الملاحظات فقط: [الملاحظات]. قسّم الإجابة إلى ثلاثة أقسام: القرارات، والمهام مع المسؤولين عنها ومواعيدها، والأسئلة العالقة. اقتبس العبارة التي تدعم كل قرار. اكتب «غير مذكور» إذا غاب اسم المسؤول أو التاريخ. لا تحوّل المقترحات إلى قرارات معتمدة.الاختبار 3: مراجعة صغيرة للكود
توفير وظيفة قصيرة والسلوك المقصود ومثال واحد فاشل. قارن ما إذا كانت الإجابة تحدد مشكلة قابلة للتكرار، وتقترح حلاً مركّزًا، وتشرح اختبارًا ذا معنى.
الاختبار الذي تم إنشاؤه ليس نتيجة اختبار. قم بإجراء الاختبارات المقترحة في بيئة التطوير الخاصة بك قبل قبول الإصلاح. لا ينبغي أن يحصل أي من النموذجين على رصيد للادعاء بتنفيذ تعليمات برمجية في محادثة عادية.
راجع هذا الكود: [code]. السلوك المتوقع: [المتطلبات]. مثال فاشل: [المدخلات والمخرجات الملحوظة]. حدد السبب المحتمل، واقترح أصغر إصلاح، وقم بإجراء اختبار يفشل قبل الإصلاح. اذكر ما لم تقم بتنفيذه.كيفية الاختيار بعد المقارنة
لكل مهمة، سجل الأخطاء الفعلية والتعليمات الفائتة والدقائق التي أمضيتها في تصحيح الإجابة. تعد قائمة التحقق البسيطة من النجاح/الفشل أكثر فائدة من درجة الذكاء الشاملة المخترعة.
كرر مهمة مهمة قبل أن تجعل نموذجًا واحدًا هو الخيار الافتراضي. إذا كان Gemini يتعامل مع ملخصاتك بشكل أفضل وكان Claude يحتاج إلى تصحيح أقل على التعليمات البرمجية الخاصة بك، فاحتفظ بكلا الدورين. توصيتنا هي طريقة الاختبار هذه؛ لم نقم بتشغيل معيار خاضع للرقابة لهذه المقالة.
الأسئلة الشائعة
هل يقوم Gemini 3.7 Flash بإنشاء الصور؟
No: Google يوثق إخراج النص لهذا النموذج. يستخدم إنشاء الصور نماذج صور منفصلة.
هل Claude الأفضل دائمًا في البرمجة؟
هذه المقالة لا تثبت ذلك. اختبر الكود المحدد وفحوصات القبول التي تهمك.