يتفوق Grok 4.7 على Fable 5.1 و GPT-5.6 Sol في اختبار الوكيل القانوني لهارفي بخمس سعر إدخال Fable

- حقق Grok 4.7 نسبة 19.6% على معيار Harvey Legal Agent، متقدماً على Fable 5.1 بنسبة 6.7% و GPT-5.6 Sol بنسبة 2.5%.
- تحدد xAI سعر Grok 4.7 بدولارين لكل مليون رمز إدخال، أي ما يعادل خُمس سعر Fable 5.1 البالغ 10 دولارات.
- لا يزال برنامج Fable 5.1 يتفوق على Grok 4.7 في Terminal-Bench 4.0، بنسبة 57.9% مقابل 38.0%.
أطلقت شركة xAI برنامج Grok 4.7 يوم الاثنين. وقد تفوق على برنامج Fable 5.1 من Anthropic وبرنامج GPT-5.6 Sol من OpenAI في معيار الوكيل القانوني، بينما كان سعره خُمس سعر Fable لكل رمز إدخال.
يبلغ سعر الإخراج 6 دولارات لكل مليون رمز مقابل 50 دولارًا في أنثروبيك
أفاد بيان شركة xAI أن Grok 4.7 حقق نسبة 19.6% في اختبار Harvey Legal Agent Benchmark. وحصل Fable 5.1 على نسبة 6.7% في الاختبار نفسه، بينما حصل GPT-5.6 Sol على نسبة 2.5%.
هذا يجعل أداء Grok 4.7 أعلى بثلاث مرات تقريبًا من أداء Anthropic، وأعلى بثماني مرات تقريبًا من أداء Sol. Cryptopolitan قد أفاد الشهر الماضي بأن Grok 4.6 كان متقدمًا بالفعل على هذا الثنائي بنسبة 15.8%.
يُعدّ العمل القانوني أحد المجالات القليلة التي يتفوق فيها Grok 4.7 على منافسيه بشكلٍ واضح. كما أنه يجتاز اختبار Fable 5.1 في هندسة الكهرباء EEBench، ويتفوق عليه في اختبار البرمجة DeepSWE.
يبلغ سعر Grok 4.7 دولارين لكل مليون رمز إدخال و6 دولارات لكل مليون رمز إخراج، وهو نفس سعر Grok 4.6. ويمثل معدل الإدخال هذا نصف معدل GPT-5.6 Sol البالغ 4 دولارات، وخُمس معدل Fable 5.1 البالغ 10 دولارات.
تبلغ تكلفة الإنتاج 6 دولارات مقابل 20 دولارًا لـ Sol، و50 دولارًا لـ Fable، أي ما يقارب ثمن رقم Anthropic.
قامت xAI برسم نتائج CursorBench 4.0 مقابل متوسط تكلفة إنجاز كل مهمة، وتؤكد أن النموذج يقع على الحد الأمثل بين السعر والأداء. يحقق Grok 4.7 حوالي 46% على هذا الرسم البياني بتكلفة تقارب 6 دولارات لكل مهمة، بينما يحتاج Claude Opus 5 إلى ضعف هذا المبلغ تقريبًا لتحقيق نتيجة مماثلة.
يُحقق برنامج Fable 5.1 أداءً أفضل مع الميزانيات الأعلى، حيث تصل كفاءته إلى 51.8% بتكلفة تقارب 17 دولارًا لكل مهمة. ووصف ماسك هذا الإصدار بأنه "مزيجtronمن الذكاء والسرعة والتكلفة المنخفضة".

يُعطي برنامج Terminal-Bench 4.0 شركة Anthropic تقدماً بنسبة 57.9% مقابل 38.0%
حلّ برنامج Grok 4.7 في المركز الثاني بعد برنامج Fable 5.1 في اختبار GDPval واختبار AA Briefcase للعمل المكتبي. ويحافظ نموذج Anthropic على تفوقه الواضح في اختبارات البرمجة المطولة ومعايير أداء المحطات الطرفية.
أكبر هامش هو في Terminal-Bench 4.0، حيث حقق Fable 5.1 نسبة 57.9% مقابل 38.0% لـ Grok 4.7، وهو فرق يبلغ حوالي 20 نقطة.
كما يتصدر Fable أيضًا في CursorBench وفي HealthBench Professional في مجال التفكير السريري، حيث يتفوق GPT-5.6 Sol أيضًا على Grok.
حقق Grok 4.7 درجة 1695 Elo على GDPval، الذي يقيس أداء النماذج في مهام يؤديها المحامون والممرضون والمحللون الماليون، مرتفعًا من درجة Grok 4.6 البالغة 1605. ويأتي هذا الرقم أقل من درجة Fable 5.1 البالغة 1735، ولكنه أعلى من درجة GPT-6 Astra الأحدث من OpenAI البالغة 1542 على نفس المخطط.
يتفوق Grok 4.7 على GPT-5.6 Sol في خمسة من أصل سبعة معايير قياس. ويخسر فقط في DeepSWE والاختبار السريري.
يعمل Grok 4.7 على 2.1 تريليون معلمة، أي بزيادة قدرها 40% عن 1.5 تريليون معلمة التي تشغل Grok 4.6. وقد أضافت xAI بيانات تدريب إضافية من SpaceX، بما في ذلك بيانات القياس عن بعد لأقمار Starlink الصناعية وسجلات التصنيع.
وتقول الشركة إن النموذج من المرجح أن يقضي وقتاً إضافياً في حل المشكلات الصعبة وأن يتحقق من إجاباته الخاصة أكثر من Grok 4.6.
النموذج تطبيق Grok و Cursor و Grok Build و xAI API، بدون قائمة انتظار.
جميع الأرقام الواردة هنا مستقاة من اختبارات شركة xAI الخاصة. أما برنامج CursorBench، وهو الاختبار الذي تعتمد عليه xAI بشكل أساسي، فهو من إنتاج شركة Cursor التي استحوذت عليها SpaceX الشهر الماضي.
تمت مقارنة xAI مع GPT-5.6 Sol، ويظهر GPT-6 Astra الأحدث من OpenAI فقط في مخططات GDPval و AA Briefcase و EEBench.
أذكى العقول في عالم العملات الرقمية يتابعون نشرتنا الإخبارية بالفعل. هل ترغب بالانضمام إليهم؟ انضم إليهم.
الأسئلة الشائعة
كم تبلغ تكلفة Grok 4.7 مقارنة بـ Fable 5.1 و GPT-5.6 Sol؟
يكلف Grok 4.7 دولارين لكل مليون رمز إدخال و 6 دولارات لكل مليون رمز إخراج، مقابل 10 دولارات و 50 دولارًا لـ Fable 5.1.
ما هي المعايير التي يتفوق فيها Grok 4.7 وما هي المعايير التي يخسر فيها؟
يفوز Grok 4.7 بمعيار Harvey القانوني بنسبة 19.6٪، بينما يتصدر Fable 5.1 على CursorBench و Terminal-Bench و HealthBench Professional.
ما هو حجم Grok 4.7 وما هي البيانات التي تم تدريبه عليها؟
يعمل Grok 4.7 على 2.1 تريليون معلمة ويتضمن بيانات تدريب إضافية من SpaceX مثل بيانات القياس عن بعد لأقمار Starlink الصناعية.
إخلاء مسؤولية: المعلومات الواردة هنا ليست نصيحة استثمارية. Cryptopolitanموقع أي مسؤولية عن أي استثمارات تتم بناءً على المعلومات الواردة في هذه الصفحة. ننصحtronبإجراء بحث مستقلdent /أو استشارة مختص مؤهل قبل اتخاذ أي قرارات استثمارية.

راندا موسى
راندا موسى محررة ومراسلة في Cryptopolitan تغطي أخبار التكنولوجيا والذكاء الاصطناعي والروبوتات والعملات الرقمية وعمليات الاحتيال والاختراقات. تعمل في مجال العملات الرقمية منذ عام ٢٠١٧، وشغلت مناصب في شركات فورورد بروتوكول وأمازيكس وكريبتوسومنياك. تحمل راندا شهادة في الهندسة الكهربائيةtronمن جامعة برادفورد.
















