المملكة المتحدة - وكالة أنباء إخباري
كشفت دراسة حديثة بعنوان "KellyBench" أن نماذج الذكاء الاصطناعي المتطورة من شركات تقنية كبرى مثل Google و OpenAI و Anthropic و xAI التابعة لإيلون ماسك ضعيفة بشكل ملحوظ في المراهنات على مباريات كرة القدم. خلال موسم محاكاة للدوري الإنجليزي الممتاز، خسرت هذه الأنظمة المتقدمة الأموال باستمرار، مما يؤكد وجود فجوة كبيرة بين براعة الذكاء الاصطناعي في مجالات مثل البرمجة وقدرته على التعامل مع تعقيدات مهام التنبؤ في العالم الحقيقي.
كُلفت ثمانية من أفضل أنظمة الذكاء الاصطناعي، في إطار دراسة "KellyBench" التي أجراها ستارت أب الذكاء الاصطناعي General Reasoning، ببناء نماذج لزيادة عائدات المراهنات وإدارة المخاطر. باستخدام البيانات التاريخية والإحصائيات لموسم الدوري الإنجليزي الممتاز 2023-24، قامت "وكلاء" الذكاء الاصطناعي بوضع رهانات افتراضية على نتائج المباريات وعدد الأهداف. وكانت النتائج صارخة: كل نموذج رائد تم تقييمه خسر المال. كان أداء Claude Opus 4.6 من Anthropic الأفضل، بخسارة متوسطة بلغت 11%، بينما أفلس Grok 4.20 من xAI. أظهر Gemini 3.1 Pro من Google بعض الأرباح المؤقتة ولكنه فشل في النهاية. خلص الباحثون إلى أن الذكاء الاصطناعي يؤدي أداءً أقل من البشر بشكل منهجي في مثل هذه السيناريوهات الديناميكية طويلة الأجل، مما يتحدى فكرة الأتمتة الفورية المدفوعة بالذكاء الاصطناعي عبر جميع القطاعات.