تخطي إلى المحتوى الرئيسي

بازينجا

وظائف الذكاء الاصطناعي

OpenAI تكشف عن قائمة الوظائف التي يمكن لـ ChatGPT استبدالها بالفعل

Written by

Picture of فريقنا

فريقنا

Communications Consultant

في خطوة جريئة، أصدرت OpenAI تقييماً جديداً يحدد 44 مهنة يمكن لنماذجها الذكية أن تؤثر فيها بشكل كبير، مدعية أن أفضل النماذج تقترب بالفعل من جودة عمل الخبراء البشريين، لكنها تواجه تشكيكاً حول مدى واقعية هذه الادعاءات.

في خطوة جريئة، أصدرت OpenAI تقييماً جديداً يحدد 44 مهنة يمكن لنماذجها الذكية أن تؤثر فيها بشكل كبير، مدعية أن أفضل النماذج تقترب بالفعل من جودة عمل الخبراء البشريين، لكنها تواجه تشكيكاً حول مدى واقعية هذه الادعاءات.

محتويات المقالة:

محاولة لقياس القيمة الاقتصادية للذكاء الاصطناعي

أصدرت شركة OpenAI، مبتكرة ChatGPT، تقييماً جديداً أطلقت عليه اسم GDPval، لقياس مدى جودة أداء نماذج الذكاء الاصطناعي الخاصة بها في «مهام واقعية ذات قيمة اقتصادية عبر 44 مهنة». تأتي هذه الخطوة كواحدة من أكثر المحاولات صراحة من الشركة لتبرير الجدوى المالية لنماذجها الذكية، خاصة بعد تزايد الشكوك حول ما إذا كانت هذه التكنولوجيا قد تصل إلى طريق مسدود.

ما هو تقييم GDPval وماذا يعني؟

يهدف التقييم الجديد إلى الانتقال من التكهنات حول تأثير الذكاء الاصطناعي على المجتمع إلى فهم ملموس لما يمكن أن تفعله النماذج بالفعل. كتبت الشركة في تدوينة مصاحبة: «التقييمات مثل GDPval تساعد في إرساء المحادثات حول تحسينات الذكاء الاصطناعي المستقبلية على الأدلة بدلاً من التخمين، ويمكن أن تساعدنا في تتبع تحسن النماذج بمرور الوقت». باختصار، تحاول OpenAI تقديم مقياس كمي لقدرات الذكاء الاصطناعي في بيئة العمل الحقيقية.

نتائج أولية جريئة ومفاجأة من المنافسين

وجدت «النتائج الأولية» لتقييم GDPval أن «أفضل النماذج الرائدة اليوم تقترب بالفعل من جودة العمل الذي ينتجه خبراء الصناعة» – وهو تصريح موجه بشكل واضح إلى النقاد الذين يقولون إن التكنولوجيا ليست على مستوى متطلبات مكان العمل.

والمثير للدهشة أن الشركة وجدت أن نموذج Claude Opus 4.1 من منافستها Anthropic كان «النموذج الأفضل أداءً» بعد تقييمه من قبل خبراء الصناعة عبر 220 مهمة. وجاء نموذج GPT-5 في المرتبة الثانية، والذي «تفوق بشكل خاص في الدقة». وحصلت نسخة أكثر قوة من GPT-5، تسمى GPT-5-high، على تقييم «أفضل من أو على قدم المساواة مع مخرجات خبراء الصناعة» في أكثر من 40% من الوقت بقليل. في المقابل، سجل GPT-4o، الذي تم إصداره قبل أكثر من عام، 13.7% فقط.

قائمة المهن المستهدفة: من المحامين إلى الممرضين

شملت المهن الـ 44 التي يمكن أن يكون للذكاء الاصطناعي فيها «أعلى تأثير على الإنتاجية في العالم الحقيقي» قائمة طويلة من المهن، بما في ذلك:

  • وكلاء مبيعات العقارات
  • الأخصائيون الاجتماعيون
  • المهندسون الصناعيون
  • مطورو البرمجيات
  • المحامون
  • الممرضون المسجلون
  • ممثلو خدمة العملاء
  • الصيادلة
  • المحققون الخاصون
  • المستشارون الماليون

تراوحت المهام المحددة من إنشاء «مشهد تنافسي لخدمات التوصيل في الميل الأخير» لمحلل مالي، إلى تقييم «صور آفات جلدية» لممرض مسجل، وتصميم كتيب مبيعات لوكيل عقاري.

دعم أم استبدال؟ اللغة الحذرة لـ OpenAI

تتعامل OpenAI بحذر شديد مع موضوع استبدال الوظائف البشرية بالكامل. تشير لغتها إلى أن الذكاء الاصطناعي «سيدعم الناس في العمل الذي يقومون به كل يوم» بدلاً من القول صراحة إن أي شخص قد يصبح عاطلاً عن العمل قريباً بسبب الذكاء الاصطناعي. هذا ليس مفاجئاً، بالنظر إلى الصورة السلبية للاحتفال بفقدان الوظائف. في الوقت نفسه، يظل ما إذا كان هذا تفسيراً صادقاً لدوافع الصناعة وأهدافها النهائية أمراً مشكوكاً فيه، حيث تباهى المسؤولون التنفيذيون في مجال الذكاء الاصطناعي طويلاً باستبدال العمالة البشرية بالذكاء الاصطناعي.

لماذا يجب أن نتعامل مع هذه النتائج بحذر؟

هناك سبب وجيه للتعامل مع أحدث نتائج تقييم OpenAI بحذر شديد. لقد رأينا بالفعل أن استخدام الذكاء الاصطناعي يسبب مشاكل كبيرة لمطوري البرمجيات والمحامين وحتى ممثلي خدمة العملاء، مما يتطلب في كثير من الأحيان المزيد من الإشراف البشري، وليس أقل. تظل الهلوسات، على وجه الخصوص، نقطة شائكة رئيسية، حيث تقوض مخرجات الأدوات القائمة على النماذج اللغوية الكبيرة، مما يجبر المستخدمين على قضاء المزيد من الوقت في فحص مخرجات الذكاء الاصطناعي بحثاً عن معلومات خاطئة.

اعترفت OpenAI بأن المهام في العالم الحقيقي نادراً ما تكون «محددة بوضوح من خلال أمر وملفات مرجعية». وكتبت الشركة: «تظهر النتائج الأولية لـ GDPval أن النماذج يمكنها بالفعل تولي بعض المهام المتكررة والمحددة جيداً بشكل أسرع وبتكلفة أقل من الخبراء. ومع ذلك، فإن معظم الوظائف هي أكثر من مجرد مجموعة من المهام التي يمكن تدوينها».

خطوة نحو الشفافية أم أداة تسويقية؟

يمثل إطلاق GDPval خطوة مثيرة للاهتمام من OpenAI نحو قياس قدرات نماذجها بشكل ملموس. ومع ذلك، من المهم النظر إليه كجزء من استراتيجية تسويقية تهدف إلى إظهار القيمة التجارية للذكاء الاصطناعي. سيظل الاختبار الحقيقي هو مدى قدرة هذه الأدوات على الأداء بشكل موثوق في الفوضى والتعقيد الذي يميز بيئات العمل الحقيقية، وهو ما لم تثبته بعد بشكل قاطع.

أسئلة شائعة

س1: هل يعني هذا أن وظيفتي في خطر؟
ج1: ليس بالضرورة على المدى القصير. تشير النتائج إلى أن الذكاء الاصطناعي يمكنه أداء مهام محددة داخل الوظيفة، وليس الوظيفة بأكملها. من المرجح أن يتغير دورك ليتضمن العمل جنباً إلى جنب مع الذكاء الاصطناعي، مع التركيز على المهارات التي لا تزال تتطلب حكماً بشرياً وإبداعاً.

س2: ما هي “النماذج الرائدة” (frontier models)؟
ج2: يشير هذا المصطلح إلى أحدث وأقوى نماذج الذكاء الاصطناعي المتاحة في وقت معين، مثل GPT-5 من OpenAI و Claude 4.1 من Anthropic.

س3: لماذا اعترفت OpenAI بتفوق نموذج منافس؟
ج3: قد يكون هذا جزءاً من استراتيجية لبناء المصداقية والشفافية. من خلال الاعتراف بأداء نموذج منافس القوي في معيارها الخاص، قد تأمل OpenAI في أن يُنظر إلى تقييمها على أنه أكثر موضوعية وموثوقية.

شارك هذا الموضوع:

شارك هذا الموضوع:

اترك رد

اترك تعليقاً

الفئات

المنشورات الأخيرة

اكتشاف المزيد من بازينجا

اشترك الآن للاستمرار في القراءة والحصول على حق الوصول إلى الأرشيف الكامل.

متابعة القراءة