كشفت دراسة حديثة عن تقدم لافت لنماذج الذكاء الاصطناعي في أداء بعض المهام المحاسبية، بعدما تفوق نموذج Claude Opus 5 على مجموعة من المحاسبين في اختبار صمم لمحاكاة أعمال واقعية تتم في نهاية الشهر المالي، محققًا دقة بلغت 100% في جميع المحاولات التي سجلتها الدراسة، وحملت الدراسة عنوان "Human Baselines for Benchmarks: AI Now Outperforms Junior Accountants"، وقارنت أداء عدد من نماذج الذكاء الاصطناعي مع 12 محاسبًا مرخصًا يحملون شهادة CPA، ويمتلكون خبرة عملية متوسطة تبلغ نحو خمس سنوات ونصف في مجال المحاسبة.
Claude Opus 5 يحقق دقة كاملة في المهام المحاسبية
طلب الباحثون من المحاسبين تنفيذ أربع حالات محاسبية مرتبطة بإجراءات نهاية الشهر، اعتمادًا على ملفات لشركات صممت بصورة تحاكي بيئات العمل الحقيقية. وشملت المهام البحث داخل مجموعة من المستندات، وتحديد الأرقام والبيانات ذات الصلة، وإجراء الحسابات المطلوبة، ثم تقديم النتائج في صورة جداول، وسجل المشاركون البشر متوسط دقة بلغ 37% في هذه المهام، مع تفاوت كبير بين النتائج؛ إذ تراوحت الدرجات الفردية من صفر% إلى نحو 90%، بينما استغرق إنجاز معظم المحاولات ما بين 30 و180 دقيقة، وفي المقابل، حقق Claude Opus 5 دقة بلغت 100% في جميع المحاولات العشرين التي تناولتها الدراسة، مع إنجاز كل مهمة خلال أقل من 10 دقائق.
وأظهرت الدراسة كذلك فارقًا كبيرًا في تكلفة إنجاز هذه المهام، إذ قدر الباحثون تكلفة المحاسبين البشر بنحو 10.35 دولار لكل معيار تقييم مكتمل، اعتمادًا على متوسط الأجور للمحاسبين في الولايات المتحدة، مقابل نحو 0.21 دولار للمعيار نفسه عند استخدام Claude Opus 5.
إيلون ماسك يعلق على تفوق الذكاء الاصطناعي
ولفتت نتائج الدراسة انتباه الملياردير الأمريكي إيلون ماسك، الذي علق على النتائج عبر منصة X، وكتب في إشارة إلى أداء النموذج في الاختبارات المحاسبية: "الذكاء الفائق، الذي كان يُعرف سابقًا بالذكاء الاصطناعي، أصبح الآن يجتاز اختبارات المحاسبة ببراعة". ويأتي تعليق ماسك في ظل تسارع قدرات نماذج الذكاء الاصطناعي في أداء المهام المهنية المتخصصة، بعدما أظهر Claude Opus 5 قدرة على إنجاز المهام التي اختبرتها الدراسة بدقة كاملة وفي وقت أقل بكثير من المشاركين البشر.
تطور سريع في أداء نماذج الذكاء الاصطناعي
وتشير نتائج الدراسة إلى أن الفجوة بين أداء البشر والذكاء الاصطناعي في هذه الاختبارات ظهرت خلال فترة زمنية قصيرة نسبيًا، إذ كانت أفضل النماذج قبل نحو 18 شهرًا لا تزال تسجل نتائج أقل من متوسط المحاسبين المشاركين في الاختبار، وبحسب الدراسة، تمكن نموذج o3 من OpenAI لاحقًا من تجاوز متوسط المحاسبين البالغ 37%، بينما وصل GPT-5 إلى نحو 69%، قبل أن تقترب نماذج حديثة أخرى من تحقيق درجات كاملة في المهام نفسها، ومن بينها Claude Opus 5، ويعكس ذلك، وفق الباحثين، تسارع قدرات النماذج المتقدمة في التعامل مع المهام التي تتطلب قراءة كميات كبيرة من المعلومات، والبحث عن بيانات محددة، واتباع تعليمات مفصلة، وإجراء عمليات حسابية منظمة.
هل يستطيع الذكاء الاصطناعي استبدال المحاسبين؟
رغم النتائج اللافتة، تحذر شركة Mercor والباحثون المشاركون في الدراسة من اعتبار الاختبار دليلًا على أن الذكاء الاصطناعي أصبح قادرًا على أداء وظيفة المحاسب بالكامل، فالاختبار ركز على مجموعة محددة من المهام التي تتميز النماذج الحالية بقدرة كبيرة على تنفيذها، بينما تتضمن مهنة المحاسبة جوانب أخرى لم تدخل ضمن التقييم، مثل التواصل مع العملاء، وطرح الأسئلة للحصول على معلومات إضافية، والتعاون مع الزملاء، والاستفادة من الخبرات المتراكمة لفهم السياق المالي للشركات، كما أن الحالات المستخدمة في الدراسة كانت مصممة أصلًا لتكون صعبة، وكان فقدان معلومة صغيرة أو ارتكاب خطأ في تفصيلة واحدة قادرًا على التأثير بشكل كبير في النتيجة النهائية.
ومع ذلك، يرى الباحثون أن هذه النتائج تشير إلى إمكانية تحقيق مكاسب إنتاجية من خلال استخدام الذكاء الاصطناعي في المهام المحاسبية المنظمة والمتكررة، حتى في حال توقفت قدرات النماذج عند مستوياتها الحالية، إذ يمكن أن يؤدي ذلك إلى تغيير طريقة توزيع وتنفيذ جزء من الأعمال المحاسبية خلال السنوات المقبلة.