arXiv cs.AI→ المصدر

FormulaSPIN: нейросеть пишет формулы для таблиц по описанию и обгоняет проприетарные модели

FormulaSPIN — новый фреймворк self-play обучения, который учит модель писать формулы для электронных таблиц прямо по описанию на естественном языке. Главный приём: система проверяет формулы на исполнимость и сама отделяет смысловые ошибки от валидных вариантов записи, обучаясь без дополнительной разметки. На бенчмарке NL2FORMULA — 74,9% точных совпадений и 87,1% корректных по исполнению, выше и обычного SFT, и топовых проприетарных моделей.

معالج بواسطة الذكاء الاصطناعي من arXiv cs.AI؛ بتحرير Hamidun News
FormulaSPIN: нейросеть пишет формулы для таблиц по описанию и обгоняет проприетарные модели
المصدر: arXiv cs.AI. كولاج: Hamidun News.
◐ استمع للمقال

في يوليو 2026، نشر باحثون على arXiv إطار العمل FormulaSPIN، وهو نظام تدريب يعتمد على مبدأ self-play يولّد معادلات لجداول البيانات انطلاقًا من وصف بلغة طبيعية، ويحقق نسبة تطابق دقيق قدرها 74.9% ودقة تنفيذ قدرها 87.1% على معيار NL2FORMULA، متفوقًا على كل من النهج الإشرافي (supervised) الكلاسيكي والنماذج المملوكة الرائدة.

كيف يتعلم النموذج من نفسه

يتدرب FormulaSPIN دون سطر واحد جديد من البيانات الموسومة — إذ يلعب النموذج ضد نفسه. ووفقًا لملخص الورقة على arXiv، صُمم التدريب كلعبة بين لاعبين: يتعلم اللاعب الرئيسي أن يفضّل المعادلات المرجعية (ground-truth) على تلك التي أنتجتها نسخته السابقة. وتُصنّف التغذية الراجعة الناتجة عن تنفيذ المعادلات الإجابات وفق "درجة الدقة"، لتُبنى بذلك خطة تعلّم تكيفية: يتقن النموذج أولًا الصحة الدلالية، ثم صقل الأسلوب في الصياغة.

وتكمن الميزة الأساسية للمهمة في قابلية التنفيذ الثنائية: فالمعادلة إما أن تُنفَّذ وتُنتج نتيجة، أو لا تُنفَّذ. وهذا يوفر آلية تحكّم ضمنية تفصل الأخطاء الدلالية عن الصيغ المكتوبة بشكل مختلف لكنها صحيحة.

لماذا يفشل SPIN التقليدي هنا

لا يعمل SPIN التقليدي بشكل جيد في توليد المعادلات، لأنه يعاقب بالتساوي أي إجابة لا تطابق المرجع حرفيًا. ووفقًا للباحثين، فإن المعادلة نفسها، المكافئة من حيث التنفيذ، تُعاقب باعتبارها "خاطئة" في مثال ما، بينما تُستخدم كمرجع في مثال آخر — ما يجعل تدرّجات التدريب متناقضة فيما بينها، ويمنع النموذج من التقارب.

ويزيل FormulaSPIN هذا التناقض عبر التحقق بالتنفيذ. فإذا أنتج تعبيران مختلفان في الشكل النتيجة نفسها، يعتبرهما النظام صحيحين وليس خطأً. كما أضاف الباحثون آلية ExecVote، وهي آلية تصويت على المستوى الدلالي تتعامل بشكل أصيل مع الحالات التي تقبل فيها مهمة واحدة عدة صياغات صحيحة.

ماذا أظهرت القياسات

حقق FormulaSPIN أفضل نتيجة جديدة على عدة معايير قياسية. ففي NL2FORMULA، بلغت نسبة التطابق الدقيق 74.9% ونسبة الصحة بالتنفيذ 87.1%، وهو مستوى مماثل لنماذج مدرَّبة على تعليقات تفضيل إضافية، وأعلى من كل من SFT التقليدي والنماذج المملوكة المتقدمة.

  • 74.9% نسبة تطابق دقيق (exact match) على معيار NL2FORMULA
  • 87.1% دقة تنفيذ (execution accuracy)
  • تدريب دون أي مثال إضافي موسوم
  • ExecVote — تصويت على المستوى الدلالي للمعادلات الصحيحة المتعددة
  • يتفوق على كل من SFT الكلاسيكي والنماذج المملوكة المتطورة (frontier)
"تُبرز هذه النتائج إمكانات self-play في المهام التي تعاني من ندرة البيانات، وتفتح الطريق أمام تعميمها لتتجاوز النطاقات القابلة للتنفيذ"، جاء في ملخص ورقة

FormulaSPIN على arXiv.

ما الذي يعنيه ذلك

لا تزال كتابة المعادلات عائقًا أمام مئات الملايين من مستخدمي جداول البيانات، بينما البيانات الموسومة اللازمة لتدريب مثل هذه النماذج شحيحة. ويُظهر FormulaSPIN أن بإمكان النموذج أن يُحسّن نفسه بنفسه، مستخدمًا التنفيذ كمصدر تحقق مجاني — دون الحاجة إلى وسم يدوي مكلف. وينطبق هذا النهج على أي مهمة يمكن فيها تنفيذ النتيجة والتحقق منها: الشيفرة البرمجية، استعلامات SQL، الحسابات.

الأسئلة الشائعة

ما هو FormulaSPIN؟

FormulaSPIN هو إطار عمل للتدريب بمبدأ self-play لتوليد معادلات جداول البيانات من نص بلغة طبيعية. يُحسّن النموذج نفسه تكراريًا، دون بيانات موسومة إضافية، مستخدمًا التحقق من قابلية تنفيذ المعادلات كمصدر للتغذية الراجعة.

بماذا يختلف

FormulaSPIN عن الضبط الدقيق (fine-tuning) المعتاد؟

يصل الضبط الدقيق الإشرافي التقليدي (SFT) بسرعة إلى سقف تفرضه محدودية الوسم. أما FormulaSPIN فيتدرب وفق مبدأ لعبة بين لاعبين، ويفصل الأخطاء الدلالية عن صيغ الكتابة الصحيحة عبر التنفيذ، لذا فهو يتفوق على SFT ولا يتطلب بيانات جديدة.

ما النتائج التي حققها FormulaSPIN؟

على معيار NL2FORMULA، حقق إطار العمل نسبة تطابق دقيق قدرها 74.9% ودقة تنفيذ قدرها 87.1% — وهو مستوى يوازي النماذج المدرَّبة على تعليقات تفضيل إضافية، ويفوق أفضل النماذج المملوكة.

ZK
Hamidun News
أخبار الذكاء الاصطناعي بدون ضوضاء. اختيار تحريري يومي من أكثر من 50 مصدر. منتج من جمال حميدون، رئيس الذكاء الاصطناعي في Alpina Digital.

هل تحتاج إلى ذكاء اصطناعي يعمل داخل شركتك — وليس فقط في موجز الأخبار؟

أبني ذكاءً اصطناعياً جاهزاً للإنتاج للشركات — أنظمة CRM مخصّصة، أدوات داخلية، وكلاء مستقلون، أتمتة سير العمل. ملك لك، مصمّم وفق عمليتك، دون رسوم لكل مستخدم. من إعداد جمال خميدون، مدير المنتجات في AlpinaGPT (منصة ذكاء اصطناعي، أكثر من 6000 مستخدم).

ما رأيك؟
جارٍ تحميل التعليقات…