Decomposable Neural Symbolic Regression
تقدم هذه الورقة طريقةً للتحليل الرمزي العصبي القابل للتفكيك تستفيد من محولات المجموعات المتعددة (Multi-Set Transformers)، والخوارزميات الجينية، والبرمجة الجينية لاستخلاص نماذج الانحدار الغامضة إلى تعبيرات متعددة المتغيرات دقيقة وقابلة للتفسير تستعيد باستمرار البنية الرياضية الأصلية مع الحفاظ على أداء تنبؤي تنافسي.
البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل
في عالم العلوم الحديث، أصبحت الحواسيب أدوات قوية للغاية لإيجاد الأنماط في البيانات. فهي تستطيع فحص آلاف القياسات من العالم الطبيعي وبناء نماذج معقدة تتنبأ بالنتائج المستقبلية بدقة عالية. وغالباً ما تُوصف هذه النماذج بأنها "معتمة" لأن منطقها الداخلي متشابك ومعقد لدرجة لا يمكن للبشر معها فهم كيفية توصلها إلى استنتاجاتها بسهولة. إنها تشبه "الصندوق الأسود": تضع البيانات في الداخل، وتخرج لك إجابة، لكن المسار بينهما يظل مخفياً. وبالنسبة للعلماء الذين يدرسون الفيزياء أو البيولوجيا أو الهندسة، فإن هذا النقص في الشفافية يمثل عقبة كبيرة. فلفهم الكون حقاً، يحتاج الباحثون إلى ما هو أكثر من مجرد التنبؤ؛ إنهم بحاجة إلى المعادلات الحاكمة، تلك الجمل الرياضية الواضحة التي تصف كيف يعمل الطبيعة. وهذا هو هدف "الانحدار الرمزي" (symbolic regression)، وهو مجال مخصص لإيجاد صيغ بسيطة ومقروءة تفسر البيانات المرصودة، بدلاً من مجرد حفظها.
لقد طور فريق من الباحثين في جامعة ولاية مونتانا طريقة جديدة لمعالجة هذه المشكلة، مقدمين منهجية يمكنها تقشير طبقات هذه النماذج الحاسوبية المعقدة للكشف عن الحقائق الرياضية البسيطة الكامنة تحتها. تبدأ طريقتهم، التي يسمونها SeTGAP، بتدريب نموذج حاسوبي قياسي عالي التعقيد لتعلم سلوك نظام ما. وبمجرد تدريب هذا النموذج "المعتم" وتشغيله، لا يحاول الباحثون عكس هندسة ملايين إعداداته الداخلية، بل يعاملون النموذج كمصدر للحقيقة ويطلبون منه أن يشرح نفسه، متغيراً واحداً تلو الآخر. يقومون بعزل كل عامل مدخل بشكل منهجي، مثل درجة الحرارة أو الضغط، ويسألون النموذج كيف يتغير المخرج عندما يتحرك عامل واحد فقط. ومن خلال القيام بذلك، ينشئ النظام سلسلة من المخططات البسيطة أحادية المتغير التي تصف شكل العلاقة لكل جزء من قطع الأحجية.
بعد ذلك، يستخدم الباحثون عملية متطورة لربط هذه المخططات الفردية معاً. تخيل محاولة فهم آلة معقدة من خلال معرفة كيفية دوران كل ترس بمفرده أولاً، ثم رؤية كيف تترابط هذه التروس معاً. يستخدم الفريق مزيجاً من الذكاء الاصطناعي والخوارزميات التطورية لدمج هذه المخططات أحادية المتغير في صيغة كاملة متعددة المتغيرات. هم لا يلقون بكل القطع معاً دفعة واحدة، مما يؤدي غالباً إلى الارتباك أو النتائج شديدة التعقيد، بل يضيفون المتغيرات واحداً تلو الآخر، مع ضمان بقاء هيكل الصيغة نظيفاً ومنطقياً في كل خطوة. تسمح هذه الطريقة لهم بالحفاظ على العلاقات الوظيفية الأصلية التي حددوها في وقت مبكر، مما يمنع المعادلة النهائية من التحول إلى تشابك فوضوي من الأرقام التي تناسب البيانات ولكنها لا تعني شيئاً.
وعندما اختبر الفريق هذه الطريقة ضد مجموعة متنوعة من المشكلات، من التحديات الرياضية الاصطناعية إلى معادلات الفيزياء في العالم الحقيقي، كانت النتائج مذهلة. ففي المشكلات الاصطناعية، نجحت طريقتهم في استعادة الهيكل الرياضي الصحيح للنظام الأساسي في كل حالة اختبار أجروها. وفي المقابل، فشلت طرق رائدة أخرى، بما في ذلك تلك التي تعتمد على التعلم العميق أو الحوسبة التطورية التقليدية، في العثور على الشكل الصحيح، حيث أنتجت تعبيرات كانت إما شديدة التعقيد أو خاطئة ببساطة، حتى لو تنبأت بالأرقام بشكل صحيح. وقد أثبت النهج الجديد كفاءة خاصة عندما كانت البيانات تحتوي على ضجيج أو أخطاء، وهو أمر شائع في القياسات الواقعية. وبينما عانت الطرق الأخرى في التعميم خارج نطاق البيانات التي تدربت عليها، صمدت المعادلات المكتشفة بهذه الطريقة جيداً عند اختبارها على نطاقات قيم جديدة وغير مرئية.
كما طبق الباحثون تقنيتهم على مجموعة شهيرة من معادلات الفيزياء تُعرف باسم "مجموعة فاينمان"، والتي تحتوي على قوانين تصف كل شيء من الجاذبية إلى سلوك الضوء. وفي هذا الاختبار المعياري، حققت طريقتهم معدلاً عالياً من النجاح في تحديد المعادلات الصحيحة، حيث احتلت المرتبة الثانية في استعادة الحلول الرمزية بنسبة نجاح بلغت حوالي 61.2%، وأظهرت أداءً تنبؤياً تنافسياً مقارنة بالعديد من التقنيات الراسخة. تشير الدراسة إلى أنه من خلال تقسيم مشكلة معقدة إلى أجزاء أصغر يمكن إدارتها ثم إعادة تجميعها بعناية، يمكن تجاوز قيود الذكاء الاصطناعي الحالي. وهذا لا يعني أن الحواسيب أقل قوة، بل يعني أن طريقة طلب شرح نفسها هي الأكثر فعالية. إن هذا العمل يثبت أنه من الممكن استخراج قوانين الطبيعة الواضحة والقابلة للقراءة من الطبقات العميقة والمخفية للتعلم الآلي الحديث، وتحويل التنبؤات المعتمة إلى فهم شفاف.
غارق في أبحاث مجالك؟
تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.