Asymptotically-informed neural networks for Black-Scholes implied volatility computation
تقدم هذه الورقة عائلة جديدة من الشبكات العصبية المستنيرة تقاربيًا والتي تستخدم دوال البوابات لتقسيم نطاق لوغاريتم الملاءمة للسعر ودمج التقريبات المحلية المتخصصة، مما يتفوق بشكل كبير على النماذج القياسية في الدقة ويوفر تخمينات أولية فعالة للغاية لحساب التقلب الضمني لنموذج بلاك-شولز القريب من دقة الآلة.
في عالم التمويل، تُعد الخيارات عقوداً تمنح المستثمر الحق، وليس الالتزام، في شراء أو بيع أصل ما بسعر محدد بحلول تاريخ معين. ولتحديد قيمة هذه العقود، يعتمد المتداولون على إطار رياضي شهير تم تطويره منذ عقود. يتطلب هذا الإطار عدة مدخلات، معظمها يسهل العثور عليه: السعر الحالي للأصل، والسعر المتفق عليه للمعاملة المستقبلية، والوقت المتبقي حتى انتهاء صلاحية العقد، وسعر الفائدة السائد. ومع ذلك، هناك مكون جوهي لا يمكن ملاحظته بشكل مباشر: التقلب المتوقع، أو مقياس مدى التذبذب الذي يُتوقع أن يشهد أسعار الأصل. وبما أن هذا الرقم مخفي، يعمل المتداولون بشكل عكسي؛ حيث ينظرون إلى السعر الفعلي الذي يتم تداول الخيار به في السوق ويستخدمون الصيغة الرياضية لحساب التقلب الذي يجب أن يكون موجوداً لإنتاج ذلك السعر. ويُعرف هذا الرقم المحسوب بالتقلب الضمني، وهو بمثابة لغة عالمية لمقارنة الخيارات المختلفة، وإدارة المخاطر، ومعايرة النماذج المالية المعقدة.
تنشأ الصعوبة عندما يتم دفع الرياضيات إلى أقصى حدودها. فعندما يكون الخيار رخيصاً للغاية، أو باهظ الثمن للغاية، أو عندما يتبقى على موعد انتهائه وقت قصير جداً أو طويل جداً، تصبح العلاقة بين السعر والتقلب حساسة للغاية. في هذه الحالات القصوى، يمكن لخطأ ضئيل في السعر أن يؤدي إلى خطأ هائل ومضلل في التقلب المحسوب. وهذا أمر خطير لأن القرارات المالية، من تحوط المحافظ الاستثمارية إلى تسعير المنتجات الجديدة، تعتمد على الحصول على هذا الرقم بدقة. فإذا كان الحساب غير دقيق قليلاً في هذه المناطق الحرجة، فقد يخلق وهماً بالربح حيث لا يوجد ربح، أو يؤدي إلى تقييمات خاطئة للمخاطر. لسنوات، حاول علماء الرياضيات وعلماء الحاسوب حل مشكلة الانعكاس هذه باستخدام الأساليب العددية القياسية أو عبر تدريب الذكاء الاصطناዊ لتقدير الإجابة، لكن هذه الأساليب غالباً ما تعاني عندما تصبح البيانات متطرفة للغاية.
قام فريق من الباحثين الآن بتقديم طريقة جديدة لتعليم الحواسيب كيفية حل هذه المشكلة من خلال احترام الشكل الفريد للمشهد المالي. فبدلاً من مطالبة برنامج حاسوبي قياسي بتعلم العلاقة الكاملة بين السعر والتقلب كمهمة واحدة كبيرة وموحدة، صمموا نظاماً يدرك أن المشكلة تمتلك سلوكيات مختلفة في مناطق مختلفة. لقد أدركوا أن العلاقة الرياضية تتصرف كخط مستقيم في بعض المناطق، ومنحدر شديد في مناطق أخرى، ومنحنى في مناطق بينهما. وللتعامل مع ذلك، بنوا نوعاً متخصصاً من الشبكات العصبية، وهي شكل من أشكال الذكاء الاصطناعي، تعمل مثل فريق من الخبراء. يستخدم هذا النظام مجموعة من المفاتيح الداخلية للكشف تلقائياً عن الجزء الذي يواجهه من المشكلة — سواء كان يتعامل مع سعر منخفض جداً، أو سعر مرتفع جداً، أو منطقة وسطى — ومن ثم يسلم عملية الحساب إلى شبكة فرعية محددة تم تدريبها للتعامل مع هذا السيناريو بدقة.
اختبر الباحثون هذا النهج مقابل الطرق التقليدية والشبكات العصبية القياسية عبر مجموعة واسعة من السيناريوهات، من ظروف السوق اليومية إلى الحالات الأكثر تطرفاً وصعوبة. كانت النتائج مذهلة؛ حيث تفوق النظام الجديد باستمرار على الأساليب القياسية، وغالباً ما قلل الخطأ بآلاف المرات. وفي المناطق الأكثر تحدياً حيث فشلت الأساليب الأخرى أو أصبحت غير مستقرة، حافظت هذه البنية الجديدة على دقة عالية. علاوة على ذلك، وجد الباحثون أن المخرجات من شبكتهم العصبية كانت دقيقة للغاية لدرجة أنها يمكن أن تعمل كنقطة بداية شبه مثالية لحساب نهائي سريع. فمن خلال تغذية تخمين الشبكة العصبية في خطوة صقل قياسية، تمكنوا من تحقيق مستوى من الدقة هو في الأساس الحد الأقصى لما يمكن للحاسوب حسابه، وذلك في خطوتين سريعتين فقط.
يُظهر هذا العمل أن الطريقة الأكثر فعالية لتعليم الآلة كيفية حل مشكلة مالية معقدة ليست تركها تتعلم كل شيء من الصفر، بل توجيهها من خلال فهم الهيكل الأساسي للمشكلة. فمن خلال بناء السلوكيات المعروفة للسوق مباشرة داخل تصميم برنامج الحاسوب، نجح الباحثون في إنشاء أداة أسرع وأكثر دقة وموثوقية من الأساليب السابقة. وهذا أمر مهم بشكل خاص للصناعة المالية، حيث تعتبر القدرة على تسعير الخيارات بدقة في ظروف السوق القاسية أمراً ضرورياً للاستقرار. وتشير الدراسة إلى أن الجمع بين سرعة تعلم الآلة والرؤى الهيكلية للتحليل الرياضي يوفر مساراً قوياً، مما يحول مشكلة عددية صعبة للغاية إلى عملية حسابية روتينية يمكن إجراؤها بدقة تشبه دقة الآلة.
بيان المشكلة يعد حساب التقلب الضمني (IV) لنموذج بلاك-شولز مهمة أساسية في التمويل الكمي، وهي ضرورية لتسعير الخيارات، ومعايرة النماذج، وإدارة المخاطر. وبينما توفر صيغة تسعير بلاك-شولز حلاً مغلقاً لأسعار الخيارات بناءً على معامل التقلب المعطى، فإن المسألة العكسية — أي تحديد التقلب الفريد σ الذي يطابق سعر السوق الملحوظ — تفتقر إلى حل تحليلي صريح. وتتحول عملية الانعكاس هذه إلى مشكلة عددية صعبة، لا سيما في الأنظمة التقاربية (asymptotic regimes) التي تقابل أسعار الخيارات أو أسعار التنفيذ أو آجال الاستحقاق القصوى (مثل الخيارات التي تكون بعيدة جداً عن سعر التنفيذ، سواء كانت داخل أو خارج النطاق، أو الآجال القصيرة جداً أو الطويلة جداً). وفي هذه المناطق، تصبح الخريطة العكسية حساسة للغاية للاضطرابات في السعر؛ حيث يمكن للأخطاء الطفيفة في التسعير أن تؤدي إلى أخطاء كبيرة في التقلب الضمني، مما قد يؤدي بدوره إلى قرارات تحوط خاطئة أو معايرة غير دقيقة للنماذج.
تعتمد الطرق العددية الحالية، مثل طريقة نيوتن-رافسون أو خوارزمية برينت، بشكل كبير على جودة التخمين الأولي، وقد تواجه صعوبات في هذه الأنظمة المتطرفة. كما أن التقريبات التحليلية غالباً ما تفتقر إلى المتانة عبر نطاقات المعلمات الواقعية، وتفشل مناهج التعلم الآلي القياسية (الشبكات العصبية ذات التغذية الأمامية العامة) في التقاط السلوكيات التحليلية المتميزة لدالة التقلب الضمني عبر أنظمة التقلب المختلفة، مما يؤدي إلى دقة وتعميم دون المستوى الأمثل.
المنهجية يقترح المؤلفون عائلة جديدة من بنيات الشبكات العصبية التي تدمج صراحةً البنية التحليلية لمسألة انعكاس بلاك-شولز. وتستلهم المنهجية الأساسية من تحليل تقسيم النطاق لـ "جاكيل" [30]، والذي يحدد أن دالة التسعير تظهر سلوكيات مختلفة نوعياً اعتماداً على نظام التقلب.
تقسيم النطاق: يتم تقسيم فضاء المدخلات، المحدد بلوغاريتم الملاءمة (A) وسعر الكول (Call Price) المعياري (C)، إلى ثلاثة مناطق متميزة بناءً على هندسة دالة التسعير:
منطقة التقارب الدنيا: تقابل الأسعار المنخفضة جداً (C→0).
المنطقة المركزية: تقابل السلوك الخطي التقريبي بالقرب من نقطة الانقلاب في منحنى التسعير.
منطقة التقارب العليا: تقابل الأسعار المرتفقة جداً (C→1).
بنية خليط الخبراء (Mixture-of-Experts): يقرب النموذج المقترح خريطة التقلب الضمني Binv(A,C) كتركيبة موزونة من تقريبات محلية متخصصة: IV(A,C)=f0(A,C)g0(A,C)+f1(A,C)g1(A,C)+f2(A,C)g2(A,C)
المقربات المحلية (gi): هي شبكات عصبية (أو تحويلات أسية لها) مدربة لنمذجة سلوك التقلب الضمني ضمن أنظمة محددة.
دوال البوابة (fi): هي دوال قابلة للتدريب تحدد وزن كل مقرب محلي. وقد صُممت لتلبي قيوداً تقاربية محددة (على سبيل المثال، f0→1 عندما C→0 و f0→0 عندما C→1) لضمان انتقالات سلسة بين الأنظمة. ويستقصي البحث نماذج بارامترية مختلفة لهذه البوابات، بما في ذلك العائلات متعددة الحدود والغاوسية، مع تبعيات لكل من A و C أو C فقط.
التحسين الهجين: تُستخدم مخرجات الشبكة العصبية كتخمينات أولية عالية الدقة لمخطط بحث عن الجذور من الدرجة الثالثة (Householder root-finding scheme). هذا النهج الهجين يستفيد من سرعة الشبكة العصبية للتهيئة ومن دقة الحل التكراري للتحسين النهائي.
المساهمات الرئيسية
البنيات المدركة للأنظمة: تصميم شبكات عصبية تتعلم صراحةً تقسيماً لنطاق (السعر-لوغاريتم الملاءمة)، وتجمع بين التقريبات المحلية المتخصصة عبر دوال بوابة، بدلاً من التعامل مع انعكاس التقلب الضمني كمشكلة انحدار عامة.
آليات البوابة القابلة للتدريب: إدخال دوال بوابة تتعلم تلقائياً حدود الانتقال بين الأنظمة التقاربية والمركزية مع احترام القيود التحليلية المعروفة.
دقة وتعميم فائقين: تُظهر التجارب العددية أن هذه البنيات تتفوق باستمرار على الشبكات العصبية ذات التغذية الأمامية القياسية عبر نطاقات واسعة من المعلمات. وغالباً ما يكون التحسن في الدقة النسبية (MSRE) عدة مراتب عشرية.
التحسين بدقة الآلة: توفر الشبكات المقترحة تخمينات أولية دقيقة للغاية لدرجة أن مخطط "هاوسهولدر" من الدرجة الثالثة يحقق نتائج قريبة من دقة الآلة بعد تمريرتين تكراريتين فقط.
القابلية للتوسع: على عكس التقريبات التحليلية التي تتطلب اشتقاق صيغ جديدة لأنظمة مختلفة، فإن النهج المقترح يتوسع طبيعياً مع تعقيد النموذج والدقة المطلوبة بمجرد توسيع مجموعة البيانات أو حجم الشبكة.
النتائج يقدم البحث تجارب عددية مستفيضة على ثلاث مجموعات بيانات تغطي نطاقات معلمات مختلفة:
مجموعة البيانات ذات النطاق الكبير (A∈[0,16],B∈[10−5,7.07]): قللت البنيات المقترحة متوسط خطأ التربيع النسبي (MSRE) في الاختبار بنحو أربعة مراتب عشرية مقارنة بالشبكات العصبية القياسية. وأكدت الخرائط الحرارية أن الأخطاء كانت صغيرة بشكل موحد عبر النطاق، بينما أظهرت الشبكات القياسية أخطاء كبيرة في أنظمة التقلب المنخفض.
مجموعة البيانات ذات النطاق المتوسط (A∈[0,3],B∈[10−7,1.22]): لوحظت تحسينات مماثلة، حيث قللت أفضل البنيات (تحديداً تلك التي تستخدم دوال بوابة غاوسية تعتمد على كل من A و C) من الـ MSRE بأكثر من ثلاث مراتب عشرية.
مجموعة البيانات ذات النطاق الصغير (A∈[0,10−5],B∈[10−5,0.18]): حتى في هذا النظام الذي يقترب من البعد الواحد حيث تؤدي الشبكات القياسية أداءً معقولاً، قدمت البنيات المقترحة تحسينات منهجية، حيث قللت الـ MSRE بمعامل قدره 39 تقريباً.
في جميع الحالات، عند الجمع مع تحسين "هاوسهولدر"، حققت الطرق المقترحة متوسط أخطاء لوغاريتمية نسبية قريبة من حد الدقة العددية (حوالي $-37إلى-39$)، متفوقة بشكل كبير على كل من الشبكات العصبية القياسية وطرق البحث عن الجذور الكلاسيكية مثل خوارزمية برينت، والتي أظهرت مشاهد أخطاء غير منتظمة في الأنظمة المتطرفة.
الأهمية يجادل البحث بأن أهمية هذا العمل تكمن في إثبات أن دمج المعرفة التحليلية النوعية (تحديداً وجود أنظمة تقاربية ومركزية متميزة) في تصميم الشبكات العصبية يحقق دقة وتعميماً أفضل بكثير من التعامل مع انعكاس التقلب الضمني كمشكلة انحدار عامة. إن المنهجية المقترحة لا تكتفي بمجرد استبدال تقنيات البحث عن الجذور الكلاسيكية، بل تعمل كمسرع قوي، حيث تضع الحلول التكرارية مباشرة في منطقة تقاربها السريع. وينتج عن ذلك حل فعال حاسوبياً وعالي الدقة، وهو قوي بشكل خاص في الأنظمة المتطرفة للمعلمات حيث تواجه الطرق التقليدية صعوبات غالباً. ويقترح المؤلفون إمكانية توسيع فلسفة التعلم الآلي "المستنير تقاربياً" لتشمل مسائل معايرة أخرى في التمويل الكمي تتضمن خرائط عكسية ذات أنظمة متعددة وتأثيرات غير خطية قوية.