🤖 AI

The AI Fiction Paradox

تقدم هذه الورقة مفهوم "مفارقة الخيال الاصطناعي"، محاججةً بأن نماذج الذكاء الاصطناعي الحالية تجد صعوبة في توليد خيال مقنع رغم تدريبها عليه لأنها تفتقر إلى القدرة على التعامل مع السببية السردية، وإعادة التقييم الاسترجاعي للمعلومات، والبنية العاطفية متعددة المقاييس، مما يثير مخاوف من أن إتقان هذه الأنماط قد يمكّن من التلاعب البشري واسع النطاق.

Katherine Elkins2026-03-17
📊 statistics

Holographic Invariant Storage: Design-Time Safety Contracts via Vector Symbolic Architectures

تقدم هذه الورقة "التخزين الهولوغرافي الثابت" (Holographic Invariant Storage - HIS)، وهو بروتوكول يستفيد من البنى المتجهة الرمزية لتوفير ضمانات سلامة ذات صيغة مغلقة عند التصميم للحد من انحراف سياق النماذج اللغوية الكبيرة، بما في ذلك حدود محددة على دقة الاسترداد، والمتانة تجاه الضجيج، والسعة، والتي تم التحقق من صحتها من خلال عمليات المحاكاة والتجارب السلوكية.

Arsenios Scrivens2026-03-17
🤖 machine learning

BERTology of Molecular Property Prediction

تتقصى هذه الورقة البحثية بشكل منهجي الأداء غير المتسق لنماذج اللغة الكيميائية (CLMs) في التنبؤ بخصائص الجزيئات، وذلك من خلال إجراء مئات التجارب المنضبطة لتحليل آثار حجم مجموعة البيانات، وحجم النموذج، والتقييس، بهدف تقديم أدلة عددية شاملة وتوضيح الآليات الكامنة التي غالباً ما يتم إغفالها في الأدبيات الحالية.

Mohammad Mostafanejad, Paul Saxe, T. Daniel Crawford2026-03-17
💬 NLP

Benchmarking Large Language Models on Reference Extraction and Parsing in the Social Sciences and Humanities

تقدم هذه الورقة معياراً موحداً لتقييم استخراج المراجع وتحليلها في العلوم الاجتماعية والإنسانية تحت ظروف واقعية، وضوضائية، ومتعددة اللغات، مظهرةً أنه بينما يصل الاستخراج إلى مرحلة التشبع، يظل التحليل يمثل عقبة يتم معالجتها بشكل أفضل عبر الجمع بين الأدوات التقليدية مثل GROBID والنماذج اللغوية الكبيرة المتكيفة مع المهام عبر التوجيه الهجين.

Yurui Zhu, Giovanni Colavizza, Matteo Romanello2026-03-17
💬 NLP

Preconditioned Test-Time Adaptation for Out-of-Distribution Debiasing in Narrative Generation

تقدم الورقة البحثية CAP-TTA، وهو إطار عمل للتكيف في وقت الاختبار يستخدم تحديثات LoRA المدركة للسياق والموجهة بمُهيئ مسبق الحساب للتخفيف ديناميكيًا من انحياز التوزيع الخارجي في توليد السرد مع تقليل زمن الاستجابة ومنع النسيان الكارثي.

Hanwen Shen, Ting Ying, Jiajie Lu, Shanshan Wang2026-03-17
💬 NLP

Repetition Without Exclusivity: Scale Sensitivity of Referential Mechanisms in Child-Scale Language Models

تُظهر هذه الدراسة أن النماذج اللغوية بمقياس الأطفال، والتي تم تدريبها على الكلام الموجه للأطفال، تُبدي تعزيزاً قوياً للتكرار بدلاً من الحصرية المتبادلة، مما يشير إلى أن التأسيس المرجعي وبنى المدخلات المحددة، وليس التحيزات الفطرية، هي الضرورية لتطور الحصرية المتبادلة.

Jon-Paul Cacioli2026-03-17
💬 NLP

Causal Tracing of Audio-Text Fusion in Large Audio Language Models

تُطوّع هذه الورقة البحثية تقنية التتبع السببي (causal tracing) لتكشف أن نماذج اللغة الصوتية الكبيرة توظف استراتيجيات دمج متنوعة على مستوى الطبقات، وتستخدم آليات محددة على مستوى الرمز (token-wise)، مثل عنق الزجاجة في الرمز النهائي ومحفزات الاستعلام الوسيطة، لدمج الميزات الصوتية مع السياق النصي.

Wei-Chih Chen, Chien-yu Huang, Hung-yi Lee2026-03-17
💬 NLP

LiveWeb-IE: A Benchmark For Online Web Information Extraction

تقدم هذه الورقة LiveWeb-IE، وهو معيار مرجعي جديد لتقييم استخراج المعلومات من الويب على المواقع الإلكترونية الحية والمتطورة، وتقترح Visual Grounding Scraper (VGS)، وهو إطار عمل وكيل متعدد المراحل يحاكي الإدراك البصري البشري لاستخراج البيانات بمتانة من صفحات الويب الديناميكية.

Seungbin Yang, Jihwan Kim, Jaemin Choi, Dongjin Kim, Soyoung Yang, ChaeHun Park, Jaegul Choo2026-03-17
🤖 machine learning

Greedy Information Projection for LLM Data Selection

تقدم الورقة البحثية "الإسقاط المعلوماتي الجشع" (Greedy Information Projection - GIP)، وهو إطار عمل منهجي يختار بكفاءة أمثلة تدريب متنوعة وعالية الجودة لضبط النماذج اللغوية الكبيرة، وذلك من خلال تعظيم المعلومات المتبادلة بين البيانات وإشارات الاستعلام الخاصة بالمهمة عبر إجراء تحسين جشع سريع.

Victor Ye Dong, Kuan-Yun Lee, Jiamei Shuai, Shengfei Liu, Yi Liu, Jian Jiao2026-03-17
💬 NLP

DeceptGuard :A Constitutional Oversight Framework For Detecting Deception in LLM Agents

تقدم هذه الورقة DeceptGuard، وهو إطار عمل للرقابة الدستورية يستفيد من مجموعة بيانات خداع اصطناعية ومجموعة هجينة من مراقبات الصندوق الأسود، وسلسلة الأفك "chain-of-thought"، ومراقبات فحص التنشيط (activation-probe) للتفوق بشكل كبير على الأساليب الحالية في اكتشاف السلوكيات الخداعية الدقيقة في وكلاء النماذج اللغوية الكبيرة (LLM agents).

Snehasis Mukhopadhyay2026-03-17