🤖 AI

Towards Efficient Multimodal and Multilingual Opinion Extraction for STI: A QLoRA-Based Fine-Tuning Approach

تقترح هذه الورقة إطار عمل للضبط الدقيق يعتمد على تقنية QLoRA باستخدام نموذج VideoLLaMA2.1 لتعزيز استخراج الآراء متعدد الوسائط ومتعدد اللغات لاستخبارات العلوم والتكنولوجيا، محققةً مكاسب أداء كبيرة مقارنة بنماذج القياس المرجعي للتعلم الصفري، مع دمج وحدة نظر التوقع الضبابي لتقييم القيمة في المهام اللاحقة.

Sheng Hong, Xuanqi Wang, Jiacheng Wang, Yuwei Wang2026-08-17
🤖 AI

BiasTrace: Linking Reasoning Behaviours to Biased Outputs in LLMs

تقدم هذه الورقة BiasTrace، وهو مخطط توصيف يربط سلوكيات استدلالية محددة بمخرجات النماذج اللغوية الكبيرة المتحيزة، مما يكشف أن أنماط الاستدلال الخفية وليس اللغة الصريحة هي التي تقود التحيز، ويسمح بتحسين الكشف والحد من التحيز أثناء وقت الاستدلال.

Varsha Ramineni, Hossein A. Rahmani, Jerome Ramos, Karin Sevegnani, Emine Yilmaz2026-08-17
🤖 AI

Can Language Models Understand mmWave Data? Benchmarking Large Language Models for mmWave Radar-Based Human Understanding

تقدم هذه الورقة البحثية mmWave-QA، وهو أول معيار لتقييم الإدراك البشري عبر موجات المليمتر المرتبط باللغة، والذي يستخدم واجهة تحويل نصي مبتكرة لتحويل السحب النقطية للرادار إلى لغة طبيعية، مما يتيح تقييم قدرات الاستدلال الصفري للنماذج اللغوية الكبيرة عبر مختلف الأجهزة والظروف البيئية الصعبة.

Jeongwan Shin, Jaehyeon Kim, Donguk Ko, Jaeho Choi2026-08-17
🤖 machine learning

Training Fair Tabular Foundation Models

تقدم هذه الورقة FairTFM، وهي استراتيجية تدريب قابلة للتوسع تدمج قيود العدالة مباشرة في النماذج التأسيسية للبيانات الجدولية عبر مهام عدالة اصطناعية وطبقة عكس التدرج، مما يتيح تنبؤات عادلة وسياقية دون الوصول إلى السمات الحساسة مع الحفاظ على دقة تنافسية.

Patrik Kenfack, Jesse C. Cresswell, Anthony L. Caterini, Samira Ebrahimi Kahou, Ulrich Aïvodji2026-08-17
🤖 AI

A Generalized Parallelogram Rule for Proportional Analogies on Riemannian Manifolds

تقدم هذه الورقة علاقة تناظر تناسبي معممة للمتعددات المترية الريمانية من خلال توسيع قاعدة متوازي الأضلاع الإقليدية إلى الفضاءات غير الإقليدية، مبرهنةً على قابليتها للتطبيق في مجالات متنوعة مثل الكرات، وفضاءات الأشكال، ومتعددات توزيع الاحتمالات.

Pierre-Alexandre Murena, Marcelo Hartmann2026-08-17
🤖 AI

MathForm: Scaling Mathematical Autoformalization with Knowledge Retrieval and Verification-Guided Refinement

تقدم الورقة البحثية MathForm، وهو إطار عمل يستفيد من استرجاع معرفة Mathlib والتحسين التكراري الموجه بالتحقق لبناء مجموعة بيانات FormalVerse واسعة النطاق، مما يمكّن تدريب نموذج MathForm-8B، الذي يتفوق بشكل كبير على نماذج الصياغة الآلية المتخصصة الحالية عبر معايير متعددة.

Lushi Pu, Weiming Zhang, Xinheng Xie, Zixuan Fu, Bingxiang He, Hengyu Zhao, Hongya Lyu, Xin Li, Jie Zhou, Yudong Wang2026-08-17
🤖 AI

Grounding Without Corrective Control: Truth-Tracking Profiles for Large Language Models

تقترح هذه الورقة إطاراً لتحليل قدرات تتبع الحقيقة لدى النماذج اللغوية الكبيرة من خلال التمييز بين "القابلية للإجابة الاشتقاقية" (الموروثة من أنماط التدريب) و"القابلية للإجابة الحية" (المعتمدة على مسارات تصحيح مستقلة وفورية)، مع المحاجة بأنه في حين تفتقر النماذج التي تعتمد على النصوص فقط إلى الأخيرة، فإن تدخلات محددة مثل الاسترجاع واستخدام الأدوات يمكن أن تستعيد التأصيل بشكل انتقائي دون اشتراط السيطرة التصحيحية الكاملة.

Brett Reynolds2026-08-17
🔬 physics

Meteorology-driven Causal Nowcasting of Fugitive Landfill Emissions Enables Proactive Public Health Response

تقدم هذه الورقة إطار عمل CAIRN، وهو إطار عمل للتعلم الآلي مدفوع بالأرصاد الجوية يتيح استجابات استباقية للصحة العامة تجاه انبعاثات المكبات المتطايرة من خلال التنبؤ الآني الدقيق للتعرض للغازات السامة وتأثيرات الروائح على المجتمع في الوقت الفعلي، مما ينقل التدخل من التحقيق الاسترجاعي إلى العمل الفوري.

Timothy C. Pearce, David J. T. Smith, Alec Dobney, Alessia Freddo2026-08-17
🤖 machine learning

Multi-Objective Bayesian Optimization for Model Merging

تقدم هذه الورقة البحثية إطار عمل MOBO-Merge، الذي يستخدم التحسين البايزي متعدد الأهداف لاختيار معلمات الدمج بكفاءة لدمج نماذج متعددة في فضاء الأوزان، مما يظهر أداءً متفوقاً على البحث العشوائي عبر مختلف مشغلات الدمج وتكوينات النماذج.

Utkarsh Agarwal, Vamshi Bonagiri, Raul Astudillo, Monojit Choudhury2026-08-17
💬 NLP

SimpleOPD: Simple Tokenizer-Agnostic On-Policy Distillation for Long-Context Reasoning

تقدم الورقة البحثية SimpleOPD، وهو إطار عمل للتقطير في السياسة (on-policy distillation) غير مرتبط بنوع الـ tokenizer، يعمل على محاذاة الامتدادات النصية المشتركة ويستخدم فقدان KL مرجعي للطالب لتقطير قدرات الاستدلال البرهاني ذات السياق الطويل بفعالية من المعلمين الأقوياء إلى الطلاب ذوي السياق القصير، مما يحقق مكاسب أداء كبيرة في الاختبارات المرجعية الرياضية والعلمية.

Haonan He, Haodi Lei, Yun Luo, Haoran Zhang, Shunkai Zhang, Yizhuo Li, Shengji Tang, Zhilin Wang, Runzhe Zhan, Lei Bai (…)2026-08-17