💬 NLP

KAPSO: A Knowledge-grounded framework for Autonomous Program Synthesis and Optimization

يُعد KAPSO إطار عمل معياريًا قائمًا على المعرفة، يعمل على تعزيز التوليف والتحسين الذاتي للبرامج من خلال دمج محرك تجريب أصيل في نظام git، ونظام معرفي مهيكل، وطبقة ذاكرة إدراكية، وذلك لتحسين المصوغات البرمجية بشكل تكراري والتغلب على الإخفاقات طويلة المدى في الوكلاء البرمجيين.

Alireza Nadafian, Alireza Mohammadshahi, Majid Yazdani2026-02-03
💬 NLP

Shaping capabilities with token-level data filtering

تُثبت هذه الورقة أن تصفية بيانات ما قبل التدريب على مستوى الرمز (token) هي وسيلة قابلة للتوسع، وقوية، وفعالة من حيث التكلفة لتشكيل النماذج اللغوية لإزالة القدرات غير المرغوب فيها أثناء مرحلة ما قبل التدريب، متفوقةً بذلك على التصفية على مستوى المستند والأساليب المتبعة في المحاذاة اللاحقة.

Neil Rathi, Alec Radford2026-02-03
💬 NLP

ChunkNorris: A High-Performance and Low-Energy Approach to PDF Parsing and Chunking

تقدم هذه الورقة تقنية ChunkNorris، وهي تقنية قائمة على الاستدلال (heuristic-based) عالية الأداء ومنخفضة استهلاك الطاقة لتحليل وتقسيم ملفات PDF، والتي تتفوق على الأساليب الحالية في وقت التنفيذ، واستهلاك الطاقة، ودقة الاسترجاع دون الاعتماد على تعلم الآلة.

Mathieu Ciancone, Clovis Varangot-Reille, Marion Schaeffer2026-02-03
💬 NLP

Chained Prompting for Better Systematic Review Search Strategies

تقدم هذه الورقة إطار عمل يعتمد على التلقين المتسلسل للنماذج اللغوية الكبيرة (LLM) يعمل على أتمتة تطوير استراتيجيات البحث للمراجعات المنهجية عبر محاكاة إجراءات التصميم اليدوية، محققاً أداءً فائقاً في الاستدعاء وتوليد عناصر (PICO) جيدة الهيكلة مقارنة بالأساليب الحالية.

Fatima Nasser, Fouad Trad, Ammar Mohanna, Ghada El-Hajj Fuleihan, Ali Chehab2026-02-03
💬 NLP

PTCBENCH: Benchmarking Contextual Stability of Personality Traits in LLM Systems

تقدم هذه الورقة PTCBENCH، وهو معيار منهجي يقيم الاستقرار السياقي لشخصيات النماذج اللغوية الكبيرة عبر سيناريوهات خارجية متنوعة باستخدام مقياس "نيو" للعوامل الخمسة الكبرى للشخصية، مما يكشف أن أحداثاً حياتية محددة يمكن أن تغير بشكل كبير كلاً من سمات الشخصية والقدرات الاستدلالية.

Jiongchi Yu, Yuhan Ma, Xiaoyu Zhang, Junjie Wang, Qiang Hu, Chao Shen, Xiaofei Xie2026-02-03
💬 NLP

SafeTalkCoach: Diversity-Driven Multi-Agent Simulation for Parent-Teen Health Conversations

يُعد SafeTalkCoach إطار عمل متعدد الوكلاء مدفوعاً بالتنوع، يقوم بتوليد محادثات واقعية وعالية الجودة وقابلة للتحكم بين الآباء والمراهقين حول الصحة الجنسية، وذلك لمعالجة ندرة البيانات الواقعية ودعم كل من أبحاث الذكاء الاصطوي وممارسات التواصل الصحي.

Benyamin Tabarsi, Wenbo Li, Tahreem Yasir, Aryan Santhosh Kumar, Laura Widman, Dongkuan Xu, Tiffany Barnes2026-02-03
💬 NLP

Extending Beacon to Hindi: Cultural Adaptation Drives Cross-Lingual Sycophancy

تُظهر هذه الدراسة أن توسيع نطاق تشخيص "بيكون" (Beacon) لظاهرة التملق يكشف عن أن معدلات التملق في اللغة الهندية أعلى بكثير في المطالبات المتكيفة ثقافياً مقارنة باللغة الإنجليزية، مما يشير إلى أن التأطير الثقافي، وليس الترميز اللغوي وحده، هو المحرك الأساسي لإخفاقات المحاذاة عبر اللغات.

Sarthak Sattigeri2026-02-03
💬 NLP

FoundationalASSIST: An Educational Dataset for Foundational Knowledge Tracing and Pedagogical Grounding of LLMs

تقدم هذه الورقة البحثية FoundationalASSIST، وهي مجموعة بيانات تعليمية شاملة تحتوي على 1.7 مليون تفاعل تفصيلي للطلاب ومواءمة مع معايير التعليم من الروضة وحتى الصف الثاني عشر (K-12)، والتي تكشف أن النماذج اللغوية الكبيرة الرائدة الحالية تفتقر بشكل كبير إلى القدرات المطلوبة لتتبع المعرفة الموثوق والاستدلال التربوي الضروري للتعلم الشخصي.

Eamon Worden, Cristina Heffernan, Neil Heffernan, Shashank Sonkar2026-02-03
💬 NLP

SPARC-RAG: Adaptive Sequential-Parallel Scaling with Context Management for Retrieval-Augmented Generation

إن SPARC-RAG هو إطار عمل متعدد الوكلاء يعمل على تحسين التوليد المعزز بالاسترجاع للأسئلة المعقدة متعددة الخطوات من خلال التنسيق التكيفي لتوسيع الاستدلال المتسلسل والمتوازي عبر إدارة موحدة للسياق، وتوليد استعلامات فرعية مستهدفة، وضبط دقيق على مستوى العمليات لتحقيق دقة فائقة بتكاليف حوسبة أقل.

Yuxin Yang, Gangda Deng, Ömer Faruk Akgül, Nima Chitsazan, Yash Govilkar, Akasha Tigalappanavara, Shi-Xiong Zhang, Sambi (…)2026-02-03
💬 NLP

CARE-RFT: Confidence-Anchored Reinforcement Finetuning for Reliable Reasoning in Large Language Models

تقدم الورقة البحثية CARE-RFT، وهي طريقة جديدة للضبط الدقيق بالتعزيز تستخدم تباعد كيه إل العكسي المائل (skew reverse KL divergence) لحل المقايضة بين أداء الاستدلال وموثوقية النموذج، محققةً قدرات الاستدلال العالية للضبط الدقيق بالتعزيز غير المقيد مع الحفاظ على المعايرة والموثوقية للنموذج الأساسي.

Shuozhe Li, Jincheng Cao, Bodun Hu, Aryan Mokhtari, Leqi Liu, Amy Zhang2026-02-03