💬 NLP

MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining

إن MachineLearningLM هو إطار عمل للتدريب المسبق المستمر يزود النماذج اللغوية الكبيرة ذات الأغراض العامة بقدرات قوية للتعلم داخل السياق متعدد الأمثلة لمهام تعلم الآلة من خلال توليف ملايين النماذج السببية الهيكلية وتقطير الاستراتيجيات القائمة على الأشجار، مما يمكّنها من التفوق على النماذج المرجعية القوية في التصنيف الجدولي مع الحفاظ على قدرات الدردشة العامة.

Haoyu Dong, Pengkun Zhang, Mingzhe Lu, Yanzhen Shen, Guolin Ke2026-04-14
💬 NLP

A Comparative Benchmark of Large Language Models for Labelling Wind Turbine Maintenance Logs

تقدم هذه الورقة إطار عمل مفتوح المصدر لتقييم نماذج لغوية كبيرة متنوعة في تصنيف سجلات صيانة توربينات الرياح غير المهيكلة، مما يكشف أنه بينما تظهر النماذج الرائدة توافقاً ومعايرة عاليين، فإن نهج "الإنسان في الحلقة" هو الاستراتيجية الأكثر فعالية على المدى القريب للاستفادة من قدراتها في تحسين جودة بيانات الصيانة.

Max Malyi, Jonathan Shek, Alasdair McDonald, Andre Biscaya2026-04-14
💬 NLP

Multi-Model Synthetic Training for Mission-Critical Small Language Models

تقدم هذه الورقة إطار عمل فعال من حيث التكلفة لتدريب نماذج لغوية صغيرة ذات مهام حرجة في مجال الاستخبارات البحرية، وذلك عبر الاستفታدة من توليد بيانات اصطناعية متعددة النماذج لضبط نموذج Qwen2.5-7B، محققةً دقة بنسبة 75% مع خفض في التكلفة بمقدار 261 ضعفاً مقارنة باستخدام النماذج الأكبر للاستدلال المباشر.

Nolan Platt, Pragyansmita Nayak2026-04-14
💬 NLP

CARINOX: Inference-time Scaling with Category-Aware Reward-based Initial Noise Optimization and Exploration

يُعدُّ CARINOX إطار عمل موحداً يعزز المحاذاة التركيبية لنماذج الانتشار من النص إلى الصورة عبر دمج تحسين واستكشاف الضجيج الأولي مع استراتيجية اختيار مكافأة مبدئية مرتبطة بالحكم البشري، محققاً بذلك مكاسب أداء كبيرة مقارنة بالأساليب المتطورة دون الحاجة إلى ضبط دقيق للنموذج.

Seyed Amir Kasaei, Ali Aghayari, Arash Marioriyad, Niki Sepasian, Shayan Baghayi Nejad, MohammadAmin Fazli, Mahdieh Sole (…)2026-04-14
💬 NLP

FS-DFM: Fast and Accurate Long Text Generation with Few-Step Diffusion Language Models

تقدم الورقة البحثية نموذج FS-DFM، وهو نموذج لغوي قائم على مطابقة التدفق المنفصل بعدد قليل من الخطوات، يحقق توليد نصوص طويلة عالية الجودة بسرعة تفوق نماذج الانتشار التقليدية بمقدار يصل إلى 128 ضعفاً، وذلك عبر التدريب على اتساق الخطوات واستخدام قواعد تحديث موثوقة لتمكين التوليد الدقيق في 8 خطوات فقط.

Amin Karimi Monsefi, Nikhil Bhendawade, Manuel Rafael Ciosici, Dominic Culver, Yizhe Zhang, Irina Belousova2026-04-14
💬 NLP

StyleBench: Evaluating thinking styles in Large Language Models

تقدم هذه الورقة البحثية StyleBench، وهو معيار شامل لتقييم خمسة أساليب استدلال عبر 15 نموذجاً من النماذج اللغوية الكبيرة مفتوحة المصدر لإثبات أن فوائد الاستدلال المهيكل تقتصر بدقة على متطلبات المهمة وقدرة النموذج، مع إظهار أن التعلم المعزز يتفوق أيضاً على الضبط الدقيق الخاضع للإشراف في تمكين الاختيار التكيفي للاستراتيجية.

Junyu Guo, Shangding Gu, Ming Jin, Costas Spanos, Javad Lavaei2026-04-14
💬 NLP

StableToken: A Noise-Robust Semantic Speech Tokenizer for Resilient SpeechLLMs

يقدم StableToken مُجزئًا دلاليًا للكلام متينًا تجاه الضجيج، يستخدم بنية متعددة الفروع مع آلية تصويت على مستوى البت لتحقيق استقرار قائم على الإجماع، مما يقلل بشكل كبير من تباين الرموز تحت الاضطرابات الصوتية ويعزز متانة نماذج الكلام اللغوية الكبيرة (SpeechLLMs) اللاحقة.

Yuhan Song, Linhao Zhang, Chuhan Wu, Aiwei Liu, Wei Jia, Houfeng Wang, Xiao Zhou2026-04-14
💬 NLP

ChatInject: Abusing Chat Templates for Prompt Injection in LLM Agents

تقدم الورقة البحثية ChatInject، وهو هجوم مبتكر يستغل اعتماد وكلاء النماذج اللغوية الكبيرة (LLMs) على قوالب الدردشة المهيكلة والحوارات متعددة الأدوار الإقناعية لتحقيق معدلات نجاح في حقن الأوامر أعلى بكثير من الطرق التقليدية، مع إظهار قدرة قوية على الانتقال والتحايل على الدفاعات الحالية.

Hwan Chang, Yonghyun Jun, Hwanhee Lee2026-04-14
💬 NLP

Infusing Theory of Mind into Socially Intelligent LLM Agents

تقدم هذه الورقة ToMA، وهو وكيل حواري تم تدريبه على توليد حالات ذهنية مفيدة صراحةً عبر الاستشراف الحواري، مما يثبت أن دمج نظرية العقل يعزز بشكل كبير من التفكير الاستراتيجي للنماذج اللغوية الكبيرة، وتحقيق الأهداف، والحفاظ على العلاقات في التفاعلات الاجتماعية.

EunJeong Hwang, Yuwei Yin, Giuseppe Carenini, Peter West, Vered Shwartz2026-04-14
💬 NLP

EEPO: Exploration-Enhanced Policy Optimization via Sample-Then-Forget

تقدم الورقة البحثية إطار عمل "تحسين السياسة المعزز بالاستكشاف" (EEPO)، وهو إطار للتعلم التعزيزي للنماذج اللغوية الكبيرة يعمل على تخفيف انهيار الإنتروبيا وتحسين أداء الاستدلال من خلال توظيف آلية "العينة ثم النسيان" لتعطيل حلقات السلوك ذاتية التعزيز وتعزيز الاستكشاف.

Liang Chen, Xueting Han, Qizhou Wang, Bo Han, Jing Bai, Hinrich Schutze, Kam-Fai Wong2026-04-14