💻 computer science

VeriInteresting: An Empirical Study of Model Prompt Interactions in Verilog Code Generation

تقدم هذه الورقة دراسة تجريبية ترسم التفاعلات بين خصائص النموذج واستراتيجيات هندسة الأوامر البرمجية لتوليد كود Verilog، مما يكشف عن الاتجاهات التي تعمم عبر نماذج لغوية ومعايير قياس متنوعة من خلال تجارب منضبطة.

Luca Collini, Andrew Hennesee, Patrick Yubeaton, Siddharth Garg, Ramesh Karri2026-03-11
💻 computer science

Self-hosted Lecture-to-Quiz: Local LLM MCQ Generation with Deterministic Quality Control

تقدم هذه الورقة مسار عمل متكامل ومستضاف ذاتياً يحول ملفات الـ PDF الخاصة بالمحاضرات إلى أسئلة اختيار من متعدد باستخدام نموذج لغوي كبير محلي وضبط جودة حتمي، مما يضمن الخصوصية والمساءلة مع إصدار مجموعة بيانات مكونة من 24 سؤالاً تم التحقق منها مع تصنيف تفصيلي للتحذيرات للاستخدام التعليمي.

Seine A. Shintani2026-03-11
🤖 AI

Fish Audio S2 Technical Report

تقدم هذه الورقة نظام Fish Audio S2، وهو نظام مفتوح المصدر لتحويل النص إلى كلام يستفيد من مسار تدريب متعدد المراحل لتمكين التوليد متعدد المتحدثين ومتعدد الأدوار مع اتباع التعليمات باللغة الطبيعية، مع توفير أوزان جاهزة للإنتاج ومحرك استدلال فعال يعتمد على SGLang.

Shijia Liao, Yuxuan Wang, Songting Liu, Yifan Cheng, Ruoyi Zhang, Tianyu Li, Shidong Li, Yisheng Zheng, Xingwei Liu, Qin (…)2026-03-11
🤖 AI

MASEval: Extending Multi-Agent Evaluation from Models to Systems

تقدم MASEval مكتبةً غير مرتبطة بإطار عمل محدد تنقل تقييم الوكلاء المتعددين من نهج متمحور حول النموذج إلى نهج متمحور حول النظام، وتثبت من خلال تجارب مكثفة أن قرارات التنفيذ المتعلقة بالبنية الطوبولوجية والتنسيق تؤثر على الأداء بشكل كبير بقدر تأثير اختيار النموذج نفسه.

Cornelius Emde, Alexander Rubinstein, Anmol Goel, Ahmed Heakl, Sangdoo Yun, Seong Joon Oh, Martin Gubri2026-03-11
💬 NLP

One Language, Two Scripts: Probing Script-Invariance in LLM Concept Representations

تُثبت هذه الورقة أن ميزات المشفّر التلقائي المتناثر (Sparse Autoencoder) في نماذج "جيما" (Gemma) تلتقط الدلالات المجردة بدلاً من الأشكال الكتابية السطحية، وذلك من خلال إظهار أن الجمل الصربية المتطابقة المكتوبة بنصوص رمزية مختلفة تماماً (اللاتينية والسيريلية) تُنشط ميزات متداخلة للغاية، مع زيادة هذا الثبات الرمزي مع نمو حجم النموذج.

Sripad Karne2026-03-11
💬 NLP

MultiGraSCCo: A Multilingual Anonymization Benchmark with Annotations of Personal Identifiers

تقدم الورقة البحثية MultiGraSCCo، وهو معيار مرجعي متعدد اللغات يحتوي على أكثر من 2,500 معرف شخصي مشروح عبر عشر لغات، والذي تم إنشاؤه باستخدام ترجمة آلية مكيفة ثقافياً لبيانات اصطناعية لتسهيل تطوير وتقييم أنظمة إخفاء الهوية مع تجاوز لوائح الخصوصية المرتبطة ببيانات المرضى الحقيقية.

Ibrahim Baroud, Christoph Otto, Vera Czehmann, Christine Hovhannisyan, Lisa Raithel, Sebastian Möller, Roland Roller2026-03-11
💬 NLP

ConFu: Contemplate the Future for Better Speculative Sampling

تقدم هذه الورقة ConFu، وهو إطار عمل جديد لفك التشفير الاستنتاجي يعزز دقة النموذج المسودة من خلال تمكين التوقع المستقبلي عبر رموز التأمل (contemplate tokens) والمطالبات الناعمة (soft prompts)، مما يحقق تحسناً بنسبة 8-11% في معدلات قبول الرموز وسرعة التوليد مقارنة بالطرق الرائدة مثل EAGLE-3.

Zongyue Qin, Raghavv Goel, Mukul Gagrani, Risheek Garrepalli, Mingu Lee, Yizhou Sun2026-03-11
💬 NLP

SciTaRC: Benchmarking QA on Scientific Tabular Data that Requires Language Reasoning and Complex Computation

تقدم الورقة البحثية SciTaRC، وهو معيار مرجعي من إعداد خبراء يوضح أن نماذج الذكاء الاصطناعي الحالية تواجه صعوبة كبيرة في الأسئلة الجدولية العلمية التي تتطلب كلاً من الاستدلال اللغوي العميق والحساب المعقد بسبب "عنق زجاجة التنفيذ" العالمي حيث تفشل النماذج في تنفيذ الخطط بأمانة رغم امتلاكها للاستراتيجيات الصحيحة.

Hexuan Wang, Yaxuan Ren, Srikar Bommireddypalli, Shuxian Chen, Adarsh Prabhudesai, Rongkun Zhou, Elina Baral, Philipp Ko (…)2026-03-11
🤖 AI

VoxEmo: Benchmarking Speech Emotion Recognition with Speech LLMs

تقدم الورقة البحثية VoxEmo، وهو معيار ومجموعة أدوات شاملة لتقييم نماذج اللغة الكبيرة الصوتية في التعرف على العواطف من خلال الكلام عبر 35 مجموعة بيانات و15 لغة، ويتميز ببروتوكول التسمية اللينة المدرك للتوزيع والذي يكشف كيف تتوافق هذه النماذج بشكل فريد مع التوزيعات العاطفية الذاتية البشرية رغم تراجعها عن النماذج المرجعية الخاضعة للإشراف في دقة التسمية الصلبة.

Hezhao Zhang, Huang-Cheng Chou, Shrikanth Narayanan, Thomas Hain2026-03-11
🤖 AI

BiCLIP: Domain Canonicalization via Structured Geometric Transformation

تقدم الورقة البحثية BiCLIP، وهو إطار عمل بسيط وفعال من حيث عدد المعلمات، يحقق أداءً هو الأفضل في فئته في مجال التكيف مع النطاقات ببيانات قليلة لنماذج الرؤية واللغة، وذلك عبر تطبيق تحويل هندسي مهيكل لمحاذاة الميزات متعددة الوسائط عبر نطاقات متباينة باستخدام مجموعة صغيرة من عينات المرتكز.

Pranav Mantini, Shishir K. Shah2026-03-11