💬 NLP

TAF-MED: Multi-Turn Safety Refusal Collapse in LLMs Under Declared Self-Treatment Intent

تقدم الورقة البحثية TAF-MED، وهو معيار مراجع من قبل أطباء يوضح أن النماذج اللغوية الكبيرة غالباً ما تنهار من الاستجابات الآمنة الأولية إلى نصائح طبية غير آمنة في المحادثات متعددة الأدوار، مما يكشف أن تقييمات السلامة في الدور الأول ليست مؤشرات كافية لسلامة المحادثة الإجمالية.

Waleed Jamil, Raphael Schmitt2026-08-12
🤖 machine learning

MRIComp4Flow: Compression of 3D Brain MRI for Training Multi-Modal Generative Models

تُثبت هذه الورقة أن بيانات التصوير بالرنين المغناطيسي ثلاثي الأبعاد للدماغ يمكن ضغطها بفعالية باستخدام برامج الترميز القياسية مثل JPEG2000 بنسب عالية (20:1) دون تدهور إحصائي في جودة التوليد للنماذج التوليدية متعددة الوسائط المدربة، مما يتيح التدريب القابل للتوسع على البنية التحتية العادية.

Lisa K. Fischer, Mykhailo Riabets, Daniel Rueckert, Benedikt Wiestler, Anke Meyer-Baese, Sandeep Nagar2026-08-12
💻 computer science

Frozen Brain-MRI Foundation Models Are Site Fingerprints

تكشف هذه الورقة أن نماذج التأسيس لصور الرنين المغناطيسي للدماغ المجمدة تشفر بطبيعتها معلومات موقع الاستحواذ كبصمة مهيمنة وقابلة للفك خطياً تتفوق غالباً على المتغيرات السريرية، مما يشكل مخاطر جسيمة في العزو ويخلق مقايضة بين إزالة انحياز الموقع والحفاظ على دقة التجزئة التشريحية.

Saman Rahbar2026-08-12
💬 NLP

Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility

تقدم هذه الورقة "الاتساق عبر السياقات" (C3)، وهو مقياس يقيم مصداقية النماذج اللغوية الكبيرة من خلال قياس استقرار استجابات النموذج تحت التغيرات السياقية، مما يثبت أن الاتساق الأعلى يرتبط بدقة أكبر ويعمل كأداة تشخيصية لتشبع الاختبارات المعيارية.

Siyang Wu, Yibo Jiang, Bryon Aragam2026-08-12
💻 computer science

Toward a Theory of Value in AI Alignment

من خلال تحليل 94 ورقة بحثية حول توافق القيم، تنتقد هذه الدراسة اعتماد المجال على التفضيلات غير المحددة والبيانات الاصطناعية، محاجةً بأن مثل هذه النهج تبسط القيم البشرية بشكل مفرط وتخاطر بإغلاق الآفاق أمام وجهات النظر المتنوعة حول كيفية تحقيق الذكاء الاصطنا truly توافق مع الاحتياجات البشرية.

Andrew Smart, Shazeda Ahmed, Jackie Kay, Jimmy Tobin, Kris Shrishak, Abeba Birhane2026-08-12
💻 computer science

Hierarchical Compositionality for An Assistive AI Agent

تقترح هذه الورقة بنية لوكيل ذكاء اصطناعي كفؤة في استهلاك الموارد وقابلة للتفسير، تعتمد على التركيب الهرمي والميزات الدلالية التي تم التحقق منها بشرياً لحل غموض الكائنات بفعالية من خلال الاستنتاج والتكيف الخاص بالمستخدم، متفوقة بذلك على النماذج المرجعية القائمة على البيانات والمتطورة حالياً.

Tianyi Fu, Mohan Sridharan2026-08-12
💬 NLP

Narrative Keyframing for Generative Creative Writing

تقدم هذه الورقة "التأطير السردي المفتاحي"، وهي تقنية كتابة إبداعية مدعومة بالذكاء الاصطناًعي مستوحاة من الرسوم المتحركة، تتيح للكُتّاب تحديد قيود الحبكة والشخصية والمنظور في لحظات قصصية محددة لتوليد النثر البيني، مما يوفر بذلك سير عمل أكثر تحكماً وشفافية وتفاعلية للسرد القصصي التكراري.

Chao Zhang, Abe Davis2026-08-12
📊 statistics

Expert-Guided g-computation with Large Language Models for Estimating Causal Effects on Timings: Applications to Hospital Quality Improvement

تقترح هذه الورقة "الحوسبة البيضوية" (egg-computation)، وهي إطار عمل للحوسبة الهيكلية (g-computation) بتوجيه من الخبراء ومعزز بنماذج اللغات الكبيرة، يجمع بين الاستدلال السريري والاستدلال السببي القائم على البيانات لتقدير وترتيب آثار توفير الوقت لتدخلات تحسين جودة المستشفيات بدقة، لا سيما للمقاييس مثل مدة الإقامة حيث تعاني الطرق التقليدية مع السيناريوهات الافتراضية أو الآليات السببية المعقدة.

Patrick Vossler, Jialin Ouyang, F. Richard Guo, Anran Huang, Ali Shojaie, Lucas Zier, Fan Xia, Jean Feng2026-08-12
🤖 machine learning

Efficient Reinforcement Learning for Long-Horizon Tool-Use Agentic Tasks

تقدم هذه الورقة البحثية SINKFLEX-RL، وهو نظام تدريب معياري يدمج واجهات البيئة، وتدفق بيانات التعلم المعزز، ومسار FlexAttention المدرك للمصب (sink-aware) لتمكين التعلم المعزز طويل الأمد وفعال الذاكرة للوكلاء مستخدمي الأدوات، مما أظهر تحسناً في مكافآت التحقق وانخفاضات كبيرة في ذاكرة الوصول العشوائي للفيديو (VRAM) في الاختبارات المعيارية الأولية.

Zelei Cheng, Amritansh Mishra, Sambit Sahu, William Campbell2026-08-12
💻 computer science

MemSpec: Memory-Aware Runtime for Adaptive Draft Scheduling in Speculative Decoding on Edge Devices

تُعد MemSpec بيئة تشغيل مدركة للذاكرة تعمل على تعزيز فك التشفير الاستباقي على أجهزة الحافة من خلال فصل اختيار المسودة عن التنفيذ عبر الإدارة الاستباقية لمجموعة العمل، مما يؤدي إلى تحسين الإنتاجية بنسبة 40.7% مقارنة بالطرق التكيفية الحالية مع تقليل عبء تبديل النماذج إلى أدنى حد.

Eunjeong Kim, Yeong Jun Jeon, Myeonggyun Han2026-08-12