💬 NLP

The politics of postmortem privacy

تتناول هذه الورقة عدم الاستقرار الداخلي والتوترات السياسية المتعلقة بالخصوصية بعد الوفاة من خلال تحليل نطاقها المتفاوت، ومبرراتها، وصياغاتها القضائية عبر السياقات العابرة للمحيط الأطلسي، وداخل أوروبا، ودول الجنوب العالمي، للكشف عن كيفية تفاوض المجتمعات بشأن الذاكرة والكرامة من خلال حوكمة بيانات الأفراد المتوفين.

Mauricio Figueroa2026-08-19
💬 NLP

Institution-Specific LLM Prompting Recovers PHI That De-identification Systems and Their Gold Standards Both Miss

تُظهر هذه الدراسة أن التلقين الموجه لنماذج اللغات الكبيرة الخاص بالمؤسسات يستعيد بفعالية معلومات صحية محمية محددة محلياً أغفلتها أنظمة إزالة تحديد الهوية التقليدية ومعاييرها المرجعية، محققةً بذلك استدعاءً ودقةً فائقين مع تمكين تدقيق وتصحيح أخطاء التوسيم المرجعي في الوقت ذاته.

Daniel Palacios, Matthew Brady Neeley, Angel Adetomike Otto, Shalini Dhamodharan, John P. Woodhouse, Chi-fan Lin, Mark Z (…)2026-08-19
🤖 AI

Memory Is Communication: The Frontier Between Remembering and Signaling

تقترح هذه الورقة "تخوم التذكر والإشارة" كإطار لتحليل كيفية تخصيص الوكلاء المحدودين للموارد المحدودة بشكل أمثل بين الذاكرة الداخلية والتواصل مع الأقران لتقليل فقدان المهام، مفترضةً أن القدرة الأكبر على التنبؤ التاريخي تقلل من الحاجة إلى الإشارات الخارجية، وهي نظرية تدعمها تجارب ألعاب المراجع الأولية.

Yashar Talebirad, Eden Redman, Ali Parsaee, Osmar R. Zaiane2026-08-19
💬 NLP

There is No Theoretical Curse of Multilinguality For Embedding Space Structure

تثبت هذه الورقة نظرياً أن "لعنة تعدد اللغات" ليست قيداً متأصلاً في بنية فضاء التضمين، حيث ينمو البعد المطلوب للمحاذاة المثالية متعددة اللغات بشكل لوغاريتمي فقط مع عدد اللغات، مما يشير إلى أن تدهور الأداء الملحوظ ينبع من بيانات العالم الحقيقي وظروف التدريب بدلاً من القيود النظرية.

Niyati Bafna, Neha Verma, Vilém Zouhar, Philipp Koehn, David Yarowsky2026-08-19
💬 NLP

Children, but not language models, show accelerating returns in word learning

تكشف هذه الورقة أنه في حين يُظهر الأطفال عوائد متسارعة في تعلم الكلمات من خلال زيادة كفاءتهم مع كل وحدة جديدة من الخبرة اللغوية، فإن النماذج اللغوية —حتى تلك المدربة على الكلام الموجه للأطفال— لا تُظهر سوى عوائد نسبية ثابتة تتوافق مع قوانين القياس.

Michael C. Frank2026-08-19
💬 NLP

Can LLMs Reason in a Legally Meaningful Manner? A Small-scale Study on European Court of Human Rights Cases

تقيم هذه الدراسة قدرة نموذج لغوي كبير من الفئة الأولى على إجراء استدلال قانوني ذي مغزى في قضايا المحكمة الأوروبية لحقوق الإنسان، حيث وجدت أن النموذج ينتج تحليلات كاملة من الناحية الهيكلية ولكنها ضحلة من الناحية الموضوعية، وأن المقيمين الآليين يفشلون في التوافق مع التقدير البشري، بينما يعمل التوجيه الخبير على تحسين عمق الاستدلال دون تعزيز دقة التنبؤ.

Amogh Raina, Ilias Chalkidis, Daniel Hershcovich, Henrik Palmer Olsen2026-08-19
💬 NLP

Token Optimization and Context Window Management in Multi-Agent AI Workflows

تقدم هذه الورقة إطار عمل عملي لتحسين استخدام الرموز (tokens) وإدارة نوافذ السياق في تدفقات عمل الذكاء الاصطناหลาย الوكلاء، حيث تثبت من خلال بيانات الإنتاج والدراسات المنضبطة أن استراتيجيات مثل "تدرج السياق" وتكوين سياق "تباين الصلة" يمكن أن تقلل بشكل كبير من زمن الاستجابة والتكاليف مع تحسين دقة النموذج.

Dvir Shamay2026-08-19
💬 NLP

Which Source Wins? Task-Dependent Reliance in Vision-Language Models

تكشف هذه الورقة أن نماذج الرؤية واللغة تغير اعتمادها ديناميكياً بين النصوص والصور بناءً على نوع المهمة وهيكل الأدلة، حيث تُظهر تفضيلاً للنصوص على الصور المتدهورة في المسائل الحسابية، لكنها تُظهر تفضيلاً أقوى للصور على النصوص المتدهورة في مهام الاستدلال القائمة على المخططات البيانية.

Rodela Ghosh, Aviral Gupta, Guangjing Wang2026-08-19
💬 NLP

What Tokens are Learned when Tokenization is Optimized Jointly with Language Modeling?

تُثبت هذه الورقة أن التحسين المشترك لعملية التجزئة مع النمذجة اللغوية يغير هياكل الرموز بشكل جذري، مما يكشف أن النهج الخالي من المجزئ مثل نماذج اللغة ذات التعلم الذاتي (SSLMs) تتعلم رموزاً متوافقة صرفياً وفعالة سياقياً تقلل من الحيرة وتحقق أداءً تنافسياً في المهام اللاحقة عبر لغات متنوعة، على عكس الشبكات الهجينة (H-Nets) التي تعطي الأولوية لكفاءة مستوى البايت.

Saketh Reddy Vemula, Parameswari Krishnamurthy2026-08-19
🤖 AI

LLMs for Medical Consultation Are Evaluated Too Late: The Preformulation Gap

تجادل هذه الورقة بأن تقييم النماذج اللغوية الكبيرة المخصصة للاستشارات الطبية يتم حالياً في مرحلة متأخرة جداً من العملية، حيث تُظهر أن التعليمات الصريحة يمكن أن تحسن التوثيق المنظم ولكنها تفشل في منع تقديم نصائح الرعاية الذاتية المبكرة بشكل موثوق أو ضمان استقاء الحقائق الجوهرية خلال مرحلة "ما قبل الصياغة" الأولية لشكوى مريض غامضة.

Yining Hua, Cyrus Ayubcha, Hongbin Na, Levi Lian, Alon Gorenshtein, Yiftach Barash, Eyal Klang2026-08-19