🤖 machine learning

Semalith v1.4: A Calibrated 184M Safety Classifier Achieving State-of-the-Art Prompt-Injection Detection at 44x Fewer Parameters than Llama-Guard-3-8B

يُعد Semalith v1.4 مصنف سلامة عالي الكفاءة بـ 184 مليون معلمة، يحقق مستويات رائدة في اكتشاف حقن الأوامر (prompt-injection) وصفر من الإيجابيات الكاذبة في المطالبات الوكيلية السليمة، مع امتلاكه 44 ضعفاً أقل من المعلمات مقارنة بـ Llama-Guard-3-8B، بينما يتميز بقدرته الفريدة على تقديم اكتشاف متزامن للضرر العام والامتثال التنظيمي المالي في تمريرة استدلال واحدة.

Tejasvi C. Addagada2026-07-28
🔢 mathematics

Learning to Optimize at Scale: A Benders Decomposition-TransfORmers Framework for Stochastic Combinatorial Optimization

تقترح هذه الورقة إطار عمل لتفكيك "بندرز" معزز بالتعلم، يستفيد من نموذج "ترانسفورمر" (Transformer) مُدرب مسبقاً لتوليد حلول تقريبية عالية الجودة بسرعة لمشاكل السيناريوهات الفرعية، مما يتيح الحل الفعال لمشاكل تحديد حجم الدفعات السعوية ثنائية المرحلة واسعة النطاق ذات الآفاق الزمنية التعسفية مع الحفاظ على عدم وجود أي عدم صلاحية.

Seung Jin Choi, Kimiya Jozani, Josh Cooper, Esra Buyuktahtakin Toy2026-07-28
💬 NLP

MioFFAn: an Annotation Software for Formula Formalization with LLM Automation Capabilities

تقدم هذه الورقة MioFFAn، وهو إطار عمل مفتوح المصدر وقابل للتخصيص للتعليق التوضيحي يوسع بنية MioGatto لتسهيل إنشاء مجموعات بيانات عالية الجودة لصياغة الصيغ الرياضية من خلال الجمع بين التعليق البشري وأتمتة النماذج اللغوية الكبيرة التركيبية.

Nicolas Sibuet, Horacio Saggion, Riccardo Rossi2026-07-28
💬 NLP

Same Question, Different Answers: Evaluating LLM Reliability Beyond Accuracy

تكشف هذه الورقة أن النماذج اللغوية الكبيرة غالباً ما تظهر عدم استقرار ملحوظ في إجاباتها عند مواجهة إعادة صياغة تحافظ على المعنى، مما يثبت أن مقاييس الدقة القياسية يمكن أن تخفي مشكلات الموثوقية وأن استراتيجيات إعادة الصياغة الذاتية يمكن أن تستعيد المعرفة الكامنة بفعالية لتحسين الأداء.

Kazem Faghih, Yize Cheng, Shoumik Saha, Mobina Pournemat, Armin Gerami, Soheil Feizi2026-07-28
🤖 machine learning

Codifying the Judge: Scalable Evaluation via Program Distillation

تقدم الورقة البحثية PAJAMA، وهو نظام تقييم قابل للتوسع يعمل على استخلاص منطق اتخاذ القرار في النماذج اللغوية الكبيرة وتحويله إلى أحكام برمجية شفافة وفعالة من حيث التكلفة لتضاهي أداء أحكام النماذج اللغوية الكبيرة مع تقليل زمن الاستجابة وتكاليف واجهة برمجة التطبيقات بشكل كبير.

Tzu-Heng Huang, Shengqi Qiu, Frederic Sala2026-07-28
🤖 machine learning

DSTFView: Multi-View Cloud-Edge Workload Forecasting with Dual-Input Spatio-Temporal-Frequency Modeling

تقترح الورقة البحثية DSTFView، وهو إطار عمل متعدد الرؤى ثنائي المدخلات مكاني-زماني-ترددي، يوازن بفعالية بين نمذجة الميزات وكفاءة التنبؤ للتنبؤ بأعباء عمل السحابة والحافة التعاونية من خلال التقاط الاعتمادات المكانية والزمنية والترددية بشكل مشترك مع دمج الرؤى تكيفيًّا للتعامل مع التغيرات المفاجئة.

Qingzhong Li, Hui Ma, Yajun Zhang, Qingchang Ma, Zhou Long2026-07-28
🤖 machine learning

Quotient Tree Arithmetic: Deferred-Division Computation with Bounded Symbolic Depth and Cross-Subtree Cancellation

تقدم هذه الورقة "حساب شجرة خارج القسمة" (Quotient Tree Arithmetic - QTA)، وهو إطار حوسبي يمثل القيم كأزواج خارج قسمة مؤجلة لتحقيق حسابات نسبية دقيقة، وعمق رمزي محدود، وإلغاء متبادل عبر الأشجار الفرعية، مما يقلل بشكل كبير من الأخطاء العددية والأعباء الإضافية على الذاكرة أثناء تدريب تعلم الآلة مع ربط نظرية التوطين الجبري بالحسابات الأصلية لمعيار IEEE.

Gregory Magarshak2026-07-28
🧬 biology

Masked Autoencoders Learn Perception-Relevant Representations from Resting State Neural Data

تُظهر هذه الدراسة أن المشفرات التلقائية المقنعة ذات التعلم الذاتي، والمُدربة مسبقاً على بيانات عصبية لحالة الراحة غير المصنفة، يمكنها تعلم بنيات دماغية قابلة للتفسير وتحسين دقة فك تشفير الإدراك بشكل كبير لدى مشارك كفيف، مما يثبت أن النشاط القشري العفوي يحتوي على معلومات غنية وذات صلة بالمهام.

Aleksandr Kovalev, Antonio Lozano, Fabrizio Grani, Cristina Soto Sanchez, Leili Soo, Rocío López-Peco, Adrian Villamarin (…)2026-07-28
🤖 machine learning

AI-Assisted Causal Inference and Mediation Analyses of Environmental and Psychosocial Determinants of Subjective Cognitive Difficulties in the All of Us Research Program

باستخدام بيانات طولية من برنامج "All of Us" البحثي وتقنيات التعلم الآلي، تجد هذه الدراسة أنه في حين تظهر التعرضات البيئية قصيرة المدى ارتباطات محدودة بصعوبات الإدراك الذاتي بعد مراعاة التباين داخل الموقع الواحد، فإن العوامل النفسية والاجتماعية مثل عبء الصحة العقلية، والوحدة، والأداء الاجتماعي، ترتبط بشكل ثابت وأقوى بهذه النتائج الإدراكية.

Cong Cao, Shuangge Ma2026-07-28