Hidden Reliability Risks in Large Language Models: Systematic Identification of Precision-Induced Output Disagreements
تقدم هذه الورقة PrecisionDiff، وهو إطار عمل آلي للاختبار التفاضلي يحدد بشكل منهجي مخاطر الموثوقية الخفية والواسعة النطاق في النماذج اللغوية الكبيرة من خلال اكتشاف التناقضات السلوكية الدقيقة وتفاوتات كسر الحماية المحتملة الناتجة عن تباين تكوينات الدقة الرقمية.