Assessing the Reliability of LLM-Generated Phenotype-Genotype Associations Through External Validation
تقارن هذه الدراسة بين أربعة نماذج لغوية كبيرة في توليد الارتباطات بين النمط الظاهري والنمط الجيني، وتجد أنه بينما يمكنها إنتاج حجم كبير من المرشحين مع دعم تحقق خارجي متوسط إلى قوي، فإن دقتها تتباين بشكل كبير حسب نوع الارتباط والنموذج، مما يؤكد الحاجة الماسة إلى مسارات تحقق صارمة.