A Pipeline for Generating Longitudinal Synthetic Clinical Notes Using Large Language Models
यह शोध पत्र एक मॉड्यूलर पाइपलाइन और 70 सिंथेटिक अनुदैर्ध्य (लॉन्गीटुडिनल) रोगी रिकॉर्ड का एक संगत डेटासेट प्रस्तुत करता है, जिसमें प्रत्येक रिकॉर्ड में 20-50 नैदानिक नोट्स हैं, जिन्हें आंतरिक निरंतरता और यथार्थवादी भिन्नता सुनिश्चित करते हुए गोपनीयता-संरक्षित नैदानिक एआई उपकरणों के विकास और मूल्यांकन को समर्थन देने के लिए लार्ज लैंग्वेज मॉडल्स का उपयोग करके तैयार किया गया है।