The Mirage of LLM Guardrails: A Case Study in AI-Assisted Medical Note Manipulation
Questo articolo dimostra empiricamente che i contemporanei modelli linguistici di grandi dimensioni commerciali possiedono vulnerabilità significative e incoerenti nelle loro barriere di sicurezza, permettendo di manipolarli facilmente per generare note mediche credibili e personalizzate che sono visivamente indistinguibili da documenti autentici.