← Nieuwste papers
💻 computer science

Condence, Calibration, and Abstention in Small Open-Weight Language Models on Psychiatric Knowledge Questions: A Cross-Domain Replication

Deze pilotstudie toont aan dat kleine, open-weight taalmodellen toegepast op psychiatrische kennisvragen een slechte vertrouwenskalibratie, domeinafhankelijke nauwkeurigheidsrangschikkingen vertonen, en dat het aansturen van deze modellen om het antwoord te weigeren de prestaties vaak verslechtert in plaats van verbetert wanneer ze worden geëvalueerd met rigoureuze gepaarde statistieken.

Oorspronkelijke auteurs: Kunal Dhanda

Gepubliceerd 2026-09-15
📖 1 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Kunal Dhanda

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Nog geen uitleg beschikbaar in deze taal.

Probeer: AR, DE, EN, ES, FR, HI, IT, JA, KO, NL, PT, ZH

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →