← Neueste Arbeiten
💻 bioinformatics

A learned fungal ITS embedding does not outperform correctly configured alignment in open-world evaluation

Diese Studie zeigt, dass ein zweckmäßig trainiertes pilzliches ITS-Embedding einen korrekt konfigurierten alignmentbasierten Ansatz in der Open-World-Evaluierung nicht übertrifft, was offenlegt, dass methodische Mängel wie heuristische Standardeinstellungen, fehlende Coverage-Filter und Data Leakage – und nicht die Repräsentation selbst – für die zuvor berichteten Vorteile gelernter Embeddings verantwortlich waren.

Ursprüngliche Autoren: O'Brien, A., Gardette, A.

Veröffentlicht 2026-09-25
📖 5 Min. Lesezeit🧠 Tiefgang

Ursprüngliche Autoren: O'Brien, A., Gardette, A.

Originalarbeit lizenziert unter CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). ⚕️ Dies ist eine KI-generierte Erklärung eines Preprints, das nicht peer-reviewed wurde. Dies ist kein medizinischer Rat. Treffen Sie keine Gesundheitsentscheidungen auf Grundlage dieses Inhalts. Vollständigen Haftungsausschluss lesen

In der verborgenen Welt unter unseren Füßen sind Pilze überall vorhanden, doch sie bleiben dem bloßen Auge weitgehend unsichtbar. Um dieses riesige Reich des Lebens zu verstehen, verlassen sich Wissenschaftler auf einen spezifischen Abschnitt des genetischen Codes, der als ITS-Region bekannt ist. Betrachten Sie diesen Code als einen einzigartigen Barcode, der auf jeder Pilzspezies aufgedruckt ist. Wenn Forscher eine Probe aus Boden oder Luft sammeln, sequenzieren sie diesen Barcode und versuchen, ihn mit einer massiven Bibliothek bekannter Pilze abzugleichen, um zu identifizieren, was sie gefunden haben. Doch die Natur steckt voller Überraschungen. Oft ist der Pilz in der Probe so neu oder so fern von bekannten Verwandten, dass er mit keinem Eintrag in der Bibliothek übereinstimmt. Die Herausforderung für Wissenschaftler ist zweifach: Sie müssen entscheiden, wann ein Pilz wirklich neu ist und unbenannt bleiben sollte, und sie müssen ihn so genau wie möglich innerhalb des Stammbaums des Lebens einordnen, selbst wenn die exakte Spezies unbekannt ist.

Jahrelang war die Standardmethode zur Lösung dieses Abgleichsproblems darin bestand, die neue Gensequenz gegen jede bekannte Sequenz in der Bibliothek zu legen und nach der passendsten Übereinstimmung zu suchen. Diese Methode, genannt Alignment (Sequenzabgleich), ist vergleichbar damit, jede Seite eines Wörterbuchs zu prüfen, um das Wort zu finden, das dem Wort, das man zu buchstabieren versucht, am ähnlichsten sieht. Vor kurzem ist ein neuerer, technologisch fortschrittlicherer Ansatz entstanden. Anstatt jede Seite zu prüfen, haben Wissenschaftler begonnen, künstliche Intelligenz einzusetzen, um den genetischen Code in einen mathematischen Punkt in einem riesigen, mehrdimensionalen Raum zu übersetzen. In diesem neuen System werden ähnliche Pilze nah beieinander platziert und unterschiedliche voneinander entfernt. Die Hoffnung war, dass dieses gelernte System neue Pilze erkennen und sie schneller und genauer in die richtige Familie einordnen könnte als die alte, langsame Methode des Seitenprüfens.

Ein Team von Forschern setzte sich zum Ziel zu testen, ob diese neue Methode der künstlichen Intelligenz der traditionellen Methode tatsächlich überlegen war. Sie entwickelten ein maßgeschneidertes KI-Modell, das speziell darauf trainiert wurde, die Pilzgenetik zu verstehen, und nutzten dabei eine massive, aktuelle Sammlung von Pilzsequenzen. Um einen fairen Test zu gewährleisten, entwarfen sie ein strenges Experiment, bei dem die KI und die traditionelle Methode anhand desselben Satzes unbekannter Proben beurteilt wurden. Sie gingen auch mit äußerster Sorgfalt vor, um ihre Testdaten vor Beginn des Experiments zu versiegeln, wodurch sichergestellt wurde, dass kein Teil des Tests versehentlich das Training der KI beeinflussen konnte. Diese „Firewall“ bedeutete, dass die Ergebnisse, sobald sie enthüllt wurden, ein wahres Maß dafür sein würden, wie gut die Methoden bei völlig neuen Daten funktionierten.

Die Forscher entdeckten, dass der Ausgang des Tests vollständig davon abhing, wie die Regeln gesetzt waren. Wenn sie die traditionelle Alignment-Methode mit ihren Standardeinstellungen durchführten, schien das neue KI-Modell besser abzupereformen. Die Forscher erkannten jedoch, dass die Standardeinstellungen nicht darauf ausgelegt waren, die bestmögliche Arbeit zu leisten. Die traditionelle Methode hatte einige potenzielle Übereinstimmungen übersprungen und die Suche zu früh abgebrochen. Als das Team die traditionelle Methode so rekonfigurierte, dass sie die Suche erschöpfend und sorgfältig durchführte – also jede Möglichkeit ohne Abkürzungen prüfte –, änderten sich die Ergebnisse komplett. Die alte Methode, die nun ihr volles Potenzial ausschöpfte, war genauer als die KI bei der Identifizierung bekannter Pilze und bei der Einordnung neuer Pilze in die korrekten Familiengruppen.

Die Studie zeigte, dass die KI ein verborgenes Schwächemerkmal hatte: Ihre Leistung änderte sich je nachdem, wie viele Proben sie gleichzeitig verarbeitete. Wenn die KI Proben in großen Gruppen verarbeitete, unterschieden sich die Ergebnisse von der Verarbeitung einzelner Proben. Diese Inkonsistenz bedeutete, dass die KI nicht wirklich stabil war. Im Gegensatz dazu lieferte die traditionelle Methode jedes Mal das gleiche Ergebnis, unabhängig davon, wie die Daten gruppiert waren. Darüber hinaus fanden die Forscher heraus, dass die Fähigkeit der KI, neue Pilze zu entdecken, nicht tatsächlich besser war als die der traditionellen Methode, wenn man dies an den spezifischen Punkten maß, an denen ein Wissenschaftler in der realen Welt eine Entscheidung treffen würde. Die KI fand nicht mehr neue Pilze, noch machte sie weniger Fehler. Tatsächlich fand die traditionelle Methode mehr neue Pilze und machte dabei weniger Fehler.

Vielleicht noch überraschender war die Entdeckung der Forscher, dass der Erfolg der KI in früheren Tests teilweise auf einen Fehler im Versuchsaufbau zurückzuführen war. Einige der „neuen“ Pilze im Test waren der KI tatsächlich bereits während ihres Trainings begegnet, obwohl sie eigentlich verborgen bleiben sollten. Als die Forscher dies behoben, indem sie diese spezifischen Pilze aus den Trainingsdaten entfernten und die KI neu trainierten, vergrößerte sich der Abstand zwischen den beiden Methoden. Die traditionelle Methode holte weiter auf und zeigte einen klaren und statistisch signifikanten Vorteil. Die Fähigkeit der KI, verschiedene Teile des genetischen Codes zu vergleichen – ein Merkmal, das eigentlich ihre Superkraft sein sollte –, erwies sich als nicht besser als das, was die traditionelle Methode durch das direkte Betrachten der gemeinsamen Teile des Codes erreichen konnte.

Die endgültige Schlussfolgerung war eindeutig: Eine sorgfältig konfigurierte traditionelle Methode entsprach oder übertraf in jeder relevanten Kategorie die Leistung des neuen Modells der künstlichen Intelligenz. Die KI war der alten Methode nicht überlegen; es war die Art und Weise, wie die alte Methode getestet worden war, die sie schwächer erscheinen ließ. Die Studie zeigte, dass die Wahl der Bewertungsregeln – etwa wie streng die Suche durchgeführt wurde und wie die Daten gruppiert wurden – über den Sieger entschied. Die Forscher betonten, dass diese Überprüfungen einfach und kostengünstig auf jede neue Methode anwendbar sind. Sie argumentierten, dass Wissenschaftler, bevor sie ein neues System der künstlichen Intelligenz für überlegen erklären, sicherstellen müssen, dass die traditionelle Baseline mit ihrer besten Leistung läuft, dass die Daten der KI tatsächlich neu sind und dass die Ergebnisse unter verschiedenen Bedingungen stabil sind. Letztendlich blieb das zuverlässigste Werkzeug zur Identifizierung der unsichtbaren Welt der Pilze dasjenige, das seit Jahrzehnten verwendet wird – vorausgesetzt, man verwendet es korrekt.

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →