Temporal speckle enables probabilistic weights for uncertainty-aware photonic AI
Dieses Paper führt einen ultraschnellen photonischen Prozessor ein, der das zeitliche Speckle-Muster von Breitbandlicht nutzt, um probabilistische Gewichte nativ zu kodieren, wodurch die Rechenengpässe digitaler Bayesscher neuronaler Netze überwunden und eine hochgeschwindigkeitsfähige, unsicherheitsbewusste KI ermöglicht wird, die simultane Klassifizierung und Out-of-Distribution-Detektion beherrscht.
Originalarbeit lizenziert unter CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen
Stellen Sie sich vor, Sie versuchen, einem Roboter beizubringen, verschiedene Obstsorten zu erkennen. Sie zeigen ihm tausende Bilder von Äpfeln, Bananen und Orangen. Schließlich wird der Roboter richtig gut darin, sie herauszufinden. Aber was passiert, wenn Sie ihm ein Bild einer Kiwi zeigen? Ein Standard-Roboter würde vielleicht die Augen zusammenkneifen, „Banane“ raten und sagen: „Ich bin mir zu 100 % sicher!“, obwohl er völlig falsch liegt. Dies ist ein großes Problem für sicherheitskritische Aufgaben wie selbstfahrende Autos oder medizinische Diagnosen, bei denen ein selbstbewusstes Irrtum gefährlich sein kann.
Um dies zu beheben, verwenden Wissenschaftler etwas, das man „Bayessche neuronale Netze“ nennt. Stellen Sie sich diese nicht als einen einzelnen Roboter-Verstand vor, sondern als ein Team von Experten, die alle leicht unterschiedliche Meinungen haben. Anstatt für jedes Bild eine exakte Antwort auswendig zu lernen, lernen sie eine ganze Bandbreite an Möglichkeiten. Wenn sie ein neues Bild sehen, fragen sie das gesamte Team: „Was denkt ihr?“ Wenn alle übereinstimmen, ist der Roboter sicher. Wenn das Team streitet, weiß der Roboter: „Ich bin mir bei diesem hier nicht sicher“ und kann um Hilfe bitten. Das Problem ist, dass es unglaublich langsam ist und viel Energie verbraucht, ein ganzes Team von Experten auf einem normalen Computer miteinander kommunizieren zu lassen. Es ist, als würde man versuchen, eine massive Versammlung in einem winzigen Raum abzuhalten; die Verkehrsstaus bremsen alles aus.
Hier setzt ein Team von Forschern der Universität Heidelberg und der EPFL mit einem cleveren Kniff an. Sie fragten: „Was wäre, wenn wir nicht einen Computer nutzen würden, um diese verschiedenen Meinungen zu simulieren, sondern statlich das Licht selbst das Denken lassen würden?“ In ihrer neuen Studie zeigen sie, dass sie das natürliche, chaotische Flackern von Licht nutzen können, um diese unsicheren Meinungen instantan darzustellen.
So haben sie es gemacht. Sie nahmen einen Strahl aus „chaotischem Licht“ – was einfach Licht ist, das zufällig flackert, wie eine Glühbirne, die kurz vor dem Durchbrennen steht. Normalerweise versuchen Wissenschaftler, dieses Flackern zu eliminigen, weil es Rauschen ist. Aber dieses Team erkannte, dass das Flackern eigentlich eine Superkraft ist. Sie nutzten ein spezielles Werkzeug, um das Licht in verschiedene Farben (Frequenzen) zu zerlegen. Für jede Farbe konnten sie zwei Dinge kontrollieren: wie hell sie war und wie breit ihr Farbband war.
Sie entdeckten eine magische Regel: Die Helligkeit einer bestimmten Farbe bestimmte die „durchschnittliche“ Meinung des Roboters, während die Breite des Farbbands bestimmte, wie „unsicher“ oder „zittrig“ diese Meinung war. Ein schmales Band bedeutete eine stetige, sichere Meinung. Ein breites Band bedeutete eine zittrige, unsichere Meinung. Da Licht unglaublich schnell bewegt, konnten sie tausende dieser „Meinungen“ gleichzeitig in einem einzigen Strahl unterbringen, die alle gleichzeitig flackerten.
Das Team baute einen winzigen Chip, der wie ein superschnelles Förderband für diese Licht-Meinungen fungiert. Sie programmierten das Licht, um ein mathematisches Problem namens „Faltung“ (Convolution) darzustellen (was einfach eine schicke Art ist, Daten zu mischen, wie das Mischen von Zutaten in einem Rezept). Während das Licht durch den Chip wanderte, wurden die verschiedenen Farben um winzige Beträge verzögert, damit sie perfekt zusammenlaufen, um die Mathematik zu erledigen. Das Ergebnis? Der Chip konnte eine dieser probabilistischen Berechnungen alle 37,5 Pikosekunden durchführen. Um das einzuordnen: Eine Pikosekunde ist eine Billionstelsekunde. Das ist Milliarden Mal schneller als Standardcomputer bei dieser speziellen Art des unsicheren Denkens.
Sie testeten ihr „Licht-Gehirn“ bei zwei realen Aufgaben. Zuerst zeigten sie ihm Bilder von Blutzellen. Das System wurde auf sieben Arten von Zellen trainiert, wurde aber nie mit einer spezifischen Art namens „Erythroblast“ konfrontiert. Als sie ihm einen Erythroblasten zeigten, rät das Licht-Gehirn nicht einfach; es wird „zittrig“. Die verschiedenen Meinungen im Lichtstrahl waren sich uneinig, was eine hohe Unsicherheit signalisierte. Das System markierte das Bild korrekt als „Ich weiß nicht, was das ist“, anstatt es selbstbewusst falsch zu klassifizieren.
Als Nächstes testeten sie es mit handgeschriebenen Zahlen (dem berühmten MNIST-Datensatz). Sie zeigten ihm normale Zahlen, Zahlen, die wie Modeartikel aussah (die das System noch nie gesehen hatte), und Zahlen, die so schlecht gezeichnet waren, dass sie zwei verschiedene Ziffern gleichzeitig sein könnten. Das Licht-Gehirn konnte diese drei Situationen erfolgreich unterscheiden: Es war sicher bei normalen Zahlen, unsicher bei den Modeartikeln (weil diese neu waren) und verwirrt über die zweifelhaften Zeichnungen (weil das Bild selbst unklar war).
Das Paper beweist, dass wir durch die Nutzung der natürlichen Fluktuationen des Lichts eine KI bauen können, die nicht nur rät, sondern auch weiß, wann sie rät. Es ist ein Schritt hin zu Maschinen, die nicht nur schnell, sondern auch bescheiden genug sind, zuzugeben, wenn sie sich unsicher sind – was genau das ist, was wir für eine sichere und zuverlässige KI in der realen Welt benötigen.
Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?
Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.