← 최신 논문
💻 computer science

Temporal speckle enables probabilistic weights for uncertainty-aware photonic AI

이 논문은 광대역 빛의 시간적 스펙클(temporal speckle)을 활용하여 확률적 가중치를 네이티브하게 인코딩함으로써 디지털 베이지안 신경망의 계산 병목 현상을 극복하고, 분류와 분포 외 탐지(out-of-distribution detection)를 동시에 수행할 수 있는 고속의 불확실성 인지형 AI를 가능하게 하는 초고속 광학 프로세서를 소개한다.

원저자: Wolfram Pernice, Frank Brückerhoff-Plückelmann, Hendrik Borras, Shivaprasad Umesh Hulyal, Lennart Meyer, Xinru Ji, Jianqi Hu, Jiale Sun, Bernhard Klein, Falk Ebert, Jelle Dijkstra, Liam McRae, Philipp
게시일 2026-08-14
📖 3 분 읽기☕ 가벼운 읽기

원저자: Wolfram Pernice, Frank Brückerhoff-Plückelmann, Hendrik Borras, Shivaprasad Umesh Hulyal, Lennart Meyer, Xinru Ji, Jianqi Hu, Jiale Sun, Bernhard Klein, Falk Ebert, Jelle Dijkstra, Liam McRae, Philipp Schmidt, Tobias Kippenberg, Holger Fröning

원본 논문은 CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

당신이 로봇에게 다양한 종류의 과일을 인식하도록 가르치려 한다고 상상해 보세요. 당신은 로봇에게 사과, 바나나, 오렌지 사진 수천 장을 보여줍니다. 결국 로봇은 그것들을 골라내는 데 매우 능숙해집니다. 하지만 만약 당신이 키위 사진을 건네준다면 어떻게 될까요? 일반적인 로봇은 눈을 가늘게 뜨고 "바나나"라고 추측하며, "100% 확신합니다!"라고 완전히 틀린 답을 자신 있게 말할 수도 있습니다. 이는 자율주행 자동차나 의료 진단처럼 안전이 중요한 직업에서 큰 문제가 됩니다. 확신에 차서 틀리는 것은 위험할 수 있기 때문입니다.

이를 해결하기 위해 과학자들은 "베이지안 신경망(Bayesian neural networks)"이라는 것을 사용합니다. 이것을 단 하나의 로봇 두뇌가 아니라, 서로 약간씩 다른 의견을 가진 전문가 팀이라고 생각해 보세요. 이들은 모든 사진에 대해 하나의 정확한 답을 암기하는 대신, 가능한 범위의 여러 가능성을 학습합니다. 새로운 이미지를 보았을 때, 로봇은 팀 전체에게 "어떻게 생각하나요?"라고 묻습니다. 모두가 동의하면 로봇은 확신을 갖습니다. 만약 팀원들이 서로 논쟁한다면, 로봇은 "이것에 대해서는 잘 모르겠습니다"라고 인지하고 도움을 요청할 수 있습니다. 문제는 일반적인 컴퓨터에서 이 많은 전문가들이 서로 대화하게 만드는 것이 믿을 수 없을 정도로 느리고 많은 에너지를 소모한다는 점입니다. 이는 마치 아주 작은 방 안에서 거대한 회의를 여는 것과 같습니다. 교통 정체로 인해 모든 것이 느려지는 것입니다.

여기서 하이델베르크 대학교와 EPFL의 연구팀이 기발한 전환점을 제시합니다. 그들은 이렇게 물었습니다. "만약 우리가 컴퓨터를 사용하여 이러한 다양한 의견을 시뮬레이션하는 대신, 빛 자체를 사용하여 사고하게 한다면 어떨까?" 그들의 새로운 연구에서, 그들은 빛의 자연스럽고 혼돈스러운 깜빡임을 사용하여 이러한 불확실한 의견들을 즉각적으로 표현할 수 있음을 보여줍니다.

그들이 이 일을 어떻게 해냈는지 설명하겠습니다. 그들은 "혼돈스러운 빛(chaotic light)"의 빔을 가져왔습니다. 이는 마치 수명이 다해가는 전구처럼 무작위로 깜빡이는 빛입니다. 보통 과학자들은 이 깜빡임을 노이즈(소음)로 간데 두고 제거하려 노력합니다. 하지만 이 팀은 이 깜빡임이 사실 '슈퍼 파워'라는 것을 깨달았습니다. 그들은 특수 도구를 사용하여 빛을 서로 다른 색상(주파수)으로 나누었습니다. 각 색상에 대해 그들은 두 가지를 조절할 수 있었습니다: 밝기와 색상 대역의 너비입니다.

그들은 마법 같은 규칙을 발견했습니다: 특정 색상의 밝기는 로봇의 "평균적인" 의견을 결정하고, 색상 대역의 너비는 그 의견이 얼마나 "불확실한지" 또는 "흔들리는지"를 결정한다는 것입니다. 좁은 대역은 안정적이고 확신에 찬 의견을 의미했습니다. 넓은 대역은 흔들리고 불확실한 의견을 의미했습니다. 빛은 매우 빠르게 움직이기 때문에, 그들은 단 하나의 빔 안에 수천 개의 이러한 "의견"들을 동시에 담아낼 수 있었습니다.

연구팀은 이 빛의 의견들을 위한 초고속 컨베이어 벨트 역할을 하는 작은 칩을 만들었습니다. 그들은 빛이 "컨볼루션(convolution)"이라는 수학 문제(레시피의 재료를 섞는 것처럼 데이터를 혼합하는 세련된 방식)를 표현하도록 프로그래밍했습니다. 빛이 칩을 통과하는 동안, 서로 완벽하게 정렬되어 계산을 수행할 수 있도록 각기 다른 색상들이 미세한 양만큼 지연되도록 했습니다. 결과는 어떠했을까요? 이 칩은 이러한 확률적 계산을 37.5 피코초마다 수행할 수 있었습니다. 37.5 피코초가 어느 정도인지 감을 잡기 위해 말씀드리자면, 1 피코초는 1조 분의 1초입니다. 즉, 이 특정 유형의 불확실한 사고를 처리하는 데 있어 표준 컴퓨터보다 수십억 배 더 빠릅니다.

그들은 이 "빛의 두뇌"를 두 가지 실제 작업에 테스트했습니다. 첫째, 혈구 세포 사진을 보여주었습니다. 시스템은 7가지 유형의 세포로 학습되었지만, '적아세포(erythroblasts)'라는 특정 유형은 본 적이 없었습니다. 적아세포를 보여주었을 때, 빛의 두뇌는 단순히 추측하는 대신 "흔들림"을 보였습니다. 빛 빔 속의 서로 다른 의견들이 서로 충돌하며 높은 불확실성을 신호했습니다. 시스템은 이미지를 잘못 분류하는 대신, "이것이 무엇인지 모르겠다"라고 정확하게 표시했습니다.

다음으로, 그들은 손글씨 숫자(유명한 MNIST 데이터셋)를 테스트했습니다. 일반적인 숫자, 시스템이 본 적 없는 패션 아이템처럼 보이는 숫자, 그리고 두 가지 숫자로 동시에 보일 만큼 형편없이 그려진 숫자를 보여주었습니다. 빛의 두뇌는 이 세 가지 상황을 성공적으로 구분해 냈습니다: 일반적인 숫자에는 확신을 가졌고, 패션 아이템(새로운 것)에 대해서는 불확실했으며, 모호한 그림(이미지 자체가 불분명한 경우)에 대해서는 혼란스러워했습니다.

이 논문은 빛의 자연스러운 변동을 사용함으로써, 우리가 단순히 추측하는 것이 아니라 자신이 언제 추측하고 있는지를 아는 AI를 구축할 수 있음을 증명합니다. 이는 단순히 빠른 것을 넘어, 자신이 확신할 수 없을 때 겸손하게 인정할 줄 아는 AI를 향한 단계이며, 이것이야말로 우리가 현실 세계에서 안전하고 신뢰할 수 있는 AI를 위해 필요로 하는 것입니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →