← 최신 논문
💬 NLP

SAGE Celer 2.6 Technical Card

SAGE Celer 2.6 는 역추론 (IR) 파이프라인과 엔드투엔드 비전 인코더를 통해 논리적 오류를 줄이고 다중 모달 기능을 강화했으며, 특히 데바나가리 문자용 커스텀 토크나이저를 도입하여 영어 추론 능력을 유지하면서 힌디어와 네팔어 등 남아시아 언어 지원에 특화된 범용 모델입니다.

원저자: SAGEA Research Team, Basab Jha, Firoj Paudel, Ujjwal Puri, Adrian Liu, Ethan Henkel, Zhang Yuting, Mateusz Kowalczyk, Mei Huang, Choi Donghyuk, Wang Junhao

게시일 2026-04-17
📖 4 분 읽기☕ 가벼운 읽기

원저자: SAGEA Research Team, Basab Jha, Firoj Paudel, Ujjwal Puri, Adrian Liu, Ethan Henkel, Zhang Yuting, Mateusz Kowalczyk, Mei Huang, Choi Donghyuk, Wang Junhao

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

🚀 SAGE Celer 2.6: "작지만 똑똑한, 그리고 우리말을 잘 아는 AI"

이 논문은 SAGEA 연구팀이 만든 새로운 인공지능 모델인 **'SAGE Celer 2.6'**에 대한 기술 보고서입니다. 이 모델은 단순히 "크기만 큰" AI 가 아니라, 작은 크기임에도 불구하고 매우 효율적이고, 특히 네팔어와 힌디어 같은 남아시아 언어에 특화된 모델입니다.

이 복잡한 내용을 일상적인 비유로 쉽게 설명해 드릴게요.


1. 핵심 철학: "거인보다 빠른 스프린터" 🏃‍♂️💨

대부분의 AI 회사들은 모델이 더 커질수록 (파라미터 수가 늘어날수록) 똑똑해진다고 믿고, 거대한 컴퓨터를 동원해 AI 를 키웁니다. 하지만 SAGEA 는 **"효율성"**을 선택했습니다.

  • 비유: 마치 거대한 트럭 (70B 모델) 이 무거운 짐을 나르지만, **스포츠카 (27B 모델)**는 경쾌하게 빠르게 달리는 것과 같습니다.
  • 결과: Celer 2.6 의 가장 큰 버전 (27B) 은 70B 모델보다 작지만, 수학 문제 풀이나 코딩, 논리 추론에서는 오히려 더 잘합니다. 이는 "단순히 많이 배우는 것"보다 **"올바르게 사고하는 법"**을 훈련시켰기 때문입니다.

2. 주요 특징 3 가지

① "거꾸로 생각하는" 검증 시스템 (Inverse Reasoning) 🧐

기존 AI 는 질문을 받으면 "아, 이거 이런 거겠지?" 하고 바로 답을 말해줍니다. 하지만 실수가 하나 나면 그 다음 단계도 틀려지는 '연쇄 오류'가 발생합니다.

  • 비유: Celer 2.6 은 답을 말하기 전에 스스로 "잠깐, 내가 이걸로 맞을까? 다른 가능성은 없을까?"라고 한 번 더 생각해보는 습관이 있습니다. 마치 시험 문제를 풀 때, 답안을 적기 전에 "혹시 내가 실수했나?" 하고 다시 확인하는 학생처럼요.
  • 효과: 이 덕분에 복잡한 수학 문제나 코딩에서 실수가 훨씬 적고, 논리적 오류를 스스로 찾아내어 수정합니다.

② "눈과 귀가 하나로 연결된" 멀티모달 👁️👂

기존 AI 는 이미지를 보는 '눈'과 글을 읽는 '입'이 따로 놀다가 나중에 연결하는 방식이었습니다.

  • 비유: Celer 2.6 은 눈과 입이 하나로 합쳐진 상태입니다. 그림을 볼 때 단순히 "이게 뭐야?"라고 묻는 게 아니라, 그림 속의 글자나 도표의 논리 구조를 글쓰기와 똑같은 방식으로 이해합니다.
  • 효과: 복잡한 다이어그램이나 손글씨가 적힌 차트를 보고도 그 내용을 정확히 이해하고 코드로 변환하는 등, 시각적 추론 능력이 뛰어납니다.

③ "우리말을 위한 맞춤 옷" (네이티브 토크나이저) 🇳🇵🇮🇳

기존 AI 들은 힌디어나 네팔어 (데바나가리 문자) 를 읽을 때, 한 글자를 여러 조각으로 잘게 나누어 처리합니다. 이는 마치 긴 문장을 읽을 때 불필요하게 쉼표를 많이 찍는 것처럼 비효율적입니다.

  • 비유: Celer 2.6 은 **네팔어와 힌디어를 위해 특별히 제작된 "맞춤형 옷"**을 입었습니다. 한 단어를 더 적게, 더 효율적으로 처리할 수 있어 속도가 빠르고 정확도가 높습니다.
  • 결과: 영어 실력을 떨어뜨리지 않으면서도, 네팔어와 힌디어로 논리적 추론을 할 때 다른 모델들보다 훨씬 자연스럽고 빠릅니다.

3. 크기에 따른 3 가지 버전 📦

이 모델은 사용 목적에 따라 3 가지 크기로 나뉩니다.

  1. Celer 2.6 Low (5B): 휴대용 스마트폰용.
    • 인터넷 없이도 내 휴대폰에서 바로 돌아갑니다. 간단한 요약, 번역, 일상 대화에 최적화되어 있습니다.
  2. Celer 2.6 Mid (10B): 회사 사무실용.
    • 일반적인 업무 문서 처리, 다국어 지원, 중간 규모의 분석 작업에 적합합니다.
  3. Celer 2.6 High (27B): 연구실/전문가용.
    • 복잡한 수학 문제, 긴 문서 분석 (256,000 자까지!), 정교한 코드 작성에 사용됩니다. 70B 모델과 맞먹는 성능을 내지만 훨씬 가볍습니다.

4. 한계점 (솔직한 이야기) 🚧

이 모델도 완벽하지는 않습니다.

  • 사실 확인: 아주 생소한 역사적 사실이나 남아시아/북미 밖의 obscure(희귀한) 정보에 대해서는 여전히 헛소리를 할 수 있습니다. (지식 자체가 없으면 추리만으로는 못 채우니까요.)
  • 3D 공간 감각: 2D 그림을 보고 복잡한 3D 물체의 회전이나 겹침을 계산하는 데는 약점이 있습니다.
  • 과도한 신중함: 아주 간단한 질문 (예: "딸기에 R 이 몇 개 있니?") 에도 너무 깊게 생각하다 보니 시간이 좀 걸릴 수 있습니다.

5. 결론: 왜 이 모델이 중요한가요? 🌟

이 논문은 **"AI 가 무조건 커야만 하는 것은 아니다"**라는 것을 증명합니다.

  • 효율성: 적은 자원으로 높은 성능을 내는 방법을 개발했습니다.
  • 포용성: 그동안 AI 에서 소외되었던 네팔어, 힌디어 사용자들에게 고품질의 AI 서비스를 제공합니다.
  • 신뢰성: 스스로를 검증하는 시스템을 넣어, AI 가 "착각"하는 것을 줄였습니다.

한 줄 요약:

"SAGE Celer 2.6 은 거창한 AI 가 아니라, 작고 빠르며, 우리말을 잘 이해하고, 스스로 생각하며 답을 찾아내는 똑똑한 비서입니다."

이 모델은 특히 개발도상국이나 자원이 부족한 환경에서도 고성능 AI 를 사용할 수 있는 길을 열어준다는 점에서 매우 의미 있는 기술입니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →