← 最新の論文
💬 NLP

Nanbeige4.1-3B: A Small General Model that Reasons, Aligns, and Acts

本論文は、推論、アライメント、行動を単一のモデルで実現し、30 億パラメータ規模でありながら大規模モデルに匹敵する性能を示す初のオープンソース小規模汎用モデル「Nanbeige4.1-3B」を提案するものである。

原著者: Chen Yang, Guangyue Peng, Jiaying Zhu, Ran Le, Ruixiang Feng, Tao Zhang, Xiyun Xu, Yang Song, Yiming Jia, Yuntao Wen, Yunzhi Xu, Zekai Wang, Zhenwei An, Zhicong Sun, Zongchao Chen

公開日 2026-02-17
📖 1 分で読めます☕ さくっと読める

原著者: Chen Yang, Guangyue Peng, Jiaying Zhu, Ran Le, Ruixiang Feng, Tao Zhang, Xiyun Xu, Yang Song, Yiming Jia, Yuntao Wen, Yunzhi Xu, Zekai Wang, Zhenwei An, Zhicong Sun, Zongchao Chen

原論文は CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む

南北(ナンペイ)4.1-3B:小さな体で、天才的な頭脳を持つ「万能型 AI」の物語

こんにちは!今日は、**「Nanbeige4.1-3B(ナンペイ 4.1-3B)」**という、とても面白い AI モデルについてお話しします。

この AI は、まるで**「背は低いが、頭脳明晰で、何でもこなせる天才少年」**のような存在です。通常、AI は「数学が得意な子」や「プログラミングが得意な子」のように、得意分野がバラバラだったり、大きな体(巨大なパラメータ数)がないと複雑なことができなかったりするものです。

しかし、この Nanbeige4.1-3B は、**たった 30 億パラメータ(3B)という小さな体でありながら、「論理的思考」「プログラミング」「複雑な検索・調査」**の 3 つをすべて同時にこなしてしまう、驚異的な「万能型」モデルなのです。

では、彼がどのようにしてここまで成長したのか、その秘密を 3 つの物語に分けて解説します。


1. 「小さな体、大きな夢」:なぜ 3B パラメータがすごいのか?

まず、AI の世界には「パラメータ数」という、AI の頭の大きさを表す単位があります。

  • 巨大な AI(100B 以上): 巨大な図書館のような頭脳。何でもできますが、重くて動きが遅く、コストも高いです。
  • 小さな AI(3B): 小さなポケットサイズの頭脳。軽くて速いですが、複雑なことは苦手だと思われていました。

Nanbeige4.1-3B のすごいところは、この「小さなポケット」の中に、巨大な図書館の知識と、探偵のような推理力を詰め込んでしまった点です。
これまでの小さな AI は、「数学は得意だけど、長い会話が続かない」「プログラミングはできるけど、人間の好みに合わない」といった「偏り」がありました。しかし、このモデルは**「何でもできる(Generalist)」**でありながら、特定の分野でもトップクラスの実力を発揮します。


2. 成長の秘密:3 つの「特訓メニュー」

この AI がこれほどまでに成長できたのは、研究者たちが彼に施した 3 つの特別なトレーニングのおかげです。

① 「完璧なレシピ」による基礎体力作り(SFT:教師あり微調整)

まず、彼に**「質の高い教科書」**を与えました。

  • コード(プログラミング): 単に「動くコード」だけでなく、「効率的で美しいコード」を書く練習。
  • 数学・論理: 難しい問題を解くための思考プロセス。
  • 長い文脈: 25 万文字(256k トークン)もの長い物語や資料を読み通す練習。
    これにより、彼は「どんな質問にも、長くても論理的に答える基礎力」を身につけました。

② 「厳格なコーチ」による修正(RL:強化学習)

次に、彼に**「厳しくも親切なコーチ」**をつけました。

  • ポイント型コーチ(Point-wise): 「その答えは長すぎる」「同じことを繰り返している」といった、**「単独での質」**を評価します。これにより、無駄な話をせず、簡潔で読みやすい答えを言えるようになりました。
  • ペア型コーチ(Pair-wise): 「A の答えと B の答え、どっちが人間が好むか?」を**「比較」**して評価します。これにより、人間の好みに合った、より自然で賢い会話ができるようになりました。

③ 「探偵の訓練」による調査力強化(Deep Search)

これが最大の特徴です。彼は**「探偵」**として訓練されました。

  • 長い探偵物語: 複雑な事件(問題)を解決するために、何百回も「検索」や「ツール使用」を繰り返す練習をしました。
  • ステップごとの評価: 1 歩ずつの行動が正しいか、情報を得られたかを厳しくチェック。
  • 結果: 彼らは、600 回ものツール呼び出しを続けても迷子にならず、複雑な問題を解決できる「長期計画力」を身につけました。これは、通常、巨大な AI しか持っていない能力です。

3. 実際の活躍:現実世界での「魔法」

このモデルは、単なる実験室の成績だけでなく、現実世界でも驚異的な結果を出しています。

  • プログラミング大会(LeetCode):
    世界中の優秀なプログラマーが参加する競技プログラミング大会で、85% の正解率を達成し、見事1 位を獲得しました!これは、30 億パラメータという小さなモデルが、300 億や 800 億パラメータの巨大モデルを凌駕した瞬間です。
  • 複雑な検索タスク:
    「過去の 6 ヶ月以内に更新された、特定の条件を満たす科学者の名前を、複数のウェブサイトを横断して見つけてください」といった、**「探偵にしかできないような複雑な検索」**でも、巨大な AI に匹敵する、あるいはそれ以上の成績を収めました。

まとめ:小さな体で、未来を変える

Nanbeige4.1-3B は、「AI は大きければ大きいほど良い」という常識を覆した画期的なモデルです。

  • 効率性: 小さな体なので、動作が速く、コストも安いです。
  • 汎用性: 数学、コード、検索、会話、すべてを一つのモデルでこなせます。
  • 実用性: 現実の難しい問題(競技プログラミングや複雑な調査)を解決できます。

まるで、**「小さなポケットに、世界を救うための万能ツールをすべて詰め込んだ」**ような存在です。この技術は、今後、私たちの日常に AI をもっと手軽に、もっと賢く取り入れるための大きな一歩となるでしょう。

「小さくても、強く、賢く、何でもできる」。それが Nanbeige4.1-3B の物語です。

自分の分野の論文に埋もれていませんか?

研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。

Digest を試す →