💻 computer science
Bee: A High-Quality Corpus and Full-Stack Suite to Unlock Advanced Fully Open MLLMs
本論文は、二重レベルの思考連鎖強化を備えた高品質な1500万ペアのデータセットHoney-Data-15M、およびHoneyPipeキュレーションパイプラインとBee-8Bモデルを導入し、これらが統合的に、原理に基づくデータ品質の向上が、完全にオープンなマルチモーダル大規模言語モデルを、半オープンな対抗モデルと競争可能な最先端性能を達成させることを実証するものである。
原論文は CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む
自分の分野の論文に埋もれていませんか?
研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。