💻 computer science
Bee: A High-Quality Corpus and Full-Stack Suite to Unlock Advanced Fully Open MLLMs
تقدم هذه الورقة البحثية Honey-Data-15M، وهي مجموعة بيانات عالية الجودة مكونة من 15 مليون زوج مع إثراء بمستوى مزدوج من تسلسل الأفكار (Chain-of-Thought)، إلى جانب خط معالجة البيانات HoneyPipe ونموذج Bee-8B، مما يثبت مجتمعاً أن التحسينات المنهجية في جودة البيانات يمكن أن تمكّن النماذج اللغوية الكبيرة متعددة الوسائط مفتوحة المصدر بالكامل من تحقيق أداء رائد ينافس النظراء شبه المفتوحين.
البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل
غارق في أبحاث مجالك؟
تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.