← Nieuwste papers
💻 computer science

Bee: A High-Quality Corpus and Full-Stack Suite to Unlock Advanced Fully Open MLLMs

Dit artikel introduceert Honey-Data-15M, een hoogwaardige dataset van 15 miljoen paren met dubbel niveau Chain-of-Thought-verrijking, samen met de HoneyPipe-curatieroute en het Bee-8B-model, die gezamenlijk aantonen dat principiële verbeteringen van de datakwaliteit volledig open multimodale grote taalmodellen in staat kunnen stellen state-of-the-art prestaties te behalen die concurreren met die van semi-open tegenhangers.

Oorspronkelijke auteurs: Yi Zhang, Bolin Ni, Xin-Sheng Chen, Heng-Rui Zhang, Yongming Rao, Houwen Peng, Qinglin Lu, Han Hu, Meng-Hao Guo, Shi-Min Hu

Gepubliceerd 2026-03-10
📖 1 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Yi Zhang, Bolin Ni, Xin-Sheng Chen, Heng-Rui Zhang, Yongming Rao, Houwen Peng, Qinglin Lu, Han Hu, Meng-Hao Guo, Shi-Min Hu

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Nog geen uitleg beschikbaar in deze taal.

Probeer: AR, DE, EN, ES, FR, HI, IT, JA, KO, NL, PT, ZH

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →