← 最新论文
💻 computer science

Bee: A High-Quality Corpus and Full-Stack Suite to Unlock Advanced Fully Open MLLMs

本文介绍了 Honey-Data-15M,这是一个包含 1500 万对数据的高质量数据集,具备双层级思维链增强,并配套提出了 HoneyPipe 数据筛选流程与 Bee-8B 模型,共同证明通过原则性的数据质量提升,可使完全开放的多模态大语言模型达到与半开放模型相媲美的最先进性能。

原作者: Yi Zhang, Bolin Ni, Xin-Sheng Chen, Heng-Rui Zhang, Yongming Rao, Houwen Peng, Qinglin Lu, Han Hu, Meng-Hao Guo, Shi-Min Hu

发布于 2026-03-10
📖 1 分钟阅读☕ 轻松阅读

原作者: Yi Zhang, Bolin Ni, Xin-Sheng Chen, Heng-Rui Zhang, Yongming Rao, Houwen Peng, Qinglin Lu, Han Hu, Meng-Hao Guo, Shi-Min Hu

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

该语言暂无解释。

试试: AR, DE, EN, ES, FR, HI, IT, JA, KO, NL, PT, ZH

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →