书生大模型全链路开源开放体系
1.书生·浦语大模型开源一周年
书生·浦语大模型,是一个基于自然语言处理技术的先进模型,旨在为用户提供高效、智能的文本处理服务,从2023年7月InternLM-7B发布,至2024年7月InternLM2.5开源,已正式开源满一周年。

2.书生·浦语2.5概览
InternLM2.5在2024年7月正式发布,其推理性能和记忆能力相较上一代拥有巨大提升。

通过基于规则的数据构造、基于模型的数据扩充、基于反馈的数据生成等多种数据合成方案,有效提升合成数据质量。
与其他同量级的开源模型对比,在各种评测数据集上,InternLM2.5也有较好的表现。

InternLM2.5能够模拟人类解决复杂问题时的处理思路,解决复杂任务。

3.书生·浦语开源模型体系
书生·浦语开源模型体系不止是InternLM系列模型,还包括了书生·万卷多模态语料库、InternEvo训练框架、LMDeploy推理框架等一系列工具。

数据层面提供了书生·万卷语料库,涵盖了丰富的多模态数据,包括文本、图像、音视频等,此外还有Miner U、Label LLM等数据处理工具,可以高质量生成训练语料并标注数据。

InternEvo训练框架相比其他训练框架,在显存、分布式训练及通信方面进行优化,降低硬件要求。

XTuner微调框架兼容大部分开源数据集格式,采用Flash Attention、DeepSpeed ZeRO等加速算法,支持QLoRA、LoRA或全量参数微调。

OpenCompass评测框架是一个全面的评测工具,涵盖自然语言理解、文本生成、对话系统等多个领域的评测任务。通过多层次结构,支持精度、召回率、F1值等多种指标,帮助开发者全面评估模型表现。

LMDeploy部署工具提供完整的模型部署解决方案,包括权重量化、推理引擎和服务等,支持GPU部署及自动化部署流程。通过全流程自动化管理,从模型优化到上线部署,大大减少了人工干预和操作错误。

此外,书生·浦语开源模型体系还提供了Lagent和MindSearch等智能体框架,以及HuixiangDou知识库构建工具。

1万+

被折叠的 条评论
为什么被折叠?



