“模型”清华团队发布ChatGLM2-6B ，在ChatGLM-6B 基础上改进

2023-06-26 17:05:08来源：PingWest品玩

今天，很高兴为大家分享来自PingWest品玩的清华团队发布ChatGLM2-6B ，在ChatGLM-6B 基础上改进，如果您对清华团队发布ChatGLM2-6B ，在ChatGLM-6B 基础上改进感兴趣，请往下看。

品玩6月26日讯，据 huggingface 页面显示， ChatGLM-6B 的第二代版本 ChatGLM2-6B 现已正式开源。

ChatGLM2-6B 拥有比 ChatGLM-6B 更强大的性能，相比于初代模型，ChatGLM2-6B 在 MMLU（+23%）、CEval（+33%）、GSM8K（+571%）、BBH（+60%）等数据集上的性能取得了大幅度的提升，在同尺寸开源模型中具有较强的竞争力。此外，ChatGLM2-6B基座模型的上下文长度由 ChatGLM-6B 的 2K 扩展到了 32K，并在对话阶段使用 8K 的上下文长度训练，允许更多轮次的对话。

另外，ChatGLM2-6B 可以实现更高效的推理，在官方的模型实现下，其推理速度相比初代提升了 42%，INT4 量化下，6G 显存支持的对话长度由 1K 提升到了 8K。

好了，关于清华团队发布ChatGLM2-6B ，在ChatGLM-6B 基础上改进就讲到这。

返回科技金融网首页 >>

版权及免责声明：凡本网所属版权作品，转载时须获得授权并注明来源“科技金融网”，违者本网将保留追究其相关法律责任的权力。凡转载文章，不代表本网观点和立场，如有侵权，请联系我们删除。