开源中文大语言模型汇总

基于英文模型增量预训练的中文模型

LLama系列:

llama作为开源社区的宠儿,有许多基于它的中文模型,下面列举比较流行的一些模型

  • Chinese llama/Chinese Alpaca:https://github.com/ymcui/Chinese-LLaMA-Alpaca
  • Colossal-LLaMA:https://huggingface.co/hpcai-tech/Colossal-LLaMA-2-7b-base
  • Atom:https://huggingface.co/FlagAlpha/Atom-7B

如果要学习如何做模型训练,推荐学习Chinese llama项目。如果是要选择强大的中文llama,推荐选Atom。

Mistral系列:

Mistral是超越llama的最强开源模型,由于发布时间晚于llama,因此其中文版本较少。

  • openbuddy-mistral:https://huggingface.co/OpenBuddy/openbuddy-mistral-7b-v13-base。openbuddy持续更新了llama、mistral、gemma等模型的中文版本,推荐大家去https://huggingface.co/OpenBuddy找找宝藏。
  • Chinese-Mistral:https://huggingface.co/itpossible/Chinese-Mistral-7B-v0.1。这是huggingface最新开源的中文Mistral,其C-Eval、C-MMLU、MMLU分数远高于其他llama、mistral变体。表明该模型同时具有较强的中英文能力。
  • JiuZhou:https://huggingface.co/itpossible/JiuZhou-base。该模型的基座模型为Chinese-Mistral,采用大规模中英文地球科学相关语料进行增量预训练,并使用了多种优化方法。由于地球科学是交叉性非常强的学科,因此其C-Eval、C-MMLU、MMLU分数进一步提高。不仅在专业领域表现出较强的知识储备,而且能力泛化到通用领域。C-Eval榜单显示,其中文能力仅次于Chatglm-6B。

如果大家需要选用强大的中文Mistral,推荐选JiuZhou。

从头训练的中文模型

  • Qwen系列
  • Chatglm系列
  • Baichuan系列

后面持续更新

相关推荐

  1. 开源中文语言模型汇总

    2024-04-02 22:52:04       16 阅读
  2. 开源语言模型简记

    2024-04-02 22:52:04       31 阅读
  3. 语言模型常见的文本切分方式整理汇总

    2024-04-02 22:52:04       33 阅读

最近更新

  1. TCP协议是安全的吗?

    2024-04-02 22:52:04       18 阅读
  2. 阿里云服务器执行yum,一直下载docker-ce-stable失败

    2024-04-02 22:52:04       19 阅读
  3. 【Python教程】压缩PDF文件大小

    2024-04-02 22:52:04       18 阅读
  4. 通过文章id递归查询所有评论(xml)

    2024-04-02 22:52:04       20 阅读

热门阅读

  1. pip/conda导出或导入环境

    2024-04-02 22:52:04       14 阅读
  2. 迪米特法则

    2024-04-02 22:52:04       16 阅读
  3. 10个大幅提升MySQL效率的使用技巧

    2024-04-02 22:52:04       15 阅读
  4. 计算机笔记(1)

    2024-04-02 22:52:04       12 阅读
  5. 图像配准概述

    2024-04-02 22:52:04       13 阅读
  6. Permission Denial: package=android does not belong to uid=2000

    2024-04-02 22:52:04       16 阅读
  7. 探索Python中的强化学习:DQN

    2024-04-02 22:52:04       16 阅读
  8. AI技术创业有哪些机会?

    2024-04-02 22:52:04       19 阅读
  9. leetcode19. 删除链表的倒数第 N 个结点

    2024-04-02 22:52:04       16 阅读
  10. C语言 结构体

    2024-04-02 22:52:04       19 阅读