fd
https://github.com/RapidAI/Open-Llama
1 baichuan2
-
1预训练官方没有,只有STF
-
2 github issus官方回答少
-
3 确认下面是1代还是2代训练代码
https://github.com/baichuan-inc/Baichuan2/issues/47,只能从头训?
https://github.com/baichuan-inc/Baichuan-7B -
4 STF数据格式
https://github.com/baichuan-inc/Baichuan2/issues/100 -
6 全参数微调
https://github.com/baichuan-inc/Baichuan2/issues/202 -
3 三方支持-预训练
https://github.com/internLM/xtuner
https://github.com/hiyouga/LLaMA-Factory#supported-models
https://github.com/hiyouga/LLaMA-Factory
https://github.com/xyjigsaw/LLM-Pretrain-SFT
__EOF__

本文作者:userName
本文链接:https://www.cnblogs.com/pyclq/p/17889172.html
关于博主:评论和私信会在第一时间回复。或者直接私信我。
版权声明:本博客所有文章除特别声明外,均采用 BY-NC-SA 许可协议。转载请注明出处!
声援博主:如果您觉得文章对您有帮助,可以点击文章右下角【推荐】一下。您的鼓励是博主的最大动力!
本文链接:https://www.cnblogs.com/pyclq/p/17889172.html
关于博主:评论和私信会在第一时间回复。或者直接私信我。
版权声明:本博客所有文章除特别声明外,均采用 BY-NC-SA 许可协议。转载请注明出处!
声援博主:如果您觉得文章对您有帮助,可以点击文章右下角【推荐】一下。您的鼓励是博主的最大动力!
【推荐】国内首个AI IDE,深度理解中文开发场景,立即下载体验Trae
【推荐】编程新体验,更懂你的AI,立即体验豆包MarsCode编程助手
【推荐】抖音旗下AI助手豆包,你的智能百科全书,全免费不限次数
【推荐】轻量又高性能的 SSH 工具 IShell:AI 加持,快人一步
· 震惊!C++程序真的从main开始吗?99%的程序员都答错了
· winform 绘制太阳,地球,月球 运作规律
· 【硬核科普】Trae如何「偷看」你的代码?零基础破解AI编程运行原理
· 上周热点回顾(3.3-3.9)
· 超详细:普通电脑也行Windows部署deepseek R1训练数据并当服务器共享给他人
2021-12-08 心理学模型
2020-12-08 二分查找