使用LLaMA-Factory快速训练自己的专用大模型

最新推荐文章于 2026-03-30 11:28:04 发布

原创

最新推荐文章于 2026-03-30 11:28:04 发布 · 1.8k 阅读

·

30

·

标签

#llama #AI #人工智能 #大模型 #语言模型

本文聊聊 LLama-Factory，它是一个开源框架，这里头可以找到一系列预制的组件和模板，让你不用从零开始，就能训练出自己的语言模型（微调）。不管是聊天机器人，还是文章生成器，甚至是问答系统，都能搞定。而且，LLama-Factory 还支持多种框架和数据集，这意味着你可以根据项目需求灵活选择，把精力集中在真正重要的事情上——创造价值。

使用LLama-Factory，常见的就是训练LoRA模型，增强模型在某方面的生成能力。本教程将以增强 GLM-4-9B-Chat 模型的脑筋急转弯能力为例，演示LoRA模型的微调方法。

环境准备

本地使用

LLama-Factory 的安装比较简单，大家直接看官网页面就够了：

github.com/hiyouga/LLa…

云镜像

如果你本地没有一张好显卡，也不想费劲的安装，就想马上开始训练。

可以试试我的云镜像，开箱即用：www.haoee.com/application…

平台注册就送一定额度，可以完成本教程的的演示示例。

镜像已经内置了几个基础模型，大都在6B-9B，单卡24G显存即可完成LoRA微调。

如果要微调更大的模型，则需要更多的显卡和显存，请在购买GPU时选择合适的显卡和数量。

已经内置的模型：Yi-1.5-9

最低0.47元/天解锁文章

评论 4

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。