Hugging Face LLM Trainer
让 Agent 准备数据、选择 GPU 并提交模型微调任务。
指导 Agent 在 Hugging Face 上完成模型微调,包括检查数据、选择硬件、提交训练、跟踪进度和导出模型。支持 SFT、DPO 等训练方式,适合已经有训练目标和数据、需要把实验跑起来的任务。
使用示例
用我的问答数据为小型开源模型做一次 SFT,先检查数据、估算预算,再给出训练配置。
提交云 GPU 训练会产生算力费用,先确认预算。
查看或编辑安装请求
将安装请求发给 Agent。请求包含原项目地址、安装范围和验证任务,可按需要编辑。
来源与验证记录
作者展示训练任务、监控及模型实验报告;是历史版本的实际流程案例,本站未提交 GPU 训练。