跳到正文
原文
Machine Learning Mastery· Vinod Chugani·· 5 小时前AI 评分65

使用 Unsloth 和 QLoRA 微调 Llama 3 进行自定义工具调用

How to Fine-Tune Llama 3 for Custom Tool Calling with Unsloth in Python

AI 导读

本文演示如何使用 Unsloth、QLoRA 和 Llama 3 8B,在免费 Google Colab T4 GPU 上微调模型,使其针对特定 API schema 输出结构化 JSON。教程涵盖工具调用数据集的构造与聊天模板格式化、LoRA 配置、TRL SFTTrainer 训练、未见查询测试及适配器保存,并指出训练损失快速接近零可能意味着记忆训练样本。

来源:Machine Learning Mastery · machinelearningmastery.com