Agentic Research

Hugging Face LLM Trainer

11,117 stars

Hugging Face 官方訓練技能:用 TRL 或 Unsloth 在 HF Jobs 基礎設施上訓練/微調語言與視覺模型,涵蓋 SFT、DPO、GRPO、reward modeling 與 GGUF 轉換。

首次公開:2025-11-24
數據截至:
2026-09-30
授權:
Apache-2.0

什麼時候用

要微調模型(LoRA/QLoRA、SFT/DPO)並用雲端 GPU 跑訓練任務時。

要注意

HF Jobs 是付費 GPU 基礎設施,訓練成本可觀;需要 HF 帳號與 token。

安裝提示詞

請幫我安裝「Hugging Face LLM Trainer」技能:從 https://github.com/huggingface/skills/tree/main/skills/huggingface-llm-trainer(技能路徑:skills/huggingface-llm-trainer/) 取得完整的技能目錄,放進我的 Agent 的技能目錄(例如專案內的 skills/ 資料夾,或該 Agent 文件指明的全域技能位置),確認裡面的 SKILL.md 存在、frontmatter 的 name 與 description 完整,然後列出這個技能宣告的腳本、外部工具與 API 需求,先不要執行任何腳本。

把這段貼給你的 agent。它刻意不含任何工具子命令 —— 指令請以該工具的官方文件為準。

取得 官方來源 來源(11,117 ★)
相容工具