Unsloth 发布免费 notebook,可将 Qwen3.5-4B 本地训练成决策模型
X:Unsloth (@UnslothAI)AIHOT スコア 59/100
要約
Unsloth 发布免费 notebook,教用户把 Qwen3.5-4B 训练成生成决策而非文本的决策模型,本地仅需 8GB VRAM。内容涵盖数据准备(state、questions、gold answers)、训练与服务;配套指南见 unsloth.ai/docs。其引用帖提到用 Clef head 加 LoRA(r=64)微调一 epoch,把 Qwen3.5 0.8B 在 3 个决策基准上的总体准确率从 20.7% 提到 74.3%,仅需 4GB VRAM。Notebook:https://colab.research.google.com/github/unslothai/notebooks/blob/main/nb/Qwen3_5_(4B)-Decision.ipynb
元の記事の見出し
You can now train your own Decision model with our free notebook! 💡