Jev news

Unsloth 开源教程:本地训练 Qwen3.5 0.8B 决策模型,准确率从 20.7% 提升至 74.3%

X:Unsloth (@UnslothAI)AIHOT score 66/100

Summary

Unsloth 发布教程与开源仓库,可将 Qwen3.8、Gemma 4 等 LLM 微调为输出选项概率的决策模型,Qwen3.5 0.8B 在 3 个决策基准上的合计准确率从 20.7% 提到 74.3%,仅需 4GB 显存。

Original title

You can now train your own Decision model like Jev locally!

Selection reason

原文给出完整微调方法和前后准确率对比,读者可在 4GB 显存上复现把 LLM 转成决策模型的流程。