研究人员使用 Unsloth 对 MedGemma 4B 和 27B 模型进行了微调,以用于肿瘤学任务,并在单个 DGX Spark 上完成了该过程。生成的 OncoLLM 模型、训练数据集以及详细报告均已公开。

  • 4B 模型使用 LoRA 进行微调,而 27B 模型使用了 QLoRA。
  • 技术说明指出,Unsloth 版本 2026.9.12 将 4B 适配器缩放约 0.5,而不是名义上的 alpha/r 比率 0.25。
  • 源模型和代码归功于 Hugging Face 上的 Grujowmi (ANTOINE Pierre),完整报告托管在 Zenodo 上。