研究者たちは、Unslothを使用して腫瘍学タスクのためにMedGemma 4Bおよび27Bモデルをファインチューニングし、単一のDGX Sparkでプロセスを完了しました。生成されたOncoLLMモデル、トレーニングデータセット、詳細なレポートはすべて公開されています。
- 4BモデルはLoRAを使用してファインチューニングされ、27BモデルはQLoRAを使用しました。
- 技術的なノートでは、Unslothバージョン2026.9.12が4Bアダプターを約0.5でスケーリングし、名目上のalpha/r比である0.25ではないことが強調されています。
- ソースモデルとコードはHugging FaceのGrujowmi (ANTOINE Pierre)に帰属され、完全なレポートはZenodoにホストされています。