研究者たちは、Unslothを使用して腫瘍学タスクのためにMedGemma 4Bおよび27Bモデルをファインチューニングし、単一のDGX Sparkでプロセスを完了しました。生成されたOncoLLMモデル、トレーニングデータセット、詳細なレポートはすべて公開されています。

  • 4BモデルはLoRAを使用してファインチューニングされ、27BモデルはQLoRAを使用しました。
  • 技術的なノートでは、Unslothバージョン2026.9.12が4Bアダプターを約0.5でスケーリングし、名目上のalpha/r比である0.25ではないことが強調されています。
  • ソースモデルとコードはHugging FaceのGrujowmi (ANTOINE Pierre)に帰属され、完全なレポートはZenodoにホストされています。