ユーザー pop123-ux は、高レベルの抽象化を段階的に除去することで Hugging Face スタックを理解するのを支援するために設計された 38 の実行可能なノートブックを含む学習リポジトリを公開しました。コレクションは、transformers や tokenizers などのコアコンポーネントからファインチューニング、PEFT、推論/RL、エンドツーエンドのプロジェクト作業に至るまでのパスをカバーしています。

  • WordPiece および Unigram トークナイザーのゼロからの実装を含みます。
  • GRPOTrainer を使用する前に、第一原理から実装された GRPO と並んで LoRA および教師ありファインチューニングを示します。
  • FAISS 意味的検索、trl、Unsloth、vLLM の実験をカバーしています。
  • 単一言語および多言語 BERT を比較し、修正された記事レベルのホールドアウト評価を行うルーマニア語 XQuAD プロジェクトを特集しています。

著者は、ゼロからの GRPO およびルーマニア語 QA 評価セクションの明確さに関する技術的なフィードバック、および学習パスのギャップに対する提案を求めています。