Пользователь pop123-ux опубликовал обучающий репозиторий, содержащий 38 рабочих блокнотов, предназначенных для помощи пользователям в понимании стека Hugging Face за счет постепенного устранения высокоуровневых абстракций. Коллекция охватывает путь от основных компонентов, таких как transformers и tokenizers, до тонкой настройки, PEFT, рассуждений/RL и работы над проектами от начала до конца.

  • Включает реализации токенизаторов WordPiece и Unigram, созданных с нуля.
  • Демонстрирует LoRA и супервизорную тонкую настройку наряду с GRPO, реализованным с первых принципов, перед использованием GRPOTrainer.
  • Охватывает эксперименты с семантическим поиском FAISS, trl, Unsloth и vLLM.
  • Содержит проект XQuAD на румынском языке, сравнивающий монолингвальные и многоязычные модели BERT с исправленной оценкой по отдельным статьям.

Автор просит техническую обратную связь по ясности разделов GRPO с нуля и оценки румынского QA, а также предложения о пробелах в образовательном пути.