Пользователь pop123-ux опубликовал обучающий репозиторий, содержащий 38 рабочих блокнотов, предназначенных для помощи пользователям в понимании стека Hugging Face за счет постепенного устранения высокоуровневых абстракций. Коллекция охватывает путь от основных компонентов, таких как transformers и tokenizers, до тонкой настройки, PEFT, рассуждений/RL и работы над проектами от начала до конца.
- Включает реализации токенизаторов WordPiece и Unigram, созданных с нуля.
- Демонстрирует LoRA и супервизорную тонкую настройку наряду с GRPO, реализованным с первых принципов, перед использованием GRPOTrainer.
- Охватывает эксперименты с семантическим поиском FAISS, trl, Unsloth и vLLM.
- Содержит проект XQuAD на румынском языке, сравнивающий монолингвальные и многоязычные модели BERT с исправленной оценкой по отдельным статьям.
Автор просит техническую обратную связь по ясности разделов GRPO с нуля и оценки румынского QA, а также предложения о пробелах в образовательном пути.