उपयोगकर्ता pop123-ux ने एक शिक्षा भंडार प्रकाशित किया है जिसमें 38 चलाए जाने वाले नोटबुक शामिल हैं जो उच्च-स्तरीय अभिव्यक्तियों को क्रमिक रूप से हटाकर उपयोगकर्ताओं को Hugging Face स्टैक को समझने में मदद करने के लिए डिज़ाइन किए गए हैं। संग्रह transformers और tokenizers जैसे मुख्य घटकों से लेकर फाइन-ट्यूनिंग, PEFT, तर्क/RL और अंत-से-अंत परियोजना कार्य तक के मार्ग को कवर करता है।

  • शून्य से बनाए गए WordPiece और Unigram टोकनाइज़र के कार्यान्वयन शामिल हैं।
  • GRPOTrainer का उपयोग करने से पहले मूल सिद्धांतों से लागू किए गए GRPO के साथ LoRA और पर्यवेक्षित फाइन-ट्यूनिंग को प्रदर्शित करता है।
  • FAISS अर्थपूर्ण खोज, trl, Unsloth और vLLM प्रयोगों को कवर करता है।
  • एक रोमानियाई XQuAD परियोजना की विशेषता है जो एकल भाषा और बहुभाषी BERT की तुलना करती है, जिसमें सही लेख-स्तर की रोकथाम मूल्यांकन शामिल है।

लेखक GRPO-फ्रॉम-स्क्रैच और रोमानियाई QA मूल्यांकन खंडों की स्पष्टता पर तकनीकी प्रतिक्रिया, साथ ही सीखने के मार्ग में अंतराल के लिए सुझाव चाहते हैं।