El usuario pop123-ux ha publicado un repositorio de aprendizaje que contiene 38 cuadernos ejecutables diseñados para ayudar a los usuarios a comprender la pila de Hugging Face eliminando progresivamente las abstracciones de alto nivel. La colección cubre un camino desde componentes centrales como transformers y tokenizers hasta el ajuste fino, PEFT, razonamiento/RL y trabajo en proyectos de extremo a extremo.
- Incluye implementaciones de los tokenizadores WordPiece y Unigram construidos desde cero.
- Demuestra LoRA y el ajuste fino supervisado junto con GRPO implementado desde primeros principios antes de usar GRPOTrainer.
- Cubre experimentos de búsqueda semántica FAISS, trl, Unsloth y vLLM.
- Presenta un proyecto XQuAD rumano que compara BERT monolingüe y multilingüe con una evaluación corregida a nivel de artículo.
El autor busca comentarios técnicos sobre la claridad de las secciones de GRPO desde cero y la evaluación de QA rumana, así como sugerencias para lagunas en el camino de aprendizaje.