El usuario pop123-ux ha publicado un repositorio de aprendizaje que contiene 38 cuadernos ejecutables diseñados para ayudar a los usuarios a comprender la pila de Hugging Face eliminando progresivamente las abstracciones de alto nivel. La colección cubre un camino desde componentes centrales como transformers y tokenizers hasta el ajuste fino, PEFT, razonamiento/RL y trabajo en proyectos de extremo a extremo.

  • Incluye implementaciones de los tokenizadores WordPiece y Unigram construidos desde cero.
  • Demuestra LoRA y el ajuste fino supervisado junto con GRPO implementado desde primeros principios antes de usar GRPOTrainer.
  • Cubre experimentos de búsqueda semántica FAISS, trl, Unsloth y vLLM.
  • Presenta un proyecto XQuAD rumano que compara BERT monolingüe y multilingüe con una evaluación corregida a nivel de artículo.

El autor busca comentarios técnicos sobre la claridad de las secciones de GRPO desde cero y la evaluación de QA rumana, así como sugerencias para lagunas en el camino de aprendizaje.