O usuário pop123-ux publicou um repositório de aprendizado contendo 38 notebooks executáveis projetados para ajudar os usuários a entender a pilha do Hugging Face removendo progressivamente as abstrações de alto nível. A coleção cobre um caminho desde componentes centrais como transformers e tokenizers até ajuste fino, PEFT, raciocínio/RL e trabalho em projetos de ponta a ponta.

  • Inclui implementações dos tokenizadores WordPiece e Unigram construídos do zero.
  • Demonstra LoRA e ajuste fino supervisionado junto com GRPO implementado desde os primeiros princípios antes de usar o GRPOTrainer.
  • Cobre experimentos de busca semântica FAISS, trl, Unsloth e vLLM.
  • Apresenta um projeto XQuAD romeno comparando BERT monolíngue e multilíngue com avaliação corrigida em nível de artigo.

O autor busca feedback técnico sobre a clareza das seções de GRPO do zero e da avaliação de QA romeno, bem como sugestões para lacunas no caminho de aprendizado.