O usuário pop123-ux publicou um repositório de aprendizado contendo 38 notebooks executáveis projetados para ajudar os usuários a entender a pilha do Hugging Face removendo progressivamente as abstrações de alto nível. A coleção cobre um caminho desde componentes centrais como transformers e tokenizers até ajuste fino, PEFT, raciocínio/RL e trabalho em projetos de ponta a ponta.
- Inclui implementações dos tokenizadores WordPiece e Unigram construídos do zero.
- Demonstra LoRA e ajuste fino supervisionado junto com GRPO implementado desde os primeiros princípios antes de usar o GRPOTrainer.
- Cobre experimentos de busca semântica FAISS, trl, Unsloth e vLLM.
- Apresenta um projeto XQuAD romeno comparando BERT monolíngue e multilíngue com avaliação corrigida em nível de artigo.
O autor busca feedback técnico sobre a clareza das seções de GRPO do zero e da avaliação de QA romeno, bem como sugestões para lacunas no caminho de aprendizado.