사용자 pop123-ux 는 고급 추상화를 단계적으로 제거하여 Hugging Face 스택을 이해하는 데 도움이 되도록 설계된 38 개의 실행 가능한 노트북이 포함된 학습 저장소를 게시했습니다. 이 컬렉션은 transformers 및 tokenizers 와 같은 핵심 구성 요소부터 파인튜닝, PEFT, 추론/RL 및 엔드투엔드 프로젝트 작업에 이르는 경로를 다룹니다.
- WordPiece 및 Unigram 토크나이저의 처음부터 구축된 구현을 포함합니다.
- GRPOTrainer 를 사용하기 전에 첫 번째 원칙에서 구현된 GRPO 와 함께 LoRA 및 감독 파인튜닝을 시연합니다.
- FAISS 의미 검색, trl, Unsloth 및 vLLM 실험을 다룹니다.
- 수정된 기사 수준 홀드아웃 평가를 수행하는 단일 언어 및 다국어 BERT 를 비교하는 루마니아어 XQuAD 프로젝트를 특징으로 합니다.
저자는 처음부터 작성된 GRPO 및 루마니아어 QA 평가 섹션의 명확성에 대한 기술적 피드백과 학습 경로에서의 격차에 대한 제안을 구합니다.