A Microsoft publicou o relatório técnico do Phi-4, um modelo de linguagem com 14 bilhões de parâmetros que prioriza a qualidade dos dados por meio do uso estratégico de dados sintéticos durante todo o treinamento. Diferente dos modelos Phi anteriores, que destilavam capacidades do GPT-4, o Phi-4 supera seu professor em tarefas de QA focadas em STEM, demonstrando que suas técnicas de geração de dados e pós-treinamento vão além da simples destilação.

  • O modelo utiliza uma receita de treinamento focada em dados sintéticos de alta qualidade, em vez de apenas conteúdo orgânico da web ou código.
  • O Phi-4 supera substancialmente o GPT-4 nas capacidades de resposta a perguntas focadas em STEM.
  • Ele alcança desempenho robusto em relação ao seu tamanho, especialmente em benchmarks focados em raciocínio, devido à melhoria nos dados, no currículo de treinamento e nas inovações de pós-treinamento.

O relatório destaca que, apesar das mínimas mudanças arquiteturais em relação ao phi-3, o foco na qualidade dos dados permite que o modelo exceda as capacidades do professor em domínios específicos.