A NVIDIA lançou o Kumo Tabular, um modelo base aberto para classificação e regressão tabular que opera por meio de aprendizado em contexto, sem exigir treinamento ou engenharia de recursos. Pré-treinado exclusivamente em dados artificiais gerados por Modelos Causais Estruturais, o modelo está disponível em três tamanhos, variando de 28M a 215M parâmetros.
- O Kumo Tabular ocupa a primeira posição nos benchmarks TabArena, BeyondArena, TALENT e ScoringBench, estabelecendo um novo estado da arte na fronteira de Pareto entre precisão e eficiência.
- A arquitetura utiliza atenção por coluna, linha e em contexto para processar tabelas, permitindo previsões para novas linhas em uma única passagem direta.
- Ele é executado por meio da biblioteca open-source structured-data-models da NVIDIA sob a licença OpenMDW-1.1 para uso comercial.
O lançamento oferece às empresas uma alternativa zero-shot às árvores de boosting de gradiente, permitindo previsão imediata em tabelas rotuladas sem o ciclo tradicional de ajuste de hiperparâmetros e validação.