NVIDIA lança Kumo Tabular, modelo aberto para dados tabulares
A NVIDIA lançou o Kumo Tabular, modelo de base aberto para dados tabulares que prevê rótulos de novas linhas a partir de uma tabela com exemplos rotulados. O modelo faz classificação e regressão em uma única passagem, sem treinamento, ajuste de hiperparâmetros ou engenharia de atributos durante o uso, e está disponível no Hugging Face por meio de uma biblioteca de código aberto.
Pré-treinado apenas com dados artificiais, o Kumo Tabular tem três tamanhos, de 28 milhões a 215 milhões de parâmetros, e é distribuído sob a licença OpenMDW-1.1, que permite uso comercial. A NVIDIA afirma que o modelo ficou em primeiro lugar nos benchmarks TabArena, BeyondArena, TALENT e ScoringBench.
Por que importa · interpretação editorial
A disponibilidade sob uma licença que permite uso comercial pode facilitar que equipes avaliem modelos tabulares abertos em problemas de classificação e regressão sem um ciclo adicional de treinamento durante o uso. As posições citadas pela NVIDIA nos benchmarks oferecem referências iniciais para essa avaliação, embora não substituam testes com dados reais.