
Nvidia é a maior publicadora mundial de modelos abertos de IA
O ecossistema de modelos abertos da NVIDIA
A NVIDIA é a maior publicadora mundial de modelos abertos de IA, com modelos entre os mais baixados do Hugging Face. O portfólio vai muito além de chatbots: modelos de raciocínio (família Nemotron), modelos de mundo físico (Cosmos), modelos de fundação para robôs humanoides (Isaac GR00T), direção autônoma (Alpamayo), descoberta de fármacos (BioNeMo), computação quântica (Ising) e previsão climática (Earth-2).
A família Nemotron evoluiu desde 2023 e hoje tem três tamanhos: Nano (tarefas simples e rápidas), Super (planejamento intermediário) e Ultra (raciocínio complexo). Cosmos, lançado na CES 2025, unificou-se em 2026 no Cosmos 3, um omni-modelo capaz de gerar cenas, raciocinar sobre elas e prever o próximo estado - incluindo uma versão Edge de 4 bilhões de parâmetros que roda em tempo real no próprio robô. O GR00T usa Cosmos como backbone de raciocínio e já está na versão 1.7, com licença comercial para produção.
Como os modelos são rápidos e capazes
Três decisões de design explicam a combinação de velocidade e capacidade:
Arquitetura híbrida: a maioria das camadas usa Mamba (custo linear com o comprimento da sequência), com algumas camadas de atenção intercaladas para recuperar precisão na busca de fatos específicos. Isso torna viável uma janela de contexto de um milhão de tokens. Camadas de Mixture-of-Experts (MoE) ativam apenas um subconjunto de parâmetros por token, mantendo o custo baixo.
Co-design GPU-modelo: os modelos maiores são pré-treinados em formato de 4 bits (NVFP4) desde o primeiro passo, porque a geração Blackwell de GPUs foi projetada com hardware rápido para 4 bits. Modelo e chip foram desenhados um para o outro.
Pós-treinamento com RL em escala: fine-tuning supervisionado seguido de reinforcement learning com mais de um milhão de rollouts. O gargalo real, segundo Bryan Catanzaro (VP de Applied Deep Learning Research), não é dado nem compute - é a diversidade dos ambientes de treino.
Uma fundação unificada
Em vez de times paralelos reinventando peças, a NVIDIA reutiliza uma base comum. A mesma arquitetura híbrida escala nos três tamanhos de Nemotron. O Cosmos Reason foi reaproveitado como núcleo de raciocínio dentro do GR00T. A cultura interna é de voluntariado: times escolhem no que trabalhar e a unificação acontece por convite, não por controle.
O que "aberto" realmente significa
A NVIDIA não libera apenas os pesos. Publica datasets de treino e pós-treino, ambientes de RL, receitas de reprodução e papers. Isso gerou uma grande comunidade de fine-tunes e derivados - a família Nemotron ultrapassou 100 milhões de downloads totais, e um dos datasets de robótica se tornou um dos mais baixados do Hugging Face.
Por que uma empresa de chips dá tudo de graça
Duas razões: (1) construir modelos abertamente mantém a NVIDIA honesta sobre para onde a IA vai, o que informa o design dos próximos chips; (2) cada equipe que adota modelos abertos e constrói sua própria IA se torna um cliente potencial de compute. A empresa prefere crescer com o ecossistema do que competir com ele.
Lições e próximos passos
Quatro lições de shipping aberto: o programa contínuo importa mais que qualquer lançamento individual; facilitar a vida do desenvolvedor (licença, docs, exemplos) é o que converte download em uso duradouro; usar uma licença confiável pela comunidade (migraram para OpenMDW, da Linux Foundation); e abrir mais cedo - as coalizões Nemotron e Cosmos vão trazer colaboradores para dentro do processo de construção. Catanzaro compara com CUDA, que levou mais de uma década para o mundo entender seu valor. Modelos abertos, diz ele, seguirão o mesmo caminho.