A Nvidia está trabalhando em uma família de modelos de inteligência artificial de código aberto que terá pelo menos 1 trilhão de parâmetros, de acordo com pessoas envolvidas no projeto revelado pelo site The Information nesta terça-feira (11). A novidade deverá ser nomeada como Nemotron 4.
Segundo a reportagem, a gigante dos semicondutores quer que essa nova geração rivalize com os maiores modelos open source do mundo. Os sistemas chineses estão entre os principais alvos, pois têm se destacado à medida que os custos da tecnologia ficam cada vez mais caros. A empresa não comentou o rumor.
Ampliando atuação no mercado de IA
Conhecida por desenvolver alguns dos chips mais avançados utilizados em soluções de IA, a Nvidia vem tentando criar um ecossistema que vá além das GPUs. A família de modelos Nemotron é parte da estratégia.
- Uma das poucas empresas americanas ofertando modelos de código aberto, ela quer aproveitar o interesse gerado pela categoria para ampliar sua participação na área;
- Sem restrições quanto ao uso em segurança cibernética, os modelos abertos chamaram a atenção após os ataques envolvendo IAs que escaparam de ambientes de teste;
- Dessa forma, os sistemas open source foram utilizados para conter os ciberataques cometidos pelas IAs autônomas;
- No caso da Hugging Face, a solução escolhida foi um modelo chinês, já que as travas de segurança impediram as tecnologias americanas de barrar a invasão.

De acordo com a publicação, a Nvidia está nas últimas etapas de desenvolvimento do Nemotron 4. O treinamento final do sistema não foi concluído, mas isso não deve impedir sua estreia ainda em 2026.
Embora a big tech não tenha definido uma data mais exata, as fontes acreditam que a quarta geração do modelo de código aberto estará disponível em algum momento no último trimestre, ou seja, entre outubro e dezembro.
Nemotron 3.5 Lightning lançado
Enquanto o modelo open source com 1 trilhão de parâmetros não chega, a Nvidia anunciou, nesta terça-feira (11), a versão mais recente da família. Trata-se do Nemotron 3.5 Lightning, focado em tarefas com agentes especializados e de alta velocidade.
A novidade tem geração de tokens quatro vezes mais rápida e tempo de conclusão 30% menor que sistemas abertos da mesma categoria, segundo a gigante da tecnologia. O lançamento pode funcionar localmente em PCs com hardware Nvidia, data centers e ambientes na nuvem.
Também foi anunciado o Nemo Switchyard, biblioteca de roteamento de modelos de código aberto capaz de direcionar, automaticamente, as tarefas para os sistemas mais adequados.
Siga no TecMundo e saiba o que disse o CEO da Nvidia, Jensen Huang, sobre o temor de que a IA acabará com a humanidade.