Nvidia werkt aan Nemotron 4, een nieuwe familie open modellen die het moet opnemen tegen de sterkste open-source modellen ter wereld. Het grootste model krijgt volgens betrokkenen minstens 1 biljoen parameters. Een releasedatum is er nog niet, de laatste trainingsronde loopt nog.
The Information stelt dat Nvidia bezig is met Nemotron 4, op basis van medewerkers die bij het project betrokken zijn. Het grootste model in die familie zou minstens 1 biljoen parameters krijgen. Volgens medewerkers kan het model op zijn vroegst laat in het najaar klaar zijn, maar de definitieve training is nog niet afgerond.
Nvidia zelf verwees naar eerdere uitspraken dat het aan Nemotron 4 werkt, maar bevestigde de details van The Information niet. Wel gaf vice president generative AI Kari Briski een verklaring af. “Nvidia investeert in Nemotron omdat we geloven dat elk bedrijf en elk land toegankelijke frontier open modellen nodig heeft om veiligheid en security te versterken, innovatie te versnellen en een fundament te bieden waarop ze van generatie op generatie kunnen vertrouwen”, aldus Briski.
Dat 1 biljoen is een forse sprong. De publiek uitgebrachte Nemotron-4-familie telt nu 340 miljard parameters en verscheen onder de Nvidia Open Model License, die distributie, aanpassing en commercieel gebruik toestaat. Recenter kwam Nemotron 3 Ultra, een open-weight MoE-model met 550 miljard parameters waarvan 55 miljard actief per token, gericht op agentic AI en langlopende reasoning-taken.
Coalitie en open brief
Vorige maand kwam Nvidia samen met andere bedrijven met een coalitie om tools voor AI-safety en cybersecurity te ontwikkelen en te delen. Daarnaast ondertekende het bedrijf een open brief met partijen als Microsoft, waarin steun wordt uitgesproken voor open-weight modellen zodat innovatie niet naar het buitenland verschuift.
Dinsdag kwam Nvidia ook met Nemotron 3.5 Lightning, gericht op onder meer code review, tool use, het monitoren van security alerts en het beantwoorden van facturatievragen. Verder bracht het bedrijf NeMo Switchyard uit, een open-source library voor model routing die AI-taken automatisch naar het meest geschikte model stuurt.
Tip: Nvidia zet Open Secure AI Alliance op na Hugging Face-incident