StorageReview.com

NVIDIA avslöjar banbrytande AI Foundation-modeller och verktyg på CES 2025

AI  ◇  Företag

På CES 2025 introducerade NVIDIA en serie nya AI-grundmodeller, verktyg och hårdvara utformade för att föra generativa och agentiska AI-funktioner direkt till konsumentdatorer och företagssystem. Dessa innovationer, som drivs av NVIDIAs senaste GPU:er i GeForce RTX™ 50-serien och NVIDIA NIM™-mikrotjänsterna, syftar till att omdefiniera hur utvecklare, företag och entusiaster interagerar med AI.

AI Foundation-modeller för RTX AI-datorer

NVIDIAs nya grundmodeller, som körs lokalt på RTX AI-datorer, kommer att revolutionera innehållsgenerering, produktivitet, AI-utveckling och vad Nvidia kallar digitalt mänskligt skapande. Dessa modeller drivs av GeForce RTX 50-seriens GPU:er, som har upp till 3,352 32 biljoner operationer per sekund av AI-prestanda och 4 GB VRAM. Byggda på NVIDIA Blackwell-arkitekturen är dessa GPU:er den första konsumenthårdvaran som stöder FPXNUMX-beräkning, vilket fördubblar AI-inferensprestanda och gör det möjligt för generativa AI-modeller att köras lokalt med ett mindre minnesfotavtryck.

NVIDIA NIM Microservices och AI Blueprints

NVIDIA NIM-mikrotjänster tillåter utvecklare och entusiaster att enkelt distribuera och integrera dessa modeller i arbetsflöden. De är optimerade för distribution över NVIDIA GPU:er, oavsett om de är på datorer, arbetsstationer eller i molnet. NIM-mikrotjänster är kompatibla med populära AI-utvecklingsramverk som LangChain, Langflow och AI Toolkit för VSCode, vilket möjliggör sömlös integration i befintliga applikationer.

Dessa mikrotjänster stöds av en pipeline av modeller från ledande utvecklare, inklusive Black Forest Labs, Meta, Mistral och Stability AI. Användningsfall sträcker sig över stora språkmodeller (LLM), vision-språkmodeller, bildgenerering, talbearbetning och retrieval-augmented generation (RAG).

En av höjdpunkterna är Llama Nemotron-familjen av öppna modeller, optimerade för agentiska AI-uppgifter som att följa instruktioner, funktionsanrop, kodning och matematik. Till exempel är Llama Nemotron Nano-modellen designad för att köras effektivt på RTX AI-datorer och arbetsstationer, vilket möjliggör avancerade AI-funktioner som chatt och kodning direkt på konsumenthårdvara.

För att demonstrera potentialen hos NIM-mikrotjänster förhandsgranskade NVIDIA Project R2X, en vision-aktiverad PC-avatar som drivs av NVIDIA RTX Neural Faces och Audio2Face™-3D. Denna avatar kan hjälpa användare med uppgifter som att sammanfatta dokument, hantera skrivbordsappar och förbättra videokonferenssamtal. Project R2X ansluter till moln AI-tjänster som OpenAI:s GPT4o och xAI:s Grok, såväl som NIM-mikrotjänster, som visar upp mångsidigheten hos NVIDIAs AI-ekosystem.

NVIDIA introducerade också AI Blueprints, förkonfigurerade referensarbetsflöden som effektiviserar agentisk och generativ AI-applikationsutveckling och distribution. Dessa ritningar gör det möjligt för företag att bygga och operationalisera anpassade AI-lösningar, skapa datadrivna AI-svänghjul som förbättrar produktiviteten. Dessa Blueprints utnyttjar NIM-mikrotjänster för att förenkla komplexa uppgifter. Till exempel, PDF-till-podcast-ritningen extraherar text, bilder och tabeller från en PDF, genererar ett podcast-skript och skapar en ljudinspelning med hjälp av AI-genererade eller användartillhandahållna röstprover. En annan plan, designad för 3D-vägledd generativ AI, låter artister styra bildgenerering med hjälp av 3D-scener skapade i verktyg som Blender.

Ritningar visar hur AI kan förbättra kreativitet och produktivitet. De ger utvecklare och kreatörer kraftfulla verktyg för att effektivisera sina arbetsflöden. Genom att köra lokalt på RTX AI-datorer eliminerar dessa ritningar behovet av molnbaserad bearbetning, vilket erbjuder snabbare och säkrare lösningar.

Agentisk AI och Nemotrons modellfamiljer

NVIDIA introducerade också modellfamiljerna Llama Nemotron och Cosmos Nemotron, designade för att främja agent AI – en ny era av AI där specialiserade agenter samarbetar för att lösa komplexa problem och automatisera uppgifter. Dessa modeller är optimerade för företagsapplikationer, inklusive kundsupport, bedrägeriupptäckt och supply chain management.

Llama Nemotron-modellerna, byggda på den populära Llama-grunden, beskärs och tränas med hjälp av NVIDIAs NeMo och de senaste teknikerna för att förbättra effektiviteten och noggrannheten. De finns i tre storlekar – Nano, Super och Ultra – för att tillgodose olika distributionsbehov, från realtidsapplikationer på datorer till operationer i datacenterskala. Dessa modeller är också anpassningsbara med hjälp av NVIDIA NeMo-mikrotjänster, vilket gör att företag kan skräddarsy dem till specifika domäner och användningsfall.

Cosmos Nemotron-modellerna, å andra sidan, fokuserar på vision-språkuppgifter, vilket gör det möjligt för AI-agenter att analysera och svara på bilder och videor. Dessa modeller passar autonoma maskiner, sjukvård, detaljhandel och mediaapplikationer. NVIDIA tillkännagav också Cosmos världsgrundmodeller för att generera fysikmedvetna videor, vilket ytterligare utökar kapaciteten hos AI-agenter i robotik och autonoma fordon.

Tillgänglighet och branschstöd

NVIDIAs NIM-mikrotjänster och AI Blueprints kommer att finnas tillgängliga i februari 2025. Initialt hårdvarustöd kommer att tillhandahållas för GeForce RTX 50 Series GPU:er, utvalda RTX 40 Series och professionella GPU:er. Ledande tillverkare, inklusive Acer, ASUS, Dell, HP, Lenovo och MSI, samt anpassade systembyggare som Corsair och Falcon Northwest, kommer att erbjuda NIM-förberedda RTX AI-datorer.

Modellerna Llama Nemotron och Cosmos Nemotron kommer också att finnas tillgängliga snart som nedladdningsbara modeller och värdbaserade API:er, med fri tillgång för utveckling och forskning genom NVIDIA Developer Program. Företag kan distribuera dessa modeller med NVIDIA AI Enterprise-programvaruplattformen, vilket säkerställer sömlös integrering i sina arbetsflöden.

Vad dessa meddelanden betyder idag

RTX AI-datorer och NIM-mikrotjänster ger generativa och agentiska AI-funktioner direkt till konsumentdatorer, vilket gör banbrytande AI-verktyg tillgängliga för en bredare publik. Uppgifter som en gång krävde kraftfulla datacenter kan nu utföras lokalt, vilket möjliggör snabbare, säkrare och mer personliga AI-upplevelser. Från att skapa digitala människor och automatisera arbetsflöden till att bygga intelligenta AI-agenter, dessa verktyg ger utvecklare och entusiaster möjlighet att tänja på gränserna för vad som är möjligt.

Inom spelvärlden omdefinierar NVIDIA ACE hur spelare interagerar med virtuella världar. Autonoma spelkaraktärer som drivs av ACE ger en ny nivå av realism och dynamik till NPC:er, vilket gör det möjligt för dem att uppfatta, planera och agera som mänskliga spelare. Denna teknik integreras redan i viktiga titlar som PUBG: BATTLEGROUNDS och NARAKA: BLADEPOINT , där AI-lagkamrater och fiender anpassar sig till spelarnas beteende, vilket skapar ett mer uppslukande och oförutsägbart spelupplägg. Utöver spelvärlden förändrar ACE:s generativa AI-funktioner även spelutvecklingen, med verktyg som Audio2Face som effektiviserar animationsarbetsflöden och möjliggör verklighetstrogna karaktärsinteraktioner. Tillsammans signalerar dessa innovationer en framtid där AI är sömlöst integrerad i alla aspekter av våra digitala liv, från produktivitet till underhållning.

En av de mest spännande tillämpningarna av ACE är i det kommande mordmysteriespelet Dead Meat , där spelare kan prata med vilken karaktär som helst med hjälp av naturligt språk. Med hjälp av NVIDIA ACE och små språkmodeller låter Dead Meat spelare förhöra misstänkta, ställa öppna frågor och manipulera eller charma dem att avslöja hemligheter. Denna interaktionsnivå, som tidigare bara var möjlig med mänskliga spelare, skapar en dynamisk och uppslukande upplevelse där varje konversation kan forma spelets resultat.

Slutsats

NVIDIAs tillkännagivanden vid CES 2025 belyser företagets engagemang för att tänja på gränserna för AI-innovation över branscher. Genom att introducera kraftfulla Nemotron-modellfamiljer med NIM microservices AI Blueprints, gör NVIDIA det möjligt för utvecklare, företag och kreatörer att låsa upp den fulla potentialen hos generativ och agent AI. Dessa framsteg, som drivs av de banbrytande GeForce RTX 50-seriens GPU:er, ger AI-kapacitet direkt till konsumentdatorer, vilket gör dem snabbare, säkrare och mer tillgängliga än någonsin tidigare.

Från att revolutionera produktivitet och innehållsskapande till att transformera spel med NVIDIA ACE autonoma karaktärer, NVIDIA sätter scenen för en ny era av AI-drivna upplevelser. Oavsett om vi möjliggör verklighetstrogna NPC:er i spel, effektiviserar kreativa arbetsflöden eller ger företag möjlighet att bygga intelligenta AI-agenter, NVIDIAs innovationer omformar hur vi interagerar med teknik. När dessa verktyg och tekniker blir tillgängliga lovar de att omdefiniera AIs möjligheter på både personliga och professionella sfärer, vilket banar väg för en mer intelligent och uppslukande framtid.

Engagera dig med StorageReview

Nyhetsbrev | YouTube | Podcast iTunes / Spotify | Instagram | Twitter | TikTok | RSS-flöde

Divyansh Jain

Maskininlärningsingenjör, hemläxa och teknikentusiast. På StorageReview leder jag AI och testning av nya arbetsbelastningar, och levererar insikter och prestandaanalyser.