OpslagReview. com

AMD ROCm 10 arriveert met de algemene beschikbaarheid van ROCm.AI: Hyperloom Agents, AMD-vaardigheden en een beweerde 3.3x snellere inferentie.

AI  ◇  Enterprise

AMD heeft ROCm 10 uitgebracht, ter gelegenheid van het tienjarig jubileum van zijn open source softwareplatform, en ROCm.AI algemeen beschikbaar gemaakt voor ontwikkelaars. ROCm.AI, dat voor het eerst werd gepresenteerd op Advancing AI 2026 , is een AI-native ontwikkelplatform dat is ontworpen om de workflows voor het bouwen, implementeren en optimaliseren van applicaties op AMD-hardware te versnellen.

ROCm.AI combineert drie componenten – ROCm Hyperloom, AMD Skills en de ROCm CLI – tot één geïntegreerde ontwikkelaarservaring. Het platform is ontworpen om AMD-specifieke expertise en agentische optimalisatie rechtstreeks te integreren in de tools die ontwikkelaars al gebruiken.

AMD-kunstwerk voor de ROCm 10-jarige jubileumuitgave: een abstracte sculptuur van met elkaar verbonden bollen boven regels code.

Volgens AMD levert een systeem geconfigureerd met ROCm.AI gemiddeld een 3.3x betere inferentieprestatie en een 2.4x betere trainingsprestatie dan ROCm 7 op vergelijkbare hardware. Dit wordt bereikt door AI-gestuurde optimalisatie van kernels, geheugenbeheer en scheduling.

Autonome inferentie-optimalisatie

ROCm Hyperloom functioneert als een autonoom agentsysteem voor het optimaliseren van end-to-end inferentieworkloads, zowel voor hostcode als GPU-kernels. Het systeem profileert een gegeven workload, identificeert prestatieknelpunten, onderzoekt mogelijke optimalisatiepaden, implementeert gerichte codewijzigingen en voert vervolgens benchmarks uit en valideert de resultaten op correctheid.

Met ROCm 10 breidt Hyperloom de ondersteuning voor AMD Instinct GPU's uit en voegt compatibiliteit toe met de vLLM- en SGLang-inferentieframeworks. Ontwikkelaars kunnen optimalisaties uitvoeren in HIP-, Triton- en FlyDSL-codebases, waarbij Hyperloom rapporten genereert met details over voorgestelde wijzigingen en gemeten of verwachte prestatieverbeteringen. Hyperloom is beschikbaar als een op zichzelf staande workflow en via integratie met AMD Skills.

Geselecteerde expertise voor AI-codeerders

AMD Skills levert zorgvuldig geselecteerde technische kennis over AMD en gevalideerde workflows rechtstreeks aan ondersteunde AI-codeerprogramma's , waaronder Claude Code, Cursor en Codex. Dit biedt ontwikkelaars AMD-specifieke begeleiding zonder hun bestaande ontwikkelomgeving te hoeven verlaten.

Diagram van de AMD Enterprise AI Reference Stack met de ROCm Core SDK, Primus en ROCm Inference-lagen, die Instinct, Radeon en Ryzen AI omvatten.

Met ROCm 10 wordt de AMD Skills-catalogus uitgebreid naar drie categorieën: client-native workflows voor lokale AI- en applicatie-integratie, cross-stack workflows voor diagnostiek, routing en replay-analyse, en server-native workflows voor AMD Instinct GPU's en AMD EPYC-processors, waaronder serving, profiling en prestatieanalyse. Skills die tijdens Advancing AI werden getoond, zijn nu beschikbaar via de Claude Code-, Codex- en Cursor-marketplaces, evenals via een open catalogus op GitHub. AMD geeft aan dat elke skill vóór de release structurele en gedragstests ondergaat.

Geïntegreerd commandoregelbeheer

De ROCm CLI, momenteel een Technology Preview-component van ROCm.AI, biedt een stabiele, uniforme commandoregelinterface voor het instellen, beheren en uitvoeren van AI-workloads op AMD-hardware. Ontwikkelaars kunnen dezelfde set commando's handmatig gebruiken, via een AI-codeagent of binnen continue integratiepipelines, voor systeeminspectie, installatie en beheer van de ROCm-omgeving, modelimplementatie, diagnostiek en runtimecontrole.

ROCm CLI is een lokale AI-controlekamer die in een terminal draait, met opties om ROCm 10 in te stellen, een model te hosten en diagnostiek uit te voeren.

De CLI wordt gedistribueerd als een vooraf gecompileerd binair bestand voor Windows en Linux en vereist geen bestaande ROCm-installatie. Het ondersteunt beheerde ROCm-omgevingen met meerdere runtimes naast elkaar, inclusief runtime-activering en -terugdraaien, samen met geïntegreerd modelserverbeheer en enginebeheer. De huidige adapters ondersteunen Lemonade op bepaalde AMD-clientsystemen en vLLM voor AMD Instinct GPU-servers.

De ROCm CLI wordt geleverd met de ROCm Console, intern voorheen bekend als "dash", die een realtime overzicht biedt van de systeemstatus en workloadactiviteit. Hiermee kunnen ontwikkelaars de gezondheid van de ROCm-runtime, de status van modelservers, het GPU-gebruik en benchmarktelemetrie monitoren, inclusief het gebruik van high-bandwidth geheugen, stroomverbruik en tokens per watt op ondersteunde AMD Instinct-systemen. De ROCm CLI Technology Preview biedt een versie-onafhankelijke ervaring vanaf ROCm 7.13, met formele ondersteuning voor ROCm 10 in het vooruitzicht.

Bredere ROCm 10 Stack-updates

Deze tools voor ontwikkelaars zijn gebouwd op de bredere ROCm 10-softwarestack, die een meer modulaire ROCm Core SDK introduceert. De release bevat ook updates voor bibliotheken, compilers, frameworks, modelondersteuning, prestatieoptimalisatie en ondersteunde hardwareplatformen.

label Waarde
Hardware configuratie Supermicro AS -4126GS-NMR-LCC (board H14DSG-OD)
8x AMD Instinct MI355X
BIOS AMI v1.4a (2025-04-16)
GPU-firmware SMC 04.86.11.02
TA RAS 27.69.00.10
TA XGMI 32.00.00.20
RLC43
MEC36
SDMA12
Ubuntu LTS 22.04.2
kernel 5.15.0-70-generic
amdgpu-stuurprogramma 6.16.6
HOST ROCm 7.1.0
Softwareconfiguratie(s) GLM-5 ROCm Docker-image: rocm/sgl-dev:v0.5.8.post1-rocm700-mi35x-20260219, PyTorch-versie 2.8.0, SGLang v0.5.8
Kimi ROCm Docker-image: vllm/vllm-openai-rocm:v0.16.0, vLLM versie 0.16.0
DeepSeek-R1 Docker-image: rocm/7.0:…sgl-dev-v0.5.2-rocm7.0-mi35x-20250915, SGLang-versie V0.5.13
vs GLM-5 ROCm Docker-image: rocm/atom:rocm7.2.2_ubuntu24.04_py3.12_pytorch_release_2.10.0_atom0.1.2.post, ATOM v0.1.2.post
Kimi ROCm Docker-afbeelding: vllm/vllm-openai-rocm:v0.22.0, vLLM versie V0.22.0

Neem contact op met StorageReview

Nieuwsbrief | YouTube | Podcast | iTunes / Spotify | Instagram | Twitter | TikTok | RSS-feed

Harold Frits

Ik zit in de technische industrie sinds IBM Selectric heeft gemaakt. Mijn achtergrond is echter schrijven. Dus besloot ik om uit de pre-sales biz te stappen en terug te keren naar mijn roots, een beetje te schrijven maar nog steeds betrokken te zijn bij technologie.