IBM hat die neuesten Open-Source-KI-Modelle von Meta – Llama 4 Scout und Llama 4 Maverick – in seine watsonx.ai-Plattform integriert. Diese Modelle der nächsten Generation, die auf der Kombination verschiedener Experten (Mixed of Experts, MoE) basieren, bieten leistungsstarke multimodale Funktionen mit deutlich verbesserter Kosteneffizienz, Skalierbarkeit und Rechenleistung. Mit Llama 4 unterstützt IBM nun 13 Meta-Modelle auf watsonx.ai und unterstreicht damit sein Engagement für einen offenen, modellübergreifenden Ansatz im Bereich der generativen KI.
Architektur mit Expertenmix: Effizienz ohne Kompromisse
Die neuen Llama 4-Modelle von Meta stellen einen bedeutenden Fortschritt in der KI-Architektur dar. Beide Modelle nutzen MoE, das intelligent nur eine Teilmenge von Modellexperten für jeden Token aktiviert, anstatt das gesamte Netzwerk einzubeziehen. Diese gezielte Inferenzstrategie erhöht den Durchsatz und senkt die Betriebskosten ohne Qualitätseinbußen.
Llama 4 Scout verfügt über insgesamt 109 Milliarden Parameter, die auf 16 Experten verteilt sind, wobei jedoch nur 17 Milliarden Parameter während der Inferenz aktiv sind. Diese effiziente Konfiguration ermöglicht eine höhere Parallelität und schnellere Reaktionszeiten bei gleichzeitig herausragender Leistung in den Bereichen Codierung, kontextbezogenes Schlussfolgern und Bildverständnis. Trotz seines geringen Speicherbedarfs wurde Scout mit 40 Billionen Token trainiert und übertrifft Modelle mit deutlich größeren aktiven Parametersätzen.
Llama 4 Maverick geht mit 400 Milliarden Parametern und 128 Experten noch einen Schritt weiter und arbeitet dabei weiterhin mit nur 17 Milliarden aktiven Parametern pro Inferenz. Laut Meta übertrifft Maverick OpenAIs GPT-4o und Googles Gemini 2.0 Flash in multimodalen Benchmarks durchweg und erreicht die Leistung von DeepSeek-V3 bei Logik- und Codierungsaufgaben, obwohl es deutlich effizienter ist.
| Modell | Gesamtparameter | Aktive Parameter | Anzahl der Experten | Kontextfenster |
|---|---|---|---|---|
| Lama 4 Scout | 109 Mrd | 17 Mrd | 16 | 10 Millionen Token |
| Lama 4 Maverick | 400 Mrd | 17 Mrd | 128 | 10 Millionen Token |
Vorreiter bei der Langzeit-KI
Llama 4 Scout führt ein bahnbrechendes Kontextfenster mit bis zu 10 Millionen Token ein – derzeit das längste in der Branche. Diese Weiterentwicklung ermöglicht die Zusammenfassung mehrerer Dokumente, eine detaillierte Codebasisanalyse und eine langfristige Benutzerpersonalisierung. Meta führt diesen Meilenstein auf zwei architektonische Innovationen zurück: verschachtelte Aufmerksamkeitsebenen (ohne Positionseinbettungen) und eine Technik zur Aufmerksamkeitsskalierung während der Inferenzzeit. Diese Verbesserungen, die zusammen als „iRope“ bezeichnet werden, bringen Meta seiner Vision einer KI mit unbegrenzter Kontextlänge näher.
Native Multimodalität für reale Anwendungsfälle
Herkömmliche LLMs werden ausschließlich mit Text trainiert und anschließend für andere Datentypen angepasst. Llama 4-Modelle hingegen gelten als „nativ multimodal“, d. h. sie werden von Grund auf mit einer Kombination aus Text-, Bild- und Videodaten trainiert. Dadurch können sie verschiedene Eingabetypen auf natürliche Weise verarbeiten und integriertere, kontextbezogene Ergebnisse liefern.

Enterprise-Bereitstellung auf IBM Watsonx
Mit watsonx.ai können Entwickler und Unternehmen auf Llama 4 Scout oder Maverick zugreifen und diese optimieren, optimieren und in Cloud-, On-Premise- oder Edge-Umgebungen bereitstellen. Die Enterprise-Plattform von IBM unterstützt den gesamten KI-Lebenszyklus und bietet Tools für Entwickler aller Erfahrungsstufen – von Code- bis hin zu Low-Code- und No-Code-Umgebungen.
watsonx.ai umfasst vorgefertigte Integrationen mit Vektordatenbanken, Agenten-Frameworks und fortschrittlicher Infrastruktur, die die Implementierung von KI im großen Maßstab erleichtern. Robuste Governance-Tools gewährleisten Compliance, Sicherheit und Auditierbarkeit auf Unternehmensniveau und unterstützen Teams bei der verantwortungsvollen Entwicklung und schnelleren Bereitstellung.
Eine strategische Allianz für die KI-Transformation
Die Partnerschaft von IBM mit Meta verbindet offene Innovation mit praktischer Unternehmensreife. Während Meta die Grenzen der Modellarchitektur erweitert, bietet IBM die Infrastruktur, Governance und Bereitstellungsflexibilität, die moderne Unternehmen benötigen, um schnell zu agieren, ohne dabei Kontrolle oder Kosteneffizienz einzubüßen.
Mit der Einführung von Llama 4 auf watsonx.ai erhalten IBM-Kunden einen neuen Satz leistungsstarker Tools, mit denen sie in einer Vielzahl von Anwendungsfällen Mehrwert erzielen können – ohne Abhängigkeit von einem Anbieter und mit der Gewissheit, auf einer für Unternehmen konzipierten Plattform zu arbeiten.




Amazon