Nvidia bringt Groq-Inferenzchip in Produktion und meldet Rekordgeschwindigkeit für KI-Agenten
Nvidia führt den Inferenz-Chip Groq 3 LPX in Vollproduktion ein und erreicht dabei 3.400 Token pro Sekunde bei KI-Modellen – allerdings unter Verwendung von mindestens 64 Beschleunigern, während Konkurrenten wie Cerebras mit deutlich weniger Hardware auskommen. Die praktische Skalierbarkeit und Wirtschaftlichkeit der Lösung für größere Modelle bleibt fraglich. Für Juristen und Steuerberater relevant: Die Marktkonkurrenz im KI-Infrastruktur-Segment intensiviert sich, was langfristig Lizenzkosten und Betriebsausgaben für KI-Lösungen beeinflussen könnte.
Originalquelle lesenDiese Zusammenfassung dient der schnellen Orientierung und ersetzt weder die Originalquelle noch eine rechtliche Prüfung. Sie wurde KI-gestützt erstellt und redaktionell kuratiert.