Infrastruktur & Compute
Chips, Rechenzentren, Inferenz und alles, worauf KI läuft. 13 Beiträge, jeder mit seiner Quellenlage.
NVIDIA kündigt PAIR-Beta und RTX-Spark-Windows-PCs für Oktober an
Auf der IFA 2026 stellt NVIDIA lokale KI-Integrationen und Optimierungen für Inferenz vor. Der offene Netzwerk-Router NVIDIA PAIR ist als Beta für Windows, macOS und Linux verfügbar; Lenovo- und Acer-Systeme mit RTX Spark sollen im Oktober folgen.
NVIDIA kündigt 28 weitere Spiele für GeForce NOW im September 2026 an
Laut einem NVIDIA-Blogbeitrag sollen im September 28 weitere Titel zu GeForce NOW kommen. Genannt werden NBA 2K27 mit DLSS 5, The Blood of Dawnwalker und Onimusha: Way of the Sword.
NVIDIA beschreibt NVLink Fusion als Plattform für kundenspezifische XPUs in KI-Rechenzentren
In einem Blogbeitrag stellt NVIDIA NVLink Fusion als Infrastruktur vor, die kundenspezifische Beschleuniger mit dem eigenen KI-Stack verbinden soll. Die Angaben zu Leistung, Effizienz und Skalierung stammen ausschließlich von NVIDIA.
NVIDIA meldet erste Vera-CPU-Server- und Rubin-GPU-Lieferung an AWS
Nach Angaben von NVIDIA erhielt AWS in Seattle erstmals einen Vera-CPU-Server und eine Vera-Rubin-GPU. Oracle Cloud Infrastructure plant laut NVIDIA ab 2026 den Einsatz von Hunderttausenden Vera-CPUs.
Infrastruktur & ComputeOpenAI meldet erste Benchmark-Ergebnisse für eigenen Inferenzchip Jalapeño
Nach Angaben des Unternehmens übertraf Jalapeño in einem öffentlichen InferenceX-Test bei GPT-OSS 120B kommerzielle Vergleichssysteme bei Spitzen-Durchsatz pro Kilowatt und Token-Latenz. Unabhängige Bestätigung liegt im vorliegenden Material nicht vor.
NVIDIA meldet bis zu 30-mal mehr Agenten-Durchsatz pro Megawatt für Vera Rubin NVL72
Die vom Hersteller veröffentlichten frühen Ergebnisse des SemiAnalysis-AgentX-Benchmarks vergleichen Vera Rubin NVL72 mit GB300 NVL72. Sie stehen noch unter Prüfung durch SemiAnalysis und erfassen die Vera-CPU-Leistung bei Tool-Aufrufen nicht.
NVIDIA kündigt NVHBM für NVLink Fusion an; Annapurna Labs soll erster Partner werden
NVIDIAs neue Speichertechnik für XPUs soll gegenüber Standard-HBM4E mehr Bandbreite bei geringerem HBM-Energieverbrauch liefern. Die Angaben stammen ausschließlich von NVIDIA; eine unabhängige Bestätigung liegt nicht vor.
NVIDIA meldet Groq 3 LPX in Vollproduktion für Vera-Rubin-Inferenzsysteme
Der Hersteller beschreibt den Beschleuniger als Baustein für agentische KI und kündigt zugleich Netzwerk- und Integrationsangebote an. Die Angaben stammen ausschließlich von NVIDIA.
NVIDIA nennt weitere Spiele- und Anti-Cheat-Unterstützung für RTX Spark vor Herbststart
Laut NVIDIA sollen Titel von EA, Embark und Ubisoft auf RTX-Spark-Geräten laufen; mit EA arbeitet das Unternehmen zudem an nativer Unterstützung für Javelin Anticheat.
Hugging Face veröffentlicht WebGPU-Kernelbibliothek und Fleet für Browser-Tests
@huggingface/kernels soll optimierte WebGPU-Kernel vom Hugging Face Hub laden und ausführen. Zum Start stehen 207 Kernel bereit; Fleet führt Benchmarks und Tests direkt auf der Hardware der Nutzenden im Browser aus.
IBM bringt vier Granite-Zeitreihenmodelle in den Early Access von Confluent Cloud
Die Modelle für Prognosen und Anomalieerkennung lassen sich laut einem IBM-Research-Beitrag über Apache-Flink-SQL-Funktionen auf Confluent Cloud auf AWS aufrufen. Unterstützung für Confluent Platform soll folgen.