NVIDIA treibt das Co-Design von KI-Modellen voran und fordert LLM-Entwickler auf, Architekturen an Inferenz-Constraints der Blackwell-Ära auszurichten
NVIDIA fordert LLM-Entwickler auf, Modelle für GPU-freundliche Inferenz gemeinsam mit der Hardware zu entwerfen – in der Annahme, dass hardwarebewusste Architekturen Kosten und Latenz im großen Maßstab senken.
