AWS benchmarkt G7-Blackwell-GPUs gegen G5 und G6 für kleine LLM-Inferenz
AWS benchmarkt 30B-MoE-Modelle auf SageMaker AI über G5, G6, G6e und G7 und zeigt, wie Blackwell Inferenzkosten und Latenz verbessern könnte.
Neueste Nachrichten und Analysen zu LLM-Benchmarks
AWS benchmarkt 30B-MoE-Modelle auf SageMaker AI über G5, G6, G6e und G7 und zeigt, wie Blackwell Inferenzkosten und Latenz verbessern könnte.
Zwei Berichte erheben widersprüchliche Behauptungen über GLM-5.2 und Qwen3.8-Max und zeigen, wie dünne Benchmark-Evidenz Vergleiche mit ChatGPT und Claude verzerren kann.
Databricks wird GLM 5.2 zu seinem Standard-Coding-Modell machen, nachdem interne Tests bei realen Codebasis-Aufgaben eine mit Opus vergleichbare Leistung zu geringeren Kosten pro Aufgabe ergaben.
Google hat Gemini 3.1 Pro vorgestellt, sein neuestes KI-Modell mit verdoppelter abstrakter Schlussfolgerungsleistung auf ARC-AGI-2, das in 12 von 19 wichtigen Benchmarks die Rivalen GPT-5.2 und Claude Opus 4.6 übertrifft.