AWS compare les GPU Blackwell G7 aux G5 et G6 pour l’inférence de petits LLM
AWS compare des modèles MoE de 30B sur SageMaker AI entre G5, G6, G6e et G7, montrant comment Blackwell pourrait améliorer le coût et la latence d’inférence.
Dernières Actualités et Analyses sur benchmarks LLM
AWS compare des modèles MoE de 30B sur SageMaker AI entre G5, G6, G6e et G7, montrant comment Blackwell pourrait améliorer le coût et la latence d’inférence.
Deux rapports avancent des affirmations contradictoires sur GLM-5.2 et Qwen3.8-Max, montrant comment des preuves de benchmark trop minces peuvent fausser les comparaisons avec ChatGPT et Claude.
Databricks fera de GLM 5.2 son modèle de codage par défaut après que des tests internes ont montré des performances comparables à Opus à moindre coût par tâche sur de vrais travaux de base de code.
Google a dévoilé Gemini 3.1 Pro, son dernier modèle d'IA affichant des performances en raisonnement abstrait doublées sur ARC-AGI-2, dépassant les rivaux GPT-5.2 et Claude Opus 4.6 sur 12 des 19 principaux benchmarks.