AWS compara las GPU Blackwell G7 con G5 y G6 para la inferencia de pequeños LLM
AWS compara modelos MoE de 30B en SageMaker AI entre G5, G6, G6e y G7, mostrando cómo Blackwell podría mejorar el coste y la latencia de inferencia.
Últimas Noticias y Análisis sobre benchmarks de LLM
AWS compara modelos MoE de 30B en SageMaker AI entre G5, G6, G6e y G7, mostrando cómo Blackwell podría mejorar el coste y la latencia de inferencia.
Dos informes hacen afirmaciones contradictorias sobre GLM-5.2 y Qwen3.8-Max, destacando cómo una evidencia de benchmark muy escasa puede distorsionar comparaciones con ChatGPT y Claude.
Databricks hará de GLM 5.2 su modelo de programación predeterminado después de que pruebas internas encontraran un rendimiento similar al de Opus con menor costo por tarea en trabajo real sobre bases de código.
Google ha presentado Gemini 3.1 Pro, su último modelo de IA con el doble de rendimiento en razonamiento abstracto en ARC-AGI-2, superando a los rivales GPT-5.2 y Claude Opus 4.6 en 12 de 19 benchmarks principales.