AWS compara GPUs G7 Blackwell com G5 e G6 para inferência de pequenos LLMs
AWS faz benchmarks de modelos MoE de 30B no SageMaker AI entre G5, G6, G6e e G7, mostrando como o Blackwell pode melhorar custo e latência de inferência.
Últimas Notícias e Análises sobre benchmarks de LLM
AWS faz benchmarks de modelos MoE de 30B no SageMaker AI entre G5, G6, G6e e G7, mostrando como o Blackwell pode melhorar custo e latência de inferência.
Dois relatórios fazem alegações conflitantes sobre GLM-5.2 e Qwen3.8-Max, destacando como evidências de benchmark muito frágeis podem distorcer comparações com ChatGPT e Claude.
A Databricks vai tornar o GLM 5.2 seu modelo padrão de programação após testes internos encontrarem desempenho semelhante ao do Opus com menor custo por tarefa em trabalho real em bases de código.
O Google revelou o Gemini 3.1 Pro, seu mais recente modelo de IA, com desempenho em raciocínio abstrato dobrado no ARC-AGI-2, superando os rivais GPT-5.2 e Claude Opus 4.6 em 12 dos 19 principais benchmarks.