AWS сравнивает Blackwell GPU G7 с G5 и G6 для инференса небольших LLM
AWS проводит бенчмарк 30B MoE-моделей на SageMaker AI между G5, G6, G6e и G7, показывая, как Blackwell может улучшить стоимость и задержку инференса.
Последние Новости и Анализ по Теме бенчмарки LLM
AWS проводит бенчмарк 30B MoE-моделей на SageMaker AI между G5, G6, G6e и G7, показывая, как Blackwell может улучшить стоимость и задержку инференса.
Два сообщения выдвигают противоречивые утверждения о GLM-5.2 и Qwen3.8-Max, показывая, как скудные данные бенчмарков могут искажать сравнения с ChatGPT и Claude.
Databricks сделает GLM 5.2 своей моделью кодирования по умолчанию после того, как внутренние тесты показали производительность уровня Opus при более низкой стоимости за задачу на реальной работе с кодовой базой.
Google представила Gemini 3.1 Pro — свою новейшую модель ИИ, демонстрирующую двукратное улучшение абстрактного рассуждения на ARC-AGI-2 и превосходящую конкурентов GPT-5.2 и Claude Opus 4.6 по 12 из 19 основных бенчмарков.