бенчмарки LLM

Databricks выбирает GLM 5.2 в качестве модели кодирования по умолчанию после внутренних тестов, показавших результаты уровня Opus при более низкой стоимости задачи

Databricks выбирает GLM 5.2 в качестве модели кодирования по умолчанию после внутренних тестов, показавших результаты уровня Opus при более низкой стоимости задачи

Databricks сделает GLM 5.2 своей моделью кодирования по умолчанию после того, как внутренние тесты показали производительность уровня Opus при более низкой стоимости за задачу на реальной работе с кодовой базой.

Google выпустила Gemini 3.1 Pro, превосходя GPT-5.2 и Claude Opus 4.6 в ключевых бенчмарках

Google выпустила Gemini 3.1 Pro, превосходя GPT-5.2 и Claude Opus 4.6 в ключевых бенчмарках

Google представила Gemini 3.1 Pro — свою новейшую модель ИИ, демонстрирующую двукратное улучшение абстрактного рассуждения на ARC-AGI-2 и превосходящую конкурентов GPT-5.2 и Claude Opus 4.6 по 12 из 19 основных бенчмарков.

Рекомендуемые

бенчмарки LLM

Последние Новости и Анализ по Теме бенчмарки LLM