Метрики AI

Microsoft продвигает новую модель ИИ для безопасности, которая, как сообщается, опередила Mythos в бенчмарке, но ключевые детали по-прежнему скудны

Microsoft продвигает новую модель ИИ для безопасности, которая, как сообщается, опередила Mythos в бенчмарке, но ключевые детали по-прежнему скудны

Microsoft заявляет, что новая модель ИИ для безопасности превзошла Mythos в бенчмарке, что сигнализирует о выходе в специализированный кибер-ИИ, тогда как покупатели требуют доказательств, а не шума.

Британский AI Security Institute заявляет, что общие бенчмарки не показывают, на что способны AI agents, когда им дают больше вычислений

Британский AI Security Institute заявляет, что общие бенчмарки не показывают, на что способны AI agents, когда им дают больше вычислений

UK AI Security Institute утверждает, что стандартные бенчмарки занижают возможности AI agents, ограничивая compute, что повышает ставки для тестов безопасности и закупочных решений.

MIT Technology Review объясняет самый неправильно понятый график в ИИ: график временного горизонта METR

MIT Technology Review объясняет самый неправильно понятый график в ИИ: график временного горизонта METR

MIT Technology Review публикует подробный анализ спорного графика временного горизонта METR, который был широко неверно истолкован как оптимистами, так и пессимистами в отношении ИИ. График, показывающий, как с течением времени улучшается способность моделей ИИ выполнять задачи, заставил некоторых поверить, что утопия или апокалипсис ИИ неизбежны. В статье разъясняется истинное значение данных и рассматриваются распространённые заблуждения относительно измерений возможностей ИИ и траекторий прогресса.

Рекомендуемые

Метрики AI

Последние Новости и Анализ по Теме Метрики AI