Производительность AI

Последние Новости и Анализ по Теме Производительность AI

Производительность AI

Anthropic запускает Opus 5.5 с более низкими ценами и заявленной производительностью уровня Fable

Anthropic запускает Opus 5.5 с более низкими ценами и заявленной производительностью уровня Fable

Anthropic выпустила Opus 5.5 с более низкими ценами на токены, более быстрым выводом и заявленными результатами уровня Fable, подняв планку для эффективного корпоративного ИИ.

Muse Spark 1.3 от Meta сокращает разрыв в производительности, одновременно атакуя конкурентов ценой

Muse Spark 1.3 от Meta сокращает разрыв в производительности, одновременно атакуя конкурентов ценой

Muse Spark 1.3 от Meta улучшает показатели в агентных задачах и программировании, но низкая стоимость за задачу может оказаться важнее, чем его все еще незавершенный вызов на переднем крае.

OpenAI сообщает о значительном приросте скорости и энергопотребления своего инференс-чипа Jalapeño

OpenAI сообщает о значительном приросте скорости и энергопотребления своего инференс-чипа Jalapeño

OpenAI утверждает, что чип Jalapeño повышает скорость инференса ИИ и энергоэффективность across models, но результаты пока исходят от самого вендора и предшествуют внедрению.

Чип Jalapeño от OpenAI показывает сильные результаты в инференсе, но до внедрения ещё годы

Чип Jalapeño от OpenAI показывает сильные результаты в инференсе, но до внедрения ещё годы

OpenAI представила бенчмарки инференса Jalapeño, которые обгоняют системы Nvidia по скорости и эффективности, но ограниченное развёртывание и данные, предоставленные поставщиком, смягчают это утверждение.

NVIDIA представила SkillEvaluator для измерения того, улучшают ли навыки агентов производительность

NVIDIA представила SkillEvaluator для измерения того, улучшают ли навыки агентов производительность

NVIDIA выпустила SkillEvaluator — open-source фреймворк, который проверяет, улучшают ли навыки агентов результаты задач, безопасность и эффективность в реальных запусках.

Оксфорд публикует живой бенчмарк риска информационных операций в ИИ, но ранний сигнал — это скорее прозрачность, чем рейтинг

Оксфорд публикует живой бенчмарк риска информационных операций в ИИ, но ранний сигнал — это скорее прозрачность, чем рейтинг

Оксфорд опубликовал живой бенчмарк риска информационных операций в ИИ, предоставив разработчикам и покупателям моделей новый сигнал безопасности, который можно отслеживать со временем.

OpenAI заявляет, что две настройки API резко улучшили GPT-5.6 на ARC-AGI-3, подчеркивая, как управление инференсом может менять результаты модели

OpenAI заявляет, что две настройки API резко улучшили GPT-5.6 на ARC-AGI-3, подчеркивая, как управление инференсом может менять результаты модели

OpenAI утверждает, что две настройки API утроили показатели GPT-5.6 на ARC-AGI-3, подчеркивая, как конфигурация инференса может перестраивать производительность модели.

Немецкий консорциум представил Soofi S — открытую 30B-модель, ориентированную на эффективность длинного контекста и более сильную работу на немецком языке

Немецкий консорциум представил Soofi S — открытую 30B-модель, ориентированную на эффективность длинного контекста и более сильную работу на немецком языке

Открытая модель Soofi S из Германии заявляет о лидерстве среди полностью открытых англоязычных и немецкоязычных бенчмарков, а её создатели также раскрыли и исправили утечку тестовых данных.

NVIDIA и LangChain продвигают Nemotron 3 Ultra с настроенным agent harness, отстаивая open-stack для корпоративных агентов

NVIDIA и LangChain продвигают Nemotron 3 Ultra с настроенным agent harness, отстаивая open-stack для корпоративных агентов

NVIDIA заявляет, что настроенный LangChain Nemotron 3 Ultra показал лучшие результаты в бенчмарке агентов среди открытых моделей, подчеркивая более дешевые корпоративные ИИ-стэки.

Реклама