ИИ-инференс

Последние Новости и Анализ по Теме ИИ-инференс

ИИ-инференс

Сообщается, что AutoModelRouter KT занял второе место в глобальном бенчмарке по маршрутизации ИИ

Сообщается, что AutoModelRouter KT занял второе место в глобальном бенчмарке по маршрутизации ИИ

Сообщается, что AutoModelRouter KT занял второе место в глобальном бенчмарке, выводя эффективность выбора модели в центр корпоративного внедрения ИИ.

AWS нацелен на задержки SageMaker Inference с помощью кэширования моделей HyperPod и маршрутизации по префиксу

AWS нацелен на задержки SageMaker Inference с помощью кэширования моделей HyperPod и маршрутизации по префиксу

AWS добавляет кэширование моделей в SageMaker HyperPod и маршрутизацию с учетом префикса в SageMaker Inference, нацеленную на более быстрое масштабирование и меньшую задержку LLM.

Nvidia, по сообщениям, изучает возможную сделку с корейским стартапом по AI-чипам Rebellions

Nvidia, по сообщениям, изучает возможную сделку с корейским стартапом по AI-чипам Rebellions

По сообщениям, Nvidia обсуждает потенциальную сделку с корейским стартапом по AI-чипам Rebellions, что указывает на более широкий интерес к альтернативам для AI-инференса и задач дата-центров.

Сообщается, что AMD добавляет кремний для AI-инференса через приобретение Taalas

Сообщается, что AMD добавляет кремний для AI-инференса через приобретение Taalas

Сообщается, что AMD приобретает Taalas, чтобы добавить специализированный кремний для AI-инференса, потенциально расширяя свою стратегию ускорителей за пределы рабочих нагрузок обучения.

Платформа Nvidia Vera Rubin нацелена на рынок ИИ-инференса объемом 1 триллион долларов

Платформа Nvidia Vera Rubin нацелена на рынок ИИ-инференса объемом 1 триллион долларов

Аналитики Bernstein прогнозируют, что грядущая платформа Vera Rubin от Nvidia может обеспечить в 5 раз более высокую производительность инференса, выводя компанию на переломный этап в ИИ.

NVIDIA GTC 2026: Дженсен Хуанг представил чип инференса Groq 3 LPX и стратегию полного стека ИИ

NVIDIA GTC 2026: Дженсен Хуанг представил чип инференса Groq 3 LPX и стратегию полного стека ИИ

На GTC 2026 генеральный директор NVIDIA Дженсен Хуанг представил выделенный инференс-рейк Groq 3 LPX, расширения платформы Vera Rubin, защитные механизмы для агентов ИИ NemoClaw и прогноз спроса на ИИ‑чипы в $1 трлн до 2027 года, что сигнализирует о стремлении NVIDIA владеть всей инфраструктурой для ИИ.

Стартап по выводам ИИ Modal Labs привлекает финансирование при оценке в $2,5 млрд, удвоившись за 5 месяцев

Стартап по выводам ИИ Modal Labs привлекает финансирование при оценке в $2,5 млрд, удвоившись за 5 месяцев

Modal Labs ведет переговоры с General Catalyst о новом раунде при оценке в $2,5 млрд, что отражает возросший интерес инвесторов к инфраструктуре вывода ИИ.

Новая арена ИИ: технологические прогнозы на 2026 год указывают на инференс и открытые системы

Новая арена ИИ: технологические прогнозы на 2026 год указывают на инференс и открытые системы

Технологические прогнозы на 2026 год указывают на значительный сдвиг от обучения моделей ИИ к инференсу как ключевому фактору. Это заставит компании принимать открытую инфраструктуру и единые плоскости управления, такие как Kubernetes, чтобы выиграть «войны инференса» и обеспечивать более быстрый локальный опыт работы с ИИ.

Реклама