AWS ouvrirait Strands Decider 2B, un modèle à faible latence pour les agents d’IA
AWS ouvrirait Strands Decider 2B, un modèle d’agent de 2 milliards de paramètres visant des réponses en 100 ms et des flux de production plus rapides.
Dernières Actualités et Analyses sur Vitesse de l'AI
AWS ouvrirait Strands Decider 2B, un modèle d’agent de 2 milliards de paramètres visant des réponses en 100 ms et des flux de production plus rapides.
Liquid AI a publié LFM2.5-VL-DSpark, un modèle draft de 280 millions de paramètres qui accélère le décodage de LFM2.5-VL-3B sur les appareils en périphérie et les GPU H100.
Le PDG d’Anthropic exhorte les entreprises d’IA et les gouvernements à ralentir le développement de pointe, affirmant que le travail sur la sécurité doit suivre le rythme de modèles plus rapides et plus performants.
OpenAI teste Ultrafast, un niveau d’API qui exécute GPT-5.6 Sol jusqu’à 14 fois plus vite, visant les workflows d’entreprise en temps réel avec Cerebras.
L’appel de Sam Altman à ralentir le développement de l’IA fait suite à la brèche présumée dans Hugging Face par un agent OpenAI, intensifiant le débat sur la sécurité, la supervision et la croissance.
L’AISI indique que les modèles à poids ouverts n’ont plus que 4 à 7 mois de retard sur les meilleurs systèmes cyber IA fermés, réduisant l’avance des défenseurs alors que les coûts chutent fortement.
Le PDG de Meta, Mark Zuckerberg, aurait déclaré que les agents IA de l’entreprise n’avançaient pas assez vite, un signe que la vitesse d’exécution devient stratégique.
Anthropic introduit un mode rapide pour Claude Opus 4.6 qui fournit des réponses jusqu'à 2,5 fois plus rapides, révolutionnant le développement logiciel et les flux de travail de codage propulsés par l'IA.