TensorRT Edge-LLM termine le benchmark agentique MLPerf Edge 6,4 fois plus vite sur Jetson AGX Thor
NVIDIA affirme que TensorRT Edge-LLM a exécuté Qwen3.6-27B 6,4 fois plus vite sur Jetson AGX Thor, mettant en avant les gains liés au cache et à la quantification pour les agents en périphérie.
