TensorRT Edge-LLM、Jetson AGX Thor上でMLPerf Edge Agenticベンチマークを6.4倍高速で完了
NVIDIAは、TensorRT Edge-LLMがJetson AGX Thor上でQwen3.6-27Bを6.4倍高速で実行し、エッジエージェント向けのキャッシュと量子化の効果を示したと述べています。
LLM性能に関する最新ニュースと分析
NVIDIAは、TensorRT Edge-LLMがJetson AGX Thor上でQwen3.6-27Bを6.4倍高速で実行し、エッジエージェント向けのキャッシュと量子化の効果を示したと述べています。
NVIDIAがtri-mode拡散LLMの重みを公開したようで、高速推論への新たな関心を示しているが、公開された証拠はまだ限られている。
Claude Opus 4.6はTerminal-Benchで65.4%、OSWorldで72.7%の画期的な性能を達成し、実際の業務アプリケーションでGemini 3 Flashを上回っています。