Technical Reports

TensorRT Edge-LLM Accelerates MLPerf Agentic Benchmark

NVIDIA tests TensorRT Edge-LLM with Qwen3.6-27B on Jetson AGX Thor, achieving a 6.4x speedup over llama.cpp in MLPerf ...