@@ -474,9 +474,7 @@ def run_tensorrt(
474474 # Get I/O tensor information using TensorRT 10 API
475475 input_names = []
476476 output_names = []
477- input_dtypes = []
478477 output_dtypes = []
479- input_shapes = []
480478 output_shapes = []
481479
482480 for i in range (engine .num_io_tensors ):
@@ -487,8 +485,6 @@ def run_tensorrt(
487485
488486 if tensor_mode == trt .TensorIOMode .INPUT :
489487 input_names .append (tensor_name )
490- input_dtypes .append (torch_dtype_from_trt (tensor_dtype ))
491- input_shapes .append (tuple (tensor_shape ))
492488 else : # trt.TensorIOMode.OUTPUT
493489 output_names .append (tensor_name )
494490 output_dtypes .append (torch_dtype_from_trt (tensor_dtype ))
@@ -514,6 +510,8 @@ def run_tensorrt(
514510 dedicated_stream = torch .cuda .Stream ()
515511 current_stream = torch .cuda .current_stream ()
516512
513+ setup_time = timeit .default_timer ()
514+
517515 # Warm up
518516 for i in range (WARMUP_ITER ):
519517 # Wait for current stream to finish
@@ -523,6 +521,7 @@ def run_tensorrt(
523521 current_stream .wait_stream (dedicated_stream )
524522 torch .cuda .synchronize ()
525523
524+ infer_start_time = timeit .default_timer ()
526525 # Performance measurement
527526 for i in range (iters ):
528527 # Wait for current stream to finish
@@ -531,9 +530,12 @@ def run_tensorrt(
531530 # Wait for TensorRT stream to finish
532531 current_stream .wait_stream (dedicated_stream )
533532 torch .cuda .synchronize ()
534- end_time = timeit .default_timer ()
535- infer_time = end_time - start_time
536- timings .append (infer_time )
533+
534+ end_time = timeit .default_timer ()
535+
536+ # to compare against torch-trt dynamo apples to apples
537+ infer_time = (end_time - infer_start_time + setup_time - start_time ) / iters
538+ timings .append (infer_time )
537539
538540 recordStats ("TensorRT" , timings , precision , batch_size , compile_time_s )
539541
0 commit comments