-
Notifications
You must be signed in to change notification settings - Fork 2.6k
Expand file tree
/
Copy pathCODEOWNERS
More file actions
490 lines (463 loc) · 31.9 KB
/
Copy pathCODEOWNERS
File metadata and controls
490 lines (463 loc) · 31.9 KB
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
51
52
53
54
55
56
57
58
59
60
61
62
63
64
65
66
67
68
69
70
71
72
73
74
75
76
77
78
79
80
81
82
83
84
85
86
87
88
89
90
91
92
93
94
95
96
97
98
99
100
101
102
103
104
105
106
107
108
109
110
111
112
113
114
115
116
117
118
119
120
121
122
123
124
125
126
127
128
129
130
131
132
133
134
135
136
137
138
139
140
141
142
143
144
145
146
147
148
149
150
151
152
153
154
155
156
157
158
159
160
161
162
163
164
165
166
167
168
169
170
171
172
173
174
175
176
177
178
179
180
181
182
183
184
185
186
187
188
189
190
191
192
193
194
195
196
197
198
199
200
201
202
203
204
205
206
207
208
209
210
211
212
213
214
215
216
217
218
219
220
221
222
223
224
225
226
227
228
229
230
231
232
233
234
235
236
237
238
239
240
241
242
243
244
245
246
247
248
249
250
251
252
253
254
255
256
257
258
259
260
261
262
263
264
265
266
267
268
269
270
271
272
273
274
275
276
277
278
279
280
281
282
283
284
285
286
287
288
289
290
291
292
293
294
295
296
297
298
299
300
301
302
303
304
305
306
307
308
309
310
311
312
313
314
315
316
317
318
319
320
321
322
323
324
325
326
327
328
329
330
331
332
333
334
335
336
337
338
339
340
341
342
343
344
345
346
347
348
349
350
351
352
353
354
355
356
357
358
359
360
361
362
363
364
365
366
367
368
369
370
371
372
373
374
375
376
377
378
379
380
381
382
383
384
385
386
387
388
389
390
391
392
393
394
395
396
397
398
399
400
401
402
403
404
405
406
407
408
409
410
411
412
413
414
415
416
417
418
419
420
421
422
423
424
425
426
427
428
429
430
431
432
433
434
435
436
437
438
439
440
441
442
443
444
445
446
447
448
449
450
451
452
453
454
455
456
457
458
459
460
461
462
463
464
465
466
467
468
469
470
471
472
473
474
475
476
477
478
479
480
481
482
483
484
485
486
487
488
489
490
# ============================================================================
# PRECEDENCE: last matching pattern wins — fallback first, module rules next, governance last.
#
# Domain (in file order) Handle
# Engineering baseline/ fallback / untriaged @NVIDIA/trt-llm-devs (global `*`, declared FIRST; incl. deprecating TRT backend)
# Multi-GPU CI gate @NVIDIA/trt-llm-multi-gpu-ci-review
# Infra @NVIDIA/trt-llm-infra-devs
# Agent config @NVIDIA/trt-llm-agent-devs
# Docs / Examples @NVIDIA/trt-llm-doc-owners
# QA @NVIDIA/trt-llm-qa
# Runtime @NVIDIA/trt-llm-runtime-devs
# Kernels - Misc @NVIDIA/trt-llm-kernels-devs
# Models @NVIDIA/trt-llm-models-devs
# General Perf @NVIDIA/trt-llm-perf-devs
# KV Cache Manager @NVIDIA/trt-llm-kv-cache-manager-devs
# Disaggregated Serving @NVIDIA/trt-llm-disagg-devs
# Attention @NVIDIA/trt-llm-torch-attention-devs
# MoE @NVIDIA/trt-llm-moe-devs
# VisualGen (AIGV) @NVIDIA/trt-llm-torch-visual-gen-devs
# Scaffolding @WeiHaocheng
# Self-managed: AutoDeploy, Triton backend, Dynamo. Governance/legal: unchanged.
#
# New handles (trt-llm-devs / doc / agent / runtime / models / perf / moe / kernels / multi-gpu-ci-review)
# must be created & populated before activation (unknown owner blocks merge).
# ============================================================================
# ===== FALLBACK (trt-llm-devs) =====
# Global net; every rule below overrides it. The explicit entries are visible parking (redundant with `*`).
* @NVIDIA/trt-llm-devs
/tensorrt_llm/commands/eval.py @NVIDIA/trt-llm-devs
/tensorrt_llm/evaluate @NVIDIA/trt-llm-devs
/tensorrt_llm/tools @NVIDIA/trt-llm-devs
/tests/integration/test_lists/test-db @NVIDIA/trt-llm-devs @NVIDIA/trt-llm-qa @NVIDIA/trt-llm-infra-devs
/tests/integration/test_lists/waives.txt @NVIDIA/trt-llm-devs @NVIDIA/trt-llm-qa @NVIDIA/trt-llm-infra-devs
/tests/test_common @NVIDIA/trt-llm-devs
/tests/unittest @NVIDIA/trt-llm-devs
# ===== TensorRT backend (will be deprecated soon) — also on the trt-llm-devs fallback =====
/tensorrt_llm/builder.py @NVIDIA/trt-llm-devs
/tensorrt_llm/commands/build.py @NVIDIA/trt-llm-devs
/tensorrt_llm/commands/prune.py @NVIDIA/trt-llm-devs
/tensorrt_llm/commands/refit.py @NVIDIA/trt-llm-devs
/tensorrt_llm/functional.py @NVIDIA/trt-llm-devs
/tensorrt_llm/graph_rewriting.py @NVIDIA/trt-llm-devs
/tensorrt_llm/layers @NVIDIA/trt-llm-devs
/tensorrt_llm/models @NVIDIA/trt-llm-devs
/tensorrt_llm/module.py @NVIDIA/trt-llm-devs
/tensorrt_llm/network.py @NVIDIA/trt-llm-devs
/tensorrt_llm/parameter.py @NVIDIA/trt-llm-devs
/tensorrt_llm/plugin @NVIDIA/trt-llm-devs
/tensorrt_llm/python_plugin.py @NVIDIA/trt-llm-devs
/tensorrt_llm/runtime @NVIDIA/trt-llm-devs
/tensorrt_llm/tools/plugin_gen @NVIDIA/trt-llm-devs
/tensorrt_llm/top_model_mixin.py @NVIDIA/trt-llm-devs
# ===== MULTI-GPU / MULTI-NODE CI TEST-LIST GATE (review group, NEW) =====
# A PR adding/expanding these expensive cases must justify WHAT is tested, WHY existing coverage is
# insufficient, and WHY a unit / single-GPU test can't do it. (Handle is a placeholder.)
/tests/integration/test_lists/test-db/*multi_gpu* @NVIDIA/trt-llm-multi-gpu-ci-review
/tests/integration/test_lists/test-db/*multi_node* @NVIDIA/trt-llm-multi-gpu-ci-review
/tests/integration/test_lists/test-db/l0_dgx_* @NVIDIA/trt-llm-multi-gpu-ci-review
# ===== INFRA =====
/.coderabbit.yaml @NVIDIA/trt-llm-infra-devs
/.github @NVIDIA/trt-llm-infra-devs
/.pre-commit-config.yaml @NVIDIA/trt-llm-infra-devs
/docker @NVIDIA/trt-llm-infra-devs
/enroot @NVIDIA/trt-llm-infra-devs
/jenkins @NVIDIA/trt-llm-infra-devs
/ruff-legacy-baseline.json @NVIDIA/trt-llm-infra-devs
/ruff-legacy.toml @NVIDIA/trt-llm-infra-devs
/scripts @NVIDIA/trt-llm-infra-devs
/security_scanning @NVIDIA/trt-llm-infra-devs
# ===== AGENT =====
/.claude @NVIDIA/trt-llm-agent-devs
/.codex @NVIDIA/trt-llm-agent-devs
/AGENTS.md @NVIDIA/trt-llm-agent-devs
/CLAUDE.md @NVIDIA/trt-llm-agent-devs
/scripts/check_skill_naming_convention.py @NVIDIA/trt-llm-agent-devs
# ===== DOCS / EXAMPLES =====
/CODE_OF_CONDUCT.md @NVIDIA/trt-llm-doc-owners
/CODING_GUIDELINES.md @NVIDIA/trt-llm-doc-owners
/CONTAINER_SOURCE.md @NVIDIA/trt-llm-doc-owners
/CONTRIBUTING.md @NVIDIA/trt-llm-doc-owners
/README.md @NVIDIA/trt-llm-doc-owners
/SECURITY.md @NVIDIA/trt-llm-doc-owners
/docs @NVIDIA/trt-llm-doc-owners
/examples @NVIDIA/trt-llm-doc-owners
# ===== QA =====
/tests/integration/defs @NVIDIA/trt-llm-devs @NVIDIA/trt-llm-qa @NVIDIA/trt-llm-infra-devs
/tests/integration/test_lists/qa @NVIDIA/trt-llm-qa
# ===== RUNTIME =====
/cpp/include/tensorrt_llm/batch_manager @NVIDIA/trt-llm-runtime-devs
/cpp/include/tensorrt_llm/common @NVIDIA/trt-llm-runtime-devs
/cpp/include/tensorrt_llm/executor @NVIDIA/trt-llm-runtime-devs
/cpp/include/tensorrt_llm/layers @NVIDIA/trt-llm-runtime-devs
/cpp/include/tensorrt_llm/runtime @NVIDIA/trt-llm-runtime-devs
/cpp/tensorrt_llm/batch_manager @NVIDIA/trt-llm-runtime-devs
/cpp/tensorrt_llm/common @NVIDIA/trt-llm-runtime-devs
/cpp/tensorrt_llm/executor @NVIDIA/trt-llm-runtime-devs
/cpp/tensorrt_llm/layers @NVIDIA/trt-llm-runtime-devs
/cpp/tensorrt_llm/nanobind @NVIDIA/trt-llm-runtime-devs
/cpp/tensorrt_llm/runtime @NVIDIA/trt-llm-runtime-devs
/cpp/tensorrt_llm/testing @NVIDIA/trt-llm-runtime-devs
/cpp/tests @NVIDIA/trt-llm-runtime-devs
/tensorrt_llm/_tensorrt_engine @NVIDIA/trt-llm-runtime-devs
/tensorrt_llm/_torch @NVIDIA/trt-llm-runtime-devs
/tensorrt_llm/commands/__init__.py @NVIDIA/trt-llm-runtime-devs
/tensorrt_llm/commands/serve.py @NVIDIA/trt-llm-runtime-devs
/tensorrt_llm/commands/utils.py @NVIDIA/trt-llm-runtime-devs
/tensorrt_llm/executor @NVIDIA/trt-llm-runtime-devs
/tensorrt_llm/grpc @NVIDIA/trt-llm-runtime-devs
/tensorrt_llm/inputs @NVIDIA/trt-llm-runtime-devs
/tensorrt_llm/llmapi @NVIDIA/trt-llm-runtime-devs
/tensorrt_llm/llmapi/mm_encoder.py @NVIDIA/trt-llm-runtime-devs @NVIDIA/trt-llm-models-devs
/tensorrt_llm/lora_helper.py @NVIDIA/trt-llm-runtime-devs
/tensorrt_llm/lora_manager.py @NVIDIA/trt-llm-runtime-devs
/tensorrt_llm/mapping.py @NVIDIA/trt-llm-runtime-devs
/tensorrt_llm/metrics @NVIDIA/trt-llm-runtime-devs
/tensorrt_llm/prompt_adapter_manager.py @NVIDIA/trt-llm-runtime-devs
/tensorrt_llm/sampling_params.py @NVIDIA/trt-llm-runtime-devs
/tensorrt_llm/scheduling_params.py @NVIDIA/trt-llm-runtime-devs
/tensorrt_llm/serve @NVIDIA/trt-llm-runtime-devs
/tensorrt_llm/tokenizer @NVIDIA/trt-llm-runtime-devs
/tensorrt_llm/usage @NVIDIA/trt-llm-runtime-devs
/tests/torch @NVIDIA/trt-llm-runtime-devs
/tests/unittest/_torch/compilation @NVIDIA/trt-llm-runtime-devs
/tests/unittest/_torch/custom_ops @NVIDIA/trt-llm-runtime-devs
/tests/unittest/_torch/distributed @NVIDIA/trt-llm-runtime-devs
/tests/unittest/_torch/executor @NVIDIA/trt-llm-runtime-devs
/tests/unittest/_torch/lora @NVIDIA/trt-llm-runtime-devs
/tests/unittest/_torch/misc/test_autotuner.py @NVIDIA/trt-llm-runtime-devs
/tests/unittest/_torch/modules @NVIDIA/trt-llm-runtime-devs
/tests/unittest/_torch/multi_gpu @NVIDIA/trt-llm-runtime-devs
/tests/unittest/_torch/pyexecutor @NVIDIA/trt-llm-runtime-devs
/tests/unittest/_torch/ray_orchestrator @NVIDIA/trt-llm-runtime-devs
/tests/unittest/_torch/sampler @NVIDIA/trt-llm-runtime-devs
/tests/unittest/_torch/speculative @NVIDIA/trt-llm-runtime-devs
/tests/unittest/_torch/speculative_hw_agnostic @NVIDIA/trt-llm-runtime-devs
/tests/unittest/executor @NVIDIA/trt-llm-runtime-devs
/tests/unittest/inputs @NVIDIA/trt-llm-runtime-devs
/tests/unittest/llmapi @NVIDIA/trt-llm-runtime-devs
/tests/unittest/llmapi/apps/*multimodal* @NVIDIA/trt-llm-runtime-devs @NVIDIA/trt-llm-models-devs
/tests/unittest/pyexecutor @NVIDIA/trt-llm-runtime-devs
# ===== KERNELS - MISC =====
/cpp/include/tensorrt_llm/deep_gemm @NVIDIA/trt-llm-kernels-devs
/cpp/include/tensorrt_llm/kernels @NVIDIA/trt-llm-kernels-devs
/cpp/tensorrt_llm/cutlass_extensions @NVIDIA/trt-llm-kernels-devs
/cpp/tensorrt_llm/deep_gemm @NVIDIA/trt-llm-kernels-devs
/cpp/tensorrt_llm/kernels @NVIDIA/trt-llm-kernels-devs
/cpp/tensorrt_llm/thop @NVIDIA/trt-llm-kernels-devs
/cpp/tests/unit_tests/kernels @NVIDIA/trt-llm-kernels-devs
/tensorrt_llm/_torch/cuda_tile_kernels @NVIDIA/trt-llm-kernels-devs
/tensorrt_llm/_torch/cute_dsl_kernels @NVIDIA/trt-llm-kernels-devs
/tests/scripts/cute_dsl_kernels @NVIDIA/trt-llm-kernels-devs
/tests/unittest/_torch/thop @NVIDIA/trt-llm-kernels-devs
# ===== MODELS =====
/docs/source/features/multi-modality.md @NVIDIA/trt-llm-models-devs @NVIDIA/trt-llm-doc-owners
/examples/llm-api/quickstart_multimodal.py @NVIDIA/trt-llm-models-devs @NVIDIA/trt-llm-doc-owners
/examples/models @NVIDIA/trt-llm-models-devs @NVIDIA/trt-llm-doc-owners
/examples/serve/*multimodal* @NVIDIA/trt-llm-models-devs @NVIDIA/trt-llm-doc-owners
/scripts/generate_config_database_tests.py @NVIDIA/trt-llm-models-devs @NVIDIA/trt-llm-doc-owners
/scripts/generate_config_table.py @NVIDIA/trt-llm-models-devs @NVIDIA/trt-llm-doc-owners
/tensorrt_llm/_torch/models @NVIDIA/trt-llm-models-devs
/tensorrt_llm/_torch/modules/mamba @NVIDIA/trt-llm-models-devs
/tensorrt_llm/quantization @NVIDIA/trt-llm-models-devs
/tests/integration/defs/accuracy/test_llm_api_pytorch_multimodal.py @NVIDIA/trt-llm-models-devs @NVIDIA/trt-llm-qa
/tests/unittest/_torch/modeling @NVIDIA/trt-llm-models-devs
/tests/unittest/_torch/models @NVIDIA/trt-llm-models-devs
/tests/unittest/_torch/modules/mamba @NVIDIA/trt-llm-models-devs
/tests/unittest/_torch/multi_gpu_modeling @NVIDIA/trt-llm-models-devs
/tests/unittest/_torch/multimodal @NVIDIA/trt-llm-models-devs
/tests/unittest/models @NVIDIA/trt-llm-models-devs
/tests/unittest/others/test_multimodal_registry.py @NVIDIA/trt-llm-models-devs
# ===== GENERAL PERF =====
/benchmarks @NVIDIA/trt-llm-perf-devs
/cpp/micro_benchmarks @NVIDIA/trt-llm-perf-devs
/docs/source/performance/perf-benchmarking.md @NVIDIA/trt-llm-perf-devs
/scripts/check_pinned_memory_usage.py @NVIDIA/trt-llm-perf-devs
/tensorrt_llm/bench @NVIDIA/trt-llm-perf-devs
/tensorrt_llm/commands/bench.py @NVIDIA/trt-llm-perf-devs
/tensorrt_llm/tools/layer_wise_benchmarks @NVIDIA/trt-llm-perf-devs
/tensorrt_llm/tools/profiler @NVIDIA/trt-llm-perf-devs
/tests/microbenchmarks @NVIDIA/trt-llm-perf-devs
/tests/scripts/allreduce_perf @NVIDIA/trt-llm-perf-devs
/tests/scripts/iteration_log_parser.py @NVIDIA/trt-llm-perf-devs
/tests/scripts/perf @NVIDIA/trt-llm-perf-devs
/tests/scripts/perf-sanity @NVIDIA/trt-llm-perf-devs
# ===== KV CACHE MANAGER =====
/cpp/include/tensorrt_llm/batch_manager/allocateKvCache* @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/include/tensorrt_llm/batch_manager/blockKey* @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/include/tensorrt_llm/batch_manager/evictionPolicy* @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/include/tensorrt_llm/batch_manager/kvCache* @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/include/tensorrt_llm/batch_manager/radixBlockTree* @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/include/tensorrt_llm/batch_manager/reorderPolicy* @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/include/tensorrt_llm/batch_manager/stringSetTrie* @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/include/tensorrt_llm/batch_manager/templatedTrie* @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/tensorrt_llm/batch_manager/allocateKvCache* @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/tensorrt_llm/batch_manager/blockKey* @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/tensorrt_llm/batch_manager/evictionPolicy* @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/tensorrt_llm/batch_manager/kvCache* @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/tensorrt_llm/nanobind/batch_manager/kvCacheManager* @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/tests/unit_tests/batch_manager/blockKey* @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/tests/unit_tests/batch_manager/evictionPolicy* @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/tests/unit_tests/batch_manager/kvCache* @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/tests/unit_tests/batch_manager/radixBlockTree* @NVIDIA/trt-llm-kv-cache-manager-devs
/tensorrt_llm/_torch/pyexecutor/kv_cache_manager_v2.py @NVIDIA/trt-llm-kv-cache-manager-devs
/tensorrt_llm/_torch/pyexecutor/mamba_cache_manager.py @NVIDIA/trt-llm-kv-cache-manager-devs
/tensorrt_llm/_torch/pyexecutor/resource_manager.py @NVIDIA/trt-llm-kv-cache-manager-devs
/tensorrt_llm/runtime/kv_cache_manager_v2 @NVIDIA/trt-llm-kv-cache-manager-devs
/tests/unittest/_torch/executor/test_dual_pool_kv_cache.py @NVIDIA/trt-llm-kv-cache-manager-devs
/tests/unittest/_torch/executor/test_kv_cache* @NVIDIA/trt-llm-kv-cache-manager-devs
/tests/unittest/_torch/executor/test_kv_pool_rebalance.py @NVIDIA/trt-llm-kv-cache-manager-devs
/tests/unittest/_torch/executor/test_kvcache_aware_router.py @NVIDIA/trt-llm-kv-cache-manager-devs
/tests/unittest/_torch/executor/test_mamba_cache_manager.py @NVIDIA/trt-llm-kv-cache-manager-devs
/tests/unittest/kv_cache_manager_v2_tests @NVIDIA/trt-llm-kv-cache-manager-devs
# ===== DISAGGREGATED SERVING =====
/cpp/include/tensorrt_llm/batch_manager/*Formatter* @NVIDIA/trt-llm-disagg-devs
/cpp/include/tensorrt_llm/batch_manager/*TransBuffer* @NVIDIA/trt-llm-disagg-devs
/cpp/include/tensorrt_llm/batch_manager/*Transceiver* @NVIDIA/trt-llm-disagg-devs
/cpp/include/tensorrt_llm/batch_manager/cacheTransferLayer* @NVIDIA/trt-llm-disagg-devs
/cpp/include/tensorrt_llm/batch_manager/disagg* @NVIDIA/trt-llm-disagg-devs
/cpp/tensorrt_llm/batch_manager/*Formatter* @NVIDIA/trt-llm-disagg-devs
/cpp/tensorrt_llm/batch_manager/*TransBuffer* @NVIDIA/trt-llm-disagg-devs
/cpp/tensorrt_llm/batch_manager/*Transceiver* @NVIDIA/trt-llm-disagg-devs
/cpp/tensorrt_llm/batch_manager/cacheTransferLayer* @NVIDIA/trt-llm-disagg-devs
/cpp/tensorrt_llm/batch_manager/disagg* @NVIDIA/trt-llm-disagg-devs
/examples/disaggregated @NVIDIA/trt-llm-disagg-devs @NVIDIA/trt-llm-doc-owners
/examples/disaggregated/slurm/benchmark @NVIDIA/trt-llm-disagg-devs @NVIDIA/trt-llm-perf-devs
/tensorrt_llm/_torch/disaggregation @NVIDIA/trt-llm-disagg-devs
/tensorrt_llm/_torch/pyexecutor/kv_cache_transceiver.py @NVIDIA/trt-llm-disagg-devs
/tensorrt_llm/disaggregated_params.py @NVIDIA/trt-llm-disagg-devs
/tensorrt_llm/serve/openai_disagg_server.py @NVIDIA/trt-llm-disagg-devs
# Disagg tests: co-own with the owning team so disagg-devs review disagg-test changes.
/tests/integration/defs/accuracy/*disagg* @NVIDIA/trt-llm-disagg-devs @NVIDIA/trt-llm-qa
/tests/integration/defs/disaggregated @NVIDIA/trt-llm-disagg-devs @NVIDIA/trt-llm-qa
/tests/integration/defs/stress_test/disagg_cancel @NVIDIA/trt-llm-disagg-devs @NVIDIA/trt-llm-qa
/tests/scripts/perf-sanity/disaggregated @NVIDIA/trt-llm-perf-devs @NVIDIA/trt-llm-disagg-devs
/tests/scripts/perf/disaggregated @NVIDIA/trt-llm-perf-devs @NVIDIA/trt-llm-disagg-devs
/tests/unittest/_torch/executor/*disagg* @NVIDIA/trt-llm-runtime-devs @NVIDIA/trt-llm-disagg-devs
/tests/unittest/_torch/multimodal/*disagg* @NVIDIA/trt-llm-models-devs @NVIDIA/trt-llm-disagg-devs
/tests/unittest/disaggregated @NVIDIA/trt-llm-disagg-devs
/tests/unittest/llmapi/*disagg* @NVIDIA/trt-llm-runtime-devs @NVIDIA/trt-llm-disagg-devs
/tests/unittest/llmapi/apps/*disagg* @NVIDIA/trt-llm-runtime-devs @NVIDIA/trt-llm-disagg-devs
# ===== ATTENTION =====
# Where a kernel is both a dir and sibling .cu/.h, keep the bare dir (subtree) AND a trailing-* (siblings).
/cpp/kernels @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/common/attention* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/flash_mla @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/IndexerKCache* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/IndexerTopK* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/attentionMask* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/buildRelativeAttentionBiasKernel* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/compressorKernels @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/contextFusedMultiHeadAttention @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/convertReqIndexToGlobal* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/decoderMaskedMultiheadAttention @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/decoderMaskedMultiheadAttention* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/deepseekV4QNormKernel* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/flashMLA @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/fmhaDispatcher* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/fusedCatFp4* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/fusedCatFp8* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/fusedQKNormRopeKernel* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/gptKernels* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/helix* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/indexerKCache* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/indexerTopK* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/inverseRopeFp8QuantKernel* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/mla* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/multiHeadAttentionCommon.h @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/sparseAttentionKernels* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/trtllmGenKernels/fmha @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/unfusedAttentionKernels @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/unfusedAttentionKernels* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/kernels/xqaDispatcher* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/nanobind/thop @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/thop/IndexerKCache* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/thop/IndexerTopK* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/thop/attention* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/thop/compressorOp.cpp @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/thop/convertReqIndexToGlobalOp.cpp @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/thop/deepseekV4QNormOp.cpp @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/thop/dsv3RopeOp.cpp @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/thop/fmhaPackMaskOp.cpp @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/thop/fusedCatFp4Op.cpp @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/thop/fusedCatFp8Op.cpp @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/thop/fusedQKNormRopeOp.cpp @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/thop/helixPostProcessOp.cpp @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/thop/inverseRopeFp8QuantOp.cpp @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/thop/mla* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/thop/relativeAttentionBiasOp.cpp @NVIDIA/trt-llm-torch-attention-devs
/cpp/tensorrt_llm/thop/trtllmGenQKVProcessOp.cpp @NVIDIA/trt-llm-torch-attention-devs
/cpp/tests/unit_tests/common/attentionWorkspaceTest.cpp @NVIDIA/trt-llm-torch-attention-devs
/cpp/tests/unit_tests/kernels/cascadeAttention* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tests/unit_tests/kernels/mla* @NVIDIA/trt-llm-torch-attention-devs
/cpp/tests/unit_tests/kernels/ropeTest.cu @NVIDIA/trt-llm-torch-attention-devs
/cpp/tests/unit_tests/kernels/sparseAttentionKernelsTest.cpp @NVIDIA/trt-llm-torch-attention-devs
/tensorrt_llm/_torch/attention_backend @NVIDIA/trt-llm-torch-attention-devs
/tensorrt_llm/_torch/cute_dsl_kernels/blackwell/paged_mqa_logits @NVIDIA/trt-llm-torch-attention-devs
/tensorrt_llm/_torch/modules/ATTENTION_DEVELOPER_GUIDE.md @NVIDIA/trt-llm-torch-attention-devs
/tensorrt_llm/_torch/modules/attention.py @NVIDIA/trt-llm-torch-attention-devs
/tensorrt_llm/_torch/modules/cross_attention.py @NVIDIA/trt-llm-torch-attention-devs
/tensorrt_llm/_torch/modules/mla.py @NVIDIA/trt-llm-torch-attention-devs
/tensorrt_llm/_torch/modules/qk_norm_attention.py @NVIDIA/trt-llm-torch-attention-devs
/tensorrt_llm/_torch/modules/rotary_embedding.py @NVIDIA/trt-llm-torch-attention-devs
/tests/scripts/cute_dsl_kernels/paged_mqa_logits @NVIDIA/trt-llm-torch-attention-devs
/tests/unittest/_torch/attention @NVIDIA/trt-llm-torch-attention-devs
/tests/unittest/_torch/custom_ops/test_deepseek_v4_q_norm.py @NVIDIA/trt-llm-torch-attention-devs
/tests/unittest/_torch/custom_ops/test_fused_inv_rope_fp8_quant.py @NVIDIA/trt-llm-torch-attention-devs
/tests/unittest/_torch/modules/helix_test_utils.py @NVIDIA/trt-llm-torch-attention-devs
/tests/unittest/_torch/modules/test_mha_helix.py @NVIDIA/trt-llm-torch-attention-devs
/tests/unittest/_torch/modules/test_mla_helix.py @NVIDIA/trt-llm-torch-attention-devs
/tests/unittest/_torch/modules/test_rotary_embedding.py @NVIDIA/trt-llm-torch-attention-devs
/tests/unittest/_torch/thop/parallel/test_indexer_topk.py @NVIDIA/trt-llm-torch-attention-devs
/tests/unittest/_torch/thop/parallel_hw_agnostic/test_fused_qk_norm_rope.py @NVIDIA/trt-llm-torch-attention-devs
/tests/unittest/_torch/thop/parallel_hw_agnostic/test_helix_postprocess.py @NVIDIA/trt-llm-torch-attention-devs
/tests/unittest/_torch/thop/serial/test_fused_cat_fp8.py @NVIDIA/trt-llm-torch-attention-devs
# ===== MoE =====
/cpp/tensorrt_llm/deep_ep @NVIDIA/trt-llm-moe-devs
/cpp/tensorrt_llm/kernels/*Moe* @NVIDIA/trt-llm-moe-devs
/cpp/tensorrt_llm/kernels/cutlass_kernels/moe_gemm @NVIDIA/trt-llm-moe-devs
/cpp/tensorrt_llm/kernels/moe* @NVIDIA/trt-llm-moe-devs
/cpp/tensorrt_llm/kernels/moeLoadBalance @NVIDIA/trt-llm-moe-devs
/cpp/tensorrt_llm/kernels/trtllmGenKernels/blockScaleMoe @NVIDIA/trt-llm-moe-devs
/cpp/tensorrt_llm/thop/*Moe* @NVIDIA/trt-llm-moe-devs
/cpp/tensorrt_llm/thop/moe* @NVIDIA/trt-llm-moe-devs
/cpp/tensorrt_llm/cutlass_extensions/include/cutlass_extensions/gemm/kernel/*moe* @NVIDIA/trt-llm-moe-devs
/cpp/tensorrt_llm/kernels/communicationKernels/moe* @NVIDIA/trt-llm-moe-devs
/cpp/tensorrt_llm/kernels/cuteDslKernels/moe* @NVIDIA/trt-llm-moe-devs
/cpp/tensorrt_llm/kernels/cutlass_kernels/include/moe_gemm_kernels.h @NVIDIA/trt-llm-moe-devs
/cpp/tensorrt_llm/kernels/cutlass_kernels/include/moe_kernels.h @NVIDIA/trt-llm-moe-devs
/cpp/tensorrt_llm/kernels/cutlass_kernels/include/moe_util_kernels.h @NVIDIA/trt-llm-moe-devs
/cpp/tensorrt_llm/kernels/internal_cutlass_kernels/include/moe_gemm_kernels.h @NVIDIA/trt-llm-moe-devs
/cpp/tensorrt_llm/kernels/internal_cutlass_kernels/include/moe_kernels.h @NVIDIA/trt-llm-moe-devs
/cpp/tensorrt_llm/kernels/llama4MinLatencyKernels/*Moe* @NVIDIA/trt-llm-moe-devs
/cpp/tensorrt_llm/kernels/marlin/*moe* @NVIDIA/trt-llm-moe-devs
/cpp/tensorrt_llm/kernels/trtllmGenKernels/batchedGemm @NVIDIA/trt-llm-kernels-devs @NVIDIA/trt-llm-moe-devs
/cpp/tensorrt_llm/nanobind/runtime/moe* @NVIDIA/trt-llm-moe-devs
/cpp/tensorrt_llm/runtime/moeLoadBalancer @NVIDIA/trt-llm-moe-devs
/tensorrt_llm/_torch/cute_dsl_kernels/blackwell/moe_as_dense_gemm @NVIDIA/trt-llm-moe-devs
/tensorrt_llm/_torch/cute_dsl_kernels/mega_moe_nvfp4 @NVIDIA/trt-llm-moe-devs
/tensorrt_llm/_torch/custom_ops/cute_dsl_megamoe_custom_op.py @NVIDIA/trt-llm-moe-devs
/tensorrt_llm/_torch/distributed/moe_alltoall.py @NVIDIA/trt-llm-moe-devs
/tensorrt_llm/_torch/expert_statistic.py @NVIDIA/trt-llm-moe-devs
/tensorrt_llm/_torch/modules/fused_moe @NVIDIA/trt-llm-moe-devs
/tensorrt_llm/_torch/modules/fused_shared_expert.py @NVIDIA/trt-llm-moe-devs
/tensorrt_llm/deep_ep @NVIDIA/trt-llm-moe-devs
/tests/microbenchmarks/bench_moe @NVIDIA/trt-llm-moe-devs
/tests/microbenchmarks/bench_moe_comm.py @NVIDIA/trt-llm-moe-devs
/tests/microbenchmarks/compare_moe_comm.py @NVIDIA/trt-llm-moe-devs
/tests/scripts/cute_dsl_kernels/moe_as_dense_gemm @NVIDIA/trt-llm-moe-devs
/tests/scripts/cute_dsl_kernels/moe_workload_generator.py @NVIDIA/trt-llm-moe-devs
/tests/unittest/_torch/modules/dwdp/test_dwdp_fixup_moe_backends.py @NVIDIA/trt-llm-moe-devs
/tests/unittest/_torch/modules/fused_moe @NVIDIA/trt-llm-moe-devs
/tests/unittest/_torch/modules/moe @NVIDIA/trt-llm-moe-devs
/tests/unittest/_torch/modules/test_fused_moe.py @NVIDIA/trt-llm-moe-devs
/tests/unittest/_torch/modules/test_fused_shared_expert.py @NVIDIA/trt-llm-moe-devs
/tests/unittest/_torch/modules/test_moe_*.py @NVIDIA/trt-llm-moe-devs
/tests/unittest/_torch/multi_gpu/test_moe_a2a.py @NVIDIA/trt-llm-moe-devs
/tests/unittest/_torch/thop/parallel/*moe* @NVIDIA/trt-llm-moe-devs
/tests/unittest/_torch/thop/serial/*moe* @NVIDIA/trt-llm-moe-devs
/tests/unittest/bindings/test_bindings_moe.py @NVIDIA/trt-llm-moe-devs
# ===== VisualGen / AIGV =====
/cpp/tensorrt_llm/thop/fusedDiT* @NVIDIA/trt-llm-torch-visual-gen-devs
/examples/visual_gen @NVIDIA/trt-llm-torch-visual-gen-devs
/scripts/visualgen_eval @NVIDIA/trt-llm-torch-visual-gen-devs
/tensorrt_llm/_torch/visual_gen @NVIDIA/trt-llm-torch-visual-gen-devs
/tensorrt_llm/_torch/visual_gen/attention_backend @NVIDIA/trt-llm-torch-attention-devs @NVIDIA/trt-llm-torch-visual-gen-devs
/tensorrt_llm/_torch/visual_gen/modules/attention.py @NVIDIA/trt-llm-torch-attention-devs @NVIDIA/trt-llm-torch-visual-gen-devs
/tensorrt_llm/media @NVIDIA/trt-llm-torch-visual-gen-devs
/tensorrt_llm/visual_gen @NVIDIA/trt-llm-torch-visual-gen-devs @NVIDIA/trt-llm-runtime-devs
/tests/integration/defs/examples/test_visual_gen.py @NVIDIA/trt-llm-torch-visual-gen-devs
/tests/integration/defs/visual_gen @NVIDIA/trt-llm-torch-visual-gen-devs
/tests/scripts/perf-sanity/visual_gen @NVIDIA/trt-llm-torch-visual-gen-devs
/tests/unittest/_torch/thop/parallel_hw_agnostic/test_fused_dit* @NVIDIA/trt-llm-torch-visual-gen-devs
/tests/unittest/_torch/visual_gen @NVIDIA/trt-llm-torch-visual-gen-devs
/tests/unittest/visual_gen @NVIDIA/trt-llm-torch-visual-gen-devs
# ===== SCAFFOLDING =====
/tensorrt_llm/scaffolding @WeiHaocheng
/tests/unittest/scaffolding @WeiHaocheng
# ===== SELF-MANAGED =====
/docs/source/features/auto_deploy @NVIDIA/trt-llm-torch-autodeploy-devs @NVIDIA/trt-llm-doc-owners
/examples/auto_deploy @NVIDIA/trt-llm-torch-autodeploy-devs
/scripts/check_auto_deploy_imports.py @NVIDIA/trt-llm-torch-autodeploy-devs
/scripts/check_model_registry.py @NVIDIA/trt-llm-torch-autodeploy-devs
/tensorrt_llm/_torch/auto_deploy @NVIDIA/trt-llm-torch-autodeploy-devs
/tests/integration/defs/accuracy/test_llm_api_autodeploy.py @NVIDIA/trt-llm-torch-autodeploy-devs @NVIDIA/trt-llm-qa
/tests/unittest/_torch/auto_deploy @NVIDIA/trt-llm-torch-autodeploy-devs
/tests/unittest/auto_deploy @NVIDIA/trt-llm-torch-autodeploy-devs
/tests/integration/defs/accuracy/test_llm_api_autodeploy.py @NVIDIA/trt-llm-torch-autodeploy-devs @NVIDIA/trt-llm-qa-function
## TensorRT-LLM Pytorch - Attention
/tensorrt_llm/_torch/attention_backend @NVIDIA/trt-llm-torch-attention-devs
/tensorrt_llm/_torch/modules/attention.py @NVIDIA/trt-llm-torch-attention-devs
## TensorRT-LLM LLM Disaggregated
/examples/disaggregated @NVIDIA/trt-llm-disagg-devs @NVIDIA/trt-llm-doc-owners
/examples/disaggregated/slurm/benchmark @NVIDIA/trt-llm-disagg-devs @NVIDIA/trtllm-bench-reviewers
/tensorrt_llm/disaggregated_params.py @NVIDIA/trt-llm-disagg-devs
/tensorrt_llm/_torch/pyexecutor/kv_cache_transceiver.py @NVIDIA/trt-llm-disagg-devs
/cpp/tensorrt_llm/batch_manager/cacheFormatter.cpp @NVIDIA/trt-llm-disagg-devs
/cpp/tensorrt_llm/batch_manager/cacheFormatter.h @NVIDIA/trt-llm-disagg-devs
/cpp/tensorrt_llm/batch_manager/cacheTransBuffer.cpp @NVIDIA/trt-llm-disagg-devs
/cpp/tensorrt_llm/batch_manager/cacheTransBuffer.h @NVIDIA/trt-llm-disagg-devs
/cpp/tensorrt_llm/batch_manager/cacheTransceiver.cpp @NVIDIA/trt-llm-disagg-devs
/cpp/tensorrt_llm/batch_manager/dataTransceiver.cpp @NVIDIA/trt-llm-disagg-devs
/cpp/tensorrt_llm/batch_manager/dataTransceiver.h @NVIDIA/trt-llm-disagg-devs
/cpp/tensorrt_llm/batch_manager/dataTransceiverImpl.cpp @NVIDIA/trt-llm-disagg-devs
/cpp/tensorrt_llm/batch_manager/dataTransceiverImpl.h @NVIDIA/trt-llm-disagg-devs
/tensorrt_llm/serve/openai_disagg_server.py @NVIDIA/trt-llm-disagg-devs
## TensorRT-LLM - KV Cache Manager
/cpp/tensorrt_llm/batch_manager/kvCacheManager.cpp @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/tensorrt_llm/batch_manager/kvCacheEventManager.cpp @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/tensorrt_llm/batch_manager/kvCacheTransferManager.cpp @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/tensorrt_llm/batch_manager/evictionPolicy.cpp @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/include/tensorrt_llm/batch_manager/kvCacheManager.h @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/include/tensorrt_llm/batch_manager/kvCacheEventManager.h @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/include/tensorrt_llm/batch_manager/kvCacheTransferManager.h @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/include/tensorrt_llm/batch_manager/evictionPolicy.h @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/tensorrt_llm/batch_manager/allocateKvCache.cpp @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/tests/unit_tests/batch_manager/kvCacheManagerTest.cpp @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/tests/unit_tests/batch_manager/kvCacheUtilsTest.cpp @NVIDIA/trt-llm-kv-cache-manager-devs
/tensorrt_llm/_torch/attention_backend/sparse/*/cache_manager.py @NVIDIA/trt-llm-kv-cache-manager-devs
/tensorrt_llm/_torch/pyexecutor/kv_cache_manager_v2.py @NVIDIA/trt-llm-kv-cache-manager-devs
/tensorrt_llm/_torch/pyexecutor/resource_manager.py @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/tensorrt_llm/nanobind/batch_manager/kvCacheManager.h @NVIDIA/trt-llm-kv-cache-manager-devs
/cpp/tensorrt_llm/nanobind/batch_manager/kvCacheManager.cpp @NVIDIA/trt-llm-kv-cache-manager-devs
# The rule below requires that any PR modifying public APIs must be approved by at least one member
# of the NVIDIA/trt-llm-committed-api-review-committee or NVIDIA/trt-llm-noncommitted-api-review-committee team.
# This approval is mandatory regardless of other approvals the PR may have received. Without approval
# from a member of this team, PRs affecting public APIs cannot be merged to main or release branches.
/tests/unittest/api_stability/ @NVIDIA/trt-llm-noncommitted-api-review-committee
/tests/unittest/api_stability/references_committed/ @NVIDIA/trt-llm-committed-api-review-committee
/tests/unittest/dynamo/ @NVIDIA/trt-llm-dynamo-devs
/triton_backend @NVIDIA/trt-llm-triton-backend-devs
# ===== DISAGG BLAST-RADIUS CO-OWNS (Tier-1) =====
# Last-match cross-cutting: adds disagg-devs to shared files that can silently break disagg e2e.
/tensorrt_llm/_torch/pyexecutor/resource_manager.py @NVIDIA/trt-llm-kv-cache-manager-devs @NVIDIA/trt-llm-disagg-devs
/tensorrt_llm/_torch/pyexecutor/py_executor.py @NVIDIA/trt-llm-runtime-devs @NVIDIA/trt-llm-disagg-devs
/tensorrt_llm/_torch/pyexecutor/model_engine.py @NVIDIA/trt-llm-runtime-devs @NVIDIA/trt-llm-disagg-devs
# ===== GOVERNANCE / LEGAL GATES =====
/.github/CODEOWNERS @NVIDIA/trt-llm-infra-devs @NVIDIA/trt-llm-oss-compliance
/.github/tava_architecture_diagram.md @NVIDIA/trt-llm-TAVA-design-change
/3rdparty/** @NVIDIA/trt-llm-oss-compliance
/ATTRIBUTIONS-*.md @NVIDIA/trt-llm-oss-compliance
/LICENSE @NVIDIA/trt-llm-oss-compliance
/constraints.txt @NVIDIA/trt-llm-oss-compliance
/cpp/CMakeLists.txt @NVIDIA/trt-llm-oss-compliance
/cpp/cmake/** @NVIDIA/trt-llm-oss-compliance
/cpp/conan.lock @NVIDIA/trt-llm-oss-compliance
/cpp/conandata.yml @NVIDIA/trt-llm-oss-compliance
/cpp/conanfile.py @NVIDIA/trt-llm-oss-compliance
/cpp/libnuma_conan.py @NVIDIA/trt-llm-oss-compliance
/docker/common/** @NVIDIA/trt-llm-infra-devs @NVIDIA/trt-llm-oss-compliance
/jenkins/license_cpp.json @NVIDIA/trt-llm-infra-devs @NVIDIA/trt-llm-oss-compliance
/pyproject.toml @NVIDIA/trt-llm-oss-compliance
/requirements-dev.txt @NVIDIA/trt-llm-oss-compliance
/requirements.txt @NVIDIA/trt-llm-oss-compliance
/setup.py @NVIDIA/trt-llm-oss-compliance
/tests/unittest/api_stability/ @NVIDIA/trt-llm-noncommitted-api-review-committee
/tests/unittest/api_stability/references_committed/ @NVIDIA/trt-llm-committed-api-review-committee
/triton_kernels/** @NVIDIA/trt-llm-oss-compliance
### Usage telemetry / privacy review
/tensorrt_llm/usage/ @NVIDIA/trt-llm-usage-telemetry-devs
/tests/unittest/usage/ @NVIDIA/trt-llm-usage-telemetry-devs
/tensorrt_llm/usage/llm_args_golden_manifest.json @NVIDIA/trt-llm-usage-telemetry-devs @NVIDIA/trt-llm-oss-compliance @NVIDIA/trt-llm-noncommitted-api-review-committee
# Uncomment only on release branches (e.g. release/0.19):
# * @NVIDIA/trt-llm-release-branch-approval