Ben Hamm
419e936a53
refactor: remove benchmark shim, use AIPerf directly ( #7074 )
...
Signed-off-by: Ben Hamm <ben.hamm@gmail.com>
Co-authored-by: Claude Opus 4.6 <noreply@anthropic.com>
Co-authored-by: Biswa Panda <biswa.panda@gmail.com>
Co-authored-by: Saravana Periyasamy <saperiyasamy@nvidia.com>
2026-03-10 03:41:36 +00:00
Neal Vaidya
ece08dc926
docs: restructure docs directory and move fern config to fern/ ( #6700 )
...
Signed-off-by: Neal Vaidya <nealv@nvidia.com>
Co-authored-by: Claude Opus 4.6 <noreply@anthropic.com>
2026-03-01 19:58:22 -08:00
hhzhang16
d56439ec28
feat: migrate GPU discovery from Dynamo Profiler to Dynamo Operator with automatic injection ( #6224 )
...
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
2026-02-14 00:34:21 +00:00
Hongkuan Zhou
a04b56310c
feat: support AIC DGD gen call (WILL BREAK DGDR) ( #6216 )
...
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
2026-02-12 08:47:55 -08:00
Jonathan Tong
39d645e586
docs: migrate Fern docs from fern/ into docs/ ( #6206 )
...
Signed-off-by: Jont828 <jt572@cornell.edu>
2026-02-11 16:22:27 -08:00
dagil-nvidia
0ef41ffe03
refactor: use tempfile module instead of hardcoded /tmp paths ( #5789 )
...
Signed-off-by: Dan Gil <dagil@nvidia.com>
Co-authored-by: Cursor <cursoragent@cursor.com>
2026-02-09 21:44:03 +00:00
dagil-nvidia
b19de4ed77
docs: cleanup of docs refactor for components, integrations, and features ( #6019 )
...
Signed-off-by: Dan Gil <dagil@nvidia.com>
Co-authored-by: Cursor <cursoragent@cursor.com>
2026-02-05 19:50:17 -08:00
Tushar Sharma
cf433e6825
chore: update all copyright headers in repo to 2026 ( #5130 )
...
Signed-off-by: Tushar Sharma <tusharma@nvidia.com>
2026-01-02 22:08:23 +00:00
Thomas Montfort
3057af00b6
feat(dep-715): refactor helm directory and remove reference to cloud ( #5042 )
2025-12-23 12:08:19 -05:00
hhzhang16
36f58e3656
feat: add an optional PVC mounting option to DGDR for profiling ( #4503 )
...
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
Signed-off-by: hhzhang16 <54051230+hhzhang16@users.noreply.github.com>
Co-authored-by: Hongkuan Zhou <tedzhouhk@gmail.com>
2025-11-21 04:59:52 +00:00
hhzhang16
fa6a7f94d5
feat: remove PVC logic from profiler planner ( #4210 )
...
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
Co-authored-by: hongkuanz <hongkuanz@nvidia.com>
2025-11-10 18:33:23 +00:00
hhzhang16
0e623146a8
feat: remove scripts for manipulating pvcs ( #4206 )
...
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
2025-11-10 11:07:58 +00:00
hhzhang16
5528f3b4d3
fix: update planner + docs now that profiling results are stored in /data ( #4098 )
...
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
2025-11-05 00:55:12 +00:00
hhzhang16
6a84ffd347
feat: turn profiling k8s jobs into sample DGDR requests ( #3864 )
...
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
Signed-off-by: Hongkuan Zhou <tedzhouhk@gmail.com>
Co-authored-by: hongkuanz <hongkuanz@nvidia.com>
Co-authored-by: Hongkuan Zhou <tedzhouhk@gmail.com>
2025-10-27 13:36:31 -07:00
Hongkuan Zhou
a1b38af25e
feat: automatic profiling config generation ( #3787 )
...
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
Signed-off-by: Hongkuan Zhou <tedzhouhk@gmail.com>
Co-authored-by: coderabbitai[bot] <136622811+coderabbitai[bot]@users.noreply.github.com>
2025-10-23 08:07:39 -07:00
hhzhang16
eb73c2b09f
feat: remove deploy/utils rbac ( #3771 )
...
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
2025-10-21 16:27:29 -07:00
Alec
179f993a54
fix: profilier bug fixes and doc improvements ( #3530 )
...
Signed-off-by: alec-flowers <aflowers@nvidia.com>
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
Co-authored-by: hongkuanz <hongkuanz@nvidia.com>
2025-10-09 14:47:26 -07:00
Hongkuan Zhou
83e259a7cc
feat: pre-deployment profiling automatically generates and deploys optimized DGD with planner ( #3441 )
...
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
2025-10-07 16:52:51 -07:00
Hongkuan Zhou
cfe74445fc
fix: correctly parse subcomponent in sla-planner + deploy/doc update ( #3363 )
...
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
2025-10-02 16:06:47 -07:00
Hongkuan Zhou
6243bcbe04
feat: support MoE model in SLA Planner Sglang ( #3185 )
...
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
Signed-off-by: Hongkuan Zhou <tedzhouhk@gmail.com>
Co-authored-by: hhzhang16 <54051230+hhzhang16@users.noreply.github.com>
2025-09-23 19:42:43 -07:00
Julien Mancuso
4a71802842
feat: revamp kubernetes doc ( #3173 )
...
Signed-off-by: Julien Mancuso <161955438+julienmancuso@users.noreply.github.com>
Co-authored-by: hhzhang16 <54051230+hhzhang16@users.noreply.github.com>
2025-09-23 14:09:29 -06:00
hhzhang16
ce36d9f4ce
feat: allow in-cluster perf benchmarks with a kubectl one-liner ( #3144 )
...
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
Signed-off-by: zhongdaor <zhongdaor@nvidia.com>
Signed-off-by: tmontfort <tmontfort@nvidia.com>
Signed-off-by: Keiven Chang <keivenchang@users.noreply.github.com>
Signed-off-by: Jacky <18255193+kthui@users.noreply.github.com>
Signed-off-by: richardhuo-nv <rihuo@nvidia.com>
Signed-off-by: Tushar Sharma <tusharma@nvidia.com>
Signed-off-by: tzulingk@nvidia.com <tzulingk@nvidia.com>
Signed-off-by: Krishnan Prashanth <kprashanth@nvidia.com>
Signed-off-by: Olga Andreeva <oandreeva@nvidia.com>
Signed-off-by: oandreeva-nv <oandreeva-nv@nvidia.com>
Co-authored-by: zhongdaor-nv <zhongdaor@nvidia.com>
Co-authored-by: Thomas Montfort <61255722+tmonty12@users.noreply.github.com>
Co-authored-by: Keiven C <213854356+keivenchang@users.noreply.github.com>
Co-authored-by: Jacky <18255193+kthui@users.noreply.github.com>
Co-authored-by: Richard Huo <rihuo@nvidia.com>
Co-authored-by: Tushar Sharma <tusharma@nvidia.com>
Co-authored-by: Tzu-Ling Kan <tzulingk@nvidia.com>
Co-authored-by: KrishnanPrash <140860868+KrishnanPrash@users.noreply.github.com>
Co-authored-by: Olga Andreeva <124622579+oandreeva-nv@users.noreply.github.com>
Co-authored-by: Ziqi Fan <ziqif@nvidia.com>
Co-authored-by: oandreeva-nv <oandreeva-nv@nvidia.com>
2025-09-23 10:03:09 -07:00
nv-nmailhot
406c4d4e87
ci: add broken links check ( #2927 )
...
Signed-off-by: Nate Mailhot <nmailhot@nvidia.com>
Signed-off-by: nv-nmailhot <nmailhot@nvidia.com>
2025-09-19 21:42:05 +00:00
Thomas Montfort
7d2fc13edb
fix: small planner manifest/doc fixes ( #3129 )
...
Signed-off-by: tmontfort <tmontfort@nvidia.com>
2025-09-19 12:46:02 -07:00
hhzhang16
c82f477dcc
feat: decouple dynamo k8s setup from additional benchmarking requirements ( #2973 )
...
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
2025-09-15 15:04:23 -07:00
Hongkuan Zhou
dcee4dbd17
feat: support trtllm in sla-planner ( #2980 )
...
Signed-off-by: Biswa Panda <biswa.panda@gmail.com>
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
Signed-off-by: ayushag <ayushag@nvidia.com>
Signed-off-by: Dillon Cullinan <dcullinan@nvidia.com>
Signed-off-by: Harrison Saturley-Hall <hsaturleyhal@nvidia.com>
Signed-off-by: alec-flowers <aflowers@nvidia.com>
Signed-off-by: Julien Mancuso <jmancuso@nvidia.com>
Signed-off-by: Pavithra Vijayakrishnan <160681768+pvijayakrish@users.noreply.github.com>
Signed-off-by: Harry Kim <harry_kim@live.com>
Signed-off-by: Tushar Sharma <tusharma@nvidia.com>
Signed-off-by: GuanLuo <gluo@nvidia.com>
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
Signed-off-by: Graham King <grahamk@nvidia.com>
Signed-off-by: Anant Sharma <anants@nvidia.com>
Signed-off-by: Greg Clark <grclark@nvidia.com>
Signed-off-by: Neal Vaidya <nealv@nvidia.com>
Co-authored-by: Biswa Panda <biswa.panda@gmail.com>
Co-authored-by: Ayush Agarwal <ayushag@nvidia.com>
Co-authored-by: Dillon Cullinan <dcullinan92@gmail.com>
Co-authored-by: Harrison Saturley-Hall <hsaturleyhal@nvidia.com>
Co-authored-by: alec-flowers <aflowers@nvidia.com>
Co-authored-by: julienmancuso <161955438+julienmancuso@users.noreply.github.com>
Co-authored-by: Pavithra Vijayakrishnan <160681768+pvijayakrish@users.noreply.github.com>
Co-authored-by: Harry Kim <harry_kim@live.com>
Co-authored-by: Tushar Sharma <tusharma@nvidia.com>
Co-authored-by: Alec <35311602+alec-flowers@users.noreply.github.com>
Co-authored-by: GuanLuo <41310872+GuanLuo@users.noreply.github.com>
Co-authored-by: hhzhang16 <54051230+hhzhang16@users.noreply.github.com>
Co-authored-by: Graham King <grahamk@nvidia.com>
Co-authored-by: Anant Sharma <anants@nvidia.com>
Co-authored-by: Greg Clark <grclark@nvidia.com>
Co-authored-by: Neal Vaidya <nealv@nvidia.com>
Co-authored-by: nv-nmailhot <nmailhot@nvidia.com>
2025-09-10 14:41:29 -07:00
hhzhang16
cfb7aed78f
feat: increase time of pvc access pod ( #2991 )
...
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
2025-09-10 18:19:03 +00:00
hhzhang16
09c7b73caf
feat: update benchmarking and deploy utils ( #2933 )
...
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
2025-09-08 22:53:55 -04:00
hhzhang16
5bbbeae359
fix: port forward to available ports when benchmarking ( #2795 )
...
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
2025-09-02 09:39:58 -07:00
hhzhang16
699996e4fe
feat: add benchmarking guide ( #2620 )
...
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
2025-08-29 17:14:55 -07:00