Commit Graph

30 Commits

Author SHA1 Message Date
Ben Hamm 419e936a53
refactor: remove benchmark shim, use AIPerf directly (#7074)
Signed-off-by: Ben Hamm <ben.hamm@gmail.com>
Co-authored-by: Claude Opus 4.6 <noreply@anthropic.com>
Co-authored-by: Biswa Panda <biswa.panda@gmail.com>
Co-authored-by: Saravana Periyasamy <saperiyasamy@nvidia.com>
2026-03-10 03:41:36 +00:00
Neal Vaidya ece08dc926
docs: restructure docs directory and move fern config to fern/ (#6700)
Signed-off-by: Neal Vaidya <nealv@nvidia.com>
Co-authored-by: Claude Opus 4.6 <noreply@anthropic.com>
2026-03-01 19:58:22 -08:00
hhzhang16 d56439ec28
feat: migrate GPU discovery from Dynamo Profiler to Dynamo Operator with automatic injection (#6224)
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
2026-02-14 00:34:21 +00:00
Hongkuan Zhou a04b56310c
feat: support AIC DGD gen call (WILL BREAK DGDR) (#6216)
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
2026-02-12 08:47:55 -08:00
Jonathan Tong 39d645e586
docs: migrate Fern docs from fern/ into docs/ (#6206)
Signed-off-by: Jont828 <jt572@cornell.edu>
2026-02-11 16:22:27 -08:00
dagil-nvidia 0ef41ffe03
refactor: use tempfile module instead of hardcoded /tmp paths (#5789)
Signed-off-by: Dan Gil <dagil@nvidia.com>
Co-authored-by: Cursor <cursoragent@cursor.com>
2026-02-09 21:44:03 +00:00
dagil-nvidia b19de4ed77
docs: cleanup of docs refactor for components, integrations, and features (#6019)
Signed-off-by: Dan Gil <dagil@nvidia.com>
Co-authored-by: Cursor <cursoragent@cursor.com>
2026-02-05 19:50:17 -08:00
Tushar Sharma cf433e6825
chore: update all copyright headers in repo to 2026 (#5130)
Signed-off-by: Tushar Sharma <tusharma@nvidia.com>
2026-01-02 22:08:23 +00:00
Thomas Montfort 3057af00b6
feat(dep-715): refactor helm directory and remove reference to cloud (#5042) 2025-12-23 12:08:19 -05:00
hhzhang16 36f58e3656
feat: add an optional PVC mounting option to DGDR for profiling (#4503)
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
Signed-off-by: hhzhang16 <54051230+hhzhang16@users.noreply.github.com>
Co-authored-by: Hongkuan Zhou <tedzhouhk@gmail.com>
2025-11-21 04:59:52 +00:00
hhzhang16 fa6a7f94d5
feat: remove PVC logic from profiler planner (#4210)
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
Co-authored-by: hongkuanz <hongkuanz@nvidia.com>
2025-11-10 18:33:23 +00:00
hhzhang16 0e623146a8
feat: remove scripts for manipulating pvcs (#4206)
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
2025-11-10 11:07:58 +00:00
hhzhang16 5528f3b4d3
fix: update planner + docs now that profiling results are stored in /data (#4098)
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
2025-11-05 00:55:12 +00:00
hhzhang16 6a84ffd347
feat: turn profiling k8s jobs into sample DGDR requests (#3864)
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
Signed-off-by: Hongkuan Zhou <tedzhouhk@gmail.com>
Co-authored-by: hongkuanz <hongkuanz@nvidia.com>
Co-authored-by: Hongkuan Zhou <tedzhouhk@gmail.com>
2025-10-27 13:36:31 -07:00
Hongkuan Zhou a1b38af25e
feat: automatic profiling config generation (#3787)
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
Signed-off-by: Hongkuan Zhou <tedzhouhk@gmail.com>
Co-authored-by: coderabbitai[bot] <136622811+coderabbitai[bot]@users.noreply.github.com>
2025-10-23 08:07:39 -07:00
hhzhang16 eb73c2b09f
feat: remove deploy/utils rbac (#3771)
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
2025-10-21 16:27:29 -07:00
Alec 179f993a54
fix: profilier bug fixes and doc improvements (#3530)
Signed-off-by: alec-flowers <aflowers@nvidia.com>
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
Co-authored-by: hongkuanz <hongkuanz@nvidia.com>
2025-10-09 14:47:26 -07:00
Hongkuan Zhou 83e259a7cc
feat: pre-deployment profiling automatically generates and deploys optimized DGD with planner (#3441)
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
2025-10-07 16:52:51 -07:00
Hongkuan Zhou cfe74445fc
fix: correctly parse subcomponent in sla-planner + deploy/doc update (#3363)
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
2025-10-02 16:06:47 -07:00
Hongkuan Zhou 6243bcbe04
feat: support MoE model in SLA Planner Sglang (#3185)
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
Signed-off-by: Hongkuan Zhou <tedzhouhk@gmail.com>
Co-authored-by: hhzhang16 <54051230+hhzhang16@users.noreply.github.com>
2025-09-23 19:42:43 -07:00
Julien Mancuso 4a71802842
feat: revamp kubernetes doc (#3173)
Signed-off-by: Julien Mancuso <161955438+julienmancuso@users.noreply.github.com>
Co-authored-by: hhzhang16 <54051230+hhzhang16@users.noreply.github.com>
2025-09-23 14:09:29 -06:00
hhzhang16 ce36d9f4ce
feat: allow in-cluster perf benchmarks with a kubectl one-liner (#3144)
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
Signed-off-by: zhongdaor <zhongdaor@nvidia.com>
Signed-off-by: tmontfort <tmontfort@nvidia.com>
Signed-off-by: Keiven Chang <keivenchang@users.noreply.github.com>
Signed-off-by: Jacky <18255193+kthui@users.noreply.github.com>
Signed-off-by: richardhuo-nv <rihuo@nvidia.com>
Signed-off-by: Tushar Sharma <tusharma@nvidia.com>
Signed-off-by: tzulingk@nvidia.com <tzulingk@nvidia.com>
Signed-off-by: Krishnan Prashanth <kprashanth@nvidia.com>
Signed-off-by: Olga Andreeva <oandreeva@nvidia.com>
Signed-off-by: oandreeva-nv <oandreeva-nv@nvidia.com>
Co-authored-by: zhongdaor-nv <zhongdaor@nvidia.com>
Co-authored-by: Thomas Montfort <61255722+tmonty12@users.noreply.github.com>
Co-authored-by: Keiven C <213854356+keivenchang@users.noreply.github.com>
Co-authored-by: Jacky <18255193+kthui@users.noreply.github.com>
Co-authored-by: Richard Huo <rihuo@nvidia.com>
Co-authored-by: Tushar Sharma <tusharma@nvidia.com>
Co-authored-by: Tzu-Ling Kan <tzulingk@nvidia.com>
Co-authored-by: KrishnanPrash <140860868+KrishnanPrash@users.noreply.github.com>
Co-authored-by: Olga Andreeva <124622579+oandreeva-nv@users.noreply.github.com>
Co-authored-by: Ziqi Fan <ziqif@nvidia.com>
Co-authored-by: oandreeva-nv <oandreeva-nv@nvidia.com>
2025-09-23 10:03:09 -07:00
nv-nmailhot 406c4d4e87
ci: add broken links check (#2927)
Signed-off-by: Nate Mailhot <nmailhot@nvidia.com>
Signed-off-by: nv-nmailhot <nmailhot@nvidia.com>
2025-09-19 21:42:05 +00:00
Thomas Montfort 7d2fc13edb
fix: small planner manifest/doc fixes (#3129)
Signed-off-by: tmontfort <tmontfort@nvidia.com>
2025-09-19 12:46:02 -07:00
hhzhang16 c82f477dcc
feat: decouple dynamo k8s setup from additional benchmarking requirements (#2973)
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
2025-09-15 15:04:23 -07:00
Hongkuan Zhou dcee4dbd17
feat: support trtllm in sla-planner (#2980)
Signed-off-by: Biswa Panda <biswa.panda@gmail.com>
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
Signed-off-by: ayushag <ayushag@nvidia.com>
Signed-off-by: Dillon Cullinan <dcullinan@nvidia.com>
Signed-off-by: Harrison Saturley-Hall <hsaturleyhal@nvidia.com>
Signed-off-by: alec-flowers <aflowers@nvidia.com>
Signed-off-by: Julien Mancuso <jmancuso@nvidia.com>
Signed-off-by: Pavithra Vijayakrishnan <160681768+pvijayakrish@users.noreply.github.com>
Signed-off-by: Harry Kim <harry_kim@live.com>
Signed-off-by: Tushar Sharma <tusharma@nvidia.com>
Signed-off-by: GuanLuo <gluo@nvidia.com>
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
Signed-off-by: Graham King <grahamk@nvidia.com>
Signed-off-by: Anant Sharma <anants@nvidia.com>
Signed-off-by: Greg Clark <grclark@nvidia.com>
Signed-off-by: Neal Vaidya <nealv@nvidia.com>
Co-authored-by: Biswa Panda <biswa.panda@gmail.com>
Co-authored-by: Ayush Agarwal <ayushag@nvidia.com>
Co-authored-by: Dillon Cullinan <dcullinan92@gmail.com>
Co-authored-by: Harrison Saturley-Hall <hsaturleyhal@nvidia.com>
Co-authored-by: alec-flowers <aflowers@nvidia.com>
Co-authored-by: julienmancuso <161955438+julienmancuso@users.noreply.github.com>
Co-authored-by: Pavithra Vijayakrishnan <160681768+pvijayakrish@users.noreply.github.com>
Co-authored-by: Harry Kim <harry_kim@live.com>
Co-authored-by: Tushar Sharma <tusharma@nvidia.com>
Co-authored-by: Alec <35311602+alec-flowers@users.noreply.github.com>
Co-authored-by: GuanLuo <41310872+GuanLuo@users.noreply.github.com>
Co-authored-by: hhzhang16 <54051230+hhzhang16@users.noreply.github.com>
Co-authored-by: Graham King <grahamk@nvidia.com>
Co-authored-by: Anant Sharma <anants@nvidia.com>
Co-authored-by: Greg Clark <grclark@nvidia.com>
Co-authored-by: Neal Vaidya <nealv@nvidia.com>
Co-authored-by: nv-nmailhot <nmailhot@nvidia.com>
2025-09-10 14:41:29 -07:00
hhzhang16 cfb7aed78f
feat: increase time of pvc access pod (#2991)
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
2025-09-10 18:19:03 +00:00
hhzhang16 09c7b73caf
feat: update benchmarking and deploy utils (#2933)
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
2025-09-08 22:53:55 -04:00
hhzhang16 5bbbeae359
fix: port forward to available ports when benchmarking (#2795)
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
2025-09-02 09:39:58 -07:00
hhzhang16 699996e4fe
feat: add benchmarking guide (#2620)
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
2025-08-29 17:14:55 -07:00