dagil-nvidia
|
0ef41ffe03
|
refactor: use tempfile module instead of hardcoded /tmp paths (#5789)
Signed-off-by: Dan Gil <dagil@nvidia.com>
Co-authored-by: Cursor <cursoragent@cursor.com>
|
2026-02-09 21:44:03 +00:00 |
dagil-nvidia
|
b19de4ed77
|
docs: cleanup of docs refactor for components, integrations, and features (#6019)
Signed-off-by: Dan Gil <dagil@nvidia.com>
Co-authored-by: Cursor <cursoragent@cursor.com>
|
2026-02-05 19:50:17 -08:00 |
Tushar Sharma
|
cf433e6825
|
chore: update all copyright headers in repo to 2026 (#5130)
Signed-off-by: Tushar Sharma <tusharma@nvidia.com>
|
2026-01-02 22:08:23 +00:00 |
Thomas Montfort
|
3057af00b6
|
feat(dep-715): refactor helm directory and remove reference to cloud (#5042)
|
2025-12-23 12:08:19 -05:00 |
hhzhang16
|
36f58e3656
|
feat: add an optional PVC mounting option to DGDR for profiling (#4503)
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
Signed-off-by: hhzhang16 <54051230+hhzhang16@users.noreply.github.com>
Co-authored-by: Hongkuan Zhou <tedzhouhk@gmail.com>
|
2025-11-21 04:59:52 +00:00 |
hhzhang16
|
fa6a7f94d5
|
feat: remove PVC logic from profiler planner (#4210)
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
Co-authored-by: hongkuanz <hongkuanz@nvidia.com>
|
2025-11-10 18:33:23 +00:00 |
hhzhang16
|
0e623146a8
|
feat: remove scripts for manipulating pvcs (#4206)
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
|
2025-11-10 11:07:58 +00:00 |
hhzhang16
|
5528f3b4d3
|
fix: update planner + docs now that profiling results are stored in /data (#4098)
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
|
2025-11-05 00:55:12 +00:00 |
hhzhang16
|
6a84ffd347
|
feat: turn profiling k8s jobs into sample DGDR requests (#3864)
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
Signed-off-by: Hongkuan Zhou <tedzhouhk@gmail.com>
Co-authored-by: hongkuanz <hongkuanz@nvidia.com>
Co-authored-by: Hongkuan Zhou <tedzhouhk@gmail.com>
|
2025-10-27 13:36:31 -07:00 |
Hongkuan Zhou
|
a1b38af25e
|
feat: automatic profiling config generation (#3787)
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
Signed-off-by: Hongkuan Zhou <tedzhouhk@gmail.com>
Co-authored-by: coderabbitai[bot] <136622811+coderabbitai[bot]@users.noreply.github.com>
|
2025-10-23 08:07:39 -07:00 |
hhzhang16
|
eb73c2b09f
|
feat: remove deploy/utils rbac (#3771)
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
|
2025-10-21 16:27:29 -07:00 |
Alec
|
179f993a54
|
fix: profilier bug fixes and doc improvements (#3530)
Signed-off-by: alec-flowers <aflowers@nvidia.com>
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
Co-authored-by: hongkuanz <hongkuanz@nvidia.com>
|
2025-10-09 14:47:26 -07:00 |
Hongkuan Zhou
|
83e259a7cc
|
feat: pre-deployment profiling automatically generates and deploys optimized DGD with planner (#3441)
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
|
2025-10-07 16:52:51 -07:00 |
Hongkuan Zhou
|
cfe74445fc
|
fix: correctly parse subcomponent in sla-planner + deploy/doc update (#3363)
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
|
2025-10-02 16:06:47 -07:00 |
Hongkuan Zhou
|
6243bcbe04
|
feat: support MoE model in SLA Planner Sglang (#3185)
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
Signed-off-by: Hongkuan Zhou <tedzhouhk@gmail.com>
Co-authored-by: hhzhang16 <54051230+hhzhang16@users.noreply.github.com>
|
2025-09-23 19:42:43 -07:00 |
Julien Mancuso
|
4a71802842
|
feat: revamp kubernetes doc (#3173)
Signed-off-by: Julien Mancuso <161955438+julienmancuso@users.noreply.github.com>
Co-authored-by: hhzhang16 <54051230+hhzhang16@users.noreply.github.com>
|
2025-09-23 14:09:29 -06:00 |
hhzhang16
|
ce36d9f4ce
|
feat: allow in-cluster perf benchmarks with a kubectl one-liner (#3144)
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
Signed-off-by: zhongdaor <zhongdaor@nvidia.com>
Signed-off-by: tmontfort <tmontfort@nvidia.com>
Signed-off-by: Keiven Chang <keivenchang@users.noreply.github.com>
Signed-off-by: Jacky <18255193+kthui@users.noreply.github.com>
Signed-off-by: richardhuo-nv <rihuo@nvidia.com>
Signed-off-by: Tushar Sharma <tusharma@nvidia.com>
Signed-off-by: tzulingk@nvidia.com <tzulingk@nvidia.com>
Signed-off-by: Krishnan Prashanth <kprashanth@nvidia.com>
Signed-off-by: Olga Andreeva <oandreeva@nvidia.com>
Signed-off-by: oandreeva-nv <oandreeva-nv@nvidia.com>
Co-authored-by: zhongdaor-nv <zhongdaor@nvidia.com>
Co-authored-by: Thomas Montfort <61255722+tmonty12@users.noreply.github.com>
Co-authored-by: Keiven C <213854356+keivenchang@users.noreply.github.com>
Co-authored-by: Jacky <18255193+kthui@users.noreply.github.com>
Co-authored-by: Richard Huo <rihuo@nvidia.com>
Co-authored-by: Tushar Sharma <tusharma@nvidia.com>
Co-authored-by: Tzu-Ling Kan <tzulingk@nvidia.com>
Co-authored-by: KrishnanPrash <140860868+KrishnanPrash@users.noreply.github.com>
Co-authored-by: Olga Andreeva <124622579+oandreeva-nv@users.noreply.github.com>
Co-authored-by: Ziqi Fan <ziqif@nvidia.com>
Co-authored-by: oandreeva-nv <oandreeva-nv@nvidia.com>
|
2025-09-23 10:03:09 -07:00 |
nv-nmailhot
|
406c4d4e87
|
ci: add broken links check (#2927)
Signed-off-by: Nate Mailhot <nmailhot@nvidia.com>
Signed-off-by: nv-nmailhot <nmailhot@nvidia.com>
|
2025-09-19 21:42:05 +00:00 |
Thomas Montfort
|
7d2fc13edb
|
fix: small planner manifest/doc fixes (#3129)
Signed-off-by: tmontfort <tmontfort@nvidia.com>
|
2025-09-19 12:46:02 -07:00 |
hhzhang16
|
c82f477dcc
|
feat: decouple dynamo k8s setup from additional benchmarking requirements (#2973)
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
|
2025-09-15 15:04:23 -07:00 |
Hongkuan Zhou
|
dcee4dbd17
|
feat: support trtllm in sla-planner (#2980)
Signed-off-by: Biswa Panda <biswa.panda@gmail.com>
Signed-off-by: hongkuanz <hongkuanz@nvidia.com>
Signed-off-by: ayushag <ayushag@nvidia.com>
Signed-off-by: Dillon Cullinan <dcullinan@nvidia.com>
Signed-off-by: Harrison Saturley-Hall <hsaturleyhal@nvidia.com>
Signed-off-by: alec-flowers <aflowers@nvidia.com>
Signed-off-by: Julien Mancuso <jmancuso@nvidia.com>
Signed-off-by: Pavithra Vijayakrishnan <160681768+pvijayakrish@users.noreply.github.com>
Signed-off-by: Harry Kim <harry_kim@live.com>
Signed-off-by: Tushar Sharma <tusharma@nvidia.com>
Signed-off-by: GuanLuo <gluo@nvidia.com>
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
Signed-off-by: Graham King <grahamk@nvidia.com>
Signed-off-by: Anant Sharma <anants@nvidia.com>
Signed-off-by: Greg Clark <grclark@nvidia.com>
Signed-off-by: Neal Vaidya <nealv@nvidia.com>
Co-authored-by: Biswa Panda <biswa.panda@gmail.com>
Co-authored-by: Ayush Agarwal <ayushag@nvidia.com>
Co-authored-by: Dillon Cullinan <dcullinan92@gmail.com>
Co-authored-by: Harrison Saturley-Hall <hsaturleyhal@nvidia.com>
Co-authored-by: alec-flowers <aflowers@nvidia.com>
Co-authored-by: julienmancuso <161955438+julienmancuso@users.noreply.github.com>
Co-authored-by: Pavithra Vijayakrishnan <160681768+pvijayakrish@users.noreply.github.com>
Co-authored-by: Harry Kim <harry_kim@live.com>
Co-authored-by: Tushar Sharma <tusharma@nvidia.com>
Co-authored-by: Alec <35311602+alec-flowers@users.noreply.github.com>
Co-authored-by: GuanLuo <41310872+GuanLuo@users.noreply.github.com>
Co-authored-by: hhzhang16 <54051230+hhzhang16@users.noreply.github.com>
Co-authored-by: Graham King <grahamk@nvidia.com>
Co-authored-by: Anant Sharma <anants@nvidia.com>
Co-authored-by: Greg Clark <grclark@nvidia.com>
Co-authored-by: Neal Vaidya <nealv@nvidia.com>
Co-authored-by: nv-nmailhot <nmailhot@nvidia.com>
|
2025-09-10 14:41:29 -07:00 |
hhzhang16
|
cfb7aed78f
|
feat: increase time of pvc access pod (#2991)
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
|
2025-09-10 18:19:03 +00:00 |
hhzhang16
|
09c7b73caf
|
feat: update benchmarking and deploy utils (#2933)
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
|
2025-09-08 22:53:55 -04:00 |
hhzhang16
|
5bbbeae359
|
fix: port forward to available ports when benchmarking (#2795)
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
|
2025-09-02 09:39:58 -07:00 |
hhzhang16
|
699996e4fe
|
feat: add benchmarking guide (#2620)
Signed-off-by: Hannah Zhang <hannahz@nvidia.com>
|
2025-08-29 17:14:55 -07:00 |