diff --git a/README.md b/README.md index aa4fe9d..80f8d37 100644 --- a/README.md +++ b/README.md @@ -44,7 +44,7 @@ **赛题二相关资料** - [赛题二方案:基于 AI Agent 开发范式的国产 GPU 大模型推理算子库优化方案](基于AI%20Agent开发范式的国产GPU大模型推理算子库优化/基于AI%20Agent开发范式的国产GPU大模型算子推理库优化方案.md) -- [模力方舟 Agent 环境准备教程](基于AI%20Agent开发范式的国产GPU大模型推理算子库优化/模力方舟Agent环境准备教程.md) +- [模力方舟 Agent 部署准备教程](基于AI%20Agent开发范式的国产GPU大模型推理算子库优化/模力方舟Agent部署准备教程.md) - [赛题二说明及资料参考](基于AI%20Agent开发范式的国产GPU大模型推理算子库优化/赛题说明.md) ## 参赛对象 diff --git a/基于AI Agent开发范式的国产GPU大模型推理算子库优化/赛题说明.md b/基于AI Agent开发范式的国产GPU大模型推理算子库优化/赛题说明.md index b395246..791f47a 100644 --- a/基于AI Agent开发范式的国产GPU大模型推理算子库优化/赛题说明.md +++ b/基于AI Agent开发范式的国产GPU大模型推理算子库优化/赛题说明.md @@ -398,9 +398,9 @@ run(q: Tensor, paged_kv_cache: Tensor | Tuple[Tensor, Tensor], *args, q_scale: f -#### 教程链接: +#### Baseline教程链接: -FlashInfer关键算子迁移与优化 +FlashInfer关键算子迁移与优化 ### Track 2:FlashAttention 关键算子迁移与优化 @@ -611,7 +611,7 @@ OOM 表示 GPU 显存不足,无法完成当前计算。常见原因: * [PyTorch CUDA 编程最佳实践]( -教程链接:FlashAttention关键算子迁移与优化 +Baseline教程链接:FlashAttention关键算子迁移与优化 ### Track 3:MCTLASS / Fused MoE 算子优化