From 330756a4e60c12048bd96a16ba592149fa8df820 Mon Sep 17 00:00:00 2001 From: Beckylu <648245013@qq.com> Date: Mon, 8 Jun 2026 18:14:32 +0800 Subject: [PATCH] =?UTF-8?q?=E6=9B=B4=E6=96=B0=E8=B5=9B=E9=A2=98=E4=BA=8C?= =?UTF-8?q?=E8=AF=B4=E6=98=8E?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit --- .../赛题说明.md | 8 +++++--- 1 file changed, 5 insertions(+), 3 deletions(-) diff --git a/基于AI Agent开发范式的国产GPU大模型推理算子库优化/赛题说明.md b/基于AI Agent开发范式的国产GPU大模型推理算子库优化/赛题说明.md index 791f47a..f06df54 100644 --- a/基于AI Agent开发范式的国产GPU大模型推理算子库优化/赛题说明.md +++ b/基于AI Agent开发范式的国产GPU大模型推理算子库优化/赛题说明.md @@ -611,7 +611,9 @@ OOM 表示 GPU 显存不足,无法完成当前计算。常见原因: * [PyTorch CUDA 编程最佳实践]( -Baseline教程链接:FlashAttention关键算子迁移与优化 +Baseline教程链接: + +FlashAttention 关键算子迁移与优化 ### Track 3:MCTLASS / Fused MoE 算子优化 @@ -653,9 +655,9 @@ INT8 量化是一种用于减少模型大小和计算复杂度的方法,特 -#### 教程链接: +#### Baseline教程链接: -MCTLASS_Fused MoE 算子优化 +MCTLASS_Fused MoE 算子优化