From 90f85a0b3e64dde96b8d89225d4232e2d66ea6e3 Mon Sep 17 00:00:00 2001 From: xiao Date: Fri, 5 Jun 2026 22:35:16 +0800 Subject: [PATCH] =?UTF-8?q?=E6=9B=B4=E6=96=B0=E9=93=BE=E6=8E=A5=E6=95=99?= =?UTF-8?q?=E7=A8=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit --- .../赛题说明.md | 4 ++-- 1 file changed, 2 insertions(+), 2 deletions(-) diff --git a/基于AI Agent开发范式的国产GPU大模型推理算子库优化/赛题说明.md b/基于AI Agent开发范式的国产GPU大模型推理算子库优化/赛题说明.md index 11cf68b..811dcf9 100644 --- a/基于AI Agent开发范式的国产GPU大模型推理算子库优化/赛题说明.md +++ b/基于AI Agent开发范式的国产GPU大模型推理算子库优化/赛题说明.md @@ -611,7 +611,7 @@ OOM 表示 GPU 显存不足,无法完成当前计算。常见原因: * [PyTorch CUDA 编程最佳实践]( -教程链接:FlashAttention Baseline 入门 +教程链接:FlashAttention关键算子迁移与优化 ### Track 3:MCTLASS / Fused MoE 算子优化 @@ -655,4 +655,4 @@ INT8 量化是一种用于减少模型大小和计算复杂度的方法,特 #### 教程链接: -Fused MoE Baseline 入门:快速跑通最小闭环教程 +MCTLASS_Fused MoE 算子优化