From 6bae74758ec0f6750d9f215817415d1e26076118 Mon Sep 17 00:00:00 2001 From: Beckylu <648245013@qq.com> Date: Fri, 5 Jun 2026 09:44:52 +0800 Subject: [PATCH] =?UTF-8?q?=E6=96=B0=E5=A2=9E=E8=B5=9B=E9=A2=98=E4=BA=8C?= =?UTF-8?q?=E8=B5=9B=E9=A2=98=E8=AF=B4=E6=98=8E?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit --- .../赛题说明.md | 33 +++++++++++++++++++ 1 file changed, 33 insertions(+) create mode 100644 基于AI Agent开发范式的国产GPU大模型推理算子库优化/赛题说明.md diff --git a/基于AI Agent开发范式的国产GPU大模型推理算子库优化/赛题说明.md b/基于AI Agent开发范式的国产GPU大模型推理算子库优化/赛题说明.md new file mode 100644 index 0000000..11babde --- /dev/null +++ b/基于AI Agent开发范式的国产GPU大模型推理算子库优化/赛题说明.md @@ -0,0 +1,33 @@ +# 赛题说明 + +## 一、赛题简要说明 + +待更新 + +## 二、任务方向 + +参赛团队可围绕以下推理算子库或核心算子,选择一类或多类任务开展优化工作: + +### Track 1:FlashInfer 关键算子迁移与优化 + +面向 Prefill、Decode、Paged KV Cache、MLA Attention 等推理场景,完成 MACA 平台适配与性能优化。 + +参考知识:待更新 + +教程链接:[FlashInfer 迁移 Baseline 实战](FlashInfer%20迁移%20Baseline%20实战.md) + +### Track 2:FlashAttention 关键算子迁移与优化 + +围绕 `flash_attn_with_kvcache` 等核心接口,提升长序列场景下的 Attention 计算性能。 + +参考知识:待更新 + +教程链接:[FlashAttention Baseline 入门](FlashAttention_Baseline入门.md) + +### Track 3:MCTLASS / Fused MoE 算子优化 + +聚焦 MoE 模型中的稀疏专家计算,优化 Fused MoE 算子的执行效率。 + +参考知识:待更新 + +教程链接:[Fused MoE Baseline 入门:快速跑通最小闭环教程](Fused%20MoE%20Baseline入门:快速跑通最小闭环教程.md)