diff --git a/基于AI Agent开发范式的国产GPU大模型推理算子库优化/赛题说明.md b/基于AI Agent开发范式的国产GPU大模型推理算子库优化/赛题说明.md new file mode 100644 index 0000000..11babde --- /dev/null +++ b/基于AI Agent开发范式的国产GPU大模型推理算子库优化/赛题说明.md @@ -0,0 +1,33 @@ +# 赛题说明 + +## 一、赛题简要说明 + +待更新 + +## 二、任务方向 + +参赛团队可围绕以下推理算子库或核心算子,选择一类或多类任务开展优化工作: + +### Track 1:FlashInfer 关键算子迁移与优化 + +面向 Prefill、Decode、Paged KV Cache、MLA Attention 等推理场景,完成 MACA 平台适配与性能优化。 + +参考知识:待更新 + +教程链接:[FlashInfer 迁移 Baseline 实战](FlashInfer%20迁移%20Baseline%20实战.md) + +### Track 2:FlashAttention 关键算子迁移与优化 + +围绕 `flash_attn_with_kvcache` 等核心接口,提升长序列场景下的 Attention 计算性能。 + +参考知识:待更新 + +教程链接:[FlashAttention Baseline 入门](FlashAttention_Baseline入门.md) + +### Track 3:MCTLASS / Fused MoE 算子优化 + +聚焦 MoE 模型中的稀疏专家计算,优化 Fused MoE 算子的执行效率。 + +参考知识:待更新 + +教程链接:[Fused MoE Baseline 入门:快速跑通最小闭环教程](Fused%20MoE%20Baseline入门:快速跑通最小闭环教程.md)