forked from metax-maca/op_optimization
赛题二readme更新
This commit is contained in:
commit
2c4a21f45c
|
|
@ -0,0 +1,33 @@
|
|||
# 赛题说明
|
||||
|
||||
## 一、赛题简要说明
|
||||
|
||||
待更新
|
||||
|
||||
## 二、任务方向
|
||||
|
||||
参赛团队可围绕以下推理算子库或核心算子,选择一类或多类任务开展优化工作:
|
||||
|
||||
### Track 1:FlashInfer 关键算子迁移与优化
|
||||
|
||||
面向 Prefill、Decode、Paged KV Cache、MLA Attention 等推理场景,完成 MACA 平台适配与性能优化。
|
||||
|
||||
参考知识:待更新
|
||||
|
||||
教程链接:[FlashInfer 迁移 Baseline 实战](FlashInfer%20迁移%20Baseline%20实战.md)
|
||||
|
||||
### Track 2:FlashAttention 关键算子迁移与优化
|
||||
|
||||
围绕 `flash_attn_with_kvcache` 等核心接口,提升长序列场景下的 Attention 计算性能。
|
||||
|
||||
参考知识:待更新
|
||||
|
||||
教程链接:[FlashAttention Baseline 入门](FlashAttention_Baseline入门.md)
|
||||
|
||||
### Track 3:MCTLASS / Fused MoE 算子优化
|
||||
|
||||
聚焦 MoE 模型中的稀疏专家计算,优化 Fused MoE 算子的执行效率。
|
||||
|
||||
参考知识:待更新
|
||||
|
||||
教程链接:[Fused MoE Baseline 入门:快速跑通最小闭环教程](Fused%20MoE%20Baseline入门:快速跑通最小闭环教程.md)
|
||||
Loading…
Reference in New Issue