forked from metax-maca/op_optimization
更新README赛题资料链接
This commit is contained in:
parent
b176212911
commit
edb74ed390
21
README.md
21
README.md
|
|
@ -18,6 +18,13 @@
|
|||
|
||||
初赛攻坚 Fused Moe Gemm、决赛冲刺 MLA/NSA,全程基于全国产技术栈开发优化,打造自主可控的低成本大模型推理算子底座。
|
||||
|
||||
**赛题一相关资料**
|
||||
|
||||
- [赛题一方案:基于国产软件栈的推理前沿算子优化比赛方案](<基于国产软件栈大模型推理前沿算子优化/基于国产软件栈的推理前沿算子优化比赛方案.md>)
|
||||
- [TileLang MACA 构建指南(模力方舟)](<基于国产软件栈大模型推理前沿算子优化/tilelang_maca_build_guide_模力方舟.md>)
|
||||
- [TileLang 算子 sample 跑通测试指南](<基于国产软件栈大模型推理前沿算子优化/race_tests_run_guide基于tilelang算子sample跑通测试.md>)
|
||||
- [赛题一国产软件栈样例说明](<基于国产软件栈大模型推理前沿算子优化/race-1-domestic-software-stack-samples.md>)
|
||||
|
||||
### 赛题二:基于 AI Agent 开发范式的国产 GPU 大模型推理算子库优化
|
||||
|
||||
大模型推理高并发、长序列、高调用频次的特性,让 FlashInfer、FlashAttention、Fused MOE 等核心算子,直接决定吞吐、延迟与显存开销,左右每 Token 综合成本。
|
||||
|
|
@ -26,6 +33,11 @@
|
|||
|
||||
从底层算子发力,提速推理、节省显存、拉高 GPU 利用率,从根源压缩每 Token 推理成本,筑牢国产 GPU 推理生态壁垒。
|
||||
|
||||
**赛题二相关资料**
|
||||
|
||||
- [赛题二方案:基于 AI Agent 开发范式的国产 GPU 大模型推理算子库优化方案](<基于AI Agent开发范式的国产GPU大模型推理算子库优化/基于AI Agent开发范式的国产GPU大模型算子推理库优化方案.md>)
|
||||
- [模力方舟 Agent 环境准备教程](<基于AI Agent开发范式的国产GPU大模型推理算子库优化/模力方舟Agent环境准备教程.md>)
|
||||
|
||||
## 参赛对象
|
||||
|
||||
面向全国全日制专科、本科、硕博在校生(非在职),40 周岁以下青年科技人才均可参与;
|
||||
|
|
@ -78,3 +90,12 @@
|
|||
|
||||
👇 报名通道:登录挑战杯官网 [www.tiaozhanbei.net](https://link.wtturl.cn/?target=https%3A%2F%2Fwww.tiaozhanbei.net&scene=im&aid=497858&lang=zh) 揭榜挂帅入口报名
|
||||
|
||||
|
||||
|
||||
## 算力获取和使用
|
||||
|
||||
沐曦开发者社区活动页面,完成新人礼任务,提前熟悉 C500 在线算力使用。https://developer.metax-tech.com/activities/6
|
||||
|
||||
报名赛事后还可额外获得300元算力代金券:https://developer.metax-tech.com/activities/17
|
||||
|
||||
使用指南:[模力方舟快速使用 SOP](<模力方舟快速使用SOP.md>)
|
||||
|
|
|
|||
|
Before Width: | Height: | Size: 9.4 KiB After Width: | Height: | Size: 9.4 KiB |
|
Before Width: | Height: | Size: 44 KiB After Width: | Height: | Size: 44 KiB |
Loading…
Reference in New Issue