forked from metax-maca/op_optimization
Merge pull request '修改readme' (#18) from beckylu-dev into master
This commit is contained in:
commit
dc99271dd7
|
|
@ -44,7 +44,7 @@
|
|||
**赛题二相关资料**
|
||||
|
||||
- [赛题二方案:基于 AI Agent 开发范式的国产 GPU 大模型推理算子库优化方案](基于AI%20Agent开发范式的国产GPU大模型推理算子库优化/基于AI%20Agent开发范式的国产GPU大模型算子推理库优化方案.md)
|
||||
- [模力方舟 Agent 环境准备教程](基于AI%20Agent开发范式的国产GPU大模型推理算子库优化/模力方舟Agent环境准备教程.md)
|
||||
- [模力方舟 Agent 部署准备教程](基于AI%20Agent开发范式的国产GPU大模型推理算子库优化/模力方舟Agent部署准备教程.md)
|
||||
- [赛题二说明及资料参考](基于AI%20Agent开发范式的国产GPU大模型推理算子库优化/赛题说明.md)
|
||||
|
||||
## 参赛对象
|
||||
|
|
|
|||
|
|
@ -398,9 +398,9 @@ run(q: Tensor, paged_kv_cache: Tensor | Tuple[Tensor, Tensor], *args, q_scale: f
|
|||
|
||||
|
||||
|
||||
#### 教程链接:
|
||||
#### Baseline教程链接:
|
||||
|
||||
<a href="https://gitlink.org.cn/xiao_xiao/op_optimization/webIDE/tree/master/%E5%9F%BA%E4%BA%8EAI%20Agent%E5%BC%80%E5%8F%91%E8%8C%83%E5%BC%8F%E7%9A%84%E5%9B%BD%E4%BA%A7GPU%E5%A4%A7%E6%A8%A1%E5%9E%8B%E6%8E%A8%E7%90%86%E7%AE%97%E5%AD%90%E5%BA%93%E4%BC%98%E5%8C%96/FlashInfer%E5%85%B3%E9%94%AE%E7%AE%97%E5%AD%90%E8%BF%81%E7%A7%BB%E4%B8%8E%E4%BC%98%E5%8C%96.md">FlashInfer关键算子迁移与优化</a>
|
||||
<a href="https://www.gitlink.org.cn/Beckylu/op_optimization/tree/master/%E5%9F%BA%E4%BA%8EAI%20Agent%E5%BC%80%E5%8F%91%E8%8C%83%E5%BC%8F%E7%9A%84%E5%9B%BD%E4%BA%A7GPU%E5%A4%A7%E6%A8%A1%E5%9E%8B%E6%8E%A8%E7%90%86%E7%AE%97%E5%AD%90%E5%BA%93%E4%BC%98%E5%8C%96%2FFlashInfer%E5%85%B3%E9%94%AE%E7%AE%97%E5%AD%90%E8%BF%81%E7%A7%BB%E4%B8%8E%E4%BC%98%E5%8C%96.md">FlashInfer关键算子迁移与优化</a>
|
||||
|
||||
### Track 2:FlashAttention 关键算子迁移与优化
|
||||
|
||||
|
|
@ -611,7 +611,7 @@ OOM 表示 GPU 显存不足,无法完成当前计算。常见原因:
|
|||
|
||||
* [PyTorch CUDA 编程最佳实践](
|
||||
|
||||
教程链接:<a href="https://gitlink.org.cn/xiao_xiao/op_optimization/webIDE/tree/master/%E5%9F%BA%E4%BA%8EAI%20Agent%E5%BC%80%E5%8F%91%E8%8C%83%E5%BC%8F%E7%9A%84%E5%9B%BD%E4%BA%A7GPU%E5%A4%A7%E6%A8%A1%E5%9E%8B%E6%8E%A8%E7%90%86%E7%AE%97%E5%AD%90%E5%BA%93%E4%BC%98%E5%8C%96/FlashAttention%E5%85%B3%E9%94%AE%E7%AE%97%E5%AD%90%E8%BF%81%E7%A7%BB%E4%B8%8E%E4%BC%98%E5%8C%96.md">FlashAttention关键算子迁移与优化</a>
|
||||
Baseline教程链接:<a href="[基于AI Agent开发范式的国产GPU大模型推理算子库优化/FlashAttention关键算子迁移与优化.md-Beckylu/揭榜挂帅-沐曦赛题](https://www.gitlink.org.cn/Beckylu/op_optimization/tree/master/基于AI Agent开发范式的国产GPU大模型推理算子库优化%2FFlashAttention关键算子迁移与优化.md)">FlashAttention关键算子迁移与优化</a>
|
||||
|
||||
### Track 3:MCTLASS / Fused MoE 算子优化
|
||||
|
||||
|
|
|
|||
Loading…
Reference in New Issue