From 4f2aa14e92353e382e59bae98abe2c19e652ebd7 Mon Sep 17 00:00:00 2001 From: cory Date: Fri, 7 Aug 2026 16:35:06 +0800 Subject: [PATCH] =?UTF-8?q?=E6=96=B0=E5=A2=9E=20=E6=B2=90=E6=9B=A6?= =?UTF-8?q?=E9=80=9A=E7=94=A8GPU=20MXMACA=E7=BC=96=E8=AF=91=E5=99=A8?= =?UTF-8?q?=E5=86=85=E5=BB=BA=E5=87=BD=E6=95=B0=E7=BC=96=E7=A8=8B=E6=8C=87?= =?UTF-8?q?=E5=8D=97=20=E5=85=A5=E5=8F=A3?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit --- README.md | 3 ++- 1 file changed, 2 insertions(+), 1 deletion(-) diff --git a/README.md b/README.md index 2bf93cc..709bc76 100644 --- a/README.md +++ b/README.md @@ -3,6 +3,7 @@ ## 常用入口 - [常见问题 FAQ](FAQ.md) +- [沐曦通用GPU MXMACA编译器内建函数编程指南](https://developer.metax-tech.com/api/client/document/preview/1395/index.html) ## XPU-OJ 基线修复及榜单调整通知 @@ -45,7 +46,7 @@ ### 赛题二:基于 AI Agent 开发范式的国产 GPU 大模型推理算子库优化 -大模型推理具有高并发、长序列、高调用频次等特点,FlashInfer、FlashAttention、Fused MoE 等核心算子直接决定模型服务的吞吐、延迟与显存开销,影响单 Token 综合推理成本。 +大模型推理具有高并发、长序列、高���用频次等特点,FlashInfer、FlashAttention、Fused MoE 等核心算子直接决定模型服务的吞吐、延迟与显存开销,影响单 Token 综合推理成本。 本赛题面向沐曦国产 GPU 及 MXMACA 软件栈,鼓励参赛团队构建或使用 AI Agent / Skill 工作流,围绕推理算子库开展代码理解、算子迁移、性能分析、Kernel 优化、自动调优、Benchmark 验证和多轮迭代,探索“Agent 驱动算子优化”的新型开发范式。