Skip to content

01 为什么编译与图优化值得单独成章

页面目标

这一页先解释编译与图优化的目标:不是“把图翻译成代码”,而是把高层结构一步步收敛成更高效的执行。

本页的输出是执行链总览:明确图结构、lowering、execution 和 backend 各自改变什么,以及为什么“图正确”不等于“执行高效”。

问题起点

很多性能问题表面上看起来像:

  • 某个模型结构不够好
  • 某个算子实现不够快
  • 某个 backend 没调好

但实际中,问题往往出在“图级判断、lowering 路径和 backend 约束之间没有对齐”。

核心矛盾

编译与图优化想把高层结构变得更高效,但代价是:

  • 需要跨图级、执行级和 backend 级同时看问题
  • 很多“看起来正确”的变换,不一定值得执行
  • 同一张图在不同 backend 上的最优解不一样

进入下一页

进入 02 图结构与 Fusion 决策,先判断哪些图级变化值得进入后续编译链。

可视化入口

Graph to Backend Chain

对应 Part

  • 1E-09 / 19 / 32 / 33
  • 1D-08 / 15 / 18 / 29
  • 2.6 / 2.7 / 2.10

本节要点

编译专题的价值在于:它解释了为什么“图没问题”不等于“执行就高效”。

Released under the MIT License.