01 为什么编译与图优化值得单独成章
页面目标
这一页先解释编译与图优化的目标:不是“把图翻译成代码”,而是把高层结构一步步收敛成更高效的执行。
本页的输出是执行链总览:明确图结构、lowering、execution 和 backend 各自改变什么,以及为什么“图正确”不等于“执行高效”。
问题起点
很多性能问题表面上看起来像:
- 某个模型结构不够好
- 某个算子实现不够快
- 某个 backend 没调好
但实际中,问题往往出在“图级判断、lowering 路径和 backend 约束之间没有对齐”。
核心矛盾
编译与图优化想把高层结构变得更高效,但代价是:
- 需要跨图级、执行级和 backend 级同时看问题
- 很多“看起来正确”的变换,不一定值得执行
- 同一张图在不同 backend 上的最优解不一样
进入下一页
进入 02 图结构与 Fusion 决策,先判断哪些图级变化值得进入后续编译链。
可视化入口
对应 Part
1E-09 / 19 / 32 / 331D-08 / 15 / 18 / 292.6 / 2.7 / 2.10
本节要点
编译专题的价值在于:它解释了为什么“图没问题”不等于“执行就高效”。
