内容简介
《深入理解 LLVM:MLIR 原理与 OpenAI Triton 实现分析》是一本聚焦现代 AI 编译器核心技术的专业著作,串联 LLVM 编译体系、MLIR 多层中间表示架构与 OpenAI Triton 编译框架,填补了底层编译原理与 AI 工程落地之间的知识空白。全书兼顾理论深度与实战落地,适合编译器开发、深度学习优化、GPU 异构计算领域的从业者与学习者阅读。
本书摒弃繁杂冗余的基础赘述,聚焦行业核心技术痛点,系统讲解 MLIR 的底层设计逻辑,详解其多层 Dialect 架构、编译 Pass 流程、层级化优化机制,阐释 MLIR 相较于传统 LLVM 单一中间表示的灵活优势,以及其适配多硬件、多 AI 框架的核心原理。同时,书籍以 OpenAI Triton 为核心落地案例,完整拆解其编译流水线,清晰梳理从 Python 语法树、Triton 专属 IR、MLIR 层级降级到 LLVM 后端生成硬件指令的全流程。
《深入理解 LLVM:MLIR 原理与 OpenAI Triton 实现分析》书中结合大量实操案例与源码解析,对比传统 CUDA 编程与 Triton 轻量化 GPU 编程的差异,讲解 Triton 无需底层硬件知识即可实现高性能算子开发的核心优势,剖析其内存布局优化、动态编译、自动并行调度等关键技术。
全书逻辑清晰、层层递进,打通了LLVM 底层编译、MLIR 架构设计、Triton 工程落地三大技术板块,既适合零基础读者搭建 AI 编译技术体系,也能帮助资深开发者深耕算子优化、模型部署与异构编译进阶技术,是一本兼具学术价值与工程实用性的 AI 编译器进阶工具书。

作者简介
👤 彭成寒
AI编译器与虚拟机技术专家,目前专注于LLVM、MLIR相关的AI编译器研究,并在JVM、V8和WebAssembly等虚拟机技术方面有着丰富的研发经验。深耕IT领域近20年,曾涉足应用软件和大数据开发等多个领域,并著有《深入理解LLVM:代码生成》《JVM G1源码分析和调优》《新一代垃圾回收器ZGC设计与实现》《深入探索JVM垃圾回收:ARM服务器垃圾回收的挑战和优化》等重要领域专著。
👤 俞佳嘉
华为编译器与编程语言实验室鸿蒙开发者生态构建技术首席专家。拥有10余年底层技术研发经验,曾在Intel、Microsoft、华为等公司从事过编译器、虚拟机、指令翻译等相关研发工作,并深入参与了Intel Houdini、华为方舟编译器等产品的核心研发工作。
👤 李灵
从事AI编译器研发工作,拥有7年编译器和虚拟机相关研发工作经验,曾深度参与多项LLVM/MLIR编译器研发工作。
👤 李存
从事AI编译器相关工作,拥有6年体系结构相关底软研发经验,曾深度参与龙芯中科二进制翻译器、华为AI编译器项目。










京公网安备11010502052249号