关于本站
本站是个人在学习与工作过程中的技术笔记整理,主要用于沉淀与分享高性能计算、GPU 内核开发、编译器以及大规模 AI 系统相关的实践经验。内容以个人记录和总结为主,欢迎交流指正。
高性能计算 HPC
CUDA / SYCL
GPU 内核优化
编译器
大模型推理
容器与分布式
重点关注方向
- GPU 设备编程与内核优化(CUDA / SYCL / Triton 等)
- 编译器前后端与中间表示(LLVM、调度与向量化)
- 大模型推理与高性能训练系统的工程实践
- AI 系统的工具链与自动化
说明
本站内容为个人学习使用,不涉及商业运营。若涉及任何技术点欢迎通过技术社区交流,共同探讨学习。
本站已进行 ICP 备案登记(备案审核中)。