写CUDA到底难在哪?

2025-06-19 21:25:11

对GPU进行性能优化时,cudagraph是绕不开的话题。

不仅是GPU,大部分的xpu都会提供类似graph mode的优化,相比于每次分别由CPU进行kernel launch的eager mode,graph mode通常都会有较大性能提升,然而也经常容易出现各种各样的奇怪问题。

NVIDIA有一个简单的 博客 介绍,其中只使用了stream capture的形式来构造cudagraph,而且本质上就是多个kernel前后提交,根本无法展示cudagraph的复杂性。

本文尝试从底层原理出发,根据文档 和 …。

写CUDA到底难在哪?
广告位810*200
相关阅读
妃子笑是荔枝中最难吃的品种吗?

妃子笑是荔枝中最难吃的品种吗?

分地方,在茂名:是的,妃子笑排最后。 在外地,妃子笑不知道...

2025-06-18
为什么现在没人提猎鹰9号了?

为什么现在没人提猎鹰9号了?

如果是看热闹的乐子人,那确实都不怎么提了。 黑Falcon...

2025-06-18
如何评价 TypeScript?

如何评价 TypeScript?

说句引战的:前端不适合硬上TS,后端更合适。 TS带来的负担...

2025-06-18
Node.js是谁发明的?

Node.js是谁发明的?

ryan dahl。 老哥在全国到处接Web项目的时候实在...

2025-06-18
Go 语言 Web 应用开发框架,Iris、Gin、Echo,哪一个更适合大型项目?

Go 语言 Web 应用开发框架,Iris、Gin、Echo,哪一个更适合大型项目?

项目起因2021 年,我在面试中多次被问到数据库内核相关问题...

2025-06-18