写CUDA到底难在哪?

2025-06-20 09:00:17

对GPU进行性能优化时,cudagraph是绕不开的话题。

不仅是GPU,大部分的xpu都会提供类似graph mode的优化,相比于每次分别由CPU进行kernel launch的eager mode,graph mode通常都会有较大性能提升,然而也经常容易出现各种各样的奇怪问题。

NVIDIA有一个简单的 博客 介绍,其中只使用了stream capture的形式来构造cudagraph,而且本质上就是多个kernel前后提交,根本无法展示cudagraph的复杂性。

本文尝试从底层原理出发,根据文档 和 …。

写CUDA到底难在哪?
广告位810*200
相关阅读
你看过最绝望的一张图片?

你看过最绝望的一张图片?

仅在2025年上半天就刷新出来的boss数量,够不够绝望? ...

2025-06-20
如何评价张智霖袁咏仪夫妇?

如何评价张智霖袁咏仪夫妇?

有人说:袁咏仪是一个极其彪悍的女人! 2004年,小S在...

2025-06-20
NAS将来会被什么产品取代?

NAS将来会被什么产品取代?

猜测一下,我认为可以被区域中心存储服务器取代。 原因是个人...

2025-06-20
同事连续几天把孩子带来上班,你们有过这样的经历吗?

同事连续几天把孩子带来上班,你们有过这样的经历吗?

前些年,同事大姐暑***的时候,孩子在家每人带。 时不时带来...

2025-06-20
有人 espresso 直接喝吗,为什么?

有人 espresso 直接喝吗,为什么?

八九十年代,下地干活的中老年人, 天蒙蒙亮起床第一件事,找去...

2025-06-20