|
|
1
2
是的,您可以控制堆栈的大小。它是在内核启动之前的运行时通过API函数设置的:
这个
但要注意堆栈大小。CUDA程序往往有数千个线程同时运行,系统将始终为所有线程维护堆栈内存。因此,您可能会很快耗尽内存。 例如,如果您的目标是4MB堆栈内存,并且运行60个块,每个块中有512个线程(这些都是合理的值!)-这将是60*512*4MB=约30GB的设备内存消耗。大多数GPU的内存都比这少。 通常,大数组最好在所有线程之间共享。 |
|
AstralHex · 矩阵乘法代码工作不正常 1 年前 |
|
|
Fishie · 作为类成员的智能指针是否仍然自动释放?[关闭] 1 年前 |
|
|
Die4Toast · 递归调用成员箭头运算符-> 1 年前 |
|
|
Anka Hanım · 关于结构和动态数组地址的问题 1 年前 |