Мне нужно сделать этот код более эффективным, не увеличивая количество потоков, я буду признателен за любые советы или темы, в которых я могу найти необходимую информацию.
Я хотел бы повысить эффективность этого кода и масштабировать его для больших интервалов времени, что бы будет ли это наиболее эффективным способом?
Я пытался увеличить количество потоков, исходя из собственного опыта. Я сделал все, что мог, но мне нужны советы или темы о том, как сделать это более эффективным
#include "cuda_runtime.h"
#include "device_launch_parameters.h"
#include
#include
using namespace std;
const int startInterval = 1000;
const int endInterval = 1999;
__global__ void runOnGPU(int* results, int* result_count)
{
int startIdx = threadIdx.x + startInterval; // Each thread starts at its corresponding index.
bool isPrime = true;
while (startIdx
Подробнее здесь: https://stackoverflow.com/questions/793 ... an-improve