Например:
Похоже, мне не нужно выполнять cudaHostUnregister и CudaHostRegister, если я переключу устройство.
Производительность и общая память обоих графических процессоров тоже не изменяются. много..
// Set Device to 0
cudaError_t cudaStatus = cudaSetDevice(0);
// Allocate buffers
int size = 8192;
float* cpuBuffer = new float[size * size];
auto totalBytes = sizeof(float) * size * size;
cudaHostRegister((void*)cpuBuffer, totalBytes, cudaHostRegisterPortable);
float* gpuBuffer = nullptr;
cudaMalloc((void**)&gpuBuffer, totalBytes);
// Transfer
cudaMemcpy((void*)gpuBuffer, (const void*)cpuBuffer, totalBytes, cudaMemcpyHostToDevice);
// Free gpu
cudaFree(gpuBuffer);
//cudaHostUnregister(cpuBuffer);
// Switch to Device 1
cudaStatus = cudaSetDevice(1);
cudaMalloc((void**)&gpuBuffer, totalBytes);
//cudaHostRegister((void*)cpuBuffer, totalBytes, cudaHostRegisterPortable);
// Transfer
cudaMemcpy((void*)gpuBuffer, (const void*)cpuBuffer, totalBytes, cudaMemcpyHostToDevice);
cudaFree(gpuBuffer);
cudaHostUnregister(cpuBuffer);
delete[] cpuBuffer;
Подробнее здесь: https://stackoverflow.com/questions/791 ... ice-with-c