From 9a6058ac4a1e74cdb491520e70f2cbdc5e9eb23b Mon Sep 17 00:00:00 2001 From: Francesco Gatti Date: Thu, 10 Aug 2017 18:47:21 +0200 Subject: [PATCH] removed sync --- src/kernels/activation_elu.cu | 1 - src/kernels/activation_leaky.cu | 1 - src/kernels/activation_logistic.cu | 1 - src/kernels/reorg.cu | 1 - src/kernels/softmax.cu | 1 - 5 files changed, 5 deletions(-) diff --git a/src/kernels/activation_elu.cu b/src/kernels/activation_elu.cu index cb6d420..5d3ef1d 100644 --- a/src/kernels/activation_elu.cu +++ b/src/kernels/activation_elu.cu @@ -34,5 +34,4 @@ void activationELUForward(dnnType* srcData, dnnType* dstData, int size) int threads = 256; activation_elu<<>>(srcData, dstData, size); - checkCuda( cudaDeviceSynchronize() ); } diff --git a/src/kernels/activation_leaky.cu b/src/kernels/activation_leaky.cu index 60466f7..4b0d3e2 100644 --- a/src/kernels/activation_leaky.cu +++ b/src/kernels/activation_leaky.cu @@ -23,7 +23,6 @@ void activationLEAKYForward(dnnType* srcData, dnnType* dstData, int size) int threads = 256; activation_leaky<<>>(srcData, dstData, size); - checkCuda( cudaDeviceSynchronize() ); } diff --git a/src/kernels/activation_logistic.cu b/src/kernels/activation_logistic.cu index 3f59cad..bd2a1e9 100644 --- a/src/kernels/activation_logistic.cu +++ b/src/kernels/activation_logistic.cu @@ -20,7 +20,6 @@ void activationLOGISTICForward(dnnType* srcData, dnnType* dstData, int size) int threads = 256; activation_logistic<<>>(srcData, dstData, size); - checkCuda( cudaDeviceSynchronize() ); } diff --git a/src/kernels/reorg.cu b/src/kernels/reorg.cu index a59ec2e..7afdc2a 100644 --- a/src/kernels/reorg.cu +++ b/src/kernels/reorg.cu @@ -44,7 +44,6 @@ void reorgForward(dnnType* srcData, dnnType* dstData, int threads = 256; reorg_kernel<<>>(size, srcData, w, h, c, n, stride, false, dstData); - checkCuda( cudaDeviceSynchronize() ); } diff --git a/src/kernels/softmax.cu b/src/kernels/softmax.cu index 5ba112b..c746b24 100644 --- a/src/kernels/softmax.cu +++ b/src/kernels/softmax.cu @@ -39,5 +39,4 @@ void softmaxForward(float *input, int n, int batch, int batch_offset, int threads = 256; softmax_kernel<<>>(input, n, batch, batch_offset, groups, group_offset, stride, temp, output); - checkCuda( cudaDeviceSynchronize() ); }