Add missing CUDA kernel to tensor scan op

The TensorScanOp implementation was missing a CUDA kernel launch.
This adds a simple placeholder implementation.
This commit is contained in:
Igor Babuschkin
2016-06-29 11:54:35 +01:00
parent 328c5d876a
commit 85699850d9
3 changed files with 159 additions and 93 deletions

View File

@@ -220,7 +220,7 @@ if(CUDA_FOUND AND EIGEN_TEST_CUDA)
ei_add_test(cxx11_tensor_reduction_cuda)
ei_add_test(cxx11_tensor_argmax_cuda)
ei_add_test(cxx11_tensor_cast_float16_cuda)
# ei_add_test(cxx11_tensor_scan_cuda)
ei_add_test(cxx11_tensor_scan_cuda)
# The random number generation code requires arch 3.5 or greater.
if (${EIGEN_CUDA_COMPUTE_ARCH} GREATER 34)