Started to vectorize the processing of 16bit floats on CPU.

This commit is contained in:
Benoit Steiner
2016-05-23 15:21:40 -07:00
parent 5d51a7f12c
commit 7d980d74e5
3 changed files with 478 additions and 4 deletions

View File

@@ -353,13 +353,14 @@ using std::ptrdiff_t;
#include "src/Core/arch/ZVector/Complex.h"
#endif
// Half float support
#include "src/Core/arch/CUDA/Half.h"
#include "src/Core/arch/CUDA/PacketMathHalf.h"
#include "src/Core/arch/CUDA/TypeCasting.h"
#if defined EIGEN_VECTORIZE_CUDA
#include "src/Core/arch/CUDA/PacketMath.h"
#include "src/Core/arch/CUDA/PacketMathHalf.h"
#include "src/Core/arch/CUDA/MathFunctions.h"
#include "src/Core/arch/CUDA/TypeCasting.h"
#endif
#include "src/Core/arch/Default/Settings.h"