I've learned to expect Windows builds to be a nightmare, but this surprises me, as it's unclear how it could arise from a faulty environment:
[..compiling fine...]
nvcc -O3 -DADD_ --compiler-options -DWIN64 -DWINDOWS -DWIN -DGPUSHMEM=200 -DHAVE_CUBLAS -gencode arch=compute_20,code=sm_20 -gencode arch=compute_20,code=compute_20 -I"C:/Program Files/NVIDIA GPU Computing Toolkit/CUDA/v5.5"/include -I../include -I../control -c zlacpy_batched.cu -o zlacpy_batched.cu_o
nvcc -O3 -DADD_ --compiler-options -DWIN64 -DWINDOWS -DWIN -DGPUSHMEM=200 -DHAVE_CUBLAS -gencode arch=compute_20,code=sm_20 -gencode arch=compute_20,code=compute_20 -I"C:/Program Files/NVIDIA GPU Computing Toolkit/CUDA/v5.5"/include -I../include -I../control -c zlaqps2_gpu.cu -o zlaqps2_gpu.cu_o
nvcc -O3 -DADD_ --compiler-options -fno-strict-aliasing -DUNIX -DGPUSHMEM=200 -DHAVE_CUBLAS -gencode arch=compute_20,code=sm_20 -gencode arch=compute_20,code=compute_20 -I"C:/Program Files/NVIDIA GPU Computing Toolkit/CUDA/v5.5"/include -I../include -I../control -c zlaqps3_gpu.cu -o zlaqps3_gpu.cu_o
zlaqps3_gpu.cu(144): error: calling a __host__ function("_copysign") from a __global__ function("magma_zscale_kernel") is not allowed
1 error detected in the compilation of "C:/cygwin64/tmp/tmpxft_00002104_00000000-8_zlaqps3_gpu.cpp1.ii".
cl : Command line warning D9002 : ignoring unknown option '-fno-strict-aliasing'
zlaqps3_gpu.cu
../Makefile.internal:92: recipe for target `zlaqps3_gpu.cu_o' failed
make[1]: *** [zlaqps3_gpu.cu_o] Error 2
[etc.]
I'm compiling in Cygwin with gcc 4.8.1 on Windows 8, with OpenBLAS, using CUDA 5.5 on a 650m. I've compiled with OpenBLAS successfully on Ubuntu 12.04 (on a different machine). As you can see, other functions compile successfully before it breaks here, such as zlaqps2_gpu.cu immediately before it. Anybody see anything wrong with my make.inc file?
GPU_TARGET = Fermi
CC = gcc
NVCC = nvcc
FORT = gfortran
ARCH = ar
ARCHFLAGS = cr
RANLIB = ranlib
OPTS = -O3 -DADD_
F77OPTS = -O3 -DADD_
FOPTS = -O3 -DADD_ -x f95-cpp-input
NVOPTS = -O3 -DADD_ --compiler-options -fno-strict-aliasing -DWIN64
LDOPTS = -fPIC -Xlinker -zmuldefs
LIB = -lopenblas -lpthread -lcublas -lcudart -lm
CUDADIR = "C:/Program Files/NVIDIA GPU Computing Toolkit/CUDA/v5.5"
LIBDIR = -LC:/Users/matt/Libraries/openblas/openblas-0.2.8 \
-L$(CUDADIR)/lib/x64
INC = -I$(CUDADIR)/include