cavis

Author	SHA1	Message	Date
Ryan Nett	79867f5c5a	cleanup SDRNN and rnn ops (#238 ) Signed-off-by: Ryan Nett <rnett@skymind.io>	2019-09-05 12:25:03 +10:00
shugeo	548044a1e2	Shugeo doc (#235 ) * Actualized doc to tnse ops. * Added comments for dynamic_stitch op. * Added comments to dynamic_stitch op implementation. * Modified comment for unstack_list op. * Added doc for space_to_depth and depth_to_space ops. * Added doc for space_to_batch op. * Enlarge test type for adjustSaturation. * Added doc for runner.	2019-09-04 14:57:59 +03:00
raver119	a90c7dd995	[WIP] Last set of changes (#234 ) * mmul op instead of cublasSgemm Signed-off-by: raver119 <raver119@gmail.com> * transB Signed-off-by: raver119 <raver119@gmail.com> * jcpp handles Signed-off-by: raver119 <raver119@gmail.com> * bitwise and/or/xor Signed-off-by: raver119 <raver119@gmail.com> * bitwise and/or/xor mapping Signed-off-by: raver119 <raver119@gmail.com> * cuda/cublas version check Signed-off-by: raver119 <raver119@gmail.com> * add expected version Signed-off-by: raver119 <raver119@gmail.com> * cuda/cublas version check in java Signed-off-by: raver119 <raver119@gmail.com> * one more error check Signed-off-by: raver119 <raver119@gmail.com> * build fix Signed-off-by: raver119 <raver119@gmail.com> * build fix Signed-off-by: raver119 <raver119@gmail.com> * build fix Signed-off-by: raver119 <raver119@gmail.com> * one more fix Signed-off-by: raver119 <raver119@gmail.com> * skip CUDA version check for now Signed-off-by: raver119 <raver119@gmail.com> * better wording Signed-off-by: raver119 <raver119@gmail.com> * few more tweaks Signed-off-by: raver119 <raver119@gmail.com> * few more tweaks Signed-off-by: raver119 <raver119@gmail.com>	2019-09-04 14:41:08 +03:00
Alex Black	6cc887bee9	Rename flatbuffers DataType to DType (#228 ) * Rename flatbuffers DataType enum to DType Signed-off-by: Alex Black <blacka101@gmail.com> * Rename flatbuffers DataType enum to DType Signed-off-by: Alex Black <blacka101@gmail.com> * Updates for flatbuffers datatype enum renaming Signed-off-by: Alex Black <blacka101@gmail.com>	2019-09-04 16:36:11 +10:00
raver119	dddc8a1143	[WIP] Thread safety (#229 ) * sync after cublasgemm Signed-off-by: raver119 <raver119@gmail.com> mutex for CublasHelper Signed-off-by: raver119 <raver119@gmail.com> * don't store cublasHandle in LaunchContext, it's per-device anyway Signed-off-by: raver119 <raver119@gmail.com> * some printout Signed-off-by: raver119 <raver119@gmail.com> * check for field instead Signed-off-by: raver119 <raver119@gmail.com> * pew-pew Signed-off-by: raver119 <raver119@gmail.com> * don't release ContextBuffers until device changed Signed-off-by: raver119 <raver119@gmail.com> * small tweak Signed-off-by: raver119 <raver119@gmail.com> * some logging in sgemm Signed-off-by: raver119 <raver119@gmail.com> * stream sync Signed-off-by: raver119 <raver119@gmail.com> * some more logging Signed-off-by: raver119 <raver119@gmail.com> * some more error checks Signed-off-by: raver119 <raver119@gmail.com> * one fancy test Signed-off-by: raver119 <raver119@gmail.com> * one fancy test Signed-off-by: raver119 <raver119@gmail.com> * minor AffinityManager fix Signed-off-by: raver119 <raver119@gmail.com> * cudaEvent error logging improvement Signed-off-by: raver119 <raver119@gmail.com> * ConstantHelper thread safety Signed-off-by: raver119 <raver119@gmail.com> * - minor corrections in ConstantTadHelper Signed-off-by: Yurii <yurii@skymind.io> * ConstantShapeHelper thread safety Signed-off-by: raver119 <raver119@gmail.com> * ConstantTadHelper.cu updated Signed-off-by: raver119 <raver119@gmail.com> * logging off Signed-off-by: raver119 <raver119@gmail.com> * logging off Signed-off-by: raver119 <raver119@gmail.com>	2019-09-03 22:00:38 +03:00
Yurii Shyrma	cb4c9377b1	Shyrma docs (#222 ) * - documenting and profiling matrix_set_diag cuda kernel Signed-off-by: Yurii <yurii@skymind.io> * - correct formula of pnorm pooling in cuda 2d/3d kernels - remove helper matrix_diag which duplicates work of helper matrix_set_diag Signed-off-by: Yurii <yurii@skymind.io>	2019-09-02 16:25:58 +03:00
raver119	106524663b	fix double consumption of rng on cpu Signed-off-by: raver119 <raver119@gmail.com>	2019-09-02 15:24:51 +03:00
AlexDBlack	7ded4416cb	Merge remote-tracking branch 'fork/master'	2019-09-02 18:52:12 +10:00
raver119	5b8ea3e830	one more tiny cuda fux Signed-off-by: raver119 <raver119@gmail.com>	2019-09-02 11:49:13 +03:00
raver119	e42c34ca55	[WIP] minor (#218 ) * - initial docs commit - merge* cuda fix Signed-off-by: raver119 <raver119@gmail.com> * one more fix Signed-off-by: raver119 <raver119@gmail.com> * one more fix Signed-off-by: raver119 <raver119@gmail.com>	2019-09-02 11:25:48 +03:00
raver119	c34826da4d	fixed args Signed-off-by: raver119 <raver119@gmail.com>	2019-09-01 22:06:01 +03:00
raver119	00cf28f477	get rid of builtin_popcount to please ppc Signed-off-by: raver119 <raver119@gmail.com>	2019-09-01 19:57:39 +03:00
raver119	3679e55c49	fix bits_hamming_distance for ppc Signed-off-by: raver119 <raver119@gmail.com>	2019-09-01 19:33:23 +03:00
Yurii Shyrma	a35926c6e9	- add parameter alpha to elu and lrelu_bp (#213 ) * - add parameter alpha to elu and lrelu_bp Signed-off-by: Yurii <yurii@skymind.io> * - forgot to correct header activations.h Signed-off-by: Yurii <yurii@skymind.io>	2019-08-31 20:57:39 +03:00
raver119	b71c993ded	[WIP] maxpool_bp cuda fix (#212 ) * one test for alex Signed-off-by: raver119 <raver119@gmail.com> * fix Signed-off-by: raver119 <raver119@gmail.com> * get rid of safety offset in cpp Signed-off-by: raver119 <raver119@gmail.com> * bfloat16 Signed-off-by: raver119 <raver119@gmail.com> * minor test rearrangement to fastpath launch Signed-off-by: raver119 <raver119@gmail.com> * - atomicAdd/Mul/Div fix for float16/bfloat16 misalignment - one special test for maxpoolbp java - safety offset of 8 bytes is back to libnd4j legacy Signed-off-by: raver119 <raver119@gmail.com>	2019-08-31 20:57:05 +03:00
Yurii Shyrma	00fd50cee2	Shyrma softmax (#209 ) * - provide new cuda kernel for softmax Signed-off-by: Yurii <yurii@skymind.io> * - further work on cuda kernel for softmax Signed-off-by: Yurii <yurii@skymind.io> * - correction cuda kernel for softmax Signed-off-by: Yurii <yurii@skymind.io>	2019-08-30 20:31:05 +03:00
raver119	bdc3eacafd	one small playground test Signed-off-by: raver119 <raver119@gmail.com>	2019-08-30 20:13:01 +03:00
raver119	70a9ae5068	[WIP] few tweaks (#206 ) * scatter empty check Signed-off-by: raver119 <raver119@gmail.com> * scatter empty test Signed-off-by: raver119 <raver119@gmail.com> * one more test Signed-off-by: raver119 <raver119@gmail.com> * two tweaks Signed-off-by: raver119 <raver119@gmail.com> * dup tweak Signed-off-by: raver119 <raver119@gmail.com> * - put empty checking of indices array immediately prior helper run Signed-off-by: Yurii <yurii@skymind.io> * minor tests fix Signed-off-by: raver119 <raver119@gmail.com> * minor tests fix Signed-off-by: raver119 <raver119@gmail.com>	2019-08-30 16:32:01 +03:00
raver119	1003428a18	[WIP] Int broadcastables (#195 ) * Removed invalid resource and fixed tests Signed-off-by: Alexander Stoyakin <alexander.stoyakin@gmail.com> * legacy scalar/pairwise/broadcast int ops Signed-off-by: raver119 <raver119@gmail.com> * NDArray int broadcastables Signed-off-by: raver119 <raver119@gmail.com> * few more bitwise tests Signed-off-by: raver119 <raver119@gmail.com> * java side update Signed-off-by: raver119 <raver119@gmail.com> * Argument type changed for shift ops Signed-off-by: Alexander Stoyakin <alexander.stoyakin@gmail.com> * legacy scalar/pairwise/broadcast int ops Signed-off-by: raver119 <raver119@gmail.com> * NDArray int broadcastables Signed-off-by: raver119 <raver119@gmail.com> * few more bitwise tests Signed-off-by: raver119 <raver119@gmail.com> * java side update Signed-off-by: raver119 <raver119@gmail.com> * Argument type changed for shift ops Signed-off-by: Alexander Stoyakin <alexander.stoyakin@gmail.com>	2019-08-30 10:12:40 +03:00
Yurii Shyrma	5395d4fbe5	- rewrite broadcast_dynamic_shape and delete corresponding helpers (#194 ) Signed-off-by: Yurii <yurii@skymind.io>	2019-08-29 20:38:02 +03:00
Yurii Shyrma	70af8c2afc	Shyrma svd (#191 ) * - add one additional test for svd * - provide float argument in eye op to be a type of output array Signed-off-by: Yurii <yurii@skymind.io> * - add cuda capability check to mmulHelper Signed-off-by: Yurii <yurii@skymind.io> * - make use another method for divice id evaluation Signed-off-by: Yurii <yurii@skymind.io> * Eye data type as T argument Signed-off-by: raver119 <raver119@gmail.com>	2019-08-28 18:27:08 +03:00
raver119	dec296da17	[WIP] bits_hamming_distance (#192 ) * bits_hamming_distance op Signed-off-by: raver119 <raver119@gmail.com> * bits_hamming_distance cuda Signed-off-by: raver119 <raver119@gmail.com>	2019-08-28 18:20:44 +03:00
raver119	f4860574d7	[WIP] More fixes (#190 ) * Refactored kernels for segment_max/min/sum ops. * Refactored segment_prod kernels. * Refactored segment_prod kernels. * DynamicPartition test Signed-off-by: raver119 <raver119@gmail.com> * Addede linear test for dynamic_partition op. * Refactored test with int datatype. * some logging Signed-off-by: raver119 <raver119@gmail.com> * some logging Signed-off-by: raver119 <raver119@gmail.com> * some logging Signed-off-by: raver119 <raver119@gmail.com> * dynamicPartition fix Signed-off-by: raver119 <raver119@gmail.com> * get rid of some logging Signed-off-by: raver119 <raver119@gmail.com> * one more test for dynamic_stitch Signed-off-by: raver119 <raver119@gmail.com> * one more test for dynamic_stitch Signed-off-by: raver119 <raver119@gmail.com> * empty check for stitch Signed-off-by: raver119 <raver119@gmail.com> * minor print changes Signed-off-by: raver119 <raver119@gmail.com>	2019-08-28 15:38:57 +03:00
raver119	3157ec110c	[WIP] reverse_sequence (#188 ) * initial commit Signed-off-by: raver119 <raver119@gmail.com> * one more print Signed-off-by: raver119 <raver119@gmail.com> * minor fix Signed-off-by: raver119 <raver119@gmail.com> * reverse_sequence fix Signed-off-by: raver119 <raver119@gmail.com> * confusion_matrix test updated Signed-off-by: raver119 <raver119@gmail.com> * minor tweak Signed-off-by: raver119 <raver119@gmail.com> * minor tweak Signed-off-by: raver119 <raver119@gmail.com> * one more reverse_sequence test Signed-off-by: raver119 <raver119@gmail.com>	2019-08-28 11:14:22 +03:00
raver119	b472d7d8c8	[WIP] few more fixes (#182 ) * one noop test Signed-off-by: raver119 <raver119@gmail.com> * skip input validation for no-input ops Signed-off-by: raver119 <raver119@gmail.com> * - one more noop empty test - one more validation before sync Signed-off-by: raver119 <raver119@gmail.com> * typo Signed-off-by: raver119 <raver119@gmail.com> * one more validation fix Signed-off-by: raver119 <raver119@gmail.com> * CUDA empty reductions java side Signed-off-by: raver119 <raver119@gmail.com> * one svd test Signed-off-by: raver119 <raver119@gmail.com> * Corrected segment_mean helpers and added another test. * Refactored segment_mean kernels to avoid race_condition.	2019-08-27 21:00:38 +03:00
Yurii Shyrma	2144941313	Shyrma fix2 (#186 ) * - further work on layer_norm Signed-off-by: Yurii <yurii@skymind.io> * - further work on layer_norm 2 Signed-off-by: Yurii <yurii@skymind.io> * - correct helpers for svd cuda Signed-off-by: Yurii <yurii@skymind.io>	2019-08-27 19:57:59 +03:00
shugeo	0849b3c1a4	Shugeo segment fix2 (#185 ) * Added test for segment_mean. * Added another test for segment_mean. * Fixed segment_* ops helpers for cuda to proper use external data.	2019-08-27 18:25:39 +03:00
raver119	7f0c660d8b	[WIP] HGemm (#181 ) * skip string arrays for device validation Signed-off-by: raver119 <raver119@gmail.com> * confusion_matrix fix Signed-off-by: raver119 <raver119@gmail.com> * exclude cublasHGemm from archs < 530 Signed-off-by: raver119 <raver119@gmail.com>	2019-08-27 15:05:43 +03:00
raver119	0e523490e9	[WIP] confusion (#180 ) * skip string arrays for device validation Signed-off-by: raver119 <raver119@gmail.com> * confusion_matrix fix Signed-off-by: raver119 <raver119@gmail.com>	2019-08-27 14:30:37 +03:00
raver119	a49f7c908b	[WIP] More fixes (#178 ) * skip string arrays for device validation Signed-off-by: raver119 <raver119@gmail.com> * histogram_fixed_width now really supports indexing types Signed-off-by: raver119 <raver119@gmail.com>	2019-08-27 13:21:01 +03:00
raver119	efbfafe3f7	[WIP] gatherND fix (#176 ) * one test for gather_nd Signed-off-by: raver119 <raver119@gmail.com> * get rid of old concat tests Signed-off-by: raver119 <raver119@gmail.com> * one printf Signed-off-by: raver119 <raver119@gmail.com> * one more legacy test removed Signed-off-by: raver119 <raver119@gmail.com> * gatherNd launch params fix Signed-off-by: raver119 <raver119@gmail.com> * gatherNd launch params fix Signed-off-by: raver119 <raver119@gmail.com>	2019-08-27 12:35:14 +03:00
raver119	df84bc7255	[WIP] More tweaks (#173 ) * CUDA empty reduction Signed-off-by: raver119 <raver119@gmail.com> * - listdiff synchronization fix for CUDA - listdiff test Signed-off-by: raver119 <raver119@gmail.com> * - IndexReduce ops now allow INDEXING_TYPES output - topK op accepts only INDEXING_TYPES as output Signed-off-by: raver119 <raver119@gmail.com>	2019-08-27 10:37:10 +03:00
raver119	25e5c23eae	[WIP] Error handling (#169 ) * CUDA reverse rewrite + couple of tests Signed-off-by: raver119 <raver119@gmail.com> * don't throw exception on invalid pointer Signed-off-by: raver119 <raver119@gmail.com> * data types validation for fastpath exec mode + 2 tests Signed-off-by: raver119 <raver119@gmail.com> * data types validation for fastpath exec mode + 2 tests Signed-off-by: raver119 <raver119@gmail.com> * ismax allowed dtypes tweak Signed-off-by: raver119 <raver119@gmail.com> * lastErrorCode + lastErrorMessage for native exceptions handling Signed-off-by: raver119 <raver119@gmail.com> * exportable ErrorReference Signed-off-by: raver119 <raver119@gmail.com> * check error codes in java Signed-off-by: raver119 <raver119@gmail.com> * - consume lastErrorCode - fast_in dtype validation fix Signed-off-by: raver119 <raver119@gmail.com> * - sg/cb allowed output type change - minor logging fix for data type validation Signed-off-by: raver119 <raver119@gmail.com>	2019-08-26 19:57:51 +03:00
raver119	bb5fc36e5e	[WIP] ops fixes (#168 ) * - correct layer_norm Signed-off-by: Yurii <yurii@skymind.io> * - further fix of layer norm Signed-off-by: Yurii <yurii@skymind.io> * - correct scatter_upd op Signed-off-by: Yurii <yurii@skymind.io> * - correct cuda kernel for histogram_fixed_width op Signed-off-by: Yurii <yurii@skymind.io> * - delete comments Signed-off-by: Yurii <yurii@skymind.io> * enabled one ignored test Signed-off-by: raver119 <raver119@gmail.com>	2019-08-26 19:37:05 +03:00
Alex Black	b417ca21bf	Fix for concat op shape function (empty shapes) (#167 ) Signed-off-by: AlexDBlack <blacka101@gmail.com>	2019-08-26 23:10:28 +10:00
raver119	daf5420f4c	cmake fix for windows debug build Signed-off-by: raver119 <raver119@gmail.com>	2019-08-26 08:13:22 +03:00
raver119	ece6a17b11	lup context fix (#164 ) Signed-off-by: raver119 <raver119@gmail.com>	2019-08-24 16:57:48 +03:00
raver119	841eeb56c5	get rid of context variable Signed-off-by: raver119 <raver119@gmail.com>	2019-08-24 16:18:38 +03:00
raver119	b091e972ef	- string NDArray flat serde impl + tests (#163 ) - string NDArray equalsTo impl Signed-off-by: raver119 <raver119@gmail.com>	2019-08-24 14:16:34 +03:00
raver119	f8364997c0	[WIP] maxpool2d_bp fix (#160 ) * one test for maxpool2d_bp Signed-off-by: raver119 <raver119@gmail.com> * - maxpool2d_bp cuda fix for NaNs - streamSync after each custom op execution Signed-off-by: raver119 <raver119@gmail.com>	2019-08-24 09:20:57 +03:00
raver119	f03b0ee78f	[WIP] more fixes (#159 ) * Added test for MatrixInverse with double input. Fixed matrixDeterminantKernel. * Fixed kernels to avoid waste templating. * Fixed logDeterminant kernel. * Refactored type check for lup' * - decrease blockDim value for zeta op Signed-off-by: Yurii <yurii@skymind.io> * Added print for compound matrix with CUDA. * Refactored upper matrix invertion kernels. * - provide move constructor and move assignment operator for OpArgsHoder class Signed-off-by: Yurii <yurii@skymind.io> * Refactored usage of launch context. * - add test for mergemax Signed-off-by: Yurii <yurii@skymind.io> * get rid of AveragingArrayProxy Signed-off-by: raver119 <raver119@gmail.com> * Refactoring of LUP inversion. * Added prints for invertion. * - add OpArgsHolder copy constructor and assignment operator Signed-off-by: Yurii <yurii@skymind.io> * Added test for lower inversion * - fix bug in upsampling2d/3d_bp op Signed-off-by: Yurii <yurii@skymind.io> * Added expensive printfs to kernel. * Refactored expensive kernel prints. * Refactored expensive printfs * - remove nullify Signed-off-by: Yurii <yurii@skymind.io> * Eliminated waste prints with tests. * upsampling2d_bp test Signed-off-by: raver119 <raver119@gmail.com> * test updated Signed-off-by: raver119 <raver119@gmail.com>	2019-08-23 19:20:50 +03:00
raver119	99cdf6d42b	- cpu isMax fix for multidim case + test - INDArray.wasClosed() fix for empty array edge case Signed-off-by: raver119 <raver119@gmail.com>	2019-08-23 18:44:37 +03:00
raver119	fb8de5006f	- concat empty scalar fix - couple of tests for empty scalar concat Signed-off-by: raver119 <raver119@gmail.com>	2019-08-23 13:16:50 +03:00
raver119	729dc5e879	[WIP] size etc (#155 ) * one test for size Signed-off-by: raver119 <raver119@gmail.com> * - few tests for size op - size/rank/size_at ops now use p instead of assign Signed-off-by: raver119 <raver119@gmail.com>	2019-08-23 12:31:12 +03:00
raver119	243bf866c4	[WIP] Few fixes (#153 ) * throw exception if op execution failed Signed-off-by: raver119 <raver119@gmail.com> * expected for test Signed-off-by: raver119 <raver119@gmail.com> * one more ismax test Signed-off-by: raver119 <raver119@gmail.com> * ismax view fix Signed-off-by: raver119 <raver119@gmail.com>	2019-08-23 09:00:10 +03:00
raver119	930b49e87f	[WIP] DeviceLocalNDArray updates (#149 ) * ContextBuffers are released upon device change Signed-off-by: raver119 <raver119@gmail.com> * DeviceLocalNDArray updates + tests Signed-off-by: raver119 <raver119@gmail.com> * special array for delayed mode Signed-off-by: raver119 <raver119@gmail.com> * additional detach() Signed-off-by: raver119 <raver119@gmail.com>	2019-08-22 20:01:29 +03:00
Alex Black	e855e47f73	More fixes (#148 ) * Small batch norm fix (cuda/no-mkldnn) Signed-off-by: Alex Black <blacka101@gmail.com> * Dropout fix for RnnOutputLayer Signed-off-by: Alex Black <blacka101@gmail.com> * Allow block size < 2 in batch_to_space_nd and space_to_batch_nd for import, in spite of what TF docs say Signed-off-by: AlexDBlack <blacka101@gmail.com>	2019-08-22 19:55:27 +10:00
raver119	eea3062ccf	[WIP] stb/bts nd (#144 ) * - start working on space_to_batch_nd Signed-off-by: Yurii <yurii@skymind.io> * - provide cpu helper for space_to_batch_nd op Signed-off-by: Yurii <yurii@skymind.io> * few typos fixed Signed-off-by: raver119 <raver119@gmail.com> * - add tests for space_to_batch and correct bugs Signed-off-by: Yurii <yurii@skymind.io> * - write cuda kernel for space_to_batch op Signed-off-by: Yurii <yurii@skymind.io> * - add order argument to shape::index2coords method in convolution cuda ops Signed-off-by: Yurii <yurii@skymind.io> * - restore some previous code Signed-off-by: Yurii <yurii@skymind.io> * old col2im kernel activated Signed-off-by: raver119 <raver119@gmail.com> * - change coords calculation in col2im kernel Signed-off-by: Yurii <yurii@skymind.io> * - restore old col2im kernel Signed-off-by: Yurii <yurii@skymind.io> * - add custom op for batch_to_space Signed-off-by: Yurii <yurii@skymind.io> * - provide cpu version for batch_to_space_nd op Signed-off-by: Yurii <yurii@skymind.io> * - provide cuda kernel for batch_to_space_nd op Signed-off-by: Yurii <yurii@skymind.io>	2019-08-21 21:11:46 +03:00
raver119	e604ffe0d2	[WIP] repeat op (#143 ) * - write new repeat helper (cpu) Signed-off-by: Yurii <yurii@skymind.io> * - update NDArray::cpu Signed-off-by: Yurii <yurii@skymind.io> * - update NDArray::repeat cuda Signed-off-by: Yurii <yurii@skymind.io>	2019-08-21 21:10:29 +03:00
raver119	3cf72e5e30	[WIP] More fixes (#142 ) * atomicAdd cc 70+ Signed-off-by: raver119 <raver119@gmail.com> * additional 8 bytes alocation Signed-off-by: raver119 <raver119@gmail.com> * missed include 2019 Signed-off-by: raver119 <raver119@gmail.com> * less spam Signed-off-by: raver119 <raver119@gmail.com>	2019-08-21 20:18:29 +03:00

1 2 3

123 Commits