Showing posts with label cuDNN. Show all posts
Showing posts with label cuDNN. Show all posts

2016-08-13

cuDNN v5.1 (August 10, 2016), for CUDA 8.0 RC

cuDNN v5.1 (August 10, 2016), for CUDA 8.0 RC と cuDNN v5.1 (August 10, 2016), for CUDA 7.5 が出ているようだ。

https://developer.nvidia.com/rdp/cudnn-download

2016-06-28

cuDNN v5.1 RC (June 16, 2016), for CUDA 7.5

cuDNN v5.1 RC (June 16, 2016), for CUDA 7.5 が出ているようだ。

https://developer.nvidia.com/cudnn

2016-05-29

cuDNN v5 (May 27, 2016), for CUDA 8.0 RC

cuDNN v5 (May 27, 2016), for CUDA 8.0 RC が出ているようだ。

2016-04-07

cuDNN v5 Release Candidate (RC) (April, 2016), for CUDA 7.5 and later

cuDNN v5 Release Candidate (RC) (April, 2016) が出ているようだ。

https://developer.nvidia.com/cudnn

2016-02-13

cuDNN v4 (Feb 10, 2016)

cuDNN v4 の正式版が出ているようだ。

https://developer.nvidia.com/cudnn

以下、リリースノートから引用。
UPDATES SINCE RELEASE CANDIDATE
  • The API of cudnnBatchNormalizationBackward has been changed to include an additional set of scaling parameters (alphaParamsDiff and betaParamsDiff) applied to the dBnScaleResult and dBnBiasResult outputs of the function.
  • The prior restriction of batch size 512 in all Batch Normalization routines has been removed.
  • Numerical stability and performance of cudnnBatchNormalizationBackward in some cases has been improved.
  • Performance of cudnnConvolutionBackwardFilter when using Algo 1 has been improved for some cases. This code path now also requires a workspace.

2016-01-26

cuDNN v4 Release Candidate (December 10, 2015)

cuDNN v4 Release Candidate (December 10, 2015) が出ていたようだ。

日本語のリリース情報は次のリンク先を参照。
https://ja-jp.facebook.com/NVIDIAGPUComputing/posts/458731480981793

以下、リリースノートから引用。
NEW FEATURES
  • Batch Normalization routines have been added.
  • Convolution forward and backward now supports NHWC tensor format.
  • FFT Tiling algorithm has been added for cudnnConvolutionForward and cudnnConvolutionBackwardData routines
  • cudnnConvolutionForward now supports computation in FP16 when run on GPU with a compute capability >= 5.3
  • cudnnConvolutionForward has been optimized for batch size = 1
  • Pooling and activation routines have a descriptor option to propagate NaN numbers.

2015-11-22

CPU で float(FP32) 型から half(FP16) 型へ変換する(逆変換もあり)方法

CPU で float(FP32) 型から half(FP16) 型へ変換する(逆変換もあり)ソースコードが、cuDNN v3 (September 8, 2015) のサンプルソースコード cudnn-sample-v3.tgz の中の fp16_emu.cpp にある。
half1 cpu_float2half_rn(float f);
float cpu_half2float(half1 h);
関連

2015-06-14

cuDNN のダウンロード方法

cuDNN (NVIDIA CUDA Deep Neural Network library) をダウンロードするには、「CUDA Registered Developer Program」への登録が必要だ。

下記のページにアクセスして、[Register] ボタンを押して登録する。

https://developer.nvidia.com/cuDNN

しかし、登録してもすぐにはダウンロードできない。

登録完了後、しばらくして(私の場合は約6時間後に)「GPU Computing & Embedded Developer Program Application Appro」という表題のメールが送られてくる。その後にサイトからダウンロードできるようになる。

ライセンス情報は Windows の場合 cudnn-6.5-win-v2.zip ファイルの中に含まれている。

[追記] (2015-07-04) ライセンス情報について修正。