AI研究科学者向けCUDAによるカスタムカーネル開発入門

AI研究科学者がカスタムAIアルゴリズムをGPUで効率的に実装するためのCUDAプログラミングの基本概念、カーネル開発、メモリ最適化、非同期実行、およびパフォーマンスプロファイリングの基礎を習得します。

CUDAプログラミングの基礎とカーネル開発

Unit 1: CUDAの世界へようこそ

Unit 2: CUDAプログラミングモデルの核心

Unit 3: 初めてのCUDAカーネル

GPUメモリ最適化と非同期実行、パフォーマンス分析の初歩

Unit 1: GPUメモリの深層

Unit 2: 非同期処理とパフォーマンス

Unit 3: パフォーマンス分析の第一歩