Leçon 2 : Pourquoi un GPU ? Débit contre latence
Un CPU est construit avec peu de cœurs très puissants qui terminent une seule tâche rapidement — c'est une latence faible. Un GPU est construit avec des milliers de cœurs simples qui effectuent la même opération sur énormément de données à la fois — c'est un débit élevé. Pour additionner deux vecteu
Un CPU, ce sont quelques chefs experts qui cuisinent vite un plat compliqué. Un GPU, ce sont mille commis de cuisine, chacun coupant une tomate — seul, chacun est lent, mais ensemble ils coupent mille tomates dans le temps d'une seule.
- débit
- La quantité de travail accomplie par unité de temps. Ici, c'est le GPU qui gagne : plein d'opérations identiques en parallèle.
- latence
- Le temps que prend une seule opération pour se terminer. Ici, c'est le CPU qui gagne : un cœur puissant termine une tâche rapidement.
- kernel
- Une fonction qui s'exécute sur le GPU. Elle est marquée par __global__ et des milliers de threads la lancent en même temps.
- SIMT
- Single Instruction, Multiple Threads (une instruction, plusieurs threads) — tous les threads exécutent la même instruction, chacun sur des données différentes.