WebGPU a mis longtemps à arriver. L'API a été conçue pour remplacer WebGL (une API basée sur OpenGL ES 2.0, vieille d'une quinzaine d'années) avec quelque chose d'adapté aux GPU modernes : accès aux compute shaders, gestion moderne de la mémoire, pipeline programmable. En 2026, c'est fait : WebGPU est stable dans Chrome, Firefox et Safari desktop. Et ça change ce qu'on peut faire dans un navigateur.
Le cas d'usage qui a tout accéléré : l'inférence IA
La demande pour faire tourner des modèles IA dans le navigateur a été le principal moteur d'adoption de WebGPU. Des projets comme WebLLM et Transformers.js exploitent les compute shaders WebGPU pour faire tourner des modèles quantisés directement dans le navigateur, sans serveur, sans coût d'inférence.
Llama 3.2 3B tourne à 15-25 tokens/seconde dans Chrome sur une carte dédiée récente. Phi-3 Mini, spécialement optimisé pour les déploiements edge, atteint 30-40 tokens/seconde. Ce n'est pas rapide comme un serveur A100, mais c'est suffisant pour un assistant de code, un correcteur d'orthographe ou un chatbot simple, le tout sans aucun appel API.
WebGPU vs WebGL : ce qui a vraiment changé
WebGL exposait OpenGL ES, qui date de 2004. Les GPU modernes ne fonctionnent plus vraiment comme ça. WebGPU s'aligne sur les APIs natives modernes (Vulkan, Metal, DirectX 12) : command buffers explicites, memory management manuel, compute shaders de première classe. Le résultat : les opérations vectorielles et matricielles (qui sont le coeur du deep learning) sont 3 à 10 fois plus rapides qu'avec WebGL.
Ce qui est faisable en 2026
- Inférence de petits LLMs (jusqu'à 7B en quantisé) pour des assistants locaux et privés.
- Traitement d'images en temps réel : segmentation, super-résolution, correction de couleur, le tout côté client.
- Simulations physiques, fluides, particules : les jeux web et les outils de visualisation scientifique bénéficient directement de l'accès aux compute shaders.
- Chiffrement matériel côté client pour des applications de messagerie ou de stockage chiffré sans serveur.
- WebGPU API — MDN — MDN, 2026
- WebGPU Fundamentals — WebGPU Fundamentals, 2025