Toutes les news taguées avec ce sujet.
NVIDIA explique comment la fusion de kernels CUDA permet de réduire les goulots d'étranglement mémoire et les latences de lancement sur GPU.
Un développeur détaille la conception d'une couche d'abstraction GPU bindless, une approche moderne qui simplifie la gestion des ressources graphiques.
Un développeur décortique le mécanisme CUDA-checkpoint de Nvidia pour réduire drastiquement les temps de démarrage des processus GPU.
NVIDIA détaille comment optimiser les communications initiées par GPU pour accélérer les simulations de dynamique moléculaire sur des infrastructures HPC massives.
Un créateur documente la construction d'un GPU artisanal, un projet DIY qui a évolué bien au-delà de ses ambitions initiales.
Un projet open-source exploite la puissance des GPU pour déchiffrer les messages codés par la machine Enigma M4 de la Seconde Guerre mondiale.
Le géant des puces GPU explore un modèle inédit : offrir des ressources de calcul à des startups en échange d'une participation à leurs revenus futurs.
Une méthode GPU-parallèle calcule des garanties formelles de contrôle robuste jusqu'à 67 Hz pour des systèmes non linéaires et des dynamiques réseaux de neurones.
NVIDIA détaille comment ses avancées matérielles — HBM, NVLink-C2C et décompression dédiée — lèvent les goulots d'étranglement mémoire et I/O des moteurs de requêtes GPU.
Le projet ZLUDA franchit une nouvelle étape avec sa version 6, permettant de faire tourner des workloads CUDA natifs sur du matériel AMD ou Intel.
L'équipe Moondream remet en question l'hypothèse d'une pénurie durable de GPU et analyse les dynamiques réelles du marché des puces IA.
Un tour d'horizon technique et pédagogique du cycle de vie complet d'un kernel CUDA, du code hôte jusqu'à l'exécution sur GPU.
SedonaDB 0.4 exploite les RT cores des GPU grand public pour accélérer les jointures spatiales, battant un H100 sur certains benchmarks.
NVIDIA détaille son support bout-en-bout des descriptor heaps Vulkan pour optimiser la liaison des ressources GPU dans les shaders.
H Company publie une analyse technique sur les fuites et gaspillages cachés de VRAM qui plombent les performances des modèles en production.
NVIDIA détaille comment optimiser le BEV pooling sur ses GPU pour les véhicules autonomes et la robotique spatiale.
AMD déploie FidelityFX Super Resolution 4.1 pour les GPU RX 7000 (RDNA 3), élargissant l'accès à son upscaling ML au-delà des seules RX 9000.
NVIDIA introduit un nouveau groupe de fonctionnalités dans ses CUDA Core Compute Libraries pour moderniser le développement C++ sur GPU.