EN
en direct
tag

#gpu

Broadcom passe le partage multi-tenant de modèles en GA et fait du cloud privé un concurrent des hyperscalers

Le 3 septembre 2026, Broadcom a mis à jour VMware Cloud Foundation en 9.1.1 avec le partage multi-tenant de modèles en disponibilité générale, une passerelle vers plus de 150 modèles et une échelle Kubernetes multipliée par 2,6. Pour l’inférence sur données réglementées, comparez le coût total d’un parc de GPU consolidé sur site au prix au jeton d’un hyperscaler avant de trancher.

Le noyau Linux 7.2.5 rattrape le pilote Blackwell et durcit ksmbd

Les noyaux stables 7.2.5 et 6.18.51, publiés le 11 septembre 2026, corrigent la sortie vidéo des GPU Blackwell dans nouveau et colmatent une fuite mémoire et un use-after-free dans ksmbd. Mettez à jour en priorité si vous exposez des partages SMB ou utilisez une carte Blackwell.

AWS et NVIDIA déploieront deux millions de GPU supplémentaires et étendent le partenariat aux CPU Vera et à la robotique

Le 26 août 2026, AWS et NVIDIA ont annoncé deux millions de GPU supplémentaires d’ici 2028, l’arrivée des CPU Vera et de la mémoire NVHBM, ainsi que des usines d’IA fédérales à 100 000 GPU. Ce n’est plus un simple contrat de fourniture de silicium : AWS co-conçoit désormais l’interconnexion et la mémoire avec NVIDIA. Voici ce que cela change pour un ingénieur cloud.

GPUThor contourne l’ECC des GPU NVIDIA et remonte en root depuis un noyau CUDA

Des chercheurs de l’université de Toronto ont démontré une attaque Rowhammer, GPUThor, qui contourne l’ECC des GPU NVIDIA Ampere pour déclencher un déni de service ou une élévation de privilèges jusqu’au root. Toute infrastructure qui partage des GPU ou exécute du CUDA non maîtrisé doit reconsidérer sa limite de confiance.

Vultr défie les hyperscalers avec un cloud GPU 50 à 90 % moins cher

En avril 2026, Vultr annonce que son infrastructure GPU Nvidia coûte 50 à 90 % de moins que les offres équivalentes d’AWS, Google Cloud et Azure. Les startups et PME qui ne peuvent pas absorber les marges des hyperscalers ont désormais une alternative crédible — structurée autour d’agents IA et d’un positionnement prix transparent.

Kubernetes 1.36 passe le GPU en ressource partageable avec DRA en GA

La version 1.36, livrée le 22 avril 2026, fait passer la Dynamic Resource Allocation en disponibilité générale. Le GPU n’est plus un entier binaire — il devient une ressource attribuable, partitionnable et planifiée par le scheduler selon les besoins réels des workloads.

Tapez au moins deux caractères.

↑ ↓ naviguer ↵ ouvrir esc fermer