Cartes graphiques : 10 ans de GPU, comment l’IA a jeté un froid
Rubin sur l’ongle
Illustration : Flock
Le 01 septembre à 15h58
Cela fait quasiment une éternité que NVIDIA lance de nouvelles cartes graphiques tous les ans. 2026 pourrait déroger à la règle et le fautif n’est pas à chercher bien loin : l’IA générative et ses insatiables besoins en GPU et mémoire. AMD et NVIDIA misent tout sur ce marché (très lucratif), avec la promesse de nouvelles puces chaque année.
Cartes graphiques : 10 ans de GPU, comment l’IA a jeté un froid
Rubin sur l’ongle
Illustration : Flock
Cela fait quasiment une éternité que NVIDIA lance de nouvelles cartes graphiques tous les ans. 2026 pourrait déroger à la règle et le fautif n’est pas à chercher bien loin : l’IA générative et ses insatiables besoins en GPU et mémoire. AMD et NVIDIA misent tout sur ce marché (très lucratif), avec la promesse de nouvelles puces chaque année.
Hardware
Hardware
6 min
Depuis l’arrivée « fracassante » de l’intelligence artificielle générative avec le lancement de ChatGPT fin 2022, le monde des cartes graphiques a changé dans les grandes largeurs. Les grands modèles de langages sont passés de dizaines de milliards de paramètres à des milliers de milliards, nécessitant toujours plus de mémoire pour être « chargés ». Les trois principaux producteurs de puces mémoires se sont réorganisés pour répondre à la demande, avec une forte baisse sur les puces grand public, provoquant des hausses très importantes sur les prix.
Mais l’IA générative a également conduit NVIDIA à revoir ses plans en matière de développement GPU : la priorité est clairement donnée au monde des datacenters et de l’IA générative et non aux joueurs. Les annonces de GeForce se font rares… La dernière carte graphique lancée par NVIDIA est la RTX 5050 en juillet 2025, il y a exactement un an.
La dernière génération de cartes a été lancée en janvier 2025 avec les RTX 5000. Depuis, rien… pas de nouvelles cartes en déclinaisons Super par exemple. À quand les GeForce RTX 60 de la génération Rubin (du moins si ce nom est conservé pour le grand public) ? Pas avant 2027, voire 2028 a priori.
En effet, selon The Information, il ne faut rien attendre en 2026 : « NVIDIA ne lancera pas de nouvelle puce graphique pour les joueurs cette année en raison d’une pénurie mondiale croissante de puces mémoire, provoquée par l’essor de l’IA », expliquaient nos confrères en février. Jusqu’à présent, le calendrier leur donne raison. Dans le monde des datacenters toutefois, c’est bien différent.
Il reste 57% de l'article à découvrir.
Déjà abonné ou lecteur ? Se connecter
Soutenez un journalisme indépendant,
libre de ton, sans pub et sans reproche.
Accédez en illimité aux articles
Profitez d'un média expert et unique
Intégrez la communauté et prenez part aux débats
Partagez des articles premium à vos contacts
expert et sans pub.
Commentaires (4)
Il y a 40 minutes
Et je n'en attendais plus d'évolution significative.
Avant l'arrivée de la génération des GPU 5000, je me souviens que NVIDIA parlait qu'elle n'aurait pas le choix de faire des GPU qui consomment 800W pour augmenter significativement les performances.
Cela s'est traduit par le nouveau connecteur de 500W qui peut avoir des problèmes de stabilité.
À cela peut se combiner aussi la finesse de gravure qui est extrèmement basse et évoluera peut. Là où le passage de 11nm à 3nm fait une belle différence, le passage de 3 à 2 nm ne semble pas faire une grosse différence.
Il reste l'empilement maintenant, mais pour quels gains ? Et surtout, cela tend à fusionner le CPU, le GPU et la RAM non ?
Il ne reste que les optimisations via le DLSS par exemple pour justifier un nouveau matériel car il y a une architecture de la puce derrière pour le faire fonctionner de manière hardware.
C'est plus simple de faire augmenter la consommation dans un grand datacenter avec des personnes prêtes à passer de datacenter de l'ordre de 50MW à 1 GW.
Et de vendre ainsi de beaux gains de puissance.
Enfin, c'est comme ça que je le vois 😅
Il y a 35 minutes
Modifié il y a 9 minutes
Il n'est désormais plus indispensable d'utiliser CUDA pour utiliser ces outils.
À l'instant
De plus , si Intel est vraiment bien supporté sous linux sur les nouvelles gammes , c'est pas une priorité sur les autres softs tel que kyber, ffmpeg,...
Mais bon au final quand même pour le prix je suis pas si déçu d'autant que la conso de 70W reste acceptable - et je pourrais m'essayer à l'IA , avec 16Go , si je me le sens ... :-)
Signaler un commentaire
Voulez-vous vraiment signaler ce commentaire ?