Connexion Premium

Cartes graphiques : 10 ans de GPU, comment l’IA a jeté un froid

Rubin sur l’ongle

Cartes graphiques : 10 ans de GPU, comment l’IA a jeté un froid

Illustration : Flock

Cela fait quasiment une éternité que NVIDIA lance de nouvelles cartes graphiques tous les ans. 2026 pourrait déroger à la règle et le fautif n’est pas à chercher bien loin : l’IA générative et ses insatiables besoins en GPU et mémoire. AMD et NVIDIA misent tout sur ce marché (très lucratif), avec la promesse de nouvelles puces chaque année.

Depuis l’arrivée « fracassante » de l’intelligence artificielle générative avec le lancement de ChatGPT fin 2022, le monde des cartes graphiques a changé dans les grandes largeurs. Les grands modèles de langages sont passés de dizaines de milliards de paramètres à des milliers de milliards, nécessitant toujours plus de mémoire pour être « chargés ». Les trois principaux producteurs de puces mémoires se sont réorganisés pour répondre à la demande, avec une forte baisse sur les puces grand public, provoquant des hausses très importantes sur les prix.

Mais l’IA générative a également conduit NVIDIA à revoir ses plans en matière de développement GPU : la priorité est clairement donnée au monde des datacenters et de l’IA générative et non aux joueurs. Les annonces de GeForce se font rares… La dernière carte graphique lancée par NVIDIA est la RTX 5050 en juillet 2025, il y a exactement un an.

La dernière génération de cartes a été lancée en janvier 2025 avec les RTX 5000. Depuis, rien… pas de nouvelles cartes en déclinaisons Super par exemple. À quand les GeForce RTX 60 de la génération Rubin (du moins si ce nom est conservé pour le grand public) ? Pas avant 2027, voire 2028 a priori.

En effet, selon The Information, il ne faut rien attendre en 2026 : « NVIDIA ne lancera pas de nouvelle puce graphique pour les joueurs cette année en raison d’une pénurie mondiale croissante de puces mémoire, provoquée par l’essor de l’IA », expliquaient nos confrères en février. Jusqu’à présent, le calendrier leur donne raison. Dans le monde des datacenters toutefois, c’est bien différent.

Il reste 57% de l'article à découvrir.

Cadenas en colère - Contenu premium

Soutenez un journalisme indépendant,
libre de ton, sans pub et sans reproche.

Accédez en illimité aux articles

Profitez d'un média expert et unique

Intégrez la communauté et prenez part aux débats

Partagez des articles premium à vos contacts

Commentaires (12)

votre avatar
Avant l'arrivée de la pénurie de la RAM, il me semblait qu'il y avait déjà un gros fléchissement des évolutions de la performance des GPUs grands publics.
Et je n'en attendais plus d'évolution significative.

Avant l'arrivée de la génération des GPU 5000, je me souviens que NVIDIA parlait qu'elle n'aurait pas le choix de faire des GPU qui consomment 800W pour augmenter significativement les performances.
Cela s'est traduit par le nouveau connecteur de 500W qui peut avoir des problèmes de stabilité.

À cela peut se combiner aussi la finesse de gravure qui est extrèmement basse et évoluera peut. Là où le passage de 11nm à 3nm fait une belle différence, le passage de 3 à 2 nm ne semble pas faire une grosse différence.
Il reste l'empilement maintenant, mais pour quels gains ? Et surtout, cela tend à fusionner le CPU, le GPU et la RAM non ?

Il ne reste que les optimisations via le DLSS par exemple pour justifier un nouveau matériel car il y a une architecture de la puce derrière pour le faire fonctionner de manière hardware.

C'est plus simple de faire augmenter la consommation dans un grand datacenter avec des personnes prêtes à passer de datacenter de l'ordre de 50MW à 1 GW.
Et de vendre ainsi de beaux gains de puissance.
Enfin, c'est comme ça que je le vois 😅
votre avatar
Le DLSS une optimisation ? C'est un palliatif pour rendre supportables des technologies qui ne peuvent atteindre 30 fps en natif. Et dans le cas de Nvidia de dénigrer la concurrence.
Je ne dis pas que c'est pas bien, j'utilise a fond le FSR4 sur mon iGPU de mon AMD Ryzen AI Max+ 395, je n’appelle pas ça optimisation.
votre avatar
un RTX 5080 pour faire tourner le jeu n'est pas non plus une optimisation :)

Et effectivement, FSR 2 étant dispo chez tout le monde, ça sauve bien les iGPU Intel XE et Vega 6/8/10/11
votre avatar
Il faut peut-être aussi prendre en compte GeForce Now, qui permet de faire tourner les jeux les plus gourmands sans carte graphique.
votre avatar
Geforce Now est un argument en faveur de la fin des CG et de l'ordi chez soi. Si l'IA ne fonctionne pas, ils pourront toujours faire du gaming avec les datacenters.
votre avatar
Pour info pour ceux qui veulent faire tourner des LLM chez eux sur leur "petit" gpu, Vulkan est venu mettre un coup de pied dans la fourmilière.
Il n'est désormais plus indispensable d'utiliser CUDA pour utiliser ces outils.
votre avatar
Oui, mais carte NVIDIA de 2011 est trop vieille pour être supportée par Vulkan ou les pilotes NVIDIA officiels 😭.
Bon après je m'y attendais 😇
votre avatar
Perso je me suis pris une Intel Arc Pro B50 qui m'a couté 320€... Avec ses 16go de VRAM et son support linux j'avais trouvé ça pas si mal. Bon, je l'ai jamais trop utilisé pour de l'IA, ce que je voulais c'était le SR-IOV , et finallement ça fait pas ce que je veux (ca divise bien la carte en 4x cartes virtuelles mais on ne peux pas associer un port video par carte virtuelle - les ports physique ne sont utilisable que sur le device physique. bien pour du déport d'affichage style sunshine/moonlight, mais sinon...)

De plus , si Intel est vraiment bien supporté sous linux sur les nouvelles gammes , c'est pas une priorité sur les autres softs tel que kyber, ffmpeg,...

Mais bon au final quand même pour le prix je suis pas si déçu d'autant que la conso de 70W reste acceptable - et je pourrais m'essayer à l'IA , avec 16Go , si je me le sens ... :-)
votre avatar
Moi j'ai une B570, avec lmstudio ça marche nickel.
votre avatar
C'est sympa les articles à liste mais de petits graphs genre RAM vs années, perf vs année, prix vs année, pref/prix vs année m'auraient plus parlés. Je sais qu'il y a beaucoup de ref mais les deux cartes Mainstream seraient pertinentes.
Voilà, petite idée pour un autre article peut-être !
votre avatar
Avoir une évolution significative tout les 2-3-4 ans n'est pas non plus un mal en soi.
Outre les bénéfices environnementaux associés à une durée de vie plus longue, cela inciterait bien plus à optimiser/compéter/maintenir l'offre logiciel associée à ces composants (pilotes, librairies, jeux, etc.).
votre avatar
ce sera une première depuis les années 90. ce sera une première depuis les années 90.
Pas complètement le rythme a même commencé à une carte majeure tous les 6mois :
Riva 128 (Avril 1997)
TNT (May 1998 - 13mois)
TNT2 (mars 1999 - 10 mois)
GeForce 256 (Octobre 1999 - 7mois)
Geforce 2(Avril 2000 - 6mois)
Geforce 3(Fevrier 2001 - 10mois)

GeForce 4(Fevrier 2002 - 12mois)
GeForce 5 le grille-pain (Mars 2003 - 13mois)
GeForce 6 (Avril 2003 - 13mois)