Mais il ne faut pas la confondre avec une carte graphique de bureau moderne. La P40 est une vieille carte de datacenter, conçue à l’origine pour l’inférence et la virtualisation, et son petit prix suppose d’accepter un vrai travail sur l’alimentation, le refroidissement et l’affichage .
Pour un LLM local, la question n’est pas seulement de savoir quelle carte est la plus récente. Il faut d’abord savoir si le modèle tient en mémoire GPU. InsiderLLM indique que les 24 Go de la P40 peuvent permettre d’exécuter certains modèles 14B entièrement sur GPU, là où une RTX 3060 12 Go ne suffit pas . Un autre guide 2026 sur les GPU d’occasion reprend la même logique : pour les charges IA, la quantité de VRAM peut peser plus lourd que la génération de la carte .
Cette capacité ne rend pas la P40 moderne pour autant. Vast.ai référence la Tesla P40 avec une date de sortie au 13 septembre 2016 et 24 Go de mémoire . Accio la décrit comme une carte de datacenter de l’ère Pascal, initialement destinée à l’inférence et à la virtualisation, aujourd’hui réutilisée par des amateurs d’IA locale parce qu’elle offre beaucoup de mémoire à bas prix . InsiderLLM la juge aussi lente selon les standards actuels et environ trois fois plus lente qu’une RTX 3090 dans sa comparaison .
Le prix de la carte seule peut donner une fausse impression. Avant d’acheter une P40, vérifiez au moins quatre points.
Le bon usage de cette carte, c’est une machine d’inférence locale. Accio rattache la seconde vie de la P40 à l’exécution de LLM en local et mentionne llama.cpp dans le contexte des montages homelab avec P40 . Le plus raisonnable est de commencer avec des modèles et des réglages qui tiennent dans 24 Go, puis d’ajuster la longueur de contexte et les paramètres de service.
Il faut aussi garder des attentes réalistes. Le retour d’expérience de RBA rappelle qu’une P40 ne peut pas exécuter les plus grands modèles de pointe et qu’elle a des limites architecturales, tout en restant capable avec une configuration adaptée .
Si vous attendez une carte silencieuse, récente et à l’aise avec tous les nouveaux modèles, la P40 risque de décevoir. InsiderLLM la décrit comme lente selon les standards modernes et environ trois fois plus lente qu’une RTX 3090 .
C’est justement parce que le prix est bas que la carte reste populaire. Dans un montage budget précis, RBA indique avoir fait tourner Qwen3 Coder 30B à environ 50 tokens par seconde sur une P40 d’occasion . Il faut lire ce chiffre comme un retour d’expérience, pas comme une garantie : le débit dépend du modèle, des réglages, de la taille de contexte, de la configuration système et du refroidissement.
| Option | Pourquoi la choisir | Prix et capacité rapportés | Compromis principal |
|---|---|---|---|
| Tesla P40 24 Go d’occasion | Le chemin le moins cher vers 24 Go de VRAM pour l’inférence locale | Les sources citent 150 à 200 $, 200 à 250 $, sous les 200 $ ou sous les 300 $ en occasion | Carte de datacenter ancienne, pas de sortie vidéo, TDP de 250 W et refroidissement à gérer |
| RTX 3090 24 Go d’occasion | Plus rapide et plus simple à intégrer dans un PC classique | Un guide 2026 la situe autour de 700 à 850 $ en occasion | Beaucoup plus chère qu’une P40, même si la P40 est décrite comme environ trois fois plus lente |
| A100 40 Go ou 80 Go | Pour de plus gros modèles quand le budget suit | L’A100 existe en variantes 40 Go et 80 Go, et les prix d’occasion de l’A100 80 Go sont rapportés en milliers de dollars |
Si l’objectif est d’obtenir une inférence locale correcte pour le minimum d’argent, avancez dans cet ordre :
Pour dépenser le moins possible, la Tesla P40 24 Go d’occasion reste l’upgrade qui se détache pour un vieux serveur : elle achète beaucoup de VRAM à des prix que les guides récents placent souvent autour de 150 à 250 $, ou sous les 300 $ selon les annonces . La bonne formule n’est toutefois pas seulement la carte. C’est la carte, plus assez de puissance électrique, un flux d’air forcé et des attentes raisonnables.
Si vous voulez 24 Go avec moins de bricolage, regardez plutôt une RTX 3090 24 Go d’occasion . Si vous avez besoin de mémoire de classe A100, il faut arrêter de raisonner en upgrade bon marché et prévoir un budget beaucoup plus large .
| Sort du cadre d’un sauvetage bon marché d’un vieux serveur |