Ese precio es el gancho. La letra pequeña: la P40 es hardware antiguo de centro de datos pensado para inferencia, no una GPU moderna de escritorio de pinchar y listo . Como siempre con segunda mano, conviene mirar el coste total del montaje, no solo el precio de la tarjeta.
Para ejecutar modelos de lenguaje grandes en local, el cuello de botella práctico suele ser muy simple: que el modelo quepa o no quepa en la memoria de la GPU. InsiderLLM señala que los 24 GB de VRAM de la P40 permiten ejecutar algunos modelos de 14B completamente en GPU cuando no cabrían en una RTX 3060 de 12 GB . Otra guía de GPU usadas para 2026 hace el mismo argumento de fondo: para cargas de IA, una tarjeta usada con más VRAM puede ser más útil que una opción más nueva con menos memoria .
Eso no convierte a la P40 en hardware moderno. Vast.ai lista la Tesla P40 con fecha de lanzamiento del 13 de septiembre de 2016 y 24 GB de memoria . Accio la describe como una GPU de centro de datos de la era Pascal, originalmente orientada a inferencia y virtualización, que ahora ha encontrado una segunda vida entre quienes montan IA local por su capacidad de 24 GB a precios bajos . InsiderLLM también la califica como lenta frente a opciones actuales y la sitúa aproximadamente tres veces por debajo de una RTX 3090 en su comparación .
El precio de la P40 puede engañar si el servidor anfitrión no está preparado. Antes de comprar, revisa estos cuatro puntos:
Piensa en este montaje como una caja de inferencia. Accio vincula la segunda vida de la P40 con la ejecución local de LLM y menciona llama.cpp en el contexto de homelabs con P40 . Empieza con modelos y configuraciones que quepan dentro de 24 GB, y ajusta longitud de contexto y parámetros de servicio en vez de asumir que cualquier modelo nuevo funcionará bien.
Ese ajuste de expectativas es importante. RBA señala que una P40 no puede ejecutar los modelos punteros más grandes y que tiene limitaciones arquitectónicas, aunque sigue siendo capaz con la configuración adecuada .
Si esperas una GPU silenciosa de escritorio que mueva con comodidad cualquier modelo nuevo, la P40 probablemente te decepcionará. InsiderLLM la describe como lenta según estándares modernos y aproximadamente tres veces más lenta que una RTX 3090 .
Aun así, los montajes reales explican por qué sigue teniendo mercado. RBA informó de un servidor económico concreto ejecutando Qwen3 Coder 30B a unos 50 tokens por segundo con una P40 usada . Ojo: no lo leas como un benchmark universal. El rendimiento cambia con el modelo, la cuantización o configuración usada, el tamaño de contexto, el sistema, los controladores y la refrigeración.
La mejor elección depende de qué estés minimizando: coste inicial, fricción de montaje o tamaño de los modelos.
| Opción | Por qué elegirla | Coste y capacidad citados | Principal sacrificio |
|---|---|---|---|
| Tesla P40 de 24 GB usada | La ruta de menor coste para conseguir 24 GB de VRAM en inferencia local | Las fuentes citan $150–$200, $200–$250, menos de $200 o por debajo de $300 en segunda mano | Tarjeta antigua de centro de datos, sin salida de vídeo, TDP de 250 W y refrigeración exigente |
| RTX 3090 de 24 GB usada | Más velocidad y un montaje más cómodo en un PC convencional | Una guía de 2026 la sitúa alrededor de $700–$850 usada | Cuesta mucho más; la P40 se describe como unas tres veces más lenta, pero bastante más barata |
| A100 de 40 GB u 80 GB | Trabajo con modelos más grandes cuando el presupuesto ya es serio | La A100 existe en variantes de 40 GB y 80 GB, y la A100 de 80 GB usada aparece en rangos de miles de dólares |
Si el objetivo es inferencia local capaz por el menor dinero posible, sigue este orden:
llama.cpp es una de las herramientas mencionadas en la cobertura de P40 para LLM locales .Para gastar lo mínimo, la Tesla P40 de 24 GB usada sigue destacando como mejora para un servidor viejo: compra mucha VRAM a precios que las guías recientes colocan aproximadamente en el rango de $150–$250 o por debajo de $300 . Pero la fórmula ganadora no es solo la tarjeta. Es la tarjeta más suficiente alimentación, aire dirigido y expectativas realistas.
Si quieres los mismos 24 GB con menos dolores de cabeza, mira una RTX 3090 de 24 GB usada . Si necesitas memoria de clase A100, deja de pensar en una mejora barata y prepara un presupuesto bastante mayor .
| Suele romper la lógica de rescatar un servidor viejo con presupuesto mínimo |