Inteligencia artificial en tu casa
La misma memoria. Buen rendimiento. La mitad del precio.
Para ejecutar en casa un modelo de lenguaje serio no hace falta comprar una tarjeta gráfica insignia de 4.650 € (5.350 $). Dos tarjetas de gama media ofrecen exactamente la misma memoria — y es la memoria la que decide qué tamaño de modelo puede siquiera arrancar. Construimos una máquina así, la medimos y mostramos los resultados.
RTX 5090 — una tarjeta insignia
- Memoria
- 32 GB
- Precio
- 4.400–4.650 € (5.100–5.350 $)
RTX 5070 Ti — dos tarjetas
- Memoria
- 16 GB + 16 GB
- Precio
- 2 × 1.050 € = 2.100 € (2 × 1.200 $ = 2.400 $)
| Variante | Memoria | Precio |
|---|---|---|
| RTX 5090 — una tarjeta insignia | 32 GB | 4.400–4.650 € (5.100–5.350 $) |
| RTX 5070 Ti — dos tarjetas | 16 GB + 16 GB | 2 × 1.050 € = 2.100 € (2 × 1.200 $ = 2.400 $) |
La memoria de ambas tarjetas se suma: el modelo se divide en dos mitades y una se calcula en la primera tarjeta y la otra en la segunda. Desde fuera parece un único ordenador con 32 GB de memoria gráfica — por el 47 % del precio del buque insignia.
Precios minoristas europeos, agosto de 2026. NVIDIA ya ha subido los precios dos veces este año — un 10–15 % en enero en toda la línea RTX 50 y en mayo solo en la RTX 5090 — y la tercera corrección anunciada llegaría al 20–30 %. La causa es el encarecimiento de la memoria GDDR7, cuya escasez se pronostica al menos hasta 2028. La subida golpea a las dos variantes, pero no por igual: el mismo 30 % supone unos 630 € (720 $) en el par de tarjetas y cerca de 1.390 € (1.600 $) en el buque insignia.
- de memoria gráfica para los modelos
- 32 GB
- de memoria gráfica para los modelos
- tokens por segundo; escribe más rápido de lo que lees
- ~200
- tokens por segundo; escribe más rápido de lo que lees
- tokens de contexto, es decir, varios cientos de páginas a la vez
- 262 000
- tokens de contexto, es decir, varios cientos de páginas a la vez
- de consumo cuando la máquina espera
- 120 W
- de consumo cuando la máquina espera
Aplicaciones
Cuatro cosas para las que la construimos
Conversación
Tu idioma, sin frases calcadas
Un asistente que escribe y traduce con naturalidad en tu idioma — los modelos son multilingües, y la calidad la verificamos en nuestro polaco nativo, uno de los idiomas más difíciles de dominar. Responde más rápido de lo que tardas en leer la frase anterior, y toda la conversación se queda en un disco de tu casa.
Imagen y vídeo
Ve lo que le enseñas
Una foto, un documento escaneado, un clip de hasta un minuto — el modelo lo describe, lo resume y extrae los datos. Sin enviar archivos privados a un servidor ajeno.
Programación
Escribe código y lo comprueba ella misma
Recibe la descripción de una tarea y trabaja por su cuenta: crea los archivos, ejecuta las pruebas, corrige los errores. En nuestro test entregaba proyectos completos de 1500–3000 líneas.
Búsqueda
Va a por información fresca
Un buscador propio en la misma máquina permite al modelo comprobar los hechos de hoy, sin cuenta y sin dejar rastro de las consultas en ningún intermediario.
La prueba
Cuarenta proyectos escritos sin nuestra ayuda
En lugar de apoyarnos en declaraciones, dimos a la máquina diez tareas difíciles de programación y cuatro configuraciones distintas del modelo. Después comprobamos los resultados con nuestras propias herramientas — porque el modelo es capaz de escribir en la documentación que las pruebas pasan, aunque no pasen.
- ejecuciones autónomas
- 40
- ejecuciones autónomas
- para el conjunto de diez proyectos
- 3,8 h
- para el conjunto de diez proyectos
- criterios de aceptación comprobados
- 284
- criterios de aceptación comprobados
- cumplidos en la mejor configuración
- 71/71
- cumplidos en la mejor configuración
-
Las pruebas las ejecutamos nosotros. La declaración del modelo de que las pruebas estaban en verde no se aceptaba sin más — el runner las lanzaba de forma independiente.
-
Los requisitos de rendimiento se comprobaron midiendo. Uno de los modelos se apuntó en la documentación un umbral más suave del que exigía la tarea. Salió a la luz solo al ejecutarlo.
-
Toda la máquina trabajó aislada — en una cuenta aparte sin privilegios, con acceso únicamente al directorio de trabajo.
La factura de la luz
Lo mismo que una buena nevera
Medimos con un enchufe inteligente, contando el consumo del ordenador entero. No solo el de las tarjetas, no sobre el papel.
- espera una pregunta
- 120 W
- espera una pregunta
- trabajo típico
- 256 W
- trabajo típico
- la configuración más exigente
- 352 W
- la configuración más exigente
- pico momentáneo
- 580 W
- pico momentáneo
1,32 €
(1,52 $): esa cantidad bastó para los cuarenta proyectos del test de arriba (a nuestra tarifa polaca), es decir, unos 0,03 € (0,04 $) por tarea. Cuatro décimas partes de esa suma se fueron solo en mantener el ordenador encendido.
Con honestidad
Lo que esta solución no hace
Velocidad.
La tarjeta insignia tiene una memoria el doble de rápida y con los modelos más pesados será más veloz. La ventaja de las dos tarjetas es la capacidad y el precio, no el récord de velocidad — aunque el ritmo de escritura va igualmente por delante de quien lee.
Uno cada vez.
La máquina mantiene en memoria un modelo en cada momento. Cambiar a otro lleva entre diez y veinte segundos — en la práctica se elige el modelo según la tarea, igual que se elige un programa.
No lo sustituye todo.
Los modelos comerciales más grandes siguen ganando en las tareas más difíciles. Para la conversación, los documentos, la imagen y el código del día a día, la diferencia deja de importar.
Necesita cuidados.
Es un servidor, no un aparato de caja: actualizaciones, copias, elección de modelos. Por eso describimos la configuración completa — incluido lo que a nosotros no nos funcionó.
Laboratorio
Todas las mediciones descritas paso a paso
Documentamos esta máquina desde el primer arranque. Échale un vistazo si quieres construir una parecida — o comprobar nuestras cifras.
Por qué dos tarjetas tienen sentido: cómo se reparte el modelo entre ellas
Dos tarjetas gráficas no calculan el doble de rápido — y no se compran para eso. Se compran para sumar la memoria. Esto es lo que ocurre exactamente por dentro cuando el modelo se reparte entre dos tarjetas, y por qué es precisamente esta forma de división la que gana en un equipo doméstico.
Leer el artículo → 6 min de lectura
Cuánto contexto cabe de verdad en 32 GB
El contexto es la memoria de la conversación — todo lo que el modelo tiene delante cuando formula la respuesta. Es el segundo consumidor de memoria de la tarjeta tras los pesos del modelo, y normalmente es él quien decide si la configuración arranca siquiera. Comprobamos dónde está el límite con 32 GB. La respuesta resultó sorprendente: la mayoría de las veces no está en el hardware.
Leer el artículo → 5 min de lectura
Los modelos que probamos — y los que se quedaron para siempre
Por la máquina pasaron treinta y dos versiones configuradas de modelos. Se quedaron de forma permanente diez perfiles de trabajo construidos sobre cuatro archivos. Esto es lo que decidía el ascenso y lo que decidía la eliminación — y por qué un archivo más caro no siempre significa mejor.
Leer el artículo → 5 min de lectura
Cuánta electricidad consume al año una IA doméstica
Medimos el consumo con un enchufe inteligente — del ordenador entero, no solo de las tarjetas, durante más de una decena de horas de trabajo continuo. La conclusión es incómoda para la intuición: lo que más electricidad devora no es calcular, sino el simple hecho de mantener la máquina encendida.
Leer el artículo → 5 min de lectura
Un buscador propio para el modelo, sin cuentas en intermediarios
Un modelo de lenguaje conoce el mundo hasta el día en que terminó su entrenamiento. Para responder preguntas sobre cosas de hoy, tiene que saber buscar. Construimos para ello un buscador propio en la misma máquina — y de paso medimos cuánto trabajo hace falta para que los resultados lleguen en tu idioma.
Leer el artículo → 5 min de lectura