Benchmarks de hardware
Medianas del carril ordinario para Qwen3.8 Flash Next. El costo local y la recuperación se recalculan con tus horas, tu electricidad y tus precios de API.
Qwen3.8 Flash Next · un flujo · primero lectura, luego escritura · ModelDock benchmarks
Los precios de API por defecto son $0.10 por millón de tokens de lectura y $0.64 por millón de tokens de escritura. Con 90/10 esa mezcla coincide con la columna de valor API publicada. Cámbialos por lo que pagas de verdad.
Tu carga
29 perfiles de hardware · Las filas de doble GPU necesitan espacio en la caja, margen de potencia y planificación multi-GPU.
| Ajuste | Evidencia | |||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|
| RTX 4090 single-card node | 24 GB | 4000 | 109,3 | Holgado | 550 W | $4199 | 75,8 | $0,056 | $1,98 | $11,67 | 433 d | Mediana |
| RTX 5080 16GB GDDR7 · single-card node | 16 GB | 3712,5 | 80,7 | Holgado | 510 W | $2800 | 58,3 | $0,058 | $1,84 | $8,98 | 392 d | Mediana |
| RTX 5070 Ti 16GB · Q3 or smaller only | 16 GB | 2498,5 | 71,1 | Holgado | 450 W | $2380 | 48,9 | $0,060 | $1,62 | $7,53 | 403 d | Mediana |
| RTX 3090 single-card node | 24 GB | 2094 | 86,5 | Holgado | 500 W | $2700 | 54,5 | $0,060 | $1,80 | $8,39 | 410 d | Mediana |
| RTX 4070 Ti SUPER 16GB 16GB GDDR6X · single-card node | 16 GB | 1700 | 72 | Holgado | 435 W | $2140 | 45,0 | $0,061 | $1,57 | $6,94 | 398 d | Mediana |
| RTX 5090 single-card node | 32 GB | 5803 | 168,4 | Holgado | 700 W | $8500 | 115,4 | $0,062 | $2,52 | $17,77 | 558 d | Mediana |
| RTX 3090 Ti single-card node | 24 GB | ~2255,1 | ~93,1 | Holgado | ~600 W | $2774 | 58,6 | $0,063 | $2,16 | $9,03 | 404 d | Estimación |
| AMD Radeon RX 7900 XTX 24GB GDDR6 · single-card node | 24 GB | 1459,3 | 75,5 | Holgado | 475 W | $2000 | 44,5 | $0,063 | $1,71 | $6,85 | 389 d | Mediana |
| AMD Radeon RX 9070 XT 16GB 16GB GDDR6 · single-card node | 16 GB | 1652 | 53,8 | Holgado | 454 W | $2000 | 35,9 | $0,076 | $1,63 | $5,54 | 513 d | Mediana |
| Ryzen AI Max+ 395 128 GB Radeon 8060S · 128GB unified memory | 128 GB | 1320 | 51,4 | Holgado | 170 W | $3500 | 32,9 | $0,077 | $0,61 | $5,06 | 786 d | Mediana |
| 2× RTX 5060 Ti 16GB each · dual-card node | 32 GB | 1602 | 67,6 | Holgado | 480 W | $2960 | 42,3 | $0,079 | $1,73 | $6,52 | 618 d | Mediana |
| RTX 5070 12 GB 12GB GDDR7 · single-card node | 12 GB | 1443,2 | 48,3 | Holgado | 400 W | $2070 | 32,1 | $0,080 | $1,44 | $4,94 | 592 d | Mediana |
| 2x RTX 3090 24 GB 24 GB each · dual-card layer split | 48 GB | 2137,6 | 111,3 | Justo | 850 W | $4200 | 65,5 | $0,082 | $3,06 | $10,08 | 598 d | Mediana |
| Mac Studio M5 Ultra 96 GB 30-core CPU · 64-core GPU · 96GB unified memory | 96 GB | ~2284,8 | ~64,8 | Holgado | ~360 W | $5499 | 44,6 | $0,097 | $1,30 | $6,87 | 987 d | Estimación |
| DGX Spark 128GB unified memory | 128 GB | 2228,5 | 48,7 | Holgado | 170 W | $5100 | 35,2 | $0,097 | $0,61 | $5,41 | 1062 d | Mediana |
| RTX PRO 6000 Blackwell 96GB GDDR7 ECC · single-card node | 96 GB | 8987,9 | 171,1 | Holgado | 720 W | $18.317 | 126,2 | $0,100 | $2,59 | $19,44 | 1087 d | Mediana |
| 2x RTX 3060 12 GB 12 GB each · dual-card layer split | 24 GB | 1239,8 | 41,3 | Holgado | 490 W | $1814 | 27,5 | $0,100 | $1,76 | $4,23 | 736 d | Mediana |
| MacBook Pro M5 Max 128 GB 128GB unified memory | 128 GB | 1310 | 67,3 | Holgado | 120 W | $6699 | 39,8 | $0,103 | $0,43 | $6,12 | 1177 d | Mediana |
| 2x TITAN RTX 24 GB 24 GB each · dual-card layer split | 48 GB | 1698,2 | 60,6 | Holgado | 710 W | $2881 | 39,6 | $0,104 | $2,56 | $6,10 | 812 d | Mediana |
| AMD Radeon RX 6900 XT 16GB 16GB GDDR6 · single-card node | 16 GB | 466 | 47,6 | Holgado | 450 W | $1669 | 21,4 | $0,118 | $1,62 | $3,30 | 994 d | Mediana |
| 2x AMD Radeon RX 6900 XT 16GB 16 GB each · dual-card layer split | 32 GB | 772,3 | 63 | Holgado | 750 W | $2138 | 31,4 | $0,123 | $2,70 | $4,83 | 1002 d | Mediana |
| Mac Studio M5 Ultra 256 GB 36-core CPU · 80-core GPU · 256GB unified memory | 256 GB | 2856 | 81 | Holgado | 360 W | $10.799 | 55,8 | $0,129 | $1,30 | $8,59 | 1481 d | Mediana |
| Mac Studio M5 Max 64 GB 40-core GPU · 64GB unified memory | 64 GB | ~517,9 | ~36 | Holgado | ~180 W | $3799 | 19,1 | $0,143 | $0,65 | $2,95 | 1653 d | Estimación |
| MacBook Pro M5 Max 64 GB 40-core GPU · 64GB unified memory · source chassis undisclosed | 64 GB | 517,9 | 36 | Holgado | 120 W | $5099 | 19,1 | $0,169 | $0,43 | $2,95 | 2028 d | Mediana |
| Mac Studio M5 Max 128 GB 40-core GPU · 128GB unified memory | 128 GB | ~517,9 | ~36 | Holgado | ~180 W | $5399 | 19,1 | $0,188 | $0,65 | $2,95 | 2349 d | Estimación |
| Mac mini M5 Pro 64 GB 18-core CPU · 20-core GPU · 64GB unified memory | 64 GB | ~259 | ~18 | Holgado | ~110 W | $2899 | 9,6 | $0,207 | $0,40 | $1,47 | 2691 d | Estimación |
| Mac Studio M4 Max 128 GB 128GB unified memory · source-backed oMLX profile | 128 GB | 446,8 | 32,5 | Holgado | 145 W | $6500 | 17,0 | $0,241 | $0,52 | $2,61 | 3108 d | Mediana |
| Mac Studio M3 Ultra 512 GB 80-core · 512GB unified memory | 512 GB | 479,6 | 18,1 | Holgado | 330 W | $9499 | 11,7 | $0,548 | $1,19 | $1,80 | 15.580 d | Mediana |
| RTX 4070 12 GB 12GB board-dependent GDDR6/GDDR6X · single-card node | 12 GB | 1376 | 36,9 | Holgado | 350 W | — | 25,7 | — | $1,26 | $3,96 | — | Mediana |
Hardware elegido
RTX 4090
24 GB · single-card node
Lectura tok/s
4000Escritura tok/s
109,3Potencia
550 WM tok/día
75,8Local $/M
$0,056Energía/día
$1,98Valor API/día
$11,67Recuperación
433 dCómo se mueven las cifras
- La capacidad diaria es horas activas por la tasa mixta. El tiempo es secuencial: parte de lectura dividida por tok/s de lectura, más parte de escritura dividida por tok/s de escritura.
- La energía por día es la potencia de todo el nodo por las horas por tu precio de electricidad.
- El costo local por millón de tokens es energía más hardware repartido en la vida útil, dividido por la capacidad diaria. Una GPU discreta es el precio de la tarjeta más $1,200 de host.
- Los días de recuperación son el precio del equipo dividido por el valor API por día menos la energía por día. Compara los precios de API de arriba; no promete un ahorro.