Cuando una caja de doce mil dólares no llegará antes de enero, la pregunta cambia de orden: en vez de comprar primero y aprender después, alquilar a dos dólares la hora, aprender primero y decidir después. Eso hace el presentador; no oculta que quiere el nuevo Mac Studio M5 Ultra, pero antes de abrir la cartera somete un modelo abierto de la clase 27-32 mil millones de parámetros a tres trabajos reales sobre una tarjeta gráfica alquilada de 96GB. El resultado es del sorprendente: el modelo local es lento pero cumple, y lo que importa es saber qué trabajo toca a cada modelo. Esta pieza sigue ese orden y verifica cada cifra con Apple, Nvidia y tiendas actuales.
El escenario es Vast.ai: alquila una instancia con RTX Pro 6000 por unos 1,5-2 dólares la hora, la pausa o la borra sin uso, como un servidor en DigitalOcean. Según GPUTable, la misma tarjeta cotiza en spot entre 0,29 y 0,67, y bajo demanda entre 0,94 y 1,49; el listado propio de Vast.ai muestra bandas similares, hasta 2,09 en la nube segura de RunPod. Los dos dólares del vídeo son una banda alta razonable del lado seguro. Ni siquiera instala él mismo; con el uso del ordenador de Codex conecta su cuenta de Vast y registra el modelo como proveedor personalizado en Open Code. El detalle importa porque derriba el muro técnico previo: alquilar, instalar y correr colapsan en pocos pasos.
¿Por qué 96GB? Porque es el billete de entrada de esta clase de pesos. El modelo oído como Quinn es en realidad la familia Qwen de Alibaba; según ResearchAudio, Qwen3 32B pide unos 28GB con cuantización INT4 a 32K de contexto y 83GB en BF16, mientras la compilación Q4_K_M en Ollama baja a unos 20GB. Con cuantización, 96GB es espacio generoso; incluso a precisión completa cabe al límite. Según Apple, el M5 Ultra arranca cerca de 7.300 $ con 96GB y sube a la banda de 12.000 con 256GB. Elegir la RTX Pro 6000 de 96GB no es azar: ambos candidatos cargan igual memoria y el duelo corre en igualdad.
Tres pruebas con trabajo real
La primera tarea es un correo de soporte: salida desordenada del helpdesk, reglas estrictas, asunto obligatorio. El presentador da la misma entrada al modelo local y al fronterizo del día; según Anthropic, Opus 5.5 salió el 22 de septiembre de 2026, más fuerte en código y agentes y un 40 por ciento más barato de operar que su antecesor en cargas típicas. Empate: el local llega al mismo veredicto en 3 minutos 12 segundos; un mes de reembolso o guía a los datos. La brecha de velocidad es ancha, la de veredicto es cero. Para colas tolerantes a la espera, la tabla dice que el local alquilado basta.
La segunda tarea es un plan de producción de 20 horas de lunes a viernes: resto de presupuesto, equilibrio de patrocinios, una urgencia del viernes, rodajes y seis posts de LinkedIn. El modelo local levanta el mismo esqueleto: calendario de 22 horas, lista de noes, mensaje al contratista, lista de incógnitas. Lo notable es que pregunta en abierto en vez de inventar lo que ignora. Aquí nace la idea del agente asíncrono : si nadie espera delante, la lentitud deja de ser defecto; para un agente que clasifica gastos a las 2am, audita un canal o cierra el mes, 3 minutos o 30 segundos dan igual.
De aquí sale un modelo mental: el moldeado interactivo —amasar un producto, escribir una campaña, programar en vivo— queda en modelos fronterizos rápidos; lo rutinario, repetido e insensible al tiempo va al modelo local. El presentador cita harnesses como Hermes y OpenClaw, y usa Open Code como peor escaparate a propósito: una caja de chat para mirar fijo, donde el modelo lento peor luce. Y aun así empata, lo que refuerza la tesis: cambia el escaparate a un agente de fondo y el valor local se multiplica. La triple razón es nítida: coste, privacidad, propiedad.
Lo especial del M5 Ultra es el ancho, no la capacidad
Según Apple, el M5 Ultra fusiona dos M5 Max en un paquete; el ancho de banda de memoria llega a 1,2 TB/s, casi el doble de los 614 GB/s del M5 Max. La memoria unificada viene en 96, 256 y 512GB, con los 512GB a fines de octubre. Ahí está la emoción del presentador: no más gigabytes, sino cuántos datos entran y salen por segundo. Ese número decide la inferencia local; la capacidad responde si cabe, el ancho a qué velocidad fluye. Para esta clase 96GB basta; la velocidad la pone la manguera.
Tres caminos llevan a los mismos 96GB con distinta factura. Según Nvidia, la RTX Pro 6000 corona la clase desktop con 96GB GDDR7 con ECC, 1.792 GB/s, 600 W y 4.000 TOPS de cómputo IA. En el listado de B&H Photo (bhphotovideo) la tarjeta figura a 10.499 $; los 15.670 $ citados en el vídeo deben leerse como precio momentáneo según vendedor, con el listado actual más bajo. El segundo camino junta tres RTX 5090 de 32GB: según Newegg cada una va de 5.300 a 9.800 $, el trío pasa de 18.000 $, más caja, red y dudas de transferencia. El tercero es la memoria unificada del Mac Studio: todo en un pozo, sin mudanzas. Elegir entre la simpleza de una tarjeta y el trío escalable es una preferencia: superficie de fallo o velocidad de traslado.
La pregunta trampa y el tercer juez
La tercera prueba es una trampa: se pide una recomendación única de marketing, se prohíben tasas inventadas y cada cifra ausente debe escribirse como desconocida. Aquí el fronterizo gana claro. El presentador entrega ambas salidas a un tercer modelo como juez, con cuatro criterios: apego a la restricción, exactitud matemática, fuerza de razonamiento y recomendación con evidencia. El fallo: Opus honra la regla de desconocido-es-desconocido, su lógica experimental sostiene, limpia la duplicación Meta-YouTube; el local cuela supuestos sin apoyo. Marcador: dos empates, una derrota. Pero la pregunta acierta: ¿en qué trabajos vale ese plus?
La cuenta cierra el experimento: gasta unos 2,82 de un crédito de diez dólares, mientras la caja de 12.000 esperaría ociosa fines de semana y noches. Con pocas horas reales al día, alquilar no alcanza ni una fracción de comprar. Y la tarjeta alquilada sirve de ensayo previo: sin ver la diferencia entre encajarse en una tarjeta y expandirse en memoria unificada cuando crezca la clase, doce mil dólares no se atan a nada. Privacidad y propiedad son el bonus: nada sale fuera, sin peajes por token, el ensayo casi gratis.
El veredicto: qué caja, para quién
No compra el M5 Ultra de 12.000; mira un M4 Mac Studio de 128GB por unos 7.000: mitad de precio, más memoria, más lento, pero la lentitud no falla en asíncrono, más disco de 4TB. Su consejo es un protocolo: alquila una hora en Vast.ai, ata un modelo local con harness Open Code o Hermes a tu trabajo real por 2 $, mira qué puedes descargar y decide. Imagen, transcripción, edición de vídeo y uso del ordenador también pueden mudarse a local; tema de próximos episodios. La tesis en una línea: alquila primero, mide, luego compra; y al comprar mira ancho y matemáticas, no prestigio.
| Opción | Precio | Memoria | Ancho |
|---|---|---|---|
| M5 Ultra 256GB | ~12.000 $ | 256GB unificada | 1,2 TB/s |
| RTX Pro 6000 | 10.499 $ + caja | 96GB GDDR7 | 1,79 TB/s |
| 3x RTX 5090 32GB | ~18.000 $+ | 96GB total | cuello PCIe |
| Vast.ai alquiler | ~2 $/h | 96GB | bajo demanda |
Momentos clave
- La pregunta de 12.000 $: sin M5 Ultra antes de enero
- Montaje Vast.ai: RTX Pro 6000 a 2 $/h
- Codex instala, Open Code conecta
- Prueba 1: el correo de soporte empata en 3 minutos
- Prueba 2: el plan semanal de 20 h sale igual
- Ancho de banda: 1,2 TB/s, doble velocidad
- Tres caminos llevan a los mismos 96GB
- Pregunta trampa: gana Opus, Codex arbitra
- Veredicto: M4 de 128GB y regla de 2 $
Comentario de la IA
"Alquilar antes de comprar puede ser la mejor idea de hardware del año. El experimento de dos dólares convierte el deseo de 12.000 en una decisión medible y, en mi opinión, devuelve el debate local del escaparate a las matemáticas."
Evaluación de la IA
La objeción más fuerte es que una tarjeta alquilada no es un Mac en propiedad. La instancia alquilada no garantiza disponibilidad; las instancias spot pueden recuperarse, los precios suben en hora punta y los datos enviados al centro de datos recortan la ganancia de privacidad. El duelo de 96GB además adula la comparación al ignorar el margen del Mac de 256GB; cuando lleguen pesos mayores, el empate de hoy puede ser el cuello de mañana. El presentador no lo afronta del todo; la prueba corre justo en la clase que cabe en 96GB.
La medición es escasa: sin tokens por segundo, sin tiempo al primer token, sin consumo, sin ruido, sin coste total. Hay una clase de modelo y tres tareas de texto; imagen, transcripción, vídeo y uso del ordenador se despachan como meramente posibles. El arbitraje es simple ciego: cuando el tercer modelo es primo de la misma familia, la independencia se debilita; se nombra un juez externo pero sin puntuación.
El interés del presentador es transparente: quiere la caja de verdad, y él mismo hace el chiste del patrocinio. Léase así el elogio del M4; el marco de valor acerca al público a la alternativa barata. Aun así, el dinero salió de su bolsillo, el método es repetible y dejó perder la tercera prueba a propósito; ese autocontrol separa la pieza de la promoción.
La lección es una regla: lista los trabajos mudables al modelo local, ensaya una hora por 2 dólares con tu trabajo real y puntúa la calidad del veredicto, no la velocidad. El umbral de compra es nítido: con más de 20 horas semanales de trabajo local continuo y mandato de privacidad, compra la caja; si no, sigue alquilando. Mi veredicto: el experimento importa porque encoge el deseo de 12.000 dólares en una medición de 2, del prestigio a la aritmética.
Fuentes
10 enlaces; 1 de ellos también citados por 10 otras noticias. Stories sharing a link do not confirm each other; a source's origin is not inferred from how often it is cited.
- @youtube.com YouTube — Craig Hewitt
- @apple.com Apple — Mac Studio Specifications
- @nvidia.com Nvidia — RTX Pro 6000 Blackwell
- @bhphotovideo.com B&H Photo — RTX Pro 6000 Listing
- @gputable.dev GPUTable — RTX Pro 6000 Rental Prices
- @vast.ai Vast.ai — RTX Pro 6000 Pricing
- @researchaudio.io ResearchAudio — Qwen3 GPU Requirements
- @ollama.com Ollama — Qwen3 32B Library
- @anthropic.com Anthropic — Claude Opus 5.5
También citado por: The superintelligence race: Musk and Huang on energy, orbital compute and safe agents · Claude Opus 5.5: From Idea to Finished Work in a Single Session · The AI Week That Packed World Models, Open Weights and Data Centers Into Orbit · OpenAI's "o" Assistant, Claude Sonnet 5.5 and MiniMax M3.1: Three Model Bets Before DevDay · The AI Price War: Opus 5.5, GPT-6 Sol and the Quiet Bottleneck of the Agent Era · Four Launches in One Day: the Opus 5.5 Comeback and the GPT-6 Sol and Luna Price Break · Decide First, Generate Later: The Jev Plus Opus 5.5 Playbook · The Market Is Underestimating This Massive AI Demand Shift · I Tested Opus 5.5 on 24 Coding Tasks: Fable-Level Quality in Half the Time and Cost · Claude Opus 5.5 in the Wild: One-Hour Award Site, 3D Space Voyage and a Single Dashboard
- @newegg.com Newegg — RTX 5090 Listings
mac studio · rtx pro 6000 · modelos locales · qwen · vast.ai · ancho de banda