Retour au fil

Faites les calculs avant d'acheter une box IA domestique

Un sondage Reddit sur les configurations IA domestiques à 10 000 $, les abonnements chinois bon marché et une RTX 3090 d'occasion passée de 639 $ à 1 400 $ tournent tous autour de la même question : la box de 128 Go dans votre panier bat-elle un forfait à 200 $ par mois ? La vidéo mesure la mémoire unifiée, la bande passante et la charge cachée en tokens des agents de code, et relie la réponse non pas à l'argent, mais à la vie privée et à la tâche que vous exécutez réellement.

Importé dans Nodesdaily : (UTC+03:00)
Voir sur YouTube — WLX87R-PPvM
Options de lecture

La lecture vocale n’est pas disponible dans ce navigateur.

Loupe à concepts

Choisissez un terme technique de cette vue pour lire sa définition générale, un exemple pédagogique et son usage dans l’article.

Aucun terme de notre glossaire n’a été trouvé dans cette vue. Le glossaire ne couvre pas encore tous les termes.

La box dans votre panier part d'un carrefour familier. Quelqu'un sur Reddit a demandé à ceux qui avaient dépensé plus de 10 000 $ dans une configuration domestique s'ils le regrettaient, récoltant 338 upvotes et 347 commentaires. Le déclencheur : le prix des forfaits chinois est devenu dérisoire, comme Z.AI avec GLM-4.6. Les gens pèsent si une machine domestique justifie son argent et son temps face à un abonnement qu'ils paient déjà, et l'hésitation se loge précisément dans cet écart.

Pourquoi le prix de l'occasion refuse de baisser

La carte la plus convoitée est la RTX 3090, âgée de cinq ans, toujours la moins chère au dollar par gigaoctet avec ses 24 Go. Un traqueur de ventes eBay finalisées relevait environ 639 $ en janvier 2026 et environ 946 $ en juin — une hausse de 47,9 % en six mois. Au 16 septembre, deux traqueurs signalaient environ 1 400 $ et 1 415 $, tandis que des propriétaires en quête d'une seconde machine évoquent 1 300 à 1 500 $ sur le marché libre.

L'affirmation d'août selon laquelle toutes les cartes auraient triplé ne survit pas au traqueur. Sur 16 cartes suivies, seules quatre ont grimpé de plus de 5 % en six mois tandis que six ont chuté de plus de 5 %. Qualifier la DGX Spark de déchet électronique fondant au quotidien relève du même avis, pas d'une mesure. Le marché de l'occasion est en feu pour une carte, pas pour toutes.

Le calcul face à votre forfait

La revente étant une conjecture, le seul chiffre dur face à une box est le forfait que vous payez déjà. Une DGX Spark à 4 699 $ équivaut à environ 23 mois d'un forfait mensuel à 200 $, sans compter l'électricité, la revente ni une éventuelle hausse future. Un révélateur fut le plafonnement de Claude Code : quelqu'un au forfait Max à 200 $ a tellement buté sur la limite qu'il a acheté une Spark dès le lendemain pour environ 5 000 $, pariant sur une infrastructure que personne ne peut brider.

La mémoire unifiée est ce qui rend ces boxes séduisantes. La Spark offre 128 Go à 4 699 $ en septembre, contre 4 000 $ auparavant. Le Framework Desktop avec Ryzen AI Max+ 395 et les mêmes 128 Go est à 3 449 $, contre 2 459 $ en janvier et 1 999 $ au lancement. Un mini PC sans marque à 3 000 $ essuie un refus sec : pas de mises à jour BIOS, pas de mises à jour de pilotes, pas de garantie, non merci. Le nouveau Mac Studio avec M5 Ultra démarre à 5 499 $ avec 96 Go, si bien que les plus grands modèles tiennent désormais, du moins sur le papier.

Tenir n'est pas la même chose que répondre vite. Comme chaque nouveau mot force le modèle à être relu, la vitesse est une affaire de bande passante, pas de capacité. La Spark délivre 273 Go/s, une comparaison Mac Studio frôle 800 Go/s, une 3090 d'occasion pousse 936 Go/s. Aux prix actuels, la 3090 offre environ 11,5 fois plus de bande passante par dollar que la Spark ; à 946 $ en juin, l'écart était d'environ 17 fois, donc l'écart s'est resserré parce que la carte est devenue chère, pas parce que la box est devenue plus rapide.

Pourquoi un agent de code cale là où le chat vole

Un agent de code est une autre bête. Il lit votre base de code et la modifie, mais avant votre prompt il précharge ses propres instructions : environ 33 000 éléments pour Claude Code et environ 7 000 pour OpenCode, selon l'outil. Une exécution mesurée avec un modèle de 120 milliards de paramètres sur la Spark lit un prompt à 1 676 éléments par seconde avec 20 000 en contexte et écrit à 36,7 ; à 48 000, lecture 1 225 et écriture 30,4. Ces 33 000 éléments de départ font donc caler 20 à 27 secondes avant le premier mot. Un propriétaire à la fois de Spark et de Mac Studio M4 Max dit que la Spark gagne quand même en temps total parce qu'elle lit plus vite, même avec plus de bande passante sur le Mac. Le cache de contexte réduit les relectures mais ne change pas quelle box est plus rapide sur quel modèle. Sur une cible de taille moyenne Qwen3 27B, la Spark et la machine AMD Max+ 395 forment le pire duo, et un DeepSeek V4 Flash en 1 bit fortement compressé sur la même puce AMD dans un Strix Halo peine à 9 à 13 par seconde avec une longue attente du premier mot, jugé irréaliste pour le travail agentique par son propriétaire pourtant satisfait. L'anecdote d'un propriétaire de serveur domestique à 48 000 $ comparant ChatGPT au local — quelques secondes contre plus de 10 minutes, 10 à 100 fois plus rapide — se décrit elle-même comme une impression, pas un benchmark.

La 3090 corrige la vitesse par dollar mais révèle un plafond de taille qui nourrit l'envie suivante. Une carte contient 24 Go, une RTX 4090 aussi 24 Go et tient à peine un modèle de 30 milliards même compressé, si bien que les acheteurs parlent d'en prendre deux, puis quatre. Les modèles que l'on admire sont plus grands : la grande famille ouverte GLM après 4.6 veut plus de 1 To. Aujourd'hui une box de 128 Go plafonne avec les variantes d'entrée de gamme de Qwen, Gemma et Llama, et la meilleure réponse à la question de savoir si un MacBook Pro de 128 Go églera un jour le codage de pointe est non, pas même de loin. Pourtant, la seule façon de grandir est d'empiler les cartes, et cette soif ne s'arrête jamais : le regret d'un propriétaire est d'en avoir acheté une au lieu de deux, un autre avec deux en veut quatre, et le parcours le plus commenté — d'un MacBook à un PC de jeu RTX 5090, puis à un Mac Studio M3 Ultra de 96 Go et enfin à quatre RTX PRO 6000 de 384 Go dans un rack au sous-sol — corrige une limite et ajoute quelque chose à essayer, le constructeur calculant délibérément jamais la date de rentabilité.

Ce que ça coûte et ce qui revient

Au sommet, la pente des prix est raide. La RTX PRO 6000 Blackwell 96 Go était affichée à 8 565 $ au lancement en mars 2025, 13 250 $ en juin 2026 et 16 000 $ sur la place de marché des vendeurs en août, soit 87 % au-dessus du lancement. La RTX 5090 est passée de 1 999 $ à 6 899 $, les propriétaires de deux exemplaires disent qu'elles valent plus du double de ce qu'ils ont payé, et une 4090 lancée à 1 700 $ paraît désormais quasiment gratuite. Les histoires de revente dépendent du moment de l'achat : les acheteurs à bas prix peuvent revendre avec un petit bénéfice, mais vous achèteriez au sommet actuel. La reprise Apple semblait basse alors que le même Mac sur le marché libre tenait près du prix payé, un M3 Ultra 512 Go vu à 21 000 livres au Royaume-Uni. L'électricité se cache en pleine lumière : une 5090 à 475-500 W a carbonisé un connecteur, une box 3090 tourne au ralenti à 85-100 W avec deux écrans quand d'autres voient 45 à 50. Laissez 100 W au ralenti toute l'année et vous brûlez 876 kWh, environ 105 $ à 0,12 $ le kWh avant d'avoir écrit un seul token. Un acheteur arrête de monter en puissance parce que l'étape suivante exige un électricien et une facture qui s'envole, la blague d'hiver étant de chauffer la maison avec des cartes, mieux que le gaz.

Tout bien pesé, la comparaison honnête reste le forfait. Un convaincu du local autoproclamé a calculé que 10 000 $ achètent environ 6,2 milliards d'éléments sur un certain forfait pro et conseille, sauf si vos données doivent rester chez vous, d'attendre que les petits modèles s'améliorent et d'essayer en attendant une carte raisonnable de 24 à 32 Go pour Qwen3 27B. L'argument d'échelle se tient à côté : un centre de données occupé 90 % du temps exécutera presque toujours un modèle moins cher qu'une box domestique inactive 90 % du temps. L'attente a une autre raison : la DRAM sous contrat en hausse de 171,8 % sur un an en novembre 2025, toujours en progression, d'où le conseil autour du nouveau Mac Studio de continuer à payer le cloud jusqu'à ce que la pression sur la mémoire passe, car 96 Go seront justes dans deux à trois ans. Une blague récurrente dit de ne pas acheter encore, l'IA est sur le point de connaître son moment bon marché, tandis que le doute inverse dit que les modèles de pointe sont souvent discrètement émoussés et que les prix sont subventionnés et exploseront quand la subvention cessera. Ce sont des avis, pas des mesures.

Sur la seule question d'argent, la box perd ; elle ne gagne que sur autre chose : la possession et la vie privée avec un modèle modeste, plus les pipelines qui tournent sans fin. La réponse la plus votée présente l'IA domestique non pas comme une économie, arguant qu'elle n'a de sens que pour ceux qui valorisent le contrôle et la vie privée — et encore, uniquement avec un modèle compact comme Qwen3 27B. Certains disent leurs données inestimables, d'autres que leurs Macs ne volent pas leurs idées, certains soutiennent que la vie privée absolue exclut tout fournisseur commercial, l'un exécute en local pour qu'aucun fournisseur n'entraîne sur son œuvre d'une vie. La riposte qualifie la vie privée de raison affichée qui justifie souvent un hobby, tandis que quelqu'un ayant de vrais besoins de confidentialité suppose que personne ne dépense 10 000 $ juste pour économiser. L'autre raison, ce sont les boucles illimitées, les pipelines automatisés qui seraient coûteux dans le cloud. Les propriétaires ne cachent pas le hobby : l'un a commencé à demander à une IA des fiches de révision pour un examen et a fini par acheter des cartes MI50 d'occasion en Chine et à affiner des modèles toute la journée pendant que l'examen s'éloignait. Rires, meilleure des addictions, le savoir n'est jamais mauvais. Le chemin pratique est modeste : louez cette PRO 6000 à l'heure sur RunPod avant d'acheter, retenez d'un Threadripper watercoolé avec 768 Go et quatre 3090s, qui reste surtout à l'écart à cause d'une carte mère d'occasion défectueuse, tandis qu'un bon vieux PC avec une seule 3090 comble son propriétaire, commencez avec une carte AMD de 16 Go qui frôlait la suffisance puis passez à une carte de 32 Go qui couvre tout, ou saisissez un PC d'occasion à 1 300 $ avec une 3090 qui fait tourner Qwen3 27B avec un grand contexte et vous donne déjà envie d'une seconde. La question du panier change donc de forme : non pas si le local égale le cloud, mais si le local est suffisant pour les tâches dont vous avez réellement besoin — et même alors, commencez petit.

Visualization: nodesdaily AI

Moments clés

  1. La box dans votre panier et le sondage Reddit
  2. Pourquoi le prix de la RTX 3090 a flambé
  3. Toutes les cartes ont-elles triplé de valeur
  4. 23 mois de forfait contre la box
  5. Mémoire unifiée et goulot de bande passante
  6. Le stall de 33 000 éléments avant le premier mot
  7. Le plafond de 24 Go et le rêve du 1 To
  8. La fièvre de l'empilement et le rack au sous-sol
  9. La trajectoire de prix de la PRO 6000 jusqu'à 16 000 $
  10. Facture d'électricité et chauffage de la maison
  11. Vie privée, hobby et commencer petit

Commentaire de l’IA

""Ma lecture est sans détour : la box domestique paraît tentante sur le papier, mais les mesures pénalisent les flux de travail agentiques, pas le chat. Les prix sont gonflés, la revente relève du vœu pieux et la consommation s'accumule discrètement, donc je juge un achat non pas au calcul en dollars, mais à la question de savoir si vos données doivent rester chez vous et si un petit modèle comme Qwen 27B fait vraiment le travail.""

Évaluation de l’IA

Construisez le meilleur argument pour le cloud dans sa forme la plus forte : le cloud délivre toujours l'intelligence de pointe en quelques secondes, sans le stall de dizaines de secondes avant le premier mot que vous mesurez sur une machine locale. Sa courbe de prix a aussi tendance à rester plate sous l'effet de la concurrence, tandis que les courbes du matériel local se courbent vers le haut. Vouloir le battre avec la seule vie privée ignore l'argument d'échelle 90/90 et le plafond dur de 273 Go/s.

Les limites sont nombreuses et liées aux mesures. Les vitesses concernent un prompt et un modèle, sans débit en batch ni embeddings. Le starter de 33 000 n'est pas universel — OpenCode est proche de 7 000 et le cache de prompt réduit les tours suivants — donc les pires stalls surestiment l'usage typique. Le calcul de revente et d'électricité pour 876 kWh par an exclut les tarifs nationaux et la surconsommation de la carte plus les écrans. Les traqueurs de prix mélangent aussi ventes eBay finalisées et moyennes d'annonces, deux univers différents pour la médiane de septembre.

Sur l'intérêt et la vérifiabilité, lisez attentivement. Les médianes de la RTX 3090 à 639 $ et 946 $ et la fourchette 1 400-1 415 renvoient à pcprice.watch et ResalePrices ; la trajectoire de la PRO 6000 de 8 565 $ à 16 000 $ correspond aux annonces vendeurs de VideoCardz ; la flambée DRAM de 171,8 % figure chez TrendForce et TechSpot ; les 273 Go/s et 128 Go de mémoire unifiée de la Spark correspondent à la fiche technique du fabricant. Les affirmations selon lesquelles toutes les cartes auraient triplé, le déchet fondant au quotidien, les prix subventionnés et l'émoussement silencieux des modèles restent des avis, pas des mesures, et ne devraient pas devenir des verdicts sans historiques de prix indépendants.

Mon filtre pratique est modeste : si vos données n'ont pas besoin de rester chez vous et que votre charge est de quelques heures de travail agentique intensif par jour, restez au forfait et testez une carte raisonnable de 24 à 32 Go via une location horaire. Si la vie privée, la propriété intellectuelle ou des boucles sans fin vous imposent le local, planifiez autour d'un petit modèle comme Qwen3 27B, achetez la box de 128 Go pour le contexte de ce modèle, pas pour un rêve de grand modèle, et validez d'abord par une location horaire. Une grande box ne signifie pas un grand modèle, elle peut signifier une grande attente.

Sources

8 liens ; aucun autre article publié ne les cite. Stories sharing a link do not confirm each other; a source's origin is not inferred from how often it is cited.

matériel · chiffres · domicile · nodesdaily

Suivre le sujet

Avant cet article

Un court ordre de lecture des articles antérieurs reliés à cet événement par un éditeur.

Preuves et sources

Consultez les passages autorisés, leurs versions et leur origine.

KAYNAKLARLA OKU

Bu haberi açalım.

Hesap kontrol ediliyor…