(Darrera actualització:
10/10/2026)
— Escrit per
SimeonOnSecurity— 11 temps de lectura en minuts
Dimensiona una configuració d’LLM local de 16GB segons els pesos del model, la memòria cau KV i el processament de prompts. Compara els pressupostos de memòria, l’amplada de banda de GPU i el cost de propietat de Qwen3.8 27B.
(Darrera actualització:
10/10/2026)
— Escrit per
SimeonOnSecurity— 13 temps de lectura en minuts
Guia pràctica d’octubre de 2026 per executar un model Qwen 27B amb 32 GB de memòria utilitzable de l’accelerador. Compara GPU individuals, equips amb dues targetes, memòria unificada, targetes usades de centres de dades, còmput llogat, suport de programari i límits de context complet.
(Darrera actualització:
10/10/2026)
— Escrit per
SimeonOnSecurity— 9 temps de lectura en minuts
La versió de 64 GB del DGX Spark de NVIDIA mostra com la pressió sobre el subministrament de memòria afecta el maquinari d’IA local. Aquesta guia explica la reducció de capacitat, els compromisos de la memòria unificada i per què l’alleujament de la DRAM és poc probable abans de finals de 2027.