(Darrera actualització:
10/10/2026)
— Escrit per
SimeonOnSecurity— 11 temps de lectura en minuts
Dimensiona una configuració d’LLM local de 16GB segons els pesos del model, la memòria cau KV i el processament de prompts. Compara els pressupostos de memòria, l’amplada de banda de GPU i el cost de propietat de Qwen3.8 27B.
(Darrera actualització:
10/10/2026)
— Escrit per
SimeonOnSecurity— 10 temps de lectura en minuts
Compara la IA local amb ChatGPT i Claude amb puntuacions de referència, estimacions de memòria, velocitat de servei i verificació d’agents. Inclou escenaris amb RTX 5090, DGX Spark i Mac Studio.
(Darrera actualització:
10/10/2026)
— Escrit per
SimeonOnSecurity— 13 temps de lectura en minuts
Guia pràctica d’octubre de 2026 per triar models d’IA locals per a agents de programació. Compara la memòria de GPU, el creixement de la KV-cache, la mida del context, la qualitat de la quantització, el processament de prompts, la configuració del raonament i el cost del lloguer al núvol.
(Darrera actualització:
10/10/2026)
— Escrit per
SimeonOnSecurity— 10 temps de lectura en minuts
Diagnostica respostes inconsistents d’OpenRouter, compara els límits dels endpoints i els costos de la memòria cau, i configura l’enrutament sense desactivar controls de qualitat per accident.