Un modello linguistico da decine di miliardi di parametri arriva sul computer e la scheda video risponde che non c'è abbastanza memoria. È il limite più comune dell'AI locale: non basta un processore veloce, il modello deve entrare nella memoria accessibile alla GPU. Framework Desktop affronta il problema con AMD Ryzen AI Max, un chip che riunisce processore e grafica e usa un unico grande serbatoio di memoria. Nella configurazione da 128 GB, Framework dichiara fino a 96 GB assegnabili alla grafica su Windows e presenta il sistema come capace di eseguire modelli della classe Llama 70B. È diverso da un desktop con scheda video separata. Una GPU consumer potente può essere molto veloce, ma spesso offre 12, 16 o 24 GB di memoria dedicata. Quando il modello non entra, una parte viene spostata nella RAM di sistema e la velocità può crollare. Il Framework sacrifica parte delle prestazioni assolute per mettere molta memoria vicino alla grafica in un volume di 4,5 litri. Le varianti ufficiali combinano Ryzen AI Max 385 con 32 GB oppure Ryzen AI Max+ 395, 16 core, con 64 o 128 GB.
Perché è importante
- La versione da 128 GB può assegnare fino a 96 GB alla grafica e caricare modelli che non entrano nelle comuni schede video da 12 o 16 GB.
- La memoria è saldata alla scheda: il PC è modulare per porte, storage, case e raffreddamento, ma non permette di aggiungere RAM in seguito.
- Eseguire un modello in locale può tenere documenti e prompt sul proprio computer, purché il software scelto non invii telemetria o richieste al cloud.
Il vantaggio non è una sigla AI: è quanta memoria può usare la grafica
La parola NPU può distrarre. È il piccolo acceleratore dedicato alle funzioni AI integrate nel sistema operativo, utile per alcuni effetti e modelli compatti. Per eseguire un grande modello generativo in locale, contano soprattutto GPU, banda di memoria, supporto del software e quantità di memoria disponibile. Non abbiamo effettuato una prova diretta del Framework Desktop: la valutazione si basa sulle specifiche del produttore, sulla documentazione AMD e su prove pubbliche. Framework costruisce il prodotto intorno a componenti standard: scheda Mini-ITX, due slot M.2 per SSD, Wi-Fi 7, Ethernet a 5 gigabit, USB4 e piccole Expansion Card intercambiabili per scegliere le porte. Case, pannelli, ventola e storage possono essere sostituiti. La memoria LPDDR5x, invece, è saldata alla scheda madre perché deve offrire banda elevata. Chi compra 32 o 64 GB non potrà aggiungerne altri tra due anni. È il compromesso centrale e va deciso prima dell'ordine. Il 25 agosto 2026 la pagina globale della sola scheda madre mostrava 969 dollari per 32 GB, 1.659 per 64 GB e 3.149 per 128 GB. Non è il costo del computer completo: servono almeno case o supporto, raffreddamento, alimentatore, SSD e sistema operativo quando a pagamento. Framework spedisce prodotti in Italia, ma disponibilità, IVA e prezzi localizzati vanno verificati nel configuratore italiano al momento dell'acquisto. L'azienda aggiorna spesso i listini perché il costo della LPDDR5x è aumentato; a luglio ha dichiarato di aver alzato ancora il prezzo della versione da 128 GB.
Il confronto va fatto sul lavoro da completare. Se usi ChatGPT, Codex nel cloud o servizi API, un normale portatile recente è sufficiente: la potenza è nei data center. Se devi sperimentare ogni giorno con modelli da 7 o 14 miliardi di parametri, 32 o 64 GB possono bastare. I 128 GB hanno senso per modelli più grandi, contesti lunghi, immagini o più servizi simultanei. Per orientarsi tra uso cloud e locale, la guida su quale PC serve davvero per ChatGPT, Codex e modelli locali offre tre scenari di spesa più ampi.
Cosa puoi farci concretamente
- Scegliere prima il modello e misurarne memoria, velocità e qualità; solo dopo decidere se servono 32, 64 o 128 GB.
- Calcolare il costo completo includendo SSD, sistema operativo, alimentazione, ventola, porte, monitor, backup e consumo elettrico.
- Per dati riservati, verificare con il firewall e la documentazione che modello, interfaccia e strumenti collegati lavorino davvero in locale.
Privacy locale sì, ma soltanto se tutto il flusso resta sul computer
Tenere il modello sulla scrivania evita di inviare ogni documento a un fornitore cloud. È utile per bozze riservate, archivi tecnici e sviluppo senza connessione. Non basta però scaricare un modello. L'interfaccia usata per chattare, le estensioni, gli strumenti agentici e i servizi di ricerca possono collegarsi a Internet. Per dati sensibili servono software documentato, aggiornamenti, cifratura del disco, account separati, backup e un controllo reale delle connessioni. Locale descrive il luogo del calcolo, non una garanzia automatica di privacy. La compatibilità è migliorata con strumenti come llama.cpp e Ollama, ma i risultati dipendono dal modello e dal backend. Molti progetti sono ottimizzati prima per GPU NVIDIA e CUDA; AMD usa percorsi diversi e alcune funzioni possono arrivare più tardi o richiedere configurazione. Prima di acquistare, prova lo stesso modello su un computer disponibile o su un servizio a ore, registra token al secondo, memoria occupata e qualità. Un modello che entra ma risponde troppo lentamente non risolve il problema. Le alternative sono nette. Un Mac Studio offre memoria unificata, software maturo e un sistema completo, ma può costare di più e non è modulare. Una workstation con NVIDIA è spesso più veloce e compatibile, però per superare 24 o 32 GB di memoria video il prezzo sale rapidamente. Mini PC Ryzen AI Max come il GMKtec EVO-X2 analizzato per l'AI locale adottano un'idea simile in un prodotto più chiuso. Il cloud resta migliore per picchi occasionali e accesso immediato a modelli di frontiera.
Il verdetto: Framework Desktop è una macchina interessante per sviluppatori e piccoli laboratori che sanno quale modello vogliono eseguire e valorizzano riparabilità, porte configurabili e Linux. La versione da 128 GB non è una scorciatoia economica universale, soprattutto dopo i rincari. Per chi usa soprattutto assistenti online, è sovradimensionata. Per chi deve tenere in casa modelli grandi e dati controllati, può essere una delle poche strade compatte, a patto di accettare la decisione irreversibile sulla RAM e di verificare il software prima dell'hardware. Nell’hardware AI prestazioni e affidabilità devono essere osservate nel sistema completo. Sensori, memoria, rete, alimentazione e software determinano il risultato quanto il componente più visibile. I test devono quindi riprodurre condizioni e carichi operativi. Nel caso di “Framework Desktop mette 128 GB in un mini PC: è davvero la scorciatoia per l'AI locale?”, questo significa leggere la novità oltre l’annuncio e capire quali parti del lavoro vengono realmente modificate. Il rischio è misurare soltanto il picco e ignorare manutenzione, sicurezza e variabilità. Nel mondo fisico un errore può fermare un processo o produrre conseguenze materiali. Soglie, ridondanze e procedure di recupero sono parte della prestazione. La diffusione dipenderà dalla capacità di ridurre costo di integrazione e tempo di riconfigurazione. Piattaforme, simulazione e strumenti condivisi possono accelerare il passaggio alla produzione, mentre il know-how sul processo resterà determinante. La notizia è quindi un indicatore di una trasformazione più ampia, che va seguita attraverso risultati e condizioni operative anziché con la sola successione degli annunci.
Quello che conta adesso
Scegliere prima il modello e misurarne memoria, velocità e qualità; solo dopo decidere se servono 32, 64 o 128 GB. Questo primo passo serve a trasformare il tema in un perimetro verificabile: un responsabile, un input conosciuto, un risultato atteso e una misura precedente con cui confrontarsi. Senza questi elementi il progetto rimane una dimostrazione difficile da valutare. Calcolare il costo completo includendo SSD, sistema operativo, alimentazione, ventola, porte, monitor, backup e consumo elettrico. L’azione deve essere documentata insieme ai criteri di controllo, indicando quali casi possono procedere e quali devono fermarsi. È così che l’esperienza delle persone diventa una regola applicabile e migliorabile nel tempo. Per dati riservati, verificare con il firewall e la documentazione che modello, interfaccia e strumenti collegati lavorino davvero in locale. Prima di estendere il metodo è utile raccogliere correzioni, tempi e costi per alcune settimane. Gli errori vanno raggruppati per causa: dati, istruzioni, strumenti o eccezioni del processo. Ogni categoria richiede un intervento diverso. La versione da 128 GB può assegnare fino a 96 GB alla grafica e caricare modelli che non entrano nelle comuni schede video da 12 o 16 GB. È il punto da cui partire perché definisce l’effetto più immediato per professionisti e imprese. La sua importanza va misurata sul lavoro quotidiano: quante attività coinvolge, quali persone tocca e cosa accade quando il risultato non è corretto.
La memoria è saldata alla scheda: il PC è modulare per porte, storage, case e raffreddamento, ma non permette di aggiungere RAM in seguito. Questo secondo elemento chiarisce perché non basta scegliere un prodotto. Servono un processo, dati affidabili e una responsabilità finale. L’adozione diventa sostenibile quando la tecnologia può essere osservata e corretta senza interrompere l’operatività. Eseguire un modello in locale può tenere documenti e prompt sul proprio computer, purché il software scelto non invii telemetria o richieste al cloud. Il terzo punto indica la prospettiva di medio periodo. La decisione migliore non è necessariamente quella con più funzioni, ma quella che mantiene valore, controllo e possibilità di evoluzione quando cambiano modelli, prezzi o requisiti.
Fonti
Documenti, comunicati e pubblicazioni consultati per ricostruire dati e contesto.
- Framework — Configurazioni e specifiche del Framework DesktopFonte primaria
- Framework — Prezzi correnti della scheda madre Ryzen AI MaxFonte primaria
- Framework — Aggiornamenti 2026 su prezzi di memoria e storageFonte primaria
- Framework — Paesi e regioni serviti, inclusa l'ItaliaDocumentazione
- AMD — Ryzen AI Max+ PRO 395, specifiche ufficialiFonte primaria



