Sotto il cofano la maggior parte degli strumenti di scrittura IA funziona allo stesso modo: quello che scrivi viene inviato a un server, un modello grande lo elabora e una risposta torna indietro attraverso la rete. Vale sia che lo strumento riscriva un paragrafo, sia che rediga un'email o si limiti a suggerire le prossime parole. È anche la parte che si nota di meno — finché non si pensa a che cosa significhi davvero «inviato a un server» per un messaggio personale o l'email a un cliente.
Un assistente di scrittura IA offline ribalta questo schema: il modello linguistico gira direttamente sul tuo PC, quindi nel giro non c'è alcun server. Questo articolo spiega come sia tecnicamente possibile, a che cosa rinunci e dove si colloca Typeahead come esempio.
Come funziona davvero la scrittura IA on-device
Gli strumenti IA cloud eseguono di norma modelli grandi — decine di miliardi di parametri — su hardware da data center, perché è l'unico posto in cui modelli simili stanno. Gli strumenti on-device usano modelli molto più piccoli e compressi, che occupano da qualche centinaio di megabyte a qualche gigabyte e girano sulla CPU o sulla GPU di un normale PC. Il prezzo di un ingombro minore è un modello un po' più piccolo — ma per un compito ristretto come prevedere la prossima parte di una frase, un modello compatto può essere davvero veloce e preciso senza bisogno della scala di un chatbot generalista.
L'inferenza vera e propria — il processo con cui il modello genera un suggerimento — avviene attraverso un runtime locale. Typeahead, per esempio, usa llama.cpp, un motore open source per eseguire modelli linguistici in modo efficiente su hardware di consumo, abbinato a un piccolo modello multilingue chiamato Qwen 3. Nessuna richiesta lascia mai la macchina, perché non c'è nessun posto dove andare: il modello e il runtime stanno entrambi sul tuo disco.
Nessun viaggio verso un server
I suggerimenti sono calcolati sulla tua CPU/GPU, non inviati a un data center e ritorno — non c'è nulla da intercettare, registrare o conservare da remoto.
Funziona senza connessione
Una volta scaricato il modello, l'assistente continua a funzionare con il Wi-Fi spento — in volo, in treno, ovunque.
Nessun account necessario
Non c'è alcun accesso legato a ciò che scrivi, perché non c'è alcun server che tenga traccia di chi lo sta usando.
I compromessi, onestamente
I modelli locali sono più piccoli dei modelli cloud più grandi, e più piccolo in genere significa meno capace nei compiti aperti come la generazione di testi lunghi o il ragionamento complesso. Per un lavoro ristretto e ben definito — prevedere come proseguirà con ogni probabilità la frase che stai già scrivendo — quel divario conta molto meno di quanto conterebbe, per esempio, per scrivere un saggio da un prompt di una riga. Il modello occupa anche spazio su disco (le tre opzioni di Typeahead vanno da circa 400 MB a 2,5 GB) e richiede un download una tantum prima di poter funzionare, a differenza di uno strumento cloud pronto nel momento in cui accedi.
Typeahead come esempio concreto
Typeahead è un'utility nell'area di notifica che suggerisce il resto della frase che stai scrivendo, in quasi tutte le app desktop di Windows: WhatsApp, Telegram, Slack, Chrome, Edge, Firefox, Outlook, Thunderbird, Word, Blocco note, Notepad++ e i riquadri di chat e di testo di VS Code. Gira su un LLM locale (Qwen 3 tramite llama.cpp) oppure su regole di correzione automatica personalizzate — completamente offline, senza account e senza telemetria del testo. La correzione automatica con snippet personalizzati e il completamento automatico da dizionario funzionano anche prima di scaricare un modello.
Sono disponibili tre dimensioni di modello, a seconda del compromesso che vuoi tra velocità e qualità: veloce (~400 MB, il predefinito), bilanciato (~1,1 GB) e massimo (~2,5 GB). Il modello è multilingue, copre oltre 100 lingue e suggerisce nella lingua in cui stai effettivamente scrivendo. I suggerimenti compaiono come testo fantasma al cursore; premi Tab (predefinito, configurabile) per accettarne uno. È un acquisto una tantum da 9,99 $ tramite il Microsoft Store con una prova gratuita di 7 giorni, e i gestori di password e le app finanziarie sono esclusi dai suggerimenti per impostazione predefinita.
Per un approccio affine, ma senza IA, alla scrittura più veloce, GagarinSoft realizza anche Text Replacements, un espansore di testo attivato da abbreviazioni digitate — utile se vuoi snippet esatti e prevedibili invece di suggerimenti generati dall'IA per una data frase.
Domande frequenti
Che cosa significa davvero «IA offline»?
Un modello locale è buono quanto un modello cloud come ChatGPT?
Typeahead invia mai il mio testo da qualche parte?
Quanto spazio su disco serve a un assistente di scrittura IA locale?
Può funzionare senza scaricare alcun modello?
Quali sono i requisiti di sistema?
Scarica Typeahead
Acquisto una tantum, nessun abbonamento. Windows 10 / Windows 11. Prova gratuita di 7 giorni.
Scaricalo dal Microsoft Store