Sotto il cofano la maggior parte degli strumenti di scrittura IA funziona allo stesso modo: quello che scrivi viene inviato a un server, un modello grande lo elabora e una risposta torna indietro attraverso la rete. Vale sia che lo strumento riscriva un paragrafo, sia che rediga un'email o si limiti a suggerire le prossime parole. È anche la parte che si nota di meno — finché non si pensa a che cosa significhi davvero «inviato a un server» per un messaggio personale o l'email a un cliente.

Un assistente di scrittura IA offline ribalta questo schema: il modello linguistico gira direttamente sul tuo PC, quindi nel giro non c'è alcun server. Questo articolo spiega come sia tecnicamente possibile, a che cosa rinunci e dove si colloca Typeahead come esempio.

Come funziona davvero la scrittura IA on-device

Gli strumenti IA cloud eseguono di norma modelli grandi — decine di miliardi di parametri — su hardware da data center, perché è l'unico posto in cui modelli simili stanno. Gli strumenti on-device usano modelli molto più piccoli e compressi, che occupano da qualche centinaio di megabyte a qualche gigabyte e girano sulla CPU o sulla GPU di un normale PC. Il prezzo di un ingombro minore è un modello un po' più piccolo — ma per un compito ristretto come prevedere la prossima parte di una frase, un modello compatto può essere davvero veloce e preciso senza bisogno della scala di un chatbot generalista.

L'inferenza vera e propria — il processo con cui il modello genera un suggerimento — avviene attraverso un runtime locale. Typeahead, per esempio, usa llama.cpp, un motore open source per eseguire modelli linguistici in modo efficiente su hardware di consumo, abbinato a un piccolo modello multilingue chiamato Qwen 3. Nessuna richiesta lascia mai la macchina, perché non c'è nessun posto dove andare: il modello e il runtime stanno entrambi sul tuo disco.

Nessun viaggio verso un server

I suggerimenti sono calcolati sulla tua CPU/GPU, non inviati a un data center e ritorno — non c'è nulla da intercettare, registrare o conservare da remoto.

Funziona senza connessione

Una volta scaricato il modello, l'assistente continua a funzionare con il Wi-Fi spento — in volo, in treno, ovunque.

Nessun account necessario

Non c'è alcun accesso legato a ciò che scrivi, perché non c'è alcun server che tenga traccia di chi lo sta usando.

I compromessi, onestamente

I modelli locali sono più piccoli dei modelli cloud più grandi, e più piccolo in genere significa meno capace nei compiti aperti come la generazione di testi lunghi o il ragionamento complesso. Per un lavoro ristretto e ben definito — prevedere come proseguirà con ogni probabilità la frase che stai già scrivendo — quel divario conta molto meno di quanto conterebbe, per esempio, per scrivere un saggio da un prompt di una riga. Il modello occupa anche spazio su disco (le tre opzioni di Typeahead vanno da circa 400 MB a 2,5 GB) e richiede un download una tantum prima di poter funzionare, a differenza di uno strumento cloud pronto nel momento in cui accedi.

Quando vince l'offline: se quello che scrivi è delicato — corrispondenza con i clienti, messaggi personali, qualsiasi cosa coperta da NDA — il compromesso sulla privacy è tutto il punto. Se ti serve un modello che rediga da zero un rapporto di cinque pagine, in genere un modello cloud più grande farà un lavoro più accurato.

Typeahead come esempio concreto

Typeahead è un'utility nell'area di notifica che suggerisce il resto della frase che stai scrivendo, in quasi tutte le app desktop di Windows: WhatsApp, Telegram, Slack, Chrome, Edge, Firefox, Outlook, Thunderbird, Word, Blocco note, Notepad++ e i riquadri di chat e di testo di VS Code. Gira su un LLM locale (Qwen 3 tramite llama.cpp) oppure su regole di correzione automatica personalizzate — completamente offline, senza account e senza telemetria del testo. La correzione automatica con snippet personalizzati e il completamento automatico da dizionario funzionano anche prima di scaricare un modello.

Sono disponibili tre dimensioni di modello, a seconda del compromesso che vuoi tra velocità e qualità: veloce (~400 MB, il predefinito), bilanciato (~1,1 GB) e massimo (~2,5 GB). Il modello è multilingue, copre oltre 100 lingue e suggerisce nella lingua in cui stai effettivamente scrivendo. I suggerimenti compaiono come testo fantasma al cursore; premi Tab (predefinito, configurabile) per accettarne uno. È un acquisto una tantum da 9,99 $ tramite il Microsoft Store con una prova gratuita di 7 giorni, e i gestori di password e le app finanziarie sono esclusi dai suggerimenti per impostazione predefinita.

Per un approccio affine, ma senza IA, alla scrittura più veloce, GagarinSoft realizza anche Text Replacements, un espansore di testo attivato da abbreviazioni digitate — utile se vuoi snippet esatti e prevedibili invece di suggerimenti generati dall'IA per una data frase.

Domande frequenti

Che cosa significa davvero «IA offline»?
Significa che il modello linguistico gira sul tuo dispositivo invece che su un server remoto. Non c'è alcuna richiesta di rete che porti il tuo testo da qualche parte: il modello, il calcolo e il risultato restano tutti in locale.
Un modello locale è buono quanto un modello cloud come ChatGPT?
Per i compiti aperti i grandi modelli cloud sono in genere avvantaggiati per via delle loro dimensioni. Per un compito ristretto come prevedere la prossima parte di una frase che stai già scrivendo, un piccolo modello locale può cavarsela benissimo senza bisogno di quella scala.
Typeahead invia mai il mio testo da qualche parte?
No. Il testo digitato non lascia mai il dispositivo. L'unica attività di rete è scaricare un modello o verificare gli aggiornamenti dell'app — non c'è account né telemetria del testo.
Quanto spazio su disco serve a un assistente di scrittura IA locale?
Per Typeahead, tra circa 0,4 GB e 2,5 GB a seconda di quale dei tre modelli scegli — veloce, bilanciato o qualità massima.
Può funzionare senza scaricare alcun modello?
Sì, in parte. La correzione automatica con snippet personalizzati e il completamento automatico da dizionario funzionano subito, prima di scaricare qualsiasi modello. I suggerimenti di continuazione completa delle frasi richiedono un modello.
Quali sono i requisiti di sistema?
Windows 10 o successivo, oppure Windows 11, con 8 GB di RAM e 0,4–2,5 GB di spazio libero su disco a seconda del modello scelto.

Scarica Typeahead

Acquisto una tantum, nessun abbonamento. Windows 10 / Windows 11. Prova gratuita di 7 giorni.

 Scaricalo dal Microsoft Store