Tout outil de prédiction de texte doit exécuter un modèle de langage quelque part. Cette question du « où » change tout. Si le modèle tourne sur un serveur distant, votre texte doit d'abord y voyager. S'il tourne sur votre propre machine, il n'en sort jamais. À l'écran, la suggestion peut sembler identique dans les deux cas — la différence reste invisible tant qu'on ne se demande pas où le calcul a réellement eu lieu.
Ce n'est pas une nuance théorique. Elle détermine ce qu'une entreprise peut techniquement faire de votre texte, ce qu'une fuite de données chez elle expose, et si votre outil continue de fonctionner dans un train sans Wi-Fi. Voici ce qui change concrètement entre les deux approches.
Comment fonctionne une autocomplétion cloud
Un assistant d'écriture cloud repose généralement sur un client léger — une extension de navigateur ou un petit processus en arrière-plan — couplé à un modèle volumineux hébergé sur un serveur distant. Le déroulement typique :
- Vous tapez quelques mots dans un champ de texte.
- Le client capture le texte environnant et l'envoie sur le réseau vers l'API du fournisseur.
- Un modèle volumineux, exécuté sur son infrastructure, génère une suite possible.
- La suggestion revient et s'affiche sous forme de texte fantôme dans votre champ.
Cet aller-retour se produit à chaque pause dans la frappe, ce qui signifie qu'un flux continu de ce que vous écrivez — brouillons d'e-mails, messages de discussion, notes internes — transite par les serveurs d'un tiers. Certains fournisseurs conservent ce trafic pour améliorer leurs modèles, détecter des abus ou déboguer leur service. D'autres non. En tant qu'utilisateur, il est généralement impossible de vérifier lequel des deux cas s'applique, et les conditions peuvent changer avec une simple mise à jour de la politique de confidentialité.
Comment fonctionne un modèle local
Un outil embarqué inverse cette architecture. Le modèle lui-même — pas seulement le client — réside sur votre machine.
Le modèle est téléchargé une seule fois
Un fichier de modèle compact et quantifié est téléchargé sur le disque lors de l'installation. Ensuite, plus aucun accès réseau n'est nécessaire pour qu'il fonctionne.
L'inférence se fait sur votre CPU/GPU
Quand vous marquez une pause en tapant, le modèle s'exécute localement via un moteur d'inférence, lisant le texte voisin directement en mémoire — il ne quitte jamais le processus.
Aucun aller-retour réseau
Il n'y a pas de serveur à qui envoyer du texte, donc aucune requête à intercepter, journaliser ou conserver. La suggestion est calculée puis abandonnée dans le même processus local.
Typeahead for Windows fonctionne exactement ainsi. Il exécute un modèle local — Qwen 3, servi par llama.cpp — directement sur votre PC. La seule activité réseau nécessaire est le téléchargement du modèle et la vérification des mises à jour de l'application ; générer des suggestions ne requiert aucune connexion, et le texte que vous tapez n'est jamais transmis nulle part.
Ce que « aucune télémétrie » signifie vraiment
« Respectueux de la vie privée » est une formule accolée à de nombreux produits dont l'implémentation réelle varie énormément. Il vaut la peine de préciser ce qu'une architecture réellement locale exclut techniquement, pas seulement contractuellement :
Sans serveur impliqué, il n'y a pas de pipeline de journalisation de texte à mal configurer, pas de tableau de bord analytique qui pourrait accidentellement inclure le contenu de vos messages, et pas de base de données de texte utilisateur susceptible d'être exposée lors d'une fuite, d'un rachat d'entreprise ou d'un changement de politique d'usage des données. L'absence de trajet vers le cloud n'est pas une promesse contractuelle — c'est une propriété de l'architecture elle-même.
Le compromis : taille du modèle et capacités
Rien de tout cela n'est gratuit. Un modèle qui tient entièrement dans 400 Mo à 2,5 Go d'espace disque, exécuté sur le processeur d'un ordinateur portable, est nécessairement plus petit que les modèles massifs que les services cloud font tourner sur des GPU de centre de données. Pour des tâches ouvertes comme rédiger un essai entier depuis rien, un grand modèle cloud garde un avantage en amplitude créative.
Mais la prédiction de la suite d'une phrase est une tâche bien plus étroite que la génération ouverte — il s'agit de prédire une continuation plausible et courte d'une phrase déjà commencée, pas de composer un contenu inédit à partir de rien. C'est une tâche qu'un petit modèle local, correctement ajusté, gère bien, ce qui explique pourquoi le compromis de taille est beaucoup plus faible pour cet usage que pour une conversation généraliste.
| Propriété | Modèle local (Typeahead) | Autocomplétion cloud |
|---|---|---|
| Où l'inférence s'exécute | Sur votre appareil | Sur le serveur du fournisseur |
| Texte envoyé sur le réseau | Jamais | À chaque suggestion |
| Fonctionne hors ligne | Oui | Non |
| Compte requis | Non | Généralement oui |
| Exposition en cas de fuite chez le fournisseur | Aucune — aucun texte stocké côté serveur | Dépend de la politique de conservation |
Pour qui cela compte le plus
L'écart entre local et cloud n'est pas seulement théorique pour quiconque tape du contenu sensible — agents de support gérant des informations de compte, personnel médical ou juridique rédigeant des notes, ou toute personne soumise à un accord de confidentialité. Il compte aussi tout simplement pour qui écrit dans un train, dans un bureau en sous-sol, ou partout où la connexion est instable : un outil cloud devient muet, un outil local ne s'en aperçoit même pas.
Typeahead traite cela comme un comportement par défaut, pas comme une option à activer. Les champs de mot de passe sont toujours ignorés, et les gestionnaires de mots de passe ainsi que les applications financières sont protégés dès l'installation, sans aucun interrupteur pour désactiver cette protection — en plus du fait que le texte tapé ne quittait de toute façon jamais l'appareil.
Questions fréquentes
Typeahead envoie-t-il un jour mon texte tapé quelque part ?
Peut-on vérifier qu'un outil est vraiment local et ne prétend pas simplement l'être ?
Un petit modèle local vaut-il un grand modèle cloud ?
Typeahead nécessite-t-il un compte ou une connexion ?
Que télécharge Typeahead sur internet, s'il télécharge quelque chose ?
Obtenir Typeahead
Suggestions générées sur votre appareil, jamais sur un serveur. 9,99 $ à l'achat unique, essai gratuit de 7 jours.
Télécharger sur le Microsoft Store