Vous tapez une question dans une intelligence artificielle en ligne. Vous attendez. Une seconde, parfois trois, parfois dix quand le service sature en milieu d’après-midi. Multipliez cette attente par les quarante ou cinquante requêtes que vous enverrez aujourd’hui, puis par les 220 jours ouvrés d’une année, et vous venez de perdre plusieurs journées entières à regarder un curseur clignoter. Maintenant, imaginez la même réponse qui commence à s’afficher avant même que votre doigt ait quitté la touche Entrée. C’est très exactement ce que promet
l’IA locale, et la promesse tient, à condition de comprendre d’où vient réellement ce fameux facteur dix.