Tu arrives tôt : c'est la toute première version du site, on y travaille encore.
DeviensDevInstagram

IA locale · version 1liens vérifiés le 5 octobre 2026

Ton IA gratuite, sur ton ordi, même dans l'avion

Les liens promis dans la vidéo, d'abord. Puis les trois étapes pour avoir une IA qui tourne sans internet, et le piège à éviter avant de partir.

Tous les liens

  1. 1. canirun.ai

    canirun.ai

    Le site détecte ta machine et te dit quels modèles passent, et lesquels sont trop lourds. À ouvrir en premier.

  2. 2. LM Studio

    lmstudio.ai

    Une appli pour télécharger un modèle et discuter avec. Gratuite. Mac, Windows, Linux.

  3. 3. Ollama

    ollama.com

    L'autre appli pour faire tourner un modèle chez toi. Gratuite. Mac, Windows, Linux.

  4. 4. Gemma 3, un modèle pour commencer

    ollama.com/library/gemma3

    Le modèle ouvert de Google, en plusieurs tailles, de 3,3 à 17 Go. Si tu ne sais pas lequel prendre, pars de celui-là.

  5. 5. Whisper, pour transcrire tes vocaux

    github.com/openai/whisper

    Le modèle de reconnaissance vocale d'OpenAI. Open source, il tourne sur ta machine, sans internet.

Tu n'as besoin que de LM Studio ou d'Ollama, pas des deux. Aucun email à donner pour lire cette page.

1

Pourquoi une IA locale, et pour quoi faire

On est en 2026, et il n'y a toujours pas le wifi dans tous les avions. Une IA locale tourne sans internet.

Une IA locale, c'est un modèle que tu télécharges une fois sur ton ordi. Ensuite, il tourne sur ta machine : pas de compte, pas d'abonnement, pas de connexion. Dans l'avion, dans le train, là où le réseau ne passe pas, il répond quand même.

Mais ne t'en sers pas pour coder. Pour avancer vite, les modèles frontières (Claude Code, Codex), il n'y a pas mieux. Un modèle local est parfait pour organiser tes tâches, ou pour dépanner.

 Un modèle localUn modèle frontière
Où il tourneSur ton ordiSur les serveurs de l'éditeur
InternetPas besoin, une fois le modèle téléchargéObligatoire
Ce que j'en faisOrganiser mes tâches, dépannerCoder
2

Étape 1 : regarde ce que ta machine peut faire tourner

Avant de télécharger quoi que ce soit, un site te dit quels modèles passent chez toi.

Ouvre canirun.ai sur l'ordi que tu emmènes. Le site détecte ta machine tout seul, dans le navigateur : ta carte graphique ou ton Mac, ta mémoire. Puis il classe les modèles ouverts selon ce qui tient vraiment dessus.

Ce que le site afficheCe que tu en fais
Ta machine, détectéeVérifie que c'est la bonne : carte graphique ou Mac, mémoire, nombre de cœurs
Une note par modèle, de S à FPlus la note est haute (S, puis A, puis B), plus le modèle est à l'aise chez toi. Tout en bas, c'est trop lourd
Ses meilleurs choix (« Best picks »)C'est là que tu prends tes deux ou trois noms

Tu n'as rien à installer et rien à comprendre aux fiches techniques : tu repars avec deux ou trois noms de modèles qui passent.

Sourcecanirun.ai, page d'accueil : « We detect your GPU or Mac and rank the open models that actually fit ». Consulté le 5 octobre 2026.

3

Étape 2 : installe LM Studio ou Ollama

Deux applis gratuites qui font la même chose : télécharger un modèle, et te laisser discuter avec.

Tu n'as besoin que d'une des deux. Tu l'installes comme n'importe quelle appli, tu l'ouvres, et tu cliques sur un modèle pour le sélectionner : elle le télécharge, et tu peux lui écrire.

 LM StudioOllama
PrixGratuit, chez toi comme au travailGratuit, code open source (licence MIT)
SystèmesMac (puce Apple), Windows, LinuxMac, Windows, Linux
Où trouver les modèlesLe catalogue de LM StudioLa bibliothèque d'Ollama
Téléchargerlmstudio.ai/downloadollama.com/download

Côté machine, la doc de LM Studio recommande 16 Go de RAM ou plus, sur Mac comme sur Windows. Sur Mac, il faut une puce Apple (M1 ou plus récent) et macOS 14. Mais le vrai juge, c'est canirun.ai : il part de ta machine.

Quel modèle prendre ? Un de ceux que canirun.ai a bien notés. Si tu veux un point de départ : Gemma 3, le modèle ouvert de Google. Il existe en plusieurs tailles, et sa fiche annonce plus de 140 langues.

La versionTaille à téléchargerElle lit
gemma3:4b3,3 GoTexte et images
gemma3:12b8,1 GoTexte et images
gemma3:27b17 GoTexte et images

Plus la version est grosse, mieux elle répond, et plus il lui faut de mémoire. Prends la plus grosse que canirun.ai note bien chez toi.

Avec Ollama, la même chose en une ligne de terminal

ollama run gemma3:4b
# télécharge le modèle la première fois, puis ouvre la discussion

SourceLM Studio gratuit : lmstudio.ai, « LM Studio is free for use at work » (8 juillet 2025). Configuration : lmstudio.ai, « System Requirements ». Licence d'Ollama : github.com/ollama/ollama. Tailles de Gemma 3 : ollama.com/library/gemma3, relevées le 5 octobre 2026.

4

Étape 3 : télécharge le modèle avant de partir

Le piège : un modèle pèse plusieurs gigas, parfois plusieurs dizaines. Ça ne se télécharge pas à la porte d'embarquement.

L'appli ne suffit pas : sans le modèle, elle est vide. Et le modèle, c'est le gros morceau. Chercher un modèle et le télécharger demandent internet ; c'est seulement une fois qu'il est sur ton disque que tout tourne hors ligne.

Donc quelques jours avant de partir, pas la veille :

  1. Télécharge le modèle, sur une bonne connexion.
  2. Vérifie qu'il marche sans internet : coupe le wifi, pose-lui une question.
  3. Vérifie qu'il est assez rapide. S'il met une minute à sortir trois lignes, prends la taille en dessous.

Si tu t'y prends quelques jours avant, tu as le temps d'en essayer un autre.

SourceCe qui demande internet et ce qui n'en demande pas : lmstudio.ai, « Offline Operation ».

5

Ce que j'en fais

Dans l'avion, ou au fin fond de Bali : je dicte, Whisper transcrit, le modèle local organise.

Quand je n'ai pas internet, je dicte des vocaux. Whisper, en local, les transcrit. Puis le modèle local m'organise tout ça : mes futures features, et mes prompts.

Quand j'ai de nouveau internet, je passe les tâches une par une dans les modèles frontières.

Sans internet

  1. Tes vocaux

    Tu dictes tes idées, comme elles viennent.

  2. Whisper, en local

    Il transcrit l'audio en texte, sur ta machine.

  3. Le modèle local

    Il range : les features à faire, les prompts à lancer.

Quand internet revient

Les modèles frontières

Tu leur passes les tâches une par une. C'est là que le code s'écrit.

Le modèle local ne code pas : il prépare le travail. Tu atterris avec une liste prête, pas avec des notes en vrac.

Whisper est le modèle de reconnaissance vocale d'OpenAI. Son code et ses modèles sont ouverts (licence MIT) et il comprend plusieurs langues. Deux façons de l'avoir chez toi :

  • Whisper, le dépôt d'OpenAI : la version d'origine, en Python.
  • whisper.cpp : la même chose réécrite pour tourner vite sur un ordi normal, Mac, Windows ou Linux. Ses modèles pèsent de 75 Mo pour le plus petit à 2,9 Go pour le plus gros.

Comme pour le reste : tu l'installes et tu le testes avant de partir.

Sourcegithub.com/openai/whisper (description, licence MIT). Plateformes et tailles des modèles : github.com/ggml-org/whisper.cpp. Consultés le 5 octobre 2026.