← Tous les guides
🦙

Claude Code avec une IA locale gratuite (Ollama)

AI_Kwat · Épisode 2 · 10 min de lecture

Ollama (licence MIT, plus de 180k étoiles GitHub) fait tourner des modèles d’IA sur votre propre ordinateur. Il propose aussi une API compatible Anthropic : Claude Code peut donc utiliser un modèle local au lieu des serveurs d’Anthropic. Normalement, Claude Code demande un abonnement Claude payant ; avec ce réglage, il parle à votre modèle local.

1

Installer Ollama

Ouvrez un terminal et lancez la commande pour votre système. Vous pouvez aussi télécharger l’installateur sur ollama.com.

Windows (PowerShell)
irm https://ollama.com/install.ps1 | iex
macOS / Linux
curl -fsSL https://ollama.com/install.sh | sh
2

Télécharger un modèle et le tester

Cette commande télécharge Gemma 4 de Google et ouvre une discussion dans votre terminal. Écrivez un message pour vérifier, puis /bye pour sortir. Les petits modèles tournent sur un portable normal ; les plus gros demandent plus de mémoire.

ollama run gemma4
3

Installer Claude Code

Passez cette étape si vous l’avez déjà. Vérifiez ensuite avec claude --version.

Windows (PowerShell)
irm https://claude.ai/install.ps1 | iex
macOS / Linux / WSL
curl -fsSL https://claude.ai/install.sh | bash
4

Connecter Claude Code à Ollama

Une seule commande. Ollama démarre Claude Code et le branche sur votre modèle grâce à son API compatible Anthropic.

ollama launch claude

Vous préférez le faire à la main ? Définissez ces variables, puis lancez Claude Code avec votre modèle (exemple de la doc Ollama) :

5

Réglage manuel (optionnel)

Shell macOS / Linux. Sous Windows PowerShell, utilisez $env:ANTHROPIC_AUTH_TOKEN="ollama", etc.

export ANTHROPIC_AUTH_TOKEN=ollama
export ANTHROPIC_API_KEY=""
export ANTHROPIC_BASE_URL=http://localhost:11434
claude --model qwen3.5
6

Donner assez de contexte au modèle

Pour les outils de code, Ollama recommande une fenêtre de contexte d’au moins 64 000 tokens pour que le modèle garde votre projet en tête. Dans l’application Ollama, utilisez le curseur de longueur de contexte dans les réglages, ou démarrez le serveur ainsi. Plus de contexte = plus de mémoire ; vérifiez avec ollama ps.

OLLAMA_CONTEXT_LENGTH=64000 ollama serve
Soyons réalistes : un modèle local n’est pas aussi capable que les meilleurs modèles de Claude. C’est excellent pour les petites modifications, les scripts et l’apprentissage, pour zéro dollar. Pour les gros projets complexes, vous voudrez quand même la vraie version.

📄 Recevoir le guide PDF

Entrez votre email et téléchargez la version imprimable. Vous recevrez aussi les nouveaux guides. Désinscription à tout moment.

Votre email sert uniquement aux guides AI_Kwat. Pas de spam.

Sources officielles