Comment j’ai optimisé Ollama pour exécuter mes modèles locaux à pleine vitesse
Quand j’ai commencé à faire tourner mes premiers modèles de langage en local avec Ollama, j’ai vite compris que la vitesse de […]
Marre des lenteurs sur Ollama ? Voici comment j’ai quadruplé mes tokens/seconde (mes retours d’XP et optimisations)
Salut à tous, Franchement, au début, je ne comprenais pas. J’ai installé Ollama pour faire tourner des LLM en local, pensant que […]
ollama n’est pas reconnu en tant que commande interne, Voilà comment régler ça une bonne fois pour toutes
Je viens de passer une bonne heure à m’arracher les cheveux sur mon PC portable en essayant de lancer un LLM en […]
Tourner Ollama sous Docker avec GPU (Nvidia/AMD) sans s’arracher les cheveux (et avec Open WebUI)
Salut à tous, Je me suis récemment lancé dans l’auto-hébergement de LLM en local. Après avoir testé pas mal de configurations, je […]
Guide complet VRAM et GPU pour Ollama : ce que j’ai appris à la dure (RTX, Mac, AMD…)
J’ai passé ces derniers mois à tester à peu près toutes les configurations possibles pour faire tourner Ollama en local. J’ai commencé […]
Comment j’ai enfin compris les GPU layers sur Ollama (et pourquoi votre modèle rame probablement sur le CPU)
Franchement, au début, je ne comprenais pas pourquoi mon Llama 3.1 ramait autant sur ma bécane alors que j’ai une configuration plutôt […]
Ollama GPU sur Windows : Mon retour d’expérience et comment j’ai résolu les pires galères de détection
Je fais tourner des LLM en local depuis pas mal de temps, et quand Ollama a sorti son installateur natif pour Windows […]
Le guide pour utiliser le GPU offloading sur Ollama
On ne va pas se mentir : la première fois qu’on lance Ollama, on a l’impression que c’est magique. Tu télécharges un […]
Mon setup Ollama ultime pour coder en local (et pourquoi vous devriez lâcher Copilot)
Honnêtement, j’en ai eu marre de payer mon abonnement GitHub Copilot. Surtout quand on voit la vitesse à laquelle les modèles open-source […]
Ollama fait enfin de la génération d’images en local (Text-to-Image) ! Mon retour sur FLUX.2 Klein et Z-Image Turbo
Salut tout le monde, Je voulais partager une petite révolution avec vous. Si vous utilisez Ollama, vous savez qu’on était habitués aux […]
Comparatif des modèles Ollama en 2026 : Lequel choisir selon votre VRAM ?
Ça fait un bon moment maintenant que je fais tourner toute ma stack d’IA en local avec Ollama, et s’il y a […]
Ollama pour faire tourner Claude Code gratuitement en local
Salut la commu ! Comme pas mal d’entre vous, je bavais d’envie devant Claude Code, l’assistant de codage dans le terminal qu’Anthropic […]