Et si vos LLM tournaient directement chez vous ? 💻
Faire tourner des modèles d'IA en local fait rêver : garder ses données chez soi, s'affranchir des coûts du cloud et disposer de modèles directement sur sa machine. Mais entre la promesse et la réalité, le chemin réserve quelques surprises.
Lors de cette session, nous discuterons d'une stack d'inférence entièrement locale sur Mac Studio M3 Ultra, avec Ollama et LM Studio.
Format : [Niveau débutant][Talk]
Au programme :
- Pourquoi faire tourner des LLM et SLM en local ?
- De Linux au Mac Studio M3 Ultra : retour sur les différentes expérimentations
- IA locale : promesses, limites et compromis rencontrés en pratique
- Le détour par le cloud… et pourquoi revenir aujourd'hui vers le local
- Ollama, LM Studio et nouveaux outils agentiques : ce qui change la donne
Selon les expérimentations du moment, la session pourra également explorer des usages plus poussés : vibe coding et agents de code, génération d'images ou encore génération vocale.
Cette session n'est donc pas une recette toute faite pour construire « la stack locale parfaite », mais plutôt le récit d'une exploration : ce qui fonctionne, ce qui déçoit, ce qui a évolué et les compromis qu'il faut accepter.