Fm chat terminal
|

FM : un LLM 100 % local, nativement dans le terminal de macOS 27

https://medium.com/@nuthalapativarun/local-ai-in-your-terminal-scripting-with-apples-new-fm-cli-and-mlx-26eae9f31007

📌 FM est un outil en ligne de commande préinstallé avec macOS 27 qui donne accès au modèle de fondation d’Apple Intelligence directement depuis le terminal — sans installation, sans clé API et sans compte.

J’ai lancé fm respond sur mon Mac et le modèle local a répondu en français, en une fraction de seconde. Pour l’activer, une seule formalité : accepter la licence (fm license), une seule fois. Rien à télécharger, rien à configurer, et aucun octet qui ne quitte la machine pour le modèle embarqué. C’est le genre de nouveauté discrète qui change durablement l’usage, plutôt que celle qui fait du bruit une semaine.

Jusqu’ici, automatiser de l’IA sur un Mac signifiait appeler une API cloud payante ou installer tout un runtime. Avec macOS 27, le terminal dispose de deux moteurs locaux. fm d’abord, qui utilise le modèle d’Apple (vous ne choisissez pas les poids, c’est son parti pris). Et mlx_lm ensuite, un CLI à installer d’un pip install mlx-lm, qui exécute n’importe quel modèle ouvert de la communauté Hugging Face sur le GPU et le Neural Engine. L’un est instantané et intégré, l’autre laisse le choix des poids.

Là où ça devient intéressant, c’est quand fm entre dans des scripts. fm respond prend une question et imprime la réponse sur la sortie standard : parfait pour une pipeline. Mais les deux commandes qui m’ont marqué sont fm schema et l’option --schema. Vous décrivez la forme de la réponse attendue (un JSON avec des champs précis) et le modèle s’y conforme de façon garantie, directement pipable dans jq ou une boucle. Fini le parsing fragile de texte libre. Pour les gros raisonnements, --model pcc bascule sur Private Cloud Compute : toujours sans clé API, mais en réseau. Et fm serve transforme le Mac en serveur local compatible Chat Completions.

Je trouve l’approche maligne : Apple ne vend pas de quota, elle distribue de l’inférence locale, comme elle le fait déjà avec la retouche photo sur iPhone. La confidentialité n’est plus un argument marketing, c’est l’architecture. Restent des limites : c’est une bêta (WWDC 2026) et les options peuvent bouger, le modèle embarqué est petit, et un Mac à 16 Go doit rester sur des modèles de 3 à 8 milliards de paramètres avec mlx_lm. Le socle est là, et il est gratuit.

  • 🖥️ Local et gratuit : aucune clé API, rien ne part pour le modèle embarqué
  • 💬 fm chat : sessions interactives sauvegardables, interruption en pleine réponse
  • 🧩 Sortie structurée : fm schema + --schema donnent du JSON pipable dans jq
  • ⚡ fm respond : une question, une réponse sur stdout, prête pour vos scripts

Au passage, le projet open source apple-fm reprend la même idée : un CLI et une bibliothèque TypeScript pour interroger le modèle embarqué, dès macOS 26.

Sources

Publications similaires

Laisser un commentaire