Un agent IA complet tient désormais dans 2,5 Go sur votre téléphone

3 min de lecture
Tous les articles du blog
Un agent IA complet tient désormais dans 2,5 Go sur votre téléphone
2.5 GB mémoire maximale requise
220 tok/s vitesse sur Apple M5 Max
30 tok/s vitesse sur smartphone
34 T tokens de pré-entraînement

2,5 Go de mémoire. Voilà tout ce qu'il faut désormais pour faire tourner un agent IA autonome sur un smartphone. Liquid AI vient de publier LFM2.5-2.6B, et le cloud devient officiellement optionnel.

LFM2.5-2.6B, un agent IA taillé pour votre poche

Publié le 4 août, ce modèle de 2,6 milliards de paramètres planifie, appelle des outils et enchaîne des actions, en local. Les poids ouverts sont disponibles sur Hugging Face, en version de base et post-entraînée.

La vitesse fait le spectacle. Liquid AI annonce 220 tokens par seconde sur une puce Apple M5 Max, 113 sur un Ryzen AI Max+ 395 et environ 30 sur un téléphone. Une démo d'agent tourne même déjà intégralement dans un navigateur.

Pourquoi LFM2.5-2.6B rivalise avec des modèles quatre fois plus gros

Le pré-entraînement a avalé près de 34 000 milliards de tokens. Sur l'usage d'outils, le modèle dépasse même Qwen3.5-9B au benchmark ToolSandbox, avec 77,83 points contre 76,44.

La recette tient en quatre étapes de post-entraînement, dont du renforcement mené dans de vrais harnais d'agents comme Hermes Agent, OpenClaw et Pi. Une stratégie maligne : gagner la catégorie qui compte sur l'appareil, plutôt que tous les classements.

Ce que ça change pour vous et les développeurs

Un agent local n'envoie aucune donnée vers un serveur, ne coûte rien par token et répond sans latence réseau. Vos mails, vos fichiers et vos requêtes restent sur votre appareil.

Côté développeurs, le support arrive dès le premier jour : llama.cpp, MLX, vLLM, SGLang et ONNX. Sur serveur, une seule carte H100 débite près de 15 000 tokens par seconde, de quoi lancer des flottes d'agents à coût marginal quasi nul.

Des limites honnêtes subsistent. La génération de code reste le terrain des gros modèles, et la licence maison lfm1.0 mérite une lecture avant tout usage commercial. Pendant que les géants open source comme Kimi K3 misent sur la démesure, Liquid AI parie sur le plus petit modèle utile.

LFM2.5-2.6B est-il gratuit ?

Oui, les versions de base et post-entraînée se téléchargent gratuitement sur Hugging Face, sous la licence lfm1.0 de Liquid AI. Un projet commercial doit d'abord vérifier ses conditions.

Quelle vitesse pour LFM2.5-2.6B sur un smartphone ?

Environ 30 tokens par seconde sur un téléphone, avec moins de 2,5 Go de mémoire. Assez pour un assistant local fluide, sans aucun appel réseau.

Vitesse de LFM2.5-2.6B selon le matériel

MatérielVitesse annoncée
Apple M5 Max220 tokens/s
AMD Ryzen AI Max+ 395113 tokens/s
Smartphone≈ 30 tokens/s
LF
Lucas Ferretti Lucas Ferretti traite des startups IA, des levées de fonds et du business de l'intelligence artificielle pour AIxploria.