Google AI Edge: l'IA de Google en local, du smartphone au microcontrôleur
Mis à jour le 17 août 2026
Google AI Edge est la pile d'outils de Google pour exécuter des modèles d'IA directement sur un appareil, téléphone, navigateur ou carte embarquée, sans détour par le cloud. L'ensemble est gratuit et open source, du moteur LiteRT à l'application de démonstration AI Edge Gallery. Un modèle PyTorch, JAX, Keras ou TensorFlow se convertit une fois, puis tourne accéléré sur CPU, GPU et NPU. Bon point, la documentation officielle se lit en français, même si l'application Gallery reste anglophone.
- Entièrement gratuit et open source, licence Apache 2.0
- Fonctionne hors ligne, les données restent sur l'appareil
- Convertit les modèles PyTorch, JAX, Keras et TensorFlow
- Application Gallery pour essayer sans écrire de code
- Accélération CPU, GPU et NPU sur Android, iOS et web
- Pensé d'abord pour les développeurs, apprentissage technique réel
- Les gros modèles réclament un téléphone haut de gamme
- Application Gallery pas encore traduite en français
Ce que contient Google AI Edge, de LiteRT à MediaPipe
LiteRT est le moteur central de la pile et le successeur officiel de TensorFlow Lite. Son exécutable pèse quelques mégaoctets et accélère les modèles convertis sur CPU, GPU et NPU. Au-dessus, LiteRT-LM orchestre les grands modèles de langage et fait tourner le même LLM sur Android, iOS et le web sans réécriture.
MediaPipe ajoute des API prêtes à l'emploi (floutage d'arrière-plan, détection d'objets, suivi des mains), tandis que Model Explorer visualise l'architecture d'un modèle pour repérer les goulots d'étranglement. Une logique d'edge computing assumée, où le calcul vient à la donnée plutôt que l'inverse.
| Composant | Rôle dans la pile |
|---|---|
| LiteRT | Conversion et exécution accélérée des modèles |
| LiteRT-LM | Le même LLM sur Android, iOS, web et embarqué |
| MediaPipe | API low-code pour la vision, le texte et l'audio |
| Model Explorer | Visualisation et débogage des architectures |
| AI Edge Portal | Benchmark à grande échelle sur téléphones réels |
AI Edge Gallery, l'essai grandeur nature sur votre propre téléphone
AI Edge Gallery, disponible sur Android et iOS, permet de tester des modèles ouverts comme Gemma 4 sans une ligne de code. Vous téléchargez un modèle depuis Hugging Face, vous coupez le wifi, et la conversation continue, images et audio compris (comptez plusieurs gigaoctets par modèle, le premier téléchargement mérite une bonne connexion).
Passons au concret, voici ce que l'application regroupe.
Le code, écrit en Kotlin sur Android et en Swift sur iOS, sert aussi de référence pour intégrer LiteRT-LM dans vos propres applications, dans la lignée des grands projets IA open source hébergés sur GitHub.
- Ask Image pour interroger une photo prise avec l'appareil
- Audio Scribe pour transcrire et traduire la voix hors ligne
- Prompt Lab pour régler température et paramètres du modèle
- Mobile Actions, des commandes vocales exécutées par FunctionGemma et ses 270 millions de paramètres
- Un benchmark intégré pour mesurer la vitesse sur votre matériel
Un banc de test cloud de plus de 120 téléphones réels
AI Edge Portal, le volet Google Cloud de l'écosystème, éprouve vos modèles sur un parc physique de plus de 120 appareils Android. Les rapports détaillent temps d'initialisation, vitesse de génération et pic de mémoire, de quoi vérifier que votre application tiendra sur les téléphones de vos clients avant publication.
Pour le reste, la mise en route ne coûte rien. Les bibliothèques s'installent depuis GitHub, les modèles pré-convertis se récupèrent sur la communauté Hugging Face de LiteRT, et la Gallery s'attrape sur les boutiques d'applications habituelles.
Questions fréquentes
Google AI Edge est-il gratuit ?
Oui, toute la pile est gratuite et open source, LiteRT et l'application AI Edge Gallery étant publiés sous licence Apache 2.0. Les modèles ouverts comme Gemma se téléchargent sans frais depuis Hugging Face. Seul AI Edge Portal relève de Google Cloud, avec les conditions propres à cette plateforme.
AI Edge Gallery peut-il remplacer Ollama ?
Sur téléphone, oui, c'est même son terrain de prédilection. Ollama vise les ordinateurs (Mac, Windows, Linux), là où AI Edge Gallery fait tourner Gemma et d'autres modèles ouverts sur Android et iOS, entièrement hors ligne. Les deux se complètent donc plus qu'ils ne se concurrencent, selon l'appareil visé.
Quel téléphone faut-il pour faire tourner AI Edge Gallery ?
Android 12 ou iOS 17 au minimum, d'après les prérequis officiels du projet. Dans la pratique, les gros modèles tournent nettement mieux sur des appareils bien dotés en mémoire, type Pixel ou iPhone haut de gamme, et les téléphones de milieu de gamme se limitent aux modèles compacts.
Quel lien entre Google AI Edge et Gemini Nano ?
LiteRT-LM, la couche LLM de la pile, est l'infrastructure que Google emploie lui-même pour déployer Gemini Nano dans Chrome et sur la Pixel Watch. Vous profitez donc du même moteur éprouvé en production chez Google pour embarquer vos propres modèles de langage dans vos applications.
Verdict : Zéro facture d'inférence, zéro donnée qui quitte l'appareil, et un chemin balisé de la conversion au déploiement. Les développeurs mobiles et web y sont chez eux, et les curieux se feront une idée en dix minutes avec la Gallery.
« Un assistant IA privé gratuit orienté confidentialité, hébergé en Europe et chiffré de bout en bout. Il combine des capacités de raisonnement poussées, la génération d'images, la recherche sur le deep web et la mémoire à long terme. Il garantit par ailleurs que vos conversations ne sont pas utilisées pour entraîner des modèles »
