Faire tourner des modèles d’IA dans votre propre navigateur
Ce n’est pas la démonstration de l’API d’un autre. Le modèle lui-même est téléchargé dans votre navigateur et exécuté sur votre matériel avec WebGPU : la question posée, la réponse et l’image ne quittent jamais la machine. Chargez-en un, passez en mode avion, continuez.
- Fonctionne entièrement dans votre navigateur
- Fonctionne hors ligne
- Aucun envoi de fichier
- Sans inscription
- Sans filigrane
Chargement de l’outil…
Comment ça marche
- Choisissez un modèle. Chacun indique sa taille de téléchargement et le matériel qu’il réclame avant que vous ne vous engagiez.
- Attendez le téléchargement — une seule fois ; ensuite le modèle reste dans le cache de votre navigateur.
- Utilisez-le. Puis, si vous voulez la preuve, coupez votre connexion et utilisez-le de nouveau.
Pourquoi rien n’est envoyé
Toutes les opérations de cette page sont effectuées par du code qui tourne dans l’onglet de votre navigateur, avec le moteur qui affiche les pages web. Le fichier est lu depuis le disque vers la mémoire de l’onglet, transformé sur place, puis réécrit sous forme de téléchargement. Il n’est jamais envoyé où que ce soit — ni à nous, ni à un tiers.
Vérifiez-le vous-même
- Ouvrez les outils de développement de votre navigateur (F12) et choisissez l’onglet « Réseau ».
- Chargez votre fichier et lancez l’outil.
- Les seules requêtes que vous verrez téléchargent le code de l’outil lui-même — et, pour quelques outils lourds, leur moteur open source depuis un CDN public — plus un petit signal de visite vers loreatec.jp (adresse et titre de la page, rien de plus). Aucune ne transporte votre fichier.
Questions fréquentes
Est-ce que ça tourne vraiment en local, ou est-ce que ça appelle une API ?
En local, et c’est l’affirmation la plus facile à vérifier de tout le site : chargez un modèle, passez en mode avion et continuez à vous en servir. Un appel d’API n’y survivrait pas. Le seul trafic réseau est le téléchargement unique des poids depuis Hugging Face, que vous pouvez observer dans l’onglet Réseau.
Pourquoi les téléchargements sont-ils si lourds ?
Parce que ce sont les vrais modèles, pas un client léger. L’estimation de profondeur pèse 30 Mo, la synthèse vocale 175 Mo, la transcription 282 Mo, la génération d’images 1,9 Go, et le plus gros modèle de chat 4,8 Go. Chacun est téléchargé une seule fois puis mis en cache ; la taille est indiquée à côté de chaque modèle avant que vous ne commenciez, et un bouton permet de tout supprimer ensuite.
Que savent faire ces huit modèles ?
Deux modèles Gemma 4 prennent du texte, des images et de l’audio, et répondent en texte. Gemma 3 1B est un petit modèle de chat, texte uniquement, pour les machines modestes. LCM Dreamshaper génère des images à partir d’une description. Kokoro lit un texte à voix haute. Whisper transcrit de l’audio. DETR trouve et nomme les objets d’une photo. Depth Anything estime la profondeur à partir d’une seule image.
Faut-il un ordinateur puissant ?
Pour les petits, non : la profondeur, la détection et la synthèse vocale tournent sur un ordinateur portable ordinaire. La génération d’images et les gros modèles de chat réclament un vrai GPU et assez de mémoire libre — chaque modèle porte un badge de niveau, pour que vous le sachiez avant de télécharger des gigaoctets. Sans WebGPU, tout fonctionne quand même sur le processeur, beaucoup plus lentement.
Sous quelles licences sont ces modèles ?
Six sont en Apache-2.0, un en MIT, et Gemma 3 1B relève des Gemma Terms. Ce sont tous des modèles ouverts, utilisés ici pour une démonstration gratuite ; chacun est nommé sur la page, pour que vous puissiez lire sa fiche sur Hugging Face.