AI-modellen draaien in je eigen browser

Geen demo van andermans API. Het model zelf wordt naar je browser gedownload en uitgevoerd op je eigen hardware met WebGPU, zodat de prompt, het antwoord en de afbeelding de machine nooit verlaten. Laad een model, zet je vliegtuigmodus aan, en ga gewoon door.

De tool wordt geladen…

Hoe het werkt

  1. Kies een model. Elk model toont zijn downloadgrootte en de hardware die het wil, voordat je verdergaat.
  2. Wacht de download af — dat is maar één keer nodig; daarna blijft hij in de cache van je browser staan.
  3. Gebruik het. Wil je het bewijs, zet dan je verbinding uit en gebruik het opnieuw.

Waarom er niets wordt geüpload

Alles wat deze pagina doet, doet code die in je browsertabblad draait, met dezelfde engine die ook webpagina’s tekent. Je bestand wordt van schijf naar het geheugen van dat tabblad gelezen, daar bewerkt en weer weggeschreven als download. Het wordt nergens naartoe gestuurd — niet naar ons, en niet naar een derde partij.

Controleer het zelf

  1. Open de ontwikkelaarstools van je browser (F12) en kies het tabblad Netwerk.
  2. Laad je bestand en start de tool.
  3. De enige verzoeken die je ziet, halen de code van de tool zelf op — en bij een paar zware tools hun opensource-engine van een openbare CDN — plus één kleine bezoekmelding aan loreatec.jp (adres en titel van de pagina, meer niet). In geen van die verzoeken zit jouw bestand.

Bewijs dat het lokaal blijft →

Veelgestelde vragen

Draait dit echt lokaal, of roept het een API aan?

Lokaal, en het is de makkelijkste bewering op deze site om te controleren: laad een model, zet vliegtuigmodus aan en blijf het gebruiken. Een API-aanroep overleeft dat niet. Het enige netwerkverkeer is de eenmalige download van de gewichten vanaf Hugging Face, die je kunt volgen in het tabblad Netwerk.

Waarom zijn de downloads zo groot?

Omdat dit de echte modellen zijn, geen dunne client. Dieptebepaling is 30 MB, spraaksynthese 175 MB, transcriptie 282 MB, beeldgeneratie 1,9 GB, en het grootste chatmodel 4,8 GB. Elk model wordt één keer opgehaald en gecachet; de grootte staat bij elk model voordat je begint, en er is een knop om ze achteraf allemaal te verwijderen.

Wat kunnen de acht modellen precies?

Twee Gemma 4-modellen nemen tekst, afbeeldingen en audio aan en antwoorden in tekst. Gemma 3 1B is een klein, alleen-tekst chatmodel voor zwakkere machines. LCM Dreamshaper genereert afbeeldingen op basis van een prompt. Kokoro leest tekst hardop voor. Whisper transcribeert audio. DETR vindt en labelt objecten in een foto. Depth Anything schat de diepte op basis van één afbeelding.

Heb ik een krachtige computer nodig?

Voor de kleine modellen niet: diepte, detectie en spraak draaien op een gewone laptop. Beeldgeneratie en de grote chatmodellen willen een echte GPU en genoeg vrij geheugen — elk model heeft een niveau-badge, zodat je dat weet voordat je gigabytes downloadt. Zonder WebGPU draait alles nog steeds op de CPU, wel veel trager.

Onder welke licenties vallen deze modellen?

Zes staan onder Apache-2.0, één onder MIT, en Gemma 3 1B onder de Gemma Terms. Het zijn allemaal open modellen die hier voor een gratis demonstratie worden gebruikt; elk model wordt op de pagina genoemd, zodat je zijn kaart op Hugging Face kunt nalezen.