Far girare modelli di IA nel tuo browser

Non è la dimostrazione dell’API di qualcun altro. Il modello viene scaricato dentro il tuo browser ed eseguito sul tuo hardware con WebGPU, quindi la richiesta, la risposta e l’immagine non lasciano mai la macchina. Caricane uno, passa alla modalità aereo e continua.

Caricamento dello strumento…

Come funziona

  1. Scegli un modello. Ognuno mostra la dimensione del download e l’hardware che vuole, prima che tu decida.
  2. Aspetta il download — una volta sola; poi resta nella cache del browser.
  3. Usalo. Poi, se vuoi la prova, spegni la connessione e usalo di nuovo.

Perché non viene caricato nulla

Ogni operazione di questa pagina la esegue codice che gira dentro la scheda del tuo browser, con lo stesso motore che disegna le pagine web. Il file viene letto dal disco alla memoria della scheda, trasformato lì e riscritto come download. Non viene mai inviato da nessuna parte: né a noi, né a terzi.

Verificalo tu stesso

  1. Apri gli strumenti per sviluppatori del browser (F12) e scegli la scheda «Rete».
  2. Carica il tuo file e avvia lo strumento.
  3. Le uniche richieste che vedrai scaricano il codice dello strumento stesso — e, in pochi strumenti pesanti, il loro motore open source da una CDN pubblica — più un piccolo segnale di visita verso loreatec.jp (indirizzo e titolo della pagina, nulla di più). Nessuna di esse porta con sé il tuo file.

La prova che resta sul tuo dispositivo →

Domande frequenti

Sta girando davvero in locale, o sta chiamando un’API?

In locale, ed è l’affermazione più facile da verificare di tutto il sito: carica un modello, passa alla modalità aereo e continua a usarlo. Una chiamata a un’API non sopravviverebbe. L’unico traffico di rete è il download dei pesi da Hugging Face, una volta sola, e lo puoi guardare nella scheda Rete.

Perché i download sono così pesanti?

Perché questi sono i modelli veri, non un client leggero. La stima della profondità è 30 MB, la sintesi vocale 175 MB, la trascrizione 282 MB, la generazione di immagini 1,9 GB e il modello di chat più grande 4,8 GB. Ognuno viene scaricato una volta e messo in cache; la dimensione è indicata accanto a ogni modello prima di iniziare, e c’è un pulsante per cancellarli tutti quando hai finito.

Che cosa sanno fare davvero gli otto modelli?

Due modelli Gemma 4 accettano testo, immagini e audio e rispondono con del testo. Gemma 3 1B è un piccolo modello di chat solo testo, per macchine più deboli. LCM Dreamshaper genera immagini a partire da una richiesta. Kokoro legge il testo ad alta voce. Whisper trascrive l’audio. DETR trova ed etichetta gli oggetti in una foto. Depth Anything stima la profondità da una sola immagine.

Mi serve un computer potente?

Per quelli piccoli no: profondità, riconoscimento e voce girano su un portatile normale. La generazione di immagini e i modelli di chat grandi vogliono una GPU vera e abbastanza memoria libera — ogni modello porta un’etichetta di fascia, così lo sai prima di scaricare dei gigabyte. Senza WebGPU funziona comunque tutto sulla CPU, molto più lentamente.

Che licenze hanno questi modelli?

Sei sono Apache-2.0, uno è MIT e Gemma 3 1B è sotto i Gemma Terms. Sono tutti modelli aperti, usati qui per una dimostrazione gratuita; ognuno è indicato per nome sulla pagina, così puoi leggerne la scheda su Hugging Face.