Rode modelos de IA no seu próprio navegador
Não é uma demonstração da API de outra pessoa. O modelo em si é baixado para o seu navegador e executado no seu hardware com WebGPU, então o pedido, a resposta e a imagem nunca saem da máquina. Carregue um, ligue o modo avião e continue.
- Funciona inteiramente no seu navegador
- Funciona offline
- Sem envio de arquivos
- Sem registro
- Sem marca d’água
Carregando a ferramenta…
Como funciona
- Escolha um modelo. Cada um mostra o tamanho do download e o hardware que pede antes de você se comprometer.
- Espere o download — só uma vez; depois ele fica no cache do seu navegador.
- Use. E, se quiser a prova, desligue a conexão e use de novo.
Por que nada é enviado
Tudo o que esta página faz é executado por código que roda dentro da aba do seu navegador, com o mesmo motor que desenha as páginas web. O arquivo é lido do disco para a memória da aba, transformado ali e escrito de volta como um download. Ele nunca é enviado a lugar nenhum — nem para nós, nem para terceiros.
Comprove você mesmo
- Abra as ferramentas de desenvolvedor do navegador (F12) e escolha a aba Rede.
- Carregue o seu arquivo e rode a ferramenta.
- As únicas requisições que você vai ver baixam o código da própria ferramenta — e, em algumas ferramentas pesadas, o motor de código aberto delas a partir de um CDN público — mais um pequeno aviso de visita para loreatec.jp (endereço e título da página, nada mais). Nenhuma delas leva o seu arquivo.
Perguntas frequentes
Isso roda mesmo localmente, ou está chamando uma API?
Localmente, e é a afirmação mais fácil de verificar em todo o site: carregue um modelo, ligue o modo avião e continue usando. Uma chamada a uma API não sobrevive a isso. O único tráfego de rede é o download único dos pesos a partir do Hugging Face, que você pode acompanhar na aba Rede das ferramentas de desenvolvedor.
Por que os downloads são tão grandes?
Porque são os modelos de verdade, não um cliente leve. A estimativa de profundidade tem 30 MB; a síntese de voz, 175 MB; a transcrição, 282 MB; a geração de imagens, 1,9 GB; e o maior modelo de chat, 4,8 GB. Cada um é baixado uma vez e guardado em cache; o tamanho aparece ao lado de cada modelo antes de você começar, e há um botão para apagar todos depois.
O que os oito modelos fazem, na prática?
Dois modelos Gemma 4 aceitam texto, imagens e áudio, e respondem em texto. O Gemma 3 1B é um modelo de chat pequeno, só de texto, para máquinas mais fracas. O LCM Dreamshaper gera imagens a partir de uma descrição. O Kokoro lê texto em voz alta. O Whisper transcreve áudio. O DETR encontra e rotula objetos em uma foto. O Depth Anything estima a profundidade a partir de uma única imagem.
Preciso de um computador potente?
Para os pequenos, não: profundidade, detecção e voz rodam em um notebook comum. A geração de imagens e os modelos de chat grandes pedem uma GPU de verdade e memória livre suficiente — cada modelo traz uma etiqueta de nível para você saber antes de baixar gigabytes. Sem WebGPU tudo continua funcionando na CPU, muito mais devagar.
Que licenças esses modelos têm?
Seis são Apache-2.0, um é MIT e o Gemma 3 1B está sob os Gemma Terms. Todos são modelos abertos usados aqui para uma demonstração gratuita; cada um aparece nomeado na página para que você possa ler a ficha dele no Hugging Face.