Ejecuta modelos de IA en tu propio navegador

No es una demo de la API de otro. El modelo se descarga en tu navegador y se ejecuta en tu hardware con WebGPU, así que la petición, la respuesta y la imagen no salen nunca del equipo. Carga uno, pon el modo avión y sigue trabajando.

Cargando la herramienta…

Cómo funciona

  1. Elige un modelo. Cada uno indica su tamaño de descarga y el hardware que pide antes de que te comprometas.
  2. Espera a la descarga: solo una vez, luego se queda en la caché del navegador.
  3. Úsalo. Y si quieres la prueba, corta la conexión y vuelve a usarlo.

Por qué no se sube nada

Todo lo que hace esta página lo ejecuta código que corre dentro de la pestaña de tu navegador, con el mismo motor que dibuja las páginas web. El archivo se lee del disco a la memoria de la pestaña, se transforma ahí y se vuelve a escribir como descarga. No se envía a ninguna parte: ni a nosotros, ni a terceros.

Compruébalo tú mismo

  1. Abre las herramientas de desarrollo del navegador (F12) y elige la pestaña «Red».
  2. Carga tu archivo y ejecuta la herramienta.
  3. Las únicas peticiones que verás descargan el código de la propia herramienta —y, en unas pocas herramientas pesadas, su motor de código abierto desde un CDN público—, más un pequeño aviso de visita a loreatec.jp (dirección y título de la página, nada más). Ninguna lleva tu archivo.

Compruébalo tú mismo →

Preguntas frecuentes

¿Esto se ejecuta de verdad en local, o llama a una API?

En local, y es lo más fácil de comprobar de todo el sitio: carga un modelo, pon el modo avión y sigue usándolo. Una llamada a una API no sobrevive a eso. El único tráfico de red es la descarga de los pesos desde Hugging Face, una sola vez, y puedes verla en la pestaña Network del navegador.

¿Por qué pesan tanto las descargas?

Porque son los modelos de verdad, no un cliente ligero. La estimación de profundidad son 30 MB; la síntesis de voz, 175 MB; la transcripción, 282 MB; la generación de imágenes, 1,9 GB; y el modelo de chat más grande, 4,8 GB. Cada uno se descarga una vez y se guarda en caché; el tamaño aparece junto a cada modelo antes de empezar, y hay un botón para borrarlos todos después.

¿Qué hacen en realidad los ocho modelos?

Dos modelos Gemma 4 aceptan texto, imágenes y audio, y responden en texto. Gemma 3 1B es un modelo de chat pequeño, solo de texto, para equipos flojos. LCM Dreamshaper genera imágenes a partir de una descripción. Kokoro lee texto en voz alta. Whisper transcribe audio. DETR encuentra y etiqueta objetos en una foto. Depth Anything estima la profundidad a partir de una sola imagen.

¿Necesito un ordenador potente?

Para los pequeños, no: profundidad, detección y voz funcionan en un portátil corriente. La generación de imágenes y los modelos de chat grandes piden una GPU de verdad y memoria libre suficiente; cada modelo lleva una etiqueta de nivel para que lo sepas antes de descargar gigabytes. Sin WebGPU todo sigue funcionando en la CPU, mucho más despacio.

¿Qué licencias tienen estos modelos?

Seis son Apache-2.0, uno es MIT y Gemma 3 1B está bajo los Gemma Terms. Todos son modelos abiertos usados aquí para una demostración gratuita; cada uno aparece con su nombre en la página para que puedas leer su ficha en Hugging Face.