Запустите ИИ-модели прямо в браузере

Это не демонстрация чужого API. Сама модель скачивается в ваш браузер и выполняется на вашем оборудовании через WebGPU, поэтому запрос, ответ и изображение никогда не покидают устройство. Загрузите модель, включите авиарежим и продолжайте работать.

Загружаем инструмент…

Как это работает

  1. Выберите модель. У каждой указан размер загрузки и требуемое оборудование — ещё до того, как вы решитесь.
  2. Дождитесь загрузки — она нужна только один раз; дальше модель остаётся в кеше браузера.
  3. Пользуйтесь ей. А затем, если нужно доказательство, отключите соединение и воспользуйтесь ей снова.

Почему ничего не отправляется на сервер

Всё, что делает эта страница, выполняет код внутри вкладки вашего браузера — тем же движком, который рисует веб-страницы. Файл читается с диска в память вкладки, преобразуется там и записывается обратно как загружаемый файл. Он никуда не отправляется — ни нам, ни третьей стороне.

Проверьте сами

  1. Откройте инструменты разработчика в браузере (F12) и перейдите на вкладку «Сеть» (Network).
  2. Загрузите свой файл и запустите инструмент.
  3. Единственные запросы, которые вы увидите, — это код самого инструмента, а у нескольких тяжёлых инструментов ещё и их открытый движок из публичного CDN, плюс один небольшой сигнал о просмотре страницы на loreatec.jp (адрес и заголовок страницы, больше ничего). Ни один из них не несёт ваш файл.

Проверьте, что файлы не уходят →

Частые вопросы

Это действительно работает локально, или где-то за кулисами вызывается API?

Локально, и это самое легко проверяемое утверждение на этом сайте: загрузите модель, включите авиарежим и продолжайте ею пользоваться. Вызов API такого не переживёт. Единственный сетевой трафик — разовая загрузка весов модели с Hugging Face, которую можно увидеть во вкладке «Сеть» (Network).

Почему загрузки такие большие?

Потому что это настоящие модели, а не тонкий клиент. Оценка глубины весит 30 МБ, синтез речи — 175 МБ, транскрибация — 282 МБ, генерация изображений — 1,9 ГБ, а самая большая чат-модель — 4,8 ГБ. Каждая скачивается один раз и кешируется; размер показан рядом с каждой моделью ещё до старта, а потом есть кнопка, чтобы удалить их все разом.

Что вообще умеют эти восемь моделей?

Две модели Gemma 4 принимают текст, изображения и звук и отвечают текстом. Gemma 3 1B — маленькая текстовая чат-модель для более слабых машин. LCM Dreamshaper генерирует изображения по запросу. Kokoro читает текст вслух. Whisper транскрибирует аудио. DETR находит и подписывает объекты на фотографии. Depth Anything оценивает глубину по одному изображению.

Нужен мощный компьютер?

Для маленьких моделей — нет: оценка глубины, распознавание объектов и речь работают на обычном ноутбуке. Генерации изображений и крупным чат-моделям нужна настоящая видеокарта и достаточно свободной памяти — у каждой модели есть значок уровня, чтобы вы понимали это ещё до того, как скачаете гигабайты. Без WebGPU всё всё равно работает, но на процессоре и намного медленнее.

Какие у этих моделей лицензии?

Шесть — под Apache-2.0, одна — под MIT, а Gemma 3 1B — под условиями Gemma Terms. Все это открытые модели, использованные здесь в качестве бесплатной демонстрации; каждая названа на странице, так что вы можете прочитать её карточку на Hugging Face.