Запустите ИИ-модели прямо в браузере
Это не демонстрация чужого API. Сама модель скачивается в ваш браузер и выполняется на вашем оборудовании через WebGPU, поэтому запрос, ответ и изображение никогда не покидают устройство. Загрузите модель, включите авиарежим и продолжайте работать.
- Работает целиком в вашем браузере
- Работает без интернета
- Без отправки файлов
- Без регистрации
- Без водяных знаков
Загружаем инструмент…
Как это работает
- Выберите модель. У каждой указан размер загрузки и требуемое оборудование — ещё до того, как вы решитесь.
- Дождитесь загрузки — она нужна только один раз; дальше модель остаётся в кеше браузера.
- Пользуйтесь ей. А затем, если нужно доказательство, отключите соединение и воспользуйтесь ей снова.
Почему ничего не отправляется на сервер
Всё, что делает эта страница, выполняет код внутри вкладки вашего браузера — тем же движком, который рисует веб-страницы. Файл читается с диска в память вкладки, преобразуется там и записывается обратно как загружаемый файл. Он никуда не отправляется — ни нам, ни третьей стороне.
Проверьте сами
- Откройте инструменты разработчика в браузере (F12) и перейдите на вкладку «Сеть» (Network).
- Загрузите свой файл и запустите инструмент.
- Единственные запросы, которые вы увидите, — это код самого инструмента, а у нескольких тяжёлых инструментов ещё и их открытый движок из публичного CDN, плюс один небольшой сигнал о просмотре страницы на loreatec.jp (адрес и заголовок страницы, больше ничего). Ни один из них не несёт ваш файл.
Частые вопросы
Это действительно работает локально, или где-то за кулисами вызывается API?
Локально, и это самое легко проверяемое утверждение на этом сайте: загрузите модель, включите авиарежим и продолжайте ею пользоваться. Вызов API такого не переживёт. Единственный сетевой трафик — разовая загрузка весов модели с Hugging Face, которую можно увидеть во вкладке «Сеть» (Network).
Почему загрузки такие большие?
Потому что это настоящие модели, а не тонкий клиент. Оценка глубины весит 30 МБ, синтез речи — 175 МБ, транскрибация — 282 МБ, генерация изображений — 1,9 ГБ, а самая большая чат-модель — 4,8 ГБ. Каждая скачивается один раз и кешируется; размер показан рядом с каждой моделью ещё до старта, а потом есть кнопка, чтобы удалить их все разом.
Что вообще умеют эти восемь моделей?
Две модели Gemma 4 принимают текст, изображения и звук и отвечают текстом. Gemma 3 1B — маленькая текстовая чат-модель для более слабых машин. LCM Dreamshaper генерирует изображения по запросу. Kokoro читает текст вслух. Whisper транскрибирует аудио. DETR находит и подписывает объекты на фотографии. Depth Anything оценивает глубину по одному изображению.
Нужен мощный компьютер?
Для маленьких моделей — нет: оценка глубины, распознавание объектов и речь работают на обычном ноутбуке. Генерации изображений и крупным чат-моделям нужна настоящая видеокарта и достаточно свободной памяти — у каждой модели есть значок уровня, чтобы вы понимали это ещё до того, как скачаете гигабайты. Без WebGPU всё всё равно работает, но на процессоре и намного медленнее.
Какие у этих моделей лицензии?
Шесть — под Apache-2.0, одна — под MIT, а Gemma 3 1B — под условиями Gemma Terms. Все это открытые модели, использованные здесь в качестве бесплатной демонстрации; каждая названа на странице, так что вы можете прочитать её карточку на Hugging Face.