Jalankan model AI di peramban Anda sendiri

Ini bukan demo dari API milik orang lain. Model itu sendiri diunduh ke peramban Anda dan dijalankan di perangkat keras Anda memakai WebGPU, jadi prompt, balasannya, dan gambarnya tidak pernah keluar dari mesin Anda. Muat satu model, aktifkan mode pesawat, dan tetap lanjutkan pemakaiannya.

Memuat alat…

Cara kerjanya

  1. Pilih sebuah model. Masing-masing menampilkan ukuran unduhannya dan perangkat keras yang dibutuhkan sebelum Anda memutuskan.
  2. Tunggu unduhannya — hanya sekali; setelah itu disimpan di cache peramban Anda.
  3. Pakai model itu. Lalu, kalau Anda ingin buktinya, matikan koneksi Anda dan pakai lagi.

Kenapa tidak ada yang diunggah

Semua yang dikerjakan halaman ini dijalankan oleh kode di dalam tab peramban Anda, memakai mesin yang sama dengan yang menampilkan halaman web. File dibaca dari disk ke memori tab Anda, diolah di sana, lalu ditulis kembali sebagai unduhan. File itu tidak pernah dikirim ke mana pun — tidak ke kami, tidak ke pihak ketiga.

Buktikan sendiri

  1. Buka alat pengembang peramban Anda (F12) lalu pilih tab “Network” (Jaringan).
  2. Muat file Anda dan jalankan alatnya.
  3. Permintaan yang akan Anda lihat hanya mengambil kode alat itu sendiri — dan, pada beberapa alat berat, mesin sumber terbukanya dari CDN publik — ditambah satu ping kunjungan halaman yang kecil ke loreatec.jp (alamat dan judul halaman, tidak lebih). Tidak satu pun membawa file Anda.

Bukti semuanya tetap lokal →

Pertanyaan yang sering diajukan

Apakah ini benar-benar berjalan lokal, atau memanggil sebuah API?

Lokal, dan ini klaim yang paling mudah dibuktikan di seluruh situs ini: muat sebuah model, aktifkan mode pesawat, lalu tetap pakai modelnya. Panggilan API tidak akan bertahan dari itu. Satu-satunya lalu lintas jaringan adalah unduhan bobot model satu kali dari Hugging Face, yang bisa Anda amati di tab “Network” (Jaringan).

Kenapa ukuran unduhannya begitu besar?

Karena ini model yang sesungguhnya, bukan klien tipis. Estimasi kedalaman 30 MB, sintesis suara 175 MB, transkripsi 282 MB, pembuatan gambar 1,9 GB, dan model chat terbesarnya 4,8 GB. Masing-masing diunduh sekali lalu disimpan di cache; ukurannya ditampilkan di samping setiap model sebelum Anda mulai, dan ada tombol untuk menghapus semuanya setelahnya.

Apa sebenarnya yang bisa dilakukan kedelapan model itu?

Dua model Gemma 4 menerima teks, gambar, dan audio, lalu menjawab dalam teks. Gemma 3 1B adalah model chat kecil khusus teks untuk perangkat yang lebih lemah. LCM Dreamshaper membuat gambar dari sebuah prompt. Kokoro membacakan teks dengan suara. Whisper mentranskripsi audio. DETR menemukan dan memberi label pada objek di sebuah foto. Depth Anything memperkirakan kedalaman dari satu gambar saja.

Apakah saya perlu komputer yang bertenaga?

Untuk model-model kecil, tidak: kedalaman, deteksi, dan suara berjalan di laptop biasa. Pembuatan gambar dan model chat besar butuh GPU sungguhan serta memori bebas yang cukup — tiap model punya lencana tingkatannya sendiri supaya Anda tahu sebelum mengunduh berapa gigabyte. Tanpa WebGPU, semuanya tetap berjalan di CPU, jauh lebih lambat.

Lisensi apa yang dipakai model-model ini?

Enam model memakai Apache-2.0, satu memakai MIT, dan Gemma 3 1B berada di bawah Gemma Terms. Semuanya model terbuka yang dipakai di sini untuk demonstrasi gratis; tiap model disebutkan namanya di halaman ini supaya Anda bisa membaca kartunya di Hugging Face.