내 브라우저에서 AI 모델 돌리기
남의 API를 흉내 낸 데모가 아닙니다. 모델 자체가 당신의 브라우저로 내려받아져 WebGPU로 당신의 하드웨어에서 실행되므로, 프롬프트도 답변도 이미지도 기기 밖으로 나가지 않습니다. 모델을 불러온 뒤 비행기 모드로 바꾸고 계속 써 보세요.
- 브라우저 안에서 전부 처리됩니다
- 오프라인에서도 작동합니다
- 업로드 없음
- 가입 없음
- 워터마크 없음
도구를 불러오는 중…
작동 방식
- 모델을 고르세요. 내려받기 전에 다운로드 크기와 필요한 하드웨어가 각각 표시됩니다.
- 다운로드를 기다리세요. 한 번만 받으면 그 뒤로는 브라우저 캐시에 남습니다.
- 써 보세요. 증거가 필요하다면 연결을 끄고 다시 써 보세요.
왜 아무것도 업로드되지 않는가
이 페이지가 하는 모든 작업은 브라우저 탭 안에서 도는 코드가 처리합니다. 웹 페이지를 그리는 그 엔진을 그대로 씁니다. 파일은 디스크에서 탭의 메모리로 읽어 들여 거기서 변환한 뒤 다시 다운로드 파일로 내보냅니다. 어디로도 전송되지 않습니다. 우리에게도, 제3자에게도.
직접 확인해 보세요
- 브라우저 개발자 도구(F12)를 열고 네트워크(Network) 탭을 선택합니다.
- 파일을 올리고 도구를 실행합니다.
- 보이는 요청은 도구 자체의 코드를 받아 오는 것뿐입니다. 무거운 몇몇 도구는 공개 CDN에서 오픈소스 엔진을 함께 받아 옵니다. 여기에 loreatec.jp로 가는 작은 방문 집계 신호 하나(페이지 주소와 제목, 그 이상은 없습니다)가 더해집니다. 어느 것도 당신의 파일을 실어 나르지 않습니다.
자주 묻는 질문
정말로 기기에서 도는 건가요, 아니면 API를 부르는 건가요?
기기에서 돕니다. 이 사이트에서 가장 확인하기 쉬운 주장이기도 합니다. 모델을 불러온 뒤 비행기 모드로 바꾸고 계속 써 보세요. API 호출이라면 그렇게는 버티지 못합니다. 유일한 네트워크 트래픽은 Hugging Face에서 오는 최초 1회 가중치 다운로드이며, 개발자 도구의 네트워크(Network) 탭에서 직접 볼 수 있습니다.
다운로드 용량이 왜 이렇게 큰가요?
얇은 클라이언트가 아니라 실제 모델이기 때문입니다. 깊이 추정은 30 MB, 음성 합성은 175 MB, 받아쓰기는 282 MB, 이미지 생성은 1.9 GB, 가장 큰 채팅 모델은 4.8 GB입니다. 각 모델은 한 번만 받아 캐시에 저장되며, 시작하기 전에 모델마다 크기가 표시되고, 나중에 전부 지우는 버튼도 있습니다.
여덟 개 모델로 실제로 무엇을 할 수 있나요?
Gemma 4 모델 두 개는 텍스트와 이미지, 오디오를 입력받아 텍스트로 답합니다. Gemma 3 1B는 성능이 약한 기기를 위한 작은 텍스트 전용 채팅 모델입니다. LCM Dreamshaper는 프롬프트로 이미지를 생성합니다. Kokoro는 텍스트를 소리 내어 읽습니다. Whisper는 오디오를 받아씁니다. DETR은 사진 속 사물을 찾아 이름을 붙입니다. Depth Anything은 이미지 한 장에서 깊이를 추정합니다.
고성능 컴퓨터가 필요한가요?
작은 모델은 아닙니다. 깊이 추정과 사물 인식, 음성은 평범한 노트북에서도 돌아갑니다. 이미지 생성과 큰 채팅 모델은 제대로 된 GPU와 충분한 여유 메모리를 요구하는데, 기가바이트 단위로 내려받기 전에 알 수 있도록 모델마다 등급 배지가 붙어 있습니다. WebGPU가 없어도 CPU로 돌아가기는 하지만 훨씬 느립니다.
이 모델들의 라이선스는 무엇인가요?
여섯 개는 Apache-2.0, 하나는 MIT, Gemma 3 1B는 Gemma Terms입니다. 모두 개방형 모델을 가져와 무료로 시연하는 것이며, 페이지에 각 이름이 적혀 있으니 Hugging Face에서 각각의 카드를 직접 읽어 볼 수 있습니다.