내 브라우저에서 AI 모델 돌리기

남의 API를 흉내 낸 데모가 아닙니다. 모델 자체가 당신의 브라우저로 내려받아져 WebGPU로 당신의 하드웨어에서 실행되므로, 프롬프트도 답변도 이미지도 기기 밖으로 나가지 않습니다. 모델을 불러온 뒤 비행기 모드로 바꾸고 계속 써 보세요.

도구를 불러오는 중…

작동 방식

  1. 모델을 고르세요. 내려받기 전에 다운로드 크기와 필요한 하드웨어가 각각 표시됩니다.
  2. 다운로드를 기다리세요. 한 번만 받으면 그 뒤로는 브라우저 캐시에 남습니다.
  3. 써 보세요. 증거가 필요하다면 연결을 끄고 다시 써 보세요.

왜 아무것도 업로드되지 않는가

이 페이지가 하는 모든 작업은 브라우저 탭 안에서 도는 코드가 처리합니다. 웹 페이지를 그리는 그 엔진을 그대로 씁니다. 파일은 디스크에서 탭의 메모리로 읽어 들여 거기서 변환한 뒤 다시 다운로드 파일로 내보냅니다. 어디로도 전송되지 않습니다. 우리에게도, 제3자에게도.

직접 확인해 보세요

  1. 브라우저 개발자 도구(F12)를 열고 네트워크(Network) 탭을 선택합니다.
  2. 파일을 올리고 도구를 실행합니다.
  3. 보이는 요청은 도구 자체의 코드를 받아 오는 것뿐입니다. 무거운 몇몇 도구는 공개 CDN에서 오픈소스 엔진을 함께 받아 옵니다. 여기에 loreatec.jp로 가는 작은 방문 집계 신호 하나(페이지 주소와 제목, 그 이상은 없습니다)가 더해집니다. 어느 것도 당신의 파일을 실어 나르지 않습니다.

직접 확인하기 →

자주 묻는 질문

정말로 기기에서 도는 건가요, 아니면 API를 부르는 건가요?

기기에서 돕니다. 이 사이트에서 가장 확인하기 쉬운 주장이기도 합니다. 모델을 불러온 뒤 비행기 모드로 바꾸고 계속 써 보세요. API 호출이라면 그렇게는 버티지 못합니다. 유일한 네트워크 트래픽은 Hugging Face에서 오는 최초 1회 가중치 다운로드이며, 개발자 도구의 네트워크(Network) 탭에서 직접 볼 수 있습니다.

다운로드 용량이 왜 이렇게 큰가요?

얇은 클라이언트가 아니라 실제 모델이기 때문입니다. 깊이 추정은 30 MB, 음성 합성은 175 MB, 받아쓰기는 282 MB, 이미지 생성은 1.9 GB, 가장 큰 채팅 모델은 4.8 GB입니다. 각 모델은 한 번만 받아 캐시에 저장되며, 시작하기 전에 모델마다 크기가 표시되고, 나중에 전부 지우는 버튼도 있습니다.

여덟 개 모델로 실제로 무엇을 할 수 있나요?

Gemma 4 모델 두 개는 텍스트와 이미지, 오디오를 입력받아 텍스트로 답합니다. Gemma 3 1B는 성능이 약한 기기를 위한 작은 텍스트 전용 채팅 모델입니다. LCM Dreamshaper는 프롬프트로 이미지를 생성합니다. Kokoro는 텍스트를 소리 내어 읽습니다. Whisper는 오디오를 받아씁니다. DETR은 사진 속 사물을 찾아 이름을 붙입니다. Depth Anything은 이미지 한 장에서 깊이를 추정합니다.

고성능 컴퓨터가 필요한가요?

작은 모델은 아닙니다. 깊이 추정과 사물 인식, 음성은 평범한 노트북에서도 돌아갑니다. 이미지 생성과 큰 채팅 모델은 제대로 된 GPU와 충분한 여유 메모리를 요구하는데, 기가바이트 단위로 내려받기 전에 알 수 있도록 모델마다 등급 배지가 붙어 있습니다. WebGPU가 없어도 CPU로 돌아가기는 하지만 훨씬 느립니다.

이 모델들의 라이선스는 무엇인가요?

여섯 개는 Apache-2.0, 하나는 MIT, Gemma 3 1B는 Gemma Terms입니다. 모두 개방형 모델을 가져와 무료로 시연하는 것이며, 페이지에 각 이름이 적혀 있으니 Hugging Face에서 각각의 카드를 직접 읽어 볼 수 있습니다.