
WebLLM을 사용하는 온디바이스 AI 브라우저 자동화. 클라우드 없음, API 키 없음, 완전 프라이빗.
WebLLM을 사용하여 AI 기반 웹 자동화를 전적으로 기기 내에서 실행하는 Chrome 확장 프로그램입니다. 클라우드 API, API 키가 필요 없으며 완전히 비공개입니다.
https://github.com/user-attachments/assets/898cc5c2-db77-4067-96e6-233c5da2bae5
저장소 복제 및 의존성 설치:
cd local-browser
npm install
확장 프로그램 빌드:
npm run build
Chrome에 로드:
chrome://extensions 열기dist 폴더 선택첫 실행:
npm run dev
파일 변경을 감지하여 자동으로 재빌드합니다.
local-browser/
├── manifest.json # Chrome extension manifest (MV3)
├── src/
│ ├── background/ # Service worker
│ │ ├── index.ts # Entry point & message handling
│ │ ├── llm-engine.ts # WebLLM wrapper
│ │ └── agents/ # AI agent system
│ │ ├── base-agent.ts
│ │ ├── planner-agent.ts
│ │ ├── navigator-agent.ts
│ │ └── executor.ts
│ ├── content/ # Content scripts
│ │ ├── dom-observer.ts # Page state extraction
│ │ └── action-executor.ts
│ ├── popup/ # React popup UI
│ │ ├── App.tsx
│ │ └── components/
│ └── shared/ # Shared types & constants
└── dist/ # Build output
이 확장 프로그램은 Nanobrowser에서 영감을 받은 이중 에이전트 아키텍처를 사용합니다.
두 에이전트 모두 구문 분석 및 실행되는 구조화된 JSON을 출력합니다.
기본 모델: Qwen2.5-1.5B-Instruct-q4f16_1-MLC (~1GB)
대체 모델 (src/shared/constants.ts에 구성):
Phi-3.5-mini-instruct-q4f16_1-MLC (~2GB, 더 나은 추론)Llama-3.2-1B-Instruct-q4f16_1-MLC (~0.7GB, 더 작은 크기)chrome://gpu에서 WebGPU 상태 확인chrome://extensions로 이동이 프로젝트는 다음에서 영감을 받았습니다:
| 패키지 | 라이선스 |
|---|---|
| @mlc-ai/web-llm | Apache-2.0 |
| React | MIT |
| Vite | MIT |
| @crxjs/vite-plugin | MIT |
| TypeScript | Apache-2.0 |
MIT 라이선스 - 자세한 내용은 LICENSE 파일 참조.