PokeClaw 대 FoneClaw: 로컬 AI 폰 에이전트와 관리형 Android 실행 비교
PokeClaw와 FoneClaw를 로컬 모델 추론, 데이터 경로, Android 동작 실행, 권한과 승인, 기기 비용, 되돌리기 쉬운 첫 테스트 기준으로 비교합니다.
- PokeClaw 대 FoneClaw의 핵심 차이는 로컬 모델 추론과 관리형 Android 실행입니다. PokeClaw는 로컬 우선 오픈소스 Android 프로토타입에 가깝고, FoneClaw는 지원되는 Android 동작을 권한과 승인 안에서 이어 가는 독립 폰 에이전트 런타임입니다.
- PokeClaw의 Local mode는 휴대폰에서 LiteRT-LM을 통해 Gemma 4를 실행하고, 설정 후 계정이나 API key 없이 사용할 수 있다고 설명됩니다. 선택형 cloud provider를 켜면 데이터 경로와 신뢰 기준이 달라집니다.
- 동작 루프는 제품 선택의 실제 기준입니다. PokeClaw는 현재 UI의 텍스트 표현을 읽고 touch, text, app opening, screen reading, screenshot, messaging, auto-reply 같은 도구를 선택하는 구조를 문서화합니다.
- FoneClaw는 이 글 업데이트 시점의 최신 제품 정보 기준으로 플로팅 접근, 사용자가 요청하는 화면 맥락, 작업 연속성, 승인, 중지, 권한 복구, capability routing을 제공하며, 첫 평가는 앱 열기나 미전송 초안처럼 되돌리기 쉬운 작업으로 시작하는 편이 좋습니다.
PokeClaw와 FoneClaw, 어떤 사용자에게 맞을까
PokeClaw 대 FoneClaw의 결론은 “어느 쪽이 더 좋다”가 아니라 “무엇을 시험하려는가”입니다. 로컬 모델 추론, 오픈소스 구조, Android 위에서 직접 돌아가는 실험형 폰 에이전트를 보고 싶다면 PokeClaw가 먼저입니다. 지원되는 Android 동작을 권한, 승인, 상태 확인, 중지, 복구 안에서 이어 가는 제품 흐름이 필요하다면 FoneClaw가 더 맞습니다.
PokeClaw 공식 GitHub 저장소는 PokeClaw를 local-first Android prototype으로 설명합니다. 이 표현은 중요합니다. PokeClaw는 연구자, 빌더, 고급 사용자가 로컬 모델과 UI 조작 루프를 직접 확인하기 좋은 방향입니다. 동시에 공식 자료가 public build를 prototype으로 부르는 만큼, 일반 소비자용 완성 제품처럼 기대하기보다 자신의 기기에서 안정성, 지연, 권한, 앱 호환성을 확인해야 합니다.
FoneClaw에서 우리는 “로컬”이라는 말을 두 가지로 나눠 봅니다. 하나는 모델 추론이 휴대폰 안에서 일어나는지입니다. 다른 하나는 실제 휴대폰 동작이 기기 위에서 보이는 상태와 사용자 통제 안에서 진행되는지입니다. PokeClaw의 강점은 전자, 즉 로컬 모델 추론 실험에 있습니다. FoneClaw가 집중하는 쪽은 후자입니다. 우리는 Android 사용자가 말한 의도를 실제 지원 동작으로 옮길 때 권한, 승인, 현재 화면, 복구가 제품 경험 안에서 보이도록 만들고 있습니다. 로컬과 클라우드 신뢰 모델을 더 넓게 비교하고 싶다면 AI Agent Trust: 클라우드 AI 보안과 로컬 휴대폰 제어를 어떻게 판단할까가 배경을 정리합니다.
모델 추론 위치와 데이터 경로 비교
로컬 AI 폰 에이전트를 고를 때 가장 먼저 확인할 것은 모델과 데이터가 어디를 지나가는지입니다. PokeClaw 공식 페이지는 Local mode에서 Gemma 4를 LiteRT-LM으로 휴대폰에서 실행한다고 설명합니다. 설정 후에는 계정이나 API key 없이 사용할 수 있다는 점도 강조합니다. 이 구조는 프롬프트와 화면 맥락을 외부 모델 API로 보내지 않고 기기 안에서 추론을 시험하려는 사용자에게 분명한 장점이 있습니다.
다만 PokeClaw가 모든 구성에서 완전히 오프라인이라고 읽으면 안 됩니다. 공식 저장소는 선택형 cloud provider도 지원한다고 설명합니다. 사용자가 cloud provider를 켜면 모델 추론 경로, 데이터 처리 위치, 계정과 API key, 로그와 비용 기준이 달라집니다. 따라서 PokeClaw를 평가할 때는 “PokeClaw인가?”보다 “Local mode인가, cloud provider를 켰는가?”를 먼저 확인해야 합니다.
FoneClaw의 비교 축은 다릅니다. FoneClaw를 만들며 우리는 모델 위치만으로 폰 에이전트의 신뢰성을 판단하지 않습니다. 사용자는 휴대폰 위에서 어떤 작업이 실제로 실행되는지, 어떤 권한이 필요한지, 실행 전 승인이 있는지, 실패했을 때 복구 경로가 보이는지를 함께 봅니다. 이 글 업데이트 시점의 최신 제품 정보 기준으로 FoneClaw는 플로팅 접근, 사용자가 요청하는 현재 화면 맥락, 작업 연속성, 승인, 중지, 권한 복구, capability routing을 제공합니다. 현재 앱 접근 경로는 FoneClaw 다운로드 페이지에서 확인할 수 있습니다.
| 비교 기준 | PokeClaw | FoneClaw |
|---|---|---|
| 중심 가치 | 로컬 우선 모델 추론과 오픈소스 Android 에이전트 실험 | 지원되는 Android 동작을 관리형 실행 흐름으로 연결 |
| 모델 경로 | Local mode에서 휴대폰 내 Gemma 4와 LiteRT-LM 사용 | 공개 문구에서는 전체 추론이 온디바이스라고 주장하지 않음 |
| 선택형 클라우드 | cloud provider를 켜면 데이터 경로가 바뀜 | 사용자는 현재 제품 정보와 기능 범위를 확인한 뒤 작업별로 평가 |
| 검증 질문 | 지금 설정이 Local mode인지, 어떤 데이터가 기기를 떠나는지 | 권한, 승인, 화면 맥락, 중지, 복구가 작업 중 보이는지 |
온디바이스 폰 에이전트의 성능은 모델이 기기 안에 있다는 사실만으로 끝나지 않습니다. 모델 파일 크기, 메모리, CPU 또는 가속 하드웨어, 배터리, 발열, 첫 응답 지연이 함께 작동합니다. 이 성능 배경은 온디바이스 LLM 최적화와 폰 AI 에이전트: 속도, 배터리, 실행 흐름에서 더 깊게 볼 수 있습니다.
각 에이전트가 화면을 보고 행동하는 방식
폰 에이전트 비교에서 두 번째로 중요한 것은 observe-and-act loop입니다. PokeClaw 공식 저장소는 휴대폰에 있는 루프가 현재 UI의 텍스트 표현을 읽고, 모델이 다음 도구를 선택하는 방식으로 설명합니다. 문서화된 도구에는 touch, text, app opening, screen reading, screenshots, messaging, auto-reply, finish 같은 동작이 포함됩니다. 이 구조는 개발자가 Android 접근성 기반 화면 표현과 도구 선택 과정을 관찰하고 바꾸기 쉽다는 장점이 있습니다.
PokeClaw의 방향은 “로컬 모델이 현재 화면을 보고 다음 행동을 고르는가”를 실험하기에 좋습니다. 예를 들어 특정 앱을 열고, 화면의 텍스트를 읽고, 입력창에 문장을 넣고, 메시지 자동 답장을 시험하는 식입니다. 다만 공식 자료에 도구가 있다는 사실이 모든 앱, 모든 화면, 모든 언어, 모든 기기에서 같은 결과를 보장하지는 않습니다. Android UI는 앱마다 다르고, 접근성 트리의 품질도 화면 구조에 따라 달라집니다.
FoneClaw에서는 화면 맥락을 사용자가 요청할 때 붙이는 방식으로 다룹니다. 사용자는 플로팅 어시스턴트를 열어 현재 화면을 맥락으로 전달하고, 필요한 질문이나 지원 동작을 이어 갈 수 있습니다. 이 흐름은 화면 전체를 자동으로 넘겨주는 경험보다 사용자의 의도를 분명히 남기는 쪽에 가깝습니다. 현재 화면을 기반으로 묻고 확인하고 실행하는 사용 흐름은 Android 플로팅 AI 어시스턴트 현재 화면: 묻고 확인하고 실행하는 방법에서 더 자세히 설명합니다.
FoneClaw의 실행은 단순한 GUI tapping 목록보다 기능 경로를 나누는 데 초점을 둡니다. 이 글 업데이트 시점의 최신 제품 정보 기준으로 FoneClaw는 화면과 앱, 기기 상태와 시스템 제어, 위치와 길 안내, 통신, 캘린더, 메모, 작업·워크플로, 플러그인 같은 경로를 요청 성격에 맞춰 라우팅합니다. 공개 기능 범위는 FoneClaw 기능 페이지에서 확인할 수 있으며, 지원되는 작업은 100+ built-in tools를 바탕으로 구성됩니다. 도구 수보다 중요한 것은 해당 작업이 어떤 권한과 승인, 상태 확인을 거쳐야 하는지 사용자에게 드러나는지입니다.
| 실행 관점 | PokeClaw | FoneClaw |
|---|---|---|
| 화면 관찰 | 현재 UI의 텍스트 표현을 읽는 로컬 루프 | 사용자가 요청할 때 현재 화면 맥락을 붙이는 흐름 |
| 행동 선택 | 모델이 문서화된 generic tools와 skills를 선택 | 요청을 지원되는 기능 경로와 승인 흐름으로 라우팅 |
| 강점 | 오픈소스 실험, 로컬 추론 확인, 루프 관찰 | 플로팅 접근, 작업 연속성, 권한과 복구가 보이는 제품 흐름 |
| 확인할 한계 | prototype 품질, 앱별 UI 차이, 기기 성능 | 지원되는 Android 작업 범위, 필요한 권한, 기능별 실행 조건 |
권한, 승인, 중지, 복구 비교
동작 제어는 로컬 여부와 별개의 문제입니다. PokeClaw 공식 페이지는 Accessibility가 screen reading과 gestures를 가능하게 한다고 설명합니다. 접근성 권한은 Android 에이전트에게 강력한 화면 관찰과 동작 가능성을 열어 주지만, 그 자체가 사용자의 이해와 동의를 자동으로 보장하지는 않습니다. 사용자는 어떤 앱 화면을 읽는지, 어떤 gesture를 수행하는지, 메시지나 auto-reply 같은 외부 효과가 생기는 작업에서 어떤 확인 단계가 있는지 봐야 합니다.
PokeClaw 저장소는 rules, guards, stuck detection, clean failures, QA priorities, limitations 같은 방향을 문서화합니다. 이는 실험형 에이전트에서 매우 중요한 신호입니다. 빌더는 모델이 잘못된 루프에 빠졌을 때 어떻게 멈추는지, 같은 버튼을 반복해서 누르는 상황을 어떻게 감지하는지, 실패를 사용자에게 어떻게 설명하는지 확인할 수 있습니다. 오픈소스라는 점은 코드를 읽고 고칠 수 있는 장점이지만, 오픈소스 자체가 안전을 자동으로 보장하지는 않습니다.
FoneClaw에서 우리는 권한, 승인, 중지, 복구를 제품의 실행 계약으로 봅니다. 사용자가 민감한 작업을 요청하면 어떤 권한이 필요한지 보여 주고, 결과가 남는 작업에서는 승인 단계를 분리하며, 도중에 멈추고 이어받을 수 있는 흐름을 설계합니다. 권한이 빠진 경우에는 관련 설정 경로와 복구 방법을 보여 주는 것이 중요합니다. 우리가 이 기준을 강하게 잡는 이유는 휴대폰 작업이 단순 답변보다 훨씬 더 큰 외부 효과를 만들기 때문입니다.
예를 들어 메시지 자동 답장, 앱 설치, 일정 변경, 위치 기반 길 안내, 시스템 설정 변경은 모두 “성공”보다 “통제된 성공”이 중요합니다. 어떤 제품을 쓰든 첫 테스트에서 바로 전송, 삭제, 구매, 계정 변경 같은 작업을 시도하지 않는 편이 좋습니다. 먼저 앱 열기, 현재 화면 설명, 미전송 초안 작성, 볼륨 상태 확인처럼 되돌리기 쉬운 작업으로 권한 요청, 승인 단계, 중지 행동, 최종 상태 검증을 봐야 합니다.
설치 방식과 기기 비용 비교
PokeClaw의 하드웨어 요구 사항은 로컬 AI 폰 에이전트를 고려하는 사용자가 가장 먼저 봐야 할 현실 조건입니다. 공식 페이지는 direct APK와 Android 9+ arm64를 제시하고, Local setup에서 첫 실행 시 약 2.6 GB 다운로드와 약 4 GB free RAM을 요구한다고 설명합니다. 또한 CPU warmup이 약 45초 걸릴 수 있고, 지원되는 accelerated hardware에서는 더 빨라질 수 있다고 안내합니다.
이 숫자는 방향을 보여 주지만 성능 보증은 아닙니다. 같은 Android 9+ arm64 기기라도 저장공간, RAM 여유, 칩셋, 발열 제어, 배터리 상태, 백그라운드 앱, OS 커스텀에 따라 결과가 달라질 수 있습니다. 로컬 모델이 매력적인 이유는 데이터 경로와 실험 통제력이지만, 그 대가로 모델 다운로드, 첫 응답 지연, 메모리 압박, 배터리 소모를 직접 감당해야 합니다.
FoneClaw 쪽에서 확인할 것은 하드웨어보다 현재 제품 경로와 권한 준비입니다. 사용자는 FoneClaw 다운로드 페이지에서 현재 앱을 확인하고, 플로팅 접근, 화면 맥락, 지원되는 Android 동작에 필요한 권한을 차례로 설정합니다. FoneClaw가 모든 추론을 온디바이스로 처리한다고 말하지 않는 이유도 여기에 있습니다. 우리는 사용자가 기대해야 할 가치를 모델 위치 하나로 고정하지 않고, 지원되는 작업이 실제 휴대폰에서 권한과 승인, 상태 확인 안에 들어오는지로 설명합니다.
설치 난이도는 선택 기준의 일부입니다. PokeClaw는 로컬 모델 실험에 익숙한 사용자에게 더 흥미로운 출발점입니다. FoneClaw는 Android 일상 작업을 실행 흐름으로 시험하려는 사용자에게 더 직접적인 경로를 제공합니다. 어느 쪽이든 첫날에는 큰 권한을 한꺼번에 열기보다 낮은 위험 작업으로 성능과 통제 흐름을 확인해야 합니다.
현실적인 작업 흐름별 선택 기준
제품 이름보다 작업 흐름을 먼저 고르면 판단이 쉬워집니다. PokeClaw는 로컬 모델 추론, 오픈소스 루프 관찰, WhatsApp auto-reply와 generic app navigation 같은 실험을 보고 싶은 사용자에게 맞습니다. GitHub 저장소는 Apache 2.0 라이선스와 trademark limits를 함께 설명하므로, 빌더는 코드 사용 조건과 이름 사용 조건을 나눠 읽으면 됩니다.
FoneClaw는 Android 사용자가 말한 일을 지원되는 휴대폰 동작으로 이어 가고 싶을 때 맞습니다. 이 글 업데이트 시점의 최신 제품 정보 기준으로 우리는 플로팅 어시스턴트, 사용자가 요청하는 화면 맥락, 작업 연속성, 권한과 승인, 중지와 복구, capability routing을 제품 흐름 안에서 다룹니다. 도구·플러그인·스킬·워크플로의 차이를 더 깊게 보고 싶다면 FoneClaw 도구·플러그인·스킬·워크플로 차이: Android 폰 에이전트 확장 계층 가이드가 구조를 따로 설명합니다.
| 원하는 일 | 먼저 볼 제품 | 검증할 질문 |
|---|---|---|
| 로컬 모델이 휴대폰에서 실제로 도는지 실험 | PokeClaw | Local mode인지, 다운로드와 RAM 조건을 만족하는지, 지연을 감당할 수 있는지 |
| 오픈소스 루프와 도구 선택 과정을 읽고 수정 | PokeClaw | 코드, rules, guards, limitations를 직접 검토할 수 있는지 |
| 현재 화면을 붙여 질문하고 지원 동작을 이어 가기 | FoneClaw | 화면 맥락을 사용자가 요청할 수 있는지, 결과가 보이는지 |
| 기기 설정, 알림, 통신, 캘린더, 메모 같은 Android 작업 | FoneClaw | 권한과 승인, 상태 확인, 중지, 복구가 작업 중 드러나는지 |
| 메시지 자동화 실험 | 둘 다 테스트 | 초안만 만드는지, 자동 전송 경계가 있는지, 실패 후 직접 이어받을 수 있는지 |
이 표는 승자표가 아닙니다. 로컬 AI 폰 에이전트가 필요한 사용자는 PokeClaw를 통해 모델 위치와 오픈소스 제어를 확인할 수 있습니다. 관리형 Android 실행이 필요한 사용자는 FoneClaw를 통해 지원되는 실제 작업의 권한과 복구 흐름을 확인할 수 있습니다. 두 제품 모두 자신의 기기, 앱, 언어, 권한 상태에서 직접 시험해야 의미가 있습니다.
선택 후 되돌리기 쉬운 첫 테스트
PokeClaw를 먼저 고를 상황은 분명합니다. 로컬 모델 추론을 직접 확인하고 싶고, Android 접근성 기반 도구 루프를 읽고 실험하며, prototype 특성을 감수할 수 있다면 PokeClaw가 좋은 출발점입니다. FoneClaw를 먼저 고를 상황도 분명합니다. Android에서 지원되는 휴대폰 동작을 플로팅 접근, 현재 화면 맥락, 승인, 중지, 복구 안에서 실행해 보고 싶다면 FoneClaw가 더 실용적인 첫 경로입니다.
첫 테스트는 되돌리기 쉬워야 합니다. 다음 순서로 진행합니다.
- 같은 Android 기기에서 배터리, 네트워크, 언어, 권한 상태를 기록합니다.
- PokeClaw에서는 Local mode인지 확인하고, FoneClaw에서는 현재 앱과 기능 범위를 공식 페이지에서 확인합니다.
- 첫 작업은 앱 열기, 현재 화면 설명, 볼륨 상태 확인, 미전송 메시지 초안 작성 중 하나로 제한합니다.
- 권한 요청, 응답 지연, 화면 이해, 승인 단계, 중지 행동, 최종 상태 확인을 따로 기록합니다.
- 한 번 성공한 뒤 권한 하나를 끄거나 앱 화면을 바꿔 재시도해 복구 설명이 나오는지 봅니다.
처음부터 전송, 삭제, 결제, 계정 변경 같은 작업을 시험하지 마세요. 좋은 비교는 위험한 작업을 먼저 해보는 것이 아니라, 낮은 위험 작업에서 관찰 가능한 증거를 쌓는 방식입니다. PokeClaw와 FoneClaw 모두 제품 페이지와 저장소의 최신 정보를 확인하고, 자신의 기기에서 같은 작업을 반복해 본 뒤 선택하는 것이 가장 정확합니다.