Gemini Guided Vision vs Lookout vs Be My Eyes: qual usar no Android?
Compare assistência pela câmera, leitura de documentos e descrição de fotos no Android. Confira idiomas, uso offline e quando recorrer à ajuda humana.
- Escolha Guided Vision para descrições faladas com orientação de enquadramento, Lookout para modos específicos de leitura e Be My AI para analisar uma foto e fazer perguntas adicionais.
- Guided Vision chegou ao Android 9 ou posterior nos idiomas e regiões do Gemini Live. Os idiomas do Lookout variam por recurso; suas descrições detalhadas de imagens e perguntas com IA têm condições próprias.
- O modo Rótulos de alimentos do Lookout pode funcionar offline após baixar dados adicionais, onde disponível. Isso não se aplica a todos os modos; Be My AI exige internet.
- Confira o conteúdo antes de agir e recorra à ajuda humana quando necessário. Um resultado revisado pode ser guardado como tarefa pessoal, sem transformar a descrição em orientação de navegação segura.
Escolha pela tarefa visual que precisa resolver
Na comparação Gemini Guided Vision vs Lookout vs Be My Eyes, comece pelo que está diante de você. Para conversar sobre uma cena pela câmera e receber instruções para melhorar o enquadramento, considere Guided Vision no Gemini Live. Para ler um documento, texto curto ou rótulo com um modo dedicado, Lookout oferece caminhos específicos. Para descrever uma foto, fazer perguntas sobre ela e recorrer a uma pessoa quando a resposta não basta, Be My AI e a ajuda de voluntários no Be My Eyes atendem a outra necessidade.
Defina uma informação concreta antes de abrir o aplicativo: o nome de um item no cardápio, uma linha numa carta ou o texto de uma embalagem. “O que há aqui?” pode produzir uma descrição geral sem resolver essa pergunta. Se você precisa de ajuda para posicionar a câmera, a orientação de enquadramento pesa na escolha. Se já tem uma foto completa, perguntas sobre essa imagem podem ser mais convenientes.
| Opção | Entrada e tarefa | Idioma e conexão | Verificação e ajuda |
|---|---|---|---|
| Gemini Guided Vision | Câmera compartilhada no Live, descrição falada e orientação de enquadramento | Confira elegibilidade, idioma, região e conexão do Gemini Live | Reposicione a câmera e confirme o detalhe; procure apoio humano se a dúvida persistir |
| Lookout | Modos para texto, documentos, rótulos e outras tarefas; também recebe imagens | Varia por recurso; Rótulos de alimentos tem uso offline condicionado | Escolha o modo correto e confira a captura; não trate uma descrição geral como leitura completa |
| Be My AI no Be My Eyes | Descrição de uma foto e perguntas posteriores | Exige internet; confira as condições no app | Envie outra imagem, pergunte mais ou busque ajuda de voluntários |
Essas rotas ajudam a interpretar informações visuais, mas uma descrição pode conter erros. Guided Vision não é um dispositivo médico nem substitui bengala ou auxílio de mobilidade; não foi destinado a navegação, detecção de obstáculos ou garantia de deslocamento seguro. Escolha a ferramenta pela informação necessária, sem usar a resposta como autorização para atravessar uma rua ou caminhar por um trajeto desconhecido.
Confira acesso, idiomas e condições no Android
O Guided Vision foi lançado em 1º de outubro de 2026 para Android 9 ou posterior, nas regiões e nos idiomas compatíveis com Gemini Live. No Gemini, abra o perfil, entre em Configurações e ative Usar Guided Vision no Live; depois, inicie Live e compartilhe a câmera. Com a função ativa, você recebe descrições faladas em tempo real e solicitações para ajustar o enquadramento.
Também há uma rota de atalho em Configurações do Android > Acessibilidade > Assistência visual > Guided Vision. Para quem usa TalkBack, o menu aberto com um toque de três dedos oferece a rota correspondente. Atualize o app e o sistema e confira se esses controles aparecem no seu aparelho elegível. O idioma deste artigo não confirma disponibilidade da função na sua conta.
A ajuda oficial do Lookout descreve os modos Texto, Explorar em beta, Rótulos de alimentos, Documentos, Moeda, Imagens e Encontrar. Documentos oferece orientação de captura em tempo real; Imagens trabalha com fotos capturadas ou compartilhadas. Confira idioma, permissão de câmera e dados necessários para o modo escolhido. Explorar em beta é menos preciso que os demais modos. Em Imagens, descrições detalhadas estão em inglês; perguntas adicionais com IA são destinadas a usuários de inglês nos Estados Unidos, Reino Unido ou Canadá.
O Be My AI no Android descreve uma imagem e permite perguntar mais por texto ou acrescentar outra foto. Essa interação trabalha com imagens, em vez de analisar vídeo continuamente. Para compartilhar uma imagem pública no Android, mantenha-a pressionada ou, com TalkBack, toque duas vezes e mantenha pressionado; escolha compartilhar a imagem e Descrever com Be My AI. A experiência é otimizada para leitores de tela.
Uma opção de compartilhamento ausente é diferente de uma descrição incompleta: primeiro confira o aplicativo, a disponibilidade da entrada e a imagem selecionada. Se você precisa configurar a operação do próprio telefone por voz, consulte Celular com comando de voz para cegos: TalkBack, Voice Access e FoneClaw.
Confira a descrição e refaça a captura quando necessário
Imagine que você quer identificar uma informação num rótulo ou ler um item do cardápio. Faça uma pergunta específica: peça o nome do produto ou o texto da linha desejada. No Guided Vision, siga as solicitações de enquadramento. No Lookout, escolha Texto ou o modo apropriado ao documento. No Be My AI, use a pergunta adicional para esclarecer o detalhe e envie uma nova imagem se a primeira não mostrar tudo.
Separe leitura e interpretação. “Leia a linha abaixo do título” pede o conteúdo visível; “o que isso significa?” pede uma explicação que pode incorporar suposições. Quando você precisa guardar uma informação exata, obtenha primeiro o trecho e esclareça palavras ou números incertos. Nas rotas que aceitam perguntas, se a resposta mistura o que aparece na imagem com uma conclusão, peça que indique o texto em que se baseou.
Uma resposta fluente não confirma que letras pequenas, valores ou negativas foram lidos corretamente. Se houver dúvida, reposicione a câmera, melhore a iluminação e faça outra captura. Compare o trecho com uma fonte acessível ou peça ajuda humana. O Be My Eyes oferece ajuda de voluntários quando a resposta da IA é insuficiente; confira a opção disponível no Android, sem presumir que todas as telas e etapas sejam idênticas às do iPhone.
Informações financeiras, dados pessoais sensíveis e dosagens de medicamentos exigem confirmação apropriada; não decida apenas pela interpretação da IA. Se duas capturas dão respostas diferentes para um valor ou uma instrução, preserve a dúvida em vez de escolher a resposta mais convincente. Quando o problema é traduzir uma imagem já capturada, Melhores apps para traduzir capturas de tela no Android: 4 opções trata desse objetivo específico.
Para planejar uso sem conexão, verifique o modo, não apenas o nome do aplicativo. Rótulos de alimentos do Lookout está disponível em alguns países e pode funcionar offline depois do download de dados adicionais. Isso não estabelece funcionamento offline de todos os modos. Be My AI precisa de internet. No Lookout, os itens de Recentes são apagados quando o aplicativo é fechado; essa lista não deve ser tratada como arquivo permanente.
Compare um cardápio, um documento e um rótulo
Os exemplos abaixo são percursos sugeridos para escolher a ferramenta e conferir o resultado. Em cada um, defina o detalhe necessário, faça a captura apropriada e tenha uma alternativa caso ele não seja legível.
Cardápio: identificar um prato e seu preço. Se precisa de orientação para enquadrar a página, comece com Guided Vision e peça: “descreva esta parte do cardápio e ajude a enquadrar a linha do prato”. Para leitura direta, considere Texto no Lookout. Se já tem uma foto, Be My AI permite perguntar sobre ela. Nas rotas com perguntas, solicite nome e preço separadamente, para evitar associar o valor de uma coluna ao prato de outra.
O resultado útil é a leitura do item escolhido com o valor correspondente. Se houver corte, reflexo ou confusão entre linhas, capture novamente a região mantendo nome e preço juntos. Quando a dúvida envolver ingredientes ou alergênicos, confirme com o estabelecimento; uma imagem incompleta não resolve a ausência dessa informação.
Documento: localizar uma data e a instrução relacionada. Escolha Documentos no Lookout quando quiser orientação para capturar uma página. Depois, confira a linha relevante junto da frase próxima à data. Guided Vision pode ajudar no enquadramento; uma foto completa pode ser analisada com perguntas adicionais no Be My AI. Confira se a data se refere ao evento, à emissão ou ao prazo indicado.
O resultado esperado é o trecho completo, com seu contexto. Se faltar uma borda ou uma segunda página, refaça a captura dessa parte antes de interpretar a instrução. Para documentos financeiros ou pessoais sensíveis, confirme por uma fonte apropriada e evite fornecer áreas sem relação com a pergunta.
Rótulo doméstico: distinguir duas embalagens. Para uma embalagem de alimento, considere Rótulos de alimentos no Lookout, onde disponível. Para texto visível em outro tipo de embalagem, escolha Texto ou uma foto com pergunta específica. Nas rotas com perguntas, peça o nome e uma característica escrita, como a variedade, em vez de concluir pela cor ou formato do recipiente.
Confira se o resultado identifica a embalagem que está sendo mostrada, e não a outra ao lado. Se a superfície curva esconde palavras, reposicione e capture o trecho restante. Se o conteúdo continuar ambíguo, peça ajuda humana antes de usá-lo. Para medicamentos, não use essa identificação como confirmação de dosagem.
Mude de rota quando faltar acesso ou informação
Uma entrada ausente pede verificação de disponibilidade; uma resposta incompleta pede revisão da captura ou da tarefa. Separar esses casos evita repetir uma pergunta quando o recurso necessário não está habilitado.
| Problema | O que conferir | Próximo caminho |
|---|---|---|
| Guided Vision não aparece | Android, atualização do app e sistema, idioma e região do Gemini Live | Use uma rota de leitura ou foto disponível; não presuma que mudar só o idioma libera a função |
| Lookout descreve a cena, mas não lê a linha | Modo escolhido e enquadramento do texto | Use Texto ou Documentos conforme a tarefa |
| Perguntas com IA não aparecem no modo Imagens | Inglês e disponibilidade nos Estados Unidos, Reino Unido ou Canadá | Escolha outro recurso disponível ou apoio humano |
| Be My AI recebe uma foto incompleta | Se o detalhe está dentro da imagem | Envie uma nova foto e faça uma pergunta delimitada |
| O recurso não responde sem rede | Conexão e requisitos do modo usado | Use somente uma opção offline já preparada e compatível, ou procure ajuda |
Antes de refazer capturas, confira a permissão de câmera quando a tarefa usa câmera e a conexão quando o serviço a exige. No Lookout, não confunda suporte geral a um idioma com as condições específicas das descrições detalhadas e perguntas em Imagens. Para uso offline de Rótulos de alimentos, prepare os dados adicionais antes de precisar deles e confirme a disponibilidade no seu país.
Se você continua obtendo descrições divergentes, pare de tratar novas respostas como confirmação automática. Delimite a pergunta, capture o detalhe ausente ou use a ajuda de voluntários no Be My Eyes. Informe qual trecho precisa esclarecer. Essa alternativa humana é especialmente útil quando a imagem não permite resolver a dúvida com segurança.
Guarde um resultado revisado como tarefa pessoal
Depois de confirmar uma informação, talvez você queira guardá-la para consultar mais tarde. Na FoneClaw, oferecemos essa etapa separada: forneça manualmente o texto revisado e peça uma anotação ou um item no centro pessoal de tarefas. Se quiser interpretar uma foto selecionada dentro da FoneClaw, use um modelo visual compatível e revise os campos propostos antes de salvá-los. Indique uma data somente quando houver prazo real.
Por exemplo, guarde o nome de um produto confirmado ou uma tarefa para pedir uma versão acessível de um documento. Se uma data permanece incerta, registre a necessidade de verificá-la em vez de criar um prazo. As predefinições de provedor e os controles de imagens ajudam a configuração; a capacidade visual depende do modelo escolhido pelo usuário.
O modelo selecionado na FoneClaw interpreta e planeja; ferramentas Android habilitadas executam as ações suportadas com as permissões necessárias e a política de aprovação vigente. Um modelo on-line pode receber o contexto fornecido. Abra o item salvo para conferir o texto. Os recursos da FoneClaw apresentam essa rota de registro pessoal, sem pressupor conexão automática com os aplicativos de assistência visual.
Se a informação estiver na interface do telefone, em vez de num objeto físico, Compreensão de tela por IA no Android: estado, captura e ação segura explica como conferir contexto e alvo antes de uma ação. Para a cena física, mantenha a escolha ligada à tarefa: câmera ao vivo com orientação, modo específico de leitura ou foto com perguntas e apoio humano.