O Agent pode abrir páginas, clicar e tirar capturas de tela?
Faça operações explícitas em páginas nos ambientes compatíveis com ferramentas de navegador.
Operações de navegador são diferentes da extração de texto
A extração de texto de páginas serve para obter texto disponível publicamente. Já as operações de navegador permitem acessar páginas, verificar estados, clicar e tirar capturas em ambientes compatíveis, sendo adequadas para observar layouts ou realizar interações dinâmicas. A capacidade do Agent de realizar essas ações depende das ferramentas e da conexão do ambiente atual.
Não presuma que toda tarefa online use um navegador real.
Informe objetivos específicos na página
Por exemplo: “Abra uma página pública, verifique se a navegação no celular cobre o conteúdo e salve uma captura de tela”. Definir claramente o estado a verificar, as condições da tela e o resultado desejado favorece resultados verificáveis mais do que “me ajude a verificar o site”.
Para problemas de interface, forneça o caminho da página e as etapas de reprodução, pedindo o registro do estado real em cada etapa. As capturas devem indicar, de preferência, se foram feitas antes ou depois da operação; só a imagem final muitas vezes não comprova que as interações intermediárias ocorreram como solicitado.
- Confirme a página de destino e o escopo permitido das operações.
- Indique o estado da página ou as interações a observar.
- Peça capturas de tela ou resultados efetivamente visíveis.
- Para envios ou alterações, confirme primeiro as operações específicas.
Limites de login e ambiente
Não presuma que o navegador usado pelo Agent tenha o estado de login do seu navegador habitual. Ambientes na nuvem e locais podem exibir páginas diferentes. Se aparecerem captchas, pedidos de login ou recusas de acesso, siga as exigências do site; a conclusão automática não é garantida. Mesmo quando a página mostrar sucesso, confira o estado final, principalmente em redirecionamentos, uploads e envios de formulários.