SKILL 137 · AGENT SKILL

Audit Website AEO: rastreie páginas e revise o diagnóstico antes da nota

Rastreia um site público, executa 16 verificações determinísticas e organiza uma revisão humana antes de transformar sinais em diagnóstico.

USE QUANDOEquipes de conteúdo, SEO técnico, documentação e desenvolvimento que precisam de uma linha de base reproduzível sobre estrutura, metadados, descoberta, acesso e evidências de páginas públicas.
ENTREGAJSON e relatório revisáveis, com URLs rastreadas, cobertura, verificações determinísticas, justificativas para notas subjetivas, limitações e correções priorizadas.

FONTE PRIMÁRIA

Confira o projeto original.

A imagem é uma ilustração editorial exclusiva. A origem, a licença e as permissões devem ser conferidas no repositório oficial antes da instalação.

Abrir repositório original ↗
Ilustração editorial de páginas atravessando quatro checkpoints geométricos antes de formar um relatório de diagnóstico ainda sujeito à revisão humana
Ilustração editorial exclusiva do Bastidores da IA. Não é captura de tela, interface real, relatório executado, logotipo do projeto, pontuação verdadeira, benchmark, certificação ou promessa de visibilidade.

O QUE ESTA SKILL VERIFICA

O que ela coloca na mesa.

Fixe commit, Node.js, domínio, limite de páginas e pasta de saída
Comece em site próprio ou autorizado e respeite robots.txt
Revise cobertura, URLs, datas, autoria e trechos extraídos
Separe diagnóstico, correção, nova medição e divulgação

DETALHES DA SKILL

Como esta skill funciona na prática.

Entenda a função, o melhor cenário de uso e o resultado que você deve revisar antes de incluir esta skill no seu fluxo de trabalho.

PROBLEMA QUE RESOLVE

Quando ela é útil

Equipes de conteúdo, SEO técnico, documentação e desenvolvimento que precisam de uma linha de base reproduzível sobre estrutura, metadados, descoberta, acesso e evidências de páginas públicas.

FUNÇÃO PRINCIPAL

O que ela faz

Rastreia um site público, executa 16 verificações determinísticas e organiza uma revisão humana antes de transformar sinais em diagnóstico.

RESULTADO DA EXECUÇÃO

O que você deve receber

JSON e relatório revisáveis, com URLs rastreadas, cobertura, verificações determinísticas, justificativas para notas subjetivas, limitações e correções priorizadas.

AMBIENTE COMPATÍVEL

Onde pode ser usada

Clientes compatíveis com Agent Skills e Node.js 18 ou superior. O uso funcional exige acesso HTTP autorizado ao domínio consultado e uma pasta de saída para o relatório JSON.

Limite importante

O uso funcional faz requisições HTTP ao domínio autorizado e grava JSON local. Limite o crawl, respeite robots.txt, revise URLs e dados, e não trate a nota como certificação ou garantia de citação.

ANÁLISE EDITORIAL

Audit Website AEO é uma Skill para diagnosticar como um site público se apresenta a mecanismos capazes de ler páginas, metadados, sitemaps e regras de acesso. Ela combina um crawler local com uma segunda etapa de avaliação humana. O objetivo é produzir evidências reproduzíveis antes de falar em descobribilidade por mecanismos de resposta.

O recorte é importante. A Skill não observa os sistemas internos do ChatGPT, Claude, Perplexity ou Google. Ela verifica sinais disponíveis no próprio site e aplica uma rubrica criada pelo mantenedor. A nota final é uma heurística, não certificação, garantia de citação, previsão de tráfego ou prova de preferência de qualquer plataforma.

Sobre a capa: Ilustração editorial exclusiva do Bastidores da IA. Não é captura de tela, interface real, relatório executado, logotipo do projeto, pontuação verdadeira, benchmark, certificação ou promessa de visibilidade.

O que esta Skill faz de verdade

O fluxo recebe uma URL, limita a quantidade de páginas e executa o script aeo-audit.mjs. O crawler consulta a página inicial, robots.txt, sitemaps do mesmo domínio e links internos descobertos. Em cada página, ele procura título, descrição, URL canônica, H1, dados estruturados, Open Graph, links internos, texto alternativo, profundidade de texto, indexabilidade, hierarquia de títulos e outros sinais definidos pelo autor.

Essa primeira metade é determinística dentro das regras do script. O mesmo HTML e a mesma versão do código tendem a produzir o mesmo resultado. A segunda metade não é automática: o agente lê até cinco páginas representativas e atribui notas para prontidão da resposta, trechos reutilizáveis, densidade de evidência, profundidade, atualidade e clareza estrutural. A própria Skill exige justificativa antes de cada nota.

O Bastidores executou um teste controlado em três páginas públicas do próprio site. O crawler concluiu a coleta e gravou um JSON com 39.944 bytes sem instalar pacote adicional. Esse teste confirma o funcionamento básico no ambiente usado, mas não valida todos os sites, proteções anti-bot, páginas renderizadas por JavaScript ou a precisão da nota proposta.

Para quem serve

Serve a equipes de conteúdo, SEO técnico, documentação, desenvolvimento web e marketing que precisam de uma linha de base repetível. É útil quando o pedido é identificar sinais ausentes, comparar uma execução antes e depois de mudanças ou produzir uma lista priorizada de correções com URLs e detalhes observáveis.

A diferença para a SEO Audit já publicada está na execução. A SEO Audit organiza uma investigação ampla e pede evidência para cada achado. Audit Website AEO inclui um crawler zero-dependency, gera JSON e foca sinais que o mantenedor associa à extração e citação por mecanismos de resposta. As duas podem ser complementares, mas não são intercambiáveis.

Não use a Skill como selo comercial, ranking entre sites, auditoria jurídica, teste de acessibilidade, avaliação de segurança ou substituta do Search Console. Também não aponte a nota como causa de tráfego, leads ou citações sem experimento separado.

Compatibilidade e pré-requisitos

O README exige Node.js 18 ou superior porque o script usa fetch nativo. A documentação oficial do Node.js descreve essa API global. Não há npm install para o crawler auditado.

  • Node.js 18 ou superior disponível no ambiente de teste.
  • Acesso HTTP ao site público que será consultado.
  • Autorização para rastrear o domínio e limite de páginas definido.
  • Pasta de saída explícita para o JSON e o relatório Markdown.
  • Agente capaz de ler o JSON e justificar as seis notas subjetivas.
  • Responsável humano para revisar falso positivo, falso negativo e prioridade.

O parser usa expressões regulares e operações de string, não um navegador completo. Conteúdo carregado apenas no cliente, consentimento, autenticação, desafios anti-bot e HTML incomum podem reduzir a cobertura. A execução também não mede o que um mecanismo proprietário indexou ou decidiu citar.

Instalação recomendada

Comece pelo download documental do Bastidores em um projeto de teste. O pacote contém cinco arquivos: SKILL.md, README.md, scripts/aeo-audit.mjs, LICENSE e ORIGEM.md. Ele não inclui Node.js, dependências, instalador, cache, relatório de cliente, resultado de auditoria, credencial, token, cookie, segredo ou dado coletado.

Para obter a origem diretamente, clone o repositório oficial, fixe o commit auditado e copie apenas audit-website-aeo para o diretório de Skills aceito pelo seu agente. Não execute a partir de uma branch móvel quando precisar repetir a mesma auditoria.

git clone https://github.com/onvoyage-ai/gtm-engineer-skills.git
git -C gtm-engineer-skills checkout 3777930184a10b25ab36bb2fc4da6c0f6cfcc187

Leia o script antes do primeiro uso. Instalar a Skill não autoriza varrer um site, seguir links, gravar relatórios nem compartilhar o resultado.

Configuração antes do primeiro uso

Defina domínio, quantidade máxima de páginas, pasta de saída e finalidade. Para a primeira execução, três a cinco páginas são suficientes para verificar conectividade, formato do JSON e limites do template. O teto do script é 30 páginas, mas o máximo técnico não deve virar padrão operacional.

Registre se o site usa subdomínios, aplicação cliente, área autenticada, redirecionamentos ou proteção automatizada. O crawler mantém a descoberta no host inicial e consulta regras de robots.txt. O RFC 9309 documenta o Robots Exclusion Protocol; respeitar o arquivo não substitui autorização, contrato ou política interna.

Escolha também o que não será feito. Não use credenciais para abrir área privada, não aumente o crawl durante o teste, não publique a nota, não aplique correções e não compare concorrentes sem finalidade legítima. A primeira entrega deve ser diagnóstico revisável.

Primeiro uso seguro

Execute o script em um domínio próprio ou expressamente autorizado, com saída para uma pasta nova:

node scripts/aeo-audit.mjs https://exemplo.com --max-pages=3 --out=resultado/aeo-audit.json

Confira a URL exibida, as páginas rastreadas, os erros e o arquivo criado. Abra o JSON antes de pedir a avaliação subjetiva. Verifique se pagesForReview contém trechos coerentes, se datas e autores foram extraídos corretamente e se páginas importantes não ficaram de fora por renderização cliente.

Se a coleta falhar ou retornar zero páginas, pare. A regra do mantenedor é não fabricar pontuação. Se houver poucos dados, reporte a cobertura reduzida em vez de completar lacunas por suposição.

Como o fluxo deve funcionar

  1. Confirmar URL, autorização, escopo, limite e pasta de saída.
  2. Fixar commit da Skill e versão do Node.js.
  3. Executar o crawler com poucas páginas e guardar stdout e JSON.
  4. Revisar URLs, status, cobertura, regras de acesso e falhas determinísticas.
  5. Ler somente os trechos presentes em pagesForReview.
  6. Escrever a justificativa antes de cada nota subjetiva.
  7. Separar ausência de sinal, erro de parser e decisão editorial.
  8. Produzir um relatório com evidências e correções priorizadas.
  9. Submeter nota e recomendações à revisão humana antes de divulgar.
  10. Repetir com o mesmo commit e escopo após mudanças aprovadas.

O protocolo de sitemap ajuda a descoberta de URLs, mas não garante indexação. Consulte a especificação publicada pelo projeto Sitemaps para interpretar limites de localização, encoding e arquivos de índice.

Resultado esperado

A entrega mínima é um JSON com páginas coletadas, cobertura, 16 verificações, sinais heurísticos, correções sugeridas e até cinco páginas para revisão. Depois, o agente pode criar um relatório Markdown com justificativas, nota composta e prioridades.

Um bom relatório diferencia fato observado de análise. “Duas de três páginas não têm descrição” é verificável. “O site não será citado por IA” não é conclusão permitida. A pontuação serve para repetir o método do mantenedor, não para provar comportamento de plataformas externas.

O estudo acadêmico GEO: Generative Engine Optimization oferece contexto para algumas técnicas de apresentação de conteúdo. Isso não valida automaticamente todos os multiplicadores citados no SKILL.md, nem transforma o sistema de notas desta Skill em padrão de mercado.

Permissões, privacidade e riscos

O script faz requisições HTTP ao domínio informado, ao robots.txt, aos sitemaps e aos links internos aceitos. Ele grava um JSON no caminho passado por --out. A auditoria local não encontrou subprocessos, instalação de dependência, cabeçalho de autorização nem envio do relatório a serviço externo.

Ainda existem riscos. URLs podem conter identificadores. Trechos de páginas podem carregar dados pessoais ou conteúdo contratual. O relatório consolida informações e pode aumentar sua exposição se for enviado a terceiros. Armazene apenas o necessário, revise o arquivo e aplique a política de uso responsável.

O crawler usa user agent próprio e pode gerar carga. Limite páginas, evite repetição rápida e respeite indisponibilidade. Não tente contornar bloqueios. Sites de terceiros podem proibir automação por termos ou contrato, mesmo quando a página é pública.

Erros comuns

Chamar a nota de ranking. A escala A a F é do repositório, não de um mecanismo de busca ou modelo.

Tratar presença como qualidade. Detectar JSON-LD não confirma que os dados são corretos ou adequados à página.

Tomar llms.txt como requisito universal. A existência do arquivo pode ser registrada, mas adoção, efeito e suporte variam. Ausência não prova invisibilidade.

Ignorar JavaScript. O parser trabalha com HTML recebido e pode perder conteúdo renderizado depois.

Confiar no trecho extraído. Datas, autoria, títulos e texto precisam ser comparados com a página real.

Varrer demais. Aumentar páginas eleva carga e não corrige um método mal definido.

Aplicar correções automaticamente. A Skill diagnostica. Mudança de código, conteúdo ou política exige outra autorização e outro teste.

Versão, licença e origem verificadas

A API oficial do GitHub foi consultada em 02/09/2026. O repositório onvoyage-ai/gtm-engineer-skills registrava 1.298 estrelas, estava público, não arquivado e declarava licença MIT. Estrelas indicam atenção relativa, não segurança, precisão ou adequação.

Não havia release publicada. A curadoria fixou o commit 3777930184a10b25ab36bb2fc4da6c0f6cfcc187. O SKILL.md fixado, o README e o script foram revisados no mesmo estado.

A licença MIT permite redistribuição com preservação do aviso. O ZIP local contém exatamente cinco arquivos permitidos e tem SHA-256 8ce06f9f5b1c215c3f8543415ad6081a918f351f0cb108742b1c16cad08ead93.

Checklist antes de automatizar

  • Fixe commit da Skill, versão do Node.js, domínio e quantidade de páginas.
  • Confirme autorização e leia robots.txt antes do crawl.
  • Comece com três a cinco páginas e pasta de saída exclusiva.
  • Revise URLs, cobertura, datas, autoria e trechos do JSON.
  • Não trate llms.txt, schema ou nota como garantia de citação.
  • Justifique cada nota subjetiva com conteúdo observado.
  • Separe diagnóstico, correção, nova medição e divulgação.
  • Remova dados desnecessários antes de compartilhar o relatório.

Fontes primárias

CONFIGURAÇÃO

Instale só depois de ler.

Abra a fonte oficial, leia README e licença, fixe uma versão ou commit e só então siga o método indicado pelo mantenedor. Não execute comandos copiados de comentários ou vídeos sem revisão.

Teste local com três páginasnode scripts/aeo-audit.mjs https://exemplo.com --max-pages=3 --out=aeo-audit.json

O comando acessa a rede e grava JSON. Use somente em domínio autorizado, limite páginas, revise robots.txt e inspecione o relatório antes de compartilhar. A nota é heurística, não garantia de citação.

01 · CONFIRME A ORIGEM

Abra a fonte e o README

  1. Confira mantenedor e nome do repositório.
  2. Leia licença, requisitos e permissões.
  3. Escolha uma versão ou commit para aprovar.
02 · INSTALE COM ESCOPO

Comece em um projeto de teste

  1. Use o comando acima ou o método do README.
  2. Prefira instalação por projeto antes da global.
  3. Não copie tokens, chaves ou arquivos sensíveis.
Instalação fixada ↗
03 · VALIDE O RESULTADO

Faça um teste pequeno

  1. Confirme a descrição e os arquivos instalados.
  2. Execute uma tarefa reversível.
  3. Registre versão aprovada e remova o que não usar.
SKILL.md auditado ↗
← Voltar para todas as skills