Diagnóstico público de e-commerce · varredura em 15 de agosto de 2026
Resumo
O que está funcionando
- ✓ WAF presente sem bloquear bots legítimos (Googlebot etc.)UA×path (GET /): browser=200 googlebot=200 bingbot=200 gptbot=200 oai-searchbot=200 chatgpt-user=200 claudebot=200 claude-searchbot=200 claude-user=200 perplexitybot=200 perplexity-user=200 ccbot=200 meta-externalagent=200
- ✓ Crawlers verificados legítimos (Bing/IA) alcançam o site (não 403 no WAF)UA matrix: browser=200 googlebot=200 bingbot=200 gptbot=200 oai-searchbot=200 chatgpt-user=200 claudebot=200 claude-searchbot=200 claude-user=200 perplexitybot=200 perplexity-user=200 ccbot=200 meta-externalagent=200
- ✓ AI bots permitidos no robots.txt não são bloqueados na camada CDN/WAFnenhuma contradição robots-allow × WAF-block nos 10 AI bots testados (GPTBot, OAI-SearchBot, ChatGPT-User, ClaudeBot, Claude-SearchBot, Claude-User, PerplexityBot, Perplexity-User, CCBot, meta-externalagent) em /. método: GET com UA spoofado (IP não-oficial) — 4xx/challenge ao UA prova bloqueio por UA-string, o mesmo mecanismo que cega o bot real; WAFs que validam IP podem divergir
Pontos críticos
- ✗ Conteúdo principal está disponível no HTML cru (baixa dependência de JS) CríticoHTML cru vazio de conteúdo-chave (invisível a GPTBot/ClaudeBot/PerplexityBot — não executam JS): https://example.com/ (21 palavras, ProductLD=false, preço=false)
- ✗ Domínio apex redireciona para o host www canônico Críticowww.example.com e example.com servem 200 em paralelo (host duplicado dilui o canônico)
- ✗ Não há host paralelo (http+https ou www+non-www) servindo 200 simultaneamente Críticovariantes→status {"http://www.example.com":200,"https://www.example.com":200,"http://example.com":200,"https://example.com":200}; 4 servem 200
Cobertura honesta: medimos 65 de 395 verificações do registro público. 28 verificações ficaram bloqueadas: parte aguarda acesso a dados privados (GA4, Search Console, VTEX) ou entrevista, parte depende de pré-condições de execução.
Problemas por página
Cada verificação reprovada, anotada na página onde foi observada e com a evidência literal capturada pelo probe. O título descreve o estado esperado; o ✗ indica que ele não foi atendido.
| Página | Verificação reprovada e evidência | Área | Severidade |
|---|---|---|---|
| Todas as páginas | ✗ Conteúdo principal está disponível no HTML cru (baixa dependência de JS)HTML cru vazio de conteúdo-chave (invisível a GPTBot/ClaudeBot/PerplexityBot — não executam JS): https://example.com/ (21 palavras, ProductLD=false, preço=false) | Aquisição de Tráfego | Crítico |
| ✗ Domínio apex redireciona para o host www canônicowww.example.com e example.com servem 200 em paralelo (host duplicado dilui o canônico) | Qualidade Técnica do Site | Crítico | |
| ✗ Não há host paralelo (http+https ou www+non-www) servindo 200 simultaneamentevariantes→status {"http://www.example.com":200,"https://www.example.com":200,"http://example.com":200,"https://example.com":200}; 4 servem 200 | Qualidade Técnica do Site | Crítico | |
| ✗ HTTPS em todas as rotas (sem conteúdo servido em HTTP)todas as entradas http resolvem para https 200 (2 cadeias) | Qualidade Técnica do Site | Crítico | |
| ✗ Acesso de AI crawlers é governado intencionalmente no robots.txtrobots.txt sem NENHUMA diretiva para AI crawlers (GPTBot, OAI-SearchBot, ChatGPT-User, ClaudeBot, Claude-SearchBot, Claude-User, PerplexityBot, Perplexity-User, Google-Extended, CCBot, meta-externalagent, Amazonbot, Applebot-Extended, Bytespider) — acesso de IA não governado (default-allow acidental) | Aquisição de Tráfego | Atenção | |
| ✗ Redirect HTTP->HTTPS usa 301 permanente (não 302)http→https: www.example.com 200, example.com 200 (esperado 301/308 permanente) | Qualidade Técnica do Site | Atenção | |
| ✗ Headers de cache/CDN corretos por tipo de páginahome Cache-Control: ∅; cf-cache-status: HIT | Qualidade Técnica do Site | Atenção | |
| ✗ Canonical de host (www vs non-www) declarado consistentementehosts sinalizados (redirects/canonical/sitemap): www.example.com, example.com (esperado só example.com) | Qualidade Técnica do Site | Atenção | |
| ✗ HSTS com max-age >= 1 ano, includeSubDomains e preloadStrict-Transport-Security: AUSENTE | Qualidade Técnica do Site | Atenção | |
| ✗ Content-Security-Policy presente e não trivialmente permissivaContent-Security-Policy AUSENTE | Qualidade Técnica do Site | Atenção | |
| ✗ Proteção contra clickjacking (X-Frame-Options ou frame-ancestors)X-Frame-Options: ∅; CSP frame-ancestors: false | Qualidade Técnica do Site | Atenção | |
| ✗ Meta description está presentemeta description 0/1 URLs | Qualidade Técnica do Site | Atenção |
Busca por IA (GEO)
Como o ChatGPT, o Perplexity e as respostas de IA do Google conseguem descobrir, entender e citar esta loja, medido em 9 dimensões sobre as 32 verificações de GEO do registro.
Scorecard do funil
A jornada do comprador, etapa a etapa, com o que passou e o que reprovou em cada uma.
Atração
40- ✗Conteúdo principal está disponível no HTML cru (baixa dependência de JS)HTML cru vazio de conteúdo-chave (invisível a GPTBot/ClaudeBot/PerplexityBot — não executam JS): https://example.com/ (21 palavras, ProductLD=false, preço=false)
- ✗Domínio apex redireciona para o host www canônicowww.example.com e example.com servem 200 em paralelo (host duplicado dilui o canônico)
- ✗Não há host paralelo (http+https ou www+non-www) servindo 200 simultaneamentevariantes→status {"http://www.example.com":200,"https://www.example.com":200,"http://example.com":200,"https://example.com":200}; 4 servem 200
- ✗Acesso de AI crawlers é governado intencionalmente no robots.txtrobots.txt sem NENHUMA diretiva para AI crawlers (GPTBot, OAI-SearchBot, ChatGPT-User, ClaudeBot, Claude-SearchBot, Claude-User, PerplexityBot, Perplexity-User, Google-Extended, CCBot, meta-externalagent, Amazonbot, Applebot-Extended, Bytespider) — acesso de IA não governado (default-allow acidental)
- ✗Redirect HTTP->HTTPS usa 301 permanente (não 302)http→https: www.example.com 200, example.com 200 (esperado 301/308 permanente)
- ✗Headers de cache/CDN corretos por tipo de páginahome Cache-Control: ∅; cf-cache-status: HIT
- ✗Canonical de host (www vs non-www) declarado consistentementehosts sinalizados (redirects/canonical/sitemap): www.example.com, example.com (esperado só example.com)
- ✗Meta description está presentemeta description 0/1 URLs
Consideração
100- ✓LCP dentro do alvo (lab e campo)
- ✓CLS dentro do alvo (sem layout shift perceptível)
- ✓INP dentro do alvo (responsividade à interação)
- ✓TTFB dentro do alvo
- ✓FCP dentro do alvo
- ✓Speed Index dentro do alvo
- ✓Total Blocking Time dentro do alvo
- ✓Reduzir CSS não utilizado
Compra
24- ✗HTTPS em todas as rotas (sem conteúdo servido em HTTP)todas as entradas http resolvem para https 200 (2 cadeias)
- ✗HSTS com max-age >= 1 ano, includeSubDomains e preloadStrict-Transport-Security: AUSENTE
- ✗Content-Security-Policy presente e não trivialmente permissivaContent-Security-Policy AUSENTE
- ✗Proteção contra clickjacking (X-Frame-Options ou frame-ancestors)X-Frame-Options: ∅; CSP frame-ancestors: false
- ✗X-Content-Type-Options nosniff presenteX-Content-Type-Options: AUSENTE
- ✗Referrer-Policy restritivo definidoReferrer-Policy: AUSENTE
- ✗Permissions-Policy restringe APIs sensíveis do browserPermissions-Policy: AUSENTE
- ✗Isolamento cross-origin (COOP/COEP/CORP) configuradosem COOP/COEP/CORP — isolamento cross-origin ausente
Retenção
não medidoNenhuma verificação desta etapa pôde ser medida só com dados públicos.
Correções ao alcance
Verificações reprovadas que o time de implementação resolve sem depender do cliente ou de terceiros, em ordem de severidade. Cada título descreve o estado esperado que hoje não é atendido.
- Crítico✗ Conteúdo principal está disponível no HTML cru (baixa dependência de JS)HTML cru vazio de conteúdo-chave (invisível a GPTBot/ClaudeBot/PerplexityBot — não executam JS): https://example.com/ (21 palavras, ProductLD=false, preço=false)
- Crítico✗ Domínio apex redireciona para o host www canônicowww.example.com e example.com servem 200 em paralelo (host duplicado dilui o canônico)
- Crítico✗ Não há host paralelo (http+https ou www+non-www) servindo 200 simultaneamentevariantes→status {"http://www.example.com":200,"https://www.example.com":200,"http://example.com":200,"https://example.com":200}; 4 servem 200
- Crítico✗ HTTPS em todas as rotas (sem conteúdo servido em HTTP)todas as entradas http resolvem para https 200 (2 cadeias)
- Atenção✗ Acesso de AI crawlers é governado intencionalmente no robots.txtrobots.txt sem NENHUMA diretiva para AI crawlers (GPTBot, OAI-SearchBot, ChatGPT-User, ClaudeBot, Claude-SearchBot, Claude-User, PerplexityBot, Perplexity-User, Google-Extended, CCBot, meta-externalagent, Amazonbot, Applebot-Extended, Bytespider) — acesso de IA não governado (default-allow acidental)
- Atenção✗ Redirect HTTP->HTTPS usa 301 permanente (não 302)http→https: www.example.com 200, example.com 200 (esperado 301/308 permanente)
- Atenção✗ Headers de cache/CDN corretos por tipo de páginahome Cache-Control: ∅; cf-cache-status: HIT
- Atenção✗ Canonical de host (www vs non-www) declarado consistentementehosts sinalizados (redirects/canonical/sitemap): www.example.com, example.com (esperado só example.com)
Identidade de marca
#334488#334488#EEEEEE#000000Neutral, factual, technical
Próximo passo
Isto é só a parte pública.
Este relatório usou apenas o que qualquer visitante consegue observar de fora: páginas públicas, dados estruturados, sinais de crawler e testes de navegador. O diagnóstico completo conecta GA4, Search Console e a plataforma da loja para medir o funil real, achar onde a receita escapa e dimensionar cada correção em reais.
Falar com a deco.cx