Diagnóstico público de e-commerce · varredura em 11 de julho de 2026
Resumo
O que está funcionando
- ✓ Participação no UCP (manifest /.well-known/ucp) é conhecida e intencionalManifest UCP (Google Universal Commerce Protocol) ausente (/.well-known/ucp → 404, corpo HTML/soft-404) — padrão emergente, ausência NÃO é defeito; registrar para inventário
- ✓ Exposição de catálogo via MCP (se existir) é descobrível e válidanenhum endpoint MCP em /.well-known/mcp/server.json→404, /api/mcp→404 — padrão emergente (Shopify storefront MCP, SEP server-card), ausência NÃO é defeito
- ✓ llms.txt (se presente) é auditado apenas por completude/llms.txt ausente (404) — sem impacto: nenhum engine principal lê o arquivo
Pontos críticos
- ✗ Crawlers verificados legítimos (Bing/IA) alcançam o site (não 403 no WAF) CríticoWAF devolve gptbot=403, oai-searchbot=403, claudebot=403, ccbot=403 enquanto Googlebot=200 — Bing + AI search cegos ao site
- ✗ AI bots permitidos no robots.txt não são bloqueados na camada CDN/WAF Críticorobots.txt permite mas CDN/WAF bloqueia: GPTBot=403, OAI-SearchBot=403, ClaudeBot=403, CCBot=403 enquanto browser=200 — site invisível a esses engines apesar do robots.txt limpo. método: GET com UA spoofado (IP não-oficial) — 4xx/challenge ao UA prova bloqueio por UA-string, o mesmo mecanismo que cega o bot real; WAFs que validam IP podem divergir
- ✗ Domínio apex redireciona para o host www canônico Críticohttps://empresas.mor.com.br/ serve 200 em paralelo com www (host duplicado dilui canônico)
Cobertura honesta: medimos 60 de 387 verificações do registro público. 16 verificações ficaram bloqueadas: parte aguarda acesso a dados privados (GA4, Search Console, VTEX) ou entrevista, parte depende de pré-condições de execução.
Problemas por página
Cada verificação reprovada, anotada na página onde foi observada e com a evidência literal capturada pelo probe. O título descreve o estado esperado; o ✗ indica que ele não foi atendido.
| Página | Verificação reprovada e evidência | Área | Severidade |
|---|---|---|---|
| Página de produto (PDP) https://empresas.mor.com.br/produto/banqueta-527 |
✗ Dados estruturados de produto não divergem entre HTML cru e DOMProduct JSON-LD AUSENTE no HTML cru em 1/1 PDPs (https://empresas.mor.com.br/produto/banqueta-527) — agentes que leem o cru (todos exceto Google) não veem o produto | Aquisição de Tráfego | Crítico |
| Todas as páginas | ✗ Crawlers verificados legítimos (Bing/IA) alcançam o site (não 403 no WAF)WAF devolve gptbot=403, oai-searchbot=403, claudebot=403, ccbot=403 enquanto Googlebot=200 — Bing + AI search cegos ao site | Funil de Conversão & Experiência | Crítico |
| ✗ AI bots permitidos no robots.txt não são bloqueados na camada CDN/WAFrobots.txt permite mas CDN/WAF bloqueia: GPTBot=403, OAI-SearchBot=403, ClaudeBot=403, CCBot=403 enquanto browser=200 — site invisível a esses engines apesar do robots.txt limpo. método: GET com UA spoofado (IP não-oficial) — 4xx/challenge ao UA prova bloqueio por UA-string, o mesmo mecanismo que cega o bot real; WAFs que validam IP podem divergir | Aquisição de Tráfego | Crítico | |
| ✗ Domínio apex redireciona para o host www canônicohttps://empresas.mor.com.br/ serve 200 em paralelo com www (host duplicado dilui canônico) | Qualidade Técnica do Site | Crítico | |
| ✗ WAF presente sem bloquear bots legítimos (Googlebot etc.)UA×path (GET /): browser=200 googlebot=200 bingbot=200 gptbot=403 oai-searchbot=403 chatgpt-user=200 claudebot=403 claude-searchbot=200 claude-user=200 perplexitybot=200 perplexity-user=200 ccbot=403 meta-externalagent=200 — WAF bloqueia gptbot/oai-searchbot/claudebot/ccbot | Qualidade Técnica do Site | Atenção | |
| ✗ Acesso de AI crawlers é governado intencionalmente no robots.txtrobots.txt sem NENHUMA diretiva para AI crawlers (GPTBot, OAI-SearchBot, ChatGPT-User, ClaudeBot, Claude-SearchBot, Claude-User, PerplexityBot, Perplexity-User, Google-Extended, CCBot, meta-externalagent, Amazonbot, Applebot-Extended, Bytespider) — acesso de IA não governado (default-allow acidental) | Aquisição de Tráfego | Atenção | |
| ✗ Headers de cache/CDN corretos por tipo de páginahome Cache-Control: no-cache; cf-cache-status: ∅ | Qualidade Técnica do Site | Atenção | |
| ✗ Registros de autenticação de e-mail (SPF/DKIM/DMARC) presentesSPF AUSENTE; DMARC presente (p=none); DKIM selector não descoberto (testados: google/default/k1/s1/selector1) | Qualidade Técnica do Site | Atenção | |
| ✗ HSTS com max-age >= 1 ano, includeSubDomains e preloadStrict-Transport-Security: max-age=16000000; includeSubDomains; preload; (max-age=16000000) | Qualidade Técnica do Site | Atenção | |
| ✗ Content-Security-Policy presente e não trivialmente permissivaContent-Security-Policy AUSENTE | Qualidade Técnica do Site | Atenção | |
| ✗ Proteção contra clickjacking (X-Frame-Options ou frame-ancestors)X-Frame-Options: ∅; CSP frame-ancestors: false | Qualidade Técnica do Site | Atenção | |
| ✗ Toda página tem exatamente um H1H1 por página: 0/1 (esperado 1) | Qualidade Técnica do Site | Atenção | |
| ✗ Schema.org em JSON-LD está presente e é sintaticamente válidoJSON-LD presente+parseável em 0/2 URLs | Qualidade Técnica do Site | Atenção |
Busca por IA (GEO)
Como o ChatGPT, o Perplexity e as respostas de IA do Google conseguem descobrir, entender e citar esta loja, medido em 9 dimensões sobre as 32 verificações de GEO do registro.
Scorecard do funil
A jornada do comprador, etapa a etapa, com o que passou e o que reprovou em cada uma.
Atração
47- ✗AI bots permitidos no robots.txt não são bloqueados na camada CDN/WAFrobots.txt permite mas CDN/WAF bloqueia: GPTBot=403, OAI-SearchBot=403, ClaudeBot=403, CCBot=403 enquanto browser=200 — site invisível a esses engines apesar do robots.txt limpo. método: GET com UA spoofado (IP não-oficial) — 4xx/challenge ao UA prova bloqueio por UA-string, o mesmo mecanismo que cega o bot real; WAFs que validam IP podem divergir
- ✗Domínio apex redireciona para o host www canônicohttps://empresas.mor.com.br/ serve 200 em paralelo com www (host duplicado dilui canônico)
- ✗Dados estruturados de produto não divergem entre HTML cru e DOMProduct JSON-LD AUSENTE no HTML cru em 1/1 PDPs (https://empresas.mor.com.br/produto/banqueta-527) — agentes que leem o cru (todos exceto Google) não veem o produto
- ✗WAF presente sem bloquear bots legítimos (Googlebot etc.)UA×path (GET /): browser=200 googlebot=200 bingbot=200 gptbot=403 oai-searchbot=403 chatgpt-user=200 claudebot=403 claude-searchbot=200 claude-user=200 perplexitybot=200 perplexity-user=200 ccbot=403 meta-externalagent=200 — WAF bloqueia gptbot/oai-searchbot/claudebot/ccbot
- ✗Acesso de AI crawlers é governado intencionalmente no robots.txtrobots.txt sem NENHUMA diretiva para AI crawlers (GPTBot, OAI-SearchBot, ChatGPT-User, ClaudeBot, Claude-SearchBot, Claude-User, PerplexityBot, Perplexity-User, Google-Extended, CCBot, meta-externalagent, Amazonbot, Applebot-Extended, Bytespider) — acesso de IA não governado (default-allow acidental)
- ✗Headers de cache/CDN corretos por tipo de páginahome Cache-Control: no-cache; cf-cache-status: ∅
- ✗Registros de autenticação de e-mail (SPF/DKIM/DMARC) presentesSPF AUSENTE; DMARC presente (p=none); DKIM selector não descoberto (testados: google/default/k1/s1/selector1)
- ✗Toda página tem exatamente um H1H1 por página: 0/1 (esperado 1)
Consideração
não medidoNenhuma verificação desta etapa pôde ser medida só com dados públicos.
Compra
32- ✗HSTS com max-age >= 1 ano, includeSubDomains e preloadStrict-Transport-Security: max-age=16000000; includeSubDomains; preload; (max-age=16000000)
- ✗Content-Security-Policy presente e não trivialmente permissivaContent-Security-Policy AUSENTE
- ✗Proteção contra clickjacking (X-Frame-Options ou frame-ancestors)X-Frame-Options: ∅; CSP frame-ancestors: false
- ✗Subresource Integrity (SRI) em scripts de terceirosterceiros sem SRI: cdnjs.cloudflare.com, www.googletagmanager.com, d335luupugsy2.cloudfront.net, ajax.googleapis.com, www.youtube.com · com SRI: 0
- ✗X-Content-Type-Options nosniff presenteX-Content-Type-Options: AUSENTE
- ✗Referrer-Policy restritivo definidoReferrer-Policy: AUSENTE
- ✗Permissions-Policy restringe APIs sensíveis do browserPermissions-Policy: AUSENTE
- ✗Isolamento cross-origin (COOP/COEP/CORP) configuradosem COOP/COEP/CORP — isolamento cross-origin ausente
Retenção
não medidoNenhuma verificação desta etapa pôde ser medida só com dados públicos.
Correções ao alcance
Verificações reprovadas que o time de implementação resolve sem depender do cliente ou de terceiros, em ordem de severidade. Cada título descreve o estado esperado que hoje não é atendido.
- Crítico✗ Crawlers verificados legítimos (Bing/IA) alcançam o site (não 403 no WAF)WAF devolve gptbot=403, oai-searchbot=403, claudebot=403, ccbot=403 enquanto Googlebot=200 — Bing + AI search cegos ao site
- Crítico✗ AI bots permitidos no robots.txt não são bloqueados na camada CDN/WAFrobots.txt permite mas CDN/WAF bloqueia: GPTBot=403, OAI-SearchBot=403, ClaudeBot=403, CCBot=403 enquanto browser=200 — site invisível a esses engines apesar do robots.txt limpo. método: GET com UA spoofado (IP não-oficial) — 4xx/challenge ao UA prova bloqueio por UA-string, o mesmo mecanismo que cega o bot real; WAFs que validam IP podem divergir
- Crítico✗ Domínio apex redireciona para o host www canônicohttps://empresas.mor.com.br/ serve 200 em paralelo com www (host duplicado dilui canônico)
- Crítico✗ Dados estruturados de produto não divergem entre HTML cru e DOMProduct JSON-LD AUSENTE no HTML cru em 1/1 PDPs (https://empresas.mor.com.br/produto/banqueta-527) — agentes que leem o cru (todos exceto Google) não veem o produto
- Atenção✗ WAF presente sem bloquear bots legítimos (Googlebot etc.)UA×path (GET /): browser=200 googlebot=200 bingbot=200 gptbot=403 oai-searchbot=403 chatgpt-user=200 claudebot=403 claude-searchbot=200 claude-user=200 perplexitybot=200 perplexity-user=200 ccbot=403 meta-externalagent=200 — WAF bloqueia gptbot/oai-searchbot/claudebot/ccbot
- Atenção✗ Acesso de AI crawlers é governado intencionalmente no robots.txtrobots.txt sem NENHUMA diretiva para AI crawlers (GPTBot, OAI-SearchBot, ChatGPT-User, ClaudeBot, Claude-SearchBot, Claude-User, PerplexityBot, Perplexity-User, Google-Extended, CCBot, meta-externalagent, Amazonbot, Applebot-Extended, Bytespider) — acesso de IA não governado (default-allow acidental)
- Atenção✗ Headers de cache/CDN corretos por tipo de páginahome Cache-Control: no-cache; cf-cache-status: ∅
- Atenção✗ HSTS com max-age >= 1 ano, includeSubDomains e preloadStrict-Transport-Security: max-age=16000000; includeSubDomains; preload; (max-age=16000000)
Próximo passo
Isto é só a parte pública.
Este relatório usou apenas o que qualquer visitante consegue observar de fora: páginas públicas, dados estruturados, sinais de crawler e testes de navegador. O diagnóstico completo conecta GA4, Search Console e a plataforma da loja para medir o funil real, achar onde a receita escapa e dimensionar cada correção em reais.
Falar com a deco.cx