> For the complete documentation index, see [llms.txt](https://help.impact.com/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://help.impact.com/other/pt-br/reference-documentation/website-crawling-governance-impactcindagent-explained.md).

# Governança de rastreamento de sites: explicação do ImpactCINDAgent

Este artigo explica como identificar, verificar e controlar o ImpactCINDAgent.

O ImpactCINDAgent é um web crawler operado pela impact.com e usado para verificar se as páginas em sites de parceiros e marcas usam corretamente o rastreamento da impact.com e cumprem os acordos da marca.

Se o seu site participa de um programa de parceria da impact.com, o ImpactCINDAgent busca páginas periodicamente para:

* **Verificar o rastreamento**: Garantir que os links e tags de rastreamento estejam instalados corretamente e funcionando.
* **Revisar a conformidade**: Verificar se o conteúdo da página está consistente com os acordos de brand safety e conformidade publicados.
* **Relatar**: Extrair metadados não pessoais (títulos, URLs canônicas, imagens de produtos, SKUs) para viabilizar relatórios para parceiros.
* **Descobrir**: Realizar crawls mais amplos para descobrir conteúdo que promove marcas cadastradas na impact.com em domínios ainda não registrados na plataforma.

### Identificar o ImpactCINDAgent

O ImpactCINDAgent se identifica por meio de uma string específica de User-Agent.

```
String completa do User-Agent: Mozilla/5.0 (compatível; ImpactCINDAgent) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/129.0.0.0 Safari/537.36
```

{% hint style="success" %}
**Observação**: O segmento da versão do Chrome é atualizado conforme o navegador subjacente é atualizado. Para identificar o bot com confiabilidade, corresponda à substring ImpactCINDAgent.
{% endhint %}

### Verificar uma solicitação

Se você precisar confirmar que uma solicitação realmente veio da impact.com (e não é um User-Agent falsificado), use um dos métodos a seguir, listados do menos ao mais confiável:

#### Método 1: verificação de intervalo de IP (alta confiança)

Confirme se o IP de origem da solicitação está dentro destes intervalos controlados pela impact.com:

**Intervalos CIDR**:

* `163.116.128.0/17`
* `162.10.0.0/17`
* `31.186.239.0/24`
* `8.39.144.0/24`
* `8.36.116.0/24`

**Endereços individuais**: `34.145.188.137`, `35.245.212.57`, `34.21.56.213`, `34.48.90.233`, `35.245.229.167`, `34.150.151.151`, `35.245.185.65`, `35.188.242.212`, `34.86.33.122`, `34.145.224.193`, `35.245.135.218`, `35.221.1.178`, `34.150.217.77`, `107.175.80.80`, `162.212.175.22`, `107.172.69.119`

#### Método 2: verificação de assinatura (mais alta confiança)

Toda solicitação do ImpactCINDAgent é assinada criptograficamente (conforme [RFC 9421](https://www.rfc-editor.org/rfc/rfc9421)). Você pode verificar as assinaturas com base em nosso [diretório de chaves públicas](https://cind-crawler.impact.com/.well-known/http-message-signatures-directory). Esta implementação é executada na [especificação web-bot-auth](https://thibmeu.github.io/http-message-signatures-directory/draft-meunier-web-bot-auth-architecture.html) que se baseia na *RFC 9421* especificação.

**Comportamento esperado:**

* **Navegação sem interface**: O ImpactCINDAgent usa um navegador real sem interface. Ele emite uma solicitação `GET` , renderiza a página, executa JavaScript e busca sub-recursos (CSS/JS) para ver a página exatamente como um usuário veria.
* **Capturas de tela**: Ele pode capturar uma captura de tela para revisão interna de conformidade. Elas nunca são públicas.
* **Redirecionamentos**: Ele segue redirecionamentos, inclusive entre origens diferentes.
* **Nenhuma ação destrutiva**: Ele não envia formulários, ignora CAPTCHAs/paywalls nem realiza `POST`/`DELETE` solicitações.

### Controlar o acesso

O ImpactCINDAgent respeita `robots.txt` diretivas direcionadas especificamente ao ImpactCINDAgent ou ao curinga `*`.

#### Bloquear totalmente

```
User-agent: ImpactCINDAgent
Disallow: /
```

#### Definir uma taxa de crawl

Se o crawler estiver afetando o desempenho do seu site, use a diretiva `Crawl-delay` .

```
User-agent: ImpactCINDAgent
Crawl-delay: 10
```

#### Limites de taxa e back-off

O ImpactCINDAgent reduz automaticamente sua taxa de solicitações se o seu servidor retornar:

* HTTP 429 (Muitas solicitações)
* HTTP 503 (Serviço indisponível)
* Ele também respeita o cabeçalho `Retry-After` se fornecido.

{% hint style="danger" %}
**Importante**: Se o seu site participa de um programa da impact.com, bloquear este crawler pode nos impedir de verificar seu rastreamento ou conformidade, o que pode afetar a situação do seu programa. Recomendamos usar `Crawl-delay` em vez de um bloqueio total.
{% endhint %}


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://help.impact.com/other/pt-br/reference-documentation/website-crawling-governance-impactcindagent-explained.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
