Voltar as noticias
Como Tornar Seu Site Legível para Agentes: 4 Camadas, Um Trabalhador
WebMCPAltaEN

Como Tornar Seu Site Legível para Agentes: 4 Camadas, Um Trabalhador

Dev.to - MCP·7 de agosto de 2026

TL;DR

Para tornar seu site legível por agentes, você precisa de quatro camadas — legível, descobrível, chamável, pagável — e três delas são arquivos que você gera no momento da construção, não código que é executado por solicitação. Um gêmeo em Markdown de cada página é 94% menor que o HTML deste site (13.698 bytes contra 227.990), um conjunto de links /.well-known/api-catalog torna esses gêmeos encontráveis, e apenas a camada chamável precisa de um servidor. Se você errar essa última parte, você também conta cada visualização de página humana, que é como este site uma vez ganhou um erro Cloudflare 1027.

O que é um site legível por agentes?

Um site legível por agentes é aquele que publica uma cópia voltada para máquinas de seu conteúdo e um índice legível por máquinas dessa cópia, em seus próprios URLs, para que um agente nunca precise analisar HTML para usá-lo. Essa é toda a definição. É uma propriedade do seu espaço de URL, não do seu servidor — é por isso que quase tudo pode ser pré-renderizado.

O post da Cloudflare sobre a internet agentic de 6 de agosto de 2026 divide o problema em quatro camadas. É um documento de visão, então nomeia produtos mais do que caminhos. Reduzido à implementação, as camadas são:

Camada A pergunta que responde O que é no disco
Legível Um agente pode consumir esta página sem analisar HTML? Um gêmeo .md de cada página
Descobrir Um agente pode encontrar o que existe antes de buscá-lo? /llms.txt, /.well-known/api-catalog
Chamável Um agente pode fazer algo, não apenas ler? Um endpoint MCP, ou ferramentas WebMCP em página
Pagável O agente pode compensá-lo pela busca? x402, slots de anúncios voltados para agentes

A ordem importa. Cada camada só vale a pena construir se a camada acima existir — um endpoint chamável que nenhum agente pode descobrir é uma URL que ninguém digita, e uma camada pagável em conteúdo que nenhum agente pode ler é um pedágio em uma estrada fechada.

Camada 1: Legível significa um gêmeo em Markdown, não um redirecionamento

A especificação llms.txt que Jeremy Howard publicou em 3 de setembro de 2024 contém toda a ideia em uma linha: sirva uma versão limpa em Markdown de uma página no mesmo URL com .md anexado. Essa é a camada legível. Tudo o mais é elaboração.

A razão para se preocupar é bytes. Eu medi uma postagem neste site de três maneiras:

URL Bytes
/blog/how-to-write-claude-md (HTML) 227.990
/blog/how-to-write-claude-md.md 19.149
/clean/blog/how-to-write-claude-md.md 13.698

O Markdown limpo é 94% menor que o HTML — um fator de 16,6. Essa diferença não é compressão, é exclusão: CSS embutido, a carga do framework, o cabeçalho e o rodapé, três blocos JSON-LD e o alternador de tema. Tudo isso é essencial para um humano e peso morto para um modelo com uma janela de contexto a preencher.

Gráfico de barras comparando três representações da mesma postagem de blog: HTML com 227.990 bytes, o gêmeo em Markdown com 19.149 bytes e o Markdown limpo com 13.698 bytes — 94% menor que o HTML

Dois detalhes de implementação são fáceis de errar.

Dê ao Markdown seu próprio URL. Não faça ramificações em User-Agent na borda para decidir o que servir. Isso é disfarce no sentido de mecanismo de busca, e também força cada visualização de página a passar por uma rota dinâmica — veja a seção de roteamento abaixo para o que isso custa. /blog/post.md como um documento separado e publicamente buscável não é disfarce; é publicar dois arquivos.

Gere-o no momento da construção. O gêmeo em Markdown é uma função pura da fonte que você já tem. Renderizá-lo sob demanda não lhe dá nada e custa uma solicitação. A divisão em duas URLs também lhe dá um lugar limpo para colocar a versão honesta: este site mantém uma cópia não patrocinada de cada postagem em /clean/blog/<slug>.md precisamente para que o documento voltado para máquinas permaneça auditável — a razão está na análise dos anúncios de agentes da TIME.

Camada 2: Onde vivem os padrões reais

Legível é uma convenção. Descobrir tem especificações reais, e usá-las não custa nada.

/llms.txt é o índice escrito por humanos: um H1, um bloco de citação resumido e listas delimitadas por H2 de links com descrições de uma linha. Pense nisso como um sitemap escrito para algo que lê prosa. A variante /llms-full.txt que a maioria dos sites também envia — todo o corpus concatenado — é uma convenção da comunidade, não parte da especificação. Envie ambos; eles atendem a diferentes orçamentos de contexto.

/.well-known/api-catalog é o padrão. RFC 9727, publicado em junho de 2025, define-o como um URI bem conhecido que retorna application/linkset+json — uma lista legível por máquinas de cada API e superfície de documento que você publica, cada uma com uma relação de link e tipo de mídia. É a diferença entre um agente adivinhando cinco caminhos bem conhecidos e lendo um documento que os nomeia todos.

O conjunto completo de descoberta neste site é nove arquivos estáticos:

/llms.txt                              text/plain
/llms-full.txt                         text/plain
/.well-known/api-catalog               application/linkset+json   (RFC 9727)
/.well-known/mcp                       application/json
/.well-known/mcp/server-card.json      application/json           (SEP-1649)
/.well-known/agent-skills/index.json   application/json
/.well-known/oauth-protected-resource  application/json           (RFC 9728)
/auth.md                               text/markdown
/.well-known/security.txt              text/plain

Cada um deles é pré-renderizado. Nenhum deles precisa de um servidor.

Um ponto de honestidade vale mais aqui do que um fluxo de autenticação fabricado: /.well-known/oauth-protected-resource neste site declara que /mcp é público e não requer autenticação, e o documento do servidor de autorização não anuncia nenhum endpoint de token porque nenhum existe. Publicar metadados OAuth que descrevem um servidor de autenticação que você não construiu é pior do que não publicar nada — isso envia agentes para um handshake que nunca será concluído.

Camada 3: Por que chamável é a única camada que precisa de um servidor

Um endpoint MCP é onde "legível por agentes" se transforma em "utilizável por agentes". Este site expõe quatro ferramentas sobre JSON-RPC em /mcp:

curl -s -X POST https://
Contexto Triplo Up

A implementação de um site legível para agentes pode transformar a forma como as empresas brasileiras interagem com tecnologias de IA. Com a adoção dessas práticas, as empresas podem melhorar a visibilidade e a eficiência de suas plataformas, facilitando a automação e a integração com agentes de IA.

Noticias relacionadas

Gostou do conteudo?

Receba toda semana as principais novidades sobre WebMCP.