Skip to main content
Agência Digital Tayo

O que é SEO semântico e por que ele importa para o Google

SEO semântico é o trabalho de fazer uma página ser reconhecida como sendo sobre um assunto, e não como um texto que repete uma palavra. A diferença está no alvo: em vez de casar o termo digitado com o termo escrito na página, o buscador tenta identificar a coisa sobre a qual a pessoa perguntou, com os atributos e as relações que essa coisa tem no mundo, e só então decidir quais páginas falam dela com competência.

Para quem decide onde investir em conteúdo numa pequena ou média empresa, essa troca de alvo muda quatro decisões concretas:

  • O que se escolhe antes de escrever. O ponto de partida deixa de ser uma lista de termos e passa a ser o assunto que a empresa quer ocupar, com tudo o que ele exige explicar.
  • Como o conteúdo é dividido em páginas. Um assunto por endereço, em vez de uma variação de termo por endereço.
  • O que é dito ao buscador de forma explícita. Dados estruturados deixam de ser detalhe técnico e passam a declarar de que assunto a página trata.
  • Como o resultado é conferido. A pergunta deixa de ser apenas em que posição o site está e passa a incluir se o buscador entendeu de que a página trata.

As quatro mudanças têm uma raiz só, e ela não está no site de ninguém: está no que o buscador passou a procurar quando recebe uma pergunta. Enquanto essa raiz não fica clara, cada decisão sobre conteúdo continua sendo tomada com a régua antiga, e é por ela que vale começar.

Por que um texto com a palavra certa perde para um que nem repete ela

O buscador avalia se a página cobre o assunto pesquisado, e não quantas vezes ela repete a palavra pesquisada. Na página em que explica como classifica os resultados, o Google afirma que “when you search for ‘dogs,’ you likely don’t want a page with the word ‘dogs’ on it hundreds of times”, ou seja, quem pesquisa “cachorros” provavelmente não quer uma página com a palavra “cachorros” repetida centenas de vezes. E completa dizendo que, com isso em mente, os algoritmos avaliam se a página contém outro conteúdo relevante além daquela palavra, como imagens de cachorros, vídeos ou uma lista de raças.

Considere duas páginas de empresas que vendem o mesmo serviço. A primeira escreve o nome do serviço dezenas de vezes, em títulos, legendas e rodapé, e não diz nada além disso. A segunda escreve o nome do serviço poucas vezes e traz o que o comprador precisa saber para decidir:

  1. O que o serviço entrega, com o resultado descrito em termos que o cliente reconhece.
  2. Quanto custa, com faixa de preço e o que faz o valor variar.
  3. Quanto tempo leva, do primeiro contato até o serviço executado.
  4. O que a empresa precisa do cliente para começar, como acesso, documento ou informação.
  5. Quem já contratou, com o caso descrito e o problema que foi resolvido.
  6. O que o serviço não faz, para o comprador errado desistir antes de pedir orçamento.

A segunda página é a que responde a pergunta inteira, e é por isso que ela ganha uma disputa que, pela régua da repetição, ela deveria perder. Os seis itens não são conteúdo extra colocado por capricho: cada um deles é uma dúvida que o comprador tem antes de decidir, e uma página que deixa as seis em aberto devolve a pessoa para a busca. Para o dono de uma PME, a leitura prática é direta: a página não perde por falta de palavra, perde por falta de assunto.

O que o buscador procura quando já não procura a sua palavra

O buscador procura a coisa de que a pergunta trata, com as relações que ela tem com outras. No dia em que anunciou o Knowledge Graph, em 16 de maio de 2012, o Google descreveu o que estava construindo como um modelo que “understands real-world entities and their relationships to one another: things, not strings”, isto é, um modelo que entende coisas do mundo real e as relações entre elas, coisas e não sequências de caracteres.

Essa coisa do mundo real é o que em SEO se chama de entidade: um serviço, uma cidade, uma profissão, uma marca, um conceito. A busca semântica é o nome do comportamento do buscador que trabalha com essas unidades em vez de trabalhar com o texto digitado. Três consequências saem daí, e todas aparecem no dia a dia de quem publica:

  • Duas palavras diferentes podem apontar para a mesma coisa, e o sistema de sinônimos do Google acha documentos relevantes mesmo quando eles não contêm as palavras exatas da pesquisa.
  • A mesma palavra pode apontar para coisas diferentes, e quem escreve precisa deixar claro, no próprio texto, de qual delas a página fala.
  • Uma coisa carrega o que se sabe sobre ela, então uma página que fala do assunto sem tocar no que ele obrigatoriamente envolve fica incompleta para quem chegou procurando aquilo.

As três juntas explicam por que a lista de termos parou de ser um bom mapa de conteúdo. Uma lista de termos trata cada linha como um destino separado, quando várias delas são a mesma coisa dita de outro jeito, e ao mesmo tempo deixa de fora tudo o que o assunto exige e que ninguém digita na busca. O que substitui a lista não é uma lista maior: é o assunto tratado como uma coisa que tem partes, e cada parte no lugar certo.

Isso vale para qualquer assunto, ou só para marcas conhecidas?

A busca semântica vale para qualquer assunto, e o que muda entre um assunto conhecido e um assunto de nicho é o tanto que o buscador já sabe antes de a sua página existir. Sobre uma cidade grande ou uma profissão regulamentada, existe informação pública farta, concordante e repetida em várias fontes. Sobre um serviço específico de um setor pequeno, existe pouca, e uma parte dela está nos sites das próprias empresas que fazem esse serviço.

Para uma PME, isso é menos um obstáculo e mais uma descrição honesta do ponto de partida. Onde há pouca informação pública sobre um assunto, a página que o explica bem tem menos concorrência de referência, e a mesma escassez que dificulta o reconhecimento também reduz o número de fontes disputando aquele lugar. O que não existe é atalho pelo tamanho da marca: o reconhecimento vem de haver material coerente sobre o assunto em vários lugares, e não de a empresa ser famosa.

Qual a diferença entre otimizar para palavra-chave e otimizar para entidade

Otimizar para palavra-chave organiza o site em torno do texto que a pessoa digita, e otimizar para entidade organiza o site em torno da coisa sobre a qual ela está perguntando. A diferença não é de vocabulário: ela muda quantas páginas o site tem, o que cada uma promete e o que se considera sucesso.

O exemplo que o próprio buscador usa mostra o tamanho do problema da régua antiga. Segundo o Google, alguém pode ter pesquisado “change laptop brightness” enquanto o fabricante escreveu “adjust laptop brightness”, e os sistemas entendem que as palavras e a intenção estão relacionadas. Duas redações, nenhuma palavra em comum na parte que importa, e a mesma coisa sendo tratada. Pela régua da palavra-chave, a página do fabricante estaria errada e deveria ser reescrita para casar com o termo digitado. Pela régua da entidade, ela está certa, e o trabalho é outro.

Otimização por palavra-chaveOtimização por entidade
Unidade de trabalhoo termo digitadoa coisa sobre a qual se pergunta
Como o site cresceuma página por variação de termouma página por assunto, com as variações dentro dela
O que a página precisa tero termo nos lugares certos, na quantidade certao assunto coberto, com atributos, relações e prova
Como se evita a disputa internaescolhendo termos diferentes para páginas parecidasdefinindo qual página é dona de qual assunto
Sinal de que deu certoa posição para aquele termoo site ser reconhecido como fonte daquele assunto, e aparecer para perguntas que ninguém previu
Onde falhao assunto fica picado em páginas quase iguaisexige decidir a fronteira entre assuntos, o que dá mais trabalho no começo

A linha que mais muda o dia a dia é a segunda. Um site montado por variação de termo cresce rápido e fica frágil, porque várias páginas passam a prometer quase a mesma coisa e nenhuma delas fica completa. Um site montado por assunto cresce mais devagar e concentra força, porque cada endereço tem um dono declarado. Toda pauta nova passa por uma pergunta antes de entrar no calendário: essa pauta é um assunto novo, ou é outra maneira de dizer um assunto que o site já tem? Se for a segunda, o lugar dela é dentro da página que já existe. Essa troca de unidade é a parte do SEO que mais reorganiza um site por dentro sem que nada mude por fora.

Palavra-chave deixou de importar?

Não. A palavra-chave deixou de ser condição, e continua sendo sinal. O Google diz, na mesma página em que explica a classificação, que “the most basic signal that information is relevant is when content contains the same keywords as your search query”, ou seja, o sinal mais básico de relevância continua sendo o conteúdo conter as mesmas palavras da pesquisa.

O que mudou é que a ausência da palavra exata deixou de eliminar a página. O sistema de sinônimos, que o Google descreve como o que permite encontrar documentos relevantes mesmo quando eles não contêm as palavras exatas usadas na pesquisa, é o que torna possível uma página vencer sem repetir o termo. Na prática isso libera a escrita de uma obrigação antiga, sem autorizar o extremo oposto: chamar o serviço pelo nome que o cliente usa é útil para o leitor e para o buscador, e trocar todo termo por sinônimo para parecer sofisticado só dificulta a leitura de quem chegou procurando aquilo.

O que mudou no buscador para que isso deixasse de ser opcional

O buscador passou a manter uma base própria sobre coisas do mundo, e não apenas um índice de páginas. O marco público dessa mudança é o Knowledge Graph, anunciado pelo Google em 16 de maio de 2012 e apresentado na ocasião como “a critical first step towards building the next generation of search”, um primeiro passo decisivo para construir a geração seguinte de busca, que aproveita a inteligência coletiva da web e entende o mundo um pouco mais como as pessoas entendem.

A partir dali passou a existir, sobre cada assunto, um registro que não depende de nenhuma página específica. Para quem publica, a consequência é direta e nova: um texto pode estar bem escrito, bem apresentado e correto em português, e ainda assim não conversar com nada do que já está estabelecido sobre o tema que ele trata.

Para o dono de um site, três exigências deixaram de ser opcionais por causa disso:

  1. Ser identificável. A página precisa deixar claro de que assunto ela trata, com o nome que esse assunto tem, e não apenas com o termo que dá audiência.
  2. Ser consistente. O que a empresa diz sobre si no site precisa bater com o que aparece sobre ela em outros lugares, porque as duas versões são lidas juntas.
  3. Ser completo o bastante. Um assunto tratado pela metade compete com fontes que o tratam inteiro, e a diferença não se resolve com mais repetição do termo.

Nenhum dos três é trabalho de redação apenas, e é aí que a conta não fecha para quem trata conteúdo como produção de texto. Identificação e consistência são decisões de arquitetura, tomadas antes da primeira linha ser escrita, e completude é uma decisão de escopo, tomada quando se define o que a página promete responder. A régua da palavra-chave não pedia nenhuma das três, e é por isso que ela parecia funcionar com menos esforço.

O que o Google já guarda sobre um assunto antes de você publicar qualquer coisa

O Google já guarda as coisas que existem dentro de um assunto, os atributos delas e as relações entre elas, numa base própria chamada Knowledge Graph, que existia antes de o seu site existir. No anúncio de 16 de maio de 2012, o Google dizia que essa base continha, naquela data, mais de 500 milhões de objetos e mais de 3,5 bilhões de fatos sobre esses objetos e sobre as relações entre eles.

Os dois números são de 2012 e servem para uma finalidade só: mostrar que a base já nasceu grande. Ninguém de fora sabe o tamanho dela hoje, e quem apresenta esses números no presente está citando um comunicado de mais de uma década atrás como se fosse a medida de agora. O que continua valendo do anúncio não é a contagem, é a natureza do que foi construído.

Para quem publica, essa base muda o ponto de partida de forma concreta:

  • A sua página não chega a uma tela em branco. O assunto já chega com nomes estabelecidos, atributos conhecidos e relações registradas, vindos de outros lugares.
  • A sua página entra num assunto que já tem versão estabelecida. Escrever contra o que já está consolidado exige explicar o porquê dentro da própria página.
  • A sua página não precisa ensinar tudo de novo. Ela precisa ocupar um lugar definido dentro do que já existe.

A diferença entre publicar contra uma tela em branco e publicar contra uma base existente aparece na hora de decidir o que escrever. Contra a tela em branco, a régua é o que a concorrência publicou. Contra a base, a régua é o que o assunto exige ter, incluindo o que nenhum concorrente escreveu ainda. É essa segunda régua que faz um site pequeno conseguir ser referência de um assunto estreito sem ter tamanho para disputar um assunto largo.

De onde vem o que o Google já sabe sobre o meu setor?

Vem de fontes públicas, e também de material que o Google reúne por conta própria. No anúncio de 2012, o Google afirmou que o Knowledge Graph “isn’t just rooted in public sources such as Freebase, Wikipedia and the CIA World Factbook”, ou seja, que ele não está enraizado apenas em fontes públicas como o Freebase, a Wikipedia e o CIA World Factbook, e acrescentou que a base é ampliada em escala muito maior.

Para um setor com muita literatura pública, isso quer dizer que as definições, os nomes e as classificações do setor já estão consolidados em algum lugar, e que o seu site entra numa conversa que já começou. Para um setor estreito, com pouca cobertura pública, quer dizer o contrário: a conversa é curta, uma parte do que existe foi escrita por quem vende aquilo, e quem escrever com precisão passa a ser parte da referência.

O que ninguém de fora consegue fazer é inspecionar essa base e ver o que está registrado sobre o próprio negócio. O caminho que sobra é indireto, e é o mesmo há anos: olhar o que aparece na busca sobre o assunto, quais nomes o buscador usa para se referir às coisas, quais perguntas ele oferece como relacionadas, e usar isso como leitura do que já está estabelecido. É uma leitura aproximada, e vale tratá-la assim.

Por que o buscador guarda relação entre coisas, e não só o nome delas

Porque o nome sozinho não identifica a coisa, e a relação identifica. Foi isso que o Google descreveu ao apresentar o Knowledge Graph como um modelo de coisas do mundo real e das relações que elas têm umas com as outras. Guardar “pilates” como texto não diz nada. Guardar que pilates é uma modalidade de exercício, praticada em estúdio, ligada a reabilitação, com aparelhos próprios e com profissionais de educação física e fisioterapia, diz tudo o que separa uma página útil de uma página vazia sobre pilates.

Um assunto, do ponto de vista de quem organiza informação, tem três camadas, e cada uma faz um trabalho diferente:

  1. A coisa em si, que é o serviço, o produto, o lugar, a profissão ou o conceito de que a página trata.
  2. Os atributos da coisa, que são as características que ela tem, como preço, duração, requisitos, público, materiais e limitações.
  3. As relações da coisa, que são os laços com outras coisas: o que ela exige antes, o que ela possibilita depois, com o que é confundida, o que compete com ela e quem a executa.

A terceira camada é a que dá mais trabalho para escrever, e é a que mais separa um texto raso de um texto competente. Uma página que descreve o serviço e lista as características cobre as duas primeiras e para ali. Uma página que também diz o que precisa estar pronto antes, o que costuma ser confundido com aquele serviço e em que situação ele não é a escolha certa cobre a terceira, e é a única das duas que responde as perguntas que o comprador faz quando está decidindo, e não quando está pesquisando preço.

Como o buscador decide que duas fontes falam da mesma coisa

Pela companhia que o nome tem nos dois lugares. Um nome isolado é ambíguo em qualquer idioma, e o que desfaz a ambiguidade são as ligações daquele nome com outras coisas já conhecidas. É o que o Google diz manter no Knowledge Graph ao lado das próprias coisas: as relações entre elas. Os termos que aparecem em volta do nome e os atributos citados entram na mesma conta, e essa parte é leitura deste texto, não do anúncio.

O mecanismo exato não é publicado, e a forma útil de enxergar isso é como uma comparação de vizinhança: duas páginas falam da mesma coisa quando o que cerca o nome nas duas aponta para a mesma coisa. Do lado de quem escreve, isso tem uma consequência prática imediata. O trabalho não é repetir o nome mais vezes, é cercar o nome com o que ele exige ter por perto.

  • Cerque com atributos. Preço, duração, requisito, público e limitação são o que separa um serviço de outro parecido.
  • Cerque com relações. O que vem antes, o que vem depois e com o que é confundido situam o serviço dentro do assunto.
  • Cerque com o vocabulário estabelecido. Os nomes técnicos, os nomes populares e as siglas que o setor usa para aquilo.
  • Cerque com referências já conhecidas. Cidade, profissão regulamentada, norma, fabricante e material funcionam como pontos de apoio já registrados.

Os quatro itens descrevem o mesmo movimento em quatro direções, e é um movimento que não tem nada a ver com densidade de termo. Uma página de 300 palavras que traz atributo, relação, vocabulário e apoio é mais identificável do que uma de 2.000 palavras que só varia a forma de escrever o nome do serviço. Para quem escreve, a pergunta que substitui “quantas vezes eu repito o termo” é outra: se alguém apagasse o nome do serviço da página inteira, daria para descobrir de qual serviço ela fala?

O que acontece quando o nome do seu serviço é ambíguo?

Quando o nome do serviço é ambíguo, a página precisa dizer de qual das coisas ela fala, porque o nome sozinho não resolve. A palavra “academia” mostra o problema em um exemplo só: ela nomeia o lugar onde se treina musculação e também o meio científico, como em academia de letras ou produção acadêmica. São duas coisas diferentes, com o mesmo nome, e nenhuma quantidade de repetição resolve, porque repetir a palavra ambígua produz mais ambiguidade.

O que resolve é a vizinhança. Uma página sobre a primeira traz matrícula, plano mensal, aparelhos, aula coletiva, avaliação física, horário de pico e professor de educação física. Uma página sobre a segunda traz pesquisa, publicação, revisão por pares, orientador e instituição de ensino. As duas usam a mesma palavra, e nenhum leitor humano se confunde por um segundo, porque o contexto resolve antes de a dúvida se formar.

Existe uma ambiguidade mais próxima do dia a dia de uma PME do que a da palavra academia, e ela vem do jeito interno de nomear serviços. Nomes de pacote, nomes de linha de produto e apelidos criados pela empresa são ambíguos por natureza, porque só existem dentro dela. Uma página que anuncia “Plano Essencial” sem dizer, em texto, o que o plano inclui, para quem serve e quanto custa está pedindo ao buscador que adivinhe a coisa a partir de um nome que ele nunca viu.

Como o buscador liga o seu conteúdo a uma entidade que ele já conhece

Pelo que a sua página dá a ele para trabalhar: o nome que você usa, o contexto em volta desse nome e a concordância entre o que a sua página afirma e o que outras fontes dizem da mesma coisa. O Google não publica como essa ligação é feita, e esses três materiais são a forma como este texto organiza o que está sob controle de quem escreve, não uma descrição do procedimento dele.

O que quebra essa ponte, num site de PME, é menos exótico do que parece:

O que quebraComo aparece na páginaO que fazer no lugar
Nome inventado sem tradução”Solução Integrada 360” como título da página de serviçousar o nome que o mercado usa, e deixar o nome comercial como subtítulo
Serviço descrito só por benefício”mais tranquilidade para a sua família”dizer qual é o serviço, o que ele inclui e o que ele não inclui
Assunto tratado por metáfora”cuidamos do seu sorriso” sem nomear o procedimentonomear o procedimento com o termo técnico e o popular
Página sem nenhuma referência conhecida por pertotexto genérico que serviria para qualquer setorcitar cidade, norma, profissão, material ou fabricante que ancoram o assunto
O mesmo assunto com nome diferente em cada página”consultoria”, “assessoria” e “acompanhamento” para a mesma coisaescolher um nome principal e usar os outros dentro do texto, como sinônimo explícito

A última linha é a que parece detalhe de estilo e não é. Quando a mesma coisa muda de nome a cada página, quem lê precisa decidir se aquilo é um serviço ou três, e essa decisão pode sair do jeito errado. Padronizar o nome é barato e vem antes de qualquer trabalho mais sofisticado: abrir as páginas do próprio site lado a lado e conferir se o serviço se chama do mesmo jeito em todas elas.

Que parte desse grafo está do seu lado da mesa

A parte que você publica e declara: as páginas do seu site, o que cada uma afirma, e as ligações que você cria entre elas. Essa malha é o Knowledge Graph próprio, e é a única parte dessa história que está inteiramente sob controle de quem tem o site.

O que está do seu lado da mesa, item por item:

  • Quais assuntos o seu site cobre, e quais ele decide não cobrir.
  • Qual página é dona de qual assunto, e o que cada uma promete responder.
  • Quais ligações existem entre as suas páginas, que é como você diz que dois assuntos seus se relacionam.
  • O que cada página afirma explicitamente sobre o assunto de que trata.

O que não está do seu lado é igualmente importante de saber, porque evita expectativa errada: o que a base do Google guarda sobre o seu setor, o que outras fontes dizem da sua empresa e como o buscador pondera tudo isso continuam fora do seu alcance direto. A parte controlável é pequena em extensão e grande em efeito, e a razão é simples: ela é a única fonte que fala do seu negócio com conhecimento de causa e com você decidindo cada palavra.

O Google precisa de uma página só para cada assunto?

Cada assunto precisa de um endereço que seja o dono dele, e não de uma página só no sentido de nunca mais tocar naquilo. Outras páginas do site podem e devem mencionar o assunto, sempre apontando para o endereço dono. O nome dessa página de referência é entity home, e o critério para escolhê-la é a promessa: dona é a que se compromete a responder o assunto inteiro.

A diferença entre mencionar e ser dono é o que organiza um site por dentro. Uma página de serviço pode citar um conceito em dois parágrafos sem prometer explicá-lo. Um artigo pode explicar o conceito inteiro e não vender nada. As duas convivem bem quando a segunda é reconhecidamente a dona e a primeira aponta para ela. Elas se atrapalham quando as duas prometem a mesma explicação.

O sintoma de que o seu site dividiu o mesmo assunto em duas páginas

O sintoma é a mesma pesquisa trazendo ora uma página sua, ora outra, sem nenhuma das duas firmar posição. No relatório de desempenho do Search Console, ele aparece de um jeito específico: uma consulta com impressões distribuídas entre duas URLs do seu site, cada uma com poucos cliques, em vez de uma URL concentrando o resultado.

Outros três sinais apontam para o mesmo problema, e todos são observáveis sem ferramenta paga:

  1. Você mesmo hesita ao mandar o link. Quando um cliente pergunta sobre o assunto e você precisa pensar em qual das duas páginas mandar, o site já dividiu o assunto.
  2. Os títulos das duas páginas só diferem na ordem das palavras. Se um humano precisa ler os dois textos para saber a diferença, a diferença não existe.
  3. As duas páginas linkam para os mesmos lugares e recebem link dos mesmos lugares. Páginas com a mesma vizinhança interna ocupam o mesmo papel dentro da estrutura do site.

Reconhecer o sintoma é uma coisa, decidir o que fazer é outra, e as duas não se resolvem no mesmo momento. Juntar, manter separadas com escopos redesenhados ou transformar uma em seção da outra são caminhos diferentes, com custos diferentes, e a escolha depende de critérios que merecem ser tratados por si. O que este bloco entrega é o diagnóstico: se a mesma consulta puxa duas URLs suas e nenhuma se firma, o problema não é falta de otimização em nenhuma das duas, é que elas disputam o mesmo lugar. Saber quais entidades merecem página própria é o passo seguinte, e é uma decisão de arquitetura, não de redação.

Por que citar um assunto de passagem não faz a página ser sobre ele

Uma página é sobre aquilo que ela se compromete a responder inteiro, e uma menção de passagem não assume compromisso nenhum. Um parágrafo que cita um assunto informa o leitor, e é útil que informe, mas não coloca a página como candidata a responder quem procura aquele assunto, porque não há ali resposta nenhuma para procurar.

A medida de quanto um assunto é central num texto tem nome, salience score, e o efeito dela é fácil de testar sem ferramenta nenhuma. Apague da página todos os trechos que falam do assunto em questão. Se o que sobrar continuar cumprindo o título da página, o assunto era passagem. Se o que sobrar virar um texto capenga, o assunto era o centro.

O teste tem uma versão comercial, que é a mais útil para quem decide pauta:

  • Um parágrafo que cita o assunto serve para situar o leitor e apontar para onde ele encontra a resposta completa.
  • Uma seção sobre o assunto serve para responder uma dúvida específica de quem já está lendo sobre outra coisa.
  • Uma página sobre o assunto promete responder tudo o que aquela dúvida envolve, e se apresenta como destino de quem chegou procurando exatamente aquilo.

Confundir os três níveis é o que produz sites com dezenas de páginas e nenhum dono claro de nada. Uma empresa de contabilidade que cita abertura de empresa em um parágrafo da página de serviços não tem uma página sobre abertura de empresa, tem uma menção, e quem procura abertura de empresa vai achar quem prometeu o assunto inteiro. A decisão não é escrever mais: é decidir quais assuntos merecem virar destino e tratar os outros como menção, de propósito.

O que a vizinhança de palavras diz sobre o seu texto

A vizinhança de palavras diz de que o texto realmente trata, porque cada assunto traz consigo um conjunto de termos que vêm junto dele. O Google descreve isso ao explicar a classificação: os algoritmos avaliam se a página contém outro conteúdo relevante além da palavra pesquisada, e o exemplo que ele dá para uma busca por cachorros são imagens de cachorros, vídeos ou uma lista de raças.

O nome desse fenômeno é co-ocorrência, e ele explica por que duas páginas com o mesmo título podem ser lidas como assuntos diferentes. Uma página sobre instalação de ar-condicionado que fala de BTU, carga térmica, dreno, infraestrutura elétrica, garantia do fabricante e responsável técnico está cercada pelos termos que o assunto exige. Uma página com o mesmo título que fala de qualidade, compromisso, atendimento diferenciado e equipe qualificada está cercada por termos que serviriam para vender qualquer coisa.

A diferença entre as duas não é de capricho na redação, é de conhecimento demonstrado. A primeira página só pode ter sido escrita por quem sabe instalar ar-condicionado, e a segunda poderia ter sido escrita por qualquer pessoa sobre qualquer serviço. Para quem revisa um texto antes de publicar, existe uma pergunta que resolve isso em um minuto: quais termos um profissional experiente do setor usaria nesta explicação e não estão aqui? O que falta nessa resposta é exatamente o que falta na página.

O que acontece com a pergunta de alguém antes de o Google procurar a resposta

Antes de procurar a resposta, o Google tenta estabelecer o que a pessoa está procurando. Segundo o Google, para devolver resultados relevantes é preciso primeiro estabelecer o que você procura, a intenção por trás da consulta, e para isso a empresa constrói modelos de linguagem que tentam decifrar como as poucas palavras digitadas na caixa de busca correspondem ao conteúdo mais útil disponível.

Essa etapa é a razão de duas pessoas digitarem coisas diferentes e receberem respostas parecidas, e de duas pessoas digitarem a mesma coisa e receberem respostas diferentes. Fazer máquinas lidarem com texto escrito por gente é o campo que se chama de processamento de linguagem natural, e para quem publica o efeito prático dele é um só: a página não é comparada com a frase digitada, é comparada com o que aquela frase significa.

Três consequências saem disso para quem escreve:

  1. Responder a dúvida vale mais do que casar com a frase. A frase digitada muda de pessoa para pessoa, a dúvida por trás dela é a mesma.
  2. A pergunta pode chegar de dezenas de formas. Escrever uma página por forma da pergunta produz páginas quase idênticas, nenhuma completa.
  3. O que não foi perguntado com essas palavras também conta. Quem pergunta o preço de um serviço ainda precisa saber o prazo para decidir, e uma página que responde as duas atende a pessoa inteira.

As três levam ao mesmo lugar: a unidade de trabalho é a dúvida, não a frase. Uma pauta que nasce de uma frase digitada tende a virar um texto curto que repete a frase e para. Uma pauta que nasce de uma dúvida obriga a listar tudo o que a pessoa precisa saber para sair dali decidida, e é isso que faz a página servir para muitas formas de perguntar a mesma coisa.

Isso significa que eu devo escrever como as pessoas falam?

Escreva como o seu cliente entende, e não como você imagina que a busca prefere. Usar o nome que o cliente usa para o serviço, explicar a sigla na primeira vez que ela aparece e responder na ordem em que a pessoa pergunta são decisões que ajudam o leitor, e o que ajuda o leitor é o que resiste a mudança de algoritmo.

O que não funciona é o contrário disso: encher o texto de frases coloquiais artificiais, escrever perguntas do jeito exato que alguém digitaria com erro de português, ou repetir a mesma pergunta em variações só para cobrir formas de busca. Nenhuma dessas coisas ajuda quem está lendo, e um texto que só faz sentido como estratégia de busca não dá ao leitor motivo para continuar nele.

Como duas páginas sem uma palavra em comum podem ser sobre a mesma coisa

Duas páginas podem ser sobre a mesma coisa sem compartilhar uma palavra porque a correspondência é feita no significado, e não na forma escrita. O Google atribui isso ao sistema de sinônimos que permite encontrar documentos relevantes mesmo quando eles não contêm as palavras exatas usadas na pesquisa.

No Brasil isso aparece em qualquer setor com vocabulário duplo. “Conserto de geladeira” e “assistência técnica em refrigeração” nomeiam o mesmo serviço, e são escritas por públicos diferentes: a primeira é do cliente, a segunda é de quem trabalha com aquilo. O que faz as duas se encontrarem é a página trazer o assunto com os termos que o cercam, não a página escrever as duas formas lado a lado.

Quem trabalha com isso chama de vetores de significado a representação que permite comparar significado em vez de comparar texto, e o efeito dela para quem escreve dispensa qualquer detalhe técnico. Vale escrever a página com o vocabulário do cliente e mencionar, dentro do texto, o nome técnico correspondente, uma vez, como quem esclarece. Isso é diferente de listar sinônimos: a lista de sinônimos serve à busca, a menção explicativa serve ao leitor que precisa reconhecer o serviço pelo nome que viu na nota fiscal.

O que você consegue afirmar para o buscador em vez de torcer para ele deduzir

Você consegue afirmar, de forma explícita, do que a página trata e quais são os dados dela, usando dados estruturados. Segundo o Google, os dados estruturados são um formato padronizado para fornecer informações sobre uma página e classificar o conteúdo dela.

O vocabulário usado para isso é o Schema.org, e a marcação escrita com ele no código da página é o que se chama de Schema Markup. O que a página declara ali não é texto para o leitor: é uma ficha, em formato fixo, dizendo o que cada dado da página é. Nome do serviço, endereço, autor do texto, data, avaliação e preço deixam de ser uma informação que alguém precisa deduzir do parágrafo e passam a ser um campo preenchido.

A declaração tem uma regra que vale a pena entender antes de implementar: ela precisa corresponder ao que está visível. O Google pede que não sejam adicionados dados estruturados sobre informações que não são visíveis para o usuário, mesmo que essas informações estejam corretas. Declarar um preço que não aparece na página, ou um serviço que a página não descreve, vai contra a orientação mesmo quando o dado é verdadeiro.

A parte de escrever, validar e publicar essa marcação sem quebrar o site é trabalho de SEO técnico, e a parte que interessa aqui é outra: decidir o que declarar. Um site pode ter marcação impecável do ponto de vista técnico e estar declarando a coisa errada, o que é um problema de significado, não de código.

Marcar o site com schema faz subir de posição?

Não. Dados estruturados não prometem posição, prometem elegibilidade a outro tipo de resultado, e nem essa é garantida. O Google afirma que não garante que seus dados estruturados serão exibidos nos resultados da pesquisa, mesmo que a página esteja marcada corretamente.

O que a marcação abre é a porta para a página aparecer de outra forma na busca, com elementos adicionais, e não uma posição melhor na lista comum. O próprio Google descreve o que se perde quando há problema: uma ação manual por dados estruturados faz a página perder a qualificação para exibição como pesquisa aprimorada, e é essa qualificação que se perde, não a classificação da página na busca na web.

Para quem está decidindo onde investir, a leitura honesta é essa: schema é um multiplicador de como a página aparece quando ela já tem motivo para aparecer, e não um substituto desse motivo. Uma página sem conteúdo que responda a dúvida não vira resposta porque ganhou marcação, e uma página que responde bem fica mais bem apresentada quando ganha.

Como se confirma que dois endereços na web falam da mesma coisa

Declarando, dentro da própria página, quais outros endereços representam aquela mesma coisa. A propriedade do Schema.org que carrega essa declaração é sameAs, definida na documentação do vocabulário como a URL de uma página de referência que indica de forma inequívoca a identidade do item, dando como exemplos a página da Wikipedia, a entrada no Wikidata ou o site oficial do item.

Na prática de uma empresa, isso quer dizer apontar do site para os endereços que já representam o negócio em outros lugares, quando eles existem e são realmente dela. O valor da declaração está inteiro na palavra inequívoca: ela serve para eliminar dúvida sobre identidade, não para acumular links. Declarar como sendo da empresa um endereço que não é dela não confirma nada, e cria uma contradição entre o que a página afirma e o que os outros endereços mostram.

Por que declarar demais é pior do que declarar de menos

Declarar demais dilui o que a página afirma ser, e ainda contraria a orientação de marcar apenas o que está visível. O Google é direto nesse ponto: não marque conteúdo que não seja visível para os leitores da página, e se a marcação descrever um agente, o corpo HTML precisa descrever esse mesmo agente.

A separação entre o que a página é e o que ela apenas cita tem tradução no vocabulário de declaração, e o par about e mentions existe exatamente para isso:

O que significaQuantos por páginaO que acontece quando se erra
O que a página éo assunto que a página promete responder inteiroumdeclarar vários faz a página não afirmar ser nada em particular
O que a página citaos assuntos que aparecem no texto sem serem o centrováriosdeclarar como centro o que é citação contradiz o que está escrito
O que não está na páginao que não aparece em lugar nenhum do texto visívelnenhumvai contra a orientação do Google, e o corpo não sustenta a ficha

A primeira linha é a que decide, e ela é uma decisão editorial disfarçada de campo técnico. Escolher o que a página é obriga a responder o que ela promete, e uma página que promete tudo não promete nada. Antes de preencher qualquer marcação, vale escrever em uma frase o que aquela página responde, e conferir se o texto visível entrega essa frase. Se não entregar, o problema está no texto, e nenhuma declaração conserta isso.

Como isso muda a forma de planejar o conteúdo

O planejamento deixa de listar termos e passa a decidir assuntos, donos e fronteiras antes de qualquer pauta existir. A pergunta que abre o planejamento troca de “quais termos têm volume” para “quais assuntos este negócio quer ser reconhecido por responder”, e as duas produzem calendários muito diferentes a partir do mesmo orçamento.

Isso não elimina a pesquisa de termos nem a preocupação com cobertura de um tema inteiro, que é o que se chama de autoridade tópica. As duas continuam existindo, e continuam sendo trabalho especializado. O que muda é a ordem: o assunto e o dono vêm primeiro, e a pesquisa de termo passa a informar como a página fala, não quantas páginas existem.

Para quem aprova orçamento de conteúdo, a troca tem um lado bom e um lado caro, e vale ver os dois antes de decidir:

O que se ganhaO que custa
Decisão de pautacada pauta tem dono e fronteira, e a dúvida “isso já não existe no site?” someexige uma definição de escopo antes da primeira pauta, que atrasa o começo
Volume publicadomenos páginas, cada uma mais completa e mais cara de produzirquem mede produção por quantidade de posts vê o número cair
Resultado ao longo do tempouma página completa continua servindo quando a forma de perguntar mudao retorno aparece mais tarde do que numa página curta que casa com um termo
Manutençãoatualizar um assunto é mexer em uma páginaa página fica longa, e revisar exige ler tudo
Equipequem escreve precisa entender o assunto, não só escrever bemencarece a redação, ou exige entrevistar quem sabe

A linha do volume publicado é a que costura a conversa difícil com quem contrata. Um plano semântico entrega menos páginas no primeiro trimestre, e é isso que ele deveria entregar. Se a régua do contrato continuar sendo quantidade de textos por mês, o método vai ser julgado pelo indicador que ele foi feito para reduzir. Vale acertar isso na aprovação do plano, e não na primeira reunião de resultado.

Preciso de um artigo para cada palavra que as pessoas digitam?

Não. Você precisa de uma página por assunto, e ela atende as muitas formas de perguntar a mesma coisa. Dez maneiras de digitar a mesma dúvida não são dez assuntos, são dez portas para a mesma sala, e construir dez salas iguais divide a força do site entre páginas que competem entre si.

O critério para separar é a resposta, não a frase. Se duas perguntas têm a mesma resposta, elas são a mesma página. Se a resposta muda, mesmo que as palavras sejam parecidas, são páginas diferentes. Quem procura o preço de um serviço e quem procura como escolher o fornecedor daquele serviço estão fazendo perguntas próximas no vocabulário e distantes na resposta, e cada uma merece o próprio endereço.

Como saber o que o seu site já cobre, sem chutar

Listando, página por página, qual assunto cada uma promete responder, e comparando essa lista com os assuntos que o negócio precisa ocupar. O trabalho é braçal e não tem atalho: abrir cada URL, escrever em uma frase o que ela responde, e anotar o assunto que ela reivindica.

Esse levantamento chama-se auditoria semântica, e ele separa o que existe em três achados:

  1. Assuntos com dois ou três donos. Páginas diferentes prometendo a mesma resposta, nenhuma completa.
  2. Assuntos sem dono nenhum. Temas que a empresa dominaria, citados em parágrafos soltos e sem página que os assuma.
  3. Páginas sem assunto identificável. Textos que falam de vários temas e não prometem responder nenhum inteiro.

Os três achados pedem decisões diferentes, e nenhum deles pede que se escreva mais antes de resolver. O primeiro pede escolha de dono, o segundo pede pauta nova, e o terceiro pede recorte ou remoção. Fazer esse inventário antes de aprovar o próximo calendário muda o que entra nele, e é trabalho de leitura, não de produção.

Dá para conferir se o buscador entendeu, ou só esperar?

Dá para conferir por sinais indiretos, todos observáveis sem ferramenta paga, embora ninguém de fora consiga abrir a base do Google e ler o que está registrado. A conferência possível é a de comportamento: o que a busca mostra sobre o assunto, e o que ela mostra sobre o seu site.

Quatro checagens práticas, na ordem em que vale fazê-las:

  • Pesquise o nome exato da sua empresa e veja o que aparece junto: quais páginas, quais perfis e qual descrição o buscador usa.
  • Pesquise o assunto da sua página principal e veja quem responde hoje, e com que tipo de conteúdo.
  • Olhe as consultas do Search Console que já trazem impressões para a página, e confira se elas são sobre o assunto que a página promete.
  • Confira se a página certa está aparecendo para o assunto certo, ou se outra página sua tomou o lugar dela.

Essas quatro checagens não provam o que o Google entendeu, e essa honestidade importa: elas mostram o resultado, que é o que está ao alcance de quem tem o site. O trabalho mais formal de conferir se cada declaração da página está correta e se as identidades apontadas batem chama-se validar entidades, e é uma etapa técnica com ferramenta e método. A leitura de comportamento acima é o que dá para fazer amanhã de manhã.

Quanto tempo leva até isso aparecer?

Não existe prazo padrão publicado para isso, e três fatores concretos determinam o tempo no seu caso. O primeiro é a frequência com que o seu site é rastreado, que muda de site para site. O segundo é quanto material já existe publicado sobre aquele assunto, dentro e fora do seu site. O terceiro é quanta fonte externa concorda com o que a sua página afirma.

Quem prometer um prazo fechado para isso está vendendo previsibilidade que ninguém tem. O que dá para acompanhar desde a primeira semana são três sinais observáveis: quais consultas passam a trazer a página, se é a página certa que aparece, e se o assunto dessas consultas é o assunto que a página promete responder. Se esses três estiverem se movendo na direção certa, o trabalho está acontecendo, mesmo que a posição ainda não tenha mudado.

O que o SEO semântico não é

SEO semântico é o trabalho de fazer o conteúdo ser reconhecido pelo assunto que ele trata, e há cinco trabalhos próximos que ele não é. A confusão entre elas é o que faz um projeto começar pelo lugar errado e cobrar do método um resultado que pertence a outro trabalho.

  • Não é fazer a sua empresa virar uma entidade conhecida. Isso é trabalho de presença, de citação externa e de consistência de dados pela web, e tem página própria neste site.
  • Não é aparecer em resposta de inteligência artificial generativa. Esse é outro campo, com outras métricas.
  • Não é pesquisa de palavra-chave. A pesquisa de termos continua existindo e informa como a página fala, não qual assunto ela ocupa.
  • Não é linkagem interna. Ligar páginas é consequência de ter assuntos definidos, e a disciplina de linkagem é tratada por si.
  • Não é cobertura completa de um tema. Cobrir um tema inteiro é autoridade tópica, que usa o trabalho semântico como base e vai além dele.

As cinco linhas descrevem trabalhos vizinhos e reais, nenhum deles dispensável. O que separa o SEO semântico dos cinco é a unidade: aqui a pergunta é sempre se o significado do que está escrito chega inteiro do outro lado. Quando essa pergunta está respondida, as outras cinco frentes passam a render mais, porque todas dependem de o conteúdo ser identificável antes de qualquer outra coisa.

Isso é a mesma coisa que otimizar para o ChatGPT?

Não. Otimizar para respostas de inteligência artificial generativa é outro trabalho, com outro objetivo e outra forma de medir, e quem trata disso aqui é a página de GEO. O SEO semântico cuida de o conteúdo ser identificável pelo assunto, o que ajuda qualquer sistema que leia texto, mas ajudar não é ser a mesma coisa.

O que dá errado quando se tenta aplicar isso cedo demais

O trabalho semântico não compensa base técnica quebrada, e aplicá-lo primeiro gasta orçamento sem mudar resultado. Uma página que o buscador não consegue rastrear, que demora a carregar ou que duplica o próprio endereço não tem problema de significado, tem problema anterior, e nenhuma quantidade de precisão no texto resolve isso.

A ordem que evita o desperdício tem três degraus:

  1. A página precisa ser acessível e indexável. Sem isso, o conteúdo não chega a ser avaliado, e é assunto de SEO técnico.
  2. O site precisa ter assuntos definidos e donos claros. É onde o trabalho semântico entra e faz diferença.
  3. O tema precisa ser coberto inteiro. É o degrau seguinte, e ele pressupõe os dois de baixo prontos.

O primeiro degrau é o que passa despercebido, porque a falha dele não aparece no texto: o artigo fica bonito, a marcação fica correta, e nada acontece. Conferir se as páginas existentes são rastreáveis e se carregam é um diagnóstico rápido, vem antes de aprovar qualquer projeto de conteúdo semântico, e é o escopo do serviço de SEO técnico. Começar pelo degrau certo é o que separa um projeto que mostra resultado de um que vira discussão sobre método.

Por onde começar se o seu site já tem conteúdo publicado

Comece pelo inventário do que existe, e só depois decida o que escrever. Um site com conteúdo publicado tem material para reaproveitar e problemas para resolver, e escrever páginas novas antes de olhar as antigas acrescenta mais um dono ao assunto que já tinha dois.

A ordem que funciona para um site já publicado é esta:

  1. Liste cada página e o assunto que ela promete. Uma frase por URL, escrita por quem conhece o negócio.
  2. Marque os assuntos com dono duplicado, que são os que mais rapidamente devolvem resultado quando resolvidos.
  3. Escolha o dono de cada assunto duplicado e decida o destino das outras: virar seção, virar recorte diferente ou sair.
  4. Complete a página dona com o que falta para ela responder o assunto inteiro, incluindo preço, prazo e limite.
  5. Só então abra pauta nova, para os assuntos que ficaram sem dono nenhum.

Os três primeiros passos não exigem escrever quase nada, e são eles que destravam os outros dois. Quem quiser percorrer isso com apoio externo encontra o caminho e os critérios em ver metodologia, e o trabalho conduzido de ponta a ponta é o que se contrata como consultoria em SEO semântico.

Vale a pena reescrever o que já está no ar?

Reescrever vale quando a página já recebe visita para o assunto certo e não responde o assunto inteiro, e não vale quando o problema dela é ser sobre um assunto que o site não quer ocupar. O critério é o mesmo nos dois casos: reescrita conserta página com destino certo e conteúdo incompleto, e não conserta página sem destino.

Três situações decidem rápido, e vale usá-las como filtro antes de estimar qualquer esforço:

  • Página com impressões e sem cliques, no assunto certo: reescrever é o melhor investimento disponível, porque o trabalho de ser encontrada já foi feito.
  • Página com assunto duplicado: decidir o dono vem primeiro, e a reescrita é do dono escolhido, não das duas.
  • Página sobre assunto que o negócio não quer ocupar: não reescreva, decida se ela some ou se ela passa a apontar para quem é dono.

O caso do meio é o que decide o destino dos outros dois, porque une duas metades de uma resposta que hoje competem uma com a outra. Comece pelas páginas que já recebem visita, resolva a duplicação antes de melhorar o texto, e deixe a pauta nova para depois que o site já tiver um dono declarado para cada assunto que ele reivindica.

Isso acontece no seu site?

Um diagnóstico gratuito aponta em qual etapa o seu site está travado e o que corrigir primeiro. Você recebe o retrato, com ou sem proposta depois.

Fale com um Consultor