User-agent: * Allow: / Sitemap: https://ortorede.pt/sitemap.xml # Mapa do site em texto, para quem o queira ler sem percorrer o site inteiro # https://ortorede.pt/llms.txt # ============================================================ # Robôs de inteligência artificial # ============================================================ # Decidido a 29/09/2026. Nem todos os robôs de IA fazem a mesma coisa, e a # diferença é o que separa estas duas listas: # # quem CITA vai ao site quando alguém faz uma pergunta e devolve a # resposta com a ligação para a Ortorede. Traz visitas. # quem TREINA leva o texto para dentro do modelo. O modelo passa a saber o # que aqui se diz, sem nunca nomear o site nem lá mandar ninguém. # # As dicas e as fichas deste site são texto escrito de raiz, não copy de # fornecedor. Alimenta-se quem devolve alguma coisa; a quem só leva, diz-se # que não. # # ISTO É UM PEDIDO, NÃO UMA FECHADURA. Quem o quiser ignorar, ignora — e o # Bytespider tem fama disso. Contra cópia deliberada não vale nada. # # A pasta _construcao não se declara aqui de propósito: já responde 404 pelo # _redirects, e escrevê-la num ficheiro público era anunciar que existe. # ---------- passam: pesquisam e citam ---------- User-agent: OAI-SearchBot Allow: / User-agent: ChatGPT-User Allow: / User-agent: PerplexityBot Allow: / User-agent: Perplexity-User Allow: / User-agent: Claude-SearchBot Allow: / User-agent: Claude-User Allow: / User-agent: Applebot Allow: / # O Google-Extended é o único que não se consegue separar: a mesma palavra # autoriza as respostas de IA do Google (onde interessa aparecer) e o uso do # texto para melhorar os modelos dele. Fica a passar, porque é o motor de # resposta com mais gente do lado de lá. User-agent: Google-Extended Allow: / # ---------- não passam: recolhem para treinar ---------- User-agent: GPTBot Disallow: / User-agent: ClaudeBot Disallow: / User-agent: anthropic-ai Disallow: / User-agent: Claude-Web Disallow: / # O Common Crawl é a recolha de onde sai o material de treino de meio mundo. User-agent: CCBot Disallow: / User-agent: Bytespider Disallow: / User-agent: Applebot-Extended Disallow: / User-agent: meta-externalagent Disallow: / # ATENÇÃO, se um dia se mexer nesta linha: o FacebookBot é o robô de treino da # Meta e NÃO é o facebookexternalhit, que é quem vai buscar a fotografia e o # título quando alguém partilha uma ligação no Facebook, no Messenger ou no # WhatsApp. Esse passa pela regra de cima e tem de continuar a passar, senão o # cartão da partilha sai vazio ([[imagem-de-partilha]]). User-agent: FacebookBot Disallow: / User-agent: Diffbot Disallow: / User-agent: Omgilibot Disallow: / User-agent: omgili Disallow: /