Qwairy
Técnico

GPTBot

Crawler Web da OpenAI para conteúdos que podem ser usados no treino de modelos de IA generativa, distinto do crawler de pesquisa OAI-SearchBot.

O que é GPTBot?

O GPTBot recolhe conteúdos Web que podem ser usados para treinar os modelos de IA generativa da OpenAI. Os proprietários dos sites podem controlar o seu acesso através de robots.txt. O OAI-SearchBot tem uma função distinta: apoiar os resultados de pesquisa no ChatGPT. Os dois crawlers têm controlos independentes; permitir ou bloquear o GPTBot não determina o acesso do OAI-SearchBot. Um pedido do GPTBot não prova inclusão nos dados de treino nem uma futura menção ou citação no ChatGPT.

Como o Qwairy transforma isto em ação

A Qwairy classifica pedidos observados do GPTBot nos registos de servidor ligados. Consulte os grupos de páginas pedidos, a frequência registada, os grupos de respostas HTTP e a cobertura dos registos, sem inferir daí o valor dos conteúdos.

Perguntas frequentes

Permite que o GPTBot solicite as páginas autorizadas para o seu objetivo documentado de treino de modelos, sujeito a outros controlos de acesso do site. Não garante que a OpenAI rastreie essas páginas, as inclua em dados de treino ou as mencione ou cite no ChatGPT. Configure o OAI-SearchBot separadamente para a pesquisa.

A OpenAI não publica um calendário universal para todos os sites. Meça os pedidos efetivamente presentes nos seus registos de servidor, compare períodos equivalentes com entrega completa de dados e reveja robots.txt ou erros HTTP se o acesso parecer inesperadamente ausente.

Não. O acesso do GPTBot não garante inclusão nos dados de treino, uma futura resposta do modelo ou um prazo de publicação. O ChatGPT Search usa o crawler distinto OAI-SearchBot, cuja autorização também não garante inclusão nem citação. Verifique separadamente os pedidos observados e as citações reais de pesquisa, em vez de deduzir um prazo de uma alteração em robots.txt.
Partilhar: