GPTBot
Crawler Web da OpenAI para conteúdos que podem ser usados no treino de modelos de IA generativa, distinto do crawler de pesquisa OAI-SearchBot.
O que é GPTBot?
O GPTBot recolhe conteúdos Web que podem ser usados para treinar os modelos de IA generativa da OpenAI. Os proprietários dos sites podem controlar o seu acesso através de robots.txt. O OAI-SearchBot tem uma função distinta: apoiar os resultados de pesquisa no ChatGPT. Os dois crawlers têm controlos independentes; permitir ou bloquear o GPTBot não determina o acesso do OAI-SearchBot. Um pedido do GPTBot não prova inclusão nos dados de treino nem uma futura menção ou citação no ChatGPT.
Como o Qwairy transforma isto em ação
A Qwairy classifica pedidos observados do GPTBot nos registos de servidor ligados. Consulte os grupos de páginas pedidos, a frequência registada, os grupos de respostas HTTP e a cobertura dos registos, sem inferir daí o valor dos conteúdos.
Perguntas frequentes
Termos relacionados
Crawler de IA
Cliente Web automatizado operado por uma empresa de IA para treino de modelos, pesquisa com IA ou recuperação de informação a pedido do utilizador.
ChatGPT
Assistente conversacional desenvolvido pela OpenAI e baseado em modelos GPT.
robots.txt
Ficheiro de texto na raiz de um site que indica aos robôs de indexação que páginas devem explorar ou evitar.
Identificador de controlo em robots.txt que permite aos editores decidir se a Google pode usar conteúdos rastreados para treinar e fundamentar os seus modelos de IA Gemini.
Base de dados estruturada de entidades e das suas relações, usada por sistemas de IA para compreender o contexto.