2. Како ChatGPT го открива вебот

2. Како ChatGPT го открива вебот

За да може една веб-страница да биде користена како извор во ChatGPT Search, најпрво мора да биде технички достапна. Тоа не значи само дека се отвора во обичен прелистувач. Потребно е crawler-от да не биде блокиран од robots.txt, CDN, WAF, firewall, bot protection, login, JavaScript зависност или погрешна HTTP конфигурација.

2.1 Од прашање до извор

Кога прашањето има корист од свежи или веб-базирани информации, ChatGPT може да изврши пребарување. Корисничкото прашање може да се преформулира во една или повеќе поконкретни пребарувачки фрази. Потоа системот ги оценува достапните извори, составува одговор и може да прикаже inline цитати или панел со извори.

ФазаШто се случува
1. ПрашањеКорисникот поставува природно формулирано прашање.
2. Search intentСистемот одредува дали е потребно веб-пребарување и може да ја преформулира намерата.
3. ИзвориСе откриваат достапни и релевантни страници, вклучително преку search партнери.
4. СинтезаИнформациите се комбинираат во директен одговор.
5. ЦитирањеКога е применливо, се прикажуваат линкови и извори за проверка.

2.2 Трите OpenAI user-agent улоги

Најчестата техничка грешка е сите OpenAI crawler-и да се третираат како една иста работа. Нивните улоги и контролите се различни.

User-agentУлогаКонтролаПрактична одлука
OAI-SearchBotАвтоматско откривање за ChatGPT SearchДа, преку robots.txtДа биде дозволен ако сакате search видливост.
GPTBotСодржина што може да се користи за подобрување и тренирање моделиДа, преку robots.txtМоже независно да се дозволи или блокира.
ChatGPT-UserПосета иницирана од корисничко барање или Custom GPTrobots.txt може да не се применуваНе одлучува дали страницата ќе се појави во Search.

Robots.Txt

Continue reading the complete book

Unlock all frameworks, permanent library access and future content updates.