Kaip svetainei patekti į dirbtinio intelekto atsakymus?
Reikia trijų dalykų vienu metu: neblokuoti AI robotų robots.txt faile, atiduoti turinį serveryje be JavaScript, ir suskaidyti tekstą taip, kad atsakymas į vieną klausimą būtų viena ištrauka. Blokuotas robotas nemato nieko, o tuščias HTML modeliui reiškia tuščią puslapį.
Klausimas skamba kaip rinkodara, bet atsakymas yra techninis. Asistentas svetainę pasiekia dviem keliais — mokymo duomenimis ir gyva paieška — ir antrasis yra tas, kurį gali paveikti šią savaitę.
Sąlygos trys, ir jos eina iš eilės.
1. Įleisk robotą
robots.txt yra pirmoji ir dažniausiai vienintelė kliūtis. Svarbu, kad
robotai skiriasi paskirtimi:
GPTBot OpenAI mokymo duomenys
OAI-SearchBot ChatGPT paieška — TAI, kas duoda nuorodą
ChatGPT-User kai zmogus paprašo atidaryti adresą
ClaudeBot Anthropic
PerplexityBot Perplexity indeksas
Google-Extended Gemini ir AI apžvalgos
Uždarius visus, dingsti ir iš atsakymų, ir iš mokymo. Uždarius tik mokymo robotus, lieki paieškoje, bet neatsiduri modelio „atmintyje". Tai sprendimas, o ne klaida — bet jis turi būti sąmoningas.
2. Atiduok turinį serveryje
Google JavaScript vykdo atskiru etapu. Dauguma AI crawlerių jo nevykdo
visai: jiems tuščias <div id="app"> yra tuščias puslapis.
Patikrinti galima be įrankių — parsisiųsk puslapį taip, kaip tai daro robotas, ir pažiūrėk, ar tekstas jame yra. Jei nėra, viskas, kas parašyta žemiau, matuoja tai, ko modelis nemato.
3. Padaryk atsakymą atskiriamą
Modelis puslapio neskaito iš eilės. Jis skaido jį į ištraukas ir renkasi tą, kuri atsako į klausimą. Antraštės yra tos ribos.
Iš to seka trys praktiniai dalykai:
- klausimas antraštėje, atsakymas iš karto po juo — be įžangos;
- 40–120 žodžių vienoje ištraukoje: trumpiau nėra ką cituoti, ilgiau atsakymas skęsta;
- savarankiškumas — pastraipa turi būti suprantama išimta iš konteksto, nes būtent taip ji ir bus paimta.
Ko nepakanka
llms.txt failas savaime matomumo neduoda: nė vienas tiekėjas viešai
neįsipareigojo jo skaityti. Turėti jį verta, bet laikyti sprendimu — ne.
Schema.org žymėjimas irgi nėra magija. Jis padeda suprasti, kas puslapyje yra, bet nepadaro turinio verto citavimo.
Susiję straipsniai
Ta pati tema iš kitos pusės — kiekvienas atsako į savo klausimą:
- Ar ChatGPT mato mano svetainę: kaip patikrinti
- Kas yra GEO optimizacija ir kuo skiriasi nuo SEO
- Ar blokuoti AI crawlerius: kada verta
Kaip tai matuojam, aprašyta ties ką tikriname.
Šaltiniai
Tai, kuo remiasi šis tekstas — pirminiai šaltiniai, ne perpasakojimai:
Dažni klausimai
Per kiek laiko pasimato rezultatas?
Gyvos paieškos kelyje — nuo kelių dienų iki kelių savaičių, kai indeksas atsinaujina. Mokymo duomenyse — tik su kitu modelio leidimu, t. y. mėnesiais. Todėl pirma tvarkomas antrasis kelias.
Ar galima „užsisakyti" vietą atsakyme?
Ne. Reklamos vietos ten nėra, o kas siūlo garantiją, siūlo tai, ko neturi. Įtakoti galima tik prieinamumą, struktūrą ir tai, ar tavo faktus patvirtina kiti šaltiniai.
Ar reikia atskiro turinio dirbtiniam intelektui?
Ne. Tas pats tekstas, parašytas su antraštėmis ir tiesiais atsakymais, veikia abiem — žmogui ir modeliui. Atskira versija po mėnesio išsiskirtų su pagrindine ir pradėtų meluoti.
Kaip sužinoti, ar mane jau cituoja?
Paprasčiausiai paklausk asistento apie savo sritį ir pažiūrėk į nuorodas po atsakymu. Antras būdas — lankomumo statistikoje ieškoti apsilankymų iš `chatgpt.com` arba `perplexity.ai`.
Pasitikrink
Nemokamas skenas parodo, ką iš to, kas aprašyta, tavo svetainė jau daro, o ko — ne.