ChatGPT naj bi gradil lastno iskalno infrastrukturo z več specializiranimi indeksi, zato ga ni ustrezno opisati le kot uporabnika Googla ali Binga.

VIR:
https://x.com/TomekRudzki/status/2095886026363293717

BISTVO:

ChatGPT-jev sistem za pridobivanje virov se po objavi interno imenuje Labrador in obsega več ločenih indeksov, ne enega samega.

Omenjeni so indeksi za splet, PDF-je, YouTube, novice, arXiv, Wikipedijo, lokalne rezultate, finance, pravo, medicino, nakupovanje in slike.

Nick Turley, vodja ChatGPT, naj bi na protimonopolnem zaslišanju v ZDA leta 2025 pod prisego povedal, da je bil razvoj lastnega indeksa del načrta OpenAI od začetka.

OpenAI naj bi želel tudi Googlove podatke, ne zato, ker lastnega sistema nima, temveč za izboljšanje kakovosti rezultatov in lastnega indeksa.

Nedavni zaposlitveni oglasi za podatkovne sisteme v eksabajtnem merilu po navedbah avtorja kažejo, da OpenAI v to infrastrukturo še naprej intenzivno vlaga.

DEJSTVA:

Avtor objave je Tomek Rudzki (@TomekRudzki), povezan s podjetjem oziroma platformo Peec AI.

Objavljena je bila 4. septembra 2026.

Sistem je v objavi poimenovan Labrador.

Navedeno zaslišanje naj bi potekalo leta 2025.

Objava omenja obseg infrastrukture na ravni eksabajtov, kar pomeni vsaj 1 milijardo gigabajtov podatkovnega prostora na eksabajt. Prvi del navedbe izvira iz objave, pretvorba enote pa je standardna definicija.

CITATI:

“ChatGPT’s retrieval system, internally called Labrador, isn’t one index.”

“It’s a family of indexes: general web, PDF, YouTube, news, arXiv, Wikipedia, local, finance, legal, medical, shopping, images.”

“Building an in-house index was the plan from day one.”

“Job postings talk about exabyte-scale database systems.”

“We heavily underestimate ChatGPT … reducing its impact to ‘they use Google’, ‘they use Bing.’”