ChatGPT, Gemini, DeepSeek... koji četbot najviše halucinira?

Glas Srpske
Dodaj glassrpske.com kao Google izvor
Foto: Shutterstock.com

Veliki jezički modeli funkcionišu tako što prepoznaju obrasce i predviđaju sljedeću najvjerovatniju riječ u nizu, a ne tako što zaista „znaju“ činjenice.

Do problema dolazi kada model ne može da pronađe jasan obrazac za odgovor, pa ipak pokuša da sastavi smislen tekst na osnovu statistike, što može dovesti do netačnih informacija.

Kompanija Legal Guardian Digital, koja se bavi SEO optimizacijom za pravne firme, analizirala je učestalost grešaka ovih alata, zadovoljstvo korisnika i stabilnost rada različitih četbotova.

Rezultati pokazuju da Google Gemini ima najveću stopu netačnih odgovora, sa čak 32% „halucinacija“. Sljedeći je ChatGPT sa približno 30%, dok je najprecizniji Perplexity AI, sa oko 13% pogrešnih odgovora. DeepSeek i Grok takođe bilježe relativno niske stope grešaka od 14% i 15%.

Kada je riječ o ukupnom utisku korisnika, DeepSeek i ChatGPT imaju najvišu ocjenu zadovoljstva od 4,7 (od maksimalnih 5), dok Perplexity AI prati sa 4,6.

U konačnom rangiranju, koje uključuje sve faktore, Perplexity AI zauzima prvo mjesto sa indeksom 85, zatim slijede Grok i DeepSeek. ChatGPT se našao na sredini liste sa skorom 50, dok je Gemini ostvario 41, a Meta AI zauzela posljednje mjesto sa 37 poena.

 
 
 

Pratite nas na našoj Facebook i Instagram stranici i X nalogu.