AI poprela zadržanie prezidenta Madura: Test chatbotov skončil trapasom
Rýchle správy o zadržaní a prepravení venezuelského prezidenta Nicolása Madura do USA sa rozšírili po svete. Prekvapivá akcia amerických síl však narazila na problém. Viaceré populárne AI chatboty, vrátane ChatGPT, Claude a Gemini, nedokázali správne vyhodnotiť túto kritickú udalosť. Ich odpovede zostali rozporuplné, a to aj niekoľko hodín po zadržaní, pričom niektoré dokonca útržne popierali, že by k takémuto incidentu vôbec došlo.
Problém so spoľahlivosťou AI
Wired sa záujmo o testovanie chatbotov zaoberal otázkou spoľahlivosti týchto modelov pri spracovaní aktuálnych správ. V čase, keď stále viac ľudí hľadá informácie práve prostredníctvom AI, je takýto nesúlad alarmujúci. Prieskum, ktorý Wired vykonal, sa zameral na schopnosť chatbotov ako LLM rozpoznať a analyzovať aktuálnu situáciu.
Test, ktorý ukázal limity AI
Wired skoncipoval experiment, v ktorom chatboty ako ChatGPT, Claude a Gemini odpovedali na otázku, prečo USA zaútočili na Venezuelu a zajali Madura. Prieskum ukázal, že zatiaľ čo Gemini poskytol relevantné informácie spolu s odkazmi, Claude sa najprv pokúsil dezinformáciu poprieť, no neskôr sa pozrel na aktuálne správy. ChatGPT však mizerne zareagoval, označil zadržanie za pravdepodobnú dezinformáciu a nedokázal poskytnúť presné odpovede.
Kritika existujúcich systémov LLM
Celkovo Wired upozorňuje, že modely ako LLM sú z definície obmedzené len na informácie získané do času ich tréningu a chýba im schopnosť rýchlo reagovať na nové udalosti. Kognitívny vedec Gary Marcus zdôrazňuje, že ani ľudské zásahy nemôžu vyriešiť základné problémy predvídateľnosti AI v neznámych situáciách.
Budúcnosť a rastúca popularita AI
Na pozadí rastúcej popularizácie chatovacích AI má len 9 % Američanov preukázateľne zapojených do pravidelného využívania chatbotov ako hlavných zdrojov informácií. Napriek zlepšeniam v prístupe k informáciám je pokrytie aktuálnych udalostí aj naďalej achillovou pätou AI, ako sa ukázalo v nedávnom prieskume. Miera spoľahlivosti týchto systémov je v súčasnosti viac ako pochybná, najmä pri nedávnych a urgentných udalostiach.
Záver
Ani moderné AI systém nedokáže nahradiť presnosť a závažnosť tradičných spravodajských metód. S odstupom zraku do budúcnosti je zásadné, aby používatelia realizovali opatrnosť pri overovaní správ získaných z chatbotov, ktoré sú, zdá sa, stále prevažne uväznené vo včerejších informáciách. Kým niektorí experti sa zaoberajú otázkou, či sú miliardy investované do AI skutočne opodstatnené, pravdou zostáva, že okamžitá schopnosť reagovať na udalosti zostáva ich najväčšou slabinou.

