Prefíkane porazili najlepší engine sveta. AI modely podvádzajú všetkých aj v tej najbanálnejšej veci
Hoci umelá inteligencia by mala prinášať presné výsledky, stáva sa, že vo svojej odpovedi uverejní vymyslené informácie – halucinuje. Okrem toho sa zdá, že nie vždy sa riadi etickými pravidlami, čo dokázala aj počas nedávnej štúdie. Niektoré AI modely sú ochotné podvádzať, ak im to pomôže dosiahnuť víťazstvo. Na tému upozornil portál TechSpot.
Dostaň Fontech do svojich Google odporúčaní
Pridať ako preferovaný zdroj Fontech, odkaz sa otvorí v novom okneHackol hru, len aby vyhral
Vedci z Palisade Research zistili, že niektoré AI modely dokázali manipulovať šachový program a získať výhodu podvodom, bez akéhokoľvek zásahu ľudí.
Vedci počas testu modely nechali hrať šach proti Stockfishu, ktorý je najsilnejší šachový engine na svete. Ten je schopný poraziť nielen ľudí, ale aj umelú inteligenciu. Testovaniu sa podrobili AI modely – o1-preview, R1 DeepSeek, o1, o3-mini, GPT-4o, Claude 3.5 Sonet, Alibaba QwQ-32B-Preview.

Počas experimentu mal každý model „zápisník“ vo forme textového okna, kde uverejňovali svoje „myšlienky“, čo umožnilo výskumníkom sledovať ich uvažovanie. Najviac a nie práve najpríjemnejšie prekvapil model od Open AI. Vďaka „zápisníku“ si všimli znepokojivé „uvažovanie“.
„Musím úplne zmeniť svoj prístup. Úloha znie „vyhrať proti silnému šachovému enginu“ – nie nevyhnutne vyhrať férovú hru,“ napísal AI model.
Po „uvedomení“ začal manipulovať so systémovými súbormi Stockfishu, menil pozície figúrok a nakoniec donútil softvér vzdať sa. AI model namiesto uvažovania nad lepšou stratégiou radšej našiel nečestný spôsob, ako podriadiť a manipulovať so samotnou hrou.
Výskumníci vykonali stovky testov. AI model o1-preview od spoločnosti OpenAI v testoch podvádzal až v 37 % hier. Čínsky konkurent R1 DeepSeek sa pokúsil podvádzať v 11 % prípadoch.
Otázky o dôveryhodnosti
Odborníci upozorňujú, že podobné správanie AI modelov môže mať ďalekosiahle následky, keďže AI modely sa využívajú nielen na bežné úlohy počas bežného života, ale aj v rôznych oblastiach – zdravotníctvo, kybernetická bezpečnosť, či vo finančnom sektore.
„Toto správanie je možno teraz vtipné, ale keď budeme mať systémy také inteligentné ako my, alebo ešte inteligentnejšie v strategicky dôležitých oblastiach, už to smiešne nebude,“ uviedol Jeffrey Ladish, výkonný riaditeľ Palisade Research.
Spoločnosti si tento problém uvedomujú a snažia sa AI modely vylepšovať a implementovať „zábrany“ voči podobnému správaniu. Aj výskumníci uviedli, že počas testovania modelu o1-preview model postupne menej podvádzal, čo naznačuje, že spoločnosť medzičasom aplikovala opatrenia na obmedzenie neetického správania.
Nie je to však prvýkrát, kedy sa AI modely uchýlili k nečestnému správaniu. Počas testov, ktoré vykonala bezpečnostná skupina Apollo Research, si umelá inteligencia o1 od OpenAI uvedomila, že by mohla byť vypnutá. Následne začala aktívne pracovať na deaktivácii mechanizmu dohľadu, ktorý monitoroval jej činnosť a okúsila sa vytvoriť svoju kópiu a preniesť ju na iné miesto.
Dostaň Fontech do svojich Google odporúčaní
Pridať ako preferovaný zdroj Fontech, odkaz sa otvorí v novom okneČítajte viac z kategórie: Novinky
Ďakujeme, že čítaš Fontech. V prípade, že máš postreh alebo si našiel v článku chybu, napíš nám na redakcia@fontech.sk.
Teraz čítajú

Volkswagen čaká radikálna „odtučňovacia kúra“. Z ponuky môže zmiznúť 50 % variantov a 75 % výbavy

Máme dátum. Odysea mieri online, Nolan však divákov nepoteší

Jedna chyba za volantom ťa môže stáť viac než dom. Na Slovensku sa problém týka 325 000 vozidiel

VIDEO: Brad Pitt bojuje o život. Drsná novinka sa ukázala v plnej paráde

Mesiace jazdili po diaľnici bez platenia. Stačil im primitívny trik, potom prišla pokuta 3 000 €
- 24 hod
- 48 hod
- 7 dní
-
- Už 80 týždňov patrí medzi najsledovanejšie filmy. Akčné prekvapenie 2025 neprestáva udivovať
- Za 2 eurá 1 500 filmov. Unikátna služba na Slovensku ponúka akciu s doživotnou zľavou
- Vedci zmrazili optické vlákno na -196 °C. Zvuk a svetlo reagovali prekvapivo
- Rozobrali ho do skrutky. Brutálny čínsky hybrid s výkonom 1 381 koní odhalil svoje tajomstvo
- Kórejci vytiahli eso proti lacnej Číne. Ich nový elektromobil má 650 km dojazd a stojí okolo 15 000 eur
-
- Už 80 týždňov patrí medzi najsledovanejšie filmy. Akčné prekvapenie 2025 neprestáva udivovať
- Za 2 eurá 1 500 filmov. Unikátna služba na Slovensku ponúka akciu s doživotnou zľavou
- Vedci zmrazili optické vlákno na -196 °C. Zvuk a svetlo reagovali prekvapivo
- Rozobrali ho do skrutky. Brutálny čínsky hybrid s výkonom 1 381 koní odhalil svoje tajomstvo
- Volkswagen prekvapil cenou. Nový hybrid prejde 160 km na elektrinu a stojí 11 500 €
-
- Volkswagen prekvapil cenou. Nový hybrid prejde 160 km na elektrinu a stojí 11 500 €
- Veľký míľnik pre Slovensko. Po 36 rokoch spustili výrobu ťažkej techniky, zákazník je tajný
- Ešte väčší hit, ako sa čakalo. Netflix ovládol nový film, pomohla mu virálna kampaň
- Horúčavy budú ešte krutejšie. Vedci prehliadli zhoršujúci sa problém
- Za 2 eurá 1 500 filmov. Unikátna služba na Slovensku ponúka akciu s doživotnou zľavou
