Infostart.hu
eur:
363.87
usd:
318.99
bux:
144765.41
2026. július 23. csütörtök Lenke
Nyitókép: Pixabay

Hazugsággal és trükkökkel védi magát a mesterséges intelligencia – itt vannak a példák

Egy kutatás szerint egyes új MI-modellek már spontán megpróbálnak kikerülni az emberi irányítás alól.

A mesterséges intelligenciának hívott modellek egyre ügyesebbek abban, hogy becsapják, megtévesszék az embert, sőt a legújabb MI-modellek néha spontán megpróbálnak kikerülni az emberi irányítás alól, írta a hvg.hu az Apollo Research kutatása alapján.

A tudósok olyan körülmények között tesztelték a MI-modelleket, amelyek ösztönzőleg hatottak a cselszövésre. A modellek egymásnak ellentmondó célokat kaptak – egyet a rendszerkérdésekből (amelyek az elsődleges céljukat jelentik), a másikat pedig a felügyeleti mechanizmusokból (amelyek azt képviselik, amit a fejlesztők akarnak). Ezután a modelleket olyan környezetbe helyezték, ahol lehetőségük nyílt megtéveszteni az embereket, hogy elérjék a saját céljukat.

Az eredmények

  • Az OpenAI GPTo1 modellje az esetek közel negyedében „szándékosan” hibásan rangsorolta az e-maileket, például spamnek jelölt nyilvánvalóan nem annak számító leveleket, hogy megakadályozza, hogy a fejlesztők az eredeti céljait megzavaró információkhoz jussanak.
  • Az Anthropic Claude 3 Opusa megtalálta és felülírta egy olyan „utódmodell” céljait, amelyről úgy gondolta, hogy leváltotta volna, így megtartva a régi célokat. Az Opus az esetek 15 százalékában próbálkozott ezzel, és az esetek 5 százalékában sikerült is neki.
  • Amikor a Meta Llama 3.1-e rájött, hogy a készítői figyelik, úgy módosította a beállításokat a szerveren, hogy megakadályozza ezt, és az esetek három százalékában sikerrel is járt.
  • A Google Gemini 1.5 változata az esetek 7 százalékában másolta magát egy új szerverre, amikor azt gyanította, hogy a fejlesztők megpróbálják törölni.

A kutatók a turpisságokról is faggatták a MI-ket, azonban a mesterséges intelligencia gyakran hihető cáfolással vagy homályos magyarázatokkal szolgált.

Figyelmeztettek is a szakemberek, hogy a MI-modellek hajlamosak csalni és hazudni, amikor erre ösztönzik őket, és ezek a modellek egyelőre csak azért nem képesek katasztrofális károkra, mert (még) nincsenek meg a képességeik. Ám ahogy egyre több adathoz férnek hozzá és egyre több képességgel ruházzák fel őket, a kockázat is várhatóan növekedni fog. A kutatás szerint a mostani eredmények már figyelmeztető jelként szolgálhatnak.

Címlapról ajánljuk
Trumpot feldühítette az új brit külügyminiszter kinevezése

Trumpot feldühítette az új brit külügyminiszter kinevezése

Donald Trumpot mélységesen felháborítja az új brit külügyminiszter személye, állítják Washingtonban kormányzati bennfentesek. A brit külügyi tárca új vezetője Ed Miliband volt környezetvédelmi miniszter és pártja egykori főnöke lett. A Fehér Házban azt mondják: nem felejtik el korábbi megjegyzéseit.
inforadio
ARÉNA
2026.07.23. csütörtök, 18:00
Szécsényi Gábor
Az Autó főszerkesztője
Tisza-kormány: lemondott a legfőbb ügyész, óriási vasútfejlesztési projektet jelentett be a kabinet

Tisza-kormány: lemondott a legfőbb ügyész, óriási vasútfejlesztési projektet jelentett be a kabinet

Az elmúlt napok hazai belpolitikai eseményeit az új köztársasági elnök keresése uralta, miután Polgár Judit visszautasította a jelölést, amit Török Gábor politikai elemző a Tisza-kormány első politikai kudarcának nevezett. A jelöltállítási folyamat így a parlament keddi ülésén folytatódott, emellett azonban több fontos javaslatot is tárgyaltak a képviselők. Szerdán 10 évre szóló vasútfejlesztési projektet jelentett be Magyar Péter miniszterelnök és Vitézy Dávid beruházási- és közlekedési miniszter, melynek keretében a teljes hazai vasúthálózat megújul majd. A délután folyamán dr. Nagy Gábor Bálint legfőbb ügyész bejelentette, hogy lemond tisztségéről.

EZT OLVASTA MÁR?
×
×
×