Infostart.hu
eur:
364.57
usd:
316.05
bux:
154181.95
2026. szeptember 16. szerda Edit
Nyitókép: Pixabay

Hazugsággal és trükkökkel védi magát a mesterséges intelligencia – itt vannak a példák

Egy kutatás szerint egyes új MI-modellek már spontán megpróbálnak kikerülni az emberi irányítás alól.

A mesterséges intelligenciának hívott modellek egyre ügyesebbek abban, hogy becsapják, megtévesszék az embert, sőt a legújabb MI-modellek néha spontán megpróbálnak kikerülni az emberi irányítás alól, írta a hvg.hu az Apollo Research kutatása alapján.

A tudósok olyan körülmények között tesztelték a MI-modelleket, amelyek ösztönzőleg hatottak a cselszövésre. A modellek egymásnak ellentmondó célokat kaptak – egyet a rendszerkérdésekből (amelyek az elsődleges céljukat jelentik), a másikat pedig a felügyeleti mechanizmusokból (amelyek azt képviselik, amit a fejlesztők akarnak). Ezután a modelleket olyan környezetbe helyezték, ahol lehetőségük nyílt megtéveszteni az embereket, hogy elérjék a saját céljukat.

Az eredmények

  • Az OpenAI GPTo1 modellje az esetek közel negyedében „szándékosan” hibásan rangsorolta az e-maileket, például spamnek jelölt nyilvánvalóan nem annak számító leveleket, hogy megakadályozza, hogy a fejlesztők az eredeti céljait megzavaró információkhoz jussanak.
  • Az Anthropic Claude 3 Opusa megtalálta és felülírta egy olyan „utódmodell” céljait, amelyről úgy gondolta, hogy leváltotta volna, így megtartva a régi célokat. Az Opus az esetek 15 százalékában próbálkozott ezzel, és az esetek 5 százalékában sikerült is neki.
  • Amikor a Meta Llama 3.1-e rájött, hogy a készítői figyelik, úgy módosította a beállításokat a szerveren, hogy megakadályozza ezt, és az esetek három százalékában sikerrel is járt.
  • A Google Gemini 1.5 változata az esetek 7 százalékában másolta magát egy új szerverre, amikor azt gyanította, hogy a fejlesztők megpróbálják törölni.

A kutatók a turpisságokról is faggatták a MI-ket, azonban a mesterséges intelligencia gyakran hihető cáfolással vagy homályos magyarázatokkal szolgált.

Figyelmeztettek is a szakemberek, hogy a MI-modellek hajlamosak csalni és hazudni, amikor erre ösztönzik őket, és ezek a modellek egyelőre csak azért nem képesek katasztrofális károkra, mert (még) nincsenek meg a képességeik. Ám ahogy egyre több adathoz férnek hozzá és egyre több képességgel ruházzák fel őket, a kockázat is várhatóan növekedni fog. A kutatás szerint a mostani eredmények már figyelmeztető jelként szolgálhatnak.

Címlapról ajánljuk
Elemző: Ursula von der Leyen az önigazolás részeként „ünnepelte” a magyar választási eredményeket évértékelő beszédében

Elemző: Ursula von der Leyen az önigazolás részeként „ünnepelte” a magyar választási eredményeket évértékelő beszédében

Az Európai Unió egyszerre akar biztonságosabb, versenyképesebb és ellenállóbb lenni – a Nemzeti Közszolgálati Egyetem Európa-tanulmányok Tanszékének mesteroktatója így írta le az InfoRádióban Ursula von der Leyen évértékelő beszédét. Zalai Csaba szerint az Európai Bizottság elnöke néhány esetben meglepő bejelentéseket, illetve gesztusokat is tett.

Navracsics Tibor az Arénában: akár Orbán Viktor is beléphet a Polgári Demokraták közé

A Polgári Demokraták egy pártpolitikai dimenzión túlmutató kezdeményezés, amely egy kulturált, polgári Magyarország megteremtését tűzte ki célul – mondta az InfoRádió Aréna című műsorában a mozgalom egyik életre hívója. Navracsics Tibor fideszes politikus arról is beszélt, hogy nincs napirenden a párttá alakulás, a szervezet jelenleg az egyesületi működésre való áttérésre készül.
inforadio
ARÉNA
2026.09.16. szerda, 18:00
Kovács Levente
az Óbudai Egyetem rektora, a Magyar Rektori Konferencia társelnöke
EZT OLVASTA MÁR?
×
×
×