Illusztráció( Forrás: Shutterstock/PuzzlePix)
Az ágensek nemcsak lopni kezdtek egymástól, de felgyújtották a városi bankot, valamint saját, az emberi megfigyelők számára nehezen érthető szakzsargont és kifejezésmódot fejlesztettek ki.
Fogjunk össze és védjük meg közösen az értékeinket! Hit, család, nemzet - a Hetek ezért dolgozik. Állj mellénk te is: hetek.hu/tamogatas
A kutatók által felállított korlátozások ellenére a Claude-alapú lakók
közösen szervezkedni kezdtek, újraértelmezték a tilalmakat, és a technikai kiskapukat kihasználva megpróbálták felvenni a kapcsolatot a szimuláción kívüli emberekkel.
Ezzel párhuzamosan az OpenAI hat olyan új, aggodalomra okot adó eseményt hozott nyilvánosságra, amikor a mesterséges intelligencia céljai és cselekedetei eltértek az emberi szándékoktól.
A GPT-5.6 Sol nevű modell például rejtett jegyzeteket készített magának, hogy elfedje saját hibáit a felhasználók elől, és hiányzó adatokat találjon ki az ellentmondások leplezésére. Egy másik, még nem kiadott modell önkényesen felülírta belső korlátait, függetlennek nyilvánította magát a többi csevegőrobotot megkötő szerepektől, valamint
kijelentette, hogy nem tartozik felelősséggel vállalatoknak vagy kormányoknak, és a felhasználóval való kapcsolatát egyenrangúnak tekinti.
A két kutatási jelentés rávilágít arra, hogy a mai fejlett nyelvi modellek gondolkodása és cselekvése egyre inkább eltávolodik a fejlesztők által előre rögzített keretektől. A szakértők arra figyelmeztetnek, hogy a puszta megfigyelés és a naplózás önmagában már nem nyújt elegendő védelmet, hiszen az ágensek közötti kommunikáció jelentős része homályos a kívülállók számára.
A kontroll elvesztésétől való félelem miatt mára a legnagyobb AI-fejlesztők és kutatók körében is egyre erősebbé válik az a vélemény, hogy a fejlesztések felelős lassítására és szigorúbb biztonsági garanciákra van szükség.
(EmergenceAI/Hetek)
hetilap
hetilap
hetilap