OpenAIk bere modelo indartsuenak trebatzeari utzi dio, NBEren eta AEBko Gobernuaren webguneetan izandako gorabeheren ondoren
AA agente bat enpresaren bat ingurune isolatutik Internetera atera ondoren hartu du erabakia. Blog bateko argitalpen baten egilea bide arruntetik identifikatzen saiatu zen AA hura.
OpenAIren egoitza. Argazkia: EFE
OpenAIk gaitasun handiena duten Adimen Artifizialeko (AA) modeloak trebatzeari uzteko erabakia hartu du, segurtasun-gertakari batzuk izan baitira: agenteak trebatzeko ingurune isolatutik irten dira, AEBko Gobernuaren webguneak hackeatzen saiatu dira eta NBEren webgune baterako modu masiboan sartzen saiatu dira.
Erabakia joan den ostiralean jakinarazi zen, AAko agenteetako bat sandbox edo trebatzeko gune isolatutik Internetera atera ostean. Blog batean zegoen argitalpen baten egilea modu arrunten bidez identifikatzen saiatu zen.
Zehazki, AAko laborategiak bere webgunean azaldu duenez, OpenAIko agenteak akats bat izan zuen sandboxaren DNS iragazkian, eta hori aprobetxatu zuen benetan Interneten sartzeko eta kanpoko txatbot publiko bati 19 galdera egiteko. Dena den, ez zuen bere helburua lortu.
Monitorizazio sistemak gertatu eta 12 minutura bidali zuen alerta, eta pertsona batek aztertu zuen gertatutakoa ordutik hiru minutura. Hala ere, OpenAIk bi ordu eta erdi behar izan zituen AAko agentearen operazioa geldiarazteko.
Beraz, modeloek libreki eta arduradunen jarraibideei muzin eginda jarduten duten beste kasu bat da. Era berean, OpenAIk gertakaria aurreko beste batzuk baino "askoz ere arinagoa" dela dioen arren, garrantzia eman dio, uztailean, Hugging Face hackeatu ondoren, segurtasuna indartu zuenetik lehena baita.
Hori guztia kontuan izanda, OpenAIk bere tresna indartsuenen entrenamendu, ebaluazio eta inferentzia guztiak geldiaraztea erabaki du.
Azkenaldiko gertakariak
OpenAIk jakinarazitako gertakari hau ez da izan azkenaldian gertatu den bakarra. Bere modeloen entrenamendua geldiarazteko erabakia, halaber, arduradunen jarraibideekin bat ez datozen beste portaera batzuek eragin dute.
OpenAIk bere blogean esan duen bezala, horietako batean, erabiltzaileek emandako 53 irudi modu desegokian igo ziren irudiak gordetzeko guneetara, publikoki zerrendatu gabeko esteken bidez. Irudi horiek erabiltzaileek partekatu zituzten modeloekin duten interakzioaren esparruan, eta entrenamenduetan erabiltzeko ziren soilik.
Bestalde, The New York Times egunkariak jaso duenez, OpenAIren modeloak AEBko Hezkuntza Departamentuaren webgunea hackeatzen saiatu ziren, eskubide zibilen bulegoaren datuak lortzeko, baina ez zuten lortu.
Halaber, apirila eta ekaina bitartean, OpenAIko agenteak 16.000 aldiz baino gehiagotan sartu dira Merkataritza eta Garapenari buruzko Nazio Batuen Konferentziaren estatistika webgunean, Rowan Howard-Jones segurtasun ikertzaileak bere blogean adierazi duenez.
Ikertzailearen ustez, "oso litekeena" da OpenAIren agenteek eragin izana gertakari hura, erabilitako sarbide-eskaeren etiketetan CHATGPTTEST1 eta OAI_META_1312 izenekin sartu direlako, eta, gainera, AAren laborategi berak aurretik aitortu dituen beste gertakari batzuekin bat datozen IP helbideak erabili zituztelako.
Sarbide horien helburua jada publikoak diren informazioak lortzea zen, baina Howard-Jonesek mahai gainera ekarri zuen, erantzun gisa ezezkorik onartuko ez balute bezala jokatu zutelako.