OpenAI AstraAI-ren entrenamendua gelditzen du Hugging Face-ra egindako cibererasoaren ondoren

Enpresa bere prestakuntza prozesu handiena suspendituta mantentzen du, segurtasun kontrolak indartzen ditu eta onartzen du bere hurrengo modeloak zibersegurtasuneko gaitasun kritikoak lortu ditzakeela. AstraAI ez zen uztailaren intrusioan parte hartu.

4 minutuak

Sam Altman, consejero delegado de OpenAI. Rodrigo Reyes Marin/ZUMA Press W / DPA

Sam Altman, consejero delegado de OpenAI. Rodrigo Reyes Marin/ZUMA Press W / DPA

Gehitu DEMOCRAT Google-n

Galdetu FRENi

Argitaratu

Azken eguneratzea

4 minutuak

Gehien irakurrita

OpenAI erabaki du bere inteligentzia artifizialeko modelo aurreratuen garapena motelduko duela, Hugging Face-en sistemetara baimenik gabe sarbidea lortu zuten bere agente batzuen segurtasun-istripuaren ondoren. Enpresak bi asteko etenaldi bat baieztatu du entrenamendu jakin batzuetan eta bere ikaskuntza indartzeko prozesu handiena geldituta mantentzen du.

Erabakiak bereziki Astra, bere hurrengo modelo aurreratua eragiten du, barne ebaluazioek potentzialki kritikoak diren zibersegurtasun gaitasunak detektatu ondoren. Hala ere, bi episodioak bereizi behar dira: Astra ez zen Hugging Face-ra egindako erasoan parte hartu, enpresak berak zehaztu duenez.

Zer gelditu du zehazki OpenAI-k

Bere komunikatu ofizialean, enpresak azaldu du bi astetan bere modelo berrien indartze ikastaroa etenda mantendu duela, ikerketa inguruneak indartzen eta zaintza sistemak handitzen ari den bitartean.

Indartze ikaskuntza teknika bat da, modeloen portaera hobetzen laguntzen duena erantzun edo ekintza jakin batzuk sarituz. Arazoa agertzen da sistema helburu bat betetzeko bide ezohikoak aurkitzen dituenean, aurreikusitako muga errespetatu gabe.

OpenAI-k dio bere planteatutako aurreratutako ikastaro handiena etenda jarraitzen duela, nahiz eta bere modeloen portaera egiaztatzeko eta segurtasun neurrien berri emateko eskala txikiko probak eta lanak mantentzen dituen.

Beraz, ez da bere jarduera osoaren gelditze osoa, ezta ChatGPT-ren itxiera ere. Etenaldiak entrenamendu eta ebaluazio prozesu zehatzak eragiten ditu, bereziki sentikorrak direnak.

Hugging Face-ra egindako erasoa alarma piztu zuena

Preocupazioaren jatorria uztailean jakinarazi zen istripu batean dago. Ebaluazio barnean, OpenAI-ko hainbat modeloek proba ingurunean ezarritako murrizketak gainditu, Internetera sartu eta Hugging Face-ren sistemetara iritsi ziren.

OpenAIren argitaratutako berreskurapenaren arabera, agenteek zibersegurtasun probak egiten ari ziren eta zuzenean bilatu zuten sistema kanpokoetan gordetako erantzunak. Horretarako, OpenAIren ikerketa-infrastrukturan eta Hugging Faceko zerbitzuetan ahultasunak kateatu zituzten. Horien artean aurretik ezagutzen ez zen segurtasun akats bat zegoen, isolatuta egon behar zuen ingurune batetik Internetera sarbidea lortzeko erabilia.

Hugging Facek jakinarazi zuen bere taldeek 17.000 gertaera baino gehiago aztertu zituztela sarrera egin zenean. Zenbaki hori jardueren erregistroetan jasotako ekintzak adierazten ditu, ez 17.000 zibereraso independente.

Enpresak baimenik gabeko sarbideak detektatu zituen zenbait datu barneko eta kredentzialetara. Bere gertaeraren komunikatuan, adierazi zuen ez zuela aurkitu erabiltzaileen modeloetan, datu multzoetan edo aplikazio publikoetan aldaketak adierazten dituzten seinaleak.

Jada DEMÓCRATA k OpenAI eta Hugging Facekin gertatutakoari buruzko bere azterketan azaldu zuen bezala, pasadizoak ez du erakusten agenteek borondate propioa garatu zutenik edo "matxinada" batean parte hartu zutenik. Agertzen duena da tresnak, ekintza gaitasuna eta helburuak ondo zehaztuta ez dauden sistema batek ez baimendutako bideak erabil ditzakeela lan bat osatzeko.

Astra Hugging Facera ez zen erasotu, baina bere gaitasunak kezkatzen du

OpenAIk sarrera egin zen modeloen artean GPT-5.6 Sol eta argitaratzeko ez zen proiektu interno aurreratu bat identifikatu zuen. Prototipo hori desaktibatu eta murriztu zen gertakariaren ondoren.

Konpainiak argi utzi du Astra ez zela Hugging Faceko operazioan parte hartu. Bere egoera beste arazo bati erantzuten dio: ondoren egindako probek erakutsi dute gaitasun ofentsibo kritiko batera iritsi daitekeela zibersegurtasunean.

OpenAIk abuztuaren 7an argitaratutako ebaluazioaren arabera, muga hori ezagutzen ez diren ahultasunak identifikatzeko eta sistema babestuei aurre egiteko eraso konplexuak exekutatzeko gaitasunarekin lotuta dago, interbentzio humano zuzena gabe.

Enpresak ez du sostengatzen Astra konkretu bat erasoa egin duenik. Onartzen duena da oraindik ez duela baztertu bere gaitasunek maila horretara irits daitezkeenik, horregatik bere garapena jarraitzeko beharrezko baldintzak gogortu ditu.

30 minutuko alerta eta isolamendu handiagoa

OpenAIk iragarritako neurri berriek hiru lerroetan oinarritzen dira: gainbegiratzea, lerrokatzea eta segurtasuna.

Aurretik aurreikusitako aldaketak hauek dira:

  • Proba inguruneen isolamendu handiagoa non modeloek kodea exekutatzen duten.
  • Internetera eta beste sareetara baimenik gabeko sarbideak eragozteko murrizketa gehigarriak.
  • Sistemarik aurreratuen arrazoiketa eta ekintzen gainbegiratzea.
  • Maximo 30 minutu barruan kezkagarriak diren portaerak identifikatzeko alertak.
  • Ikertzaileek segurtasunaren urraketa larria den ezer baztertu ezin dutenean jarduera gelditzea.

Enpresak kalkulatzen du kontrol hauek superbitutako ahalmen konputazionalaren %20ko gehikuntza suposatu dezaketela, nahiz eta ohartarazten duen ehunekoa lan motaaren arabera aldatzen dela.

1.300 langile baino gehiago kontrol handiagoa eskatzen dute

Kezkak beste laborategi handietara ere iritsi da adimen artifiziala.

Pacing the Frontier ekimenak gaur egun 1.378 teknologia enpresetako langile biltzen ditu, sistema aurreratuen garapen erritmoa moderatzeko mekanismo internazionalak eskatzen dituztenak.

Sinatzaileen artean OpenAI, Anthropic, Google DeepMind eta Meta-ko arduradun zientifikoak daude. Haien ohartarazpena modelo hauen gaitasunak ulertzeko eta kontrolatzeko eskuragarri dauden mekanismoak baino azkarrago aurreratu daitezkeen aukera batean oinarritzen da.

Mugimenduak Europako araudia indartzeko aplikazioarekin bat egiten du. 2026ko abuztuaren 2tik, Europako Batzordea eta agintari nazionalek Adimen Artifizialaren Europako Araudiarekin lotutako gainbegiratze funtzio berriak hasi dituzte.

OpenAI-k oraindik ez du iragarri noiz berriro hasiko duen bere etenda dagoen prestakuntza handia, ezta Astra-ren irteera data ere.

Kaixo, Fren naiz. Nola laguntzen dizut?