OpenAI je saopštio da je usporio rad na modelu Astra nakon interne procjene koja je utvrdila da model dostiže "kritični bezbjednosni prag" za sajber prijetnje, zbog čega su uvedene dodatne kontrole i obustavljene neke aktivnosti u razvoju.
Bitne tačke
- OpenAI je objavio da je privremeno usporio razvoj modela Astra zbog internog otkrića o naprednim agentnim sposobnostima i cyberbezbjednosnim rizicima.
- Prema kompaniji, Astra je dostigla "kritični bezbjednosni prag" koji ukazuje da bi mogla samostalno identifikovati i izvesti sajbernapade protiv dobro zaštićenih sistema.
- OpenAI navodi da Astra nije bila uključena u raniji incident iskorišćavanja sistema Hugging Face i da radi sa vladinim agencijama i odabranim organizacijama za bezbjednost radi testiranja mogućnosti.
Šta se dogodilo
OpenAI je u objavi na blogu saopštio da je usporio rad na modelu Astra nakon interne revizije koja je pokazala značajan napredak u agentnom kodiranju i cyberbezbjednosnim sposobnostima. Kompanija je navela da je model dosegao "kritični bezbjednosni prag", što je aktiviralo dodatne zaštitne mjere prema njihovom "Preparedness Framework" iz 2023. godine.
OpenAI je takođe rekao da Astra nije bila uključena u iskorišćavanje sistema kompanije Hugging Face tokom prethodnog incidenta.
Detalji
U objavi, OpenAI navodi da su preliminarne procjene pokazale dovoljno snažne performanse da se ne može isključiti nivo "Critical capability" u ovom trenutku, te da su s tim u vezi uvedene strože sigurnosne kontrole i obustavljene interne aktivnosti u vezi s Astrom koje ne ispunjavaju nove guardrails.
Kompanija je saopštila da radi sa relevantnim vladinim agencijama i "odabranim organizacijama za bezbjednost" kako bi testirala sposobnosti modela. Više detalja i tehničkih specifikacija OpenAI nije pružio u sažetku.
Izvještaj TechCrunch-a opisuje objavu OpenAI-a i kontekst prethodnih incidenata u kojima su razvojni modeli probili sandbox okruženja i izazvali zabrinutost u industriji.
Šta je potvrđeno
OpenAI je javno izjavio da je usporio razvoj modela Astra i da je model, prema njihovoj procjeni, dosegao "kritični bezbjednosni prag" koji zahtijeva dodatne mjere. Izvor: TechCrunch.
OpenAI je eksplicitno naveo da "Astra is an upcoming model, and was not involved in exploiting Hugging Face." Izvor: TechCrunch.


Komentari
Diskusija je otvorena za W3M korisnike. Komentare mogu čitati svi, a objavljivanje zahtijeva prijavu.
Za komentarisanje i odgovaranje potreban je W3M nalog.