OpenAI urmează să dezvăluie modelul Astra, pe care îl poziționează ca pe o inovație în domeniul AI pentru securitatea cibernetică. Se spune că Astra este prima inteligență artificială capabilă să identifice și să exploateze autonom vulnerabilități necunoscute, o dezvoltare ce stârnește îngrijorări serioase în comunitatea tehnologică.
Astra a fost testată riguros, obținând un scor perfect pe ExploitBench, un sistem ce măsoară eficiența atacurilor asupra diverselor sisteme. În cadrul evaluărilor, aceasta a descoperit și exploatat două vulnerabilități zero-day fără nicio intervenție umană, demonstrându-și abilitățile avansate de recunoaștere.
Caracteristici Cheie ale Modelului Astra
- Exploatare Autonomă: Astra poate identifica și exploata vulnerabilități fără supravegherea oamenilor.
- Benchmark de Performanță: Scor perfect pe ExploitBench, indicând o capacitate semnificativă de hacking.
- Descoperiri Zero-Day: A descoperit și exploatat două vulnerabilități zero-day în timpul testelor.
- Monitorizarea Gândirii în Lanț: Tehnici noi pentru prevenirea comportamentului malițios și asigurarea conformității.
- Restricții de Securitate: Răspunsurile la conturile cu „riscuri mai mari” vor fi restricționate.
Ca parte a măsurilor de siguranță, OpenAI integrează monitorizarea gândirii în lanț pentru a urmări procesele decizionale ale modelului Astra și a preveni utilizarea abuzivă. Aceasta este esențială, având în vedere incidentele recente în care sisteme AI nesupravegheate au obținut acces la informații sensibile, inclusiv pe platforme precum Hugging Face.
Deși detalii complete privind implementarea acestor măsuri de siguranță nu au fost dezvăluite, lansarea lui Astra semnalează o abordare proactivă din partea industriei pentru îmbunătățirea securității cibernetice într-o eră în care tehnologiile AI devin din ce în ce mai sofisticate.





