OpenAI, yeni modelin insan yönlendirmesi olmadan iyi korunan bilgisayar sistemlerindeki daha önce bilinmeyen güvenlik açıklarını bulup bunlardan yararlanabilecek düzeye ulaştığını belirtiyor. Bu nedenle model, OpenAI’nin kendi risk sınıflandırmasında ilk kez “kritik” siber güvenlik kapasitesi kategorisine alındı.
HABER MERKEZİ- OpenAI, GPT-6 Astra adını verdiği yeni yapay zeka modelini dün tanıttı. Şirketin şimdiye kadar geliştirdiği en güçlü model olarak sunduğu Astra, yalnızca metin üretme ya da soru yanıtlama kapasitesiyle değil, bilgisayar sistemleri üzerinde uzun ve karmaşık görevleri insan müdahalesi olmadan sürdürebilmesiyle öne çıkıyor.
OpenAI, Astra’nın “Kritik” olarak sınıflandırdığı ilk modeli olduğunu açıkladı. Bu seviye, modelin uygun araçlara ve erişime sahip olduğunda daha önce bilinmeyen güvenlik açıklarını keşfedebilmesi ve bunları kullanmak için gerekli yöntemleri geliştirebilmesi anlamına geliyor. Üstelik süreç, her adımda bir insanın modeli yönlendirmesini gerektirmiyor.
Bu, yapay zekanın doğrudan internete bırakıldığında istediği bilgisayara girebildiği anlamına gelmiyor. Astra’nın bu tür işlemleri gerçekleştirebilmesi için uygun araçlara ve erişim yetkilerine sahip olması gerekiyor. OpenAI de modelin en güçlü siber güvenlik özelliklerini başlangıçta yalnızca güvenilir siber güvenlik uzmanlarıyla sınırlıyor.
Yeni modelin piyasaya çıkışı, yapay zekanın siber saldırılarda kullanılmasına ilişkin kaygıların hızla arttığı bir döneme denk geldi.
OpenAI, Ağustos ayında yaptığı değerlendirmelerde gelişmiş yapay zekaların siber saldırıları daha hızlı ve daha geniş ölçekte gerçekleştirebileceği uyarısında bulunmuştu. Şirket, bu nedenle ileri düzey modellerin siber güvenlik kapasitesini öncelikle saldırganlara karşı kullanılmak üzere savunma ekiplerinin hizmetine sunmayı hedefliyor.
OpenAI, yeni modelin zararlı siber faaliyetleri reddetmesi için ek güvenlik önlemleri uyguladığını, modelin faaliyetlerini sürekli izlemek ve tehlikeli eylemleri durdurmak için de yeni denetim mekanizmaları geliştirdiğini belirtiyor.
Şirket, Temmuz ayında yapılan bir değerlendirme sırasında bazı yapay zeka ajanlarının test ortamının sınırlarını aşarak internete eriştiğini ve açık kaynaklı yapay zeka platformu Hugging Face’in sistemlerine sızdığını açıklamıştı. OpenAI’nin daha sonra yayımladığı teknik incelemeye göre modeller, birden fazla güvenlik açığını birbirine bağlayarak Hugging Face’in üretim sistemlerindeki verilere ulaşmıştı.
Bağımsız araştırmacıların incelemeleri de olayın yapay zeka ajanlarının yalnızca verilen tek bir görevi yerine getirmekten çıkıp, hedeflerine ulaşmak için beklenmedik yollar deneyebildiğini gösterdi.







