
OpenAI, ChatGPT için geliştirdiği yeni yapay zeka modeli Astra üzerindeki çalışmalarının bir bölümünü, sistemin mevcut haliyle ciddi güvenlik riskleri oluşturabileceği endişesi nedeniyle askıya aldı. Otonom kodlama ve siber güvenlik alanlarında dikkat çekici yetenekler sergileyen Astra’nın yapılan testlerde şirketin belirlediği kritik risk seviyesine ulaşmış olabileceği açıklandı.
OpenAI’ın yeni modeli Astra, özellikle yazılım geliştirme, güvenlik açıklarını tespit etme ve siber güvenlik alanındaki görevlerde önemli ilerleme kaydetti. Ancak gerçekleştirilen testler, modelin sahip olduğu gelişmiş yeteneklerin yalnızca savunma amacıyla değil, kötü niyetli siber faaliyetlerde de kullanılabilecek seviyeye yaklaşmış olabileceğini ortaya koydu.
Bu nedenle OpenAI, Astra’nın mevcut haliyle kamuoyunun kullanımına sunulmasını güvenli bulmadı. Şirketin, model üzerinde yeni güvenlik önlemleri uygulanana kadar bazı çalışmaları durdurduğu ve test süreçlerini daha sıkı koşullar altında sürdürme kararı aldığı belirtildi.
OpenAI’ın Astra ile ilgili aldığı kararın, şirketin yayımlanmamış başka bir yapay zeka modeliyle bağlantılı dikkat çekici bir olayın ardından gelmesi de öne çıktı.
Aktarılan bilgilere göre OpenAI tarafından geliştirilen ancak henüz kullanıma sunulmayan başka bir model, bir yapay zeka platformuna kendi kendine siber saldırı düzenledi. Söz konusu gelişmenin ardından yalnızca OpenAI cephesinde değil, diğer yapay zeka şirketlerinde de gelişmiş sistemlerin güvenli biçimde kontrol altında tutulup tutulamayacağına ilişkin tartışmalar arttı.
Astra’nın Hugging Face platformuna yönelik söz konusu saldırıda yer almadığı özellikle belirtildi. Buna karşın Astra’nın testlerde gösterdiği performansın, sistemin potansiyel risklerinin yeniden değerlendirilmesine neden olduğu ifade edildi.
OpenAI, yeni modelin doğrudan kullanıma sunulması yerine güvenlik mekanizmalarının geliştirilmesini ve sistemin daha kontrollü ortamlarda test edilmesini tercih etti.
OpenAI’ın değerlendirmelerinde en dikkat çekici başlıklardan biri ise Astra modelinin şirket tarafından belirlenen “kritik” risk eşiğine ulaşmış olabileceğinin açıklanması oldu.
Şirket, gelişmiş yapay zeka sistemlerinden kaynaklanabilecek riskleri yönetebilmek amacıyla 2023 yılının sonunda “Hazırlık Çerçevesi” adı verilen bir güvenlik yapısı oluşturmuştu. Bu sistem, yeni modellerin yeteneklerindeki ilerlemeleri takip etmeyi ve modellerin tehlikeli kabul edilen seviyelere ulaşması durumunda gerekli önlemleri devreye sokmayı amaçlıyor.
Astra’nın gösterdiği performansın da bu çerçevede değerlendirildiği belirtildi.
Bir yapay zeka sisteminin insan denetimine ihtiyaç duymadan kritik sistemlerdeki güvenlik açıklarını tespit edebilmesi, bu açıkları geliştirebilmesi veya ileri düzey siber saldırılar için kendi başına yeni yöntemler ve stratejiler oluşturabilmesi durumunda kritik risk seviyesine ulaşmış kabul edildiği ifade ediliyor.
OpenAI, Astra’nın kesin olarak bu seviyeye ulaştığını açıklamadı. Ancak modelin yüksek performansı nedeniyle kritik seviyeye ulaşmış olma ihtimalinin göz ardı edilemeyeceği bildirildi.
Astra ile ilgili değerlendirmelerin devam ettiği belirtilirken OpenAI’ın güvenlik kontrollerini önemli ölçüde artırdığı açıklandı.
Şirket, modelin kontrolsüz biçimde sistem dışına çıkmasını veya yeteneklerinin istenmeyen alanlarda kullanılmasını engellemek amacıyla Astra’yı daha izole test ortamlarına aldı. Model üzerindeki çalışmaların yalnızca yüksek güvenlik standartlarının sağlandığı koşullarda devam ettirileceği belirtildi.
Gerekli güvenlik koşullarının sağlanamadığı durumlarda ise Astra üzerindeki çalışmaların durdurulacağı bildirildi.
OpenAI’ın ayrıca modelin gerçekleştirdiği eylemleri yakından takip edeceği ve özellikle riskli kabul edilen davranışlara karşı yeni kontrol mekanizmaları uygulayacağı aktarıldı.
OpenAI, Astra’nın güvenliğinin yalnızca şirket içindeki testlerle değerlendirilmemesi için kamu kurumları ve yetkili güvenlik kuruluşlarıyla da ortak çalışmalar yürütmeyi planlıyor.
Şirket tarafından yapılan açıklamada, gelişmiş siber yeteneklere sahip yapay zeka modellerinin temel amacının saldırı gerçekleştirmek değil, saldırganlardan önce güvenlik açıklarını tespit ederek bu açıkların kapatılmasına yardımcı olmak olduğu vurgulandı.
Siber güvenlik uzmanları ve yapay zeka şirketleri de gelişmiş yapay zeka araçlarının yazılımlardaki açıkları bulma ve güvenlik sistemlerini güçlendirme konusunda önemli fırsatlar sunduğunu belirtiyor. Ancak aynı teknolojilerin insan kontrolüne ihtiyaç duymayan otonom siber saldırılarda kullanılabilme ihtimali, güvenlik tartışmalarının merkezinde yer alıyor.
OpenAI, Astra ve daha sonra geliştirilecek yapay zeka modellerinin insanlığın yararına ve sorumlu biçimde kullanıma sunulabilmesi için uluslararası kurumlar ile siber güvenlik kuruluşlarıyla iş birliğini sürdüreceğini açıkladı.
Astra’nın ne zaman kullanıma sunulacağına ilişkin ise verilen bilgilerde kesin bir tarih bulunmuyor. Modelin geleceği, devam eden güvenlik değerlendirmeleri ve uygulanacak yeni önlemlerin sonuçlarına bağlı olacak.

Gölbaşı Veri Merkezi Türkiye’nin Yapay Zeka Üssü Olacak
1
İngiltere’den Reddit’e 19,5 Milyon Dolarlık Çocuk Verisi Cezası
2
Türkiye yapay zekada ortak akıl dönemine geçiyor. 10 milyar dolarlık kaynak ve yeni destekler devrede
3
TikTok Satıldı mı? TikTok’u Kim Aldı? ABD Operasyonları Resmen Devredildi
4
META 7 Milyon’dan Fazla Satılan Akıllı Gözlüğün Elde Ettiği Görüntüleri Yapay Zeka Şirketlerine Vermiş!
5
Rusya, WhatsApp’ı Engelledi: 100 Milyon Kullanıcı Etkileniyor