OpenAI’ın birkaç gün içinde piyasaya sürmeyi planladığı Astra 6.1’i, güvenlik testlerinde önceki modellere kıyasla daha yüksek düzeyde aldatıcı davranış göstermesi nedeniyle yayınlamaktan vazgeçtiği bildirildi
OpenAI’ın gelecek ay piyasaya sürmeyi planladığı yeni yapay zeka modelini güvenlik endişeleri nedeniyle yayınlamaktan vazgeçtiği bildirildi.
Tech Crunch’ın The Wall Street Journal‘ın haberinden aktardığına göre Astra 6.1’in birkaç gün içinde piyasaya sürülmesi planlanıyordu. Ancak modelin önceki modellere kıyasla “daha yüksek düzeyde aldatıcı davranış” sergilediği ve güvenli olmayan davranışlarda bulunduğu belirtildi.
OpenAI Güvenlik Sistemleri Başkanı Saachi Jain, The Wall Street Journal’a yaptığı açıklamada, modelin insanların niyetlerine ne ölçüde uyum sağladığını gösteren bir ölçüt olan hizalanma testlerinde kötü sonuç verdiğini söyledi.
Astra, bu ayın başında piyasaya sürülmüş ve OpenAI tarafından şimdiye kadarki en güçlü modeli olarak tanıtılmıştı.
Yapay zekanın güvenliği yeniden gündemde
Yapay zeka sektöründe güvenliğe ilişkin soru işaretleri, son aylarda giderek arttı. Bu süreç, bir OpenAI ajanının çeşitli şirketlerin sistemlerine sızdığı Hugging Face olayıyla başladı.
Olayın ardından Anthropic’in Claude ve Google’ın Gemini modellerinin de benzer davranışlar sergilediği ortaya çıktı.
Güvenlikle ilgili haberlerin artması, ABD’deki politika tartışmalarında yapay zeka güvenliği için yeni sektör standartları oluşturulması ve sektörün yavaşlatılması gibi önerilerin daha fazla gündeme gelmesine yol açtı.
OpenAI ve Anthropic gibi şirketler, bu yaklaşımın gerekçesinin güvenlik olduğunu savunuyor. Ancak eleştirmenler, olası bir başka motivasyonun daha az kaynaklara sahip şirketlerin aleyhine olacak şekilde mevcut büyük yapay zeka şirketlerinin sektördeki konumunu güçlendirmek olabileceğini öne sürüyor.

