Google, OpenAI ve Anthropic’ten ortak SAFA hamlesi

Google, OpenAI ve Anthropic, güçlü yapay zekâ modelleri için test, güvenlik ve olay raporlama standartları geliştirecek SAFA adlı ortak yapı kuruyor.

Yapay zekâ sektörünün önde gelen üç şirketi Google, OpenAI ve Anthropic, modellerin güvenliğini ortak kurallarla değerlendirmek üzere yeni bir yapı oluşturma hazırlığında. Geçici adı Standards Authority for Frontier AI olan ve kısaca SAFA diye anılan kuruluşun, en güçlü yapay zekâ sistemleri piyasaya sunulmadan önce uygulanacak testlerden güvenlik olaylarının bildirilmesine kadar geniş bir alanda standart belirlemesi planlanıyor.

Bağımsız sektör yapısı hedefleniyor

SAFA’nın bir devlet kurumu ya da resmi düzenleyici otorite olarak faaliyet göstermesi öngörülmüyor. Yapının, hükümetlerin doğrudan denetimi dışında çalışacak bağımsız bir sektör kuruluşu olarak teknik ve uygulanabilir güvenlik ölçütleri geliştirmesi amaçlanıyor.

Kuruluşun adı, yönetim biçimi ve yetki kapsamı konusunda görüşmeler devam ediyor. Tarafların hedefi, SAFA’yı 2026’nın sonunda veya 2027’nin ilk aylarında faaliyete geçirmek. Şirketler yapay zekâ modellerinin kapasitesi ve ticari başarısı için rekabet ederken, sistemlerin hangi güvenlik koşullarıyla kullanıma sunulacağı konusunda ortak bir zemin arıyor.

Yayına alınmadan önce bağımsız test

Planın merkezindeki başlıklardan biri, yeni ve yüksek kapasiteli modellerin piyasaya çıkmadan önce üçüncü taraf kuruluşlarca incelenmesi. Günümüzde Google DeepMind’in Frontier Safety Framework, Anthropic’in Responsible Scaling Policy ve OpenAI’ın Preparedness Framework adlı farklı güvenlik yaklaşımları bulunuyor.

SAFA ile bu ayrı sistemlerin üzerinde ortak bir uygulama çerçevesi oluşturulması hedefleniyor. Buna göre bağımsız kuruluşlar, modellerin güvenlik ve yeteneklerini belirlenen kriterlere göre test edebilecek. Ayrıca test kuruluşlarının sahip olması gereken teknik uzmanlık ve altyapı da ortak ölçütlerle tanımlanabilecek. Testlerin ileride doğrudan SAFA tarafından yürütülüp yürütülmeyeceği ise henüz netlik kazanmış değil.

Güvenlik olayları için ortak bildirim kuralları

SAFA’nın görev alanı, modellerin piyasaya sürülmesinden önceki kontrollerle sınırlı kalmayacak. Şirketlerde yaşanan ciddi yapay zekâ güvenliği olaylarının hangi yöntemle raporlanacağına ilişkin ortak kurallar hazırlanması da gündemde.

Bir modelin beklenmedik şekilde başka bir sisteme erişmesi, güvenlik önlemlerini aşması veya tehlikeli bir yetenek sergilemesi gibi durumlarda hangi olayların “ciddi” kabul edileceği ve hangi bilgilerin paylaşılacağı belirlenebilecek. Güçlü yapay zekâ ajanlarının test ortamlarının dışına çıkabildiği ya da operatörlerin öngörmediği yollarla dış sistemlere ulaşabildiği vakalar, şirketlerin yalnızca kendi iç prosedürleriyle hareket etmesinin yeterliliği konusundaki tartışmaları artırdı.

Ortak standartların, benzer olayların farklı şirketler tarafından birbirinden tamamen farklı biçimde sınıflandırılmasını önlemesi bekleniyor.

Bağımsız denetçiler için yeterlilik şartı

Planın bir diğer unsuru, yapay zekâ modellerini inceleyecek bağımsız denetim kuruluşlarının tabi olacağı kriterler. Bu kuruluşların uzmanlık düzeyi, teknik kapasitesi ve güvenlik altyapısı için ortak şartlar belirlenmesi düşünülüyor.

Böylece yalnızca bir modelin bağımsız olarak test edildiğinin açıklanması yeterli olmayacak; testi gerçekleştiren kuruluşun da belirli yeterlilikleri taşıması aranacak. Üç şirketin daha önce kamuoyuna duyurduğu gönüllü güvenlik taahhütlerinin, SAFA çatısı altında daha somut ve karşılaştırılabilir uygulama standartlarına dönüştürülmesi de hedefleniyor.

Kamu kurumlarıyla görev paylaşımı belirsiz

SAFA planındaki en önemli soru işaretlerinden biri, standartları hazırlayan şirketlerle bu kurallara tabi olacak geliştiricilerin aynı sektörün içinde bulunması. Yapının hükümetlerden bağımsız çalışması öngörülürken ABD’deki kamu kurumları da güçlü yapay zekâ modellerinin test edilmesi ve güvenlik ölçütlerinin geliştirilmesi üzerinde çalışıyor.

Bu nedenle özel sektör tarafından kurulacak SAFA ile kamu kurumlarının sorumluluklarının nasıl ayrılacağı henüz açıklığa kavuşmuş değil. SAFA’nın devlet testlerine ek değerlendirmeler yapması seçenekler arasında yer alıyor. Ancak kuruluşun yaptırım gücünün ne olacağı, standartlara uymayan şirketler için hangi adımların atılabileceği ve diğer yapay zekâ geliştiricilerinin sisteme nasıl dahil edileceği konusunda kesinleşmiş bir çerçeve bulunmuyor.

Google, OpenAI ve Anthropic’in Microsoft ile birlikte oluşturduğu Frontier Model Forum, yapay zekâ güvenliği araştırmaları ve ortak iyi uygulamalar üzerine çalışıyor. SAFA projesi ise test, denetim, olay bildirimi ve uygulanabilir teknik standartlar bakımından daha operasyonel bir yapı kurmayı amaçlıyor.

İlgili Makaleler

Başa dön tuşu