Yapay zeka uzmanları, önde gelen yapay zeka şirketlerini temel güvenlik alanlarında değerlendiriyor.
Yapay Zeka Güvenlik Endeksi nedir? Önde gelen yapay zeka sistemleri hızla gelişiyor ve modeller daha otonom, yetenekli ve potansiyel olarak kendi kendini geliştiren hale geldikçe, mevcut zararlar ve uzun vadeli kontrol edilebilirlik hakkında giderek daha acil sorular ortaya çıkıyor. Yetenekler arttıkça, bu sistemlerin sunduğu fırsatlar ve oluşturdukları riskler de buna paralel olarak genişliyor. Geleceğin Yaşamı Enstitüsü tarafından bağımsız bir teknik ve yönetim uzmanları paneliyle geliştirilen Yapay Zeka Güvenlik Endeksi, önde gelen yapay zeka şirketlerinin bu zorluklara ne kadar sorumlu bir şekilde yaklaştığına dair tarafsız ve iki yılda bir yapılan bir değerlendirme sunmaktadır. Rekabet baskıları, güvenliğin yerine karı ödüllendirebilir; bu nedenle Endeks, şirketlerin güvenlik uygulamalarını görünür ve karşılaştırılabilir hale getirerek, daha yüksek standartları karşılamak için itibar baskısı yaratarak bu teşvikleri dengelemeyi amaçlamaktadır. Metodoloji 2026 Yaz Yapay Zeka Güvenlik Endeksi, şeffaflığı artırmak, sağlam güvenlik uygulamalarını teşvik etmek, iyileştirme alanlarını vurgulamak ve politika yapıcıları ve kamuoyunu gerçek güvenlik önlemlerini boş vaatlerden ayırt edebilmeleri için güçlendirmek amacıyla, Anthropic, Alibaba Cloud, DeepSeek, Google DeepMind, Meta, Mistral, OpenAI, xAI ve Z.ai olmak üzere dokuz yapay zeka şirketinin güvenlik uygulamalarını altı kritik alanda değerlendirmektedir. Genel amaçlı yapay zekanın teknik ve yönetişim yönleri konusunda önde gelen yedi uzmandan oluşan bağımsız bir değerlendirme paneli, şirketlerin performanslarını sorumlu davranışın 37 göstergesi üzerinden değerlendirmek, harf notları, kısa gerekçeler ve iyileştirme önerileri sunmak için gönüllü olmuştur. Değerlendirme, 1) ilgili araştırma makaleleri, politika belgeleri, haber makaleleri ve sektör raporları da dahil olmak üzere kamuya açık materyallerden ve 2) firmaların güvenlik ile ilgili uygulamalar, süreçler ve yapılar konusunda şeffaflığı artırmak için kullanabileceği özel bir sektör anketinden elde edilen şirket özel bilgilerine dayalı kapsamlı bir kanıt tabanıyla desteklenmiştir. Göstergelerin ve toplanan kanıtların tam listesi, raporun tamamında sunulmaktadır.

Temel bulgular
Endeks bulgularından çıkarılan en önemli sonuçlar:
Anthropic, OpenAI ve Google DeepMind zirvedeki yerlerini koruyor.
Anthropic, nispeten güçlü şeffaflığı, nispeten yerleşik güvenlik çerçevesi, teknik araştırması ve yönetişimi sayesinde altı alandan beşinde liderliği ele geçirerek yine en yüksek genel notu alıyor. OpenAI ise daha geniş bir değerlendirme paketi ve dış testlerle çeşitli etkileşimi sayesinde Risk Değerlendirmesi alanında liderliğe yükseldi.
Meta iyileşirken xAI kötüleşiyor
Meta 6. sıradan 4. sıraya yükselirken, xAI 4. sıradan 7. sıraya geriledi.
Avrupa uyumsuzluğu
Avrupa Birliği yapay zeka güvenliği düzenlemelerinde öncü olmasına rağmen, Avrupa’nın önde gelen yapay zeka şirketi Mistral güvenlik konusunda sonuncu sırada yer aldı.
Yetersiz güvenlik bölgesel bir sorun değil, küresel bir sorundur
Üç şirket başarısız not aldı; bunlardan biri ABD’den (xAI), biri Çin’den (DeepSeek) ve biri de Avrupa’dan (Mistral).
Değerlendirme yapanlar, sektörün yapay zekanın askeri kullanımına yönelmesini yeni ortaya çıkan bir risk olarak işaret etti.
2024’ten 2026’ya kadar, daha önce askeri uygulamaları yasaklayan Anthropic, OpenAI, Google DeepMind ve Meta gibi şirketler, xAI ve Mistral’e katılarak savunma ortaklıkları arayışına girerek kademeli olarak geri adım attılar. İç gözetim ve otonom silahlar konusundaki sınırlamalarına rağmen, Anthropic, kitlesel sivil ölümlerine neden olan Minab okul greviyle bağlantılı olduğu bildirilen “şüpheli askeri faaliyetler” nedeniyle inceleme kurulundan eleştiri aldı. Bu arada, önde gelen Çinli firmalar, Alibaba Cloud ve Z.ai’nin reddettiği askeri bağlantılar iddialarıyla karşı karşıya.
Güvenlik uygulamaları konusunda sektör liderleri bile daha önceki taahhütlerinden geri adım atıyor.
Anthropic, OpenAI, Google DeepMind ve Meta, kırmızı çizgilere yaklaşıldığında tek taraflı olarak duraklama taahhütlerini zayıflattı veya geçersiz kıldı; bazıları bunu rakiplere bağlı koşullara dayandırdı. Eleştirmenler bunu ‘sürekli değişen hedef’ olarak nitelendiriyor ve ‘genel olarak güvenlik çerçevelerini baltaladığını’ savunuyor.
Varoluşsal Güvenlik, sektör genelinde en zayıf alandır.
Hiçbir şirket C- notunun üzerine çıkamıyor; çoğu D veya daha düşük not alıyor. Anthropic’in anayasal sınıflandırıcıları, OpenAI’nin yönetişim kurumları çağrısı, Google DeepMind’ın izleme taahhütleri ve Meta’nın kontrol kaybı hükümleri gibi yapıcı girişimler mevcut, ancak panelistler tarafından ‘tamamen yetersiz’ olarak değerlendiriliyor. Yorumlanabilirlik ve Düşünce Zinciri (CoT) izlenebilirliği gibi baskın paradigmalar, ‘tespit önleme anlamına gelmez’ gerekçesiyle sorgulanıyor.
Güvenlikle ilgili söylemler, ortaya çıkan davranışların önüne geçiyor.
Google DeepMind, OpenAI ve xAI genelinde, yöneticilerin kamuoyuna yönelik güven verici mesajları, ticari davranışlardan ve yasal duruşlardan farklılık gösteriyor; bu da belirtilen taahhütleri gerçek güvenlik uygulamaları için güvenilir bir gösterge olmaktan çıkarıyor.
Şirketler güvenlik çerçevelerini yayınlıyor ve güncelliyor, ancak bu çerçevelerin yaptırım gücü zayıf.
ABD/AB uyumluluk süreleri yaklaşırken, Anthropic, OpenAI, Google DeepMind, Meta ve xAI daha kapsamlı çerçeveler yayınladı ve güncelledi; ancak bunlarda bazen nicel eşikler, gerçekten bağımsız denetimler ve net karar verme yetkisi eksikliği bulunuyor.
Not: Endeks, 3 Haziran 2026 tarihine kadar olan kanıtları toplamıştır ve yakın zamanda meydana gelmiş olabilecek yeni olayları içermemektedir.
“Sektörde yapay zeka güvenliği konusunda iyi çalışmalar yapılıyor olsa da, yetenek yarışı daha da aşırı bir hal aldı. Şirketler, yeni sistemleri yalnızca yetenek seviyelerine uygun güvenlik önlemleriyle piyasaya sürme konusundaki önceki taahhütlerinden geri adım attılar; şimdi ise, bunu yapmanın açıkça güvensiz olduğu durumlarda bile sistemleri piyasaya sürmeyi planlıyorlar.”
Prof. Stuart Russell, UC Berkeley’de Bilgisayar Bilimleri Profesörü
https://futureoflife.org/ai-safety-index-summer-2026/
Raporun tamamına ulaşmak için aşağıdaki link kullanılabilir.
https://futureoflife.org/wp-content/uploads/2026/07/AI-Safety-Index-Summer-2026-Digital.pdf
