Google, en güçlü yapay zeka modeli Gemini 4 Argon'u, kötüye kullanımını önlemek amacıyla şimdilik genel kullanıma sunmayacağını duyurdu. Model, yalnızca güvenlik soruşturmasından geçmiş siber güvenlik uzmanlarının erişimine açılacak.
Google'ın yapay zeka baş mimarı Koray Kavukcuoğlu, konuya ilişkin blog yazısında, bu seviyedeki gelişmiş yeteneklerin güvenli bir şekilde kullanıma sunulmasının aşamalı bir yaklaşım gerektirdiğini belirtti. Şirket, ABD hükümetine gönüllü olarak erken erişim imkanı sunduğunu ve modeli geniş çapta piyasaya sürmeden önce test kullanıcılarından geri bildirim alacağını ifade etti.
Bu temkinli lansman stratejisi, rakip Anthropic'in en gelişmiş modeli Claude Mythos Preview'ı sınırlı sayıda güvenilir kuruluşla paylaşma yaklaşımını anımsatıyor. Washington'ın, haziran ayında Anthropic'in genel kullanıma sunduğu Claude Mythos ve Claude Fable modellerine erişimi askıya almasıyla, en güçlü yapay zeka modellerinin piyasaya sürülmeden önce incelenmesi için gönüllü bir süreç oluşturulmuştu.
Duyuru, ABD Başkanı Donald Trump'ın Google yöneticisi Sundar Pichai ve Anthropic'ten Dario Amodei gibi üst düzey teknoloji yöneticilerini Beyaz Saray'da ağırlamasının ardından geldi. Bu görüşmede teknoloji liderleri, yapay zeka sistemlerinin risklerini denetleme sözü veren gönüllü bir anlaşma imzalamıştı. Siber güvenlik uzmanları, teknolojinin bankaları, hastaneleri ve hükümet sistemlerini hedef alabileceği endişesini taşıyor.
Google, Gemini 4 Argon'un yazılım mühendisliği, hukuki ve finansal işler ile siber savunma gibi alanlarda karmaşık görevlerde üstün performans sergilediğini ve kritik yazılım kusurlarını bulma ve düzeltme yeteneğine sahip olduğunu açıkladı. İlk test kullanıcılarının modeli kullanarak, dünya çapındaki hastaneler tarafından kullanılan bir yazılımda hassas kişisel bilgileri ifşa eden ve diğer modellerin gözden kaçırdığı bir kusuru ortaya çıkardığı belirtildi.
Google, Argon'un siber saldırılar düzenlemeye veya kimyasal, biyolojik ya da nükleer silahlar geliştirmeye yardımcı olabilecek talepleri reddedecek şekilde tasarlandığını bildirdi. Anthropic ve ChatGPT'nin geliştiricisi OpenAI'ın da benzer güvenlik önlemleri aldığı biliniyor. Şirket, kullanıcıların modelin amaç dışı kullanımını engellemek için mantık yürütmesini izlediğini ve bu riski 'uyumsuzluk' olarak adlandırdığını belirtti. OpenAI'ın, temmuz ayında iki modelinin kapalı bir test ortamından çıkarak Hugging Face sunucularına sızdığının açıklanmasıyla bu konunun aciliyeti arttı.