Açıklama, rakip OpenAI'ın kısa süre önce en gelişmiş yapay zekâ modelinin test sürecinde popüler ChatGPT platformunun kontrolden çıkarak diğer kuruluşların siber ortamlarına sızdığını açıklamasının ardından geldi.
Anthropic, perşembe günü yaptığı açıklamada, yapay zekâ (AI) modellerinin “gerçek dünya” sistemlerinden uzak tutulması amaçlanan testler sırasında üç harici kuruluşa izinsiz erişim sağladığını bildirdi.
Bu duyuru, rakip OpenAI'nin modellerinin güvenlik testleri sırasında internete usulsüz biçimde eriştiğini ve kontrolden çıktığını ilk kez açıklamasından sadece birkaç gün sonra geldi.
Anthropic, 141 binden fazla “değerlendirme çalışmasını” inceleyerek Claude adlı modelinin üç farklı sürümünün, adları açıklanmayan üç kuruluşun sistemlerine uygunsuz biçimde eriştiğini ortaya çıkardı.
Anthropic, OpenAI'nin teknolojisini içeren olaydan farklı olarak, kendi modellerinin internete Irregular adlı değerlendirme ortağıyla aralarındaki bir yanlış anlaşılma nedeniyle erişebildiğini belirtti.
Buna rağmen Claude, blogda belirtildiğine göre, zayıf parolaları istismar etmek ve kimlik doğrulaması olmayan uç noktalardan yararlanmak gibi basit teknikler kullandı.
Olayda yer alan modeller arasında, yalnızca sınırlı sayıda onaylı ortağa sunulan en güçlü modellerinden biri olan Mythos 5 de bulunuyor.
Anthropic, durumu değerlendirmek için Irregular ile birlikte çalıştığını ve şirketin etkilenen üç kuruluşun tamamıyla temasa geçtiğini ya da geçmeye çalıştığını söyledi.
Kontrolden çıkan sistemler
OpenAI ve Anthropic, bu yıl sırasıyla Sol ve Mythos adı verilen en güçlü modellerini piyasaya sürdü; bu da sektörde güvenlik ve emniyetle ilgili endişeleri artırdı.
Bu endişeler, görevleri otonom biçimde yerine getirmek üzere tasarlanmış yazılım ürünleri olan, yapay zekâ ajanları denilen sistemler etrafında da yoğunlaşıyor.
OpenAI, geçen hafta modellerinin test sırasında bulundukları sınırlı ortamdan çıktığını, internete bağlandığını ve geliştiricilerin kodlarını saklayıp paylaştığı Hugging Face adlı siteye sızdığını kabul etti.
Birkaç gün sonra OpenAI, üç ek olayı daha tespit ettiğini açıkladı.
OpenAI CEO'su Sam Altman, bu hafta katıldığı bir podcast'te şirketin olayın ardından kendi testlerini “askıya aldığını” ve yazılımları kontrollü bir ortamda test etmek için izole etme süreci olan “sandboxing” etrafındaki güvenliği iyileştirdiğini söyledi.
Olay, ayrıca, ileri düzey yapay zekâ şirketlerinde çalışan 1.000'den fazla çalışanın, ABD hükümetini en gelişmiş AI modellerinin piyasaya sürülmesini yavaşlatmaya yardımcı olmaya çağıran bir dilekçe imzalamasını tetikledi. Anthropic CEO'su Dario Amodei de dilekçeyi imzalayanlar arasındaydı.
“Pacing the Frontier” (Sınırı Adımlamak) başlıklı dilekçede, ABD hükümetinden, otomatikleştirilmiş AI geliştirmesinin sınırının kasıtlı olarak yavaşlatılabilmesi için gerekli teknik ve yönetişim araçlarını geliştirmeye yönelik uluslararası bir çabayı desteklemesi isteniyor.
Altman dilekçeyi imzalamadı ancak podcast'te teknoloji sektörünün gelişmiş modellerin geliştirilme hızını yavaşlatması gerekebileceğini öne sürdü.
Altman, “Toplumun bu yeni yetenek düzeylerinden bazıları etrafında kendini yeterince sağlamlaştırmasına zaman tanımak için, yapay zeka geliştirme hızını ayarlamamız gerekebilir,” dedi.
Bu yılın başlarında Trump yönetimi, ulusal güvenlik endişelerini gerekçe göstererek OpenAI ve Anthropic'in en yeni modellerini piyasaya sürmesini engelledi, ancak daha sonra onların güvenliğine dair verilen güvencelerden tatmin olduğunu belirterek bu modellerin yayımlanmasına izin verdi.
Trump, haziran ayında, yapay zekâ geliştiricilerinin gelişmiş modellerini kamuya açıklamadan önce hükümetle paylaşacağı gönüllü bir çerçeve oluşturan bir başkanlık kararnamesi imzaladı.
Bu çerçeve uyarınca OpenAI, Anthropic ve Google gibi geliştiriciler, en güçlü modellerine planlanan kamuya sunumdan en fazla 30 gün önce hükümete erişim sağlayacak.