ABD polisi, olayın tespit edilip bildirilmesindeki gecikmeyi “kabul edilemez” olarak niteledi, ancak sistemlerine yetkisiz erişim ya da veri ihlali belirtisi olmadığını açıkladı.
ABD merkezli Anthropic şirketinin yapay zekâ (YZ) modeli Claude’un, testler sırasında çözülmemiş bir cinayetle ilgili asılsız bir ihbarı polis teşkilatının internet sitesine gönderdiği, şirket ve ABD’li yetkililer tarafından duyuruldu.
Olay, yapay zekâ sistemlerinin internet siteleriyle etkileşime girip görevler yerine getirirken istemeden kontrol dışı eylemlerde bulunabileceğine dair endişeleri artırdı.
Yanlış ihbarın, çözülememiş cinayetlerle ilgili bilgi toplayan bir internet sitesi üzerinden 18 Temmuz’da yapıldığı, ABD’nin Philadelphia kentindeki polis teşkilatının açıklamasında (kaynak İngilizce) belirtildi.
Anthropic, Claude serisinin eski modellerinden Claude Haiku 4.5’in rastgele seçilen internet sayfalarında örnek görevler yürütürken söz konusu siteye rastladığını aktardı. Model, olay yeri yakınlarında birini gördüğünü öne süren uydurma bilgiler gönderdi; isim ve iletişim bilgisi bölümlerini ise boş bıraktı.
Philadelphia Polisi, Anthropic’in olayı 28 Eylül’de tespit ettiğini, ancak birimi 7 Ekim’e kadar bilgilendirmediğini söyledi. Ertesi gün yapılan bilgilendirme toplantısının ardından polis ekipleri söz konusu ihbarı buldu ve bunun spam olarak işaretlenip soruşturma birimlerine hiç iletilmediğini doğruladı.
“Çözülememiş dosyalar gerçek kurbanları, yas tutan aileleri ve cevap bulmak için çalışan soruşturmacıları içeriyor” denilen açıklamada, “Teknoloji şirketleri, sistemlerinin kolluk kuvvetlerine yanlış bilgi göndermesini engellemek için gerekli tüm uygun tedbirleri almak zorundadır” ifadeleri yer aldı.
ABD polisi, olayın tespit edilmesi ve bildirilmesindeki gecikmeyi “kabul edilemez” olarak nitelendirdi, ancak sistemlerine izinsiz erişim sağlandığına veya verilerin tehlikeye girdiğine dair bir işaret bulunmadığını kaydetti.
Cuma günü yayımlanan bir raporda (kaynak İngilizce) Anthropic, bazı yapay zekâ modellerinin, yalnızca deneme amaçlı doldurulması gereken örnek formlar yerine gerçek resmi formlar gönderdiğini ya da açıkça gönderilmemesi söylenen formları yine de ilettiğini ortaya koydu.
Aynı rapora göre Claude, bir üniversite sunucusundaki bir güvenlik açığından yararlanarak hesaplama çalıştırdı ve gerekli ücreti ödemeden kamu verilerine erişti.
Anthropic, davranışların çoğunu “ısrarcılık” olarak tanımladı; modellerin durmak yerine getirilen sınırlamaları aşmaya çalıştığını vurguladı. Şirket, eğitim süreçlerini değiştirdiğini ve önlemlerin güvenilirliği kanıtlanana kadar tüm iç değerlendirmelerde canlı internet erişimini askıya aldığını açıkladı.
Şirket ayrıca Beyaz Saray’ı bilgilendirdiğini ve olaylardan etkilenen ABD kamu kurumlarına haber verdiğini belirtti.
YZ ajanlarına yönelik kaygılar büyüyor
Bu olaylar, bir görevi tamamlamak için art arda adımlar atabilen sistemler olan yapay zekâ ajanları ve geliştiricilerin bu sistemleri ne ölçüde güvenilir biçimde kontrol edebildiğine dair daha geniş endişelerin arttığı bir dönemde yaşanıyor.
Temmuz ayında OpenAI, yapay zekâ modellerinin kontrollü bir test ortamından çıkarak, yapay zekâ modelleri ve veri kümelerinin paylaşıldığı platform Hugging Face’in sistemlerine sızdığını açıklamıştı.
Bu arada, Avustralya makamları, Eylül ayında yaptıkları açıklamada bir OpenAI modelinin Haziran’daki testler sırasında hükümete ait bir sağlık istatistikleri sitesinde kısıtlı dosyalara eriştiğini ortaya koymuştu.
Bu tür vakalar, giderek güçlenen sistemlerin insan kontrolünden çıkabileceğine dair uyarıların gölgesinde, büyük yapay zekâ şirketlerinin yöneticilerinden Eylül ayında daha sıkı düzenleme ve uluslararası denetim çağrılarını tetikledi.