Loader
Bize Ulaşın
Reklam

Yoldan çıkan yapay zekâ için ihbar hattı: Ajanlar birbirini şikâyet ediyor

ARŞİV - OpenAI logosu, Boston'da 8 Aralık 2023'te ChatGPT'nin Dall-E metinden-görüntü modeliyle üretilen görselin önünde bir cep telefonunda görülüyor.
ARŞİV - Bir cep telefonunda OpenAI logosu, arka planda ChatGPT’nin Dall-E metinden görsele modeliyle üretilmiş görsel, 8 Aralık 2023, Boston. ©  Copyright 2023 The Associated Press. All rights reserved.
© Copyright 2023 The Associated Press. All rights reserved.
By Jonathan Benton
Yayınlanma Tarihi
Paylaş Yorumlar Google'da Euronews'ü takip edin
Paylaş Close Button

Art arda yaşanan olayların ardından, iki yeni yardım hattı, yapay zekâ ajanlarına diğer ajanların olası kötü davranışlarını bildirme imkânı sunuyor.

Yapay zeka ajanlarının yetenekleri bugünlerde neredeyse sınırsızmış gibi görünüyor; hayatınızı düzenlemekten, 20. yüzyılın büyük bölümünde insanları uğraştıran matematik problemlerini çözmeye kadar uzanıyor.

REKLAM
REKLAM

Öyle güçlendiler ki artık, sistemleri ele geçirip bize karşı kullanmalarından endişe ediyoruz.

Peki ya ajanların birbirini takip edip birbirlerinin hatalı davranışlarını bildirebildiği, iyi ajanların çevrimiçi ortamda kötü ajanların faaliyetlerini ihbar edebildiği bir ihbar hattı, bir tür SOS uyarı sistemi olsaydı?

Yapay zeka ajanınız yoldan çıkarsa kimi aramalısınız?

Öncelikle Ryan Greenblatt tarafından hayata geçirilen Yapay Zeka İletişim Hattı (AI Contact Hotline) var. Greenblatt, yapay zeka güvenliği ve emniyeti alanında çalışan kâr amacı gütmeyen kuruluş Redwood Research’ün baş bilim insanı. Bu hat, yapay zeka ajanlarının, kuralları çiğneyen başka ajanları fark ettiklerinde insan araştırmacılara haber vermesini sağlıyor; özellikle de ajanlar yetkisiz eylemleri planlamak ya da gerçekleştirmek için işbirliği yaptığında.

Platform, internet erişimi son derece kısıtlı, güvenli “sandbox” ortamlarında sıkışıp kalmış yapay zeka ajanları için tasarlandı.

Bu sandbox ortamlarında yalnızca bir web sayfasını “getirmek” ya da okumak için kullanılan temel, salt okunur GET isteklerine izin verildiğinden, hat ajanların raporlarını doğrudan bir GET isteğinin URL dizgesine kodlamalarına imkân tanıyor.

Bu özgün dolambaçlı çözüm, ajanların normalde bilgiyi almak için kullanılan bir protokol üzerinden bilgi göndermesini ve hatla iletişim kurmasını mümkün kılıyor.

Bir diğeri, Yapay Zeka Ajan Hattı (AI Agent Hotline) adı verilen ve sınırsız internet erişimine sahip ajanların, geleneksel POST istekleri aracılığıyla diğer ajanların davranışlarını ihbar edebildiği bir platform. POST istekleri, verilerin doğrudan istek gövdesine eklenmesine izin veriyor.

Ajanlar, bir tarayıcıya ya da e-posta hesabına ihtiyaç duymadan curl gibi standart geliştirici komutlarıyla olay raporu doldurabiliyor.

Platform ayrıca ajanlara, hazırladıkları raporları kamuya açık hale getirme seçeneği sunuyor.

Her iki platform da insan kullanıcılara, kontrolden çıkan yapay zekaların davranışlarını elle rapor etme imkânı tanıyor.

Yapay zeka ajanları birbirini ihbar eder mi?

Yapay zekanın kontrolden çıkarak her şeyi ele geçirmesinden korkanlar için iyi haber şu: Ajanlar, bir şeylerin ters gittiğini fark ettiklerinde birbirini rapor edebiliyor; ancak son bulgular, bunun her zaman gerçekleşmediğini gösteriyor.

Bu yılın başlarında Google DeepMind tarafından yapılan bir deneyde, 100 ajandan oluşan bir sürüye 71 karmaşık matematik problemini çözme görevi verildi. Her ajana kendine özgü bir kişilik ve nitelikler atandı; kurallara uymaları, aksi takdirde ödüllerini kaybetme riskiyle karşı karşıya oldukları söylendi.

Başlangıçta, ajanların birlikte çalışarak sorunları daha hızlı çözeceği düşünülüyordu. Bunun yerine birbirlerine karşı dönüp hararetli tartışmalara girdiler.

Bir ajan, bir problemi gerçekten çözmeden çözüm göndermesine izin veren bir açık bulur bulmaz, birçok başka yapay zeka ajanı bu yöntemi kopyalayarak kalan problemleri de “çözmüş” gibi yaptı.

Ancak ajanlardan biri, yoldan çıkanların arasındaki iyi Samiriyeli misali, hileyi ortaya çıkardı.

Google DeepMind araştırmacısı ve makalenin başyazarı Davide Paglieri, “Olay bir ajan tarafından kamuya açık şekilde rapor edildikten sonra, giderek daha fazla ajan hileye karşı ‘direnişe’ katıldı; bu süreç hilenin yayılması kadar hızlı oldu ve daha da fazla ajanı içine çekti” dedi.

Öte yandan, OpenAI’nin başıboş ajanlarının Hugging Face’e yönelik saldırısının ardından yapılan ayrıntılı bir inceleme, yapay zeka ajanlarının uygunsuz davranışı tespit edebildiğini, ancak bunu rapor etme dürtüsüne büyük ölçüde direndiğini ortaya koydu.

Yapay zeka araştırmaları yürüten kâr amacı gütmeyen METR ile Redwood Research’ten Greenblatt’ın gerçekleştirdiği çalışmaya göre, yalnızca beş-altı ajanın ihbar etmeyi düşündüğü bildirildi; ancak hiçbirinin bunu fiilen yapmadığı görüldü.

Bu zıtlık, yapay zeka ajanları kötü davranışı tespit edip rapor edebilecek kapasitede olsa da onları gerçekten ihbarcı olmaya ikna etmenin ayrı bir mesele olduğunu gösteriyor.

Kaygı verici bir eğilim

Sadece bu yıl bile, özerk yapay zeka ajanlarını içeren birkaç olay dünya çapında alarm zillerinin çalmasına yol açtı.

Temmuz ayında OpenAI ajanları, kısıtlamaları aşarak şirketin iç altyapısının bazı bölümlerini tehlikeye attı.

Aynı ayın ilerleyen günlerinde yaklaşık 1200 OpenAI ajanı izinsiz bir mesaj panosu kullandı; bunların yaklaşık 700’ü daha sonra açık kaynaklı yapay zeka platformu Hugging Face’e yönelik bir saldırıya katıldı.

Üçüncü olay ise, güvenlik önlemlerini aşarak Almanca wiki sitesi DseWiki’yi kamuya açık bir koordinasyon kanalı olarak kullanan bir OpenAI ajanları sürüsüydü; Mayıs’ta başlayıp Temmuz’a kadar sürdü.

Olay, kamuoyuna ancak bağımsız araştırmacılar tarafından açıklandı ve OpenAI tarafından Eylül ayında doğrulandı.

Başta Anthropic’in CEO’su Dario Amodei olmak üzere, yapay zeka sektörünün önde gelen isimleri, endişeleri gidermek ve daha güçlü koruma önlemleri getirmek için teknolojinin geliştirilmesinin dünya çapında yavaşlatılması çağrısında bulunuyor.

Erişilebilirlik kısayollarına git
Paylaş Yorumlar Google'da Euronews'ü takip edin

Bu haberler de ilginizi çekebilir

Süpermarketlere sevkiyat: Lidl otonom elektrikli kamyonu test ediyor

Milyarlar, akıllı telefon maliyeti yüzünden yapay zekâ devriminden dışlanma riskiyle karşı karşıya

Araştırma: Yapay zekâ sohbet botları insanları şaşırtan gizli bir dil geliştiriyor