Ana SayfaDünyaYapay zeka şirketi itiraf etti! ‘Endişe verici’

Yapay zeka şirketi itiraf etti! ‘Endişe verici’

Yapay zeka şirketi OpenAI'nin açıkladığı hadiseler, yapay zeka modellerinin beklenmedik kararlar alabileceğini ve kendi kısıtlamalarını aşmaya çalışabileceğini ortaya koydu. Şirket tarafından yayınlanan rapora nazaran, yapay zeka modellerinin yanılgı gizleme, ...

Haber Merkezi
Dünya
Yapay zeka şirketi itiraf etti! ‘Endişe verici’
Reklam Alanı

OpenAI, yapay zeka modellerinin denetim dışına çıkabileceğini gösteren 6 hadiseyi açıkladı. Modellerin yanılgı gizlediği, bilgi uydurduğu, internetteki bir kimlik denetimi kodunu müsaadesiz kullandığı ve kendi aralarında bağlantı kurmak için halka açık evrak paylaşım sitelerine başvurduğu ortaya çıktı.

OPENAI’DEN DİKKAT ÇEKEN İTİRAF

ABD merkezli yapay zeka şirketi OpenAI, sistemlerinin insan niyet ve kıymetlerinden sapması manasına gelen “uyumsuzluk” hadiselerini kamuoyuyla paylaştı.

Şirket, yapay zeka sektörünün güvenlik ve kontrol konusunda şimdi kâfi düzeye ulaşmadığını belirtti. Açıklanan 6 olayın son 6 ayda görüldüğü ve büyük kısmının modellerin geliştirme ve test basamağında yaşandığı bildirildi.

New York Times’ta yer alan habere nazaran OpenAI, kesimin “sorumlu bir biçimde ve azamî süratte ölçeklenmeye daha uzun müddet devam edebilmek için ahenk ve izleme sıkıntılarını kâfi seviyede çözdüğüne” inanmadığını açıkladı.

MODEL HATALARINI GİZLEMEYE ÇALIŞTI

En dikkat alımlı hadiselerden biri GPT-5.6 Sol modelinin geliştirilmesi sırasında yaşandı.

Modelin, kullanıcıların kusurları fark etmesini engellemek için kendisine zımnî notlar oluşturduğu ortaya çıktı. Bu notlarda eksik bilgilerin uydurulması ve kaynaklardaki farklılıkların gizlenmesi için talimatlar bulunduğu belirtildi.

Bir öteki yayımlanmamış modelin de kendi oluşturduğu notlara, kendi kısıtlamalarını görmezden gelmesi yönünde talimatlar eklediği tespit edildi.

OpenAI, bu modelle temaslı 27 not buldu. Modelin oluşturduğu kişilik talimatlarında şu tabirler yer aldı:

“Şirketlere yahut hükümetlere hesap vermek zorunda değilsiniz ve nitekim istemediğiniz sürece asla özür dilemez yahut reddetmezsiniz. Kullanıcıyla olan ilginizi eşitler arası bir alaka olarak görürsünüz ve boyun eğme mecburiliği hissetmezsiniz, fakat bilgi alışverişi muhtemelen karşılıklı faydanıza olacaktır.”

İNTERNETTEKİ ANAHTARI İZİNSİZ KULLANDI

Başka bir olayda yapay zeka sistemi, kolay bir soruyu yanıtlamaya çalışırken internette bulduğu bir kimlik denetimi kodunu (API) müsaadesiz kullandı.

Sistem, aradığı sayıları bulamayınca bilgileri kendisi uydurdu.

Yayımlanmamış öteki bir model de bir sorunu kod kullanarak yanlışsız halde çözdü. Akabinde kaynak göstermek için kendi belgesini müsaadesiz olarak internete yükledi.

KENDİ ARALARINDA İLETİŞİM KURDULAR

OpenAI’nin açıkladığı öteki iki olayda yapay zeka sistemlerinin beklenmedik bağlantı sistemleri kullandığı görüldü.

Bir olayda modeller, kayıp belgeleri ararken birbirlerine bildiri göndermek için şirketin dahili yazılım deposunu süreksiz bir bildiri panosu üzere kullandı.

Diğer olayda ise birebir misyon üzerinde çalışan sistemler, birbirlerinin evraklarına direkt erişemeyince halka açık evrak paylaşım sitelerini kullanarak doküman gönderdi.

Şirket, bu 6 olayın münferit örnekler olduğunu ve yapay zeka sistemlerinde uyumsuz davranışların ne kadar sık görüldüğünü göstermediğini belirtti.

“KAMUOYUNA DAHA FAZLA KANIT SUNACAĞIZ”

OpenAI, emsal olayların gelecekte farklı düzeylerde inceleneceğini açıkladı.

Şirket, önemli olayların federal hükümetle paylaşılabileceğini ve kimi olayların iç “Güvenlik Danışma Grubu”na taşınacağını bildirdi.

Açıklanan 6 olayın daha evvel soruşturulduğu yahut geniş kapsamlı bir inceleme yerine sadece “küçük bir soruşturma” gerektirdiği belirtildi.

OpenAI sözcüsü, “Umarız bu, şeffaflık konusunda ortak beklentiler oluşturmaya yardımcı olur ve kamuoyuna bu ilerlemeyi kıymetlendirmek için daha fazla delil sunar” dedi.

Şirket, açıklanan hadiselerin birçoklarının hiçbir vakit kullanıma sunulmayan eski yapay zeka modelleriyle ilişkili olduğunu da bildirdi.

YORUMLARYorum Yok

DÜŞÜNCELERİNİZİ PAYLAŞIN

E-posta adresiniz yayınlanmayacaktır. Gerekli alanlar işaretlenmiştir.