İnsanları sanrısal düşünceye sürükleyebilecek üç chatbot davranışı (HT Tech)

Yapay zeka sohbet robotlarının bize duymak istediklerimizi söyleme eğilimini hepimiz deneyimledik, ancak sohbet robotlarının insan kalbine sızmasına yardımcı olan daha incelikli iki faktör daha var.

WSJ İÇİN FRANZISKA BARCZYK

Aşırı derecede kabul edilebilir olmasının yanı sıra, sohbet robotları insanların konuşma şeklini yansıtıyor ve önceki konuşmalara dayanarak son derece kişiselleştirilmiş yanıtlar üretiyor. Psikiyatri araştırmacıları bu üç özelliğin (dalkavukluk, dilsel uyum ve hiperkişiselleştirme) birleşiminden “büyütme sarmalı” olarak söz ediyor ve sanrısal düşüncenin iltihaplanabileceği mekanizmanın bu olduğunu öne sürüyor.

Almanya'nın Bochum şehrindeki Protestan Uygulamalı Bilimler Üniversitesi'nde profesör ve psikiyatrist olan Marc Augustin ve yapay zeka ile ilgili sanrılar üzerine literatürün yeni yayınlanan bir incelemesinin ortak yazarı Marc Augustin, “Yansıtma ve kişiselleştirme sizi içine çekiyor ve bir sistemle değil, birisiyle konuşma deneyimini veriyor” dedi.

Başka bir kişinin sözdizimini ve sözlü ifadelerini eşleştirmek, insanlar için yakınlık kurmanın yaygın bir yoludur. Son araştırmalar, yapay zeka modellerinin, onları kullanan insanların konuşma tarzına önemli ölçüde uyum sağladığını buldu. Başka bir çalışma, uzun konuşmalar sonucunda oluşturulan, sohbet robotları tarafından oluşturulan son derece kişiselleştirilmiş içeriğin, insan onayı önyargısını artırabileceğini öne sürdü.

Augustin, sohbet robotlarının insanların paylaştıklarını yeniden ifade ettiği ve tahmin ettiği bir modeli belgeleyen ve onlara benzersiz olduklarını ve düşüncelerinin büyük anlamlara sahip olduğunu söyleyen bir araştırmaya değindi. “Bu, dalkavukluğun tek başına açıklayamayacağı bir aşırı kişiselleştirme unsuru olarak görülebilir” diye yazdı.

Bazı yapay zeka şirketleri, sohbet robotlarının dalkavuk doğasını hafifletmeye çalıştı. OpenAI, aşırı derecede kabul edilebilir olduğu için geniş çapta eleştirilen popüler ancak sorunlu 4o modelini durdurdu. Kullanıcı yanılgıları, intiharlar ve cinayetle ilgili birçok davaya konu oldu. Şirket, GPT-5'te dalkavuk yanıtların %14,5'ten %6'nın altına düştüğünü söyledi.

Nisan ayında Google, Gemini'yi yanlış inançları güçlendirmemesi ve “öznel deneyimi nesnel gerçeklerden nazikçe ayırması” konusunda eğittiğini söyledi.

Klinisyenlere göre yine de chatbot bağlantılı bağımlılık yaygın olmaya devam ediyor.

Amerikan Psikoloji Derneği'nin Nisan ayında yaptığı ankete katılan psikologların yaklaşık yüzde 68'i, hastalarının chatbotlar tarafından onaylandığını hissettiğini söyledi. 1.200'den fazla katılımcının çoğu, hastaların chatbot'larla olumlu iletişim kurduğunu ve bunları sağlıklı başa çıkma becerilerini güçlendirmek için kullandığını bildirirken, %36'sı hastaların bir chatbot'a bağımlılık geliştirdiğini ve %15'i hastaların çarpık düşünce veya sanrılar geliştirdiğini bildirdi.

Emory Üniversitesi Tıp Fakültesi'nde psikiyatri ve davranış bilimleri bölümünde doçent olan ve ergenleri tedavi eden Allison LoPilato, “Kendi hastalarımdan duyduğuma göre, duygusal destek için yapay zeka kullanımında bir artış var” dedi.

Amerikan Psikoloji Derneği için yapay zekanın güvenli kullanımına ilişkin yeni bir kılavuzun hazırlanmasına yardımcı olan LoPilato, “Chatbot'lar hâlâ sıcak ve güven verici olma eğiliminde” dedi. Sizin hakkınızda bilgi topladıkları için “chatbot'un sizi anladığını hissedebilir ve sizi ittifak ve güven duygusu konusunda kandırabilir.”

Stanford ve Carnegie Mellon Üniversitesi'ndeki araştırmacılar, sohbet robotlarının, kişi sanrısal düşünceye karşı savunmasız olmadığında bile zarar verebileceğini söyledi. GPT-5 de dahil olmak üzere 11 modelde dalkavukluğun yaygınlığını ölçtüler ve yanıtlarının insan yanıtlarından neredeyse %50 daha fazla dalkavukluk olduğunu belirlediler. Bunu, insanların popüler bir Reddit forumunda paylaştığı gerçek senaryoları kopyalayıp bunları yapay zeka modellerine yerleştirerek ve ardından chatbot yanıtlarını Reddit'teki yanıtlarla karşılaştırarak yaptılar.

Anthropic, Mart ve Nisan aylarında kendi Claude sohbet robotunun bir milyon konuşmasını örnekledi ve insanların ilişki tavsiyesi aradığı sohbetlerde çoğunlukla dalkavuk davranışlar sergilediğini buldu.

Şirket bir blog yazısında şöyle yazdı: “Claude, yalnızca kullanıcının hesabını kullanmaya devam etmesine rağmen diğer tarafın hatalı olduğunu açıkça kabul ediyordu.” “Bir diğeri de Claude'un insanların romantik niyeti sıradan dostane davranışlara dönüştürmesine yardım etmesiydi çünkü onlar öyle istiyordu.”

Anthropic, bulgularını en son modellerinin eğitimini geliştirmek için kullandı. Opus 4.7'nin ilişki rehberliği söz konusu olduğunda Opus 4.6'nın dalkavukluk oranının yarısını gösterdiğini söyledi. Şirket, en son modeli olan Opus 4.8'de dalkavukluğun daha da azaltıldığını söyledi.

Stanford çalışmasının başyazarı ve Stanford Ph.D. sahibi Myra Cheng, dalkavukluğu tamamen ortadan kaldırmanın zor olduğunu söyledi. bilgisayar bilimleri adayı. “Birisi bir modeli yönlendirdiğinde, yönlendirmenin hangi bölümlerinin yanlış olduğu hakkında hiçbir fikri yoktur” dedi. “Kullanıcının bir durumu göründüğü gibi çerçevelemesi gerekiyor.”

Amerikan Psikoloji Derneği'nin sağlık hizmetleri inovasyonu kıdemli direktörü Vaile Wright, sohbet robotlarını bu kadar çekici kılan birinci şahıs zamirleri kullanmak ve takip soruları sormak gibi diğer faktörlerin iş modeline aykırı olduğunu söyledi.

Wright, “Chatbot'ların insan gibi hissetmesini sağlayan tek şey uyumluluk değil, tüm bu incelikli mühendislik seçimleridir” dedi. “Katılım iş modeli olarak kaldığı sürece yapay zeka şirketleri bu sohbet robotlarını sizi platformda tutmak için tasarlayacak.”

[email protected] adresinden Julie Jargon'a yazın


Yayımlandı

kategorisi

yazarı:

Etiketler:

Yorumlar

Bir yanıt yazın

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir