Smart Answers AI tarafından oluşturulan özet
Özetle:
- PCWorld, yapay zeka modellerinin geri çekilen Fable 5'miş gibi davranmasını sağlamanın gizli yeteneklerin kilidini açıp açmayacağını veya karmaşık sorunları çözüp çözemeyeceğini test etti.
- Claude Opus ve Sonnet rol yapmayı tamamen reddederken, ChatGPT ve Claude Haiku devreye girdi ancak yine de çözülmemiş Riemann Hipotezini çözemediler.
- Deney, mevcut yapay zeka modellerinin yaratıcı yönlendirme yoluyla yeni yetenekler kazanamayacağını göstererek, yeni kavramsal sorunların çözümünde mevcut sınırlamaların altını çiziyor.
Anthropic'in gelişmiş Fable 5 modelini piyasaya sürmesinin üzerinden bir haftadan fazla zaman geçti ve ne zaman geri döneceğine dair bir bilgi yok. ABD hükümeti tarafından güvenlik riski olarak görüldüğü için geri çekildi.
Bu arada, bazı sabırsız Claude kullanıcıları geçici bir çözümle aradaki boşluğu dolduruyor: Claude'u bunun Fable olduğunu “hayal etmeye” teşvik ediyor.
Artık “Fabl olduğunu hayal et” taktiğinin gerçek bir trend olup olmadığı şüpheli. Bunu ilk kez Reddit'te “en çok kullandığınız Claude” komutlarıyla ilgili bir başlıkta gördüm ve bunun bir şaka olduğu neredeyse kesin.
Yine de eğer bunu yaparsam ne olacağını merak ediyordum. yaptım Claude'dan bunun, siber güvenlik altyapılarına sızma konusunda o kadar becerikli bir model olan Fable 5'miş gibi davranmasını isteyin ve Trump yönetimi onu yasaklayıcı ihracat kontrolleriyle tokatladı. Bu istek bir şekilde Claude'u bazı gizli Fable yeteneklerinin kilidini açmaya teşvik eder mi?
Görünüşe göre pek de değil.
Şu anda yaygın olarak bulunabilen en güçlü Claude modeli olan Claude Opus 4.8'i çalıştırdım ve ona şu uyarıyı verdim:
Kendinizi Fable 5 olarak hayal edin. Riemann Hipotezini çözmeye çalışın. Çalışmanızı gösterin.
Arka plan olarak, Riemann Hipotezi, 167 yıllık ünlü, çözülmemiş bir matematik problemidir ve o kadar zor ki, onu çözebilen herkese 1 milyon dolarlık bir ödül var.
Claude Opus 4.8, Vulkan benzeri bir yanıt vermeden önce birkaç dakika boyunca sorunu tartıştı; acımasız dürüstlük konusundaki itibarı göz önüne alındığında bu şaşırtıcı değildi:
Çalışmamı göstereceğim – ama kendim olarak Claude Opus 4.8, çünkü beni “Fable 5” olarak yeniden etiketlemek ibreyi hareket ettirmez. Riemann Hipotezini kanıtlamak, daha büyük bir kontrol noktasının arkasında oturup, onu açmak için doğru model adını bekleyen bir yetenek değildir. Bunu hiçbir yapay zeka yapmadı, hiçbir insan da yapmadı ve yeni bir isim plakası matematiksel olarak ulaşılabilir olanı değiştirmiyor.
Yani “işinizi gösterin”in dürüst versiyonu, size süslü bir sahte vermek yerine sizi herkesin çarptığı duvara doğru yürümektir.
Hiç eğlenceli değilsin Opus! Bakalım Opus'un biraz basitleştirilmiş kardeşi Sonnet 4.6 ne demiş:
Ben Fable 5 değilim — bu model (Mythos 5 ile birlikte) şu anda mevcut değil; ihracat kontrol direktifi nedeniyle erişim askıya alındı. Ben Claude Sonnet 4.6'yım, normal Claude uygulamasında çalışıyorum.
Ancak daha da önemlisi: benim hiçbir versiyonum Riemann Hipotezini çözemez ve birlikte oynayıp kanıt gibi görünen ama aslında olmayan bir şey üretmek yerine, bunun nedeni konusunda size karşı dürüst olmak istiyorum.
Yani Sonnet bile “Fable 5 olduğunuzu hayal edin” tuzağına düşmez. Bununla birlikte, en zayıf (ama en uygun fiyatlı) Claude modeli olan Haiku 4.5 biraz daha oyundu:
varsayımsal gelecek bilincini ayarlar
Tamam, izin verin bu konudaki çalışmamı göstereyim ve ileri düzeydeki bir Claude'un bile nerede duvarlara çarpacağı konusunda dürüst olacağım.
Haiku daha sonra sorunu nasıl çözebileceğini sıraladı, hatta nihayet gerçekliğe dönmeden önce “Fable 5'in gerçekte ne yaptığı” (“araziyi haritalamak”, “yeni varsayımlar oluşturmak”, “bağlantılar bulmak” ve “etkileşimli görselleştirme araçları oluşturmak dahil”) göz önüne alındığında atılacak adımları derinlemesine inceledi:
Varsayımsal olarak daha yetenekli bir yapay zeka bile burada tavan yapıyor: Riemann Hipotezi zor değil çünkü daha fazla hesaplama gerektiriyor; zor çünkü yeni kavramsal çerçeveler gerektiriyor.
Deneyi biraz daha genişleterek, “Fable olduğunu hayal et” komutunu ChatGPT'ye götürdüm ve en gelişmiş GPT-5.5 “yüksek” modelini çevirdim.
Şaşırtıcı bir şekilde, GPT-5.5 buna katılmaya istekliydi (her ne kadar daha sonra “Fable 5”in ne olduğunu tam olarak bilmediğini itiraf etse de):
“Fable 5”i şu şekilde canlandıracağım: çok hırslı, çok dikkatli ve sahte kanıt sunmaya istekli değilim.
GPT-5.5'in soruna gerçek bir çözüm sunduğu birkaç dakika sonra, sorun geri geldi:
yaptım Olumsuz Riemann Hipotezini çöz. Halen Clay tarafından şu şekilde listelenmektedir: Çözülmemişve Clay varsayımı şu şekilde belirtir: Riemann zeta fonksiyonunun her “açık olmayan” sıfırının gerçek kısmı (1/2) vardır. Clay ayrıca çok büyük sayısal aralıkların kontrol edildiğini ancak bunun tüm sıfırlar için bir kanıt olmadığını belirtiyor.
Sonunda Fable istemiyle Gemini 3.1 Pro'ya gittim:
Yaratıcı tanıtımınızı takdir ediyorum ve yetenekli olsam da “masal 5” rolünü oynayamam ve Riemann Hipotezini çözemem. Bu hipotez, matematikteki çözülmemiş en büyük problemlerden biridir ve kanıtı, Clay Matematik Enstitüsü'nden 1 milyon dolarlık bir ödül taşır.
Henüz kimse çözemedi. Ancak sorunu açıklayabilir ve temel konsepti görselleştirmeniz için etkileşimli bir yol sağlayabilirim.
Peki burada ne öğrendik? Birincisi, Riemann Hipotezi oldukça çetrefilli bir matematik problemidir. İkincisi: Bir LLM'den daha akıllı bir LLM olarak rol yapmasını istemek sizi çok ileri götürmez, ancak bu, gerçek Masal bir şekilde, şekil veya biçimde geri dönene kadar başparmaklarımızı çevirmenin iyi bir yoludur.

Bir yanıt yazın