ChatGPT'nin Yeni Kamera Özelliği Korkunç Derecede Doğru


Aylarca süren testlerden sonra OpenAI, Eylül ayında ChatGPT için “gelişmiş ses” modunu kullanıma sundu. Bu özellik, ChatGPT ile gerçek zamanlı konuşmalar yapmanızı sağlar: Başka bir soru sormak için botu ve onun “konuşmasını” kesebilirsiniz ve o, hem yanıtlarını hem de verdiği tonlamayı bilgilendirmek için ses tonunuzu anlar. kullanır. (Onun çok güldüğünde tüyler ürpertici.)

Ancak gelişmiş ses modunun bir özelliği lansmandan bu yana eksikti. OpenAI, Mayıs ayında bu avantajı ilk kez duyurduğunda, ChatGPT'nin kameranıza nasıl erişebileceğini ve etrafınızdaki dünyayı nasıl “görebileceğini” göstermişti. Botla sohbet ederken kameranızı bir şeye doğrultabilir, bir soru sorabilirsiniz ve ChatGPT elinden gelen en iyi şekilde yanıt verecektir. Yedi ay sonra bu yetenek ortaya çıktı ve korkutucu derecede etkileyici.

Erişmek için ChatGPT'ye Plus (ayda 20 ABD doları) veya Pro (ayda 200 ABD doları) ücretli aboneliğinizin olması gerekir. ChatGPT Ekibi aboneleri de bu kampanyadan yararlanabilir. OpenAI zamanla kullanıma sunulacağından, ödeme yapsanız bile bu özellik sizin tarafınızda hemen kullanılamayabilir.

ChatGPT gelişmiş ses modunun görüş özelliğinin test edilmesi

Hesabınıza sunulduktan sonra kameraya erişim oldukça basittir. Gelişmiş ses modunu her zaman yaptığınız gibi, sohbetin sağ alt köşesindeki dalga biçimi simgesini kullanarak başlatırsınız. Buradan, elbette canlı kamera yayınını başlatan yeni bir kamera simgesi göreceksiniz. Bu, sohbeti kesintiye uğratmaz: ChatGPT ile bir sohbetin ortasında olabilir, kamerayı açabilir ve konuşmaya devam edebilirsiniz, ancak artık kamera beslemesi de sohbetin bir parçası olarak sunuluyor.

Bunu ilk kullandığımda, kamerayı, üzerinde bir iPhone kablosu ve Magic Trackpad'im bulunan yakınlarda bulunan bir Nintendo Switch kutusuna doğrulttum ve “Bu nedir?” diye sordum. ChatGPT şunları söyledi: “Üstünde bazı kablolar ve bir dizüstü bilgisayar bulunan bir Nintendo Switch OLED kutusuna benziyor. Bunu kurmayı planlıyor musunuz?” Üçte ikisi doğru, çünkü trackpad'imi dizüstü bilgisayarla karıştırdı, ama hey, yeterince yakın. Daha sonra onu su şişeme doğrulttum ve neyi vurguladığımı belirlemesini istedim: “Bu siyah Hydro Flask şişesine benziyor. İçecekleri soğuk veya sıcak tutmak için harika! Onu sık sık yanınıza alır mısınız?”

Bir takip sordum: “Bunun Hydro Flask'ın hangi modeli olduğunu biliyor musun?” ChatGPT: “Tam modelden emin olamıyorum ama geniş ağızlı şişelerden birine benziyor, muhtemelen 32 ons civarında. Kesinlikle içeceklerinizi saatlerce doğru sıcaklıkta tutmak için tasarlandı.” Bu…temel olarak doğru. ChatGPT'nin tahmin etmesi konusunda pek rahat değilim boyut doğru da.

ChatGPT'nin doğru bir şekilde Apple Magic Keyboard olduğunu belirttiği klavyeme geçtim. Hangi anahtarları görebildiğini sordum ve çerçevedeki anahtarların hepsini olmasa da bir kısmını adlandırdım. Kaç tane anahtar görebildiğini sordum ve “yaklaşık 30” dedi, oysa 26 tane vardı. Yani tekrar kapatalım.

MacBook'umdaki MagSafe bağlantı noktasını, sağındaki iki USB bağlantı noktasını ve kulaklık girişini tanımlamayı başardı. Tavanımdaki havalandırmayı ve ön kapımın yanında bulunan özel bot türlerini tanıdı. Sonuç olarak, üzerinde test ettiğim her şeyi tanıdı; trackpad hariç.

Gelişmiş ses modunun görüşü hızlıdır

Ancak tanınmanın ötesinde, sanırım beni en çok şaşırtan şey bu tepkilerin hızıydı. ChatGPT'den bir şeyi tanımlamasını istersiniz ve bunu bazen gerçek bir kişiden yapmasını istediğinizden daha hızlı yapar. Bazen bot bir kelimeyi bir anlığına tutar (örn. “Ben bu bir…”) ki bu muhtemelen ChatGPT'nin söylemek istediği şeyin geri kalanını işlemesine izin veren bir hiledir. Ayrıca verdiği ilk tepkiyle de kendinden daha az emin olduğumu fark ettim: Onu Magic Mouse'uma doğrulttum ve ilk tahmini ne bilgisayar faresi olduğunu. Ancak hangi marka olduğunu sorduğumda sadece Apple'ı belirtmedi, aynı zamanda “şık tasarımı” ve “dokunmaya duyarlı yüzeyi” ile bilinen bir Apple Magic Mouse olduğunu söyledi.

Ancak her şey göz önüne alındığında, bu yanıtlar genellikle neredeyse anında oluyor ve bu da OpenAI modellerinin bugünlerde ne kadar güçlü olduğunu gösteriyor. Hala büyük ölçüde yapay zekaya şüpheyle yaklaşan biriyim ama bu, uzun zamandır beni etkileyen ilk gelişmeydi ve bu konuda ne hissettiğim konusunda kararsızım.

Bir yandan bu teknolojinin iyilik için kullanıldığını görebiliyordum. Bunun gibi bir şeyin, özellikle akıllı gözlük gibi kullanışlı bir cihazda, görme engelli veya görme bozukluğu olan kullanıcılar için ne kadar yararlı olabileceğini bir düşünün. Birisi yapay zeka asistanına hangi yöne baktığını, bir restorandaki menüyü okumayı veya karşıdan karşıya geçmenin güvenli olup olmadığını sorabilir. Bunun gibi teknolojiler aramayı daha iyiye doğru değiştirebilir ve akıllı telefon kameramızı bir konuya doğrultarak dünya hakkında yeni şeyler öğrenmeyi kolaylaştırabilir.

Diğer yandan, özellikle yapay zeka hâlâ halüsinasyona yatkın olduğu için zihnim olumsuza dönüyor. Gittikçe daha fazla insan bu teknolojiyi kullandıkça, yapay zekanın yapabileceği hataları kaçınılmaz olarak deneyimleyecekler ve eğer robotun görevlerde (özellikle de güvenliklerini ilgilendiren konularda) yardımcı olmasına güveniyorlarsa, halüsinasyonlar tehlikeli olabilir. Büyük bir hatayla karşılaşmadım; sadece trackpad karışımı. Anderson Cooper, botun bir geometri probleminde hata yaptığını buldu (yine çok büyük bir sorun değil). Ancak bu teknoloji hızla geliştikçe, doğasındaki kusurların başarısızlık riskini artırdığını da hatırlatmak isteriz.

Belki de bu yüzden her canlı kamera oturumu, bu özelliği güvenlikle ilgili hiçbir şey için kullanmamanız konusunda sizi uyarıyor.


Yayımlandı

kategorisi

yazarı:

Etiketler:

Yorumlar

Bir yanıt yazın

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir