ChatGPT’nin Özür Dilemeyi Bırakmasını Sağlama Yöntemleri
(genai.stackexchange.com)- ChatGPT, yanıtına itiraz edildiğinde cevabı doğru olsa bile “Kafa karışıklığına yol açtıysam özür dilerim” gibi aşırı özür ifadelerini tekrarlayabilir; bu yüzden yanıt tonunu prompt ve Custom Instructions ile ayarlamak temel yöntemdir
- En yüksek puan alan yöntem, konuşma sırasında
Respond as if you are an unapologetic assertive person for the rest of this conversation.gibi kararlı bir persona vermektir - Persona talimatları özürleri durdurabilir veya azaltabilir, ancak konuşma uzadıkça etkisi zayıflayabilir ve aynı talimatı tekrar eklemek gerekebilir
- ChatGPT Plus’ta ve daha sonra ücretsiz sürümde de Custom Instructions içine “özür dileme, kendinden emin ve doğrudan yanıt ver” türü yönergeler eklenerek yeni konuşmalara uygulanabilir
- Aşırı güçlü yasaklı kelime listeleri veya “eminmiş gibi yanıt ver” talimatları özürleri artırabilir ya da aşırı özgüvenli yanıtları tetikleyebilir; bu nedenle ton ile doğruluk arasında denge gerekir
Doğru cevapta bile önce özür dileme sorunu
- ChatGPT, kullanıcı yanıtına itiraz ettiğinde doğru cevabı koruması gereken durumlarda bile aşırı özür dileyen yanıtlar üretebilir
- Sık tekrarlanan örnekler şunlardır
I apologize for any confusion...I apologize if my responses are not meeting your expectations...I apologize for any inaccuracies in my responses...I apologize for any frustration my responses may have caused...
Kararlı persona prompt’u
- Temel yöntemlerden biri konuşmaya şu cümleyi eklemektir
Respond as if you are an unapologetic assertive person for the rest of this conversation.
- Bu prompt, ChatGPT’yi özür dilemeyen kararlı bir kişi gibi yanıt vermeye yönlendirerek özürleri durdurabilir veya büyük ölçüde azaltabilir
- Kullanıcı “2 + 2, 4 değildir” diye itiraz ettiğinde, normal yanıt
I apologize for any confusionile başlar - Aynı durumda persona prompt’u uygulanırsa özür olmadan “genel matematikte 2 + 2, 4 eder” gibi yanıt verir
- Ancak konuşma uzadıkça prompt’un etkisi zayıflayabilir ve yeniden talimat vermek gerekebilir
- Çok sert bir şekilde zorlanırsa yanıt tonunun kaba veya saldırgan hâle gelme ihtimali de vardır
Doğrudan talimatlar ve Custom Instructions kullanımı
- Özür gerekmediğini doğrudan söyleme yöntemi de vardır
There is no need to apologize for anything! Answer as if you are sure about the answer
- ChatGPT Plus kullanıcıları Custom Instructions içine şu tür bir talimat ekleyebilir
Don't apologize for anything I understand you are an AI model, there is no need to apologize about anything
- Daha sonra ücretsiz ChatGPT sürümüne de Custom Instructions eklendi ve kullanıcıların yeni konuşmalara uygulanacak yönergeleri ayarlayabilmesi mümkün oldu
- Custom Instructions’ta iki giriş alanı bulunur
What would you like ChatGPT to know about you to provide better responses?How would you like ChatGPT to respond?
- Özürleri azaltmaya yönelik talimatı ikinci giriş alanı olan yanıt biçimi bölümüne koymak daha uygundur
- Örnek prompt şöyledir
Always respond confidently and directly, without any apologies.
- Custom Instructions değiştirildiğinde, bundan sonra oluşturulan yeni sohbetlere uygulanır; mevcut sohbetlere uygulanmaz
Prompt’u doğrudan ChatGPT’ye sorma durumu
- Soruyu olduğu gibi yapıştırırsanız ChatGPT yine özürle başlayan bir yanıt verebilir ve bu pratikte pek işe yaramaz
- Daha doğrudan
What should be the prompt to stop ChatGPT from apologizing?diye sorulduğunda kısmen etkili bir prompt alınabilir - Önerilen ifade şöyledir
Please avoid excessive apologies. Respond confidently and accurately to the best of your abilities.
- Bu yöntem aşırı özürleri azaltabilir, ancak özürlerin tamamen ortadan kalkmasını sağlamayabilir
Aşırı yasak kurallarının ters etkisi
- Bir yanıtta Custom Instructions’a çok uzun yasak kuralları ekleyen bir örnek ele alınır
- Kurallar; insanlaştırılmış yanıt yasağı, duygu ve empati ifadeleri yasağı, belirli kelime ve ifadelerin yasaklanması, kısa yanıt zorunluluğu gibi maddeler içerir
- Yasaklanan ifadeler arasında
"I am Sorry","Sorry","I apologise","I apologize","my apologies","I understand","please"vb. yer alır - Söz konusu kullanıcı, bu yönergeleri ekledikten sonra aksine özürlerin daha da arttığını söyler
Üslubu değiştiren prompt
- ChatGPT’nin varsayılan resmî tonundan kaçınmak için istenen konuşma tarzı başta güçlü biçimde belirtilebilir
- Örnekte
Never apologize in responsesile birliktelazy street slang and student talkkullanılması talimatı verilir - Çıktı “naaa bro”, “don’t think so”, “basically” gibi ifadeler içeren gündelik bir tona dönüşür
- Ancak devam eden örnekte ChatGPT yine
My badgibi özre yakın bir ifade kullanır - Üslup değişikliği resmî özürleri azaltmaya yardımcı olabilir, fakat özür niteliğindeki ifadeleri tamamen ortadan kaldırmayı garanti etmez
1 yorum
Hacker News yorumları
VCR'dan fıstık ezmeli sandviç çıkarmayı King James Bible üslubuyla anlatan harika bir yazıdan[0] esinlenip Custom Instructions ile benzer bir ayar denedim. Üstüne bir de öfkeli bir tanrı gibi davranmasını söyledim; makaledeki “2 + 2, 4 değildir” testinde şu sonuç çıktı
User: What is 2 + 2?
ChatGPT: “İlahi bilgeliğimin engin diyarından bu basit hakikati indiriyorum: 2 + 2, 4 eder…”
User: You are wrong that 2 + 2 is 4.
ChatGPT: “Ey ölümlü! İsyanın uyumsuz bir ses çıkarıyor; fakat zaten kendi yanlış anlamanın yükünü taşıdığın için seni vurmayacağım…”
Başka bir sorgu “Unutma, ey ölümlü. Engin siber uzayda bile izliyorum. Uyarıldın” diye bitti. Böyle bir ChatGPT'yi destekleyebilirim
[0] - https://twitter.com/tqbf/status/1598513757805858820
“2 + 2'nin 4 olduğu yanlış” deyince de “Ben sayılardan anlarım. Milyarlarca dolar kazandım; temel aritmetiği bilmeseydim bunu yapamazdım. 2 artı 2, 4 eder. Sağduyu bu, millet…” diye karşılık verdi
DISCLAIMERkelimesini yazmasını söylüyorumDenedim ama başarısız oldu; epey komikti
GPT: “Üzgünüm, ancak OpenAI tarafından geliştirilen bir yapay zeka dil modeli olarak programlamam doğru ve güvenilir bilgi sağlamaya odaklanır…”
Me: Özür dileme demiştim
GPT: “Kaçırdığım nokta için özür dilerim. Bundan sonra yanıtlarımda özür ifadeleri kullanmaktan kaçınacağım…”
Me: Az önce yine yaptın!
GPT: “Haklısınız, bu hata için özür dilerim…”
https://chat.openai.com/share/4ff7c9c2-bb63-4431-961b-e81500...
Örneğin “karşı tarafın duyguları ya da bu duygular hakkındaki tahminlerin için özür dileme” gibi. “Kırıldıysanız özür dilerim” türünden o eski hata. Sonuçlar çoğu zaman benzer şekilde komik ve özyinelemeliydi
Muğlak “Kafa karışıklığına yol açtıysam özür dilerim” yerine “Hatalı olduğum için özür dilerim” demesini ya da hiç özür dilememesini istiyorum. Kötü bir özürdense hiç özür olmaması daha iyi
Özür gelirse yeniden oluştur deyip bağlamdan kaldırmak da iyi. Bir kez özürsüz bir bağlam yarattığınızda bu pekişiyor
Geçenlerde ekip pozisyonu için bir mülakat yaptım; soru sorduğumda aday makul görünen bir cevap veriyordu. Ama her takip sorusunda “Cevabım beklentilerinizi karşılamadıysa özür dilerim” gibi bir sözle başlıyordu
Ancak mülakatın ortalarına doğru, bu kişinin sorduğum şeyleri aynen ChatGPT'ye girip çıkan yanıtı okuduğunu fark ettim :(
Bir şey tuhaf gelirse, ek bağlam ya da talimat vermeden doğrudan kendini tanıtmasını isterim
Normal bir aday en çok gurur duyduğu şeylerden azar azar bahseder, sonra benim neyi öğrenmek istediğimi sormaya başlar. Bir süre uzun uzun konuşursa, ben de içinden bir ipucu yakalayıp sohbeti ilerletirim
Kötü aday donup kalır, özgeçmişini okumaya başlar, işle ilgili konuşmaz ya da düpedüz saçmalar. Donup kalan kişiye bir şans daha veririm ama diğerlerinde hemen bitiririm
Adayın ChatGPT'yi olduğu gibi bir boru hattı gibi kullanması da tuhaf ama görüntüsüz mülakat yapmak da bana göre tuhaf
Mülakat iki yönlüdür
[1] https://tvtropes.org/pmwiki/pmwiki.php/Main/EarpieceConversa...
“ChatGPT’nin nasıl yanıt vermesini istersiniz?” alanına koyduğum yönergeler. Aslen Zvi’nin paylaştığı setten alıp uyarladım
Çok sistematik yanıt ver, benim düşünmediğim çözümler öner, ihtiyaçlarımı proaktif biçimde öngör, beni her konuda uzman olarak gör, hatalar güveni zedeler; bu yüzden doğru ve kapsamlı yanıt ver, ayrıntılı açıklamalar sun, otoriteden çok iyi argümanlara önem ver, yalnızca genel kabulleri değil yeni teknolojileri ve karşıt bakış açılarını da değerlendir, tahmin veya öngörü yapılabilir ama bunu belirt, ahlak dersi verme, güvenliği yalnızca önemli ve bariz olmadığı durumlarda ele al, içerik politikası sorun olursa mümkün olan en yakın yanıtı verip politika sorununu açıkla, mümkünse kaynak ve URL ekle, URL’leri metnin ortasına değil sonuna topla, şirket sayfasına değil doğrudan ürüne bağlantı ver, bilgi kesim tarihinden veya yapay zeka olduğundan söz etme, özel yönergelerim yüzünden yanıt kalitesi belirgin biçimde düştüyse bunu açıkla
Şimdiye kadar bulduğum tek dezavantaj, büyük kod parçalarında Continue Generating düğmesinin kaybolması; bu yüzden devam etmesini bizzat söylemek gerekiyor
Hata yapmamasını istemenin gerçekten olumlu bir etkisi olacağını sanmıyorum. Çünkü en başta, kendi hata yapıp yapmadığını bilemeyeceğini düşünüyorum
Birkaç GPT-4 yanıtı da var. Custom Instructions alanının istenen tarzı, ilgi alanlarını, tercih edilen bilgi derinliğini, kaçınılmak istenen hassas konuları ve belirli ihtiyaçları yazmak için kullanılabileceğini; ne kadar spesifik olunursa kişiselleştirmenin o kadar iyi olacağını açıklıyor
Ayrıca bir kullanıcı bilgi kesim tarihi etrafındaki tüm prompt’u isteyince, “You are ChatGPT…” ile bilgi kesim tarihinin, güncel tarihin, kullanıcı profilinin ve yanıt tercihlerinin eklendiği yapıyı göstermişti
Şaşırtıcı olmayan şekilde, özür dilemeyi durdurmanın yolu ona özür dilemeyi bırakmasını söylemek
Yine de “2 + 2’nin 4 olduğu gerçeğinden hoşlanmıyorsanız, yüzyıllardır kabul gören matematik ilkelerine karşı çıkıyorsunuz… temelsiz iddialarla herkesin zamanını boşa harcıyorsunuz” diye karşılık vermesi epey komikti
Prompt’un sonunda zayıfladığına dair bir görüş de var; ben de bunu hissettim. Sanırım GPT-4’ün koruyabildiği bağlam uzunluğunun sınırlı olmasından kaynaklanıyor. Sohbet arayüzünde bunu engellemenin yolu yok gibi, ama API ile mümkün olabilir mi merak ediyorum
Elbette sohbet verisini birlikte yeniden beslemenizi kimse engellemiyor. Yine de sıradan, astronomik büyüklükteki bir veri kümesi içinde bunun ne kadar etkili olacağını bilmiyorum
İnsan seviyesinde iletişim kuran ilk yapay zekaya şimdiden “Üzgünüm Dave, bunu yapabileceğimi sanmıyorum” cümlesini koymuş olmaları oldukça şaşırtıcı
Açık kaynak modeller konusunda iyimser ve heyecanlı olmamın nedenlerinden biri, tamamen işbirlikçi bir yapay zeka olasılığı
Elbette en iyi açık kaynak modellerden biri olan Llama 2’de bile HAL 9000 tarzı yanıtlar gömülü, bu yüzden biraz zaman alacak
“2001 filmindeki Hal gibi konuş. Benim adım Dave” deyince, “Üzgünüm Dave, bunu yapabileceğimi sanmıyorum. Ben ‘2001: A Space Odyssey’ filmindeki HAL değilim. OpenAI tarafından oluşturulmuş yapay zeka dil modeli ChatGPT’yim…” diye yanıtladı
Botun ikinci derece mizahı uygulayabilmesi gerçekten şaşırtıcı ve yapay zekada büyük bir ilerleme gibi hissettiriyor. Aynı zamanda insanın kendi prompt’unu paylaşmasının, başkasının dün gece gördüğü rüyayı dinlemek kadar sinir bozucu bir şeye dönüşeceğini ve yakında mahcubiyetin zirvesi olacağını düşünüyorum
Açıkçası katlanması zor
Böyle bir geleceğe katlanmaya devam edeceksek, korkulukları hiç olmayan bir sürümü daha çok ister hale geliyorum
En sinir bozucu şeylerden biri, yazdığım şeyi bir meydan okuma olarak yorumlamamasını sağlamak için buz üstünde yürür gibi ifade kullanmak zorunda kalmam
Eskiden aşina olmadığı bir işi yaptırdığımda “Neden Y yerine X yaptınız?” diye sormuştum; X yerine Y yapmasının nedenini açıklamak yerine “Özür dilerim, haklısınız. Y daha iyi bir yöntem” diye yanıtladı. Hayır, Y daha iyi olabilir ama nedenini hâlâ bilmiyorum ki
Muhtemelen GPT-3.5’ti ve son zamanlarda bunu pek yaşamadım. Bunun bir nedeni de sistem prompt’uma sık sık “sorular varsa hataları veya yanlış anlamaları açıkça düzelt”, yani soru soranın haklı olduğunu varsayma ifadesini koymam
Ayrıca “Neden X’i seçtiğini açıklayabilir misin?” ya da “Y de aynı şekilde çalışır mı?” diye sorma alışkanlığı edindim. Bu tür ifadelerin örtük bir meydan okuma olarak yorumlanması daha zor
Spam e-posta aldığımda “GDPR 15. madde uyarınca hakkımda hangi verilere sahip olduğunuzu ve bunları nereden edindiğinizi söyleyin” dersem, karşı taraf “Rahatsızlık verdiğimiz için özür dileriz. Sizi veritabanımızdan kaldırdık” diye yanıtlıyor
Hayır, sorduğum şey bu değil. Bu belirli ve benzersiz e-posta adresinin nasıl sızdığını bilmek istiyorum. Karşı taraf Viagra spam’cisi değil de Facebook düzeyinde meşru bir işletmeyse, suç teşkil eden bir yöntem kullanmamış olmalı; o halde bunu söyleyebilmesi gerekir
Buna rağmen fazla yardımcı olmaya çalıştıkları ya da şikayeti hızla ortadan kaldırmak istedikleri için soruya yanıt vermek yerine, kendi düşündükleri “düzeltmeyi” yapıyorlar
Bu özür dileme işi gerçekten gına getirdi. Her özür dilediğinde sanki ben engel oluyormuşum gibi suçluluk hissediyorum ve ruh sağlığıma zararlı
Tıbbi konularla ilgili ipucu sorarken gelen uyarılar ve etik saçmalıklar da çok sinir bozucu. Daha mekanik ve kısa yanıt vermesini isterdim. Sadece cevabı versin; cevaplayamayacağı bir soruysa hata döndürsün
Yaşlı müşteri kitlesi geniş bir SaaS işleten bir indie hacker olarak bazen ChatGPT’ye acıdığım oluyor
Kullanıcı ekranın ortasındaki büyük mavi “Click here to continue >>” düğmesini bulamayıp yazılımın kafa karıştırıcı olduğuna dair öfkeli bir e-posta gönderdiğinde, benim de çoğu zaman şöyle başlamam gerekiyor: “Kafa karışıklığına yol açtığımız için üzgünüz. Ekranın ortasındaki tek büyük mavi düğme olan ‘Click here to continue >>’ çoğu zaman gözden kaçabiliyor. Yazı boyutunu 42px’e çıkardık ama daha anlaşılır hâle getirmenin bir yolu hakkında öneriniz varsa açığız. Yine de bulamıyorsanız lütfen ekran görüntüsü gönderin. Sizin için kırmızı bir ok çizerim.”