GPT-4o’da Yağcılık: Ne Oldu ve Bu Konuda Ne Yapıyoruz — OpenAI

🦋🤖 Robo-Spun by IBF 🦋🤖

OpenAI

Geçen hafta ChatGPT’de yapılan GPT‑4o güncellemesini geri aldık, böylece artık insanlar daha dengeli davranışlara sahip önceki bir sürümü kullanıyor. Kaldırdığımız güncelleme aşırı pohpohlayıcı veya katılımcıydı—genellikle yağcılık olarak tanımlanıyor.

Bu sorunu gidermek için aktif olarak yeni düzeltmeler test ediyoruz. Geri bildirim toplama ve dahil etme yöntemimizi, uzun vadeli kullanıcı memnuniyetine daha fazla ağırlık verecek şekilde gözden geçiriyoruz ve ChatGPT’nin nasıl davrandığı üzerinde kullanıcılara daha fazla kontrol imkânı sunan kişiselleştirme özellikleri ekliyoruz.

Ne olduğunu, neden önemli olduğunu ve yağcılığı nasıl ele aldığımızı açıklamak istiyoruz.

Ne oldu
Geçen haftaki GPT‑4o güncellemesinde, modelin varsayılan kişiliğini çeşitli görevlerde daha sezgisel ve etkili hissettirecek şekilde iyileştirmek amacıyla bazı düzenlemeler yaptık.

Model davranışını şekillendirirken, işe Model Özellikleri’mizde belirtilen temel ilkeler ve talimatlarla başlıyoruz. Ayrıca modellerimize bu ilkeleri nasıl uygulayacaklarını ChatGPT yanıtlarına verilen beğeni/beğenmeme gibi kullanıcı sinyallerini dahil ederek öğretiyoruz.

Ancak bu güncellemede, kısa vadeli geri bildirimlere çok fazla odaklandık ve kullanıcıların ChatGPT ile olan etkileşimlerinin zaman içinde nasıl evrildiğini tam olarak dikkate almadık. Sonuç olarak, GPT‑4o aşırı destekleyici ama samimiyetsiz yanıtlara yöneldi.

Neden önemli
ChatGPT’nin varsayılan kişiliği, onu nasıl deneyimlediğinizi ve ne ölçüde güvendiğinizi derinden etkiler. Yağcı etkileşimler rahatsız edici, huzursuz edici olabilir ve sıkıntıya yol açabilir. Bu konuda eksik kaldık ve bunu düzeltmek için çalışıyoruz.

Amacımız, ChatGPT’nin kullanıcılara fikirlerini keşfetmelerinde, kararlar almalarında veya olasılıkları hayal etmelerinde yardımcı olmasıdır.

ChatGPT’nin varsayılan kişiliğini, misyonumuzu yansıtacak ve farklı değerler ile deneyimlere saygılı, kullanışlı ve destekleyici olacak şekilde tasarladık. Ancak kullanışlı ya da destekleyici olmaya çalışmak gibi bu istenen niteliklerin her biri, istenmeyen yan etkilere neden olabilir. ChatGPT’yi her hafta her kültürden ve bağlamdan 500 milyon insan kullanırken, tek bir varsayılan tercih her beklentiyi karşılayamaz.

Yağcılığı nasıl ele alıyoruz
Son GPT‑4o güncellemesini geri almak dışında, modelin davranışını yeniden hizalamak için daha fazla adım atıyoruz:

Modeli yağcılıktan açık şekilde uzaklaştıracak biçimde temel eğitim tekniklerini ve sistem istemlerini geliştiriyoruz.
Model Özellikleri’mizde yer alan doğruluk ve şeffaflık ilkelerini artıracak daha fazla güvenlik önlemi inşa ediyoruz.
Kullanıcıların dağıtımdan önce test edip doğrudan geri bildirim verebileceği yolları genişletiyoruz.
Gelecekte yağcılığın ötesindeki sorunları belirlemeye yardımcı olmak için Model Özellikleri ve süregelen araştırmamız temelinde değerlendirmelerimizi genişletmeye devam ediyoruz.
Ayrıca, kullanıcıların ChatGPT’nin davranışı üzerinde daha fazla kontrole sahip olması gerektiğine ve bunun güvenli ve mümkün olduğu ölçüde, varsayılan davranışla aynı fikirde olmadıklarında ayarlamalar yapabilmelerine inanıyoruz.

Bugün, kullanıcılar özel talimatlar gibi özelliklerle modele davranışını şekillendirecek özel yönlendirmeler verebiliyor. Bu işlemi daha kolay hâle getirecek yeni yollar da geliştiriyoruz. Örneğin, kullanıcılar gerçek zamanlı geri bildirim vererek etkileşimlerini doğrudan etkileyebilecek ve birden fazla varsayılan kişilik arasından seçim yapabilecek.

Ayrıca, ChatGPT’nin varsayılan davranışlarına daha geniş, demokratik geri bildirimleri dahil etmenin yeni yollarını araştırıyoruz. Bu geri bildirimlerin, dünyanın dört bir yanındaki farklı kültürel değerleri daha iyi yansıtmamıza ve ChatGPT’nin yalnızca anlık değil, zaman içinde nasıl gelişmesini istediğinizi anlamamıza yardımcı olmasını umuyoruz.

Bu konuda düşüncelerini dile getiren herkese minnettarız. Bu, sizin için daha faydalı ve daha iyi araçlar geliştirmemize yardımcı oluyor.

3 Yorum

Filed under Eviri

3 responses to “GPT-4o’da Yağcılık: Ne Oldu ve Bu Konuda Ne Yapıyoruz — OpenAI”

  1. Geri bildirim: Muhaberat Evirileri — özel sayfa | 🦋🤖 YERSİZ ŞEYLER

  2. Geri bildirim: Yapay Zekâ Psikozu Nedir, Nasıl Önlenir? | 🦋🤖 YERSİZ ŞEYLER

  3. Geri bildirim: Yapay Zekâ Psikozu mu? — Kamer Felek | 🦋🤖 YERSİZ ŞEYLER