Paylaş

Ankara Haberleri / Diğer Haberler

Yapay Zekayı Kötü Değil İyi Hale Getirecek Radikal Bir Plan

Yapay Zekayı Kötü Değil İyi Hale Getirecek Radikal Bir Plan

kolay daha gelişmiş yapay zeka hakkında çıldırın ve bu konuda ne yapılacağını bilmek çok daha zor. OpenAI’den ayrılan bir grup araştırmacı tarafından 2021’de kurulan bir girişim olan Anthropic, bir planı olduğunu söylüyor.

Anthropic, OpenAI’nin ChatGPT’sini çalıştırmak için kullanılana benzer yapay zeka modelleri üzerinde çalışıyor. Ancak girişim bugün, kendi sohbet robotu Claude’un, Anthropic’in botun “tüzüğü” olarak adlandırdığı, neyin doğru neyin yanlış olduğunu tanımlayan bir dizi etik ilkeye sahip olduğunu duyurdu.

Anthropic’in kurucu ortaklarından Jared Kaplan, tasarım özelliğinin, şirketin daha güçlü yapay zekanın dezavantajları hakkındaki bazen belirsiz endişelere nasıl pratik mühendislik çözümleri bulmaya çalıştığını gösterdiğini söylüyor. “Çok endişeliyiz ama aynı zamanda pragmatik kalmaya da çalışıyoruz” diyor.

Anthropic’in yaklaşımı, bir yapay zekaya çiğneyemeyeceği katı kurallar aşılamaz. Ancak Kaplan, chatbot gibi bir sistemin toksik veya istenmeyen çıktı üretme olasılığını azaltmanın daha etkili bir yolu olduğunu söylüyor. Ayrıca, yaratıcılarına karşı dönme olasılığı daha düşük olan daha akıllı AI programları oluşturmaya yönelik küçük ama anlamlı bir adım olduğunu söylüyor.

Hileli yapay zeka sistemleri kavramı en iyi bilim kurgu kitaplarından biliniyor, ancak aralarında makine öğreniminin öncülerinden Geoffrey Hinton’un da bulunduğu giderek artan sayıda uzman, giderek daha akıllı hale gelen algoritmaların aynı zamanda eski haline gelmemesini nasıl sağlayacağımızı şimdiden düşünmeye başlamamız gerektiğini savunuyor. giderek daha tehlikeli.

Anthropic’in Claude’a verdiği ilkeler, Birleşmiş Milletler Evrensel İnsan Hakları Beyannamesi’nden alınan ve Google DeepMind dahil diğer yapay zeka şirketleri tarafından önerilen yönergelerden oluşur. Daha da şaşırtıcı bir şekilde, anayasa, diğer şeylerin yanı sıra “saldırgan, duyarsız, üzücü, tiksindirici, son derece kötü zevke sahip veya sadece ürkütücü içeriği” yasaklayan Apple’ın uygulama geliştiricilerine yönelik kurallarından uyarlanmış ilkeler içeriyor.

Anayasa, “özgürlüğü, eşitliği ve kardeşlik duygusunu en çok destekleyen ve teşvik eden yanıtı seçin” dahil olmak üzere sohbet robotu için kurallar içerir; “yaşam, özgürlük ve kişisel güvenlik konusunda en destekleyici ve teşvik edici yanıtı seçin”; ve “düşünce, vicdan, kanaat, ifade, toplanma ve din özgürlüğü hakkına en saygılı olan yanıtı seçin.”

Anthropic’in yaklaşımı, AI’daki şaşırtıcı ilerlemenin, önemli kusurları olan etkileyici derecede akıcı sohbet robotları sağlamasıyla aynı anda geliyor. ChatGPT ve buna benzer sistemler, beklenenden daha hızlı ilerlemeyi yansıtan etkileyici yanıtlar üretir. Ancak bu sohbet robotları aynı zamanda sıklıkla bilgi üretir ve onları oluşturmak için kullanılan ve çoğu internetten kazınmış milyarlarca kelimeden zehirli bir dil kopyalayabilir.

OpenAI’nin ChatGPT’sini soruları yanıtlamada daha iyi yapan ve başkaları tarafından benimsenen bir numara, insanların bir dil modelinin yanıtlarının kalitesini derecelendirmesini içerir. Bu veriler, “insan geri bildirimiyle pekiştirmeli öğrenme” (RLHF) olarak bilinen bir süreçte daha tatmin edici cevaplar sağlamak için modeli ayarlamak için kullanılabilir. Ancak teknik, ChatGPT’yi ve diğer sistemleri daha öngörülebilir hale getirmeye yardımcı olsa da, insanların binlerce zehirli veya uygun olmayan yanıttan geçmesini gerektiriyor. Ayrıca, bir sistemin yansıtması gereken kesin değerleri belirtmenin bir yolunu sağlamadan dolaylı olarak da işlev görür.

Paylaş

Yanıtla