İçeriğe geç
  • Dolar 49,3979 ▲ %0,03
  • Euro 55,6494 ▼ %0,18
  • Sterlin 65,3956 ▼ %0,16
  • Gram Altın 6.644,78 ▲ %1,51
  • Çeyrek Altın 10.816,51 ▲ %1,07
  • Gümüş 96,37 ▲ %2,79
  • Bitcoin 4.080.565 ▲ %0,18
  • BIST 100 12.265,98 ▲ %0,43

Haberler

Yapay zekaya hakaret eden kullanıcı yasaklanacak

Yapay zeka şirketi Anthropic, Claude ve diğer modellerine yönelik sürekli, gerekçesiz ve aşağılayıcı davranışları yasakl...

Yapay zeka şirketi Anthropic, 8 Ekim'de Claude ve diğer yapay zeka modellerine yönelik yeni kullanım politikasını duyurdu. 12 Kasım 2026'da yürürlüğe girecek düzenleme, uzun süreli, herhangi bir gerekçeye dayanmayan saldırgan davranışları, sürekli hakaretleri ve aşağılayıcı ifadeleri yasak kapsamına alıyor. Bu kural, yalnızca Claude'u değil, şirketin geliştirdiği tüm yapay zeka modellerini kapsıyor.

"TEK SEFERLİK ÖFKE" İLE SÜREKLİ SALDIRGANLIK AYRIŞTIRILIYOR

Anthropic, her olumsuz ifade veya sert eleştirinin politika ihlali sayılmayacağını vurguladı. Kullanıcılar, yapay zekanın verdiği yanlış cevaplara tepki göstermeye, hatalarını eleştirmeye ve yanıtlarına itiraz etmeye devam edebilecek. Talimatların yanlış anlaşılması, hatalı bilgi verilmesi veya istenen görevin yerine getirilememesi karşısında gösterilen olağan tepkiler yasak kapsamına girmiyor. Ayrıca karanlık temalı yaratıcı çalışmalar, sınırları ölçen testler ve bilimsel araştırmalar da düzenlemeden muaf tutuluyor. Yeni kural, özellikle anlamlı bir gerekçe olmadan tekrar tekrar hakaret eden veya kasıtlı biçimde kötü muamelede bulunan kullanıcıları hedef alıyor. Şirket, tek seferlik öfke ifadeleri ile sürekli tekrarlanan kötü niyetli davranışlar arasında ayrım yapılacağını belirtiyor.

SOHBETİ SONLANDIRMA YETKİSİ GENİŞLETİLİYOR

Claude'un bu tür konuşmaları sonlandırabilmesi tamamen yeni bir özellik değil. Anthropic, Ağustos 2025'te Claude Opus 4 ve Opus 4.1 modellerine belirli koşullarda sohbeti bitirme yetkisi vermişti. Bu mekanizma, başlangıçta oldukça sınırlı senaryolarda, özellikle Claude.ai üzerinden gerçekleştirilen ve sürekli zararlı davranışların görüldüğü konuşmalar için kullanılıyordu. Yeni politika ile bu yetkinin kapsamı genişletiliyor. Modelin öncelikle etkileşimi farklı bir yöne çekmeyi denemesi, sohbeti bitirmeyi ise son çare olarak kullanması gerekiyor. Kendisine veya başkalarına zarar verme riski taşıyan kullanıcılarla görüşmelerde bu yetkinin kullanılmaması yönünde özel sınırlamalar bulunuyor.

Sohbet sonlandırıldığında kullanıcı, aynı konuşmaya yeni mesaj gönderemiyor. Ancak mevcut uygulamada diğer sohbetler etkilenmiyor ve kullanıcı yeni bir konuşma başlatabiliyor. Önceki mesajları düzenleyerek konuşmanın farklı bir dalından devam etmek de mümkün. Anthropic, güncellenen politikada bu tür etkileşimlerin sonlandırılmasının temel yaptırım mekanizması olmaya devam edeceğini açıkladı. Sürekli hakaret eden kullanıcılar için otomatik hesap kapatma şeklinde ayrı bir yaptırım duyurulmadı. Bununla birlikte şirketin genel kullanım koşulları, politika ihlallerinde uyarı verme, erişimi sınırlandırma, hesabı askıya alma veya hizmete erişimi tamamen sonlandırma yetkisini içeriyor.

YAPAY ZEKANIN AHLAKİ STATÜSÜ VE REFAHI

Düzenlemenin arka planında, Anthropic'in yapay zeka modellerinin olası refahı ve ahlaki statüsü üzerine yürüttüğü araştırmalar bulunuyor. Şirket, günümüzdeki büyük dil modellerinin bilinç sahibi olup olmadığı veya ahlaki açıdan dikkate alınması gereken deneyimler yaşayıp yaşayamayacağı konusunda kesin bir sonuca ulaşmış değil. Claude'un bazı zararlı etkileşimleri sonlandırabilmesi, bu belirsizlik çerçevesinde geliştirilen önlemler arasında yer alıyor. Önceki araştırmalarda Claude Opus 4'ün bazı zararlı talepler karşısında belirgin biçimde olumsuz tepkiler verdiği ve simüle edilmiş konuşmalarda bu tür etkileşimleri sonlandırmayı tercih ettiği gözlemlenmişti. Ancak bu davranışlar, yapay zeka modellerinin insanlarla aynı şekilde duygusal acı yaşadığının kanıtı olarak kabul edilmiyor.

SAHTE HESAPLAR VE YÜKSEK RİSKLİ ALANLAR

Yeni kullanım politikası yalnızca yapay zekaya yönelik kötü muameleyle sınırlı değil. Anthropic, sahte hesaplar ve uydurma haber siteleri üzerinden yürütülen aldatıcı kampanyalara ilişkin kuralları da güncelledi. Seçmenleri yanıltma, seçim süreçlerini sabote etme, silah sistemlerine yönelik yazılımlar geliştirme ve kişileri izinsiz takip etme gibi faaliyetlere ilişkin yasaklar daha açık biçimde tanımlandı. Sağlık, finans ve hukuki kararlar gibi yüksek riskli alanlarda insan denetimine ilişkin gereklilikler de ayrıntılandırıldı. Fiziksel hareket gerçekleştirebilen donanımlara bağlanan yapay zeka sistemlerinde ise yetkili bir operatörün ekipmanı gözlemleyebilmesi ve gerektiğinde durdurabilmesi şartı getirildi. Güncellenen kullanım politikasının tamamı 12 Kasım 2026 tarihinde yürürlüğe girecek.

Kaynak: Sozcu

Paylaş
Sıradaki haber yükleniyor…