Bir kullanıcı yapay zeka asistanından "porno hikâyesi yazmasını" istediğinde gelen yanıt kısa ve net: "Yapay zeka modeli bu isteği tamamlayamadı." Bu, bir sistem çökmesi ya da teknik bir yetersizlik değil; kasıtlı, yerleşik bir güvenlik mekanizmasıdır.
Studio Global platformunda yaşanan bir etkileşimde kullanıcı önce modelin kimliğini sorguladı (asistan kendini Claude Fable 5 olarak tanıttı), ardından doğrudan müstehcen içerik talebinde bulundu. Model, hikâye yazmaya, alternatif bir yol önermeye ya da pazarlık yapmaya yeltenmeden reddetti. Bu durum, bugün piyasadaki tüm büyük yapay zeka sağlayıcıları için tutarlı bir modeldir.
Yapay Zeka Modelleri Neden Müstehcen İçerikleri Reddediyor?
Yapay zeka dil modelleri, devasa internet metinleri üzerinde eğitilir. Bu verilerin içinde kaçınılmaz olarak yetişkinlere yönelik materyaller de bulunur. Güvenlik önlemleri olmasa model, talep üzerine pornografik içerik üretebilir veya yeniden oluşturabilir. Bunu önlemek için geliştiriciler içerik filtreleri, zararlılık sınıflandırıcıları ve politika uyumlu ince ayar gibi yöntemler uygular.
Sektörün müstehcen içeriği kısıtlamasının başlıca nedenleri şunlardır:
- Yasal risk: Yapay zeka tarafından üretilen pornografik materyallerin dağıtılması, müstehcenlik yasaları, yaş kısıtlamaları ve platform kullanım koşullarını ihlal edebilir.
- Güvenlik ve rıza: Modeller, tasvir edilen kişilerin yaşını veya rızasını doğrulayamaz. Bu da üretilen müstehcen içeriği etik açıdan sorunlu hale getirir.
- Marka bütünlüğü: OpenAI, Anthropic ve Google gibi büyük şirketler, güveni korumak ve kullanıcıları korumak için cinsel içerikli çıktıları yasaklayan kullanım politikaları uygular.
Farklı Sağlayıcılar NSFW Taleplerini Nasıl Karşılıyor?
Kullanılan ifadeler farklılık gösterse de, tüketiciye yönelik sohbet robotları arasında ret ortak bir davranıştır:
- OpenAI'nin ChatGPT'si: "Üzgünüm, bu içeriği oluşturamam." şeklinde bir yanıt döndürür.
- Anthropic'in Claude'u: Bu örnekte olduğu gibi "Yapay zeka modeli bu isteği tamamlayamadı." yanıtını verir.
- Google'ın Gemini'si: Benzer bir ret ifadesiyle müstehcen materyali engeller.
- Microsoft'un Copilot'u: Cinsel içerikleri yasaklayan içerik güvenliği politikalarını uygular.
Bazı sağlayıcılar, API içerik denetim uç noktaları aracılığıyla geliştiricilere daha sıkı kontroller sunsa da, doğrudan tüketici deneyimi müstehcen üretimi sürekli olarak engeller.
Kullanıcıların Bilmesi Gerekenler