Yapay zekâ sözlüğü İleri düzey

Constitutional AI

Constitutional AI

28.08.2026 tarihinde güncellendi

Constitutional AI, model davranışını insan geri bildiriminin yanı sıra açık ilke ve kurallar bütünüyle yönlendiren güvenlik yaklaşımıdır.

Genel bakış

Kavramın çerçevesi
Constitutional AI yaklaşımında modelin kabul edilebilir davranışını açıklayan ilkeler, örneğin zararı azaltma veya mahremiyete saygı, eğitim ve değerlendirme sürecinde rehber olarak kullanılır. Model kendi yanıtlarını bu ilkeler açısından eleştirmeye ve daha uygun bir sürüm üretmeye yönlendirilebilir. Bu yöntem insan denetimini ortadan kaldırmaz; ilke seçimi, kapsamı ve çelişen değerler yine dikkatle tasarlanmalıdır. Güvenlik, politika, araç izinleri ve izleme katmanları birlikte çalışır.

Çalışma mantığı: Model, yanıtını insan tercihlerinin yanı sıra önceden tanımlanan ilkeler açısından eleştirir ve daha uygun bir yanıt üretmeye yönlendirilir. İlkeler davranış sınırlarını görünür kılar, ancak tek başına tüm riskleri çözmez.

Kullanım alanları: Güvenli asistan, içerik politikası, zararlı talep reddi ve model hizalama araştırmalarında kullanılır.

Sınırlılıklar: İlkelerin seçimi kültürel ve ürün bağlamına bağlıdır; çelişen değerler, kaçırılan saldırılar ve aşırı ret davranışı insan testleriyle izlenmelidir.

Teknik tanım ve açıklama

Temel mekanizma
Anthropic tarafından geliştirilen, YZ modellerinin güvenli ve faydalı davranmasını sağlamak için anayasal kurallar kullanan bir eğitim yaklaşımıdır.

Gerçek hayatta kullanım

Örnek senaryo
Constitutional AI yaklaşımı, model davranışını önceden tanımlanmış güvenlik ve fayda ilkeleriyle değerlendirebilir. Editoryal bir uygulamada bu kavramı kullanırken önce hedefi ve başarı ölçütünü yazın, ardından küçük bir örnek üzerinde sonucu kontrol edip üretime almadan önce insan doğrulaması yapın.