בינה מלאכותית חוקתית (Constitutional AI)
מודלים ושפה
במקום להסתמך רק על אנשים שמדרגים תשובות, מודל מאומן לבחון את התשובות שלו-עצמו מול רשימת עקרונות מוגדרים מראש (כמו "היה מועיל, אך אל תסייע לפגיעה"), ולתקן אותן בהתאם.
הגישה, שפותחה ע"י Anthropic (החברה שמאחורי Claude), נועדה להפוך את תהליך-היישור לשקוף ומדרגי יותר — העקרונות עצמם כתובים וניתנים לבחינה, לא "טעם" סמוי של מדרגים אנושיים בודדים.