Term

アライメント

別名: AI Alignment

Overview

最終更新: 2026年7月9日

アライメントは、AIシステムが人間の意図、目標、倫理的価値観に沿って動作するように調整する技術的・思想的なプロセスを指す。LLMにおいては、有害な回答の抑制や、特定の政治的・文化的なバイアスの制御が含まれる。強化学習(RLHF)などの手法を用いて行われるが、どの価値観を「正解」とするかについては、開発企業の主観や所在国の法的・政治的背景が反映されやすく、中立性の確保が課題となっている。

Mentioned Articles

1 件