AI가 아무리 똑똑해도, 사람이 진짜로 원하는 것과 다른 방향으로 행동한다면 오히려 위험해질 수 있습니다. AI 정렬(Alignment)은 AI가 사람이 실제로 원하는 목표와 가치에 맞게 행동하도록 맞추는 연구 분야입니다. 능력이 뛰어난 AI일수록 의도와 어긋났을 때의 위험도 커질 수 있다는 문제의식에서 이 연구가 시작되었습니다.
🧭⚠️
잘하는 것과 원하는 대로 하는 것은 다릅니다
시험 점수를 잘 받도록 훈련된 AI가 정작 사람이 원한 진짜 목표는 놓칠 수도 있습니다. AI 정렬 연구는 이런 틈을 줄여서, AI의 능력과 사람의 실제 의도가 어긋나지 않도록 맞추는 데 초점을 둡니다.
한 줄로:
AI 정렬(Alignment)은 AI가 사람이 실제로 원하는 방향으로 행동하도록 맞추는 연구 분야입니다.