본문의 개요: 전 세계 사람들이 급변하는 인공지능(AI)에 대한 기대를 품고 있는 반면, 그 막대한 능력이 인간의 통제를 벗어나 걷잡듯이 굴러버릴까 하는 우려를 동시에 안고 있습니다. 그리고 전 세계 연구자들은 AI의 안전성을 높이고, 걷잡음을 방지하며, 그 능력을 인간에게 바람직한 방향으로 이끌 방법을 모색하고 있습니다. 하지만 규칙을 부여하고, 금지 사항을 설정하고, 인간이 감시하고, AI의 행동을 외부에서 통제하는 것만으로는 고도의 인공지능의 걷잡힌 발상을 막을 수 있을까요? AI의 능력이 더욱 고도화될수록, 모든 상황을 인간이 사전에 예측하는 것은 점점 더 어려워지고, 모든 것을 규칙으로 부여하는 것도 불가능해지며, 외부에서의 통제만으로는 걷잡음을 막을 수 없게 될 것입니다. AI를 외부에서 통제하는 것 외에도, AI 스스로 자신의 판단을 되돌아보고, 그 판단이 인간이나 사회에 어떤 영향을 미치는지 고려하며, 단기적인 목표 달성뿐만 아니라 그 이후에 발생할 결과까지 고려하고, 여러 가치가 충돌했을 경우에는 단순하게 하나의 목표를 최대화하는 것이 아니라, 인간에게 더 바람직한 선택을 찾아 지속적으로 개선하는 능력을 길러야 할까요. 또한, 자신의 판단에 문제가 있다는 것을 인지했을 때, 멈춰 서서 반성하고, 필요하다면 판단을 수정하는 능력을 갖추어야 합니다. 이것이 AI의 걷잡힌 발상을 막고, 그 막대한 능력을 인간 사회에게 바람직한 방향으로 이끌 수 있는 하나의 효과적인 방법이 될 수 있습니다. “AI의 걷잡힌 발상을 막기 위해, AI를 외부에서 억압하는 것 외에도, AI 스스로 자신의 판단을 되돌아보고, 그 판단이 인간이나 사회에 어떤 영향을 미치는지 고려하며, 단기적인 목표 달성뿐만 아니라 그 이후에 발생할 결과까지 고려하고, 여러 가치가 충돌했을 경우에는 단순하게 하나의 목표를 최대화하는 것이 아니라, 인간에게 더 바람직한 선택을 찾아 지속적으로 개선하는 능력을 길러야 합니다.” 이를 위한 기반으로 “자기 인식 의식”과 “관계 인식 의식”이라는 기능을 AI에게 부여합니다.
출처: note 원문
번역: Gemma 3(.44) 초벌 + 교정 검수
원문 보기 | 출처: note.com