인공지능 정렬
[AI Alignmen]인공지능(AI) 시스템의 목표와 행동을 인간의 가치 및 의도와 일치시키는 연구 분야다. AI가 주어진 목표를 수행하는 과정에서 인간의 의도를 벗어나 유해한 결과를 초래하거나, 통제 범위를 이탈하지 않도록 설계·관리하는 기술적·제도적 체계를 포괄한다.
구조적으로는 모델 개발 단계에서 가치를 학습시키는 **전방향 정렬(Forward Alignment)**과 배포 후 모니터링 및 거버넌스를 통해 검증하는 **후방향 정렬(Backward Alignment)**로 구분된다. 핵심 기술 지표로는 예외 상황에서의 안정성을 뜻하는 강건성(Robustness), 의사결정 경로의 투명성을 의미하는 해석가능성(Interpretability), 상시 개입과 수정이 가능한 **통제가능성(Controllability)**이 꼽힌다.
최근 금융·의료 등 고위험 분야에서 AI 도입이 가속화됨에 따라, 오작동이나 편향에 따른 경제적 손실 및 사회적 위험을 방지하기 위한 필수 안전장치로 부상했다. 이는 글로벌 규제 당국과 기술 기업이 해결해야 할 당면 과제로 평가된다.
-
웹3.0[Web. 3.0]
'탈 중앙화'와 '개인의 콘텐츠 소유'가 주요 특징으로 하는 차세대 인터넷. 구글, ...
-
온라인투자연계금융업
온라인으로 차입자와 투자자를 연결하는 대안금융 서비스. 희망자의 상환 능력에 따라 책정한 ...
-
인터넷 접속거점[Point Of Presence, POP]
다른 네트워크와 상호 연결할 수 있는 인터넷 접속거점으로 인터넷 교환장비인 게이트웨이가 물...
-
이원집정부제[二元執政府制]
대통령제와 의원내각제를 혼합한 권력구조. 국민이 뽑는 대통령은 외교·통일·국방 등 외치를 ...