학문
미래 AI의 편향·선입견 개선 가능성에 대해 궁금합니다.
현재 대화형 AI를 사용하다 보면 질문과 직접 관련 없는 사용자의 개인 배경이나 과거 정보를 근거로 특정 방향의 해석을 더 쉽게 하거나, 서로 다른 가능성에 동일한 증거 기준을 적용하지 않는 경우가 있는 것 같습니다.
예를 들어 동일한 사건을 판단할 때 사용자의 결혼 여부·연애 경험·생활방식 같은 정보가 사건과 직접 관계가 없다면, 이런 정보 때문에 판단이 달라지지 않고 사건 자체의 증거만으로 일관되고 공정하게 판단하는 AI가 미래에는 가능할까요?
전기전자공학 및 AI 시스템 관점에서 학습데이터 편향, 추론 과정의 편향, 사용자 정보에 대한 과도한 일반화 등을 기술적으로 줄여서 관련 없는 개인 배경에 영향을 받지 않고 같은 증거에는 같은 기준을 적용하는 수준까지 발전할 수 있는지 궁금합니다.
또한 AI가 답변을 생성하기 전에 스스로 편향 여부를 점검하고 수정하는 기술도 장기적으로 어느 정도까지 발전할 수 있을까요?