▶ 안전성 평가 강화 밝혀
▶ 관련 웹페이지도 신설
챗GPT 개발사 오픈AI는 14일 ‘자사 AI 모델에 대한 안전성 평가 결과를 발표하는 ’안전성 평가 허브‘라는 웹페이지를 공개한다고 밝혔다.
이 웹페이지에서는 자사 AI 모델이 유해 콘텐츠 생성, 탈옥(안전 장치를 우회해 제한된 콘텐츠 생성), 환각 등의 테스트에서 어떤 점수를 받았는지를 보여주게 된다. 오픈AI의 AI 모델 투명성 강화 노력은 최근 일부 모델을 둘러싸고 논란이 제기됐기 때문이다.
최근 오픈AI는 일부 대표 모델에 대해 안전성 테스트를 급하게 진행하고, 다른 모델에 대해서는 기술 보고서를 공개하지 않았다는 지적을 받아왔다. 또 지난 3월 말 챗GPT의 기본 모델인 GPT-4o의 업데이트 이후 사용자들의 불만이 커지면서 최근에는 업데이트를 전면 취소하기도 했다.
GPT-4o 업데이트는 챗GPT가 사용자 질문이나 말에 칭찬이나 동조를 많이 하도록 만들어졌는데, 문맥이나 상황과 맞지 않는 반응이 나올 때가 있었기 때문이다. 사용자들은 동물을 죽였다거나 금주 약속을 깼다는 얘기에도 “훌륭하다”는 ’생뚱맞은 칭찬‘을 받았다는 경험담이 나왔다.
댓글 안에 당신의 성숙함도 담아 주세요.
'오늘의 한마디'는 기사에 대하여 자신의 생각을 말하고 남의 생각을 들으며 서로 다양한 의견을 나누는 공간입니다. 그러나 간혹 불건전한 내용을 올리시는 분들이 계셔서 건전한 인터넷문화 정착을 위해 아래와 같은 운영원칙을 적용합니다.
자체 모니터링을 통해 아래에 해당하는 내용이 포함된 댓글이 발견되면 예고없이 삭제 조치를 하겠습니다.
불건전한 댓글을 올리거나, 이름에 비속어 및 상대방의 불쾌감을 주는 단어를 사용, 유명인 또는 특정 일반인을 사칭하는 경우 이용에 대한 차단 제재를 받을 수 있습니다. 차단될 경우, 일주일간 댓글을 달수 없게 됩니다.
명예훼손, 개인정보 유출, 욕설 등 법률에 위반되는 댓글은 관계 법령에 의거 민형사상 처벌을 받을 수 있으니 이용에 주의를 부탁드립니다.
Close
x