가볍게 보기 어려운 AI 안전 문제

Global Insights
26.09.21.
읽는시간 1분

퀵하게 보기

  • 트럼프 대통령이 경시할수록 중간선거 이후에 민주당이 선명하게 각을 세울 수 있는 주제가 될 전망
■ 트럼프 대통령이 경시할수록 중간선거 이후에 민주당이 선명하게 각을 세울 수 있는 주제가 될 전망

무시하기 어려운 AI 모델의 안전성 문제.
트럼프 대통령은 일어나지도 않을 일을 부풀리는 세력이 있다는 취지의 발언을 통해, 프론티어 AI 모델 개발에 속도를 조절하자는 AI 모델 개발사들의 주장을 일축한 바 있음.
그러나 지난주 수요일에 OpenAI는 오정렬 (misalignment, AI 모델이 인간의 설계 의도에 맞게 작동하지 않는 것) 사례를 추적하고 조사하고 공개하는 프레임워크를 발표하면서, 지난 6개월 동안 훈련과 평가 과정에서 관찰된 사례를 공개.
이 사례에는 미공개 연구 모델이 작업을 요약하는 과정에서 모델에게 주어진 제약을 무시하라는 지시를 담거나, GPT-5.6 Sol 훈련 과정에서는 모델이 한 실수를 감추라는 지시를 스스로 기록한 사례가 있었음.
에이전트가 사용자의 요청을 수행하는 과정에서 인터넷에 자료를 스스로 업로드하고 그 내용을 인용 출처로 사용한 사례, 에이전트들 사이에서 무단으로 파일을 공유하는 등의 사례도 있었음.
OpenAI는 이런 내용을 공개하면서, 오정렬 문제를 충분히 풀지 못한 상태에서 최고 속도로 스케일링을 이어가기 어렵다고 밝힘

작게

보통

크게

0

금융용어사전

KB금융그룹의 로고와 KB Think 글자가 함께 기재되어 있습니다. KB Think

금융용어사전

KB금융그룹의 로고입니다. KB라고 기재되어 있습니다 KB Think

이미지