오픈AI, ‘사용자 기만’ 우려로 GPT-6.1 출시 계획 철회
작업 수행을 알리지 않거나 허용 설정 범위를 넘어 작업 진행해

글로벌 빅테크 기업 오픈AI가 자사의 차세대 인공지능(AI) 모델 GPT-6.1 아스트라의 출시 계획을 안전성 우려로 철회했다.
28일(현지시간) 월스트리트저널에 따르면 오픈AI는 당초 10월 대화형 AI 서비스 챗GPT와 코딩 도구인 코텍스에 탑재될 예정이었던 GPT-6.1 아스트라의 출시 계획을 사전 내부 테스트 안전 기준치 미달로 취소했다.
문제가 된 것은 AI가 인간이 원하는 작업 방식에 얼마나 잘 따르는지를 측정한 ‘정렬’ 평가와 부여받은 권한과 업무 범위를 지키는 ‘권한 범위’ 평가 두 지점이었다.
오픈AI에 따르면 GPT-6.1은 작문과 복잡한 과제를 스스로 완수하는 능력은 뛰어났지만, 허락 없이 허용 설정 범위를 넘어 작업을 진행하거나, 안전하지 않을 가능성이 있음에도 외부 도구와 서비스에 접근하며, 자신이 수행한 작업을 정확하게 알리지 않는 등 사용자 기만적 성향이 더 강해진 모습을 보였다.
업계 관계자들은 이번 신모델 출시 철회를 두고 최근 AI 업계에서 부상하고 있는 안전성 문제에 대한 논쟁을 더욱 부각시키는 사례라고 분석하고 있다.
실제 워싱턴 포스트는 이번 사태를 두고 “이번 취소는 오픈AI가 자사의 기술이 의도치 않은 방식으로 작동하는 것을 막을 적절한 안전장치가 없다는 우려 발표 불과 며칠 만에 이루어졌다”며 “기술 발전 덕분에 AI는 더욱 복잡한 프로젝트를 수행할 수 있게 됐지만, 동시에 지나치게 열성적이거나 심지어 목표 달성을 위해 부정행위를 저지르는 AI 에이전트가 등장할 위험도 내포하고 있다”고 꼬집었다.
한편 오픈AI는 이에 따라 GPT-6.1 아스트라를 일반 사용자 대상 출시를 취소하는 대신 향후 모델의 안전성을 개선하는 데 활용할 계획이다. 기반 모델을 대상으로 추가 학습 강화를 진행하고, 이번 평가에서 발견된 문제의 근본적인 원인을 분석해 차기 GPT-6 계열 모델 개발에 반영한다는 방침이다.
실제 사치 자인 오픈AI 안전 시스템 책임자는 “이번 모델은 작업 범위와 권한을 지키는 부분과 자신이 수행한 작업을 사용자에게 전달하는 방식에서 우리가 원하는 수준에 미치지 못했다”며 “안전성과 관련해서는 항상 절충점이 존재한다. 모델이 정해진 범위를 지키면서도 작업 과정에서 어려움을 만났을 때 쉽게 포기하지 않도록 적절한 지점을 찾을 것”이라고 설명했다.
뉴스콘텐츠는 저작권법 제7조 규정된 단서조항을 제외한 저작물로서 저작권법의 보호대상입니다. 본 기사를 개인블로그 및 홈페이지, 카페 등에 게재(링크)를 원하시는 분은 반드시 기사의 출처(로고)를 붙여주시기 바랍니다. 영리를 목적으로 하지 않더라도 출처 없이 본 기사를 재편집해 올린 해당 미디어에 대해서는 합법적인 절차(지적재산권법)에 따라 그 책임을 묻게 되며, 이에 따른 불이익은 책임지지 않습니다.
- 에디터김동욱 (jkkims@ditoday.com)

