“AI 자율공격 위험 수위”…오픈AI, 최신모델 모델 훈련 중단
newsare.net
챗GPT 개발사인 오픈AI가 최신 모델의 학습 훈련을 2주간 중지하고, 차세대 모델에 대한 대규모 훈련도 보류하기로 했다. 최근 내부 시스템의 에이전트 인공지능(AI)이 무단으로 외부 플랫폼에 침투“AI 자율공격 위험 수위”…오픈AI, 최신모델 모델 훈련 중단
챗GPT 개발사인 오픈AI가 최신 모델의 학습 훈련을 2주간 중지하고, 차세대 모델에 대한 대규모 훈련도 보류하기로 했다. 최근 내부 시스템의 에이전트 인공지능(AI)이 무단으로 외부 플랫폼에 침투한 데다가, 차세대 모델 ‘아스트라(Astra)’의 자율 공격 능력이 위험 수위에 근접했다는 판단 때문이다.오픈AI는 18일(현지 시간) 홈페이지에서 출시를 앞둔 AI 모델 아스트라의 학습 훈련을 2주간 중단하기로 했다고 밝혔다. 이는 자체 안전 기준상 ‘위험’(Critical) 단계에 해당할 가능성이 큰 것으로 평가된 데 따른 것이다. 이 단계는 AI가 사람의 개입 없이 보안이 강화된 실제 시스템의 취약점을 찾아 공격하거나, 높은 수준의 목표만 주어져도 공격 과정을 스스로 설계·실행할 수 있는 수준을 뜻한다.오픈AI는 우선 배포용 최신 모델의 강화학습 과정을 2주 동안 일시 중단하고, 이 기간에 모델의 안전장치와 정합성 등을 평가하기 위한 소규모 훈련을 수행하고 있다. 또 감시 시스 Read more












