자유게시판

openai 내부모델 2주간 학습 중단

작성자
작성일
2026-08-19 08:01
조회
3


모델의 능력이 강력해질수록, 모델을 내부에서 개발하고 테스트하는 과정에서 발생할 수 있는 위험도 함께 커집니다.

 

우리는 배포를 목적으로 개발 중인 최신 모델들에 대한 강화학습(RL) 훈련을 2주 동안 일시 중단했습니다. 그 기간 동안 연구 환경의 보안을 강화하고, 레드팀 테스트를 진행했으며, 모니터링 범위를 확대했습니다.

 

현재 계획된 가장 큰 규모의 프런티어 강화학습 훈련은 여전히 보류된 상태입니다. 그에 앞서 더 작은 규모의 훈련과 평가를 통해 이러한 안전장치가 실제로 효과적인지 검증하고, 모델이 의도에 맞게 정렬(alignment)되어 있다는 추가적인 근거를 확보하고 있습니다.

 

 



(그래도 훌륭한 새 모델들은 곧 출시할 예정입니다. 이번 조치의 영향은 그보다 더 먼 시점에 출시될 모델들에 해당합니다.)

 

 

 
전체 0