Astra급 사이버 역량에서 중요한 것은 모델보다 통제 루프다
OpenAI의 Astra 사이버보안 평가와 배포 안전장치를 바탕으로 고성능 에이전트의 능력·정렬·모니터링을 분리해 읽습니다.
3편
OpenAI의 Astra 사이버보안 평가와 배포 안전장치를 바탕으로 고성능 에이전트의 능력·정렬·모니터링을 분리해 읽습니다.
OpenAI가 차기 모델의 사이버 역량 평가 뒤 강화학습과 도구 사용 감시를 조정한 이유를 개발 비용과 안전 기준의 관점에서 해설합니다.
차기 모델의 사이버 역량 평가와 강화학습 중단, 감시·격리 비용이 AI 모델 개발에 주는 의미를 살펴봅니다.