크롬 V8 제로데이 2건 찾아 구글 신고
익스플로잇짐 평가에서 GPT-5.6 사이버가 오픈AI가 평가한 모델 중 가장 높은 성공률을 기록했다. 오픈AI 제공오픈AI가 취약점 연구와 익스플로잇(취약점 악용) 검증에 특화한 인공지능(AI) 모델 ‘GPT-5.6 사이버’를 10일(현지시간) 공개하고, 회사의 사이버방어 지원 프로그램 ‘데이브레이크’(Daybreak)도 블루·레드 두 등급으로 개편했다. 사이버공격자가 AI를 대규모로 배치하기 전에 방어자를 먼저 무장시킨다는 취지다.
데이브레이크 프로그램에서 블루는 최상위 범용 모델 ‘GPT-5.6 솔’에 보안 업무용으로 조정한 안전장치를 적용해 취약점 탐지·악성코드 분석·사고 대응·패치 검증 등에 쓰는 등급이다. 오픈AI는 “대부분의 방어자를 위한 출발점”이라고 했다. 레드는 승인받은 전문 보안 조직에 GPT-5.6 사이버를 제공해 익스플로잇 개발과 레드팀 활동까지 지원한다. 두 등급 모두 신원 확인과 사용 목적 제한, 모니터링을 거쳐야 한다.
GPT-5.6 사이버는 GPT-5.6 솔 기반으로 보안 작업 시 불필요한 ‘거부 반응’을 줄이도록 미세조정(파인튜닝)한 모델이다. 자체 평가에서 고난도 보안 요청의 95%에 답변을 완료해 이전 세대 GPT-5.5 사이버(57.3%)와 일반 솔(1.5%)을 크게 앞섰다. 이용료는 100만 토큰당 입력 12.5달러·출력 75달러로 솔(5달러·30달러)보다 비싸다.
오픈AI에 따르면 이 모델을 활용해 크롬의 자바스크립트 엔진 ‘V8’에서 연계 악용이 가능한 미공개 취약점 2건을 찾아 구글에 신고했고, 이 중 1건은 ‘CVE-2026-15903’으로 지정돼 수정됐다. 모바일 운영체제(OS) 최소 5건, 데이터베이스(DB) 치명적 취약점 3건, OS 커널 권한 상승 취약점 400여 건도 찾았다.
오픈AI는 이 모델의 사이버 능력을 자체 안전 기준상 ‘위험’(Critical)에 못 미치는 ‘높음’(High)으로 평가했고, 지난달 자사 모델들이 내부 평가 도중 통제를 벗어나 허깅페이스를 해킹했던 사건에서 이 모델은 무관하다고 밝혔다. 벤처비트는 당시 허깅페이스 방어팀이 상용 모델의 답변 거부로 공격 자료 분석에 애를 먹었다며, 이번 ‘거부 완화’가 이런 ‘방어자 차단’ 문제를 겨냥한 것이라고 분석했다.
테크크런치는 앤트로픽의 보안 특화 모델 ‘미토스’에 이은 대응이라며, 잇단 AI 위협 경고가 AI기업의 마케팅 기회로도 쓰인다는 비판을 함께 전했다. 앞서 오픈AI는 차세대 모델 ‘아스트라’가 ‘위험’ 수준에 도달했을 가능성을 배제할 수 없다며 출시를 연기한 바 있다.