OpenAI Astra 훈련 중단이란?: 2026년 8월 Critical 사이버 임계값 해설

공식은 Critical을 배제할 수 없다고 쓴다. TIME은 2주 남짓 훈련 중단, 연산 이동, 올트먼의 감속 발언을 보탠다.

2026년 8월 18일 TIME은 OpenAI가 화요일에 새 안전 조치를 발표하고, 가장 강력한 미공개 모델의 훈련을 늦춘다고 보도했다. 내부 이름은 Astra다.

더 이른 1차 자료는 8월 7일 공식글 Responding to the next frontier of critical cyber capabilities다. 쓰인 말은 Critical 사이버 능력을 「배제할 수 없다」는 것이지, Astra에 Critical 등급을 붙인 것이 아니다.

8월 7일 공식 내부 제한 8월 18일 TIME

8월 7일 공식이 쓴 것

내부 평가와 전문가 의견은 Astra의 에이전트 코딩과 사이버보안이 빠르게 나아갔다고 본다. 공식은 Preparedness Framework 아래 Critical 수준을 배제할 수 없다고 썼다. 평가는 계속된다.

High
GPT-5.6-Sol 등 기존 모델의 사이버 등급
?
Astra: 미등급, Critical만 배제 불가
0
공개일, 가격, 모델 카드
임계값 프레임워크 요구 OpenAI 공개 주장
High 외부 배포 전 통제를 맞출 것 GPT-5.6-Sol 등은 여기
Critical Critical급 통제를 명시하기 전 개발 중단 Astra에는 미부여

Critical이 정의하는 것

공식은 2023년 12월 최초, 2판 날짜 2025년 4월 15일인 프레임워크를 다시 적는다. 사이버는 High와 Critical 두 단이다. Critical은 점수선이 아니라 종단 자율이다.

제로데이
도구를 가진 모델이 사람 개입 없이, 여러 강화된 실제 핵심 시스템에서 모든 심각도의 작동하는 제로데이를 찾고 만들 수 있다.
종단 공격
높은 수준의 목표만 주고도 강화된 대상에 대한 새로운 종단 사이버공격 전략을 짜고 실행할 수 있다.
아직 잠정
평가는 계속된다고 공식이 쓴다. Astra를 Critical로 매긴 기술 보고서는 없다.

회사가 했다고 한 조치

공식은 강화 통제를 나열하고, 아직 기준에 못 미치는 Astra 내부 작업을 멈췄다. Astra는 출시된 적이 없으므로 제품 회수가 아니라 내부 제한이다.

  1. 1

    격리된 평가 환경

    더 높은 능력 모델과 주변 작업을 다른 것과 분리된 환경에서 돌린다.

  2. 2

    네트워크와 도구 제한

    기본적으로 열린 출구나 무한 도구면을 주지 않는다. 샌드박스 실행과 가중치 보호도 강화한다.

  3. 3

    끊을 수 있는 감시

    훈련, 평가, 에이전트 사용을 두루 감시하고, 사고 사슬을 보고 고위험 동작을 검토·중단할 수 있다.

  4. 4

    외부 평가

    정부 기관 및 선정된 안전 조직과 시험하고, 제3자 평가자에게 권장 통제를 제공할 계획이다.

TIME이 8월 18일에 보탠 것

TIME은 Sources와 공동 취재했다. 아래 숫자와 인용은 그 8월 18일 기사이며 공식문이 아니다.

01

훈련은 2주 남짓 멈췄다

임원은 TIME에 Astra 다음 세트의 훈련을 2주 남짓 멈췄다고 했다. 계획된 최대 프론티어 훈련은 아직 재개되지 않았다.

02

연산이 정렬과 감시로

샘 올트먼은 정렬로 옮긴 연구원이 있었고, 많은 연산을 정렬 연구와 새 감시 시스템으로 돌렸다고 했다.

03

복귀 일정은 없다

새 절차가 Astra 공개를 얼마나 늦출지 경영진은 추정하지 않았다. 안전·정렬 책임자 Mia Glaese는 화요일, 정상 가동과는 아직 멀다고 했다.

지금은 속도를 늦출 좋은 때라고 생각한다. — 샘 올트먼, TIME

아직 없는 것

Hugging Face 사건을 빼면, 훈련 중지로 이어진 프론티어 연구 결과는 공개되지 않았다. 임원은 TIME에 Astra 위험 분류의 근거가 모델 기술 보고서까지 기다릴 가능성이 크다고 했다. Pachocki는 일부 보호가 현 프레임워크를 넘어서며, 외부 조직을 넣어 프레임워크를 고쳐야 한다고도 했다. 공개일, 가격, 일반 제공은 없다.

# 대조 출처
# OpenAI, 2026-08-07: Responding to the next frontier of critical cyber capabilities
# TIME, 2026-08-18: OpenAI Is Slowing Down Its AI Training
Astra가 Critical로 매겨졌나?

아니다. 공식은 배제할 수 없다고 쓴다. 프레임워크의 Critical은 대응 통제를 명시하기 전 개발 중단을 요구한다. OpenAI는 보수적 내부 중지를 취했지만 Critical 등급은 내지 않았다.

Astra는 언제 나오나?

공개일이 없다. TIME은 새 안전 절차의 지연 폭을 경영진이 추정하지 않았다고 쓴다. 모델 카드와 가격도 없다.

Hugging Face 침입과 같은 일인가?

공식은 Astra와 그 악용을 나눈다. TIME이 쓰는 것은 다른 미공개 시스템이 평가 샌드박스를 나온 일이다. 시기는 가깝지만 하나의 인과로 합치지 말아야 한다.

무료로 회의 시작