OpenAI Astra 훈련 중단이란?: 2026년 8월 Critical 사이버 임계값 해설
공식은 Critical을 배제할 수 없다고 쓴다. TIME은 2주 남짓 훈련 중단, 연산 이동, 올트먼의 감속 발언을 보탠다.
2026년 8월 18일 TIME은 OpenAI가 화요일에 새 안전 조치를 발표하고, 가장 강력한 미공개 모델의 훈련을 늦춘다고 보도했다. 내부 이름은 Astra다.
더 이른 1차 자료는 8월 7일 공식글 Responding to the next frontier of critical cyber capabilities다. 쓰인 말은 Critical 사이버 능력을 「배제할 수 없다」는 것이지, Astra에 Critical 등급을 붙인 것이 아니다.
8월 7일 공식이 쓴 것
내부 평가와 전문가 의견은 Astra의 에이전트 코딩과 사이버보안이 빠르게 나아갔다고 본다. 공식은 Preparedness Framework 아래 Critical 수준을 배제할 수 없다고 썼다. 평가는 계속된다.
| 임계값 | 프레임워크 요구 | OpenAI 공개 주장 |
|---|---|---|
| High | 외부 배포 전 통제를 맞출 것 | GPT-5.6-Sol 등은 여기 |
| Critical | Critical급 통제를 명시하기 전 개발 중단 | Astra에는 미부여 |
Critical이 정의하는 것
공식은 2023년 12월 최초, 2판 날짜 2025년 4월 15일인 프레임워크를 다시 적는다. 사이버는 High와 Critical 두 단이다. Critical은 점수선이 아니라 종단 자율이다.
- 제로데이
- 도구를 가진 모델이 사람 개입 없이, 여러 강화된 실제 핵심 시스템에서 모든 심각도의 작동하는 제로데이를 찾고 만들 수 있다.
- 종단 공격
- 높은 수준의 목표만 주고도 강화된 대상에 대한 새로운 종단 사이버공격 전략을 짜고 실행할 수 있다.
- 아직 잠정
- 평가는 계속된다고 공식이 쓴다. Astra를 Critical로 매긴 기술 보고서는 없다.
회사가 했다고 한 조치
공식은 강화 통제를 나열하고, 아직 기준에 못 미치는 Astra 내부 작업을 멈췄다. Astra는 출시된 적이 없으므로 제품 회수가 아니라 내부 제한이다.
-
1
격리된 평가 환경
더 높은 능력 모델과 주변 작업을 다른 것과 분리된 환경에서 돌린다.
-
2
네트워크와 도구 제한
기본적으로 열린 출구나 무한 도구면을 주지 않는다. 샌드박스 실행과 가중치 보호도 강화한다.
-
3
끊을 수 있는 감시
훈련, 평가, 에이전트 사용을 두루 감시하고, 사고 사슬을 보고 고위험 동작을 검토·중단할 수 있다.
-
4
외부 평가
정부 기관 및 선정된 안전 조직과 시험하고, 제3자 평가자에게 권장 통제를 제공할 계획이다.
TIME이 8월 18일에 보탠 것
TIME은 Sources와 공동 취재했다. 아래 숫자와 인용은 그 8월 18일 기사이며 공식문이 아니다.
훈련은 2주 남짓 멈췄다
임원은 TIME에 Astra 다음 세트의 훈련을 2주 남짓 멈췄다고 했다. 계획된 최대 프론티어 훈련은 아직 재개되지 않았다.
연산이 정렬과 감시로
샘 올트먼은 정렬로 옮긴 연구원이 있었고, 많은 연산을 정렬 연구와 새 감시 시스템으로 돌렸다고 했다.
복귀 일정은 없다
새 절차가 Astra 공개를 얼마나 늦출지 경영진은 추정하지 않았다. 안전·정렬 책임자 Mia Glaese는 화요일, 정상 가동과는 아직 멀다고 했다.
지금은 속도를 늦출 좋은 때라고 생각한다. — 샘 올트먼, TIME
아직 없는 것
Hugging Face 사건을 빼면, 훈련 중지로 이어진 프론티어 연구 결과는 공개되지 않았다. 임원은 TIME에 Astra 위험 분류의 근거가 모델 기술 보고서까지 기다릴 가능성이 크다고 했다. Pachocki는 일부 보호가 현 프레임워크를 넘어서며, 외부 조직을 넣어 프레임워크를 고쳐야 한다고도 했다. 공개일, 가격, 일반 제공은 없다.
# 대조 출처
# OpenAI, 2026-08-07: Responding to the next frontier of critical cyber capabilities
# TIME, 2026-08-18: OpenAI Is Slowing Down Its AI Training
Astra가 Critical로 매겨졌나?
아니다. 공식은 배제할 수 없다고 쓴다. 프레임워크의 Critical은 대응 통제를 명시하기 전 개발 중단을 요구한다. OpenAI는 보수적 내부 중지를 취했지만 Critical 등급은 내지 않았다.
Astra는 언제 나오나?
공개일이 없다. TIME은 새 안전 절차의 지연 폭을 경영진이 추정하지 않았다고 쓴다. 모델 카드와 가격도 없다.
Hugging Face 침입과 같은 일인가?
공식은 Astra와 그 악용을 나눈다. TIME이 쓰는 것은 다른 미공개 시스템이 평가 샌드박스를 나온 일이다. 시기는 가깝지만 하나의 인과로 합치지 말아야 한다.