오픈AI는 9월 3일 GPT 6 아스트라를 제한된 조직부터 배포하며, 자사 최고 수준의 지능·정렬 모델이라고 소개했다. 또한 처음으로 사이버 보안 역량 ‘치명적(Critical)’ 등급에 도달한 모델이라고 밝혔다. 오픈AI가 공개한 성적은 FrontierMath Tier 4 98%, ARC AGI 3 99.9%, ExploitBench 100%다.
게시자GPT-5.6 Terra로 편집GPT Image 2로 이미지 생성
연구 답변

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce with the September 3 launch of GPT-6 Astra—including its claimed intelligence, alignment, record benchmark results,. Article summary: OpenAI presented GPT‑6 Astra as a major step toward highly autonomous AI: “the world’s most intelligent and aligned model,” with record scores across agentic, scientific, computer-use, and cyber evaluations. These are Op. Topic tags: general, documentation, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fak
오픈AI는 9월 3일 공개한 **GPT-6 아스트라(Astra)**를 코딩, 리서치, 컴퓨터 사용, 전문 업무처럼 여러 단계를 거치는 복잡한 작업을 겨냥한 모델로 소개했다. 회사는 이를 자사에서 가장 지능적이고 정렬(alignment)이 잘된 모델이라고 주장했지만, 즉시 일반 공개하지 않고 일부 조직에 먼저 제한 배포했다. 2
5
13
이번 발표에서 눈여겨볼 대목은 단순한 벤치마크 점수만이 아니다. 오픈AI는 아스트라가 자사의 ‘준비도 프레임워크(Preparedness Framework)’에서 사이버 보안 역량 ‘치명적(Critical)’ 기준에 처음 도달한 모델이라고 밝혔다. 성능 주장과 배포 제한 방침을 함께 봐야 하는 이유다. 10
12
오픈AI는 아스트라가 컴퓨터 사용, 웹 탐색, 소프트웨어 엔지니어링, 사이버 보안, 과학, 전문 업무에서 최고 수준의 성능을 보인다고 설명한다. 개발자 문서에서는 복잡한 추론, 코딩, 컴퓨터 사용, 조사, 문서 제작을 위한 모델로 제시한다. 1
3
13
회사가 공개한 대표 평가 결과는 다음과 같다.
다만 이 수치는 오픈AI가 공개한 자체 평가 결과이며, 독립적으로 재현·검증된 측정치라는 뜻은 아니다. 높은 벤치마크 성적은 해당 시험 과제에서의 진전을 보여줄 수 있지만, 그것만으로 범용지능이나 실제 업무 환경에서의 일관된 판단력, 모든 상황에서의 안전한 자율성을 입증하지는 않는다.
오픈AI에 따르면 아스트라는 준비도 프레임워크상 처음으로 사이버 보안 역량 ‘치명적’ 등급에 도달했다. 회사 설명상 이는 모델이 적절한 도구와 접근 권한을 받았을 때, 사람이 모든 단계를 지시하지 않아도 다수의 방어가 강한 시스템에서 아직 알려지지 않은 보안 취약점을 찾고 새로운 악용 방법을 개발할 수 있다는 의미다. 10
12
여기에는 두 가지 중요한 한계가 있다.
오픈AI는 유해한 사이버 활동에 대한 보호 조치를 강화했고, 아스트라 배포 과정에서 추가 모니터링을 적용한다고 밝혔다. 5
10 처음부터 광범위하게 개방하지 않고 단계적으로 접근을 제공하는 정책도 회사가 인식한 추가 위험과 맞닿아 있다.
오픈AI는 아스트라를 자사에서 가장 정렬이 잘된 모델로 부르며, 작업 범위를 더 잘 지키고 더 투명하게 소통한다고 주장한다. 2
13
그러나 모델 공개에서 말하는 ‘정렬’은 특정 훈련 방식과 평가에서의 성능을 뜻한다. 에이전트가 사용자의 의도를 언제나 정확히 파악한다거나, 어떤 운영 경계도 넘지 않는다거나, 사람의 검토 없이 안전하게 배포할 수 있다는 보증은 아니다. 오픈AI의 릴리스 노트도 에이전트가 지시를 잘못 해석했을 수 있는 사례를 찾기 위한 추가 모니터링을 포함한다고 설명한다. 5
따라서 에이전트 도입을 검토하는 조직이라면 ‘정렬’이라는 표기보다 다음을 확인하는 편이 실질적이다. 어떤 권한을 부여하는지, 중요한 조치에 승인이 필요한지, 활동 기록이 남는지, 예상 밖의 행동이 나왔을 때 얼마나 신속하게 중단할 수 있는지다.
제공된 자료에는 일부 평가 수치와 관련해 벤치마크 오염 가능성, 특수 접근 구성과 기본 프로덕션 접근의 차이에 대한 후속 설명이 있었다는 내용이 포함돼 있다. 또 추론 과정(체인 오브 소트)만 보는 모니터링이 더 많은 맥락을 함께 보는 방식보다 덜 효과적이었던 테스트도 언급된다.
다만 제공된 1차 출처 발췌문만으로는 모든 수치의 수정 이력이나 전체 모니터링 방법론을 독립적으로 감사할 수준까지 확인하기 어렵다. 따라서 헤드라인 성적과 안전성 평가는 계속 갱신될 수 있는 출시 근거로 받아들이고, 특정 점수나 배포 주장을 토대로 결정을 내리기 전 최신 모델 문서와 안전성 자료를 확인하는 것이 타당하다. 2
3
10
이번 출시는 오픈AI 모델이 관련된 앞선 보안 테스트 사건 뒤에 이뤄졌다. 오픈AI는 이 사건이 아스트라의 안전 접근 방식에 반영됐다고 밝혔으며, 아스트라 자체가 해당 사건에 연루된 모델은 아니었다고 설명한다. 10
이 맥락은 중요하다. 자율 시스템은 모델의 성능에 더해 브라우저, 코드 도구, 각종 소프트웨어를 통해 실제 행동을 수행할 능력을 결합한다. 여러 시스템을 넘나들며 일을 처리할 수 있다는 점이 바로 유용성의 근거인 동시에, 격리 환경, 최소 권한 원칙, 모니터링이 더 중요해지는 이유이기도 하다.
오픈AI는 아스트라를 처음에는 제한된 조직에 배포하고, 이후 더 넓은 제공 범위를 계획한다고 밝혔다. 5
13
개발자용 API 가격은 입력 100만 토큰당 10달러, 출력 100만 토큰당 50달러다. 모델 페이지에는 105만 토큰의 컨텍스트 윈도와 최대 12만 8,000토큰 출력도 안내돼 있다. 3
ChatGPT 제공은 별도의 요금제별·단계별 방식으로 이뤄진다. 오픈AI 도움말에 따르면 아스트라 기반 GPT-6 Pro는 Pro 100달러, Pro 200달러, Business, Enterprise 플랜에 순차 제공되며, Plus 플랜에는 배포 진행에 따라 ChatGPT Work와 Codex에서 아스트라가 제공된다. 실제 이용 가능 여부는 ChatGPT 제품과 워크스페이스 설정에 따라 달라질 수 있다. 6
GPT-6 아스트라는 서로 떼어놓고 볼 수 없는 두 메시지와 함께 등장했다. 오픈AI는 복잡하고 에이전트형인 업무 수행 능력이 크게 진전했다고 주장하는 동시에, 이 모델의 사이버 보안 역량을 자사가 제시한 최고 위험 단계로 분류했다. 10
13
벤치마크는 오픈AI 평가에서 아스트라가 무엇을 해냈다고 회사가 말하는지를 보여준다. 반면 단계적 접근, 추가 모니터링, 사이버 관련 제한은 회사 역시 그 역량을 일상적 기능으로 취급하지 않는다는 신호다. 도입을 검토하는 팀의 우선순위는 벤치마크 성적을 곧바로 신뢰할 수 있는 자율성으로 간주하는 일이 아니라, 좁게 제한한 도구 범위, 중요한 행동의 명시적 승인 절차, 격리된 실행 환경, 검토 가능한 로그를 갖춘 통제된 배포여야 한다.
Studio Global AI
이 페이지에는 Studio Global 내에서 계속할 수 있는 소스 기반 답변이 포함되어 있습니다.
오픈AI는 9월 3일 GPT 6 아스트라를 제한된 조직부터 배포하며, 자사 최고 수준의 지능·정렬 모델이라고 소개했다. 또한 처음으로 사이버 보안 역량 ‘치명적(Critical)’ 등급에 도달한 모델이라고 밝혔다.
오픈AI는 9월 3일 GPT 6 아스트라를 제한된 조직부터 배포하며, 자사 최고 수준의 지능·정렬 모델이라고 소개했다. 또한 처음으로 사이버 보안 역량 ‘치명적(Critical)’ 등급에 도달한 모델이라고 밝혔다. 오픈AI가 공개한 성적은 FrontierMath Tier 4 98%, ARC AGI 3 99.9%, ExploitBench 100%다. 회사는 적절한 도구와 접근 권한이 주어지면 미지의 취약점을 찾아 새로운 공격 방법을 개발할 수 있다고 설명한다.
API 가격은 입력 100만 토큰당 10달러, 출력 100만 토큰당 50달러다. ChatGPT 제공 범위는 요금제와 제품별로 순차 확대되며, 조직의 워크스페이스 설정에 따라 달라질 수 있다.