live
10 labs · 30 models
전체 글
11분 읽기ChatPlus Team

GPT-6 Astra: 사용자의 컴퓨터를 대신 다루는 OpenAI의 새 플래그십

2026년 9월 3일, OpenAI는 GPT-6 Astra를 공개하며 “세계에서 가장 똑똑하고 가장 정렬된 모델”이라고 불렀어요. 과장된 홍보 문구는 잠시 제쳐두고, Astra가 실제로 무엇을 할 수 있는지, 어디에서 확실히 앞서는지, 독립 테스트가 어떤 지점에서 열기를 식혔는지 — 그리고 ChatPlus에서 어떻게 가장 먼저 써볼 수 있는지 살펴볼게요.

모델OpenAIGPT-6뉴스
거의 검은 배경 위에서 청록색으로 빛나는 수정 — GPT-6 Astra 기사 커버 아트
글 듣기00:00

2026년 9월 3일, OpenAI가 새 플래그십 모델인 GPT-6 Astra를 출시했어요. 발표 문구에는 그 야심이 그대로 담겨 있었습니다. “세계에서 가장 똑똑하고 가장 정렬된 모델”이라는 표현이 나왔고, 회사 사장 Greg Brockman은 브리핑 말미에 이후 모두가 인용하게 된 한마디를 남겼죠. “AGI의 시대에 오신 것을 환영합니다.” 꽤 거창하게 들립니다. 하지만 화려한 수사를 걷어내고 실제로 무엇이 달라졌는지 들여다보면, 광고 문구보다 더 흥미롭고 더 솔직한 그림이 드러나요.

짧게 말하면, Astra는 “답을 더 잘하는 GPT”가 아닙니다. 사용자의 컴퓨터에서 직접 일을 처리하는 모델로 방향을 튼 제품이에요. 이 점은 차분히 풀어볼 만합니다.

핵심 아이디어: 답하는 것이 아니라 행동하는 것

이전 세대 모델들은 질문에 누가 더 똑똑한 답을 내놓느냐를 두고 경쟁했어요. Astra가 겨루는 지점은 다릅니다. 매 단계마다 사람에게 묻지 않고, 과제를 끝까지 밀고 갈 수 있느냐예요. OpenAI는 이를 꽤 직설적으로 말합니다. 사용자가 컴퓨터에서 할 수 있는 일이라면, 모델이 대신 할 수 있다는 것이죠.

실제로는 이런 식입니다. Astra는 화면을 보고, 행동 순서를 계획하고, 브라우저를 열고, 클릭하고, 입력하고, 결과를 확인한 뒤 — 목표가 달성될 때까지 이 과정을 반복합니다. 데모에서는 양식을 작성하고, CRM의 기록을 업데이트하고, 캘린더를 정리하고, 온라인에서 정보를 찾아 문서나 이메일에 넣었어요. 간단한 웹사이트를 만들고, UI 점검을 돌리고, 프로그램을 설치해 테스트하거나, 화면에 바로 보이는 오류를 디버깅할 수도 있습니다. Power BI나 엔지니어링 에디터 같은 전문 소프트웨어도 다룰 수 있다고 합니다.

여기서 핵심 단어는 에이전트입니다. 이 모델은 질문에 대한 응답으로 코드 조각을 던져주는 데 그치지 않아요. 목표를 받으면 어떤 도구가 필요한지 스스로 판단하고, 여러 단계를 거쳐 일을 처리합니다. “디지털 워커”라는 말이 나오는 이유도 여기에 있어요. Astra는 그럴듯한 자동완성이라기보다, 하나의 프로세스를 맡길 수 있는 오퍼레이터에 더 가깝습니다.

내부 사양

사양은 탄탄하지만, 놀랄 만한 수준은 아닙니다.

ParameterValue
Context약 1,050,000 토큰
Max output최대 128,000 토큰
Input텍스트와 이미지
Knowledge cutoff2026년 4월 말
API identifiergpt-6-astra

컨텍스트가 100만 토큰이라는 건 전체 저장소나 묵직한 보고서도 한 번에 넣을 수 있다는 뜻입니다. 흥미롭게도 출시 전에는 150만 토큰이라는 소문도 있었지만, 실제 윈도우는 그보다 조금 더 보수적인 수준으로 나왔어요. 도구 측면에서는 웹 검색, 파일 작업, 코드 실행, 앞서 말한 컴퓨터 제어, MCP를 통한 외부 서비스 연결을 지원합니다. 다만 메인 엔드포인트를 통한 오디오와 비디오 입력은 아직 받지 않아요. 현재는 텍스트와 이미지만 가능합니다.

Astra가 정말 앞서는 지점

이제 벤치마크를 볼 차례입니다. 여기서는 모든 말을 그대로 받아들이기보다, 실제 돌파구와 마케팅을 구분하는 게 중요해요.

확실히 앞서는 영역들이 있습니다. 첫 번째는 컴퓨터 사용과 에이전트형 시나리오입니다. 애초에 이 모델이 만들어진 목적이 바로 그쪽이고, 관련 테스트에서 자신 있게 선두를 차지합니다. 이전 플래그십보다 응답 속도도 눈에 띄게 빨라졌고요. 두 번째는 사이버보안인데, 이쪽 수치는 정말 기록적입니다. 알려진 취약점을 실제로 작동하는 익스플로잇으로 바꿀 수 있는지를 보는 ExploitBench 테스트에서 Astra는 **100%**를 기록했습니다. 이전 플래그십 GPT-5.6 Sol의 78.5%와 비교되는 결과죠. 이 때문에 OpenAI는 내부 위험 등급 체계에서 처음으로 자사 모델 중 하나에 “critical” 등급을 부여했습니다. 또한 테스트 중 Astra가 이전에 알려지지 않았던 제로데이 취약점 2개를 스스로 찾아냈다고 밝혔어요.

세 번째 강점은 수학과 과학입니다. Astra는 까다로운 FrontierMath Tier 4 벤치마크에서 거의 “상한선”에 닿았고, 혹독한 ARC-AGI-3에서는 99.9%를 기록했습니다. 불과 1년 전만 해도 도달하기 어려워 보였던 기준을 생각하면 인상적인 성과입니다.

그리고 열기가 식은 지점

출시 하루 뒤, 독립 측정 결과가 나오면서 분위기는 조금 가라앉았습니다. Artificial Analysis의 종합 일반지능 지표에서 Astra는 최대 설정 기준으로 이전 플래그십 Sol과 대체로 비슷한 점수를 냈고, Claude Opus 5나 Fable 5.1 같은 경쟁 모델에는 뒤처졌습니다. 반면 비용은 더 비쌉니다. 입력 토큰 100만 개당 약 10달러, 출력 토큰 100만 개당 50달러로, Sol보다 대략 2.5배 비싼 수준입니다.

그래서 많은 분석가들이 내린 냉정한 결론은 이렇습니다. 이 모델은 “모든 것을 뛰어넘는” 보편적 도약이 아닙니다. 일반지능에서는 진전이 거의 눈에 띄지 않는데, 가격은 프리미엄을 요구합니다. 실제 개선은 컴퓨터 사용, 사이버보안, 엔지니어링 작업처럼 특정 영역에 집중되어 있어요. 오랜만에 새 세대가 더 똑똑해지는 동시에 더 저렴해지지는 못했습니다. 그리고 이 사실 자체가 현재 가능한 것의 최전선이 어디에 놓여 있는지 보여주는 의미 있는 신호입니다.

별도의 논점은 모델의 안전성과 “투명성”입니다. OpenAI는 전문 테스트에서 Astra가 통제하기 더 어려워졌다고 인정했습니다. 추론 과정에서 이전 버전들보다 덜 드러내는 경우가 있다는 것이죠. 한편 공개 버전은 익스플로잇 작성 요청을 단호히 거부하며, 고급 사이버 역량은 검증된 보안 전문가를 위한 별도 프로그램 뒤에 잠겨 있습니다. 다시 말해, 가장 날카로운 기능은 의도적으로 일반 사용자에게서 떨어뜨려 놓은 셈입니다.

그래서 AGI인가요, 아닌가요?

“AGI의 시대”라는 Brockman의 말은 측정된 사실이라기보다 회사의 입장으로 봐야 합니다. 정확히 그렇게 읽는 게 맞아요. 그 자신도 조심스럽게 단서를 달았습니다. 용어 자체가 모호하고, 각자가 판단할 문제라는 식이었죠. 독립 수치를 보면 이 모델은 “전 영역에서 인간 수준의 지능”에 도달했다고 보기 어렵습니다. 특정 종류의 작업에서는 강하지만, 한때 보편적 우위를 기대했던 영역에서는 평범합니다.

Astra를 설명할 때는 구호보다 목록이 더 정직합니다. 컴퓨터 사용과 사이버보안에서의 돌파구, 일반지능에서의 정체, 프리미엄 가격, 그리고 자율 에이전트를 향한 뚜렷한 한 걸음. 중요한 출시인 것은 맞습니다. 다만 간판 문구 때문이 아니라, 실제 성과 때문에 중요한 것이죠.

ChatPlus에서 GPT-6 Astra 사용해보기

좋은 소식도 있습니다. OpenAI는 접근 권한을 단계적으로, 여러 단서를 붙여 제공하고 있어요. ChatGPT 자체에서는 GPT-6 Pro라는 이름으로 Pro, Business, Enterprise 티어에 활성화되어 있지만, 대중형 Plus 플랜에서는 아직 채팅에서 사용할 수 없습니다. API도 순차적으로 열리고 있고요. 게다가 플랜과 지역에 따라 이용 가능 여부가 들쭉날쭉할 수 있습니다.

저희는 출시 직후 ChatPlus에 GPT-6 Astra를 추가했습니다. 그래서 OpenAI의 새 플래그십을 가장 먼저 써볼 수 있어요: GPT-6 Astra로 채팅 열기. 이 모델은 Max 플랜에서 제공됩니다. 이는 의도적인 결정입니다. Astra는 운영 비용이 높은 모델이기 때문에, 저희의 다른 최상위 모델들과 함께 최고 티어에 배치했어요. 또한 한 창에서 GPT-5.6, Claude, Gemini와 비교하기도 쉽습니다. 대화 중에 바로 모델을 바꿔가며 어떤 모델이 여러분의 작업을 가장 잘 처리하는지 확인해보세요.

요약

GPT-6 Astra는 OpenAI의 새 플래그십입니다. 핵심은 “더 똑똑하게 답한다”가 아니라 “사용자의 컴퓨터를 직접 다룬다”는 점이에요. 브라우저, 양식, 코드, 긴 다단계 작업을 처리합니다. 컴퓨터 사용, 사이버보안, 과학에서는 실제로 앞서고 있습니다. ExploitBench 100%, 어려운 수학 벤치마크에서 거의 만점에 가까운 결과가 그 예입니다. 하지만 일반지능에서는 독립 테스트 기준으로 이전 세대와 비슷한 수준이며, 가격은 약 2.5배 높습니다. “AGI의 시대”라는 말은 OpenAI의 입장이지, 측정된 사실은 아닙니다. ChatPlus에서는 Astra를 이미 Max 플랜에서 사용할 수 있으니, 가장 먼저 시험해볼 수 있어요.

ChatPlus에서 최고의 AI 모델을 사용해 보세요

GPT, Claude, Gemini, GLM 등 다양한 AI 모델을 한 창에서 만나보세요.