2시간 전

GPT-6 Astra 공개, 컴퓨터 조작부터 코딩·과학 연구까지 무엇이 달라졌나

OpenAI가 차세대 AI 모델 GPT‑6 Astra를 공식 발표했습니다.

GPT-6 Astra 공개, 컴퓨터 조작부터 코딩·과학 연구까지 무엇이 달라졌나

발표 시점은 미국 현지시간으로 2026년 9월 3일이며, 한국시간으로는 9월 4일입니다. GPT‑6 Astra는 일부 기관에 먼저 제공되기 시작했으며, 향후 며칠에 걸쳐 ChatGPT 유료 요금제와 OpenAI API, Microsoft Azure, AWS Bedrock으로 확대될 예정입니다.

OpenAI는 GPT‑6 Astra를 자사 모델 가운데 가장 지능적이고 정렬 수준이 높은 모델이라고 소개했습니다. 특히 이번 모델은 단순히 질문에 답하거나 글을 생성하는 것을 넘어, 컴퓨터와 웹브라우저를 직접 사용해 여러 단계로 구성된 실제 업무를 수행하는 능력이 크게 강화됐습니다.

이번 글에서는 GPT‑6 Astra의 주요 기능과 벤치마크 성능, 제공 대상, 사이버 보안 관련 안전조치까지 정리해 보겠습니다.


GPT‑6 Astra란?

GPT‑6 Astra는 OpenAI가 사전학습과 강화학습, 정렬 연구를 결합해 개발한 차세대 프런티어 AI 모델입니다.

OpenAI에 따르면 GPT‑6 Astra는 다음 영역에서 최고 수준의 성능을 목표로 개발됐습니다.

  • 컴퓨터 조작

  • 웹브라우저 탐색

  • 소프트웨어 엔지니어링

  • 사이버 보안

  • 과학 및 수학 연구

  • 문서·스프레드시트·프레젠테이션 제작

  • 전문 지식 업무

  • 복잡한 다단계 작업 수행

기존 생성형 AI가 사용자의 질문에 텍스트로 답하는 데 집중했다면, GPT‑6 Astra는 화면을 이해하고 필요한 도구를 사용하면서 업무를 실제로 처리하는 AI 에이전트 성격이 더욱 강해졌습니다.

온라인 양식을 작성하거나 CRM의 고객 정보를 업데이트하고, 일정을 정리하는 것과 같은 반복 업무를 수행할 수 있습니다. 웹에서 자료를 조사한 뒤 이메일이나 문서 편집기에 요약문을 작성하고, 과학 데이터를 분석해 그래프를 만들거나 웹사이트를 제작한 다음 화면을 보며 품질을 점검하는 작업도 지원합니다.


GPT‑6 Astra의 주요 특징

1. 컴퓨터와 웹브라우저를 직접 사용하는 능력 강화

GPT‑6 Astra의 가장 큰 특징은 컴퓨터 사용 능력입니다.

OpenAI가 공개한 사례에 따르면 Astra는 화면에 표시된 내용을 이해하고 마우스와 키보드 기반 작업을 수행할 수 있습니다. 단순한 클릭 자동화가 아니라 업무의 목적과 현재 상황을 파악하면서 다음 행동을 결정하는 방식입니다.

활용 가능한 작업의 예시는 다음과 같습니다.

  • 온라인 양식 작성

  • CRM 고객 정보 업데이트

  • 캘린더 및 일정 정리

  • 웹 자료 조사와 결과 요약

  • 이메일 및 문서 초안 작성

  • 과학 데이터 분석과 시각화

  • 웹사이트 제작 및 프런트엔드 QA

  • 소프트웨어 설치와 테스트

  • 화면에 나타난 오류 분석 및 문제 해결

OpenAI는 PCB 설계 도구인 KiCad에서 전자회로 도면을 바탕으로 부품을 배치하고 배선을 구성하는 사례도 공개했습니다. Blender로 주택 모델을 만든 뒤 Unreal Engine 5에서 둘러볼 수 있는 공간으로 변환하는 작업도 시연했습니다.

이는 AI 에이전트의 활용 범위가 브라우저 자동화에서 전문 소프트웨어 조작까지 확대되고 있다는 의미입니다.

2. 문서·스프레드시트·프레젠테이션 제작 개선

GPT‑6 Astra는 기존 템플릿을 따르면서 문서와 슬라이드, 스프레드시트를 제작하는 능력도 강화됐습니다.

기업에서 사용하는 보고서나 발표 자료는 내용만 정확하다고 완성되는 것이 아닙니다. 회사의 템플릿과 문체, 문서 구조, 시각적 규칙까지 맞춰야 합니다.

OpenAI는 Astra가 다음과 같은 요소를 더 잘 반영한다고 설명했습니다.

  • 기존 템플릿과 레이아웃 유지

  • 핵심 내용을 중심으로 한 구조적인 서술

  • 조직의 문체와 시각적 스타일 반영

  • 불필요한 배경 정보 반복 최소화

  • 업무에 바로 사용할 수 있는 산출물 생성

단순한 초안 생성을 넘어, 실제 업무에 제출할 수 있는 수준의 결과물을 만드는 방향으로 발전한 것입니다.

3. 소프트웨어 엔지니어링 성능 향상

OpenAI는 GPT‑6 Astra를 자사의 역대 모델 가운데 가장 뛰어난 소프트웨어 엔지니어링 모델이라고 소개했습니다.

Astra는 코드 작성뿐 아니라 코드베이스 구조를 이해하고, 기존 프로젝트의 규칙과 테스트 결과를 참고하면서 장시간 작업을 이어가는 능력이 강화됐습니다.

Codex에서는 컨텍스트가 가득 찼을 때 단순히 이전 대화를 하나의 요약문으로 압축하는 대신, 작업 노트를 유지하고 과거 컨텍스트를 검색하는 새로운 방식도 도입됩니다. 대규모 리팩터링이나 장시간 디버깅 과정에서 이전에 실패한 접근법과 요구사항, 테스트 결과가 누락되는 문제를 줄이기 위한 기능입니다.

OpenAI는 Codex 실행 환경의 개선과 Astra의 효율성을 결합했을 때 Mind2Web 기준으로 기존 GPT‑5.6 Sol 환경보다 작업 완료 속도가 1.9배 빨라졌다고 밝혔습니다.

4. 사용자 의도 이해와 정렬 성능 개선

GPT‑6 Astra는 사용자의 의도를 이해하고 허용된 작업 범위를 지키는 정렬(alignment) 능력도 개선됐습니다.

지시가 다소 모호하더라도 일상적인 부분은 문맥에 따라 판단하고, 결과에 큰 영향을 미치는 결정은 사용자에게 필요한 질문을 하도록 설계됐습니다. Codex에서는 답변을 기다리는 동안 사용자 확인과 무관한 다른 작업을 계속 처리할 수도 있습니다.

작업 도중 새로운 요구사항이나 수정 지시가 들어왔을 때 기존 목표를 잃지 않는 능력도 강화됐습니다. 이전 모델은 중간 지시를 새로운 목표로 받아들여 처음 요청을 놓치는 경우가 있었지만, Astra는 변경된 조건을 반영하면서 전체 작업의 방향을 유지하도록 개선됐다는 설명입니다.

OpenAI는 내부 평가에서 GPT‑5.6 Sol이 별도의 운영 안전장치가 없을 때 허용된 대상을 벗어난 비율이 48%였지만, GPT‑6 Astra는 동일한 유형의 평가에서 0%를 기록했다고 밝혔습니다.

다만 이는 OpenAI가 설계한 내부 평가 결과이므로, 모든 실제 환경에서 어떠한 오류도 발생하지 않는다는 뜻으로 해석해서는 안 됩니다.


GPT‑6 Astra 벤치마크 성능

OpenAI는 GPT‑6 Astra가 컴퓨터 사용과 전문 업무, 코딩, 과학, 사이버 보안 등 여러 평가에서 최고 수준의 결과를 기록했다고 밝혔습니다.

컴퓨터 작업 및 전문 업무

벤치마크

GPT‑6 Astra 성적

Agents’ Last Exam

59.3%

OSWorld 2.0

72.6%

ScreenSpot-Pro

92.7%

AutomationBench

41.4%

BenchCAD

95.9%

BrowseComp

91.5%

Agents’ Last Exam은 금융 모델링과 엔지니어링, 미디어 제작 등 실제 소프트웨어를 활용하는 복잡한 전문 업무를 평가합니다. GPT‑6 Astra는 59.3%를 기록해 OpenAI가 제시한 비교 모델 가운데 가장 높은 결과를 보였습니다.

OSWorld 2.0에서는 72.6%를 기록했습니다. OpenAI의 지연시간 시뮬레이션에 따르면 작업당 약 40분이 걸려 65.7%를 기록한 GPT‑5.6 Sol의 약 75분보다 수행 시간이 약 47% 줄었습니다.

코딩 및 소프트웨어 엔지니어링

벤치마크

GPT‑6 Astra 성적

Terminal-Bench 4.0

57.9%

DeepSWE v1.1

74.1%

FrontierCode 1.1 Extended

64.5%

Internal Database Migration Tasks

63.9%

Terminal-Bench 4.0은 소프트웨어 엔지니어링과 시스템 설정, 데이터 분석을 포함한 복잡한 터미널 작업 수행 능력을 평가합니다. GPT‑6 Astra는 57.9%를 기록했습니다.

과학 및 추론

벤치마크

GPT‑6 Astra 성적

Terminal-Bench Science 0.1

64.6%

FrontierMath Tier 4 v2

97.6%

GPQA Diamond

96.0%

ARC-AGI-3

99.9%

OpenAI는 Astra가 수학과 과학 연구에서도 큰 발전을 보였다고 설명했습니다. Terminal-Bench Science 0.1은 코드와 터미널 도구를 이용해 데이터 분석, 시뮬레이션, 모델 적합 등의 과학 연구 절차를 수행하는 능력을 평가합니다.

FrontierMath Tier 4에서는 공식 표 기준 97.6%를 기록했습니다. OpenAI의 본문에서는 반올림해 98%로 소개됐습니다. ARC-AGI-3에서는 99.9%를 기록했다고 발표했습니다.

벤치마크를 볼 때 주의할 점

위 수치는 OpenAI가 공식 발표 자료에서 공개한 결과입니다. 일부 평가는 OpenAI의 연구 환경이나 내부 벤치마크를 사용했으며, 모델별 도구와 실행 조건도 완전히 동일하지 않을 수 있습니다.

OpenAI 역시 연구 환경 또는 API에서 진행한 평가 결과가 실제 ChatGPT 환경과 다를 수 있다고 명시했습니다. 시스템 프롬프트와 사용할 수 있는 도구, 안전장치, 모델의 연산 설정에 따라 실제 체감 성능은 달라질 수 있습니다.

따라서 벤치마크는 Astra의 성능 방향을 보여주는 참고 자료로 보되, 독립적인 검증 결과와 실제 서비스 사용 사례도 함께 살펴볼 필요가 있습니다.


크게 강화된 사이버 보안 능력

GPT‑6 Astra는 사이버 보안 분야에서도 높은 성능을 기록했습니다.

벤치마크

GPT‑6 Astra 성적

ExploitBench

100.0%

ExploitGym

42.4%

ExploitBench 2026년 6~8월 데이터

39.0%

SRE-Bench

88.0%

SEC-Bench Pro

85.4%

OpenAI에 따르면 Astra는 ExploitBench에서 100%를 기록했고, 소스코드 없이 실행 파일의 핵심 논리를 역공학하는 능력을 평가하는 SRE-Bench에서는 첫 시도 기준 88.0%, 네 번의 시도 내에서는 99.2%의 해결률을 기록했습니다.

또한 2026년 6월부터 8월까지 공개된 비교적 새로운 취약점을 이용해 구성한 내부 평가 과정에서 알려지지 않았던 제로데이 취약점 두 건을 발견하고 활용했다고 OpenAI는 밝혔습니다. 해당 취약점은 관련 유지관리자에게 공개 절차를 진행하고 있습니다.

이처럼 강력해진 사이버 역량은 보안 코드 검토와 취약점 발견, 패치 제작 등 방어 업무에 도움이 될 수 있습니다. 반면 공격 목적으로 악용될 위험도 커집니다.

OpenAI는 GPT‑6 Astra가 자사의 Preparedness Framework에서 사이버 보안 분야 Critical 기준에 도달했다고 설명했습니다. 이에 따라 일반 출시 버전에는 추가 안전조치가 적용되며, 고급 취약점에 대한 개념증명 공격 코드 작성과 같은 일부 요청은 거부됩니다.

OpenAI는 향후 OpenAI Daybreak 프로그램을 통해 검증된 방어 목적의 사용자에게 취약점 검증, 악성코드 분석, 탐지 엔지니어링 등 보다 폭넓은 보안 작업을 제한적으로 제공할 계획입니다.


GPT‑6 Astra는 누가 사용할 수 있나?

GPT‑6 Astra는 발표와 동시에 모든 사용자에게 일괄 제공되는 방식이 아닙니다.

OpenAI는 우선 제한된 일부 기관에 Astra를 제공하고, 향후 며칠에 걸쳐 다음 서비스로 확대할 예정이라고 밝혔습니다.

  • ChatGPT Plus

  • ChatGPT Pro

  • ChatGPT Business

  • ChatGPT Enterprise

  • OpenAI API

  • Microsoft Azure

  • AWS Bedrock

현재 공식 발표의 출시 대상에는 ChatGPT 무료 요금제가 포함되지 않았습니다.

ChatGPT Pro·Business·Enterprise 사용자는 상위 모델인 GPT‑6 Astra Pro도 이용할 수 있습니다. Enterprise 환경에서는 출시 시점에 Astra가 기본적으로 비활성화돼 있어 워크스페이스 관리자가 직접 활성화해야 합니다.

개발자는 OpenAI API에서 **gpt-6-astra**라는 모델명으로 사용할 수 있습니다.

OpenAI API 표준 가격은 다음과 같습니다.

  • 입력 토큰 100만 개당 10달러

  • 출력 토큰 100만 개당 50달러

캐시 읽기와 쓰기에는 별도 요금이 적용됩니다. 최대 2배 빠른 처리 속도를 제공하는 Fast mode도 지원되며, 가격은 표준 처리 요금의 2배입니다.


GPT‑6 Astra가 중요한 이유

GPT‑6 Astra의 의미는 단순히 더 높은 벤치마크 점수를 기록한 새로운 언어 모델이라는 데 그치지 않습니다.

이번 모델은 사용자의 요청을 이해한 뒤 컴퓨터와 브라우저, 전문 소프트웨어를 사용하고 여러 단계를 거쳐 결과물을 완성하는 방향으로 발전했습니다. AI가 사람에게 방법을 설명하는 수준에서 벗어나, 실제 디지털 업무를 대신 수행하는 에이전트로 이동하고 있다는 점이 핵심입니다.

특히 다음과 같은 변화에 주목할 필요가 있습니다.

  1. 대화형 AI에서 실행형 AI로의 전환
    답변을 생성하는 것을 넘어 컴퓨터에서 실제 행동을 수행합니다.

  2. 전문 업무 자동화 범위 확대
    개발뿐 아니라 금융 모델링, 엔지니어링, 디자인, 과학 분석, 문서 제작까지 다룹니다.

  3. 긴 작업을 관리하는 능력 강화
    이전 요구사항과 테스트 결과를 검색하고 참고하면서 장시간 작업을 이어갈 수 있습니다.

  4. 강력한 능력에 맞춘 안전장치 강화
    특히 사이버 보안처럼 오용 위험이 큰 분야에는 접근 제한과 모니터링이 함께 적용됩니다.

기업 입장에서는 단순한 챗봇 도입보다 업무 흐름 전체를 AI 에이전트에 연결하는 방안을 본격적으로 검토해야 하는 시점이 다가오고 있습니다. 반면 자동화 과정에서 잘못된 판단이나 권한 초과가 발생하지 않도록 사용자 승인 절차와 접근 권한, 실행 기록, 결과 검증 체계도 함께 설계해야 합니다.


마무리

OpenAI의 GPT‑6 Astra는 컴퓨터 조작과 웹 탐색, 코딩, 문서 제작, 과학 연구, 사이버 보안 등 실제 업무 수행 능력을 강화한 차세대 AI 모델입니다.

Agents’ Last Exam과 AutomationBench, ScreenSpot-Pro 등 컴퓨터 작업 관련 평가에서 OpenAI가 제시한 비교 모델 가운데 최고 수준의 성과를 기록했으며, 사용자 의도를 이해하고 허용된 작업 범위를 지키는 정렬 성능도 개선됐습니다.

다만 공개된 수치는 OpenAI의 공식 평가 결과이며, 일부에는 내부 벤치마크와 특정 실행 환경이 사용됐습니다. 실제 ChatGPT와 API 환경에서의 성능은 도구와 설정, 안전장치에 따라 달라질 수 있습니다.

GPT‑6 Astra의 진정한 변화는 AI가 얼마나 좋은 문장을 생성하는지가 아니라, 복잡한 컴퓨터 업무를 얼마나 정확하고 안전하게 끝까지 수행할 수 있는지에 있습니다. 단계적 출시 이후 실제 사용자와 기업 환경에서 어떤 결과를 보여줄지 지켜볼 필요가 있습니다.


자주 묻는 질문

GPT‑6 Astra는 언제 공개됐나요?

OpenAI는 미국 현지시간 2026년 9월 3일 GPT‑6 Astra를 공식 발표했습니다. 한국시간으로는 2026년 9월 4일입니다.

GPT‑6 Astra를 무료로 사용할 수 있나요?

현재 OpenAI가 발표한 제공 대상은 ChatGPT Plus·Pro·Business·Enterprise입니다. 공식 발표에는 무료 요금제가 포함되지 않았습니다.

API 모델명은 무엇인가요?

OpenAI API에서는 gpt-6-astra라는 모델명으로 제공됩니다.

GPT‑6 Astra는 어디에서 제공되나요?

ChatGPT 유료 요금제와 OpenAI API, Microsoft Azure, AWS Bedrock을 통해 단계적으로 제공될 예정입니다.

GPT‑6 Astra의 가장 큰 특징은 무엇인가요?

컴퓨터 화면과 웹브라우저를 이해하고 여러 단계의 실제 업무를 수행하는 컴퓨터 사용 능력이 핵심입니다. 코딩과 문서 제작, 과학 연구, 전문 업무, 사이버 보안 성능도 함께 강화됐습니다.

벤치마크 점수를 그대로 믿어도 되나요?

공식 수치는 OpenAI가 공개한 평가 결과입니다. 일부 평가는 내부 환경이나 특정 도구를 사용했기 때문에 실제 ChatGPT 사용 경험과 차이가 있을 수 있습니다. 독립 평가와 실제 활용 사례를 함께 확인하는 것이 좋습니다.


공식 자료

이 글은 2026년 9월 4일 기준 OpenAI 공식 발표 내용을 바탕으로 작성했습니다. 출시 대상과 기능, 가격은 향후 변경될 수 있습니다.

7
  • 본 콘텐츠는 정보 제공을 목적으로 하며, 특정 금융투자상품의 매매 권유, 종목 추천, 투자 자문을 목적으로 작성된 것이 아닙니다. 너디스은(는) 콘텐츠에 포함된 자료와 정보의 정확성 및 완전성을 보증하지 않으며, 이를 근거로 한 투자 등 의사결정의 결과에 대해 책임을 지지 않습니다.
  • 본 콘텐츠는 2026년 9월 작성 시점의 정보를 기준으로 하며, 이후 시장 상황·정책·기술 동향 등의 변화에 따라 내용이 달라질 수 있습니다. 투자에는 원금 손실 위험이 따르며, 모든 투자 판단과 그 결과는 투자자 본인에게 귀속됩니다.
  • 콘텐츠에 포함된 견해는 작성자 개인의 주관적 판단이 포함될 수 있습니다. 최종 의사결정 전 공신력 있는 자료를 직접 확인하시기 바랍니다.

지금 많이 보는 글