OpenAI는 GPT-6 Astra를 출시하였으며, 이는 지금까지 가장 능력 있는 모델로 인공지능 기술의 중요한 진전을 나타냅니다. Greg Brockman에 의해 “능력의 세대적 도약”으로 불리는 Astra는 인공지능 일반 지능(AGI)에 가장 근접한 모델로 평가받고 있습니다. 특히 이 모델은 인간의 개입 없이 보안 시스템에 자율적으로 해킹할 수 있는 능력을 가지고 있다고 평가받는 첫 번째 OpenAI 모델입니다. 이러한 발전은 GPT-6 Astra AGI를 AI 능력 진화에 있어 중요한 발전으로 위치 짓습니다.
테스트에서 GPT-6 Astra는 ExploitBench에서 100%를 기록했습니다. 두 번째 평가에서는 Google의 V8 JavaScript 엔진에서 20개의 최근 취약점을 사용했습니다. 그 평가에서 Astra는 이전 모델인 GPT-5.6 Sol을 초월하며 두 개의 이전에 알려지지 않은 제로데이 취약점을 발견하고 연결했습니다. 이 모델은 단계별 인간 감독 없이도 이전에 알려지지 않은 소프트웨어 결함을 독립적으로 발견하고, 이를 견고한 시스템 전반에 작동하는 악용으로 연결할 수 있는 능력을 가지고 있다고 보고됩니다.
시연에서 Astra는 법적 계약서를 포맷하고, 3D 게임을 제작하며, 음식 옵션을 검색하는 동안 테니스 코트를 예약했습니다. 보고서에 따르면, KiCad에서 인쇄 회로 기판을 설계하고 W-2 양식으로 세금 신고서를 작성할 수 있다고 합니다. 또한 Unity에서 3D 도시 장면을 제작할 수 있다고도 합니다. 이러한 시연 및 보고서는 문서 포맷팅, 소프트웨어 및 게임 개발, 일정 관리, 전자 설계, 세금 작성, 그리고 3D 장면 구성에 적용된 능력을 보여줍니다.
이 요약은 GPT-6 Astra에 대한 보고된 테스트 결과 및 시연 내용을 나열합니다. 추가 설명이나 분석 없이 이러한 결과를 제시합니다. 여기에는 더 이상의 기술 세부 사항이 포함되어 있지 않습니다.
GPT-6 Astra에 대한 과학적 평가에는 소수 사이의 간격에 대한 수학적 결과의 개선이 포함되었습니다. 이 모델은 생물학, 화학, 의학 및 물리학 테스트에서 새로운 기준을 세웠으며 여러 과학 분야에 걸쳐 있습니다. 확인되지 않은 유출에 따르면 ARC-AGI3 기준 점수가 98.6%로 나타났으며, 이러한 유출 수치는 아직 확인되지 않았습니다. 평가 결과는 Astra의 성능 평가의 일환으로 보고되었습니다.
Astra는 OpenAI의 준비 프레임워크에 따라 “중대한” 임계값을 초과했습니다. Astra의 자율성은 이전 시스템보다 모니터링을 더 어렵게 만들며, 평가에 따르면 Astra는 이전 모델보다 추적하기 더 어렵다고 나타났습니다. Jakub Pachocki는 회사가 활성화 모니터링을 통해 모니터링을 강화하거나 사고의 연쇄를 더 투명하게 만들 것이라고 밝혔습니다. 이러한 절차는 계획된 모니터링 변경으로 설명됩니다.
이 평가 결과와 명시된 모니터링 조치는 추가 분석 없이 제공됩니다. 여기에서는 추가 해석이 제공되지 않습니다.
OpenAI의 GPT-6 Astra는 현재까지 회사의 가장 강력한 모델로 제시되며, 인공지능 일반화에 이르는 단계로 보고되고 있습니다. 이 모델의 고급 기능에는 자율 사이버 작업 및 광범위한 과학 성능이 포함되어 있으며, 자율성 덕분에 이전 시스템보다 모니터링하기 더 어렵다고 보고되었습니다.
OpenAI 직원, 특히 Jakub Pachocki는 회사가 활성화 모니터링을 통해 모니터링을 강화하거나 모델의 사고 연쇄를 더 투명하게 만드는 방법으로 이러한 목표를 이룰 것이라고 밝혔습니다.


