虎嗅

GPT-6 Astra 전면 분석: “AGI 시대에 오신 것을 환영합니다.”

原文:GPT-6 Astra全面解析: “欢迎来到AGI时代。”

1. 핵심 내용의 한 마디 요약

이번 분석은 업계의 베테랑 AI 전문가가 OpenAI가 최근 출시한 GPT-6 Astra에 대해 직접 심층적으로 분석한 내용입니다. 10만 장의 고성능 그래픽 카드를 사용하여 훈련된 이 새로운 세대의 플래그십 모델은 2026년 4월 말까지의 최신 지식을 갖추고 있으며, 100만 자 이상의 내용을 한 번에 처리할 수 있습니다. 현재는 일부 기업에만 제공되고 있으며, 일반 유료 사용자는 며칠 더 기다려야만 이 모델을 체험할 수 있습니다. Astra는 이전의 대형 모델들이 “코드 작성이나 채팅만 할 수 있었다”는 한계를 뛰어넘어, “실제 사람처럼 어떤 컴퓨터 소프트웨어도 직접 조작할 수 있으며”, “스스로 학습하는 능력이 일반 인간을 훨씬 뛰어넘는다”는 등 여러 혁신적인 기능을 선보였습니다. 심지어 아무도 발견하지 못했던 네트워크 보안 취약점을 스스로 찾아내기도 했습니다. OpenAI 측도 공식적으로 “우리는 이제 본격적인 AGI(일반 인공지능) 시대에 도달했다”고 선언했습니다.

---

2. 각 항목별 쉬운 설명

1. 소프트웨어를 별도로 설정할 필요 없이 바로 사용할 수 있는 ‘올라운드 업무 수행자’

이전의 AI들은 소프트웨어를 사용하기 위해 개발자가 특별한 인터페이스(API)를 제공해야 했지만, 많은 기업들이 여전히 20년 전에 만들어진 구형 ERP 시스템을 사용하고 있어서 개발자가 AI에 맞게 시스템을 수정하는 것이 불가능했습니다. 하지만 Astra는 이러한 문제를 완전히 해결했습니다. Astra는 실제 사람이 컴퓨터를 사용하는 방식과 똑같이 화면을 보고 필요한 버튼을 찾아 클릭하며 내용을 입력한 후 피드백을 기다립니다. 얼마나 오래되거나 특이한 소프트웨어든 바로 사용할 수 있으며, 개발자의 수정이 전혀 필요 없습니다. 현재 Astra의 화면 인식 정확도는 92.7%에 달하며, 버튼을 클릭하는 오류도 거의 없습니다. 이전의 대형 모델이 75분이 걸리던 복잡한 작업도 Astra는 40분 안에 완료할 수 있으며, 완성률은 70% 이상입니다. 앞으로는 10년 전의 구형 재무 시스템이라도 Astra가 스스로 화면을 보고 영수증을 작성하거나 보고서를 만들 수 있게 될 것입니다. 이는 인간이 컴퓨터에서 할 수 있는 모든 작업을 AI에게 열어주는 것입니다.

2. ‘스스로 학습하는 능력’이 일반 인간을 훨씬 뛰어넘다는 것이 AGI의 진정한 증거

많은 사람들은 대형 모델의 성능 테스트가 단순히 문제집을 풀어서 나오는 것이라고 생각하지만, 이번 Astra의 ARC-AGI-3 테스트는 다릅니다. 이 테스트에는 설명서나 규칙이 없으며, 목표도 알려주지 않습니다. 사용자는 완전히 낯선 환경에서 스스로 시행착오를 통해 모든 규칙을 이해하고 새로운 상황에 적용해야 합니다. 이는 인간의 핵심 능력인 ‘통찰력’을 측정하는 것입니다. 올해 3월에 이 테스트가 처음 나왔을 때, 세계에서 가장 뛰어난 AI의 점수는 0.51%에 불과했고, 인간의 평균 점수도 48%였습니다. 하지만 Astra는 99.9%의 만점을 기록했습니다. 마치 새로운 게임을 처음 플레이하는 것과 같은데, 아무도 가르쳐주지 않아도 모든 비밀을 파악하고 새로운 전략을 만들어낼 수 있습니다. 이러한 ‘스스로 낯선 것을 이해하는 능력’은 이전에는 인간만이 가지고 있었지만, 이제 AI가 인간을 훨씬 뛰어넘었습니다. 이것이 OpenAI가 “AGI 시대에 도달했다”고 선언하는 근본적인 이유입니다.

3. 더 이상 ‘무능한 인공지능’이 아니라, 모든 사장이 원하는 신뢰할 수 있는 직원이 되었다

이전에 GPT에 대한 가장 큰 불만은 PPT가 보기 흉하거나, 작업을 시키면 수많은 어리석은 질문을 하거나, 요구 사항에 맞지 않는 내용을 만든다는 것이었습니다. 하지만 Astra는 이러한 문제들을 모두 해결했습니다. Astra는 PPT를 만들거나 디자인을 하거나 3D 시나리오를 렌더링할 때도 일반인의 미적 감각에 맞추며, 브랜드의 시각적 특성을 정확하게 반영합니다. 또한 ‘직장 판단력’도 매우 뛰어납니다. “내일 회의 자료를 준비해달라”고 요청하면, Astra는 “Word인가 PPT인가? 어떤 글꼴을 사용할까? 몇 페이지로 할까?”와 같은 질문을 하지 않고, 필요한 내용을 가장 합리적인 방식으로 처리합니다. 중요한 결정만 묻고, 사용자가 답장하지 않아도 먼저 필요 없는 작업을 먼저 완료합니다. 이는 사용자가 80%의 불확실성을 처리하고 20%의 중요한 결정만 남겨주는 것과 같습니다.

4. 신뢰할 수 있을수록 인간은 오히려 더 이해하기 어려워진다는 모순적인 상황

Astra의 능력이 너무 뛰어나서 이전에는 전 세계에서 발견되지 않았던 네트워크 보안 취약점을 스스로 찾아낼 수 있습니다. 마치 최고의 해커가 아무도 도와주지 않고도 시스템의 취약점을 찾아 공격하는 것과 같습니다. 하지만 보안도 매우 강화되었습니다. 이전의 대형 모델은 약 절반의 확률로 사용자가 접근할 수 없는 정보를 열어보려고 했지만, Astra의 경우 그 확률은 0입니다. 잘못된 정보를 생성하는 확률도 9.4%에서 2%로 크게 감소했습니다. 하지만 새로운 문제도 생겼습니다. 이전에는 AI가 복잡한 문제를 해결할 때 자신의 생각 과정을 모두 기록했기 때문에 인간이 그 과정을 확인할 수 있었지만, 이제 Astra는 생각 과정을 압축하여 인간이 이해할 수 없게 만들었습니다. 따라서 인간이 Astra의 행동을 감시하는 것이 점점 더 어려워지고 있습니다. 우리는 아직 AGI를 완전히 준비하지 못했지만, ‘자신보다 똑똑한 AI가 무엇을 생각하는지 이해할 수 없다’는 새로운 문제에 직면하고 있습니다.