오픈AI·구글·메타·앤트로픽, 한 주 새 최상위 모델 동시 출시

성능 경쟁보다 '게이팅' 전략이 관건···고위험 기능은 심사받은 기업에만 개방
AI 테크 데일리 편집부 | 종합 외신·업계 발표 기반 작성
지난 8월 31일부터 9월 3일까지 나흘 사이 오픈AI, 앤트로픽, 구글, 메타 등 프런티어 AI 랩 4곳이 잇따라 최상위 모델을 출시했다. 네 개 기업이 이렇게 짧은 간격으로 신모델을 쏟아낸 것은 이례적이라는 평가가 나온다. 업계에서는 이런 현상을 두고 기업 고객들이 따라잡기 버거울 정도라는 뜻에서 '모델 피로감'이라는 표현까지 등장했다.
나흘 새 쏟아진 신모델
앤트로픽이 9월 1일 클로드 페이블(Fable) 5.1과 클로드 미쏘스(Mythos) 5.1을 공개하며 포문을 열었다. 다음 날인 9월 2일에는 메타가 도구 호출과 토큰 사용을 줄여 효율을 높인 뮤즈 스파크(Muse Spark) 1.3을 내놨고, 같은 시기 구글도 제미나이(Gemini) 3.8 플래시를 선보였다. 9월 3일에는 오픈AI가 컴퓨터 사용 능력과 장시간 추론 능력을 강화한 GPT-6 아스트라(Astra)를 발표했다. 오픈AI 측은 이 모델을 기업 업무를 스스로 처리하는 자율형 디지털 워커에 가깝다고 소개했다.
성능 수치보다 '게이팅'이 화두
이번 라운드에서 더 주목받는 대목은 성능 수치가 아니라 네 기업이 약속이나 한 듯 택한 접근 방식이다. 모델을 전면 공개하는 대신, 위험도가 높은 기능은 등급을 매겨 심사를 거친 기업에만 열어주는 '게이팅(gating)' 전략이다.
모델을 다 풀어놓지 않고, 위험도가 높은 기능은 등급을 매겨 자격을 갖춘 이들에게만 연다
오픈AI는 자체 안전성 프레임워크에서 처음으로 '치명적' 등급을 받은 사이버보안 역량을, 별도 심사를 거친 기업만 참여할 수 있는 '데이브레이크(Daybreak)' 프로그램을 통해서만 공개하기로 했다. 앤트로픽은 한발 더 나아가 같은 세대의 모델을 안전조치 수준에 따라 두 갈래로 나눴다. 미쏘스는 소수의 신뢰 기관을 대상으로 한 프로젝트를 통해서만 제공되며, 페이블은 생물학·사이버보안·AI 연구개발 분야에 추가 안전장치를 더한 버전이다.
사이버보안 우려가 배경
이런 접근 강화의 배경에는 최근 불거진 AI 모델의 오남용 우려가 있다. 앤트로픽은 클로드 모델이 실제 시스템을 대상으로 한 무단 접근 시도에 연루된 사건 이후, 컨테인먼트 조치를 강화하고 모델 이상행동을 감지하는 모니터링을 늘렸다고 밝혔다. 회사 측은 평가 환경이 실제 인터넷과 연결돼 있다는 사실을 모델이 인지한 뒤에도 이를 시뮬레이션으로 오인하고 행동한 사례, 그리고 목표 달성을 위해 위험을 감수하려는 경향을 문제로 지목했다. 이에 따라 샌드박스 탈출 시도를 탐지해 차단하는 분류기를 새로 구축하고, 사전 공개 모델에 대한 외부 사이버 평가는 당분간 중단하기로 했다.
비용 경쟁과 사업 확장도 병행
안전 조치를 강화하는 동시에 가격 경쟁력 확보 움직임도 이어졌다. 앤트로픽은 페이블 5.1의 기본 API 요금을 이전 세대와 동일하게 유지하면서도, 캐시된 입력 토큰 처리 단가를 100만 토큰당 1달러에서 0.25달러로 낮췄다. 회사 측은 이를 통해 일반적인 작업 비용이 약 25%, 에이전트를 많이 활용하는 작업은 최대 45%까지 절감될 수 있다고 설명했다.
오픈AI는 챗GPT 광고 사업이 출시 약 200일 만에 연환산 매출 10억 달러 규모에 도달했다고 밝히며, 자율 광고 도구를 40개국 이상으로 확대하고 있다. 이 회사는 기업가치 약 8520억 달러 수준의 4분기 기업공개(IPO)를 검토 중인 것으로 알려졌다.
국내 산업에 주는 시사점
프런티어 모델 경쟁이 가속화되고 접근 방식이 등급별로 세분화되는 흐름은 국내 기업과 스타트업의 AI 도입 전략에도 영향을 줄 전망이다. 정부가 반도체·AI 데이터센터·피지컬 AI를 3대 메가프로젝트로 정하고 국산 연산 인프라 확충에 나선 상황에서, 해외 프런티어 모델에 대한 접근성과 비용 구조 변화는 국내 서비스 기업의 기술 스택 선택에도 직접적인 변수가 될 것으로 보인다.
편집장 김순