⚡ 스프 핵심요약
오픈AI의 신규 모델 GPT-5.6은 코딩 대회에서 인간 전문가와 기존 AI를 압도하는 성능을 입증하며 개발 분야에서의 영향력을 재확인했습니다.
기업용 AI 시장에서 성능 상향 평준화가 이루어지며 토큰 비용 효율을 극대화한 가성비 모델이 시장 점유율 확보의 핵심 변수로 떠올랐습니다.
엔트로픽은 컴퓨팅 자원 한계로 인한 비용 모델 정책의 어려움을 겪는 반면 오픈AI와 xAI는 강력한 성능 대비 낮은 가격을 무기로 공격적인 시장 경쟁을 벌이고 있습니다.
안녕하세요. 데이터를 만지고 다루는 안혜민 기자입니다. 앤트로픽에 밀리고 있다는 평가를 받던 오픈AI가 칼을 갈고 나왔습니다. 신규 모델 GPT-5.6에 대한 호평이 이어지면서 AI 시장이 다시 술렁이고 있죠. 오늘 오그랲에서는 GPT-5.6 이야기를 준비했습니다. 이 모델이 왜 주목받는지, 또 이로 인해 AI 시장이 어떻게 흘러가고 있는지 5가지 그래프를 통해 살펴보겠습니다.
체스, 바둑에 이어 코딩까지... 최정상 프로그래머, AI에 무너지다
오픈AI 이야기에 앞서서 먼저 일본으로 가보겠습니다. 2012년에 설립된 AtCoder라는 곳이 있습니다. 여기선 주기적으로 프로그래밍 대회를 개최해서 전 세계의 프로그래머들이 자신들의 능력을 뽐낼 수 있게 하고 있어요. 그중에서도 온라인 예선과 정규 대회를 통해 쌓은 점수 최상위권만 모아서 겨루는 대회가 있습니다. 이름하여 World Tour Finals죠. AtCoder 레이팅 상위 12명의 정예 챔피언들을 도쿄로 초청해 오프라인에서 겨루는 코딩 대회입니다. 올해에도 전 세계에서 내로라하는 프로그래머들을 모아 대회가 진행되었죠.
이 두 분야 각각에 12명의 프로그래머들이 참여하게 되는데, 작년부터는 여기에 AI 모델도 참여해서 경쟁을 하고 있어요. 작년에 치러진 대회에서는 휴리스틱 영역에서 AI 모델이 인간 프로그래머에게 패배한 바 있죠. AI의 코딩 성능이 올라왔다곤 하지만 최상위 그룹에서는 여전히 인간이 더 높았던 겁니다. 당시 AI를 꺾었던 선수는 폴란드의 프로그래머 Psyho였고요. 과연 올해는 어땠을까요?
이번에는 알고리즘 영역입니다. 알고리즘은 총 5문제가 출제되고, 누가 먼저 정답을 맞히는 가로 승패가 갈립니다. 알고리즘 부문에 참여한 프로그래머들 면면을 보면 정말 이쪽 필드에서 다 대단한 양반들입니다. 최연소 11살의 나이로 국제정보올림피아드에 참가했던 벨라루스의 tourist. 역사상 최초로 국제정보올림피아드 6연속 금메달이라는 기록을 세우기도 했죠. 또 수상한 애니 프사를 가진 중국의 전설적인 프로그래머 jiangly도 있습니다. 이들뿐 아니라 미국과 캐나다의 대표 프로그래머들도 참여해 자웅을 겨루었는데, 그 결과를 그래프를 통해 살펴보겠습니다.
절치부심한 오픈AI... 성능에 가성비까지 챙긴다
이런 서사가 있지만, 사실 개발 영역에서 탁월한 성능을 보여준 건 최근까지는 앤트로픽 모델들이었습니다. 클로드 코드를 써보고 만족한 개발자들이 많고, 기업들도 앞다퉈 앤트로픽의 제품을 사용할 정도니까요. 실제 기업들의 LLM 지출을 살펴보면 앤트로픽은 지난해 오픈AI를 역전했어요.
반면 오픈AI는 사실 기대치에 못 미치는 결과물을 내놓았습니다. 가령 작년 여름에 나왔던 GPT-5를 기억하시나요? 많은 사람들이 숫자 4에서 5로 넘어가는 모델이 나오는 만큼 엄청난 성능 향상을 기대했는데, 열어보니 실상은 달랐죠.
그렇다고 오픈AI가 가만히 있었던 것은 아닙니다. 꾸준히 성능 향상을 위해 달려왔죠. 특히 작년 하반기부터 그 변화의 모습이 보이기 시작했습니다. 2025년 9월 아제르바이잔의 수도 바쿠로 가보겠습니다. 바쿠에서 열린 국제 대학생 프로그래밍 대회 ICPC 결승전입니다. 약 3,000개 대학들이 참여해서 상위 139개 팀만이 결승에 진출했는데, 이들은 총 12개의 알고리즘 문제를 제한시간 5시간 안에 풀어야 했습니다.
GPT-5 출시 이후 버전을 계속 업데이트해 나간 오픈AI. 그리고 드디어 GPT-5.6이 세상에 나왔습니다. 물론 이 모델도 바로 시중에 풀리진 않았습니다. 미국 정부가 제한을 걸어서 정부 승인을 받은 파트너 조직 20곳부터 사용할 수 있었죠. AI 모델을 이렇게 정부가 제한적으로 접근하도록 한 건 앤트로픽의 페이블, 미토스 5 이후 이번이 두 번째입니다. 오픈AI는 정부의 요청을 받으면서도 이런 방식이 정례화되선 안된다고 지적했어요. 한편으로 규제를 받아들인 건 IPO를 앞두고 있다는 배경도 있지만, 내부적으로도 모델의 위험성을 어느 정도 인정했기 때문입니다.
이후 오픈AI와 미국 정부 간의 협의가 이뤄지면서 제한이 풀렸고, 결국 GPT-5.6은 정식으로 시장에 풀렸습니다. 가장 높은 등급의 Sol부터 경량화 모델 Terra, 그리고 더 경량화된 Luna 모델까지 세 등급으로 나뉘어 나왔어요. 모델 수준을 평가한 지표들을 보면 코딩이나 금융 영역에서 앤트로픽의 클로드 페이블 5 수준까지 올라왔습니다. 심지어 GPT-5.6 Sol 울트라 모델의 경우엔 수학계에서 50년간 풀리지 않았던 난제를 단 1시간 만에 증명해 내기도 했죠.
성능과 함께 사람들이 반응한 건 모델의 가성비입니다. 사실 신규 모델이 여기저기서 다 나오고 성능 상향평준화가 어느 정도 이뤄지면서, 이제 중요한 건 비용입니다. 토큰 비용 최적화를 어느 기업이 해내느냐에 따라 선택이 갈리고 있는 거죠. 비용 측면에서도 이번 GPT-5.6는 경쟁력이 있다는 평가가 나옵니다.
발등에 불 떨어진 앤트로픽? 페이블 5, 무료 3차 연장
이런 상황이 닥치니 앤트로픽 입장에서는 신경이 쓰일 수밖에 없을 겁니다. 페이블 5를 6월 초에 공개했지만 3일 만에 미국 정부의 통제 지침 때문에 서비스가 중단되면서 선점 효과도 제대로 누리지 못했죠. 한 달 가까이 지난 7월 1일이 돼서야 통제가 풀리면서 서비스가 재개되었으니 미국 정부가 원망스러울 수도 있을 겁니다.
그런데 그 상황에서 오픈AI의 GPT-5.6이 공개된 겁니다. 성능도 페이블 5에 뒤지지 않는데 가격이 저렴하니 소비자들은 즉각 반응했고, 이걸 앤트로픽도 바로 인지하게 되었어요. 그래서 앤트로픽이 꺼내든 정책이 무료 혜택 연장 카드였습니다.
사실 앤트로픽 입장에서도 페이블 5를 구독 요금제에 넣고 싶은 마음이 없는 게 아닙니다. 하지만 이렇게 따로 요금제를 세팅한 이유는 컴퓨팅 자원이 충분치 않기 때문이죠. 구독 요금제에 넣어버리면 페이블 5의 사용량이 폭증할 텐데, 그걸 감당할 컴퓨팅 리소스가 아직 앤트로픽에겐 없는 겁니다. 만약 그렇게 되면 지연시간도 생기고 서버도 걸핏하면 다운되면서 사용자 경험은 훨씬 안 좋아지겠죠.
성능은 올라오고, 가격은 내려오고 앤트로픽이 선점했던 코딩 시장이 새로운 국면으로 접어들고 있습니다. 빅테크 기업들의 경쟁이 성능을 넘어 가격으로 번지고 있는 건 소비자 입장에서는 나쁘지 않은 일이에요. 더 좋은 모델을 더 싼 값에 쓸 수 있게 됐으니까요.
다만 주요 AI 기업들 대부분이 여전히 적자 상태라는 점은 생각해 볼 지점입니다. 이런 출혈 경쟁이 언제까지 이어질 수 있을지 아무도 장담할 수 없으니까요. 과연 프론티어 모델 경쟁의 최종 승자는 누가 될까요? 오늘 준비한 오그랲은 여기까지입니다. 긴 글 끝까지 읽어 주셔서 진심으로 감사드립니다.
참고자료
- Psyho(@FakePsyho) | X
- Ethan Knight(@__eknight__) | X
- AtCoder World Tour Finals 2026 Heuristic | AtCoder E
- nterprise LLM API Market Share by Usage | Menlo Ventures
- ICPC 2025 World Finals Baku | ICPC World Finals
- Preparedness Framework | OpenAI
- Artificial Analysis Coding Agent Index v1.1 | OpenAI
- A Proof Of The Cycle Double Cover Conejcture | OpenAI
- Prompt Used For "A Proof Of The Cycle Double Cover Conejcture" | OpenAI
- Vals Index Industry Average Accuracy Comparison | Vals AI
글 : 안혜민 디자인 : 안준석 인턴 : 신연성
동영상 기사
동영상 기사
댓글