OpenAI는 아스트라급 지능을 정가의 5분의 1 가격에 내놨고, 구글은 법무·금융·보안 같은 고위험 지식 작업에 특화된 모델을 꺼냈다. 앤트로픽은 같은 값으로 더 많은 일을 시키는 효율 경쟁과 1억 달러짜리 인재 양성 프로그램을 동시에 걸었고, 메타는 개인 에이전트를 안경 위에 올렸으며, xAI는 음성과 코딩 단가를 바닥까지 끌어내렸다. 이번 주 5대 AI 모델 업체의 전선은 '성능'에서 '가성비·도메인·하드웨어·인재'로 재편됐다.

하지만 실제 현장은 다르다. 발표가 쏟아졌다고 해서 다음 주에 우리 회사 업무 방식이 바뀌지는 않는다. 실무에서 갈리는 지점은 여전히 스펙표가 아니라 도입 경로와 비용 구조, 리스크 통제, 그리고 검증 가능성이다. 한국 B2B IT 실무자가 이번 주 발표에서 봐야 할 것도 바로 이 지점이다.

OpenAI·Google: 가성비 프론티어와 도메인 특화의 등장

OpenAI는 9월 29일 데브데이에서 GPT-6.1 솔을 공개했다(OpenAI 발표). 입력 2달러·출력 10달러·캐시 0.1달러로, 아스트라(입력 10달러·출력 50달러·캐시 1달러) 대비 정가가 5분의 1 수준이다. 성능도 딥SWE 75.2%, 오토메이션벤치 31.7%, OS월드 71.4%로 아스트라(딥SWE 73.5%)에 근접했다. 울트라패스트(6배 요금·8배 속도), 도츠에이전트(아스트라 구동·자체 클라우드), SQLite가 내장된 챗GPT사이트(800만 사용자), 코덱스시큐리티를 함께 출시했고, 월 500달러 프로 요금제에 아스트라 울트라패스트를 포함했다.

구글은 9월 30일 제미나이 4 아르고스를 발표했다(구글 블로그). 실세계 소프트웨어 엔지니어링·법무·금융·사이버 방어의 복합 워크플로에서 프론티어급이라는 평가를 받았고, 페어윈드의 신뢰할 수 있는 사이버 방어자에게 우선 배포되며 미국 정부 사전 접근 절차도 병행한다. 10월 6일에는 임베딩 젬마 2(7.4억 파라미터, 아파치 2.0)를 공개해 텍스트·코드·이미지·비디오·오디오를 한 모델로 임베딩하는 온디바이스 경로를 열었다.

이 발표가 왜 중요한가 (실무 의미): GPT-6.1 솔은 '아스트라급 지능을 에이전트 워크로드 단가로' 진입시키는 신호다. 캐시 90% 할인을 얹으면 반복 프롬프트·RAG·장문 처리가 많은 자동화 파이프라인의 비용이 급감한다. 아르고스는 고위험 지식 작업(법무 검토·금융 모델링·보안 감사) 전용 프론티어로, 범용 모델과 역할을 나누는 투트랙 전략의 근거가 된다.

국내 반향: 국내 금융·법무·보안 기업은 아르고스의 API 개방 시점과 데이터 레지던시 조건, 페어윈드 자격 요건을 미리 파악해 둘 필요가 있다. 임베딩 젬마 2는 멀티모달 RAG·온디바이스 검색·프라이버시 우선 파이프라인을 단일 모델로 묶는 선택지가 된다.

Anthropic: '같은 예산, 더 많은 작업'을 노린 5.5 패밀리

앤트로픽은 9월 22일 오퍼스 5.5를, 9월 28일 소네트 5.5를 공개했다(앤트로픽 뉴스). 오퍼스 5.5는 파이블 5.1 수준의 성능을 오퍼스 5 대비 40% 낮은 비용(입력 4달러·출력 20달러)으로 제공한다. 소네트 5.5는 정가가 그대로(입력 2달러·출력 10달러)지만 토큰 사용량 30% 감소·속도 30% 증가로 작업당 최대 30%의 비용 절감을 노린다. 에이전트 코딩 벤치마크에서는 터미널벤치 4.0 70.6%, 프론티어코드 46.2%, 커서벤치 55.5%를 기록했다.

10월 2일에는 클로드 프론티어 아카데미를 출범시켰다. 1억 달러를 투입해 2027년까지 1만 명의 FDE(현장 배포 엔지니어)를 양성하는 프로그램으로, 액센추어·베인·캡제미니·딜로이트·맥킨지·모건스탠리가 1차 코호트다. 샌프란시스코·뉴욕·런던에서 운영하며 지명제로 계정팀을 통해 신청한다.

이 발표가 왜 중요한가 (실무 의미): 5.5 패밀리는 '동일 예산으로 더 많은 작업'과 '동일 작업을 더 저렴하게'를 동시에 겨냥한다. 소네트 5.5를 일상·버그 수정·문서 작업에, 오퍼스 5.5를 복잡한 판단·장기 과업에 배치하는 투트랙이 곧 표준 구성이 된다. 프론티어 아카데미는 '모델은 있는데 쓸 사람이 없다'는 엔터프라이즈 병목을 정면으로 건드린다.

국내 반향: 국내 SI·컨설팅·금융권이 FDE 파이프라인을 확보하면 앤트로픽 생태계의 구축·마이그레이션·운영 역량을 선점할 수 있다. 다만 하이쿠 5.5는 아직 미출시이고, 배치 API 50% 할인·캐시 읽기 0.05배 같은 가격표를 먼저 확인한 뒤 이전 계획을 세우는 편이 안전하다.

Meta·xAI: 착용형 에이전트와 음성·코딩 가격 파괴

메타는 9월 23~25일 커넥트 2026에서 뮤즈 개인 에이전트를 AI 글래스에 탑재하고, 레이밴 메타 3세대·오디오·VR 글래스를 공개했다(Meta AI 블로그). 뮤즈는 시큐어 VM에서 동작하며 연내 사용자 단독 키를 보유하는 컨피덴셜 VM을 예고했다. 글래스는 100종 이상을 연말까지 출시하고 인도에서 먼저 선보인다(레이밴 3세대 4.4만 루피).

xAI는 9월 21일 그로크 4.7을 출시했다(xAI 뉴스). 2.1조 파라미터·50만 토큰 컨텍스트에 입력 2달러·출력 6달러로 4.6과 같은 값이다. 자기 검증 강화, 긴 컨텍스트 관리, 그로크봇 하네스 네이티브 이해가 특징이다. 9월 18일에는 그로크 보이스 트랜스크라이브 2.0을 내놓으며 1.0 대비 정확도를 2배로 높이고 가격은 유지했다.

이 발표가 왜 중요한가 (실무 의미): 메타는 브라우저·데스크톱을 넘어 '착용형 상시 에이전트'라는 새 폼팩터를 열었다. 현장 작업자·물류·유통·의료·제조에서 핸즈프리 업무 위임, 실시간 시각 질의, 청각 보조(FDA 인가)를 바로 PoC할 수 있다. 그로크 4.7은 출력 6달러로 오픈AI 6.1 솔(10달러) 대비 40% 저렴하고 아스트라(50달러) 대비 87% 저렴해, 모델 라우터·서드파티 하네스에서 즉시 쓸 수 있는 최저가 후보가 됐다.

국내 반향: 국내 안경·웨어러블·통신사·제조사는 컨피덴셜 VM과 데이터 레지던시, 한국어 음성 품질을 검증한 뒤 도입 로드맵을 세우는 게 현실적이다. 그로크 4.7과 음성 2.0 조합은 콜센터·고객 상담·현장 기록·회의록 자동화에서 단일 벤더 최저가 후보지만, 한국어 벤치마크와 데이터 거버넌스·SLA·엔터프라이즈 지원이 아직 성숙하지 않아 PoC 이후 계약 조건을 세밀하게 검토해야 한다.

성능표가 아니라 여섯 축으로 포트폴리오를 다시 짜야 한다

이번 주 5강의 발표는 '가성비 프론티어·도메인 특화·인재 파이프라인·착용형 에이전트·음성·코딩 가격 파괴'라는 여섯 축으로 동시에 전개됐다. OpenAI는 아스트라급 지능의 진입가를 5분의 1로 낮췄고, 구글은 고위험 지식 작업 전용 프론티어와 온디바이스 임베딩을 내놨다. 앤트로픽은 효율과 인재 공급을 함께 풀었고, 메타는 에이전트 폼팩터와 데이터 주권을 확장했으며, xAI는 코딩·STT 단가의 바닥을 다시 갱신했다.

한국 기업은 이제 모델 성능표 한 장으로 벤더를 고르던 방식을 접어야 한다. 대신 '에이전트 워크로드 단가, 도메인 검증 경로, 배포 엔지니어 공급망, 착용형 PoC 시나리오, 음성·코딩 통합 단가, 데이터 거버넌스'라는 실무 평가축으로 포트폴리오를 다시 짜야 한다. 모든 걸 한꺼번에 바꿔야 한다는 뜻은 아니다. 콜센터 한 부서, 백오피스 업무 하나처럼 작은 단위부터 새 축으로 평가한 모델을 붙여 검증하는 것에서 시작하면 된다.