📋
핵심 요약
OpenAI는 8월 21일 GPT-5.6 Sol의 API·크레딧 가격을 3개월간 20% 이상 인하했고, 구글은 도이치은행·CME그룹이 참여한 금융기관 전용 에이전트 플랫폼 'Gemini Enterprise for Financial Services'를 정식 출시했다.
Anthropic은 9월 1일 예정이던 가격 인상을 전격 취소하고 Claude Sonnet 5의 출시 할인가(입력 2달러/출력 10달러)를 영구 표준가로 확정했다.
xAI는 Grok 4.6을 Amazon Bedrock에 정식 제공하며 50만 토큰 컨텍스트를 갖췄고, 메타는 24시간 자율 실행되는 터미널 코딩 에이전트 'Muse Code' 베타를 공개했다.
메타 연구진에 따르면 Muse Spark 1.2는 도구 연동 평가 점수가 59.8점에서 72.0점으로(+12.2점) 올라, 에이전트가 외부 도구를 제대로 활용할 때 성능이 크게 향상됨을 입증했다.

OpenAI는 플래그십 모델 가격을 20% 내렸고, 구글은 금융권 전용 에이전트 플랫폼을 띄웠다. 앤트로픽은 인상 계획을 철회하며 가격을 고정했고, xAI는 AWS 영토로 들어왔으며, 메타는 24시간 자율 코딩 에이전트를 풀었다. 2026년 8월 넷째 주, 세계 5대 AI 거인이 기업 시장을 놓고 벌인 전면전의 핵심과 한국 B2B 현장에 미칠 파장을 분석한다.

OpenAI·Google: 가격 인하와 금융 특화 패키지로 기업 진입장벽을 허문다

OpenAI는 8월 21일 GPT-5.6 Sol의 API 및 크레딧 가격을 향후 3개월 동안 20% 이상 인하한다고 발표했다(로이터, OpenAI 블로그). 앞서 8월 19일에는 ChatGPT 유료 사용자에게 추론 깊이를 조절하는 슬라이더를 제공하고, 무료 사용자에게는 GPT-5.6 Luna 무제한 텍스트 채팅과 Think 버튼을 열었다. 플래그십 모델의 가격을 분기 단위로 20% 이상 내린 조치는 기업의 에이전트 운영 예산에 직접 영향을 준다. 추론 슬라이더를 활용하면 단순 질의응답은 저비용 모드로, 복잡한 코드 작성과 데이터 분석은 고성능 모드로 자동 분배하여 토큰 소비를 최적화할 수 있다.

한국 B2B 현장에서 이 변화는 마이그레이션 리스크 축소로 이어진다. GPT-5.6 계열 모델로 에이전트 파이프라인을 전환하려는 한국 SaaS 기업과 스타트업은 초기 비용 부담을 대폭 줄일 수 있다. 일회성 테스트가 아닌 상시 가동형 에이전트를 운영할 때 토큰 비용 예측성이 확보되는 점이 핵심이다.

구글은 8월 25일 금융기관 전용 에이전트 플랫폼인 'Gemini Enterprise for Financial Services'를 정식 출시했다(PRNewswire, Google Cloud 블로그). 도이치은행과 CME그룹이 초기 설계 파트너로 참여한 이 플랫폼은 50개 이상의 금융 전문 스킬, 엔터프라이즈 데이터 커넥터, 서드파티 에이전트 생태계를 하나로 묶었다. 또한 8월 20일에는 코딩 에이전트 플랫폼 Antigravity에 중앙 관리 및 지출 통제 기능을 추가하여 엔터프라이즈 구독 기본 구성에 포함했다.

구글의 행보는 보수적인 규제 산업의 진입로를 직접 개척한다는 점에서 실무적 의미가 크다. 금융권이 요구하는 데이터 레지던시, 보안 격리, 거버넌스 기준을 플랫폼 차원에서 해결해주기 때문이다. 이는 한국 금융사와 핀테크 기업의 AI 도입 논의를 단순 개념검증(PoC) 단계에서 실전 배포 단계로 전환시키는 계기가 된다. 금융위원회와 금융감독원의 망분리 및 데이터 가이드라인을 준수하면서도 내부망 전면 재구축 없이 고객 응대, 여신 심사, 투자 리서치 업무에 에이전트를 가동할 수 있는 길이 열렸다.

Anthropic·xAI: 에이전트 운영 예산 고정과 AWS 멀티클라우드 확장

앤트로픽(Anthropic)은 8월 10일 Claude Sonnet 5의 출시 할인가인 입력 100만 토큰당 2달러, 출력 100만 토큰당 10달러를 영구 표준 가격으로 확정했다(Anthropic 공식 뉴스). 당초 9월 1일로 예정되었던 가격 인상(입력 3달러, 출력 15달러)을 전격 취소한 것이다. 최고 성능 모델인 Opus 4.8의 가격도 기존 입력 5달러, 출력 25달러 수준을 유지한다.

이 조치는 에이전트 가동 예산의 불확실성을 완전히 제거한다. Opus급 에이전트 성능을 발휘하는 Sonnet 5를 고정 가격으로 이용할 수 있게 되면서, 기업은 모델 교체에 따른 공수 없이 연간 토큰 예산을 확정할 수 있다. 여기에 프롬프트 캐싱 90% 할인과 배치 처리 50% 할인을 조합하면 실제 체감 단가는 더욱 낮아진다. 특히 AWS Bedrock과 GCP Vertex AI에서도 동일한 가격 조건이 적용되어, 한국 기업은 기존 클라우드 마켓플레이스 환경에서 특정 벤더에 귀속되지 않고 최신 모델을 즉시 도입할 수 있다.

xAI는 8월 19일 Grok 4.6을 Amazon Bedrock에서 정식 제공하기 시작했다(xAI 공식 뉴스, AWS 블로그). 50만 토큰의 컨텍스트 창과 4단계 추론 노력 조절 기능(low/medium/high/xhigh)을 갖췄으며, 함수 호출, 웹 검색, X 검색, 코드 실행을 통합 지원한다. 이어 8월 21일에는 Grok Bot 접근 권한을 SuperGrok Plus 및 Cursor의 Pro+, Teams 전 요금제로 확대했다.

xAI의 Bedrock 입성은 기업 인프라 선택권을 넓힌다. 독자적인 API나 별도 보안 승인 절차 없이, 기존 AWS 계정의 IAM 권한, VPC 보안 구획, 비용 통합 정산 체계를 그대로 활용해 Grok 4.6 기반 에이전트를 빌드할 수 있다. AWS 서울 리전을 이용하는 한국 기업들은 인프라 구조를 변경하지 않고도 OpenAI, 앤트로픽, xAI 모델을 동일한 환경에서 비교 검증하고 멀티모델 포트폴리오를 구성할 수 있게 되었다.

Meta: 24시간 자율 터미널 에이전트와 도구 연동 점수 12.2점 상승

메타(Meta)는 8월 24일 macOS와 리눅스 환경에서 가동되는 터미널 코딩 에이전트 'Muse Code'의 베타 버전을 공개했다(Meta Superintelligence Labs 블로그). Muse Spark 1.2 모델로 작동하는 이 에이전트는 백그라운드에서 저장소 전체 단위의 작업을 24시간 지속 수행한다. 작업 도중 발생하는 모든 이벤트를 로그로 기록하여 크래시 복구, 사용자 승인 게이트, 계획 수정 기능을 자체적으로 제공한다.

메타 연구진이 8월 20일 공개한 기술 블로그에 따르면, Muse Spark 1.2는 도구 연동 평가 점수가 기존 59.8점에서 72.0점으로 12.2점 상승했다. 도구 없이 단독 작동할 때의 점수(60.2점)를 크게 웃도는 수치로, 에이전트가 외부 도구를 제대로 활용할 때 성능이 대폭 향상됨을 입증했다.

Muse Code의 배포는 단일 프롬프트 응답이나 짧은 스니펫 생성에 머물던 AI 코딩을 '24시간 자율 야간 개발' 영역으로 끌어올렸다. 수천 번의 도구 호출을 이어가며 GPU 커널 최적화나 대규모 레거시 코드 이전 같은 장시간 작업을 완료할 수 있는 수준에 도달했다. 이는 한국의 제조, 방산, 금융 분야 기업에 의미가 크다. 엄격한 보안 때문에 클라우드를 쓰지 못하고 온프레미스 망분리 환경에서 자체 Git 서버를 가동하는 기업들이, 로컬 GPU 클러스터에 Muse Code를 올려 내부 코드베이스를 안전하게 리팩토링하고 보안 패치를 자동화할 수 있는 기반이 마련되었기 때문이다.

결론: 단순 모델 비교를 넘어 맞춤형 포트폴리오로 전환할 때

2026년 8월 넷째 주 AI 5강의 움직임은 '비용 절감, 규제 대응, 자율 가동'이라는 세 가지 핵심 축으로 요약된다. OpenAI는 플래그십 가격을 낮춰 운영 상한선을 열었고, 구글은 금융권 규제 장벽을 패키지로 풀었다. 앤트로픽은 운영 예산을 고정시켰고, xAI는 클라우드 생태계로 침투했으며, 메타는 사람이 잠든 사이 돌아가는 로컬 개발 시프트를 현실화했다.

한국 B2B AI 및 IT 실무자에게 필요한 질문은 더 이상 "어떤 모델이 가장 똑똑한가"가 아니다. "우리 조직의 워크플로, 보안 규제, 예산 구조에 가장 적합한 모델 및 인프라 조합은 무엇인가"를 판단해야 한다. 거창한 전면 재구축보다는 현장 요구가 가장 높은 작은 워크플로 하나부터 시작하면 된다. 거버넌스와 비용을 조율하며 차근차근 확장해 나갈 때, AI 5강의 기술 경쟁은 우리 조직의 실행력을 올려주는 가장 실질적인 무기가 된다.

참고 자료

  • 로이터·OpenAI 블로그 — GPT-5.6 Sol API·크레딧 가격 인하 발표(2026년 8월 21일)
  • PRNewswire·Google Cloud 블로그 — 'Gemini Enterprise for Financial Services' 정식 출시
  • Anthropic 공식 뉴스 — Claude Sonnet 5 출시 할인가 영구 표준가 확정
  • xAI 공식 뉴스·AWS 블로그 — Grok 4.6 Amazon Bedrock 정식 제공
  • Meta Superintelligence Labs 블로그 — 터미널 코딩 에이전트 'Muse Code' 베타 공개