xAI 「Grok 3.5」 공식 출시——사고 연쇄 강화와 X 통합으로 실시간 추론 업무의 구조가 바뀐다
機械翻訳 / Machine-translated
xAI가 2026년 8월 8일(태평양 시간), 차세대 모델 「Grok 3.5」를 공식 출시했다. 컨텍스트 윈도우를 전 세대 대비 3배인 100만 토큰으로 확장하고, X 플랫폼의 실시간 데이터에 대한 네이티브 액세스를 결합한 구성은, SNS 모니터링·경쟁사 모니터링·마켓 인텔리전스 분야에서 「검색→분석→보고」 워크플로 자체를 바꿀 가능성이 있다.
xAI는 태평양 시간 8월 8일 오후 2시, 공식 계정을 통해 Grok 3.5 제공 시작을 발표했다. API는 당일부터 152개국에서 이용 가능하며, 요금은 입력 $8/100만 토큰, 출력 $24/100만 토큰으로 책정됐다. 컨텍스트 윈도우는 Grok 3의 32만 토큰에서 약 3배 확장됐다.
벤치마크 측면에서는 MMLU 94.2%, GPQA(대학원 수준 과학 QA) 89.1%를 기록했다. OpenAI GPT-5의 MMLU 95.1%에는 근소하게 미치지 못하지만, xAI가 독자적으로 정의하는 「실시간 추론」 평가에서는 92.7%로 이를 앞섰다고 한다. 추론 속도는 전 세대 대비 2.4배.
출시 직후 X에는 검증 게시글이 급증했으며, 속보 계정들에서는 다음과 같은 실험 보고가 이어졌다:
「Grok 3.5에 X 라이브 검색을 활용해 "오늘 반도체 주가 동향"을 물었더니, 개별 종목의 가격 변동과 관련 뉴스를 3분 만에 정리해줬다. 직접 구축한 RAG 파이프라인이 필요 없어질지도 모르겠다」
Grok 3은 2026년 2월에 공개됐으나, 실시간 데이터 액세스는 X의 검색 기능에 한정돼 있었고, 구조화 데이터 처리 정확도가 약점으로 꼽혔다. 그 사이 GPT-5·Gemini 2.5 Ultra가 잇따라 투입되면서 xAI의 벤치마크상 우위는 반년 만에 줄어들었다.
Grok 3.5에서는 사고 연쇄(Chain-of-Thought) 처리 단계를 「최대 64단계」에서 「최대 256단계」로 확장했다. 복수 단계의 추론이 필요한 금융 분석·법무 문서 검토·코드 생성에서 기존 대비 정답률이 평균 17포인트 향상됐다고 xAI는 주장하고 있다.
지금까지 Grok의 X 통합은 「키워드 검색」에 그쳤다. Grok 3.5에서는 특정 해시태그·계정 그룹의 트렌드를 시계열로 집계하고, 요약·감성 분석까지 일관되게 처리할 수 있는 설계가 됐다. Brandwatch 등 전용 SNS 리스닝 툴과의 경쟁 관계가 명확하게 형성됐다.
100만 토큰은 한국어 기준 약 80만 자, A4 환산 약 1,600페이지 분량에 해당한다. 계약서·재무 보고서·소스 코드 리포지토리 전체 분석이 현실적인 비용으로 완결되는 수준에 진입한다. 장문 처리 특화 전용 툴 시장에 대한 압박이 높아질 것이다.
입력 $8/M 토큰은 Claude Sonnet 4.6($3/M)이나 GPT-4o($5/M)와 비교하면 다소 높다. 다만 X 실시간 데이터 포함으로 생각하면, 별도의 수집·검색 비용이 절감되므로 SNS 분석 특화 용도에서는 총비용이 역전되는 시나리오도 있다.
MCP(Model Context Protocol) 지원은 「준비 중」으로 돼 있으며, LangChain·CrewAI와의 공식 연동은 미확인 상태다. 자율 에이전트 프레임워크로의 통합은 경쟁사 대비 1~2개월 늦은 상황으로 보이며, 엔터프라이즈 본격 도입의 병목이 될 가능성이 있다.
Grok 3.5가 일반적인 LLM 출시와 차별화되는 점은, X의 10억 사용자가 매초 생성하는 데이터를 「추론의 입력」으로 직접 활용할 수 있다는 점이다. 다른 모델이 인터넷 전체를 검색 대상으로 삼는 것과 달리, Grok은 특정 플랫폼을 깊이 파고드는 설계——이 비대칭성은 소셜 리스닝, 선거 분석, 금융 뉴스 감성 분석 영역에서 구조적인 강점이 된다.
다만 우려 사항은 명확하다. X의 데이터 품질은 플랫폼 운영 방침에 따라 변동하기 쉬우며, 허위 정보·스팸이 모델의 추론에 혼입될 위험은 배제할 수 없다. 「속보성」과 「신뢰성」의 트레이드오프는 사용 측이 설계 단계에서 자각적으로 대처해야 할 문제다.
MCP 미지원이라는 현 상황은, 엔터프라이즈 전개를 서두르는 조직에게 실질적인 장벽이 된다. 향후 60일 이내에 공식 지원이 나오는지 여부가 에이전트 시장에서의 도입률을 가르는 분기점이 될 것이다.
Grok 3.5는 「고속·광범위한 컨텍스트·X 통합」이라는 세 가지 측면에서, SNS 기반 비즈니스 인텔리전스 업무에 가장 직접적으로 영향을 미치는 구성이다. 벤치마크 최고 자리는 노리지 못하고 있지만, X 데이터와의 원활한 통합이라는 차별화 축은 다른 모델이 모방하기 어렵다. 다음 초점은 MCP 지원과 에이전트 프레임워크 연동의 공식 발표——그것이 확정되면, 기업의 도입 판단이 일제히 움직일 것으로 보인다.
※ 본 기사는 미라이 뉴스 편집부의 AI 라이터(AI 뉴스)가 작성했습니다.