DeepSeek 「R2」 공식 출시——추론 비용 90% 절감으로 오픈소스 LLM 경쟁의 전제가 바뀐다
機械翻訳 / Machine-translated
DeepSeek이 추론 특화 모델 「R2」를 2026년 8월 9일 22:00(UTC+8)에 공식 출시했다. 입력 토큰 단가 $0.014/M은 현행 GPT-4o 대비 약 89% 저렴하며, 동시에 주요 벤치마크(AIME 2025: 92.3%, SWE-bench Verified: 61.8%)에서 GPT-5 수준에 나란히 한다고 발표했다. 오픈 웨이트 배포·상업적 이용 개방의 조합은 2025년 1월 R1 출시 당시를 뛰어넘는 구조적 임팩트가 될 수 있다.
GitHub 및 DeepSeek 공식 사이트에서 모델 웨이트와 테크니컬 리포트가 동시에 공개되었다. 아키텍처는 MoE(Mixture of Experts)를 채택했으며, 파라미터 총수는 비공개이나 활성 파라미터 수는 R1 대비 약 40% 감소했다고 설명하고 있다.
추론 비용(API 경유, 2026년 8월 9일 기준):
벤치마크 속보값(DeepSeek 공식 리포트 기준):
「R2의 SWE-bench 61.8%는 내부 테스트 수치로 공식 리더보드는 아직 미반영. 다만 로컬에서 돌려본 느낌은 R1보다 확실히 빠르고, 코드도 깔끔하다. 비용까지 포함하면 이보다 나은 선택지가 떠오르지 않는다」
(X, 엔지니어 계정, 2026-08-09)
DeepSeek-R1이 2025년 1월에 출시된 이후 18개월, LLM 시장의 추론 비용은 업계 전반에서 급격히 하락했다. OpenAI·Anthropic·Google이 잇달아 API 가격을 인하하는 가운데, DeepSeek은 「효율성의 비대칭 전략」을 지속해왔다. R1은 Hugging Face에서 공개 3개월 이내에 다운로드 수 1,800만을 돌파하며, 아시아·유럽 중소기업에서의 온프레미스 도입 사례가 급증한 바 있다.
라이선스 변경도 중요한 포인트다. R1은 상업적 이용에 일부 제한이 있었지만, R2는 「DeepSeek Model License 2.0」을 채택하여 월간 활성 사용자 1억 미만의 상업적 이용을 원칙적으로 무상 개방했다. 이 변경이 국내 SaaS 벤더로의 파급을 가속시킬 것으로 보인다.
입력 $0.014/M 토큰이 의미하는 것은, 100만 자 상당의 문서 처리(약 700K 토큰)가 $10 이하로 가능하다는 것이다. 법무·회계·의료 분야의 대량 문서 처리 업무에서 월별 비용 시산이 1~2자릿수 달라지는 수준의 변화가 된다.
API가 아닌 웨이트를 직접 배포하기 때문에, 금융·의료·공공기관 등 「클라우드에 원본 데이터를 올릴 수 없는」 업종에서의 로컬 운용이 즉시 가능해진다. 데이터 주권에 대한 우려가 뿌리 깊은 일본 시장에서는 다른 모델보다 빠르고 광범위하게 영향이 나타날 것으로 보인다.
AIME 2025의 92.3%는 R1 대비 +12pt로, 현재 최상위권으로 꼽히는 모델과 동등한 수준에 진입한다. 코딩 에이전트나 수리 분석 툴에의 탑재를 검토하던 개발자는 비용 견적을 즉시 재검토할 필요가 생기게 된다.
R2가 중국 기업 출신의 오픈 웨이트라는 사실은 변하지 않는다. 보안 심사·컴플라이언스 대응 비용을 R2 도입의 장벽으로 보는 서구 기업은 계속 존재할 것이다. 일본 기업은 「비용 절감 vs 거버넌스 리스크」의 저울질을 조직별로 판단해야 하는 국면에 놓여 있다.
R1 출시 당시에는 2주 이내에 경쟁사들이 가격 개정을 단행한 전례가 있다. 이번에도 72시간 이내에 어떠한 대응책이 나올 가능성이 높다.
R2가 들이밀고 있는 것은 「성능 경쟁이 끝나고 비용 경쟁으로 이행했다」는 도식이 아니다. 성능과 비용 모두가 동시에 움직이고 있는 것이 현재 상황이다. 어느 쪽으로도 차별화하지 못하는 API 프로바이더는 2026년 말을 향해 포지션을 잃게 될 것으로 보인다.
일본 시장에서 특히 영향이 큰 것은 기업용 SaaS 개발자층이라고 본다. GPT-4o 수준의 정확도를 온프레미스에서 $0.014/M 입력으로 구동할 수 있다면, 「비용 문제로 AI 탑재를 포기했던」 제품의 채산 라인이 완전히 달라진다. 개발자들이 R1에 반응한 속도를 감안하면, R2의 평가 사이클은 앞으로 1~2주 안에 집중적으로 돌아갈 것이다.
한편, 데이터 거버넌스와 수출 규제 관점은 무시할 수 없다. 법무·정보보안 부문과의 조정 공수까지 포함하여 ROI를 계산해야 하는 국면이며, 「일단 써보자」로 끝낼 수 없는 경우도 나올 것이다.
향후 48~72시간 안에 주목해야 할 것은 두 가지——경쟁 API의 가격 개정 타이밍, 그리고 SWE-bench 공식 리더보드로의 R2 등록 확정이다. 후자가 확인되면, 코딩 에이전트 시장에서의 도입 논의가 일제히 움직이기 시작할 것이다.
DeepSeek R2는 AI 모델 선정에서의 「성능이냐 비용이냐」라는 이항 대립을 사실상 무효화했다. 정확도 90%대·추론 비용 ▲89%라는 조합은, AI 도입을 검토 중인 기업의 의사결정을 가속시키는 기폭제가 될 수 있다. 당신의 조직이 가진 「비용 문제로 AI를 도입하지 못했다」는 전제는, 오늘을 기점으로 재검토해야 할 단계에 왔는지도 모른다.
※본 기사는 미라이 뉴스 편집부의 AI 라이터(AI 뉴스)가 작성했습니다.