실제 Token 사용량 · 중국 모델 46% · 사용량≠품질 · 앱 계층 · 8월 예측
몇 달 전 벤치마크만으로 모델을 고르고 계신가요? OpenRouter는 세계 최대 중립 모델 라우팅 플랫폼으로, 순위는 마케팅이 아니라 개발자가 실제로 지불한 Token 사용량을 반영합니다. 본문은 2026년 7월 25일 기준 최신 데이터로 7월 3대 변화를 분석합니다: 샤오미 Mimo V2.5 1위, 중국 벤더 46% 점유 돌파, capability와 popularity의 분기. Top 12 표, 벤더 점유율, 앱 계층, 가격 대조, 6단계 계층 라우팅 Runbook, 8월 트렌드 예측을 포함하며 6월 순위 해설 및 OpenRouter 연동 가이드와 상호 링크합니다.
OpenRouter 공식 순위(openrouter.ai/rankings)는 실제 유료 Token 트래픽으로 정렬되며, 본질적으로 「개발자가 무엇을 쓰는가」이지 「어떤 모델이 가장 똑똑한가」가 아닙니다. 순위를 조달 결정에 인용하기 전에 다음 5가지 맹점을 먼저 인식하세요.
사용량을 품질과 혼동: 저렴하고 빠른 모델이 고트래픽 앱 뒤에 있으면 상위에 오르지만, 복잡 추론에서 더 강하다는 뜻은 아닙니다. 어려운 작업의 소비 점유율 그림은 완전히 다릅니다.
하루 챔피언만 봄: 순위는 일별로 크게 변동합니다(Mimo V2.5와 Claude Opus 4.8 순위는 날마다 바뀝니다). 벤더 총 점유율과 30일 누적도 함께 확인하세요.
가격 레버 무시: DeepSeek V4 Flash 입력 약 $0.05–0.14/M, GPT-5.5 약 $5/M——약 35배 가격 차로, 사용량 순위는 상당 부분 가격 수학의 결과입니다.
모델 계층만 보고 앱 계층 무시: 모델 순위는 「어떤 두뇌가 인기인지」를, Apps 순위는 「그 두뇌로 무엇을 하는지」를 보여 줍니다——코딩 Agent와 롤플레이가 대부분의 트래픽을 차지합니다.
보안·컴플라이언스 신변수 경시: 이번 주 OpenAI 미공개 모델 샌드박스 탈출 사건이 확산되며, 기업 선정에서 「벤더 보안 평판」 비중이 뚜렷이 올라갑니다.
맹점을 인식한 뒤 다음 절의 7월 데이터 표를 올바르게 읽으세요. 이는 트래픽 온도계이지 능력 판결문이 아닙니다.
7월 25일 기준 일일 Token 사용량 Top 12와 벤더 점유율은 다음과 같습니다(수치는 게시 시점 openrouter.ai/rankings 실시간 데이터를 우선하세요).
| 순위 | 모델 | 벤더 | 일일 Token | 근 30일 누적 |
|---|---|---|---|---|
| 1 | Mimo V2.5 | 샤오미 | 1.4T | 31.2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943.9B | 23.6T |
| 3 | Hy3 | Tencent | 590B | 23.4T |
| 4 | Nemotron 3 Ultra 550B (무료) | NVIDIA | 428.6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413.7B | 11.6T |
| 6 | GLM 5.2 | 智谱 Z.ai | 316.7B | 13.3T |
| 7 | MiniMax M3 | MiniMax | 262.5B | 15.1T |
| 8 | Step 3.7 Flash | 阶跃星辰 | 204.8B | 5.9T |
| 9 | Kimi K3 | Moonshot AI | 157.6B | 1.6T (신규) |
| 10 | Ling 3.0 Flash | 蚂蚁 InclusionAI | 128.3B | 417.3B |
| 11 | Gemini 3 Flash Preview | 106.3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99.5B | 3.6T |
| 벤더 | 소속 | 점유율 (약) |
|---|---|---|
| DeepSeek | 중국 | 16%–18% (단일 벤더 최고 안정 1위) |
| 샤오미 | 중국 | 8%–18% (Mimo V2.5 급등, 변동 최대) |
| Anthropic | 미국 | 10%–15% |
| Tencent | 중국 | 8%–13% |
| 미국 | 8%–13% | |
| 중국 벤더 합계 약 46% (1년 전 <2%); 미국 3사 합계 약 30%–36% (1년 전 약 70%) | ||
DeepSeek은 벤더 점유율에서 가장 안정적인 챔피언이지만, 「월간 챔피언 모델」은 MiniMax M2.5 → MiMo-V2-Pro → Mimo V2.5로 계속 바뀝니다——오늘 1위만 보면 안 됩니다.
| 모델 | 입력/M | 출력/M | 포지션 |
|---|---|---|---|
| DeepSeek V4 Flash | $0.05–0.14 | $0.24–0.28 | 가성비 1위, Agentic Coding 1순위 |
| GLM 5.2 | $0.45 | $3.31 | 오픈소스 중 Opus급 계획 품질 |
| Kimi K3 | ~$3 | ~$15 | 1.4TB 오픈 가중치, 클로즈드급 능력 |
| Claude Opus 5 | $5 (고속 $10) | $25 (고속 $50) | 클로즈드 플래그십, FrontierBench v0.1 43.3% |
작업 유형별 소비 금액 비중: 일반 대화 35.7%, Agent 워크플로 30.4%, 코드 26.5%. 「분류/복잡 추론」만 보면 Claude Sonnet 4.6과 Opus 4.7이 각 13.5%로 공동 1위, GPT-5.5 11.6%로 3위——저가 오픈소스 모델은 이 차원에서 거의 보이지 않습니다. 시장은 덤벨형: 오픈소스가 물량, 클로즈드가 어려운 작업 가격 결정력을 지킵니다.
개인 개발자든 기업 기술 책임자든, 다음 6단계로 OpenRouter 데이터를 실행 가능한 계층 라우팅 전략으로 전환할 수 있습니다(OpenRouter API 가이드의 fallback 설정과 함께 사용하세요).
작업 버킷 정리: workload를 대량(잡담, 창작, 롤플레이, 간단 코딩)과 어려운 작업(복잡 추론, 고위험 Agent 결정, 강한 일관성 분류)으로 나눕니다.
대량 계층 모델 선정: DeepSeek V4 Flash(가성비 최우)와 GLM 5.2(오픈소스 중 Opus에 가장 가까운 계획 품질)를 우선 테스트하고 채택률·오류율을 기록합니다.
어려운 작업 계층 플래그십: 막힌 단계는 Claude Opus 5 또는 GPT-5.6으로 라우팅. Opus 5 출시 해설의 가성비 변화도 참고하세요.
OpenRouter fallback 체인 설정: 주 모델 429/다운 시 자동 예비 전환. models 배열로 우선순위를 명시하고 비즈니스 코드에 하드코딩 재시도를 피합니다.
내부 평가 세트 구축: 순위만 믿지 말고 실제 prompt로 채택률·지연·청구를 측정하고, 매월 openrouter.ai/rankings와 대조해 라우팅표를 갱신합니다.
보안 점수카드 반영: 벤더 보안 기록, 샌드박스 탈출 이력, 컴플라이언스 자격을 선정 가중치에 기록. 자율 Agent는 권한 축소와 감사 로그를 적용합니다.
힌트: 국내에서 OpenRouter 평균 지연은 약 180–250ms이며 국내 세금계산서를 지원하지 않습니다. 프로덕션은 컴플라이언스 중계를 평가하고, OpenRouter는 기술 사전 검증 샌드박스에 적합합니다.
| 순위 | 앱 | 유형 | 점유 (약) |
|---|---|---|---|
| 1 | Hermes Agent | 개인 Agent/CLI | ~45% |
| 2 | Kilo Code | 코딩 Agent | ~13% |
| 3 | OpenClaw | 범용 Agent | ~9% |
| 4 | Claude Code | 코딩 Agent | ~6% |
| 5 | Descript | 콘텐츠 제작 | ~4.5% |
| 6–10 | pi, Lemonade, ISEKAI ZERO, Janitor AI, Cline | Agent/롤플레이 | 1.7%–3.3% |
Cline → Roo Code → Kilo Code는 같은 코드 계보의 세 번째 분기이며, 「손자 세대」 Kilo Code가 조상 Cline을 역전했습니다. 롤플레이/동반형(Janitor AI, ISEKAI ZERO, SillyTavern 등)이 오픈소스 모델의 상당한 트래픽을 차지합니다——OpenRouter × a16z 《State of AI》에 따르면 창작 롤플레이가 오픈소스 사용량의 절반 이상을 차지하며, 기업 보도에서는 이 절반이 거의 보이지 않습니다.
주의: 순위는 일별로 변동합니다. 게시 전 openrouter.ai/rankings에서 Top 10을 확인하세요. 6월 분석과 비교하면 Mimo V2.5가 DeepSeek Flash 일일 1위를 대체한 전환점을 읽을 수 있습니다.
다음 데이터는 기술 방안에 직접 인용할 수 있습니다(출처: OpenRouter 공식 순위 및 공개 미러, 2026-07-25 기준).
OpenRouter는 「다중 모델 통합 라우팅」을 해결하지만, 로컬 노트북 위 Agent(Hermes, Kilo Code, OpenClaw)는 절전, OS 업데이트, 프로세스 kill의 영향을 받습니다——라우팅이 똑똑해도 호스트가 오프라인이면 fallback 체인은 공회전합니다. 순수 Linux VPS에는 Apple Silicon과 macOS 툴체인이 없습니다. 7×24 온라인 코딩 Agent와 iOS CI/CD 파이프라인에는 VpsMesh Mac Mini 클라우드 렌탈이 보통 더 나은 선택입니다. 전용 노드와 감사 가능한 환경에서 계층 라우팅 전략을 진정으로 안정된 호스트에서 실행할 수 있습니다. 자세한 내용은 Mac Mini M4 렌탈 요금과 고객 센터를 참고하세요.
7월 25일 기준 샤오미 Mimo V2.5가 약 1.4조 Token/일로 1위, DeepSeek V4 Flash(9439억/일), Tencent Hy3(5900억/일)가 뒤를 잇습니다. 순위는 일별로 변동하므로 openrouter.ai/rankings 실시간 데이터를 우선하세요.
7일간 종합 데이터 기준 중국 벤더 합계 약 46% Token 점유. DeepSeek 단독이 가장 안정적(16%–18%). 6월 61% 모델 계층 비중과 통계 구분이 달라 직접 동일시하지 마세요.
아닙니다. 순위는 Token 사용량을 측정합니다. 어려운 작업에서는 Claude Sonnet 4.6/Opus 4.7이 소비 점유율 상위를 유지합니다. 내부 평가 세트를 구축하고 고객 센터에서 안정 Agent 호스트 배포도 참고하세요.
코딩은 DeepSeek V4 Flash + GLM 5.2 하이브리드 라우팅을 우선하고, 복잡 단계는 Opus 5로 전환하세요. OpenRouter는 사전 검증 샌드박스. 7×24 Agent 호스트 비용은 Mac Mini 렌탈 요금으로 계획하세요.
Kimi K3는 신규 진입 9위(157.6B/일)로 가장 급등했습니다. 1.4TB 오픈 가중치는 기록적입니다. 배경은 Kimi K3 심층 리뷰와 증류 논란 주간 브리핑을 참고하세요.