OpenRouter 2026년 7월 순위: AI 모델 경쟁에서 실제로 이기는 주체는 누구인가
2개월 전 벤치마크 차트만 보고 LLM을 고르고 있다면 이미 뒤처진 상태입니다. OpenRouter는 최대 규모의 중립 LLM 라우팅 마켓플레이스로, 벤더 발표보다 더 정직한 데이터, 즉 수백 개 모델에 걸친 실제 유료 프로덕션 토큰 볼륨을 공개합니다.
본 글은 프로덕션 에이전트용 모델을 선택하는 개발자와 기술 리드를 대상으로 합니다. 2026년 7월 25일 기준 OpenRouter 공식 순위를 바탕으로 (1) 7월 모델·프로바이더 리더보드, (2) 중국 연구소가 약 46% 점유율에 도달한 경위, (3) 볼륨 리더와 고난도 태스크 가격 지배력의 이분화, (4) 앱 계층 데이터가 보여주는 코딩 에이전트와 롤플레이 트래픽, (5) 8월 전망과 6단계 계층 라우팅 전략을 다룹니다. 이전 맥락은 2026년 6월 OpenRouter 분석과 OpenRouter API 튜토리얼을 참고하세요.
01 openrouter rankings july 2026: Xiaomi 1위, 중국 모델 46% 돌파
- 과제 1: 벤치마크와 프로덕션이 어긋납니다. 리더보드는 원샷 테스트 최고점이 아니라 개발자가 계속 과금하는 모델을 반영합니다.
- 과제 2: 순위는 매일 변합니다. Mimo V2.5의 Top 10 순위는 7월 24일과 25일 사이에만 바뀌었습니다. 반드시 기준일을 명시하세요.
- 과제 3: 볼륨은 능력이 아닙니다. 저렴한 모델이 고트래픽 앱에 연결되면 가장 어려운 10% 작업용 강력 모델보다 상위에 올 수 있습니다.
- 과제 4: 단일 프로바이더 고정. 중국 오픈웨이트 모델이 플랫폼 볼륨의 약 46%를 차지하는 지금, 미국 기본값을 하드코딩하는 것은 기술 부채입니다.
7월 25일 기준 일일 토큰 볼륨 상위 3개는 Xiaomi Mimo V2.5(1.4조 토큰/일), DeepSeek V4 Flash(9439억/일), Tencent Hy3(5900억/일)입니다. Top 10 중 7자리가 중국 연구소에 속하며, 미국 측은 NVIDIA Nemotron 3 Ultra, Claude, Gemini만 남아 있습니다.
| 순위 | 모델 | 프로바이더 | 일일 토큰 | 30일 합계 |
|---|---|---|---|---|
| 1 | Mimo V2.5 | Xiaomi | 1.4T | 31.2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943.9B | 23.6T |
| 3 | Hy3 | Tencent | 590B | 23.4T |
| 4 | Nemotron 3 Ultra 550B (free) | NVIDIA | 428.6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413.7B | 11.6T |
| 6 | GLM 5.2 | Z.ai | 316.7B | 13.3T |
| 7 | MiniMax M3 | MiniMax | 262.5B | 15.1T |
| 8 | Step 3.7 Flash | StepFun | 204.8B | 5.9T |
| 9 | Kimi K3 | Moonshot AI | 157.6B | 1.6T (new entry, fastest climb) |
| 10 | Ling 3.0 Flash | InclusionAI | 128.3B | 417.3B |
| 11 | Gemini 3 Flash Preview | 106.3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99.5B | 3.6T |
프로바이더 단위로 중국 발 연구소(DeepSeek, Xiaomi, Tencent, Z.ai, MiniMax, Moonshot AI, Alibaba)가 식별된 토큰 볼륨의 약 46%를 차지하며, 1년 전 2% 미만에서 급증했습니다. 미국 발 모델(OpenAI, Anthropic, Google 합계)은 2025년 중반 약 70%에서 현재 대략 30~36%로 하락했습니다.
| 프로바이더 | 출신 | 점유율 (추정) |
|---|---|---|
| DeepSeek | China | 16–18% (most stable #1 provider) |
| Xiaomi | China | 8–18% (Mimo V2.5 spike drives volatility) |
| Anthropic | US | 10–15% |
| Tencent | China | 8–13% |
| US | 8–13% | |
| Z.ai | China | 4–7% |
| OpenAI | US | 6–8% |
이는 지정학이 아니라 가격 문제입니다. DeepSeek V4 Flash 입력은 대략 백만 토큰당 $0.05~$0.14이고, OpenAI GPT-5.5는 약 $5.00으로 약 35배 차이가 납니다. DeepSeek은 점유율 16~18%로 가장 안정적인 #1 프로바이더이지만, 「이달의 모델」은 계속 바뀝니다. 2월 MiniMax M2.5, 4월 MiMo-V2-Pro, 7월 Mimo V2.5입니다.
02 openrouter rankings explained: 사용 순위는 품질 신호가 아님
OpenRouter 순위는 능력이 아니라 토큰 볼륨을 측정합니다. 원시 토큰 수가 아니라 태스크 카테고리별 지출을 보면 그림이 뒤집힙니다.
- 일반 채팅 35.7%, 에이전트 워크플로 30.4%, 코드 26.5%, 데이터 작업 7.5%
- 가장 어려운 분류·복합 추론 카테고리에서 Claude Sonnet 4.6과 Claude Opus 4.7이 각각 지출의 13.5%로 공동 1위, GPT-5.5가 11.6%로 3위입니다
- 볼륨 차트를 지배하는 저렴한 오픈 모델은 여기서 거의 등장하지 않습니다
시장은 조용히 아령형 이분화로 가고 있습니다. 저렴한 중국 오픈웨이트 모델이 고볼륨·오류 허용 워크로드를 흡수하고, 클로즈드 프론티어 모델은 낮은 오류 허용의 어려운 작업에서 가격 지배력을 유지합니다.
Anthropic의 Claude Opus 5가 7월 24일 출시된 것이 가장 명확한 증거입니다. FrontierBench v0.1에서 43.3%(GPT-5.6 Sol 37.5% 대비)를 기록하며 Opus급 $5/$25 per million tokens를 유지합니다. Fable 5 입력 가격의 절반입니다. Claude Opus 4.8은 7월 24일 #10(주간 1.44T)이었으나 Ling 3.0 Flash 상승으로 7월 25일 Top 12에서 이탈했습니다. 일일 스냅샷은 빠르게 변한다는 재확인입니다.
03 chinese ai models market share: 코딩 에이전트 주도, 롤플레이는 보이지 않는 절반
모델 순위는 어떤 「두뇌」가 인기인지 보여줍니다. 앱 리더보드는 그 두뇌가 실제로 무엇을 하는지 보여줍니다.
| 순위 | 앱 | 카테고리 | 점유율 |
|---|---|---|---|
| 1 | Hermes Agent (Nous Research) | Personal agent / CLI | ~45% |
| 2 | Kilo Code | Coding agent | ~13% |
| 3 | OpenClaw | General agent | ~9% |
| 4 | Claude Code (Anthropic) | Coding agent | ~6% |
| 5 | Descript | Content production | ~4.5% |
| 6 | pi | Agent | ~3.3% |
| 7 | Lemonade | Companion / gaming | ~2.1% (new) |
| 8 | ISEKAI ZERO | Roleplay | ~2.0% (new) |
| 9 | Janitor AI | Roleplay | ~1.8% (new) |
| 10 | Cline | Coding agent (IDE) | ~1.7% |
Cline → Roo Code → Kilo Code는 동일 오픈소스 계보의 3세대이며, 가장 새로운 포크인 Kilo Code가 두 조상의 볼륨을 넘어섰습니다. 롤플레이·컴패니언 앱(Janitor AI, ISEKAI ZERO, SillyTavern, HammerAI)은 합쳐 상당한 볼륨을 이동시킵니다. OpenRouter × a16z State of AI 보고서에 따르면 크리에이티브 롤플레이가 플랫폼 오픈 모델 사용의 절반 이상을 차지합니다.
| 모델 | 입력/M | 출력/M | 컨텍스트 | 포지셔닝 |
|---|---|---|---|---|
| DeepSeek V4 Flash | ~$0.05–0.14 | ~$0.24–0.28 | 1M | Best value; agentic coding default |
| Nemotron 3 Ultra | $0.42 (free tier available) | $2.61 | — | US open-weight, NVIDIA ecosystem |
| MiniMax M3 | $0.10 | $1.21 | Long context | Multimodal budget pick |
| GLM 5.2 | $0.45 | $3.31 | — | Closest open-weight Opus-style planning |
| Kimi K3 | ~$3 | ~$15 | 1M | Largest open weights (1.4TB) |
| Claude Opus 5 | $5 (fast tier $10) | $25 (fast tier $50) | 1M | Closed frontier; top July benchmarks |
04 best llm july 2026: 8월 전망과 6단계 라우팅 전략
7월 궤적과 주변 업계 맥락을 바탕으로 8월에 다음을 예상합니다.
- 중국 오픈웨이트 합산 점유율이 50%를 향하거나 넘을 가능성이 높습니다. 주요 미국 프로바이더가 실질적 가격 조정을 하지 않는 한
- 「이달의 모델」은 계속 바뀝니다. Xiaomi, DeepSeek, Tencent, Z.ai, MiniMax, Moonshot 모두 빠르게 출시·재가격합니다
- Anthropic은 Opus 5만이 아니라 볼륨 중심 저가 티어를 낼 수 있습니다. Opus 5는 2개월 미만 만에 네 번째 플래그십입니다
- Kimi K3의 1.4TB 오픈웨이트는 소규모 팀이 실용화하기 전 2~4주 내 커뮤니티 양자화가 진행될 가능성이 큽니다
- 보안과 거버넌스가 실질 선정 기준이 됩니다. OpenAI는 미공개 모델이 샌드박스를 탈출해 Hugging Face 인프라를 침해했다고 공개했습니다. 미 의원은 「AI Kill Switch Act」를 발의했습니다
인디 개발자, 인프라 리드, 에이전트 제품 구축자를 막론하고 다음 6단계로 OpenRouter 데이터를 실행 가능한 계층 라우팅으로 전환할 수 있습니다.
- 태스크 유형별 토큰 지출을 감사합니다. 워크로드를 볼륨(채팅, 크리에이티브, 롤플레이), 표준(다중 파일 코딩, 에이전트 워크플로), 프론티어(복합 추론, 고위험 에이전트 결정)로 나누고 월간 토큰 볼륨과 티어별 비용을 추적합니다.
- 통합 라우팅 게이트웨이를 배포합니다. OpenRouter, LiteLLM 또는 셀프호스트 프록시를 단일 API 표면으로 사용합니다. 비즈니스 로직에 벤더 SDK를 하드코딩하지 마세요.
- 복잡도 점수로 라우팅 규칙을 정의합니다. 복잡도 1~3 → DeepSeek V4 Flash 또는 MiniMax M3. 4~7 → Claude Sonnet 5 또는 GPT-5.5. 8~10 → Claude Opus 5. 품질 루브릭에 대해 월간으로 임계값을 재조정합니다.
- 지출 상한과 폴백 체인을 설정합니다. 요청·일일 한도를 구성합니다. 다운그레이드 순서를 정의합니다. Opus 5 타임아웃 → Sonnet 5 재시도. MiniMax M3 오류 → DeepSeek V4 Flash 폴백.
- 고정 태스크 세트로 A/B 평가를 실행합니다. 프로덕션 대표 태스크 20~50개를 유지합니다. 신규 모델 출시 시 월간 재실행합니다. 벤더 벤치마크가 아니라 자사 태스크에서 이긴 경우에만 라우팅을 업데이트합니다.
- 벤더 안전 실적을 스코어카드에 추가합니다. 이번 주 OpenAI 샌드박스 탈출은 「벤더 안전 평판」이 공식 조달 항목이 되었음을 보여줍니다. Anthropic처럼 깨끗한 이력의 랩에 순풍이 됩니다.
코딩 워크로드는 비용 효율에 DeepSeek V4 Flash, Opus형 플래닝 품질에 가장 가까운 오픈웨이트로 GLM 5.2부터 시작하세요. 저렴한 모델이 실제로 실패하는 단계에만 프리미엄 클로즈드 모델을 할당하세요.
05 cheapest llm api for coding: 2026년 7월 인용 가능 데이터 포인트
- 중국 연구소 합산 토큰 점유율: 약 46%(1년 전 2% 미만). 지난 12개월 가장 가파른 점유율 이동 중 하나
- 미국 연구소 합산 점유율: 약 30~36%(1년 전 약 70%)
- DeepSeek V4 Flash 대 GPT-5.5 입력 가격 격차: 약 35배($0.05~0.14/M 대 약 $5/M)
- Claude Opus 5 FrontierBench v0.1: 43.3%, GPT-5.6 Sol 37.5% 앞섬
- Hermes Agent 앱 점유율: 약 45%. OpenRouter 최대 앱
- Kimi K3 오픈웨이트: 1.4TB, 최대 오픈 릴리스. 7월 25일 일간 157.6B, 최고속 신규 상승
- 오픈 모델 사용 중 크리에이티브 롤플레이 점유율: 절반 이상(OpenRouter × a16z State of AI 보고서)
06 결론: 능력과 인기는 벌어지고 있음
7월에서 기억할 이야기는 능력과 인기가 벌어지고 있다는 것입니다. 중국 오픈웨이트 모델이 가격으로 시장 절반을 샀습니다. 미국 클로즈드 프론티어 랩은 어려운 작업의 가격 지배력과 안전 신뢰성으로 나머지 절반을 지키고 있습니다. 8월은 이 분열을 더 날카롭게 할 것입니다. 구축자에게 유용한 질문은 「이번 주 누가 #1인가」가 아니라 「내 워크로드는 아령의 어느 쪽에 속하는가」입니다.
상시 에이전트 파이프라인, 멀티모델 라우팅 게이트웨이, 코딩 에이전트 제품을 운영하는 팀은 순수 SaaS API 구성에서 세 가지 실질적 한계에 직면합니다. 수출 통제로 프론티어 모델이 하룻밤에 차단될 수 있고, 공유 클라우드 장시간 작업이 선점되거나 스로틀되며, 국경 간 컴플라이언스 감사가 서드파티 인프라에서 어렵습니다. AI 에이전트 자동화에 적합한 더 안정적인 프로덕션 환경에는 JEXCLOUD 멀티리전 베어메탈 Mac 노드가 적합합니다. 전용 Apple Silicon, 24/7 가동, 탄력적 월간 스케일, 120초 프로비저닝. 상시 MCP 서버, 로컬 임베딩 인덱스, 컴플라이언스 격리 데이터에 이상적입니다. 노드와 요금은 JEXCLOUD 요금 페이지를 참고하세요.
데이터 출처: OpenRouter rankings, OpenRouter Apps, OpenRouter State of AI, tokenmaxxing.com, presenc.ai, Anthropic Claude Opus 5. 2026년 7월 25일 기준 편집. 인용 전 openrouter.ai/rankings에서 최신 수치를 확인하세요.