# 📒 PARKSY AI 가계부 — LLM 과금 인상 전수 백서

> **"개발자가 아닌 새끼가 AI로 6개월 버텼는데, 이제 AI 회사들이 돈을 받기 시작했다."**

**버전**: 2026-07-10 v1.0 (초판)  
**작성**: Claude Code (DeepSeek Aider) × 박태정 (EduArt Engineer)  
**선행 문서**: PARKSY-GPU-COST-WHITEPAPER-2026-07-09.md  
**트리거**: "야 왜 과금 올라간다고 하는 거냐 — 커뮤니티 리서치 해봐"

---

## 0. 한 줄 결론

> **2026년 상반기, AI 회사들은 전부 "우리 너무 싸게 팔았다"는 걸 깨달았다.**
> 지금까지는 VC 돈으로 보조금 받는 식으로 싸게 공급됐는데, 그 보조금이 사라지는 중.
> **Anthropic은 2배, DeepSeek는 피크타임 2배, OpenAI는 구독료 2배.**

---

## 1. 개요: 왜 갑자기 올리냐

2026년 상반기, AI 업계에 **세 가지 근본 변화**가 동시에 터졌다.

### 1-1. 투자자 압박
| 회사 | 마지막 펀딩 | 밸류에이션 | 조건 |
|------|------------|-----------|------|
| Anthropic | Series G $30B | **$380B** | "이제 돈 벌어라" |
| OpenAI | — | 추정 $300B+ | 프리미엄 요금제 출시 |
| DeepSeek | 중국 VC 수조 원 | 비공개 | "수익성 증명하라" |

Anthropic이 $380B 밸류에이션을 받았다는 건 **투자자들이 "너네 앞으로 이만큼 벌어야 한다"는 뜻이다.** 지금까지 AI는 전부 VC 돈으로 보조금 받는 식으로 싸게 공급됐다.

### 1-2. 컴퓨팅 파워 한계
- DeepSeek V4: 수억 개 쿼리를 $0.14/M 토큰으로 처리 중 → **서버 터져감**
- Anthropic: Claude Code 사용량 폭증 → 예상 비용 $6/일 → **실제 $13/일**
- OpenAI: GPT-5 학습비만 수십억 달러 → **고정비 회수 압박**

### 1-3. NVIDIA 칩 수급 문제
- DeepSeek는 미국 수출 규제로 H100/B200 제때 못 구함
- **자체 AI 칩 "DSpark" 개발에 수십억 위안 투입** → 이 비용을 API 요금에 전가
- 반사이익: 중국 자체 칩 생태계 성장

---

## 2. 회사별 과금 인상 내역

### 2-1. 🔴 Anthropic — 가장 공격적

#### Claude Fable: 구독제에서 제외 (2026.7.7)
**가장 충격적인 소식.** 신형 모델 **Claude Fable**을 7월 7일부터 **구독(Pro/Max)에 포함 안 시키고 pay-per-token만** 받기로 했다.

| 모델 | Input (/M tokens) | Output (/M tokens) | 구독 포함? |
|------|-------------------|-------------------|-----------|
| **Fable 5** | **$10** | **$50** | ❌ **페이퍼톡 only** |
| Opus 4.8 | $5 | $25 | ✅ |
| Opus 4.6 | $5 | $25 | ✅ |
| Sonnet 5 | $3~5 | $15~25 | ✅ |

**계산:** Fable 한 번 호출(input 1K + output 500) = $0.035. 하루 500번 = **$17.5/일** = **$525/월**. 이게 구독료에 안 포함됨.

#### Claude Code: 예상 비용 2배 인상 (2026.4.29)
**출처:** Business Insider, The Register, Futurism

> **Anthropic, Claude Code 예상 비용을 $6/일 → $13/일로 조용히 2배 올림.**

The Register (2026.4.16):  
> *"Anthropic, 엔터프라이즈 번들 토큰을 시트 딜에서 제거 — 기업들을 종량제로 밀어넣음"*

Futurism (2026.5.3):  
> *"AI로 코드 짜는 경제학이 전보다 훨씬 나빠지고 있다"*

#### Medium 칼럼: "7월 7일, 당신이 싫어할 AI의 새로운 시대"
**출처:** Michal Malewicz, Medium (2026.7.8, 좋아요 400+)

> *"LLM 파워 유저는 이제 냄비 속 개구리다. 아무도 준비되지 않았다."*
> *"월 $100 AI 구독의 실제 원가는 $4000까지 나간다. 지금까지는 보조금이었을 뿐."*

---

### 2-2. 🟡 OpenAI — 구독료 2배 + 모델별 차등

#### 요금제 개편
| 플랜 | 가격 | 특징 |
|------|------|------|
| Go | **$8/월** | 신규 저가 (기존 무료 사용자 수익화) |
| Plus | **$20/월** | 유지 |
| Pro | **$100/월** | 5배 한도 (기존 $20→$200에서 조정) |
| Pro Max | **$200/월** | 20배 한도 (신설) |

#### API 가격
| 모델 | Input | Output |
|------|-------|--------|
| GPT-5 | $10/M | $30/M |
| GPT-4.1 | $2/M | $8/M |
| GPT-4o-mini | $0.15/M | — |

#### 구조적 변화 (2026.4)
- OpenAI, **GPT-5.5 Pro 모델 도입** — Pro $100에서 5배 한도
- **무료 사용자 제한 강화** → Go $8/월 유도

---

### 2-3. 🔴 DeepSeek — "싼 게 비지떡" 증명

#### 충격: 가격 전쟁 시작한 회사가 가장 먼저 인상
**출처:** TNW (The Next Web) / SCMP (South China Morning Post) — 2026.4

> *"중국 AI 가격 전쟁을 시작한 DeepSeek가, 가장 먼저 가격을 올린 회사가 되었다."*
> *"상황의 아이러니: 싸움을 시작한 자가 먼저 역주행했다."*

#### 피크타임 할증 (Time-of-Use Pricing)
| 항목 | 내용 |
|------|------|
| 적용 모델 | **DeepSeek V4 시리즈** (V4, V4-Flash, V4-Pro) |
| 할증 폭 | **피크 시간대 2배 (×2)** |
| 적용 대상 | API 클라이언트 (웹챗 사용자 제외) |
| 발표일 | 2026년 4월 |
| 피크 시간대 | 비공개 (알고리즘으로 결정) |
| 업계 최초 | 중국 LLM API 업계 최초의 다이나믹 프라이싱 |

#### 인상 이유 3가지
1. **컴퓨팅 파워 한계 도달** — V4가 너무 잘 나가서 서버가 감당 불가
2. **NVIDIA 칩 수급 문제** — 자체 AI 칩(DSpark) 개발비 전가
3. **기존 가격 지속 불가능** — $0.14/M 토큰은 평생 갈 수 있는 가격이 아님

#### 가격 비교 (2026.7 기준)
| 모델 | Input | Output | 미국 대비 |
|------|-------|--------|----------|
| DeepSeek V4-Flash | **$0.14/M** | $0.28/M | 약 1/35 |
| DeepSeek V4-Pro | **$0.20/M** | $0.40/M | 약 1/25 |
| DeepSeek V4 (피크) | **$0.28~0.40/M** | — | ×2 적용 |
| Claude Opus 4.6 | $5/M | $25/M | 기준 |
| GPT-5 | $10/M | $30/M | 기준 |

**즉:** 피크타임 2배 돼도 미국 모델보다 12~17배 싸다. 근데 **"싼 게 비지떡"** — 서버 불안정, Rate Limit, 갑작스러운 정책 변경.

---

## 3. 박씨 가계부 — 직접 영향 분석

### 3-1. 현재 박씨 AI 사용 구조

```
Claude Code Max $20/월
  ├── 순정 Claude (Opus/Sonnet) — 가끔
  └── DeepSeek backend (--bare --model deepseek-chat) — 메인
        └── DeepSeek V4 API — 매일 수백~수천 호출
```

### 3-2. 과금 인상이 박씨에게 미치는 영향

| 경로 | 영향 | 심각도 |
|------|------|--------|
| Claude Code Max $20 | **고정 — 변동 없음** (Max 구독에 포함) | 🟢 |
| DeepSeek V4 API | **피크타임 2배** — 한국 오후~밤 = 중국 피크타임 | 🔴 |
| Claude Code 총 사용량 | **Anthropic이 추적 불가** — DeepSeek backend 우회 중 | 🟢 |
| Fable pay-per-token | **영향 없음** — Fable 안 씀 | 🟢 |
| Claude Code 기업 예상 $13/일 | **영향 없음** — 개인 Max 요금제 | 🟢 |

### 3-3. DeepSeek V4 피크타임 할증 시뮬레이션

| 시간대 | 한국 시간 | 중국 시간 | 할증 | 예상 비용 |
|--------|----------|----------|------|----------|
| 오전~오후 | 08~14시 | 07~13시 | ×1 | 기준 |
| **오후~야간 (피크)** | **14~24시** | **13~23시** | **×2** | **2배** |
| 심야 (오프피크) | 00~08시 | 23~07시 | ×1 (추정) | 기준 |

**박씨 주요 작업 시간:** 오후~야간 (14~24시) = **DeepSeek 피크타임 정확히 일치**

---

## 4. 업계 전체 트렌드

### 4-1. 중국 모델 반사이익

**CNBC (2026.7.7):**  
> *"중국 AI 모델이 미국 기업 사이에서 채택 급증. OpenRouter에서 중국 모델 비중 큰 폭 증가."*

미국 모델이 비싸지니까 DeepSeek, GLM-5.1, Qwen 등 중국 모델로 갈아타는 기업 증가 중.

### 4-2. 중국 AI 가격 전쟁 역전

**Yellow.com (2026.6):**  
> *"중국 AI는 이제 미국 모델보다 최대 30배 더 싸다"*

| 구분 | 2025 초 (전쟁 시작) | 2026 상반기 | 2026 하반기 전망 |
|------|-------------------|------------|-----------------|
| DeepSeek | 가격 파괴 (최저가) | 피크타임 2배 | 추가 인상? |
| 알리바바 Qwen | 무료~할인 | 가격 유지 | 추격 인상? |
| 바이두 ERNIE | 가격 인하 | 유지 | 관망 |
| ByteDance | 무료 | 유지 (광고 모델) | 최대 변수 |

### 4-3. "AI Tax" 시대

Medium (2026.7.6):  
> *"AI 세금(Stop Paying the AI Tax) — 품질 유지하면서 LLM 비용 줄이는 모든 기술"*

LLM 사용이 늘수록 **"AI Tax"** 라는 개념이 등장. 즉 API 호출 한 번 한 번이 세금처럼 쌓인다는 인식.

---

## 5. 전망과 대책

### 5-1. 6개월 전망

| 시기 | 예상 |
|------|------|
| 2026 Q3 | DeepSeek V4 피크타임 2배 정착 → 다른 중국 모델 추격 인상 |
| 2026 Q4 | Claude Code Max 요금 조정 가능성 (현재 $20~$100) |
| 2027 Q1 | OpenAI 추가 요금제 개편 (GPT-5 학습비 회수) |
| 2027 | 중국 모델도 수익성 압박 → 본격적인 가격 인상 |

### 5-2. 박씨 대책 매트릭스

| 방법 | 효과 | 난이도 | 추천 |
|------|------|--------|------|
| **오프피크 시간대 작업** (한국 새벽~아침) | 피크 2배 회피 | ✅ 쉬움 | ⭐⭐⭐ |
| **DeepSeek V4 → R1으로 다운그레이드** | V4는 할증 대상, R1은 아님 | ✅ 쉬움 | ⭐⭐⭐ |
| **중국 모델 이원화** (GLM-5.1/Qwen) | DeepSeek 단일 의존도 분산 | ⚠️ 보통 | ⭐⭐ |
| **Claude Code 순정 복귀** | $20/Max 고정, 과금 변동 없음 | ✅ 쉬움 | ⭐⭐ |
| **RunPod Serverless GPU 온디맨드** | 자체 추론 = API 비용 0 | 🔴 어려움 | ⭐ |
| **HQ Cell System 폐기** | 불필요한 API 호출 제거 | ✅ 쉬움 | ⭐⭐⭐ |

### 5-3. 최종 권장

> 1. **지금 당장:** 작업 시간대를 오전/새벽으로 옮겨라. DeepSeek 피크타임 2배를 피하는 게 가장 쉬운 방법이다.
> 2. **이번 주:** `--model deepseek-chat`에서 `--model deepseek-r1`로 바꿔봐라. V4는 할증 대상, R1은 아직 아니다.
> 3. **이번 달:** DeepSeek 단일 의존도에서 벗어나라. GLM-5.1, Qwen-Plus 같은 대안을 테스트해봐라.
> 4. **장기:** Claude Code Max $20 구독은 유지하라. 이건 고정비라서 천장이 정해져 있다. API 호출을 구독 안으로 최대한 우겨넣는 게 가장 안전한 전략이다.

---

## 부록: 주요 출처

| 출처 | URL | 날짜 |
|------|-----|------|
| Business Insider | `businessinsider.com/anthropic-claude-code-token-estimates-2026-4` | 2026.4.29 |
| The Register | `theregister.com/2026/04/16/anthropic-ejects-bundled-tokens` | 2026.4.16 |
| Futurism | `futurism.com/artificial-intelligence/economics-ai-churn-code` | 2026.5.3 |
| Medium (Malewicz) | `michalmalewicz.medium.com/july-7-marks-the-next-era-of-ai` | 2026.7.8 |
| TNW / SCMP | `thenextweb.com/news/deepseek-peak-hour-api-surcharge` | 2026.4 |
| CNBC | `cnbc.com/2026/07/07/chinese-ai-models-costs-us-openai-anthropic` | 2026.7.7 |
| Yellow.com | `yellow.com/ko/news/중국-ai-30배-저렴` | 2026.6 |
| Reuters | `reuters.com/anthropic-spacex-data-center-deal-2026-05-06` | 2026.5.6 |
| Hamidun News | `news.hamidun.com/en/news/11212/deepseek-double-tariff` | 2026.7.5 |
| CostGoat | `costgoat.com/compare/llm-api` | 2026.7 |
| AI Pricing Guru | `aipricing.guru/news/deepseek-verification-loop` | 2026.7.8 |
| Goldman via Futunn | `news.futunn.com/en/post/75523943/deepseek-peak-hour-goldman` | 2026.7.4 |

---

*본 백서는 Claude Code + Playwright 웹 리서치로 작성되었습니다.  
모든 가격은 발표 시점 기준이며, 실제 청구 금액은 사용 패턴에 따라 다릅니다.*

*"씨발 6개월짜리 가계부인데 벌써 3번이나 올랐어."* — 박태정, 2026-07-10