Plafonul general saptamanal Max 5x se consuma in ~2 zile, urmate de ~5 zile blocate. Masurat pe 3 masini (Windows, claude-agent, moltbot), 2026-07-29 -> 2026-09-01: 11,15 miliarde tokeni, 435 sesiuni, 64.211 cereri API, dedup pe message.id + requestId. Deficit +32% (~570 prompturi/saptamana). Concluzia nu e cea asteptata: bugetele plafonate in dolari (OpenCode Zen $20, OpenCode Go) se evapora la acest volum -- Go a tinut 1-2 zile in practica. Planurile Z.AI se contorizeaza in prompturi, nu in dolari, si rezista la un workload cu 7,1 cereri API per prompt. Z.AI Coding Lite ($18/luna) acopera 70% din deficit; Pro ($72) il acopera integral. Verificat empiric ca subagentii nu pot rula pe GLM (in proces, moștenesc auth), dar sesiunile separate pot: endpoint fals local a primit cererea cu tokenul alternativ, fara sa atinga OAuth-ul Max. Masurat: ~186MB RSS si 20-60s pornire per sesiune -- de aici regulile de orchestrare (sarcini mari, max 4 procese, fan-out in interiorul unei sesiuni GLM). Ramane neverificat multiplicatorul de credite pentru GLM-5.3-Flash; la 3x in loc de 1x, Lite pica si decizia se muta pe Pro. - docs/supliment-glm-zai.md: rezumat de implementare (indexat in CLAUDE.md) - claude_usage_report.md + CSV-uri: analiza completa si datele brute - tools/claude_usage_*.py: pipeline de masurare read-only, re-rulabil remote - tools/claude-glm.sh: wrapper de sesiune GLM (task/resume/shell) Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com> Claude-Session: https://claude.ai/code/session_01Q4uzvgm7AyJch5WH8QHRhY
30 KiB
Analiză consum Claude Code — Claude Max 5x vs. OpenCode Zen (GLM-5.3)
Generat: 2026-09-01 · Perioadă: 2026-07-29 → 2026-09-01 (35 zile) · 3 mașini · 435 sesiuni · 11.15 miliarde tokeni
0. Ce a fost scanat
| Mașină | Locație | Fișiere | Înregistrări | Duplicate | Sesiuni | Prima zi | Ultima zi | Zile active |
|---|---|---|---|---|---|---|---|---|
claude-agent |
~/.claude/projects (Linux, LXC 171) |
70 | 3,973 | 1,857 | 60 | 2026-08-17 | 2026-09-01 | 5 |
moltbot |
/home/moltbot/.claude/projects (Linux, LXC 110) |
163 | 3,423 | 1,613 | 157 | 2026-08-02 | 2026-09-01 | 31 |
LENOVO-AIO-BIRO |
C:\Users\<user>\.claude\projects (Windows) |
859 | 111,127 | 50,764 | 218 | 2026-07-29 | 2026-09-01 | 29 |
Windows a fost extras de o sesiune Claude Code rulată manual pe acea mașină, cu exact același script și aceeași cheie de deduplicare — altfel cifrele nu s-ar putea aduna. Datele au trecut printr-un pas de tabel (separator TAB, date în format M/D/YYYY); au fost renormalizate la ISO, iar toate cele 218 UUID-uri de sesiune au fost validate. Ceasul din zi s-a pierdut la conversie, dar granularitatea folosită în raport e ziua.
Corecție de premisă
Sesiunea care a condus analiza nu rulează pe Windows — rulează pe LXC 171 claude-agent (Linux claude-agent 6.8.12-15-pve). Windows a fost acoperit separat, prin sesiunea deschisă acolo.
Surse de token usage și care e autoritativă
| Sursă | Conține | Verdict |
|---|---|---|
~/.claude/projects/**/*.jsonl, câmpul message.usage din înregistrările assistant |
input_tokens, output_tokens, cache_creation_input_tokens, cache_read_input_tokens, thinking_tokens, model, requestId |
AUTORITATIVĂ — valori raportate de API |
~/.claude/stats-cache.json |
mesaje/sesiuni/tool-calls pe zi, din 2025-12-31 | secundară — zero tokeni; dovadă că istoricul e mai lung decât transcripturile |
~/.claude/history.jsonl |
6.400 de prompturi, din 2025-12-31 | secundară — fără tokeni |
Lungimea transcriptului nu a fost folosită ca proxy pentru tokeni nicăieri.
1. Perioada
- Început: 2026-07-29
- Sfârșit: 2026-09-01
- Zile calendaristice: 35
- Zile cu activitate: 34
- Zile lipsă: 2026-07-31
Acoperirea e inegală: Windows și moltbot acoperă luna întreagă, dar claude-agent are doar 5 zile cu transcripturi păstrate (retenția implicită de 30 de zile plus o recreare a directorului pe 2026-08-30). stats-cache.json arată activitate continuă din 2025-12-31. Consumul istoric real e mai mare decât cel de aici; nu am extrapolat nimic — toate cifrele sunt tokeni observați efectiv.
2. Deduplicare
Cheie: message.id + requestId. Aceeași cerere API reapare în mai multe fișiere după --resume, fork de sesiune sau compactare.
- Înregistrări
assistantcuusageîntâlnite: 118,523 - Duplicate eliminate: 54,234 (45.8%)
- Cereri API unice numărate: 64,289
- Sesiuni prezente pe mai multe mașini: 0 (verificat pe toate cele trei perechi)
- Linii malformate: 0
3. Total
| Metrică | Valoare |
|---|---|
| Sesiuni | 435 |
| Turn-uri asistent (cereri API) | 64,211 |
| Input tokens (necache) | 338,907 |
| Output tokens | 23,297,506 |
| Cache creation (write) | 288,224,316 |
| Cache read | 10,836,625,270 |
| TOTAL | 11,148,485,999 |
Cache read = 97.2% din volum. Output-ul real e doar 0.21%. Asta e semnătura unui workload agentic: contextul se retrimite la fiecare turn, iar tarifarea cache-ului decide costul.
Medii: 25,628,703 tokeni/sesiune (148 turn-uri) · 318,528,171 tokeni/zi · 12.4 sesiuni/zi.
Breakdown pe calculator
| Mașină | Sesiuni | Turn-uri | Input | Output | Cache write | Cache read | Total | % |
|---|---|---|---|---|---|---|---|---|
| LENOVO-AIO-BIRO | 218 | 60,304 | 330,668 | 20,939,475 | 269,887,835 | 10,356,404,686 | 10,647,562,664 | 95.5% |
| claude-agent | 60 | 2,114 | 4,418 | 1,543,956 | 6,731,712 | 297,811,719 | 306,091,805 | 2.7% |
| moltbot | 157 | 1,793 | 3,821 | 814,075 | 11,604,769 | 182,408,865 | 194,831,530 | 1.7% |
Breakdown pe model
| Model | Sesiuni | Turn-uri | Input | Output | Cache write | Cache read | Total | % |
|---|---|---|---|---|---|---|---|---|
| claude-sonnet-5 | 37,902 | 261,427 | 3,475,072 | 198,256,274 | 6,508,379,975 | 6,710,372,748 | 60.2% | |
| claude-opus-5 | 25,343 | 75,166 | 19,607,975 | 85,344,425 | 4,168,532,752 | 4,273,560,318 | 38.3% | |
| claude-fable-5 | 941 | 2,106 | 208,768 | 4,533,984 | 158,857,102 | 163,601,960 | 1.5% | |
| claude-haiku-4-5-20251001 | 25 | 208 | 5,691 | 89,633 | 855,441 | 950,973 | 0.0% |
Breakdown pe lună
| Lună | Sesiuni | Turn-uri | Input | Output | Cache write | Cache read | Total | % |
|---|---|---|---|---|---|---|---|---|
| 2026-07 | 845 | 6,527 | 330,630 | 7,941,767 | 184,927,510 | 193,206,434 | 1.7% | |
| 2026-08 | 62,519 | 330,686 | 22,755,166 | 277,847,883 | 10,515,360,962 | 10,816,294,697 | 97.0% | |
| 2026-09 | 847 | 1,694 | 211,710 | 2,434,666 | 136,336,798 | 138,984,868 | 1.2% |
Breakdown pe zi
| Zi | Sesiuni | Turn-uri | Input | Output | Cache write | Cache read | Total | % |
|---|---|---|---|---|---|---|---|---|
| 2026-07-29 | 214 | 3,434 | 76,615 | 1,093,695 | 20,587,396 | 21,761,140 | 0.2% | |
| 2026-07-30 | 631 | 3,093 | 254,015 | 6,848,072 | 164,340,114 | 171,445,294 | 1.5% | |
| 2026-08-01 | 1,243 | 8,856 | 560,845 | 5,561,396 | 250,296,311 | 256,427,408 | 2.3% | |
| 2026-08-02 | 2,095 | 5,496 | 1,344,277 | 6,977,342 | 339,262,565 | 347,589,680 | 3.1% | |
| 2026-08-03 | 3,225 | 23,466 | 1,228,967 | 19,167,120 | 536,296,804 | 556,716,357 | 5.0% | |
| 2026-08-04 | 323 | 13,015 | 142,150 | 1,971,068 | 39,101,333 | 41,227,566 | 0.4% | |
| 2026-08-05 | 657 | 1,787 | 286,446 | 4,672,434 | 91,066,167 | 96,026,834 | 0.9% | |
| 2026-08-06 | 3,064 | 28,381 | 1,125,446 | 14,847,361 | 493,347,883 | 509,349,071 | 4.6% | |
| 2026-08-07 | 2,068 | 4,963 | 676,244 | 17,444,157 | 413,402,684 | 431,528,048 | 3.9% | |
| 2026-08-08 | 4,255 | 47,237 | 1,331,620 | 20,159,731 | 830,971,552 | 852,510,140 | 7.6% | |
| 2026-08-09 | 5,283 | 64,396 | 1,373,409 | 22,876,001 | 886,709,264 | 911,023,070 | 8.2% | |
| 2026-08-10 | 3,984 | 53,819 | 1,283,159 | 18,754,319 | 634,612,620 | 654,703,917 | 5.9% | |
| 2026-08-11 | 1,562 | 9,071 | 698,861 | 6,558,893 | 221,468,597 | 228,735,422 | 2.1% | |
| 2026-08-12 | 250 | 653 | 142,318 | 1,672,205 | 37,721,945 | 39,537,121 | 0.4% | |
| 2026-08-13 | 84 | 166 | 27,185 | 334,918 | 8,022,052 | 8,384,321 | 0.1% | |
| 2026-08-14 | 19 | 38 | 2,401 | 214,217 | 782,061 | 998,717 | 0.0% | |
| 2026-08-15 | 18 | 36 | 2,434 | 213,650 | 728,993 | 945,113 | 0.0% | |
| 2026-08-16 | 18 | 36 | 2,815 | 212,322 | 726,847 | 942,020 | 0.0% | |
| 2026-08-17 | 39 | 78 | 9,934 | 310,995 | 2,021,166 | 2,342,173 | 0.0% | |
| 2026-08-18 | 285 | 568 | 181,938 | 1,228,874 | 40,742,116 | 42,153,496 | 0.4% | |
| 2026-08-19 | 870 | 1,740 | 523,899 | 2,930,364 | 142,095,433 | 145,551,436 | 1.3% | |
| 2026-08-20 | 2,131 | 4,320 | 838,986 | 8,335,140 | 329,763,669 | 338,942,115 | 3.0% | |
| 2026-08-21 | 3,374 | 6,952 | 938,769 | 11,353,197 | 678,083,464 | 690,382,382 | 6.2% | |
| 2026-08-22 | 4,219 | 8,438 | 1,367,817 | 18,528,526 | 793,556,645 | 813,461,426 | 7.3% | |
| 2026-08-23 | 4,780 | 9,560 | 1,667,111 | 16,953,670 | 881,927,242 | 900,557,583 | 8.1% | |
| 2026-08-24 | 1,004 | 2,008 | 449,421 | 4,405,346 | 169,736,444 | 174,593,219 | 1.6% | |
| 2026-08-25 | 1,291 | 2,582 | 993,949 | 4,814,837 | 224,746,691 | 230,558,059 | 2.1% | |
| 2026-08-26 | 58 | 116 | 24,692 | 311,333 | 3,235,406 | 3,571,547 | 0.0% | |
| 2026-08-27 | 2,553 | 5,106 | 857,461 | 11,835,008 | 454,391,610 | 467,089,185 | 4.2% | |
| 2026-08-28 | 2,850 | 5,700 | 1,229,085 | 13,010,965 | 392,932,032 | 407,177,782 | 3.7% | |
| 2026-08-29 | 3,473 | 6,946 | 970,773 | 12,843,362 | 447,480,189 | 461,301,270 | 4.1% | |
| 2026-08-30 | 2,462 | 4,924 | 885,887 | 10,238,581 | 324,734,530 | 335,863,922 | 3.0% | |
| 2026-08-31 | 4,982 | 10,232 | 1,586,867 | 19,110,551 | 845,396,647 | 866,104,297 | 7.8% | |
| 2026-09-01 | 847 | 1,694 | 211,710 | 2,434,666 | 136,336,798 | 138,984,868 | 1.2% |
4. Prețuri — verificate 2026-09-01
Pagina oficială OpenCode Zen (opencode.ai/docs/zen) nu listează încă GLM-5.3 sau GLM-5.3-Flash. Cele mai noi GLM de acolo:
| Model pe Zen | Input | Output | Cache read | Cache write |
|---|---|---|---|---|
| GLM 5.2 | $1.40 | $4.40 | $0.26 | — |
| GLM 5.1 | $1.40 | $4.40 | $0.26 | — |
| GLM 5 | $1.00 | $3.20 | $0.20 | — |
| Claude Opus 5 | $5.00 | $25.00 | $0.50 | $6.25 |
| Claude Sonnet 5 | $2.00 | $10.00 | $0.20 | $2.50 |
| Claude Fable 5 | $10.00 | $50.00 | $1.00 | $12.50 |
| Claude Haiku 4.5 | $1.00 | $5.00 | $0.10 | $1.25 |
Pentru GLM-5.3 am folosit prețurile oficiale Z.AI (furnizorul modelului). Zen revinde de regulă la același tarif — GLM 5.2 pe Zen e identic cu tariful Z.AI, ceea ce validează proxy-ul.
| Model | Input | Cache read | Cache write | Output |
|---|---|---|---|---|
| GLM-5.3 | $1.40 | $0.26 | fără tarif separat | $4.40 |
| GLM-5.3-Flash (promo, până 2026-09-09 24:00 UTC+8) | $0.075 | $0.015 | fără tarif separat | $0.25 |
| GLM-5.3-Flash (preț de listă) | $0.15 | $0.03 | fără tarif separat | $0.50 |
Surse: opencode.ai/docs/zen · docs.z.ai/guides/overview/pricing · openrouter.ai/z-ai/glm-5.3-flash
Cache write: niciun model GLM nu are tarif separat de cache creation (spre deosebire de modelele Claude de pe Zen).
cache_creation_input_tokensse facturează deci la tariful de input normal.cache_read_input_tokensnu a fost tratat ca input normal — are tariful lui redus. Vezi Scenariul B pentru varianta fără cache.
5. Cost echivalent Zen — Scenariul A (tokeni reali, tarife de cache)
| Model | Input | Cache read | Cache write | Output | TOTAL |
|---|---|---|---|---|---|
| GLM-5.3 | $0.47 | $2817.52 | $403.51 | $102.51 | $3324.02 |
| GLM-5.3-Flash (promo) | $0.03 | $162.55 | $21.62 | $5.82 | $190.02 |
| GLM-5.3-Flash (listă) | $0.05 | $325.10 | $43.23 | $11.65 | $380.03 |
Medii
| Model | / sesiune | / zi | / lună (30 zile) |
|---|---|---|---|
| GLM-5.3 | $7.641 | $94.97 | $2849.16 |
| GLM-5.3-Flash (promo) | $0.437 | $5.43 | $162.87 |
| GLM-5.3-Flash (listă) | $0.874 | $10.86 | $325.74 |
6. Scenariul B — fără avantajul cache-ului
Tot cache_read + cache_creation facturați ca input normal.
| Model | A (cu cache) | B (fără cache) | Factor |
|---|---|---|---|
| GLM-5.3 | $3324.02 | $15677.77 | 4.7× |
| GLM-5.3-Flash (promo) | $190.02 | $840.21 | 4.4× |
| GLM-5.3-Flash (listă) | $380.03 | $1680.43 | 4.4× |
7. Comparație cu Claude Max 5x
Nu există conversie oficială Anthropic din quota Max în tokeni, deci nu o inventez. Compar ce ai plătit cu ce ar fi costat exact aceiași tokeni la tarif per-token.
| Claude Max 5x | Zen GLM-5.3 | Zen GLM-5.3-Flash (promo) | Zen GLM-5.3-Flash (listă) | |
|---|---|---|---|---|
| Cost pentru perioada măsurată | $100/lună | $3,324.02 | $190.02 | $380.03 |
| Tokeni | 11,148,485,999 | identic | identic | identic |
| Sesiuni | 435 | identic | identic | identic |
| Modele | Opus 5, Sonnet 5, Fable 5, Haiku 4.5 | GLM-5.3 | GLM-5.3-Flash | GLM-5.3-Flash |
Cât valorează de fapt abonamentul Max
Aceiași 11,148,485,999 tokeni, fiecare model la propriul lui tarif pe Zen (Opus 5 la preț de Opus 5, Sonnet 5 la preț de Sonnet 5 etc.):
$5,167.05
Abonamentul Max 5x de $100 a livrat consum care la tarif per-token ar fi costat $5,167 — adică Max e de 52× mai ieftin decât plata la token pentru exact aceleași modele. Asta e cifra cea mai importantă din tot raportul.
Acoperirea celor $20 Zen
| Model | Cost pentru consumul observat | % din $20 | De câte ori acoperă $20 consumul |
|---|---|---|---|
| GLM-5.3 | $3,324.02 | 16,620% | 0.006× |
| GLM-5.3-Flash (promo) | $190.02 | 950% | 0.105× |
| GLM-5.3-Flash (listă) | $380.03 | 1,900% | 0.053× |
Scenariul B, fără cache:
| Model | Cost | % din $20 | Acoperire |
|---|---|---|---|
| GLM-5.3 | $15,677.77 | 78,389% | 0.001× |
| GLM-5.3-Flash (promo) | $840.21 | 4,201% | 0.024× |
| GLM-5.3-Flash (listă) | $1,680.43 | 8,402% | 0.012× |
Cât consum încap în $20
| Model | Tokeni pentru $20 | % din consumul lunar | Zile la ritmul actual | Sesiuni |
|---|---|---|---|---|
| GLM-5.3 | 67,078,331 | 0.6% | 0.21 | 2.6 |
| GLM-5.3-Flash (promo) | 1,173,426,044 | 10.5% | 3.68 | 45.8 |
| GLM-5.3-Flash (listă) | 586,713,022 | 5.3% | 1.84 | 22.9 |
8. Abonamentele Z.AI GLM Coding Plan
Planurile Z.AI nu se facturează pe tokeni, ci pe prompturi (turnuri umane) contorizate în credite, cu două limite simultane: una la 5 ore și una săptămânală. Documentația Z.AI notează că „un prompt poate invoca modelul de 15–20 de ori" — deci comparația corectă nu se face pe cererile API, ci pe prompturile tale reale.
Prețuri (verificate 2026-09-01)
| Plan | Lunar | Anual | Efectiv/lună anual | Economie | Prompturi / 5h | Prompturi / săpt. | Credite / săpt. |
|---|---|---|---|---|---|---|---|
| Lite | $18.00 | $151.20 | $12.60 | 30% | ~80 | ~400 | 10.000 |
| Pro | $72.00 | $604.80 | $50.40 | 30% | ~400 | ~2.000 | 60.000 |
| Max | $160.00 | $1.344,00 | $112.00 | 30% | ~1.600 | ~8.000 | 140.000 |
Toate planurile includ GLM-5.3 și GLM-5.3-Flash. Surse: docs.z.ai/devpack/overview · aipricing.guru
Câte prompturi dai de fapt
Am numărat prompturile umane reale (excluzând tool_result, care în transcript apar tot ca mesaje de tip user):
| Mașină | Prompturi umane | Cereri API | Cereri / prompt |
|---|---|---|---|
claude-agent |
245 | 2.143 | 8,75 |
moltbot |
309 | 1.810 | 5,86 |
LENOVO-AIO-BIRO |
~8,451 (estimat) | 60,304 | 7.14 (aplicat) |
| TOTAL | ~9,005 | 64,211 | 7.14 |
Estimare marcată: scriptul rulat pe Windows a raportat doar cererile API, nu și prompturile umane. Cifra pentru Windows e derivată din raportul măsurat pe cele două mașini Linux (7.14 cereri API per prompt). E singura extrapolare din tot raportul și e marcată ca atare. Raportul real pe Windows poate diferi — sesiunile de acolo par mai lungi, deci numărul de prompturi ar putea fi mai mic (și acoperirea planurilor, mai bună).
Ritm rezultat: ~1,801 prompturi/săptămână (~257/zi) pe 35 zile.
Acoperire — la multiplicator 1×
| Plan | Anual | Efectiv/lună | Prompturi/săpt. | Acoperă din nevoia ta | Verdict |
|---|---|---|---|---|---|
| Lite | $151.20 | $12.60 | ~400 | 22% | insuficient |
| Pro | $604.80 | $50.40 | ~2,000 | 111% | ACOPERĂ |
| Max | $1,344.00 | $112.00 | ~8,000 | 444% | ACOPERĂ |
Acoperire — dacă GLM-5.3 consumă credite multiplicat
Z.AI aplică multiplicatori de credite modelelor mari (documentat 3× în orele de vârf și 2× off-peak pentru GLM-5.2 / GLM-5-Turbo; pentru GLM-5.3 multiplicatorul nu e publicat explicit). Dacă GLM-5.3 se contorizează la fel, acoperirea scade proporțional:
| Plan | 1× (Flash / off-peak promo) | 2× (off-peak) | 3× (peak) |
|---|---|---|---|
| Lite | 22% | 11% | 7% |
| Pro | 111% | 56% | 37% |
| Max | 444% | 222% | 148% |
Comparație completă a opțiunilor
| Opțiune | Cost efectiv/lună | Acoperă volumul tău? | Observație |
|---|---|---|---|
| Claude Max 5x (actual) | $100.00 | DA, 100% | modelele Claude; $5,167 valoare la tarif per-token |
| OpenCode Zen, GLM-5.3-Flash | $190.02 (pay-per-token) | da, dar costă 1.9× cât Max | fără plafon, dar fără reducere de abonament |
| OpenCode Zen, GLM-5.3 | $3,324.02 (pay-per-token) | da, dar costă 33× cât Max | prohibitiv |
| OpenCode Zen $20 (buget fix) | $20.00 | NU — 10,5% | vezi secțiunea 7 |
| Z.AI Coding Lite anual | $12.60 | NU — 22% la 1× | cel mai ieftin plan cu GLM-5.3 |
| Z.AI Coding Pro anual | $50.40 | DA la 1× (111%), nu la 2–3× | cel mai bun raport dacă multiplicatorul e 1× |
| Z.AI Coding Max anual | $112.00 | DA, cu marjă (444% la 1×, 148% la 3×) | singurul sigur indiferent de multiplicator |
Ce înseamnă asta concret
Z.AI Coding Pro anual ($604,80/an = $50,40/lună) e de departe cea mai interesantă opțiune din tot setul — la ritmul tău de ~1,801 prompturi/săptămână, cota lui de ~2.000/săptămână acoperă 111% din volum, la jumătate din prețul Max 5x.
Dar cu trei rezerve serioase:
- Marja e subțire. 111% nu e mult peste 100%. O săptămână mai aglomerată decât media te scoate din cotă, și atunci aștepți resetarea.
- Multiplicatorul de credite e necunoscut pentru GLM-5.3. Dacă e 2× sau 3× ca la GLM-5.2, Pro acoperă doar 56%–37% și ai nevoie de Max ($112/lună).
- Limita de 5 ore contează separat. Media ta zilnică încape în cota de 5h a planului Pro (~400), dar zilele de vârf pot să nu încapă. Cotele sunt simultane: săptămânală ȘI la 5 ore.
Diferența de calitate rămâne argumentul decisiv. Un plan Z.AI îți dă GLM-5.3, nu Opus 5. La tine 38% din volum rulează deja pe Opus 5 — muncă unde ai ales conștient modelul mare.
9. Scenariul real: Opus planifică, GLM-5.3-Flash execută
Fluxul vizat înlocuiește doar treapta de execuție (azi Sonnet 5) cu GLM-5.3-Flash, păstrând Opus 5 pe Max pentru planificare. Asta nu e o felie arbitrară din volum — e exact împărțirea care se vede deja în date.
| Treaptă | Model azi | Tokeni/lună | % volum | Turn-uri | Prompturi/săpt. (est.) |
|---|---|---|---|---|---|
| Planificare | Opus 5 | 4.27B | 38.3% | 25,343 | ~711 |
| Execuție | Sonnet 5 | 6.71B | 60.2% | 37,902 | ~1,063 |
| Alte | Fable 5 + Haiku | 165M | 1.5% | 966 | ~27 |
Cât costă mutarea treptei de execuție
| Variantă | Cost/lună | Observație |
|---|---|---|
| Zen pay-per-token, Flash promo | $113.38 | tarif promoțional, expiră 2026-09-09 |
| Zen pay-per-token, Flash listă | $226.77 | tariful de după |
| Z.AI Coding Lite anual | $12.60 | cotă ~400 prompturi/săpt. = 38% din nevoie |
| Z.AI Coding Pro anual | $50.40 | cotă ~2.000/săpt. = 188% din nevoie |
| Z.AI Coding Max anual | $112.00 | cotă ~8.000/săpt. = 752% |
Treapta de execuție are nevoie de ~1,063 prompturi/săptămână. Lite nu ajunge (38%). Pro ajunge cu marjă de 1.9× — și, spre deosebire de comparația pe volumul total, aici marja e confortabilă.
Detaliu în favoarea ta: multiplicatorul de credite Z.AI (3× peak / 2× off-peak) e documentat pentru modelele mari, nu pentru cele „de rutină". GLM-5.3-Flash e modelul mic, deci probabil se contorizează la 1×. Dacă e așa, Pro acoperă treapta de execuție cu 188% și rămâne loc de creștere. Confirmă asta înainte să plătești anual.
Calibrare cu OpenCode Go — datele tale reale
OpenCode Go costă $10/lună și include limite exprimate în valoare de consum, nu în tokeni:
| Limită | Valoare |
|---|---|
| La 5 ore | $12 de consum |
| Săptămânal | $30 de consum |
| Lunar | $60 de consum |
Abonamentul s-a consumat în 1–2 zile. Asta confirmă independent analiza: la volumul tău, consumul săptămânal echivalent e $38 pe GLM-5.3-Flash promo și $665 pe GLM-5.3 — deci plafonul săptămânal de $30 al lui Go se evaporă în 0.3 zile pe modelul mare și în 5.5 zile pe Flash. Un plan plafonat în dolari nu rezistă la acest volum, indiferent de furnizor.
De asta planurile Z.AI sunt altceva: cota lor e în prompturi, nu în dolari de consum. Un prompt care declanșează 20 de invocări de model costă la fel ca unul care declanșează 2 — iar sesiunile tale au în medie 7.1 cereri API per prompt. Exact tipul de workload pe care tarifarea per-prompt îl avantajează, și pe care cea per-dolar îl penalizează.
10. Problema reală: plafonul general săptămânal Max 5x
Max 5x are două plafoane săptămânale — unul general, pe toate modelele, și unul separat pentru Opus. Limita atinsă e cea generală, ceea ce înseamnă că un supliment pe GLM-5.3-Flash chiar poate ajuta: fiecare prompt mutat în altă parte eliberează cotă de Max.
Tiparul se vede în date
| Săptămână | Total | Profil zilnic (M tokeni, Lu→Du) |
|---|---|---|
| 2026-W31 | 0.80B | We 22 · Th 171 · Sa 256 · Su 348 |
| 2026-W32 | 3.40B | Mo 557 · Tu 41 · We 96 · Th 509 · Fr 432 · Sa 853 · Su 911 |
| 2026-W33 | 0.93B | Mo 655 · Tu 229 · We 40 · Th 8 · Fr 1 · Sa 1 · Su 1 |
| 2026-W34 | 2.93B | Mo 2 · Tu 42 · We 146 · Th 339 · Fr 690 · Sa 813 · Su 901 |
| 2026-W35 | 2.08B | Mo 175 · Tu 231 · We 4 · Th 467 · Fr 407 · Sa 461 · Su 336 |
| 2026-W36 | 1.01B | Mo 866 · Tu 139 |
Săptămâna W33 e semnătura manualului pentru un plafon atins: 655M luni, 229M marți, apoi 40M, 8M, 1M, 1M, 1M. Cota s-a consumat în două zile, urmate de cinci zile moarte. Exact ce descrii. Prin contrast, W32 și W34 au mers 7 zile din 7, la 2,93–3,40B.
- Zile efectiv blocate (sub 50M tokeni): 10 din 34 = 29%
- Zi activă mediană: 419M tokeni
- Livrat efectiv de Max 5x: 2.23B/săptămână
- Cerere dacă ai lucra 7 zile din 7 la ritmul median: 2.94B/săptămână
- Deficit: 0.71B/săptămână = +32% ≈ ~570 prompturi/săptămână
Deficitul e o estimare conservatoare: presupune că în zilele blocate ai lucra la ritm median (419M), nu la ritmul zilelor bune (peste 850M). Cererea reală suprimată e probabil mai mare. Nu se poate măsura direct — Claude Code nu persistă evenimentele de limită în transcript, apar doar în stream-ul SDK.
Ce plan acoperă deficitul
Nu trebuie mutat tot volumul — doar atât cât să elibereze cota lipsă.
| Plan | Lunar | Anual (efectiv/lună) | Cotă/săpt. | Acoperă deficitul de ~570 | Zile blocate rămase |
|---|---|---|---|---|---|
| Lite | $18.00 | $12.60 | ~400 | 70% | ~0.6/săpt. |
| Pro | $72.00 | $50.40 | ~2,000 | 351% | ~0.0/săpt. |
| Max | $160.00 | $112.00 | ~8,000 | 1403% | ~0.0/săpt. |
Azi ai ~2.0 zile blocate pe săptămână. Lite ar duce-o la ~0.6, Pro la zero, cu marjă de 3.5× pentru creștere.
Verificare din a doua direcție
Dacă muți toată treapta de execuție (Sonnet 5, 59% din turn-uri, ~1,063 prompturi/săpt.) pe GLM-5.3-Flash, eliberezi 59% din cota Max — care ar ține atunci de 2.4× mai mult, adică toată săptămâna în loc de două zile.
Pentru asta ai nevoie de ~1,063 prompturi/săpt.: Lite (38%) nu ajunge, Pro (188%) ajunge cu marjă.
Cele două calcule dau răspunsuri diferite pentru Lite pentru că măsoară lucruri diferite: primul, cât lipsește ca să nu mai fii blocat; al doilea, cât ar costa mutarea completă a treptei de execuție. Nu ai nevoie de mutarea completă — ai nevoie doar de deficit.
11. Fișiere generate
| Fișier | Conținut |
|---|---|
claude_usage_report.md |
acest raport |
claude_usage_sessions.csv |
435 rânduri, una per sesiune |
claude_usage_summary.csv |
agregate: TOTAL, mașină, model, lună, zi |
tools/claude_usage_extract.py |
extractorul read-only (rulabil remote: ssh host 'python3 -' < script) |
tools/claude_usage_report.py |
agregator + CSV |
tools/claude_usage_md.py |
generatorul acestui raport |
12. CONCLUZIE
„Dacă păstrez Claude Max 5x $100 și adaug OpenCode Zen $20, cât coding suplimentar obțin?"
Foarte puțin — aproximativ 3.7 zile pe lună, în cel mai bun caz.
Consumul real pe 35 zile, pe trei mașini: 11.15 miliarde de tokeni, 435 sesiuni, 64,211 cereri API. La acest volum, $20 nu sunt un supliment — sunt o rotunjire.
| GLM-5.3 | GLM-5.3-Flash (promo) | GLM-5.3-Flash (listă) | |
|---|---|---|---|
| Cost pentru volumul tău lunar | $3,324 | $190 | $380 |
| Cât din el acoperă $20 | 0.6% | 10.5% | 5.3% |
| Zile de lucru din $20 | 0.21 | 3.7 | 1.8 |
Punct cu punct
1. Ar fi fost $20 Zen suficienți pentru consumul observat?
NU, pe niciun model.
- GLM-5.3-Flash (promo): $190.02 — de 9.5× peste buget. Cel mai bun caz posibil.
- GLM-5.3-Flash (listă, după 9 sept.): $380.03 — de 19× peste buget.
- GLM-5.3: $3,324.02 — de 166× peste buget.
- Fără cache (Scenariul B), chiar și Flash promo ajunge la $840.21 — de 42× peste.
2. Câte sesiuni/zi înseamnă?
Ritmul real: 12.4 sesiuni/zi, 319M tokeni/zi. Cu $20 obții:
- GLM-5.3-Flash promo: 3.7 zile (~46 sesiuni)
- GLM-5.3-Flash listă: 1.8 zile (~23 sesiuni)
- GLM-5.3: 0.21 zile (~3 sesiuni) — sub o zi
3. Ce model e mai avantajos?
GLM-5.3-Flash, de 17.5× mai ieftin decât GLM-5.3. Diferența absolută pe consumul tău: $3,134.00 ($3,324.02 vs $190.02). La preț de listă diferența rămâne $2,943.99. Compromisul e de calitate — Flash e modelul mic.
4. Diferența de cost GLM-5.3 vs GLM-5.3-Flash
| GLM-5.3 | Flash (promo) | Flash (listă) | |
|---|---|---|---|
| Total | $3,324.02 | $190.02 | $380.03 |
| Pe zi | $94.97 | $5.43 | $10.86 |
| Pe sesiune | $7.641 | $0.437 | $0.874 |
| Raport față de GLM-5.3 | 1× | 17.5× mai ieftin | 8.7× mai ieftin |
5. Ce procent din utilizarea Claude poate fi mutat realist pe Zen?
Structura reală: 60% Sonnet 5, 38% Opus 5, 1.5% Fable 5, restul Haiku.
Întrebarea corectă nu mai e „ce procent muți", ci „cât încape în $20" — și răspunsul e 10.5% din volum, la cel mai ieftin tarif posibil. Chiar dacă ai muta pe Zen absolut tot ce rulează azi pe Sonnet, ai depăși bugetul de câteva ori.
Cu $20/lună pe GLM-5.3-Flash poți acoperi realist ~11% din volum — echivalentul a ~1173M tokeni. Ținta rezonabilă: un singur flux automat, mic și bine delimitat (un bot, un job de noapte, un agent în buclă), nu o felie procentuală din tot ce faci.
6. Dar abonamentele Z.AI?
Aici răspunsul e cu totul altul decât la Zen $20. La ~1,801 prompturi/săptămână:
| Efectiv/lună (anual) | Acoperire la 1× | Acoperire la 3× | |
|---|---|---|---|
| Z.AI Coding Lite | $12.60 | 22% | 7% |
| Z.AI Coding Pro | $50.40 | 111% | 37% |
| Z.AI Coding Max | $112.00 | 444% | 148% |
Lite ($12,60/lună) e opțiunea potrivită pentru rolul pe care îl căutai la Zen $20 — cost similar, dar acoperă 22% din volum în loc de 10.5%, adică de 2× mai mult pentru aceiași bani. Modelul de abonament bate plata la token, exact cum o face și Max față de tarifele Zen.
Recomandare
Păstrează Max 5x — la $5,167 valoare per-token pentru $100 plătiți, e cea mai bună afacere din tot setul de date. Nu e nimic de optimizat acolo.
Nu lua OpenCode Zen $20. La volumul tău e o rotunjire (10,5%), iar pentru bani similari Z.AI Coding Lite anual ($12,60/lună) îți dă de 2× mai mult. Singurul motiv real pentru Zen ar fi accesul la multe modele diferite dintr-un singur cont, nu volumul.
Dacă vrei capacitate suplimentară serioasă, ordinea corectă e:
- Z.AI Coding Lite anual, $12,60/lună — ca supliment: preia un flux automat întreg (tot
moltbot= 195M tokeni/lună) și îți lasă Max liber pentru munca grea. Risc mic, cost mic. Aici aș începe. - Z.AI Coding Pro anual, $50,40/lună — dacă vrei să muți o felie mare din volum. Acoperă 111% la 1×, dar doar 37% dacă GLM-5.3 se contorizează la 3×. Verifică multiplicatorul înainte, e diferența dintre „ajunge" și „nu ajunge".
- Z.AI Coding Max anual, $112/lună — singurul care acoperă volumul indiferent de multiplicator, dar la acel preț compari direct cu un al doilea Max 5x sau cu Max 20x, unde primești Opus 5 în loc de GLM-5.3.
Testul decisiv nu e de preț, e de calitate. Toate variantele Z.AI îți dau GLM-5.3, nu Opus 5, iar 38% din volumul tău rulează pe Opus 5 pentru că ai ales asta. Ia Lite anual o lună, rutează pe el fluxurile automate, și vezi dacă rezultatul e acceptabil înainte să muți ceva important.
Rolul rămas pentru Zen $20 (dacă îl iei totuși) e restrâns:
- buget de experiment — să testezi dacă GLM-5.3-Flash e destul de bun pe un flux anume, înainte să iei o decizie mai mare;
- overflow de urgență — dacă atingi limita Max într-o zi aglomerată, ai un backup care costă cenți pe oră;
- un singur job automat mic — de exemplu tot ce rulează pe
moltbot(195M tokeni = $3.81/lună pe Flash promo, 19% din buget).
Rezerve
claude-agentare doar 5 zile din 35 cu transcripturi păstrate; consumul lui real e mai mare decât cei 306M măsurați. Nu am extrapolat. Efectul e mic la scara totalului (2,7%), dar direcția e clară: totalul real e mai mare, nu mai mic.- Alte mașini Windows din tailnet (
marius-hx90g,lenovo-aio-h1,lg17,roa-carapetru2) nu au fost scanate — erau offline. Dacă rulezi Claude Code și pe ele, totalul crește. - Cache hit rate-ul e ipoteza critică: 97.2% din volum e cache read. OpenCode cu GLM nu garantează același comportament de caching ca Claude Code — Scenariul B ($840 în loc de $190) e cazul rău, și nu e improbabil.
- Prețul Flash e promoțional până pe 2026-09-09; se dublează după.
- GLM-5.3 nu e listat oficial pe OpenCode Zen — am folosit tariful Z.AI ca proxy, validat prin faptul că GLM 5.2 are pe Zen exact prețul Z.AI.
- Datele Windows au trecut printr-o conversie de tabel (TAB + date M/D/YYYY). UUID-urile și valorile numerice au fost validate, dar nu am putut verifica independent fișierele sursă.