Files
ROMFASTSQL/claude_usage_report.md
Claude Agent a01cac0657 feat(analiza): consum real Claude Code si dimensionarea suplimentului GLM
Plafonul general saptamanal Max 5x se consuma in ~2 zile, urmate de ~5 zile
blocate. Masurat pe 3 masini (Windows, claude-agent, moltbot), 2026-07-29 ->
2026-09-01: 11,15 miliarde tokeni, 435 sesiuni, 64.211 cereri API, dedup pe
message.id + requestId. Deficit +32% (~570 prompturi/saptamana).

Concluzia nu e cea asteptata: bugetele plafonate in dolari (OpenCode Zen $20,
OpenCode Go) se evapora la acest volum -- Go a tinut 1-2 zile in practica.
Planurile Z.AI se contorizeaza in prompturi, nu in dolari, si rezista la un
workload cu 7,1 cereri API per prompt. Z.AI Coding Lite ($18/luna) acopera 70%
din deficit; Pro ($72) il acopera integral.

Verificat empiric ca subagentii nu pot rula pe GLM (in proces, moștenesc auth),
dar sesiunile separate pot: endpoint fals local a primit cererea cu tokenul
alternativ, fara sa atinga OAuth-ul Max. Masurat: ~186MB RSS si 20-60s pornire
per sesiune -- de aici regulile de orchestrare (sarcini mari, max 4 procese,
fan-out in interiorul unei sesiuni GLM).

Ramane neverificat multiplicatorul de credite pentru GLM-5.3-Flash; la 3x in
loc de 1x, Lite pica si decizia se muta pe Pro.

- docs/supliment-glm-zai.md: rezumat de implementare (indexat in CLAUDE.md)
- claude_usage_report.md + CSV-uri: analiza completa si datele brute
- tools/claude_usage_*.py: pipeline de masurare read-only, re-rulabil remote
- tools/claude-glm.sh: wrapper de sesiune GLM (task/resume/shell)

Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>
Claude-Session: https://claude.ai/code/session_01Q4uzvgm7AyJch5WH8QHRhY
2026-09-01 11:32:56 +00:00

30 KiB
Raw Blame History

Analiză consum Claude Code — Claude Max 5x vs. OpenCode Zen (GLM-5.3)

Generat: 2026-09-01 · Perioadă: 2026-07-29 → 2026-09-01 (35 zile) · 3 mașini · 435 sesiuni · 11.15 miliarde tokeni

0. Ce a fost scanat

Mașină Locație Fișiere Înregistrări Duplicate Sesiuni Prima zi Ultima zi Zile active
claude-agent ~/.claude/projects (Linux, LXC 171) 70 3,973 1,857 60 2026-08-17 2026-09-01 5
moltbot /home/moltbot/.claude/projects (Linux, LXC 110) 163 3,423 1,613 157 2026-08-02 2026-09-01 31
LENOVO-AIO-BIRO C:\Users\<user>\.claude\projects (Windows) 859 111,127 50,764 218 2026-07-29 2026-09-01 29

Windows a fost extras de o sesiune Claude Code rulată manual pe acea mașină, cu exact același script și aceeași cheie de deduplicare — altfel cifrele nu s-ar putea aduna. Datele au trecut printr-un pas de tabel (separator TAB, date în format M/D/YYYY); au fost renormalizate la ISO, iar toate cele 218 UUID-uri de sesiune au fost validate. Ceasul din zi s-a pierdut la conversie, dar granularitatea folosită în raport e ziua.

Corecție de premisă

Sesiunea care a condus analiza nu rulează pe Windows — rulează pe LXC 171 claude-agent (Linux claude-agent 6.8.12-15-pve). Windows a fost acoperit separat, prin sesiunea deschisă acolo.

Surse de token usage și care e autoritativă

Sursă Conține Verdict
~/.claude/projects/**/*.jsonl, câmpul message.usage din înregistrările assistant input_tokens, output_tokens, cache_creation_input_tokens, cache_read_input_tokens, thinking_tokens, model, requestId AUTORITATIVĂ — valori raportate de API
~/.claude/stats-cache.json mesaje/sesiuni/tool-calls pe zi, din 2025-12-31 secundară — zero tokeni; dovadă că istoricul e mai lung decât transcripturile
~/.claude/history.jsonl 6.400 de prompturi, din 2025-12-31 secundară — fără tokeni

Lungimea transcriptului nu a fost folosită ca proxy pentru tokeni nicăieri.

1. Perioada

  • Început: 2026-07-29
  • Sfârșit: 2026-09-01
  • Zile calendaristice: 35
  • Zile cu activitate: 34
  • Zile lipsă: 2026-07-31

Acoperirea e inegală: Windows și moltbot acoperă luna întreagă, dar claude-agent are doar 5 zile cu transcripturi păstrate (retenția implicită de 30 de zile plus o recreare a directorului pe 2026-08-30). stats-cache.json arată activitate continuă din 2025-12-31. Consumul istoric real e mai mare decât cel de aici; nu am extrapolat nimic — toate cifrele sunt tokeni observați efectiv.

2. Deduplicare

Cheie: message.id + requestId. Aceeași cerere API reapare în mai multe fișiere după --resume, fork de sesiune sau compactare.

  • Înregistrări assistant cu usage întâlnite: 118,523
  • Duplicate eliminate: 54,234 (45.8%)
  • Cereri API unice numărate: 64,289
  • Sesiuni prezente pe mai multe mașini: 0 (verificat pe toate cele trei perechi)
  • Linii malformate: 0

3. Total

Metrică Valoare
Sesiuni 435
Turn-uri asistent (cereri API) 64,211
Input tokens (necache) 338,907
Output tokens 23,297,506
Cache creation (write) 288,224,316
Cache read 10,836,625,270
TOTAL 11,148,485,999

Cache read = 97.2% din volum. Output-ul real e doar 0.21%. Asta e semnătura unui workload agentic: contextul se retrimite la fiecare turn, iar tarifarea cache-ului decide costul.

Medii: 25,628,703 tokeni/sesiune (148 turn-uri) · 318,528,171 tokeni/zi · 12.4 sesiuni/zi.

Breakdown pe calculator

Mașină Sesiuni Turn-uri Input Output Cache write Cache read Total %
LENOVO-AIO-BIRO 218 60,304 330,668 20,939,475 269,887,835 10,356,404,686 10,647,562,664 95.5%
claude-agent 60 2,114 4,418 1,543,956 6,731,712 297,811,719 306,091,805 2.7%
moltbot 157 1,793 3,821 814,075 11,604,769 182,408,865 194,831,530 1.7%

Breakdown pe model

Model Sesiuni Turn-uri Input Output Cache write Cache read Total %
claude-sonnet-5 37,902 261,427 3,475,072 198,256,274 6,508,379,975 6,710,372,748 60.2%
claude-opus-5 25,343 75,166 19,607,975 85,344,425 4,168,532,752 4,273,560,318 38.3%
claude-fable-5 941 2,106 208,768 4,533,984 158,857,102 163,601,960 1.5%
claude-haiku-4-5-20251001 25 208 5,691 89,633 855,441 950,973 0.0%

Breakdown pe lună

Lună Sesiuni Turn-uri Input Output Cache write Cache read Total %
2026-07 845 6,527 330,630 7,941,767 184,927,510 193,206,434 1.7%
2026-08 62,519 330,686 22,755,166 277,847,883 10,515,360,962 10,816,294,697 97.0%
2026-09 847 1,694 211,710 2,434,666 136,336,798 138,984,868 1.2%

Breakdown pe zi

Zi Sesiuni Turn-uri Input Output Cache write Cache read Total %
2026-07-29 214 3,434 76,615 1,093,695 20,587,396 21,761,140 0.2%
2026-07-30 631 3,093 254,015 6,848,072 164,340,114 171,445,294 1.5%
2026-08-01 1,243 8,856 560,845 5,561,396 250,296,311 256,427,408 2.3%
2026-08-02 2,095 5,496 1,344,277 6,977,342 339,262,565 347,589,680 3.1%
2026-08-03 3,225 23,466 1,228,967 19,167,120 536,296,804 556,716,357 5.0%
2026-08-04 323 13,015 142,150 1,971,068 39,101,333 41,227,566 0.4%
2026-08-05 657 1,787 286,446 4,672,434 91,066,167 96,026,834 0.9%
2026-08-06 3,064 28,381 1,125,446 14,847,361 493,347,883 509,349,071 4.6%
2026-08-07 2,068 4,963 676,244 17,444,157 413,402,684 431,528,048 3.9%
2026-08-08 4,255 47,237 1,331,620 20,159,731 830,971,552 852,510,140 7.6%
2026-08-09 5,283 64,396 1,373,409 22,876,001 886,709,264 911,023,070 8.2%
2026-08-10 3,984 53,819 1,283,159 18,754,319 634,612,620 654,703,917 5.9%
2026-08-11 1,562 9,071 698,861 6,558,893 221,468,597 228,735,422 2.1%
2026-08-12 250 653 142,318 1,672,205 37,721,945 39,537,121 0.4%
2026-08-13 84 166 27,185 334,918 8,022,052 8,384,321 0.1%
2026-08-14 19 38 2,401 214,217 782,061 998,717 0.0%
2026-08-15 18 36 2,434 213,650 728,993 945,113 0.0%
2026-08-16 18 36 2,815 212,322 726,847 942,020 0.0%
2026-08-17 39 78 9,934 310,995 2,021,166 2,342,173 0.0%
2026-08-18 285 568 181,938 1,228,874 40,742,116 42,153,496 0.4%
2026-08-19 870 1,740 523,899 2,930,364 142,095,433 145,551,436 1.3%
2026-08-20 2,131 4,320 838,986 8,335,140 329,763,669 338,942,115 3.0%
2026-08-21 3,374 6,952 938,769 11,353,197 678,083,464 690,382,382 6.2%
2026-08-22 4,219 8,438 1,367,817 18,528,526 793,556,645 813,461,426 7.3%
2026-08-23 4,780 9,560 1,667,111 16,953,670 881,927,242 900,557,583 8.1%
2026-08-24 1,004 2,008 449,421 4,405,346 169,736,444 174,593,219 1.6%
2026-08-25 1,291 2,582 993,949 4,814,837 224,746,691 230,558,059 2.1%
2026-08-26 58 116 24,692 311,333 3,235,406 3,571,547 0.0%
2026-08-27 2,553 5,106 857,461 11,835,008 454,391,610 467,089,185 4.2%
2026-08-28 2,850 5,700 1,229,085 13,010,965 392,932,032 407,177,782 3.7%
2026-08-29 3,473 6,946 970,773 12,843,362 447,480,189 461,301,270 4.1%
2026-08-30 2,462 4,924 885,887 10,238,581 324,734,530 335,863,922 3.0%
2026-08-31 4,982 10,232 1,586,867 19,110,551 845,396,647 866,104,297 7.8%
2026-09-01 847 1,694 211,710 2,434,666 136,336,798 138,984,868 1.2%

4. Prețuri — verificate 2026-09-01

Pagina oficială OpenCode Zen (opencode.ai/docs/zen) nu listează încă GLM-5.3 sau GLM-5.3-Flash. Cele mai noi GLM de acolo:

Model pe Zen Input Output Cache read Cache write
GLM 5.2 $1.40 $4.40 $0.26 —
GLM 5.1 $1.40 $4.40 $0.26 —
GLM 5 $1.00 $3.20 $0.20 —
Claude Opus 5 $5.00 $25.00 $0.50 $6.25
Claude Sonnet 5 $2.00 $10.00 $0.20 $2.50
Claude Fable 5 $10.00 $50.00 $1.00 $12.50
Claude Haiku 4.5 $1.00 $5.00 $0.10 $1.25

Pentru GLM-5.3 am folosit prețurile oficiale Z.AI (furnizorul modelului). Zen revinde de regulă la același tarif — GLM 5.2 pe Zen e identic cu tariful Z.AI, ceea ce validează proxy-ul.

Model Input Cache read Cache write Output
GLM-5.3 $1.40 $0.26 fără tarif separat $4.40
GLM-5.3-Flash (promo, până 2026-09-09 24:00 UTC+8) $0.075 $0.015 fără tarif separat $0.25
GLM-5.3-Flash (preț de listă) $0.15 $0.03 fără tarif separat $0.50

Surse: opencode.ai/docs/zen · docs.z.ai/guides/overview/pricing · openrouter.ai/z-ai/glm-5.3-flash

Cache write: niciun model GLM nu are tarif separat de cache creation (spre deosebire de modelele Claude de pe Zen). cache_creation_input_tokens se facturează deci la tariful de input normal. cache_read_input_tokens nu a fost tratat ca input normal — are tariful lui redus. Vezi Scenariul B pentru varianta fără cache.

5. Cost echivalent Zen — Scenariul A (tokeni reali, tarife de cache)

Model Input Cache read Cache write Output TOTAL
GLM-5.3 $0.47 $2817.52 $403.51 $102.51 $3324.02
GLM-5.3-Flash (promo) $0.03 $162.55 $21.62 $5.82 $190.02
GLM-5.3-Flash (listă) $0.05 $325.10 $43.23 $11.65 $380.03

Medii

Model / sesiune / zi / lună (30 zile)
GLM-5.3 $7.641 $94.97 $2849.16
GLM-5.3-Flash (promo) $0.437 $5.43 $162.87
GLM-5.3-Flash (listă) $0.874 $10.86 $325.74

6. Scenariul B — fără avantajul cache-ului

Tot cache_read + cache_creation facturați ca input normal.

Model A (cu cache) B (fără cache) Factor
GLM-5.3 $3324.02 $15677.77 4.7×
GLM-5.3-Flash (promo) $190.02 $840.21 4.4×
GLM-5.3-Flash (listă) $380.03 $1680.43 4.4×

7. Comparație cu Claude Max 5x

Nu există conversie oficială Anthropic din quota Max în tokeni, deci nu o inventez. Compar ce ai plătit cu ce ar fi costat exact aceiași tokeni la tarif per-token.

Claude Max 5x Zen GLM-5.3 Zen GLM-5.3-Flash (promo) Zen GLM-5.3-Flash (listă)
Cost pentru perioada măsurată $100/lună $3,324.02 $190.02 $380.03
Tokeni 11,148,485,999 identic identic identic
Sesiuni 435 identic identic identic
Modele Opus 5, Sonnet 5, Fable 5, Haiku 4.5 GLM-5.3 GLM-5.3-Flash GLM-5.3-Flash

Cât valorează de fapt abonamentul Max

Aceiași 11,148,485,999 tokeni, fiecare model la propriul lui tarif pe Zen (Opus 5 la preț de Opus 5, Sonnet 5 la preț de Sonnet 5 etc.):

$5,167.05

Abonamentul Max 5x de $100 a livrat consum care la tarif per-token ar fi costat $5,167 — adică Max e de 52× mai ieftin decât plata la token pentru exact aceleași modele. Asta e cifra cea mai importantă din tot raportul.

Acoperirea celor $20 Zen

Model Cost pentru consumul observat % din $20 De câte ori acoperă $20 consumul
GLM-5.3 $3,324.02 16,620% 0.006×
GLM-5.3-Flash (promo) $190.02 950% 0.105×
GLM-5.3-Flash (listă) $380.03 1,900% 0.053×

Scenariul B, fără cache:

Model Cost % din $20 Acoperire
GLM-5.3 $15,677.77 78,389% 0.001×
GLM-5.3-Flash (promo) $840.21 4,201% 0.024×
GLM-5.3-Flash (listă) $1,680.43 8,402% 0.012×

Cât consum încap în $20

Model Tokeni pentru $20 % din consumul lunar Zile la ritmul actual Sesiuni
GLM-5.3 67,078,331 0.6% 0.21 2.6
GLM-5.3-Flash (promo) 1,173,426,044 10.5% 3.68 45.8
GLM-5.3-Flash (listă) 586,713,022 5.3% 1.84 22.9

8. Abonamentele Z.AI GLM Coding Plan

Planurile Z.AI nu se facturează pe tokeni, ci pe prompturi (turnuri umane) contorizate în credite, cu două limite simultane: una la 5 ore și una săptămânală. Documentația Z.AI notează că „un prompt poate invoca modelul de 15–20 de ori" — deci comparația corectă nu se face pe cererile API, ci pe prompturile tale reale.

Prețuri (verificate 2026-09-01)

Plan Lunar Anual Efectiv/lună anual Economie Prompturi / 5h Prompturi / săpt. Credite / săpt.
Lite $18.00 $151.20 $12.60 30% ~80 ~400 10.000
Pro $72.00 $604.80 $50.40 30% ~400 ~2.000 60.000
Max $160.00 $1.344,00 $112.00 30% ~1.600 ~8.000 140.000

Toate planurile includ GLM-5.3 și GLM-5.3-Flash. Surse: docs.z.ai/devpack/overview · aipricing.guru

Câte prompturi dai de fapt

Am numărat prompturile umane reale (excluzând tool_result, care în transcript apar tot ca mesaje de tip user):

Mașină Prompturi umane Cereri API Cereri / prompt
claude-agent 245 2.143 8,75
moltbot 309 1.810 5,86
LENOVO-AIO-BIRO ~8,451 (estimat) 60,304 7.14 (aplicat)
TOTAL ~9,005 64,211 7.14

Estimare marcată: scriptul rulat pe Windows a raportat doar cererile API, nu și prompturile umane. Cifra pentru Windows e derivată din raportul măsurat pe cele două mașini Linux (7.14 cereri API per prompt). E singura extrapolare din tot raportul și e marcată ca atare. Raportul real pe Windows poate diferi — sesiunile de acolo par mai lungi, deci numărul de prompturi ar putea fi mai mic (și acoperirea planurilor, mai bună).

Ritm rezultat: ~1,801 prompturi/săptămână (~257/zi) pe 35 zile.

Acoperire — la multiplicator 1×

Plan Anual Efectiv/lună Prompturi/săpt. Acoperă din nevoia ta Verdict
Lite $151.20 $12.60 ~400 22% insuficient
Pro $604.80 $50.40 ~2,000 111% ACOPERĂ
Max $1,344.00 $112.00 ~8,000 444% ACOPERĂ

Acoperire — dacă GLM-5.3 consumă credite multiplicat

Z.AI aplică multiplicatori de credite modelelor mari (documentat 3× în orele de vârf și 2× off-peak pentru GLM-5.2 / GLM-5-Turbo; pentru GLM-5.3 multiplicatorul nu e publicat explicit). Dacă GLM-5.3 se contorizează la fel, acoperirea scade proporțional:

Plan 1× (Flash / off-peak promo) 2× (off-peak) 3× (peak)
Lite 22% 11% 7%
Pro 111% 56% 37%
Max 444% 222% 148%

Comparație completă a opțiunilor

Opțiune Cost efectiv/lună Acoperă volumul tău? Observație
Claude Max 5x (actual) $100.00 DA, 100% modelele Claude; $5,167 valoare la tarif per-token
OpenCode Zen, GLM-5.3-Flash $190.02 (pay-per-token) da, dar costă 1.9× cât Max fără plafon, dar fără reducere de abonament
OpenCode Zen, GLM-5.3 $3,324.02 (pay-per-token) da, dar costă 33× cât Max prohibitiv
OpenCode Zen $20 (buget fix) $20.00 NU — 10,5% vezi secțiunea 7
Z.AI Coding Lite anual $12.60 NU — 22% la 1× cel mai ieftin plan cu GLM-5.3
Z.AI Coding Pro anual $50.40 DA la 1× (111%), nu la 2–3× cel mai bun raport dacă multiplicatorul e 1×
Z.AI Coding Max anual $112.00 DA, cu marjă (444% la 1×, 148% la 3×) singurul sigur indiferent de multiplicator

Ce înseamnă asta concret

Z.AI Coding Pro anual ($604,80/an = $50,40/lună) e de departe cea mai interesantă opțiune din tot setul — la ritmul tău de ~1,801 prompturi/săptămână, cota lui de ~2.000/săptămână acoperă 111% din volum, la jumătate din prețul Max 5x.

Dar cu trei rezerve serioase:

  1. Marja e subțire. 111% nu e mult peste 100%. O săptămână mai aglomerată decât media te scoate din cotă, și atunci aștepți resetarea.
  2. Multiplicatorul de credite e necunoscut pentru GLM-5.3. Dacă e 2× sau 3× ca la GLM-5.2, Pro acoperă doar 56%–37% și ai nevoie de Max ($112/lună).
  3. Limita de 5 ore contează separat. Media ta zilnică încape în cota de 5h a planului Pro (~400), dar zilele de vârf pot să nu încapă. Cotele sunt simultane: săptămânală ȘI la 5 ore.

Diferența de calitate rămâne argumentul decisiv. Un plan Z.AI îți dă GLM-5.3, nu Opus 5. La tine 38% din volum rulează deja pe Opus 5 — muncă unde ai ales conștient modelul mare.

9. Scenariul real: Opus planifică, GLM-5.3-Flash execută

Fluxul vizat înlocuiește doar treapta de execuție (azi Sonnet 5) cu GLM-5.3-Flash, păstrând Opus 5 pe Max pentru planificare. Asta nu e o felie arbitrară din volum — e exact împărțirea care se vede deja în date.

Treaptă Model azi Tokeni/lună % volum Turn-uri Prompturi/săpt. (est.)
Planificare Opus 5 4.27B 38.3% 25,343 ~711
Execuție Sonnet 5 6.71B 60.2% 37,902 ~1,063
Alte Fable 5 + Haiku 165M 1.5% 966 ~27

Cât costă mutarea treptei de execuție

Variantă Cost/lună Observație
Zen pay-per-token, Flash promo $113.38 tarif promoțional, expiră 2026-09-09
Zen pay-per-token, Flash listă $226.77 tariful de după
Z.AI Coding Lite anual $12.60 cotă ~400 prompturi/săpt. = 38% din nevoie
Z.AI Coding Pro anual $50.40 cotă ~2.000/săpt. = 188% din nevoie
Z.AI Coding Max anual $112.00 cotă ~8.000/săpt. = 752%

Treapta de execuție are nevoie de ~1,063 prompturi/săptămână. Lite nu ajunge (38%). Pro ajunge cu marjă de 1.9× — și, spre deosebire de comparația pe volumul total, aici marja e confortabilă.

Detaliu în favoarea ta: multiplicatorul de credite Z.AI (3× peak / 2× off-peak) e documentat pentru modelele mari, nu pentru cele „de rutină". GLM-5.3-Flash e modelul mic, deci probabil se contorizează la 1×. Dacă e așa, Pro acoperă treapta de execuție cu 188% și rămâne loc de creștere. Confirmă asta înainte să plătești anual.

Calibrare cu OpenCode Go — datele tale reale

OpenCode Go costă $10/lună și include limite exprimate în valoare de consum, nu în tokeni:

Limită Valoare
La 5 ore $12 de consum
Săptămânal $30 de consum
Lunar $60 de consum

Abonamentul s-a consumat în 1–2 zile. Asta confirmă independent analiza: la volumul tău, consumul săptămânal echivalent e $38 pe GLM-5.3-Flash promo și $665 pe GLM-5.3 — deci plafonul săptămânal de $30 al lui Go se evaporă în 0.3 zile pe modelul mare și în 5.5 zile pe Flash. Un plan plafonat în dolari nu rezistă la acest volum, indiferent de furnizor.

De asta planurile Z.AI sunt altceva: cota lor e în prompturi, nu în dolari de consum. Un prompt care declanșează 20 de invocări de model costă la fel ca unul care declanșează 2 — iar sesiunile tale au în medie 7.1 cereri API per prompt. Exact tipul de workload pe care tarifarea per-prompt îl avantajează, și pe care cea per-dolar îl penalizează.

10. Problema reală: plafonul general săptămânal Max 5x

Max 5x are două plafoane săptămânale — unul general, pe toate modelele, și unul separat pentru Opus. Limita atinsă e cea generală, ceea ce înseamnă că un supliment pe GLM-5.3-Flash chiar poate ajuta: fiecare prompt mutat în altă parte eliberează cotă de Max.

Tiparul se vede în date

Săptămână Total Profil zilnic (M tokeni, Lu→Du)
2026-W31 0.80B We 22 · Th 171 · Sa 256 · Su 348
2026-W32 3.40B Mo 557 · Tu 41 · We 96 · Th 509 · Fr 432 · Sa 853 · Su 911
2026-W33 0.93B Mo 655 · Tu 229 · We 40 · Th 8 · Fr 1 · Sa 1 · Su 1
2026-W34 2.93B Mo 2 · Tu 42 · We 146 · Th 339 · Fr 690 · Sa 813 · Su 901
2026-W35 2.08B Mo 175 · Tu 231 · We 4 · Th 467 · Fr 407 · Sa 461 · Su 336
2026-W36 1.01B Mo 866 · Tu 139

Săptămâna W33 e semnătura manualului pentru un plafon atins: 655M luni, 229M marți, apoi 40M, 8M, 1M, 1M, 1M. Cota s-a consumat în două zile, urmate de cinci zile moarte. Exact ce descrii. Prin contrast, W32 și W34 au mers 7 zile din 7, la 2,93–3,40B.

  • Zile efectiv blocate (sub 50M tokeni): 10 din 34 = 29%
  • Zi activă mediană: 419M tokeni
  • Livrat efectiv de Max 5x: 2.23B/săptămână
  • Cerere dacă ai lucra 7 zile din 7 la ritmul median: 2.94B/săptămână
  • Deficit: 0.71B/săptămână = +32% ≈ ~570 prompturi/săptămână

Deficitul e o estimare conservatoare: presupune că în zilele blocate ai lucra la ritm median (419M), nu la ritmul zilelor bune (peste 850M). Cererea reală suprimată e probabil mai mare. Nu se poate măsura direct — Claude Code nu persistă evenimentele de limită în transcript, apar doar în stream-ul SDK.

Ce plan acoperă deficitul

Nu trebuie mutat tot volumul — doar atât cât să elibereze cota lipsă.

Plan Lunar Anual (efectiv/lună) Cotă/săpt. Acoperă deficitul de ~570 Zile blocate rămase
Lite $18.00 $12.60 ~400 70% ~0.6/săpt.
Pro $72.00 $50.40 ~2,000 351% ~0.0/săpt.
Max $160.00 $112.00 ~8,000 1403% ~0.0/săpt.

Azi ai ~2.0 zile blocate pe săptămână. Lite ar duce-o la ~0.6, Pro la zero, cu marjă de 3.5× pentru creștere.

Verificare din a doua direcție

Dacă muți toată treapta de execuție (Sonnet 5, 59% din turn-uri, ~1,063 prompturi/săpt.) pe GLM-5.3-Flash, eliberezi 59% din cota Max — care ar ține atunci de 2.4× mai mult, adică toată săptămâna în loc de două zile.

Pentru asta ai nevoie de ~1,063 prompturi/săpt.: Lite (38%) nu ajunge, Pro (188%) ajunge cu marjă.

Cele două calcule dau răspunsuri diferite pentru Lite pentru că măsoară lucruri diferite: primul, cât lipsește ca să nu mai fii blocat; al doilea, cât ar costa mutarea completă a treptei de execuție. Nu ai nevoie de mutarea completă — ai nevoie doar de deficit.

11. Fișiere generate

Fișier Conținut
claude_usage_report.md acest raport
claude_usage_sessions.csv 435 rânduri, una per sesiune
claude_usage_summary.csv agregate: TOTAL, mașină, model, lună, zi
tools/claude_usage_extract.py extractorul read-only (rulabil remote: ssh host 'python3 -' < script)
tools/claude_usage_report.py agregator + CSV
tools/claude_usage_md.py generatorul acestui raport

12. CONCLUZIE

„Dacă păstrez Claude Max 5x $100 și adaug OpenCode Zen $20, cât coding suplimentar obțin?"

Foarte puțin — aproximativ 3.7 zile pe lună, în cel mai bun caz.

Consumul real pe 35 zile, pe trei mașini: 11.15 miliarde de tokeni, 435 sesiuni, 64,211 cereri API. La acest volum, $20 nu sunt un supliment — sunt o rotunjire.

GLM-5.3 GLM-5.3-Flash (promo) GLM-5.3-Flash (listă)
Cost pentru volumul tău lunar $3,324 $190 $380
Cât din el acoperă $20 0.6% 10.5% 5.3%
Zile de lucru din $20 0.21 3.7 1.8

Punct cu punct

1. Ar fi fost $20 Zen suficienți pentru consumul observat?

NU, pe niciun model.

  • GLM-5.3-Flash (promo): $190.02 — de 9.5× peste buget. Cel mai bun caz posibil.
  • GLM-5.3-Flash (listă, după 9 sept.): $380.03 — de 19× peste buget.
  • GLM-5.3: $3,324.02 — de 166× peste buget.
  • Fără cache (Scenariul B), chiar și Flash promo ajunge la $840.21 — de 42× peste.

2. Câte sesiuni/zi înseamnă?

Ritmul real: 12.4 sesiuni/zi, 319M tokeni/zi. Cu $20 obții:

  • GLM-5.3-Flash promo: 3.7 zile (~46 sesiuni)
  • GLM-5.3-Flash listă: 1.8 zile (~23 sesiuni)
  • GLM-5.3: 0.21 zile (~3 sesiuni) — sub o zi

3. Ce model e mai avantajos?

GLM-5.3-Flash, de 17.5× mai ieftin decât GLM-5.3. Diferența absolută pe consumul tău: $3,134.00 ($3,324.02 vs $190.02). La preț de listă diferența rămâne $2,943.99. Compromisul e de calitate — Flash e modelul mic.

4. Diferența de cost GLM-5.3 vs GLM-5.3-Flash

GLM-5.3 Flash (promo) Flash (listă)
Total $3,324.02 $190.02 $380.03
Pe zi $94.97 $5.43 $10.86
Pe sesiune $7.641 $0.437 $0.874
Raport față de GLM-5.3 1× 17.5× mai ieftin 8.7× mai ieftin

5. Ce procent din utilizarea Claude poate fi mutat realist pe Zen?

Structura reală: 60% Sonnet 5, 38% Opus 5, 1.5% Fable 5, restul Haiku.

Întrebarea corectă nu mai e „ce procent muți", ci „cât încape în $20" — și răspunsul e 10.5% din volum, la cel mai ieftin tarif posibil. Chiar dacă ai muta pe Zen absolut tot ce rulează azi pe Sonnet, ai depăși bugetul de câteva ori.

Cu $20/lună pe GLM-5.3-Flash poți acoperi realist ~11% din volum — echivalentul a ~1173M tokeni. Ținta rezonabilă: un singur flux automat, mic și bine delimitat (un bot, un job de noapte, un agent în buclă), nu o felie procentuală din tot ce faci.

6. Dar abonamentele Z.AI?

Aici răspunsul e cu totul altul decât la Zen $20. La ~1,801 prompturi/săptămână:

Efectiv/lună (anual) Acoperire la 1× Acoperire la 3×
Z.AI Coding Lite $12.60 22% 7%
Z.AI Coding Pro $50.40 111% 37%
Z.AI Coding Max $112.00 444% 148%

Lite ($12,60/lună) e opțiunea potrivită pentru rolul pe care îl căutai la Zen $20 — cost similar, dar acoperă 22% din volum în loc de 10.5%, adică de 2× mai mult pentru aceiași bani. Modelul de abonament bate plata la token, exact cum o face și Max față de tarifele Zen.

Recomandare

Păstrează Max 5x — la $5,167 valoare per-token pentru $100 plătiți, e cea mai bună afacere din tot setul de date. Nu e nimic de optimizat acolo.

Nu lua OpenCode Zen $20. La volumul tău e o rotunjire (10,5%), iar pentru bani similari Z.AI Coding Lite anual ($12,60/lună) îți dă de 2× mai mult. Singurul motiv real pentru Zen ar fi accesul la multe modele diferite dintr-un singur cont, nu volumul.

Dacă vrei capacitate suplimentară serioasă, ordinea corectă e:

  1. Z.AI Coding Lite anual, $12,60/lună — ca supliment: preia un flux automat întreg (tot moltbot = 195M tokeni/lună) și îți lasă Max liber pentru munca grea. Risc mic, cost mic. Aici aș începe.
  2. Z.AI Coding Pro anual, $50,40/lună — dacă vrei să muți o felie mare din volum. Acoperă 111% la 1×, dar doar 37% dacă GLM-5.3 se contorizează la 3×. Verifică multiplicatorul înainte, e diferența dintre „ajunge" și „nu ajunge".
  3. Z.AI Coding Max anual, $112/lună — singurul care acoperă volumul indiferent de multiplicator, dar la acel preț compari direct cu un al doilea Max 5x sau cu Max 20x, unde primești Opus 5 în loc de GLM-5.3.

Testul decisiv nu e de preț, e de calitate. Toate variantele Z.AI îți dau GLM-5.3, nu Opus 5, iar 38% din volumul tău rulează pe Opus 5 pentru că ai ales asta. Ia Lite anual o lună, rutează pe el fluxurile automate, și vezi dacă rezultatul e acceptabil înainte să muți ceva important.

Rolul rămas pentru Zen $20 (dacă îl iei totuși) e restrâns:

  • buget de experiment — să testezi dacă GLM-5.3-Flash e destul de bun pe un flux anume, înainte să iei o decizie mai mare;
  • overflow de urgență — dacă atingi limita Max într-o zi aglomerată, ai un backup care costă cenți pe oră;
  • un singur job automat mic — de exemplu tot ce rulează pe moltbot (195M tokeni = $3.81/lună pe Flash promo, 19% din buget).

Rezerve

  1. claude-agent are doar 5 zile din 35 cu transcripturi păstrate; consumul lui real e mai mare decât cei 306M măsurați. Nu am extrapolat. Efectul e mic la scara totalului (2,7%), dar direcția e clară: totalul real e mai mare, nu mai mic.
  2. Alte mașini Windows din tailnet (marius-hx90g, lenovo-aio-h1, lg17, roa-carapetru2) nu au fost scanate — erau offline. Dacă rulezi Claude Code și pe ele, totalul crește.
  3. Cache hit rate-ul e ipoteza critică: 97.2% din volum e cache read. OpenCode cu GLM nu garantează același comportament de caching ca Claude Code — Scenariul B ($840 în loc de $190) e cazul rău, și nu e improbabil.
  4. Prețul Flash e promoțional până pe 2026-09-09; se dublează după.
  5. GLM-5.3 nu e listat oficial pe OpenCode Zen — am folosit tariful Z.AI ca proxy, validat prin faptul că GLM 5.2 are pe Zen exact prețul Z.AI.
  6. Datele Windows au trecut printr-o conversie de tabel (TAB + date M/D/YYYY). UUID-urile și valorile numerice au fost validate, dar nu am putut verifica independent fișierele sursă.