# Analiză consum Claude Code — Claude Max 5x vs. OpenCode Zen (GLM-5.3) **Generat:** 2026-09-01 · **Perioadă:** 2026-07-29 → 2026-09-01 (35 zile) · **3 mașini · 435 sesiuni · 11.15 miliarde tokeni** ## 0. Ce a fost scanat | Mașină | Locație | Fișiere | Înregistrări | Duplicate | Sesiuni | Prima zi | Ultima zi | Zile active | |---|---|---:|---:|---:|---:|---|---|---:| | `claude-agent` | `~/.claude/projects` (Linux, LXC 171) | 70 | 3,973 | 1,857 | 60 | 2026-08-17 | 2026-09-01 | 5 | | `moltbot` | `/home/moltbot/.claude/projects` (Linux, LXC 110) | 163 | 3,423 | 1,613 | 157 | 2026-08-02 | 2026-09-01 | 31 | | `LENOVO-AIO-BIRO` | `C:\Users\\.claude\projects` (Windows) | 859 | 111,127 | 50,764 | 218 | 2026-07-29 | 2026-09-01 | 29 | Windows a fost extras de o sesiune Claude Code rulată manual pe acea mașină, cu **exact același script și aceeași cheie de deduplicare** — altfel cifrele nu s-ar putea aduna. Datele au trecut printr-un pas de tabel (separator TAB, date în format M/D/YYYY); au fost renormalizate la ISO, iar toate cele 218 UUID-uri de sesiune au fost validate. Ceasul din zi s-a pierdut la conversie, dar granularitatea folosită în raport e ziua. ### Corecție de premisă Sesiunea care a condus analiza **nu rulează pe Windows** — rulează pe LXC 171 `claude-agent` (`Linux claude-agent 6.8.12-15-pve`). Windows a fost acoperit separat, prin sesiunea deschisă acolo. ### Surse de token usage și care e autoritativă | Sursă | Conține | Verdict | |---|---|---| | `~/.claude/projects/**/*.jsonl`, câmpul `message.usage` din înregistrările `assistant` | `input_tokens`, `output_tokens`, `cache_creation_input_tokens`, `cache_read_input_tokens`, `thinking_tokens`, `model`, `requestId` | **AUTORITATIVĂ** — valori raportate de API | | `~/.claude/stats-cache.json` | mesaje/sesiuni/tool-calls pe zi, din 2025-12-31 | secundară — **zero tokeni**; dovadă că istoricul e mai lung decât transcripturile | | `~/.claude/history.jsonl` | 6.400 de prompturi, din 2025-12-31 | secundară — fără tokeni | Lungimea transcriptului nu a fost folosită ca proxy pentru tokeni nicăieri. ## 1. Perioada - **Început:** 2026-07-29 - **Sfârșit:** 2026-09-01 - **Zile calendaristice:** 35 - **Zile cu activitate:** 34 - **Zile lipsă:** 2026-07-31 Acoperirea e inegală: Windows și moltbot acoperă luna întreagă, dar **`claude-agent` are doar 5 zile** cu transcripturi păstrate (retenția implicită de 30 de zile plus o recreare a directorului pe 2026-08-30). `stats-cache.json` arată activitate continuă din **2025-12-31**. Consumul istoric real e mai mare decât cel de aici; **nu am extrapolat nimic** — toate cifrele sunt tokeni observați efectiv. ## 2. Deduplicare Cheie: `message.id` + `requestId`. Aceeași cerere API reapare în mai multe fișiere după `--resume`, fork de sesiune sau compactare. - Înregistrări `assistant` cu `usage` întâlnite: **118,523** - Duplicate eliminate: **54,234** (45.8%) - Cereri API unice numărate: **64,289** - Sesiuni prezente pe mai multe mașini: **0** (verificat pe toate cele trei perechi) - Linii malformate: **0** ## 3. Total | Metrică | Valoare | |---|---:| | Sesiuni | 435 | | Turn-uri asistent (cereri API) | 64,211 | | Input tokens (necache) | 338,907 | | Output tokens | 23,297,506 | | Cache creation (write) | 288,224,316 | | Cache read | 10,836,625,270 | | **TOTAL** | **11,148,485,999** | Cache read = **97.2%** din volum. Output-ul real e doar **0.21%**. Asta e semnătura unui workload agentic: contextul se retrimite la fiecare turn, iar tarifarea cache-ului decide costul. Medii: **25,628,703** tokeni/sesiune (148 turn-uri) · **318,528,171** tokeni/zi · **12.4** sesiuni/zi. ### Breakdown pe calculator | Mașină | Sesiuni | Turn-uri | Input | Output | Cache write | Cache read | Total | % | |---|---:|---:|---:|---:|---:|---:|---:|---:| | LENOVO-AIO-BIRO | 218 | 60,304 | 330,668 | 20,939,475 | 269,887,835 | 10,356,404,686 | 10,647,562,664 | 95.5% | | claude-agent | 60 | 2,114 | 4,418 | 1,543,956 | 6,731,712 | 297,811,719 | 306,091,805 | 2.7% | | moltbot | 157 | 1,793 | 3,821 | 814,075 | 11,604,769 | 182,408,865 | 194,831,530 | 1.7% | ### Breakdown pe model | Model | Sesiuni | Turn-uri | Input | Output | Cache write | Cache read | Total | % | |---|---:|---:|---:|---:|---:|---:|---:|---:| | claude-sonnet-5 | | 37,902 | 261,427 | 3,475,072 | 198,256,274 | 6,508,379,975 | 6,710,372,748 | 60.2% | | claude-opus-5 | | 25,343 | 75,166 | 19,607,975 | 85,344,425 | 4,168,532,752 | 4,273,560,318 | 38.3% | | claude-fable-5 | | 941 | 2,106 | 208,768 | 4,533,984 | 158,857,102 | 163,601,960 | 1.5% | | claude-haiku-4-5-20251001 | | 25 | 208 | 5,691 | 89,633 | 855,441 | 950,973 | 0.0% | ### Breakdown pe lună | Lună | Sesiuni | Turn-uri | Input | Output | Cache write | Cache read | Total | % | |---|---:|---:|---:|---:|---:|---:|---:|---:| | 2026-07 | | 845 | 6,527 | 330,630 | 7,941,767 | 184,927,510 | 193,206,434 | 1.7% | | 2026-08 | | 62,519 | 330,686 | 22,755,166 | 277,847,883 | 10,515,360,962 | 10,816,294,697 | 97.0% | | 2026-09 | | 847 | 1,694 | 211,710 | 2,434,666 | 136,336,798 | 138,984,868 | 1.2% | ### Breakdown pe zi | Zi | Sesiuni | Turn-uri | Input | Output | Cache write | Cache read | Total | % | |---|---:|---:|---:|---:|---:|---:|---:|---:| | 2026-07-29 | | 214 | 3,434 | 76,615 | 1,093,695 | 20,587,396 | 21,761,140 | 0.2% | | 2026-07-30 | | 631 | 3,093 | 254,015 | 6,848,072 | 164,340,114 | 171,445,294 | 1.5% | | 2026-08-01 | | 1,243 | 8,856 | 560,845 | 5,561,396 | 250,296,311 | 256,427,408 | 2.3% | | 2026-08-02 | | 2,095 | 5,496 | 1,344,277 | 6,977,342 | 339,262,565 | 347,589,680 | 3.1% | | 2026-08-03 | | 3,225 | 23,466 | 1,228,967 | 19,167,120 | 536,296,804 | 556,716,357 | 5.0% | | 2026-08-04 | | 323 | 13,015 | 142,150 | 1,971,068 | 39,101,333 | 41,227,566 | 0.4% | | 2026-08-05 | | 657 | 1,787 | 286,446 | 4,672,434 | 91,066,167 | 96,026,834 | 0.9% | | 2026-08-06 | | 3,064 | 28,381 | 1,125,446 | 14,847,361 | 493,347,883 | 509,349,071 | 4.6% | | 2026-08-07 | | 2,068 | 4,963 | 676,244 | 17,444,157 | 413,402,684 | 431,528,048 | 3.9% | | 2026-08-08 | | 4,255 | 47,237 | 1,331,620 | 20,159,731 | 830,971,552 | 852,510,140 | 7.6% | | 2026-08-09 | | 5,283 | 64,396 | 1,373,409 | 22,876,001 | 886,709,264 | 911,023,070 | 8.2% | | 2026-08-10 | | 3,984 | 53,819 | 1,283,159 | 18,754,319 | 634,612,620 | 654,703,917 | 5.9% | | 2026-08-11 | | 1,562 | 9,071 | 698,861 | 6,558,893 | 221,468,597 | 228,735,422 | 2.1% | | 2026-08-12 | | 250 | 653 | 142,318 | 1,672,205 | 37,721,945 | 39,537,121 | 0.4% | | 2026-08-13 | | 84 | 166 | 27,185 | 334,918 | 8,022,052 | 8,384,321 | 0.1% | | 2026-08-14 | | 19 | 38 | 2,401 | 214,217 | 782,061 | 998,717 | 0.0% | | 2026-08-15 | | 18 | 36 | 2,434 | 213,650 | 728,993 | 945,113 | 0.0% | | 2026-08-16 | | 18 | 36 | 2,815 | 212,322 | 726,847 | 942,020 | 0.0% | | 2026-08-17 | | 39 | 78 | 9,934 | 310,995 | 2,021,166 | 2,342,173 | 0.0% | | 2026-08-18 | | 285 | 568 | 181,938 | 1,228,874 | 40,742,116 | 42,153,496 | 0.4% | | 2026-08-19 | | 870 | 1,740 | 523,899 | 2,930,364 | 142,095,433 | 145,551,436 | 1.3% | | 2026-08-20 | | 2,131 | 4,320 | 838,986 | 8,335,140 | 329,763,669 | 338,942,115 | 3.0% | | 2026-08-21 | | 3,374 | 6,952 | 938,769 | 11,353,197 | 678,083,464 | 690,382,382 | 6.2% | | 2026-08-22 | | 4,219 | 8,438 | 1,367,817 | 18,528,526 | 793,556,645 | 813,461,426 | 7.3% | | 2026-08-23 | | 4,780 | 9,560 | 1,667,111 | 16,953,670 | 881,927,242 | 900,557,583 | 8.1% | | 2026-08-24 | | 1,004 | 2,008 | 449,421 | 4,405,346 | 169,736,444 | 174,593,219 | 1.6% | | 2026-08-25 | | 1,291 | 2,582 | 993,949 | 4,814,837 | 224,746,691 | 230,558,059 | 2.1% | | 2026-08-26 | | 58 | 116 | 24,692 | 311,333 | 3,235,406 | 3,571,547 | 0.0% | | 2026-08-27 | | 2,553 | 5,106 | 857,461 | 11,835,008 | 454,391,610 | 467,089,185 | 4.2% | | 2026-08-28 | | 2,850 | 5,700 | 1,229,085 | 13,010,965 | 392,932,032 | 407,177,782 | 3.7% | | 2026-08-29 | | 3,473 | 6,946 | 970,773 | 12,843,362 | 447,480,189 | 461,301,270 | 4.1% | | 2026-08-30 | | 2,462 | 4,924 | 885,887 | 10,238,581 | 324,734,530 | 335,863,922 | 3.0% | | 2026-08-31 | | 4,982 | 10,232 | 1,586,867 | 19,110,551 | 845,396,647 | 866,104,297 | 7.8% | | 2026-09-01 | | 847 | 1,694 | 211,710 | 2,434,666 | 136,336,798 | 138,984,868 | 1.2% | ## 4. Prețuri — verificate 2026-09-01 Pagina oficială **OpenCode Zen (`opencode.ai/docs/zen`) nu listează încă GLM-5.3 sau GLM-5.3-Flash.** Cele mai noi GLM de acolo: | Model pe Zen | Input | Output | Cache read | Cache write | |---|---:|---:|---:|---:| | GLM 5.2 | $1.40 | $4.40 | $0.26 | — | | GLM 5.1 | $1.40 | $4.40 | $0.26 | — | | GLM 5 | $1.00 | $3.20 | $0.20 | — | | Claude Opus 5 | $5.00 | $25.00 | $0.50 | $6.25 | | Claude Sonnet 5 | $2.00 | $10.00 | $0.20 | $2.50 | | Claude Fable 5 | $10.00 | $50.00 | $1.00 | $12.50 | | Claude Haiku 4.5 | $1.00 | $5.00 | $0.10 | $1.25 | Pentru GLM-5.3 am folosit **prețurile oficiale Z.AI** (furnizorul modelului). Zen revinde de regulă la același tarif — GLM 5.2 pe Zen e identic cu tariful Z.AI, ceea ce validează proxy-ul. | Model | Input | Cache read | Cache write | Output | |---|---:|---:|---:|---:| | **GLM-5.3** | $1.40 | $0.26 | *fără tarif separat* | $4.40 | | **GLM-5.3-Flash** (promo, până 2026-09-09 24:00 UTC+8) | $0.075 | $0.015 | *fără tarif separat* | $0.25 | | **GLM-5.3-Flash** (preț de listă) | $0.15 | $0.03 | *fără tarif separat* | $0.50 | Surse: [opencode.ai/docs/zen](https://opencode.ai/docs/zen/) · [docs.z.ai/guides/overview/pricing](https://docs.z.ai/guides/overview/pricing) · [openrouter.ai/z-ai/glm-5.3-flash](https://openrouter.ai/z-ai/glm-5.3-flash) > **Cache write:** niciun model GLM nu are tarif separat de cache creation (spre deosebire de modelele Claude de pe Zen). `cache_creation_input_tokens` se facturează deci la tariful de **input normal**. `cache_read_input_tokens` **nu** a fost tratat ca input normal — are tariful lui redus. Vezi Scenariul B pentru varianta fără cache. ## 5. Cost echivalent Zen — Scenariul A (tokeni reali, tarife de cache) | Model | Input | Cache read | Cache write | Output | **TOTAL** | |---|---:|---:|---:|---:|---:| | GLM-5.3 | $0.47 | $2817.52 | $403.51 | $102.51 | **$3324.02** | | GLM-5.3-Flash (promo) | $0.03 | $162.55 | $21.62 | $5.82 | **$190.02** | | GLM-5.3-Flash (listă) | $0.05 | $325.10 | $43.23 | $11.65 | **$380.03** | ### Medii | Model | / sesiune | / zi | / lună (30 zile) | |---|---:|---:|---:| | GLM-5.3 | $7.641 | $94.97 | $2849.16 | | GLM-5.3-Flash (promo) | $0.437 | $5.43 | $162.87 | | GLM-5.3-Flash (listă) | $0.874 | $10.86 | $325.74 | ## 6. Scenariul B — fără avantajul cache-ului Tot `cache_read` + `cache_creation` facturați ca input normal. | Model | A (cu cache) | B (fără cache) | Factor | |---|---:|---:|---:| | GLM-5.3 | $3324.02 | $15677.77 | **4.7×** | | GLM-5.3-Flash (promo) | $190.02 | $840.21 | **4.4×** | | GLM-5.3-Flash (listă) | $380.03 | $1680.43 | **4.4×** | ## 7. Comparație cu Claude Max 5x Nu există conversie oficială Anthropic din quota Max în tokeni, deci nu o inventez. Compar ce ai plătit cu ce ar fi costat exact aceiași tokeni la tarif per-token. | | Claude Max 5x | Zen GLM-5.3 | Zen GLM-5.3-Flash (promo) | Zen GLM-5.3-Flash (listă) | |---|---|---|---|---| | Cost pentru perioada măsurată | **$100/lună** | $3,324.02 | $190.02 | $380.03 | | Tokeni | 11,148,485,999 | identic | identic | identic | | Sesiuni | 435 | identic | identic | identic | | Modele | Opus 5, Sonnet 5, Fable 5, Haiku 4.5 | GLM-5.3 | GLM-5.3-Flash | GLM-5.3-Flash | ### Cât valorează de fapt abonamentul Max Aceiași 11,148,485,999 tokeni, **fiecare model la propriul lui tarif pe Zen** (Opus 5 la preț de Opus 5, Sonnet 5 la preț de Sonnet 5 etc.): # **$5,167.05** Abonamentul Max 5x de $100 a livrat consum care la tarif per-token ar fi costat **$5,167** — adică Max e de **52× mai ieftin** decât plata la token pentru exact aceleași modele. Asta e cifra cea mai importantă din tot raportul. ### Acoperirea celor $20 Zen | Model | Cost pentru consumul observat | % din $20 | De câte ori acoperă $20 consumul | |---|---:|---:|---:| | GLM-5.3 | $3,324.02 | 16,620% | **0.006×** | | GLM-5.3-Flash (promo) | $190.02 | 950% | **0.105×** | | GLM-5.3-Flash (listă) | $380.03 | 1,900% | **0.053×** | Scenariul B, fără cache: | Model | Cost | % din $20 | Acoperire | |---|---:|---:|---:| | GLM-5.3 | $15,677.77 | 78,389% | 0.001× | | GLM-5.3-Flash (promo) | $840.21 | 4,201% | 0.024× | | GLM-5.3-Flash (listă) | $1,680.43 | 8,402% | 0.012× | ### Cât consum încap în $20 | Model | Tokeni pentru $20 | % din consumul lunar | Zile la ritmul actual | Sesiuni | |---|---:|---:|---:|---:| | GLM-5.3 | 67,078,331 | 0.6% | 0.21 | 2.6 | | GLM-5.3-Flash (promo) | 1,173,426,044 | 10.5% | 3.68 | 45.8 | | GLM-5.3-Flash (listă) | 586,713,022 | 5.3% | 1.84 | 22.9 | ## 8. Abonamentele Z.AI GLM Coding Plan Planurile Z.AI nu se facturează pe tokeni, ci pe **prompturi** (turnuri umane) contorizate în credite, cu două limite simultane: una la 5 ore și una săptămânală. Documentația Z.AI notează că *„un prompt poate invoca modelul de 15–20 de ori"* — deci comparația corectă nu se face pe cererile API, ci pe prompturile tale reale. ### Prețuri (verificate 2026-09-01) | Plan | Lunar | Anual | Efectiv/lună anual | Economie | Prompturi / 5h | Prompturi / săpt. | Credite / săpt. | |---|---:|---:|---:|---:|---:|---:|---:| | Lite | $18.00 | **$151.20** | $12.60 | 30% | ~80 | ~400 | 10.000 | | Pro | $72.00 | **$604.80** | $50.40 | 30% | ~400 | ~2.000 | 60.000 | | Max | $160.00 | **$1.344,00** | $112.00 | 30% | ~1.600 | ~8.000 | 140.000 | Toate planurile includ **GLM-5.3 și GLM-5.3-Flash**. Surse: [docs.z.ai/devpack/overview](https://docs.z.ai/devpack/overview) · [aipricing.guru](https://www.aipricing.guru/z-ai-subscription-pricing/) ### Câte prompturi dai de fapt Am numărat prompturile umane reale (excluzând `tool_result`, care în transcript apar tot ca mesaje de tip `user`): | Mașină | Prompturi umane | Cereri API | Cereri / prompt | |---|---:|---:|---:| | `claude-agent` | 245 | 2.143 | 8,75 | | `moltbot` | 309 | 1.810 | 5,86 | | `LENOVO-AIO-BIRO` | **~8,451** *(estimat)* | 60,304 | 7.14 *(aplicat)* | | **TOTAL** | **~9,005** | 64,211 | 7.14 | > **Estimare marcată:** scriptul rulat pe Windows a raportat doar cererile API, nu și prompturile umane. Cifra pentru Windows e derivată din raportul măsurat pe cele două mașini Linux (7.14 cereri API per prompt). E singura extrapolare din tot raportul și e marcată ca atare. Raportul real pe Windows poate diferi — sesiunile de acolo par mai lungi, deci numărul de prompturi ar putea fi mai mic (și acoperirea planurilor, mai bună). Ritm rezultat: **~1,801 prompturi/săptămână** (~257/zi) pe 35 zile. ### Acoperire — la multiplicator 1× | Plan | Anual | Efectiv/lună | Prompturi/săpt. | Acoperă din nevoia ta | Verdict | |---|---:|---:|---:|---:|---| | Lite | $151.20 | $12.60 | ~400 | **22%** | insuficient | | Pro | $604.80 | $50.40 | ~2,000 | **111%** | **ACOPERĂ** | | Max | $1,344.00 | $112.00 | ~8,000 | **444%** | **ACOPERĂ** | ### Acoperire — dacă GLM-5.3 consumă credite multiplicat Z.AI aplică multiplicatori de credite modelelor mari (documentat 3× în orele de vârf și 2× off-peak pentru GLM-5.2 / GLM-5-Turbo; pentru GLM-5.3 multiplicatorul nu e publicat explicit). Dacă GLM-5.3 se contorizează la fel, acoperirea scade proporțional: | Plan | 1× (Flash / off-peak promo) | 2× (off-peak) | 3× (peak) | |---|---:|---:|---:| | Lite | 22% | 11% | 7% | | Pro | 111% | 56% | 37% | | Max | 444% | 222% | 148% | ### Comparație completă a opțiunilor | Opțiune | Cost efectiv/lună | Acoperă volumul tău? | Observație | |---|---:|---|---| | **Claude Max 5x** (actual) | $100.00 | **DA, 100%** | modelele Claude; $5,167 valoare la tarif per-token | | OpenCode Zen, GLM-5.3-Flash | $190.02 *(pay-per-token)* | da, dar costă 1.9× cât Max | fără plafon, dar fără reducere de abonament | | OpenCode Zen, GLM-5.3 | $3,324.02 *(pay-per-token)* | da, dar costă 33× cât Max | prohibitiv | | OpenCode Zen $20 (buget fix) | $20.00 | **NU — 10,5%** | vezi secțiunea 7 | | **Z.AI Coding Lite anual** | **$12.60** | NU — 22% la 1× | cel mai ieftin plan cu GLM-5.3 | | **Z.AI Coding Pro anual** | **$50.40** | **DA la 1× (111%)**, nu la 2–3× | cel mai bun raport dacă multiplicatorul e 1× | | **Z.AI Coding Max anual** | **$112.00** | **DA, cu marjă (444% la 1×, 148% la 3×)** | singurul sigur indiferent de multiplicator | ### Ce înseamnă asta concret **Z.AI Coding Pro anual ($604,80/an = $50,40/lună) e de departe cea mai interesantă opțiune din tot setul** — la ritmul tău de ~1,801 prompturi/săptămână, cota lui de ~2.000/săptămână acoperă 111% din volum, la **jumătate din prețul Max 5x**. Dar cu trei rezerve serioase: 1. **Marja e subțire.** 111% nu e mult peste 100%. O săptămână mai aglomerată decât media te scoate din cotă, și atunci aștepți resetarea. 2. **Multiplicatorul de credite e necunoscut pentru GLM-5.3.** Dacă e 2× sau 3× ca la GLM-5.2, Pro acoperă doar 56%–37% și ai nevoie de Max ($112/lună). 3. **Limita de 5 ore contează separat.** Media ta zilnică încape în cota de 5h a planului Pro (~400), dar zilele de vârf pot să nu încapă. Cotele sunt simultane: săptămânală ȘI la 5 ore. **Diferența de calitate rămâne argumentul decisiv.** Un plan Z.AI îți dă GLM-5.3, nu Opus 5. La tine 38% din volum rulează deja pe Opus 5 — muncă unde ai ales conștient modelul mare. ## 9. Scenariul real: Opus planifică, GLM-5.3-Flash execută Fluxul vizat înlocuiește **doar treapta de execuție** (azi Sonnet 5) cu GLM-5.3-Flash, păstrând Opus 5 pe Max pentru planificare. Asta nu e o felie arbitrară din volum — e exact împărțirea care se vede deja în date. | Treaptă | Model azi | Tokeni/lună | % volum | Turn-uri | Prompturi/săpt. *(est.)* | |---|---|---:|---:|---:|---:| | Planificare | Opus 5 | 4.27B | 38.3% | 25,343 | ~711 | | Execuție | Sonnet 5 | 6.71B | 60.2% | 37,902 | ~1,063 | | Alte | Fable 5 + Haiku | 165M | 1.5% | 966 | ~27 | ### Cât costă mutarea treptei de execuție | Variantă | Cost/lună | Observație | |---|---:|---| | Zen pay-per-token, Flash promo | $113.38 | tarif promoțional, expiră 2026-09-09 | | Zen pay-per-token, Flash listă | $226.77 | tariful de după | | Z.AI Coding **Lite** anual | $12.60 | cotă ~400 prompturi/săpt. = **38%** din nevoie | | Z.AI Coding **Pro** anual | $50.40 | cotă ~2.000/săpt. = **188%** din nevoie | | Z.AI Coding **Max** anual | $112.00 | cotă ~8.000/săpt. = 752% | Treapta de execuție are nevoie de **~1,063 prompturi/săptămână**. **Lite nu ajunge** (38%). **Pro ajunge cu marjă de 1.9×** — și, spre deosebire de comparația pe volumul total, aici marja e confortabilă. > **Detaliu în favoarea ta:** multiplicatorul de credite Z.AI (3× peak / 2× off-peak) e documentat pentru modelele mari, nu pentru cele „de rutină". GLM-5.3-**Flash** e modelul mic, deci probabil se contorizează la 1×. Dacă e așa, Pro acoperă treapta de execuție cu 188% și rămâne loc de creștere. Confirmă asta înainte să plătești anual. ### Calibrare cu OpenCode Go — datele tale reale OpenCode Go costă **$10/lună** și include limite exprimate în valoare de consum, nu în tokeni: | Limită | Valoare | |---|---:| | La 5 ore | $12 de consum | | Săptămânal | $30 de consum | | Lunar | $60 de consum | Abonamentul s-a consumat în 1–2 zile. Asta **confirmă independent** analiza: la volumul tău, consumul săptămânal echivalent e $38 pe GLM-5.3-Flash promo și $665 pe GLM-5.3 — deci plafonul săptămânal de $30 al lui Go se evaporă în 0.3 zile pe modelul mare și în 5.5 zile pe Flash. Un plan plafonat în dolari nu rezistă la acest volum, indiferent de furnizor. **De asta planurile Z.AI sunt altceva:** cota lor e în prompturi, nu în dolari de consum. Un prompt care declanșează 20 de invocări de model costă la fel ca unul care declanșează 2 — iar sesiunile tale au în medie 7.1 cereri API per prompt. Exact tipul de workload pe care tarifarea per-prompt îl avantajează, și pe care cea per-dolar îl penalizează. ## 10. Problema reală: plafonul general săptămânal Max 5x Max 5x are **două plafoane săptămânale** — unul general, pe toate modelele, și unul separat pentru Opus. Limita atinsă e cea **generală**, ceea ce înseamnă că un supliment pe GLM-5.3-Flash chiar poate ajuta: fiecare prompt mutat în altă parte eliberează cotă de Max. ### Tiparul se vede în date | Săptămână | Total | Profil zilnic (M tokeni, Lu→Du) | |---|---:|---| | 2026-W31 | 0.80B | We **22** · Th **171** · Sa **256** · Su **348** | | 2026-W32 | 3.40B | Mo **557** · Tu **41** · We **96** · Th **509** · Fr **432** · Sa **853** · Su **911** | | 2026-W33 | 0.93B | Mo **655** · Tu **229** · We **40** · Th **8** · Fr **1** · Sa **1** · Su **1** | | 2026-W34 | 2.93B | Mo **2** · Tu **42** · We **146** · Th **339** · Fr **690** · Sa **813** · Su **901** | | 2026-W35 | 2.08B | Mo **175** · Tu **231** · We **4** · Th **467** · Fr **407** · Sa **461** · Su **336** | | 2026-W36 | 1.01B | Mo **866** · Tu **139** | **Săptămâna W33 e semnătura manualului pentru un plafon atins:** 655M luni, 229M marți, apoi 40M, 8M, 1M, 1M, 1M. Cota s-a consumat în două zile, urmate de cinci zile moarte. Exact ce descrii. Prin contrast, W32 și W34 au mers 7 zile din 7, la 2,93–3,40B. - **Zile efectiv blocate** (sub 50M tokeni): **10 din 34** = 29% - **Zi activă mediană:** 419M tokeni - **Livrat efectiv de Max 5x:** 2.23B/săptămână - **Cerere dacă ai lucra 7 zile din 7 la ritmul median:** 2.94B/săptămână - **Deficit: 0.71B/săptămână = +32%** ≈ **~570 prompturi/săptămână** > Deficitul e o estimare **conservatoare**: presupune că în zilele blocate ai lucra la ritm median (419M), nu la ritmul zilelor bune (peste 850M). Cererea reală suprimată e probabil mai mare. Nu se poate măsura direct — Claude Code nu persistă evenimentele de limită în transcript, apar doar în stream-ul SDK. ### Ce plan acoperă deficitul Nu trebuie mutat tot volumul — doar atât cât să elibereze cota lipsă. | Plan | Lunar | Anual (efectiv/lună) | Cotă/săpt. | Acoperă deficitul de ~570 | Zile blocate rămase | |---|---:|---:|---:|---:|---:| | Lite | $18.00 | $12.60 | ~400 | **70%** | ~0.6/săpt. | | Pro | $72.00 | $50.40 | ~2,000 | **351%** | ~0.0/săpt. | | Max | $160.00 | $112.00 | ~8,000 | **1403%** | ~0.0/săpt. | Azi ai ~2.0 zile blocate pe săptămână. **Lite ar duce-o la ~0.6**, **Pro la zero**, cu marjă de 3.5× pentru creștere. ### Verificare din a doua direcție Dacă muți **toată** treapta de execuție (Sonnet 5, 59% din turn-uri, ~1,063 prompturi/săpt.) pe GLM-5.3-Flash, eliberezi 59% din cota Max — care ar ține atunci de **2.4× mai mult**, adică toată săptămâna în loc de două zile. Pentru asta ai nevoie de ~1,063 prompturi/săpt.: **Lite (38%) nu ajunge, Pro (188%) ajunge cu marjă.** Cele două calcule dau răspunsuri diferite pentru Lite pentru că măsoară lucruri diferite: primul, cât lipsește ca să nu mai fii blocat; al doilea, cât ar costa mutarea completă a treptei de execuție. **Nu ai nevoie de mutarea completă** — ai nevoie doar de deficit. ## 11. Fișiere generate | Fișier | Conținut | |---|---| | `claude_usage_report.md` | acest raport | | `claude_usage_sessions.csv` | 435 rânduri, una per sesiune | | `claude_usage_summary.csv` | agregate: TOTAL, mașină, model, lună, zi | | `tools/claude_usage_extract.py` | extractorul read-only (rulabil remote: `ssh host 'python3 -' < script`) | | `tools/claude_usage_report.py` | agregator + CSV | | `tools/claude_usage_md.py` | generatorul acestui raport | ## 12. CONCLUZIE ### „Dacă păstrez Claude Max 5x $100 și adaug OpenCode Zen $20, cât coding suplimentar obțin?" **Foarte puțin — aproximativ 3.7 zile pe lună, în cel mai bun caz.** Consumul real pe 35 zile, pe trei mașini: **11.15 miliarde de tokeni**, 435 sesiuni, 64,211 cereri API. La acest volum, $20 nu sunt un supliment — sunt o rotunjire. | | GLM-5.3 | GLM-5.3-Flash (promo) | GLM-5.3-Flash (listă) | |---|---:|---:|---:| | Cost pentru volumul tău lunar | $3,324 | $190 | $380 | | Cât din el acoperă $20 | 0.6% | **10.5%** | 5.3% | | Zile de lucru din $20 | 0.21 | **3.7** | 1.8 | ### Punct cu punct **1. Ar fi fost $20 Zen suficienți pentru consumul observat?** **NU, pe niciun model.** - GLM-5.3-Flash (promo): $190.02 — de **9.5× peste buget**. Cel mai bun caz posibil. - GLM-5.3-Flash (listă, după 9 sept.): $380.03 — de **19× peste buget**. - GLM-5.3: $3,324.02 — de **166× peste buget**. - Fără cache (Scenariul B), chiar și Flash promo ajunge la $840.21 — de 42× peste. **2. Câte sesiuni/zi înseamnă?** Ritmul real: **12.4 sesiuni/zi**, 319M tokeni/zi. Cu $20 obții: - GLM-5.3-Flash promo: **3.7 zile** (~46 sesiuni) - GLM-5.3-Flash listă: **1.8 zile** (~23 sesiuni) - GLM-5.3: **0.21 zile** (~3 sesiuni) — sub o zi **3. Ce model e mai avantajos?** **GLM-5.3-Flash**, de **17.5× mai ieftin** decât GLM-5.3. Diferența absolută pe consumul tău: **$3,134.00** ($3,324.02 vs $190.02). La preț de listă diferența rămâne **$2,943.99**. Compromisul e de calitate — Flash e modelul mic. **4. Diferența de cost GLM-5.3 vs GLM-5.3-Flash** | | GLM-5.3 | Flash (promo) | Flash (listă) | |---|---:|---:|---:| | Total | $3,324.02 | $190.02 | $380.03 | | Pe zi | $94.97 | $5.43 | $10.86 | | Pe sesiune | $7.641 | $0.437 | $0.874 | | Raport față de GLM-5.3 | 1× | 17.5× mai ieftin | 8.7× mai ieftin | **5. Ce procent din utilizarea Claude poate fi mutat realist pe Zen?** Structura reală: **60%** Sonnet 5, **38%** Opus 5, 1.5% Fable 5, restul Haiku. Întrebarea corectă nu mai e „ce procent muți", ci **„cât încape în $20"** — și răspunsul e **10.5%** din volum, la cel mai ieftin tarif posibil. Chiar dacă ai muta pe Zen absolut tot ce rulează azi pe Sonnet, ai depăși bugetul de câteva ori. Cu $20/lună pe GLM-5.3-Flash poți acoperi realist **~11% din volum** — echivalentul a ~1173M tokeni. Ținta rezonabilă: **un singur flux automat**, mic și bine delimitat (un bot, un job de noapte, un agent în buclă), nu o felie procentuală din tot ce faci. **6. Dar abonamentele Z.AI?** Aici răspunsul e cu totul altul decât la Zen $20. La ~1,801 prompturi/săptămână: | | Efectiv/lună (anual) | Acoperire la 1× | Acoperire la 3× | |---|---:|---:|---:| | Z.AI Coding **Lite** | $12.60 | 22% | 7% | | Z.AI Coding **Pro** | $50.40 | **111%** | 37% | | Z.AI Coding **Max** | $112.00 | 444% | **148%** | **Lite ($12,60/lună) e opțiunea potrivită pentru rolul pe care îl căutai la Zen $20** — cost similar, dar acoperă 22% din volum în loc de 10.5%, adică de **2× mai mult** pentru aceiași bani. Modelul de abonament bate plata la token, exact cum o face și Max față de tarifele Zen. ### Recomandare **Păstrează Max 5x — la $5,167 valoare per-token pentru $100 plătiți, e cea mai bună afacere din tot setul de date.** Nu e nimic de optimizat acolo. **Nu lua OpenCode Zen $20.** La volumul tău e o rotunjire (10,5%), iar pentru bani similari Z.AI Coding Lite anual ($12,60/lună) îți dă de 2× mai mult. Singurul motiv real pentru Zen ar fi accesul la multe modele diferite dintr-un singur cont, nu volumul. **Dacă vrei capacitate suplimentară serioasă**, ordinea corectă e: 1. **Z.AI Coding Lite anual, $12,60/lună** — ca supliment: preia un flux automat întreg (tot `moltbot` = 195M tokeni/lună) și îți lasă Max liber pentru munca grea. Risc mic, cost mic. **Aici aș începe.** 2. **Z.AI Coding Pro anual, $50,40/lună** — dacă vrei să muți o felie mare din volum. Acoperă 111% la 1×, dar doar 37% dacă GLM-5.3 se contorizează la 3×. Verifică multiplicatorul înainte, e diferența dintre „ajunge" și „nu ajunge". 3. **Z.AI Coding Max anual, $112/lună** — singurul care acoperă volumul indiferent de multiplicator, dar la acel preț compari direct cu un al doilea Max 5x sau cu Max 20x, unde primești Opus 5 în loc de GLM-5.3. **Testul decisiv nu e de preț, e de calitate.** Toate variantele Z.AI îți dau GLM-5.3, nu Opus 5, iar 38% din volumul tău rulează pe Opus 5 pentru că ai ales asta. Ia Lite anual o lună, rutează pe el fluxurile automate, și vezi dacă rezultatul e acceptabil înainte să muți ceva important. **Rolul rămas pentru Zen $20** (dacă îl iei totuși) e restrâns: - **buget de experiment** — să testezi dacă GLM-5.3-Flash e destul de bun pe un flux anume, înainte să iei o decizie mai mare; - **overflow de urgență** — dacă atingi limita Max într-o zi aglomerată, ai un backup care costă cenți pe oră; - **un singur job automat mic** — de exemplu tot ce rulează pe `moltbot` (195M tokeni = $3.81/lună pe Flash promo, 19% din buget). ### Rezerve 1. **`claude-agent` are doar 5 zile din 35** cu transcripturi păstrate; consumul lui real e mai mare decât cei 306M măsurați. Nu am extrapolat. Efectul e mic la scara totalului (2,7%), dar direcția e clară: totalul real e mai mare, nu mai mic. 2. **Alte mașini Windows** din tailnet (`marius-hx90g`, `lenovo-aio-h1`, `lg17`, `roa-carapetru2`) nu au fost scanate — erau offline. Dacă rulezi Claude Code și pe ele, totalul crește. 3. **Cache hit rate-ul e ipoteza critică:** 97.2% din volum e cache read. OpenCode cu GLM nu garantează același comportament de caching ca Claude Code — Scenariul B ($840 în loc de $190) e cazul rău, și nu e improbabil. 4. **Prețul Flash e promoțional** până pe 2026-09-09; se dublează după. 5. **GLM-5.3 nu e listat oficial pe OpenCode Zen** — am folosit tariful Z.AI ca proxy, validat prin faptul că GLM 5.2 are pe Zen exact prețul Z.AI. 6. **Datele Windows au trecut printr-o conversie de tabel** (TAB + date M/D/YYYY). UUID-urile și valorile numerice au fost validate, dar nu am putut verifica independent fișierele sursă.