chore: auto-commit from dashboard

This commit is contained in:
2026-07-10 15:12:22 +00:00
parent 7b44749e5a
commit 738dc0181a
13 changed files with 383 additions and 44 deletions

View File

@@ -1,5 +1,21 @@
{
"notes": [
{
"file": "notes-data/youtube/2026-07-10_opencode-token-usage-96-percent.md",
"title": "I Cut My OpenCode Token Usage by 96% - Here's How",
"date": "2026-07-10",
"tags": [],
"domains": [
"work",
"growth"
],
"types": [],
"category": "youtube",
"project": null,
"subdir": null,
"video": "",
"tldr": "Autorul folosește un proxy man-in-the-middle pentru a vedea exact ce trimite OpenCode (agent de coding AI) către LLM la un simplu \"hello\" — și găsește 8.000 de tokeni: system prompt de 9.500 caractere..."
},
{
"file": "notes-data/youtube/2026-07-08_fine-tune-modele-mari-kimi-k27.md",
"title": "Fine-Tune the biggest open-source models (even with a bad PC)",
@@ -10192,11 +10208,11 @@
}
],
"stats": {
"total": 589,
"total": 590,
"by_domain": {
"work": 201,
"work": 202,
"health": 104,
"growth": 274,
"growth": 275,
"sprijin": 39,
"scout": 9
},
@@ -10213,7 +10229,7 @@
"reflectii": 3,
"retete": 1,
"tools": 7,
"youtube": 158,
"youtube": 159,
"memory": 44
}
},

View File

@@ -14,7 +14,7 @@
- **[reflectii/](reflectii/index.md)** — 3 note
- **[retete/](retete/index.md)** — 1 note
- **[tools/](tools/index.md)** — 7 note
- **[youtube/](youtube/index.md)** — 158 note
- **[youtube/](youtube/index.md)** — 159 note
## Note la rădăcină

View File

@@ -0,0 +1,48 @@
# I Cut My OpenCode Token Usage by 96% - Here's How
**URL:** https://youtu.be/FX7jcd3GYtI
**Durata:** 9:42
**Data salvat:** 2026-07-10
**Tags:** @work @growth @ai @agents @llm
---
## TL;DR
Autorul folosește un proxy man-in-the-middle pentru a vedea exact ce trimite OpenCode (agent de coding AI) către LLM la un simplu "hello" — și găsește 8.000 de tokeni: system prompt de 9.500 caractere + 11 definiții de tool-uri (bash, task, edit, read etc.) trimise la FIECARE request, plus un al doilea apel LLM ascuns doar pentru titlul conversației. Soluția: creează un agent custom minimal (fără tools, system prompt scurt) → 300-500 tokeni, reducere ~90-96%. Recomandare: pornește minimal, adaugă tools doar când chiar ai nevoie de ele.
---
## Puncte cheie
- **8.000 tokeni pentru "hello"** — 0,025% e mesajul propriu-zis, restul e scaffolding (system prompt + tool definitions)
- OpenCode face **2 apeluri LLM** per mesaj: unul ascuns doar ca să genereze titlul conversației (~2.000 tokeni, pt un titlu de 1 cuvânt)
- System prompt default: ~114 linii, spune LLM-ului tot ce poate/nu poate face, format, emoji, etc.
- 11 tool definitions trimise mereu — bash tool singur = 4.700 caractere, task tool = 3.000 caractere
- **Cache-ul providerului NU te ajută pe tine** — reduce costul $ pentru provider, dar tot trimiți full payload pe rețea, tot consumi context window și latență
- Soluție: agenți custom minimali (folder `.opencode/agents/*.md`) cu system prompt scurt și zero/puține tools, setați ca `primary` — switch cu Tab între agent complet (build) și agent lean
- Trade-off: agentul lean nu are task/sub-agents, web fetch, etc. — dar poți adăuga selectiv doar ce ai nevoie
- Filosofie: **start minimal, expand when necessary** — nu monta toate tool-urile/MCP-urile by default
---
## Quote-uri relevante
> "8,000 tokens. That's what it cost me to say hello to an AI coding agent."
> "Cached tokens are a cost optimization for the provider, not you. For you, it's still 8,000 tokens of latency and context window usage."
> "Start minimal and expand when necessary."
---
## Idei acționabile pentru Marius
- [ ] Relevant pentru Claude Code / echo-core: verifică dacă subagenții custom (`Agent` tool) pot fi definiți cu scope minim (fără tool-uri inutile) pentru task-uri simple, ca să reduci tokeni pe apelurile dese (heartbeat, routine checks) @work
- [ ] Ideea de "agent lean vs agent complet, switch la nevoie" se mapează pe strategia ta Haiku/Sonnet din AGENTS.md — poate merită un al treilea nivel: agent minimal fără tools pentru întrebări simple @growth
---
## Surse menționate
- Repo GitHub cu scriptul proxy + config agent (menționat, link nu apare explicit în transcript)

View File

@@ -1,6 +1,6 @@
# Index — youtube/
> 158 note. Citește acest index întâi; deschide doar fișierele relevante.
> 159 note. Citește acest index întâi; deschide doar fișierele relevante.
- **[Talk to Claude on 3CX Phone System Tutorial (Full Setup)](2025-02-13_talk-to-claude-3cx-phone.md)** `@work`
Tutorial complet pentru a vorbi cu Claude Code prin telefon, folosind 3CX (sistem telefonic cloud gratuit) + un proiect GitHub custom. Setup
@@ -316,5 +316,7 @@
Chris Koerner explică cum pornești o afacere cu $1k-$5k și ce principii l-au dus la succes cu 35+ proprietăți RV și multiple business-uri. E
- **[Fine-Tune the biggest open-source models (even with a bad PC)](2026-07-08_fine-tune-modele-mari-kimi-k27.md)** `@work @growth`
Tutorial complet despre cum se fine-tunează modele AI masive (ex: Kimi K2.7 — 1 trilion parametri) pe date proprii, fără hardware de sute de
- **[I Cut My OpenCode Token Usage by 96% - Here's How](2026-07-10_opencode-token-usage-96-percent.md)** `@work @growth`
Autorul folosește un proxy man-in-the-middle pentru a vedea exact ce trimite OpenCode (agent de coding AI) către LLM la un simplu "hello" —
- **[thinking-on-paper](thinking-on-paper.md)** `@growth`
Metoda "Thinking on Paper" — 3 principii: **Make it Wrong** (scrie repede, fără perfecționism), **Make it Shorter** (doar keywords), **Make