PROGRESS: starea Q&A (transcriere pe 2 masini) + deciziile de format

Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>
Claude-Session: https://claude.ai/code/session_01MtSTyTmt6AbCL9j5ajEDm1
This commit is contained in:
Claude Agent
2026-09-12 15:20:24 +00:00
parent fc3c3f5897
commit 0d3f5f7e2f
2 changed files with 50 additions and 0 deletions

View File

@@ -19,6 +19,56 @@ pe Gitea. Pagină publicată (Tailscale, doar în tailnet):
Toate transcrise (`transcripts/`) și sumarizate (`summaries/`), diagrame
verificate vizual (Playwright + server local), pe Gitea până la ultimul commit.
## În curs: Q&A (28 sesiuni) — pornit 2026-09-12 15:18
Userul a cerut extinderea la Q&A, apoi cele 5-6 lecții 1:1, apoi Analiza
Zilnică (147). Decizii luate cu el:
- **Format Q&A**: un fișier per sesiune, dar structurat pe *subiecte* cu
titluri descriptive (nu pe dată), plus `summaries/09_QA/INDEX_TEMATIC.md`
care adună toate întrebările din toate sesiunile pe temă.
- **Întrebările administrative se aruncă** (o linie la final cu câte).
- **Diagrame doar unde adaugă ceva** (mecanism de preț, exemplu numeric,
setup) — nu pentru răspunsuri de proces/psihologie.
- **Sample aprobat**: `summaries/09_QA/01_2026-08-25.md` (commit `fc3c3f5`).
E referința canonică pentru restul sesiunilor Q&A.
### Transcriere în curs — DOUĂ mașini
- **local (claude-agent)**: `tmux qa_local`, 16 fișiere, log
`transcribe_qa_local.log`. Măsurat: `medium` int8, 4 cores = 0.56x
durata audio.
- **moltbot** (LXC, 6 cores, fără GPU): `tmux qa_molt`, 12 fișiere în
`/root/atm/audio`, script `/root/atm/tr_worker.py`, log `/root/atm/tr.log`.
Rulează `medium` int8 cu `cpu_threads=5` (lasă 1 core pentru code-server
și ttyd, care rulează acolo). Venv: `/home/moltbot/echo-core/.venv`.
Acces: Tailscale SSH ca `root@moltbot` (userul a autorizat o dată).
- Split făcut LPT greedy **pe durată**, nu pe număr (sesiunile variază
5 min - 3h24m). ETA ~15.7h ambele. Backup audio pentru moltbot rămâne
local în `audio/09_Q_and_A_molt/`.
- **După ce termină**: adu transcrierile de pe moltbot în
`transcripts/09_Q_and_A/` (`scp root@moltbot:/root/atm/transcripts/*.txt`),
apoi sumarizează în formatul din sample.
### A/B pe modele, deja făcut — nu-l repeta
`whisper-small-ro-cv11-int8` (fine-tunat RO, există pe moltbot) e
**inutilizabil** pe conținutul ăsta: "MP4 short" → "empe patrat şort",
"PDF" → "pe-defect", "poziția" → "poliția". Fine-tunat pe Common Voice
(vorbire citită), se rupe pe live Zoom cu jargon englezesc. `medium`
generic câștigă clar și nu e nici mai lent (moltbot small-ro: 2.26x
realtime; local medium: 1.78x).
### Ce urmează după Q&A
1. Cele 5-6 lecții 1:1 (module 11, 17, 18, 20, 21, 22 — câte 1 lecție).
Formatul se decide **după** transcriere — nu știm dacă e mentorat
personal (irelevant) sau conținut tehnic.
2. Analiza Zilnică (147). Userul vrea un **sample separat** pe un fișier
înainte, ca să aprobe un template — nu porni în masă fără asta.
### Modificări de infrastructură făcute pentru asta
- `extract_audio.py`: `--only <modul>` acum **ocolește** `CORE_MODULES`
(înainte filtra întâi pe ele); `--lectures N` limitează la primele N.
- `render_html.py`: adăugat extensia `toc`, ca headingurile să primească
`id` — fără ea link-urile din `INDEX_TEMATIC.md` n-au unde ateriza.
## Ce a rămas — blocat de acces (`purchase_required`)
Modul 5 (7), Modul 6 (6), Master ATM 1-4 (4+3+5+3=15) = **28 lecții**.
Dacă userul primește acces: rulează din nou

View File