Verificarea integrala a gasit in toate cele 10 documente lucruri pe care verificarea pe diff nu le vedea. Tiparul dominant: citate normalizate tacit - ASR-ul strica un cuvant, cine scrie il repara in interiorul ghilimelelor, si citatul nu mai e al lui. Co-Authored-By: Claude Opus 5 <noreply@anthropic.com> Claude-Session: https://claude.ai/code/session_01ThN7ixZrowca8aTGrK1MUJ
64 lines
2.6 KiB
Python
64 lines
2.6 KiB
Python
#!/usr/bin/env python3
|
|
"""Verificare INTEGRALA, nu doar pe diff: un verificator per document, pe tot
|
|
textul. Documentele sunt mari (1000-2700 de linii), deci agentul citeste pe
|
|
bucati si raporteaza unde a ajuns daca nu termina.
|
|
"""
|
|
import pathlib
|
|
import subprocess
|
|
|
|
D = "summaries/08_ANALIZA_ZILNICA/"
|
|
DOCS = [
|
|
"01_buy_doji_si_strategia_mici.md",
|
|
"02_mbt10.md",
|
|
"03_locul_crimei_si_pullback.md",
|
|
"04_pivoti_si_proiectii.md",
|
|
"05_volum.md",
|
|
"06_structura_trend.md",
|
|
"07_context_de_piata.md",
|
|
"08_executie_si_risc.md",
|
|
"09_earnings_si_optiuni.md",
|
|
"10_sinteza.md",
|
|
]
|
|
|
|
P = (
|
|
"Lucrezi in /workspace/atm-curs-dl. Verifici INTEGRAL {doc} ({n} linii) si NU "
|
|
"modifici nimic. Nu te uita la git diff: de data asta verifici tot documentul, "
|
|
"de la cap la coada, nu doar ce s-a schimbat recent. "
|
|
"PROCEDURA: citeste documentul in bucati de 200 de linii cu sed -n. Pentru "
|
|
"fiecare citat pe care il intalnesti (forma (fisier.txt:linii)), deschide "
|
|
"sursa cu sed -n '<linii>p' pe fisierul din transcripts/08_*/ si compara "
|
|
"cuvant cu cuvant. Nu sari niciun citat si nu presupune ca unul e bun pentru "
|
|
"ca suna plauzibil. "
|
|
"Ordinea gravitatii: (1) citat inventat sau compus din doua sesiuni, "
|
|
"(2) citat normalizat - ghilimelele contin alte cuvinte decat transcrierea, "
|
|
"(3) numar de linie gresit, (4) citat real dar pe langa subiectul pentru care "
|
|
"e pus, (5) contradictie interna intre doua locuri din document, "
|
|
"(6) deductie nemarcata data ca vorbele lui, (7) regula sprijinita pe "
|
|
"sesiunile inlocuitorului (38_30062026, 39_29062026, 40_26062026, "
|
|
"41_25062026 - atentie, uneori e citat tickerul, nu fisierul), (8) text "
|
|
"orfan: titlu, TLDR, nota finala sau trimitere interna ramasa pe o formulare "
|
|
"pe care corpul n-o mai sustine. "
|
|
"Daca ajungi la ~250k tokeni, opreste-te, spune pana la ce linie ai ajuns si "
|
|
"ce ai gasit pana acolo - un raport partial onest e mai util decat unul "
|
|
"complet inventat. "
|
|
"RAPORT: o linie per problema, cu doc:<linie>, ce scrie, ce zice sursa si "
|
|
"citatul exact din sed; 'ok' pe o linie pentru categoriile curate; la final "
|
|
"pana la ce linie ai verificat si un verdict."
|
|
)
|
|
|
|
pathlib.Path(".opencode/lot_verif_full.txt").write_text(
|
|
"\n".join(
|
|
"{}\t{}".format(
|
|
f[:2],
|
|
P.format(
|
|
doc=D + f,
|
|
n=subprocess.run(["wc", "-l", D + f], capture_output=True, text=True)
|
|
.stdout.split()[0],
|
|
),
|
|
)
|
|
for f in DOCS
|
|
)
|
|
+ "\n"
|
|
)
|
|
print(len(DOCS), "sarcini de verificare integrala")
|