docs(maria): a doua instalare, pe LXC 104, si de ce diagnosticul a dus in eroare
Prototipul a ramas sa ruleze pe LXC 104 (/root/maria-whatsapp-bridge/), in afara git-ului, si aceea era Maria conectata la WhatsApp — nu cea din git, de pe 171. Indexul ei avea 24 de chunk-uri dintr-un singur fisier, deci inventa raspunsuri la orice iesea din subiectul roaauto. Pe 171 totul parea rupt (nimic pe 8091, WhatsApp neasociat, rag.log fara activitate) desi utilizatorul primea raspunsuri pe telefon. Notat in README cum se verifica intai care instanta e conectata, ca sa nu se mai piarda timp asa. Notat si ca LLM-ul de raspuns (llama.cpp, Qwen3.5-2B-Q4, port 8091) ruleaza pe LXC 104 si se foloseste prin retea; pe 171 Ollama are doar embeddings. Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com> Claude-Session: https://claude.ai/code/session_01Q4uzvgm7AyJch5WH8QHRhY
This commit is contained in:
@@ -18,6 +18,35 @@ Nu confunda cu:
|
||||
- **Punte Discord -> Claude Code** (`discord-bridge/`, acelasi container) — alt
|
||||
proiect, alt scop (comanda Claude Code de pe Discord, nu suport RAG).
|
||||
|
||||
## ATENTIE: a existat o a doua instalare, pe LXC 104
|
||||
|
||||
Prototipul din care a plecat acest proiect a fost lasat sa ruleze pe **LXC 104
|
||||
(Flowise)**, in `/root/maria-whatsapp-bridge/` — in afara git-ului, cu propriul
|
||||
`consumer.py`, propriul `rag_index.json` si propriul `auth/` de WhatsApp.
|
||||
|
||||
Pana pe 2026-08-31, **aceea era Maria care raspundea de fapt pe WhatsApp**, iar cea
|
||||
din git (LXC 171) nu fusese niciodata asociata. Indexul prototipului avea 24 de
|
||||
chunk-uri dintr-un singur fisier (`roaauto_instructiuni.txt`), deci raspundea
|
||||
inventand la orice intrebare din afara acelui subiect — inclusiv e-Factura.
|
||||
|
||||
Confuzia a costat timp de diagnostic: pe LXC 171 totul parea rupt (niciun LLM pe
|
||||
8091, WhatsApp neasociat, `rag.log` fara activitate) desi utilizatorul primea
|
||||
raspunsuri. Explicatia era ca ne uitam la containerul gresit.
|
||||
|
||||
**Daca depanezi Maria, verifica intai pe ce container ruleaza instanta conectata:**
|
||||
|
||||
```bash
|
||||
# aici (LXC 171)
|
||||
curl -s http://127.0.0.1:8099/status
|
||||
# pe LXC 104, daca mai exista
|
||||
ssh root@10.0.20.201 "pct exec 104 -- curl -s http://127.0.0.1:8099/status"
|
||||
```
|
||||
|
||||
LLM-ul de raspuns (`llama.cpp` cu `Qwen3.5-2B-Q4_K_M`, port 8091) ruleaza tot pe
|
||||
LXC 104 si e folosit prin retea: `LLM_URL=http://10.0.20.161:8091`. Pe LXC 171 nu
|
||||
exista niciun model de chat — Ollama de aici are doar `nomic-embed-text`, pentru
|
||||
embeddings.
|
||||
|
||||
## Arhitectura
|
||||
|
||||
```
|
||||
|
||||
Reference in New Issue
Block a user