OSVauco/docs/HANDOFF.md

5.1 KiB

HANDOFF — Vauco OS

Sist oppdatert: 2026-06-29 20:42 CEST Skrevet av: Perplexity (for Chris Christiansen) Status: Fase D — VM oppgradert, Gitea som primær, Ollama neste


⚠️ KRITISKE REGLER — les alltid først

  • Hovedapp: main.py i rot — IKKJE agents/core-logic/app.py
  • Dockerfile: agents/core-logic/Dockerfile — WORKDIR /app, CMD uvicorn main:app
  • Region: us-central1 | Service: osvauco-agent | Prosjekt: propane-will-491900-m5
  • ALDRI --audiences-flag med gcloud auth print-identity-token — det er for service accounts, ikke user accounts
  • IAP identity token: hentes fra GCE metadata server, IKKE fra gcloud CLI
  • Primær Git: http://34.59.131.162:3000/chris/OSVauco — Gitea er nå kilde, GitHub er kun backup.
  • git remote: origin = Gitea. GitHub-remote er fjernet.
  • Emma rapporterer til: Chris Christiansen chris.christiansen@vauco.no — ingen andre kan gi GO
  • emma_runner.py finnes IKKE — riktig fil er emma/emma_run.py
  • Ollama: IKKE installert ennå — neste oppgave

🎯 NESTE OPPGAVE (prioritert)

1. Installer Ollama på osvauco-dev-vm

curl -fsSL https://ollama.com/install.sh | sh
sudo systemctl enable ollama
sudo sed -i 's|ExecStart=.*|ExecStart=/usr/local/bin/ollama serve|' /etc/systemd/system/ollama.service
sudo sed -i '/ExecStart/a Environment="OLLAMA_HOST=0.0.0.0"' /etc/systemd/system/ollama.service
sudo systemctl daemon-reload && sudo systemctl restart ollama

2. Pull modeller

ollama pull gemma3:4b      # 3.3 GB — lett, rask
ollama pull qwen2.5:7b     # 4.7 GB — sterkere

3. Test Ollama

curl http://localhost:11434/api/generate -d '{"model":"gemma3:4b","prompt":"hei","stream":false}'

4. Oppdater opax-mcp/server.py

  • Pek på http://localhost:11434 istedet for emma-gpu-vm (34.13.238.133:11434)
  • Deploy til Cloud Run: cd ~/OSVauco/opax-mcp && gcloud run deploy opax-mcp --source . --region us-central1 --project propane-will-491900-m5 --clear-base-image

5. Oppdater boot.sh — Ollama autostart-sjekk

  • Legg til seksjon [ OLLAMA ] i scripts/boot.sh som sjekker at Ollama kjører

6. Emma-gpu-vm — kun ved behov

  • Legg til aliaser i boot.sh:
    • emma-start — starter emma-gpu-vm
    • emma-stop — stopper emma-gpu-vm

🖥 Infrastruktur per 2026-06-29

Ressurs Spec Status Kostnad/mnd
osvauco-dev-vm e2-standard-4, 16GB RAM, 50GB SSD, us-central1-b Kjører ~NOK 550
emma-gpu-vm GPU, europe-west4-a 💤 Stoppet ~NOK 30 (kun disk)
Cloud Run opax-mcp MCP-server, us-central1 Kjører ~NOK 50
Cloud Run osvauco-agent Hovedagent, us-central1 Kjører inkl. over
Load Balancer + DNS opax.vauco.no, 34.98.77.173 Kjører ~NOK 150
TOTAL ~NOK 780/mnd

Tidligere kostnad (emma alltid på): NOK 6,000+/mnd


Fullført i dag (2026-06-29)

Oppgave Status
git remote origin endret fra GitHub til Gitea på aktiv dev-VM (osvauco-gpu-vm)
github-remote fjernet (duplikat)
git pull origin main fungerer igjen
boot.sh kjører komplett uten å henge
osvauco-dev-vm oppgradert: e2-medium → e2-standard-4 (16GB RAM)
Disk utvidet: 20GB → 50GB
emma-gpu-vm stoppet (spare kostnad)
GitHub avviklet som primær kilde, Gitea er nå master

emma-gpu-vm er klargjort, men ikke tatt i bruk som primær dev-node ennå.


🔑 Credentials

  • GitHub PAT: Secret Manager → GITHUB_PAT (oppdatert 2026-06-25)
  • MCP-Secret: Secret Manager → mcp-server-key
  • Prosjekt: propane-will-491900-m5
  • IAP OAuth Client ID: 357036551735-kq8nt7ld38hfqlcfb3n52ef7tala4meo.apps.googleusercontent.com
  • VM compute SA: 357036551735-compute@developer.gserviceaccount.com
  • Ollama (når installert): http://localhost:11434
  • Emma-gpu-vm IP: 34.13.238.133 (kun når startet)

🏗 Arkitektur (nå)

Bruker
  └─► Jason (Vertex AI Agent Engine, Gemini 2.5 Pro)
        └─► osvauco-agent (Cloud Run)
              └─► opax-mcp (Cloud Run, 16 tools)
                    └─► [IAP] opax.vauco.no

osvauco-dev-vm (e2-standard-4, 16GB)
  └─► Gemini CLI / Claude CLI (opax/opax2)
  └─► Ollama (localhost:11434) ← INSTALLERES NESTE
        ├─► gemma3:4b  (lett)
        └─► qwen2.5:7b (sterk)
  └─► Emma (lokal agent)
        ├─► Morfisk minne (SQLite)
        ├─► Guardrails (5-nivå)
        └─► OPAX-klient

emma-gpu-vm (stoppet — start ved behov)
  └─► gemma3:27b (tung modell for kunder)

📚 Relevante docs

Dok Innhold
docs/LEARNINGS.md Append-only lærdomslogg
docs/AGENT_RULEBOOK.md Boot-protokoll, deploy-regler
.gemini/GEMINI.md Instrukser til Gemini CLI på VM
scripts/boot.sh Session-starter, aliaser, TUI-valg
scripts/vm-teardown.sh Cron 03:00 CEST — stopper dev-vm
docs/DNS-OG-INFRASTRUKTUR.md DNS-kart, IAP-routing