#!/usr/bin/env python3
"""Plot SAC training progress from live campaign logs.
Pure-stdlib SVG output (matplotlib not available on this box).
Generates:
docs/graph_eval_winrates.svg - two stacked panels: Run 3 trend (raw dots +
rolling-10 thick line) per opponent, and
Run 1 vs Run 3 Corners on a fraction-of-run axis
docs/graph_losses.svg - critic/actor/alpha loss curves from training_metrics.jsonl
Usage:
python3 tools/plot_progress.py [campaign_log] [metrics_jsonl] [v1_log] [outdir]
All args optional; defaults relative to the SAC_LSTM_Bot/ root (parent of tools/).
python3 tools/plot_progress.py --selftest # tiny built-in sanity check
"""
import json
import math
import re
import sys
import tempfile
from pathlib import Path
ROOT = Path(__file__).resolve().parent.parent
EVAL_RE = re.compile(r">>> \[eval\] win rate: (\d+)/(\d+) \(([\d.]+)%\) vs (\S+)")
TREND_WINDOW = 10 # rolling mean shown as the thick trend line
BUCKETS = 40 # v1 downsampling for the Run1-vs-Run3 panel
COLORS = {"Corners": "#d62728", "Crazy": "#1f77b4", "Target": "#2ca02c"}
V1_COLOR = "#999999"
W, M_L, M_R, M_T, M_B = 1000, 70, 20, 40, 45 # graph 2 geometry (unchanged)
def parse_eval_series(path):
"""Return {opponent: [win% per eval, in file order]}."""
series = {}
if not path.is_file():
print(f"[skip] eval log not found: {path}")
return series
for line in path.read_text(errors="replace").splitlines():
m = EVAL_RE.search(line)
if not m:
continue
try:
pct = float(m.group(3))
except ValueError:
continue
series.setdefault(m.group(4), []).append(pct)
return series
def parse_metrics(path):
"""Return list of metric dicts, skipping malformed lines."""
rows = []
if not path.is_file():
print(f"[skip] metrics file not found: {path}")
return rows
for line in path.read_text(errors="replace").splitlines():
line = line.strip()
if not line:
continue
try:
rows.append(json.loads(line))
except json.JSONDecodeError:
continue
return rows
def rolling(vals, w=TREND_WINDOW):
out, s = [], 0.0
for i, v in enumerate(vals):
s += v
if i >= w:
s -= vals[i - w]
out.append(s / min(i + 1, w))
return out
# ---------- tiny SVG helpers ----------
def esc(s):
return str(s).replace("&", "&").replace("<", "<").replace(">", ">")
def svg_open(w, h, title):
return (f'\n')
out.write_text(s)
return 1
# ---------- selftest ----------
def selftest():
with tempfile.TemporaryDirectory() as td:
td = Path(td)
(td / "log").write_text(
">>> [eval] win rate: 3/10 (30%) vs Corners\n"
"garbage line\n"
">>> [eval] win rate: 7/10 (70%) vs Crazy\n"
">>> [eval] win rate: broken\n"
">>> [eval] win rate: 5/10 (50%) vs Corners\n")
ser = parse_eval_series(td / "log")
assert ser == {"Corners": [30.0, 50.0], "Crazy": [70.0]}, ser
assert rolling([10] * 25, 20)[-1] == 10.0
assert rolling([1, 2, 3], 20) == [1.0, 1.5, 2.0]
assert bucket_means(list(range(1287)), BUCKETS) is not None
assert len(bucket_means(list(range(1287)), BUCKETS)) == BUCKETS
bm = bucket_means([0, 10], BUCKETS)
assert bm == [0.0, 10.0], bm # fewer points than buckets -> no empty buckets
(td / "m.jsonl").write_text(
'{"critic_loss": 10, "actor_loss": -2, "alpha": 0.5}\n'
"not json\n"
'{"critic_loss": 100, "actor_loss": -4, "alpha": 0.25}\n')
rows = parse_metrics(td / "m.jsonl")
assert len(rows) == 2 and rows[1]["critic_loss"] == 100
ok = graph_losses(rows, td / "g2.svg") and graph_eval(ser, {"Corners": [0, 10]}, td / "g1.svg")
assert ok and (td / "g1.svg").stat().st_size > 500
g1 = (td / "g1.svg").read_text()
assert 'width="1200"' in g1, "canvas must be >=1200 wide"
assert g1.count("= 2) + 2 # trends + v1 buckets + v3 trend
assert g1.count(" 0 else ROOT / "campaign_v2_stdout.log"
metrics = Path(args[1]) if len(args) > 1 else ROOT / "training_metrics.jsonl"
v1log = Path(args[2]) if len(args) > 2 else ROOT / "weights_v1_archive" / "campaign_stdout.log"
outdir = Path(args[3]) if len(args) > 3 else ROOT / "docs"
outdir.mkdir(parents=True, exist_ok=True)
made = 0
series_v2 = parse_eval_series(campaign)
print(f"[info] v2 evals parsed: " +
", ".join(f"{k}={len(v)}" for k, v in sorted(series_v2.items())) or "(none)")
series_v1 = parse_eval_series(v1log)
print(f"[info] v1 evals parsed: " +
", ".join(f"{k}={len(v)}" for k, v in sorted(series_v1.items())) or "(none)")
made += graph_eval(series_v2, series_v1, outdir / "graph_eval_winrates.svg")
rows = parse_metrics(metrics)
print(f"[info] metric rows parsed: {len(rows)}")
made += graph_losses(rows, outdir / "graph_losses.svg")
if made:
print(f"[done] {made} graph(s) written to {outdir}")
else:
print("[error] nothing plotted - check paths above")
sys.exit(1)
if __name__ == "__main__":
main()