feat(hermes): restart-request guardian for post-update pod restarts #25
Loading…
Add table
Add a link
Reference in a new issue
No description provided.
Delete branch "feat/restart-request-guardian"
Deleting a branch is permanent. Although the deleted branch may continue to exist for a short time before it actually gets removed, it CANNOT be undone in most cases. Continue?
Problem
Nach jedem
hermes update(nightly cron) sind die neuen Module auf Disk, aber die laufenden Gateways haben alte Module im RAM. Resultat:ImportError: cannot import name CHECK_FN_CACHE_BYPASSbei allen Profilen. Bisheriger Fix: manuellespodman pod restart hermes.pod.Lösung
Container-seitig (Maia Cron, nicht im Repo): Ein
post-update-restart-checkCron (02:00, 1h nach dem nightly update) liestupdate.log, ein LLM entscheidet ob ein Neustart nötig ist, und rufthermes-request-restart podauf. Der Helper schreibt Counter in/var/lib/hermes/restart-requests.jsonauf dem shared Rootfs.Host-seitig (im Repo): Ein systemd User-Timer (alle 60s) pollt die Request-Datei, vergleicht mit dem letzten bedienten Stand und führt
systemctl --user restart hermes-pododerpodman restart <container>aus. Deployment direkt in der Hermes-Rolle, ohne die zentraleservices-Rolle zu verändern.Dateien
ansible/roles/hermes/templates/restart-guardian/*— Systemd-Templates (script, service, timer)ansible/roles/hermes/tasks/main.yml— Deployt den Watcher direkt (keininclude_role: services)Deployment
Der Timer startet automatisch. Container-seitige Scripts (
hermes-request-restart.py,hermes-nightly-update.sh) sind nicht Teil dieses Repos — sie werden direkt auf dem Rootfs gemanagt.663e191f7ato64e6720d43View command line instructions
Checkout
From your project repository, check out a new branch and test the changes.