14:32
2026-08-09
github.com
ai-safety
Adversarial LLM Reversal for hermes-agent
Hermes plugin developer released an adversarial LLM reversal tool, hermes-agent, that catches large language models sandbagging in real time by forking two disposable clones every seventh turn to inteβ¦