La seguridad de Hermes Agent empieza con nuevos límites de confianza
Hermes Agent security no se reduce a confirmar comandos. Hermes, de Nous Research, combina memoria persistente, skills autónomas, gateways de mensajería, cron, subagentes, MCP y varios backends de terminal. Para equipos OpenClaw, la revisión debe cubrir el runner y también el plano de control.
Office Claws es independiente de Hermes y OpenClaw. Su encaje honesto es operar flujos Codex desde escritorio y VPS: control local, logs visibles, runners desechables y gates de revisión.
Qué cambia para equipos OpenClaw
| Superficie | Riesgo | Regla más segura |
|---|---|---|
| Memoria | Contexto privado persiste más de lo esperado | Separar memoria personal, de equipo y de repo |
| Skills | Automatización generada se vuelve confianza ejecutable | Revisar, versionar y probar skills como código |
| Mensajería | Un chat puede iniciar una operación | Limitar canales y confirmar escrituras |
| Cron | El agente actúa después con contexto viejo | Guardar owner, repo, rama y fallo esperado |
| Subagentes | Trabajo paralelo mezcla ramas o secretos | Una tarea, un runner, una rama, un token |
El mismo principio aparece en OpenClaw security best practices, OpenClaw background tasks y OpenClaw vs Codex: autoridad estrecha y observable.
Checklist práctica
- Empieza en un workspace desechable.
- No copies secretos de larga duración al runner.
- Define qué puede recordarse y cómo borrarlo.
- Trata las skills como artefactos de supply chain.
- Activa solo los gateways necesarios.
- Haz explícitos los cron jobs.
- Exige PR antes de main o producción.
- Conserva logs auditables de prompts, comandos, diffs y tokens.
Arquitectura recomendada
Mantén secretos y aprobaciones en el operador humano, ejecuta el experimento en un runner aislado con un checkout y una rama, y deja que GitHub/CI/producción acepten cambios solo tras tests y revisión. Office Claws for OpenClaw users aporta visibilidad de runners, logs, ramas y ciclo de vida VPS sin afirmar que importe estado de Hermes u OpenClaw.
Fallos que conviene probar
Prueba prompt injection contra variables de entorno, scripts de instalación maliciosos, comandos de chat sin contexto, cron tras cambios de rama, subagentes compitiendo y skills antiguas que llaman producción. Si puedes revocar un token y destruir un runner, el límite funciona.
Fuentes y lecturas relacionadas
- Documentación de Hermes Agent: https://hermes-agent.nousresearch.com/docs/
- GitHub: https://github.com/NousResearch/hermes-agent
- Hermes Agent OpenClaw Migration
- OpenClaw vs Codex
- OpenClaw Desktop Manager