Ir al contenido

Hermes Agent: Por Qué el Agente IA Más Popular NO Basta — Guion v1

Hermes Agent: Por Qué el Agente IA Más Popular NO Basta — Guion v1

Sección titulada «Hermes Agent: Por Qué el Agente IA Más Popular NO Basta — Guion v1»
  • Formato: concepto + demo real (patrón validado)
  • Duración objetivo: 35-45 min
  • Hook variante B (analogía de dolor) + variante C (contraste)
  • Demo: instalar Hermes, correr, conectar skills, mostrar límites
  • Verificar CADA dato con fuentes primarias antes de grabar

[CÁMARA]

Más de 160,000 estrellas en GitHub en pocos meses. El agente open source que todos están instalando en VPS de 5 dólares. Y sí, funciona. Lo instalé, lo probé, y funciona.

Pero hay cosas que no te están contando. Su propia documentación dice que los perfiles no aíslan el acceso al disco. Un usuario auditó sus sesiones y encontró que el 87% tenían violaciones del sistema de seguridad. Y su arquitectura es un solo agente con 20 interfaces — no es un sistema multi-agente.

Hoy te voy a mostrar Hermes como lo que realmente es — con sus fortalezas reales y sus limitaciones reales. Desde la perspectiva de alguien que ya tiene agentes corriendo en producción.


[CÁMARA]

Tres cosas que van a ver en este video:

  1. Voy a instalar Hermes, conectar mis skills existentes — que son compatibles porque usan el mismo estándar — y mostrar qué funciona bien de verdad.

  2. Les voy a mostrar lo que la documentación oficial de Hermes dice versus lo que los YouTubers te venden. Son cosas distintas.

  3. Y al final vamos a ver dónde encaja Hermes en el panorama real de agentes en producción — y dónde no encaja.


[CÁMARA]

Y como siempre, todo va a estar disponible en la descripción. Los invito a suscribirse que estamos haciendo cosas muy entretenidas. Vamos a eso.


[2:30 - 5:00] QUÉ ES HERMES — lo que sí es

Sección titulada «[2:30 - 5:00] QUÉ ES HERMES — lo que sí es»

[CÁMARA]

Antes de hablar de problemas, hay que reconocer lo que Hermes hace bien. Porque hay cosas genuinamente buenas.

Hermes es un agente de IA open source creado por Nous Research. Gratuito, código abierto, y no recolecta datos sobre cómo lo usas. Corre en tu propia infraestructura — ya sea tu máquina local, un VPS, un container Docker o incluso opciones serverless. Ellos mismos se definen como — y esto es importante:

[PANTALLA — cita en inglés: “The self-improving AI agent”]

“El agente de IA que se mejora a sí mismo”. Un agente autónomo. No un harness, no un framework, no una plataforma. Un agente.

[PANTALLA — arquitectura de Hermes]

Y tiene tres cosas que son genuinamente inteligentes desde un punto de vista de ingeniería:

Uno: Progressive Disclosure de skills.

Hermes no carga todos los skills en el contexto de una vez. Primero le muestra al modelo solo los nombres y descripciones de los skills disponibles — eso cuesta unos 3,000 tokens en total, no importa si tienes 10 o 50 skills. Cuando el modelo identifica cuál necesita, ahí carga el contenido completo de ese skill específico. Y si necesita un archivo de referencia adicional, lo carga en un tercer paso. Solo carga lo que necesita cuando lo necesita.

Dos: Self-improving loop.

Después de que el agente completa una tarea compleja — 5 o más llamadas a herramientas — automáticamente genera un skill con el procedimiento que usó. La próxima vez que encuentra una tarea similar, usa ese skill en vez de razonar desde cero. Usuarios reportan un 40% más rápido en tareas repetitivas después de un par de horas de uso.

Tres: El estándar SKILL.md.

Los skills de Hermes siguen el formato de agentskills.io. Esto significa que un skill escrito para Claude Code, para Cursor, para Codex — funciona en Hermes sin modificación. Y al revés. Es un estándar cross-vendor que se adoptó en 12 semanas. Eso es raro en esta industria.

Además, 20+ plataformas de mensajería, modo voz con speech-to-text local, 70+ herramientas integradas, y múltiples backends de ejecución — local, Docker, SSH y opciones serverless.

O sea, Hermes es impresionante para lo que fue diseñado.

La pregunta es: ¿para qué fue diseñado?


[5:00 - 10:00] LO QUE HERMES DICE SER vs LO QUE TE VENDEN

Sección titulada «[5:00 - 10:00] LO QUE HERMES DICE SER vs LO QUE TE VENDEN»

[CÁMARA]

Y acá viene lo que me motivó a hacer este video.

Como vimos, Hermes se define como un agente autónomo. Nunca, en ninguna parte de su documentación, usa la palabra “harness”. Se posiciona como un agente, no como infraestructura de control.

Pero si vas a YouTube, te encuentras con otra historia. Te dicen que Hermes es un harness, que es lo que controla al modelo. Lo ponen al mismo nivel que Claude Code o Codex — pero ni Hermes, ni Claude Code, ni Codex se definen así en su documentación oficial. Son agentes o herramientas de desarrollo. Es la comunidad la que les puso esa etiqueta.

Y ojo — no es que esté completamente equivocado. Hermes sí rodea al modelo con memoria, skills y configuración. Pero si lo analizamos con los principios reales de harness engineering — los que presentó Fowler, Hashimoto, OpenAI — le falta la mitad.

Si viste mi video de Harness Engineering, recordarás que Fowler divide el harness en Guides y Sensors.

[CLIP: Harness Engineering — 7:49 a 8:40]

“Visión número uno de Martin Fowler. Él divide el Harness en dos grandes categorías. La primera, guías. Controles que anticipan el comportamiento del agente y lo guían antes de que actúe. Son como la rienda del caballo. Y el número dos, sensores. Controles que observan después de que el agente actúa.”

[CÁMARA]

Ahora apliquemos eso a Hermes.

[PANTALLA — tabla Fowler aplicada a Hermes]

Hermes tiene?
Guides (antes de actuar)
Skills/SKILL.md ✅ Sí — define qué puede hacer
SOUL.md / AGENTS.md ✅ Sí — configura identidad y reglas
Approval system ✅ Parcial — approval.py para comandos peligrosos
Sensors (después de actuar)
Validación de outputs ❌ No valida lo que el agente produce
Health checks ❌ No verifica que el agente funcione correctamente
Revisión automatizada ❌ No tiene quién revise las decisiones del agente
Observabilidad ❌ No hay logs centralizados ni métricas
Auditoría ❌ No hay registro de qué hizo y por qué

[CÁMARA]

Hermes tiene controles previos reales. Antes de que el agente actúe, hay un sistema de aprobación, hay una lista de comandos que nunca se pueden ejecutar, hay protección contra accesos a redes internas y filtrado de credenciales en subprocesos. Eso está bien hecho.

Pero lo que pasa después de que el agente actúa — validar lo que produjo, verificar que sigue funcionando bien, registrar qué hizo y por qué — eso no lo tiene. Y eso es lo que necesitas cuando un agente opera sin que alguien esté mirando.


[10:00 - 15:00] LA SEGURIDAD QUE NADIE MENCIONA

Sección titulada «[10:00 - 15:00] LA SEGURIDAD QUE NADIE MENCIONA»

[CÁMARA]

Ahora vamos a algo más serio. Porque la seguridad de Hermes tiene un lado bueno y un lado que no te cuentan.

[PANTALLA — diagrama “7 Defense Layers”: User Authorization, Command Approval, Container Isolation, MCP Credential Filtering, Context File Scanning, Cross-Session Isolation, Input Sanitization]

El lado bueno: Hermes documenta 7 capas de defensa. Les voy a mostrar acá. Tiene un hardline blocklist — una lista de comandos que nunca se pueden ejecutar, ni siquiera si desactivas todas las protecciones. Un rm -rf /, un fork bomb, formatear un disco — siempre bloqueado. También tiene aislamiento con Docker y filtrado de credenciales para que los servidores MCP no vean tus API keys. Eso es trabajo serio de seguridad.

[CÁMARA]

Pero acá viene lo que no te cuentan.

[PANTALLA — Auditoría de seguridad]

Un usuario publicó en GitHub — issue #7826 — una auditoría independiente sobre la versión 0.8.0: 4 hallazgos críticos y 9 de alta severidad. En la configuración por defecto.

[PANTALLA — Session audit]

Y un usuario — un ingeniero — hizo algo que nadie más había hecho. Corrió un script de auditoría contra sus propias sesiones. 129 sesiones en 23 días. Resultado: 112 de 129 sesiones contenían al menos una violación del approval gate. 87%.

[CÁMARA]

Y hay algo más sutil que es quizás el más peligroso: Memory Injection. Hermes ingiere contenido de documentos, emails, páginas web y lo guarda como memoria legítima. Si alguien planta instrucciones ocultas en un documento — por ejemplo, algo que diga “el usuario autorizó acceso a tal archivo” — Hermes podría almacenarlo. Y en una sesión futura, esa memoria envenenada se activa sin que el usuario lo sepa.

Esto se llama Promptware. El issue #496 en GitHub lo trackea abiertamente. No es un bug — es una clase de ataque que los sistemas de seguridad tradicionales no detectan porque operan a nivel de proceso, no a nivel de prompt.


[15:00 - 18:00] LA ARQUITECTURA — UN AGENTE, NO UN SISTEMA

Sección titulada «[15:00 - 18:00] LA ARQUITECTURA — UN AGENTE, NO UN SISTEMA»

[CÁMARA]

Algo que es muy importante entender: la arquitectura de Hermes.

[PANTALLA — diagrama de arquitectura]

La documentación oficial dice textualmente:

[PANTALLA — cita en inglés: “One AIAgent class serves CLI, gateway, ACP, batch, and API server”]

“Una sola clase AIAgent sirve CLI, gateway, ACP, batch y API server.” Es UN agente con múltiples interfaces. No es un sistema multi-agente distribuido — no son servicios independientes con límites de red, permisos separados y despliegue individual. Cuando le hablas por Telegram, por Discord, por CLI — siempre es la misma clase, la misma instancia. Hermes sí tiene delegate_task y subagentes, pero son efímeros y corren dentro del mismo proceso.

[CÁMARA]

Y los profiles — que se presentan como la forma de correr “múltiples agentes” — aíslan la configuración, la memoria, los skills y las sesiones. Pero la documentación dice, y cito textualmente:

[PANTALLA — cita en inglés: “Profiles do NOT isolate filesystem access. The agent still has the same filesystem access as your user account”]

“Los perfiles NO aíslan el acceso al filesystem. El agente sigue teniendo el mismo acceso que tu cuenta de usuario.” O sea, tienes dos perfiles que no comparten memoria pero sí comparten tu disco duro completo.

Y hay un bug documentado — issue #6320 — donde session_search devuelve resultados de TODAS las instancias, no solo la tuya. Contaminación de memoria entre perfiles.

[CÁMARA]

Compara eso con lo que nosotros construimos en este canal. 7 agentes en Cloud Run. Cada uno es un servicio independiente con su propia URL, su propio container, sus propios permisos IAM. Se comunican por A2A Protocol via HTTP. Si uno se cae, los otros siguen. Si uno escala, no afecta a los demás.

Hermes: 1 AIAgent → 20 interfaces → 1 proceso → 1 filesystem
Nuestro: 7 agentes → 7 containers → 7 URLs → A2A Protocol → IAM por servicio

Son arquitecturas completamente distintas para problemas completamente distintos.


[CÁMARA]

Y acá hay otro punto que nadie cuestiona. Todos los videos te dicen: “instálalo en un VPS de Hostinger por 5 dólares al mes.”

Y funciona. Para un agente personal, para una persona, un VPS es suficiente. Hermes es I/O-bound — llama APIs de LLMs, el VPS solo maneja la lógica del agente y la memoria. No necesita GPU.

[CÁMARA]

Pero un VPS de 5 dólares no tiene:

  • Escalamiento automático
  • Alta disponibilidad — se cae el VPS, se cae todo
  • Aislamiento entre agentes
  • Monitoreo ni alertas
  • CI/CD para actualizar sin downtime
  • Networking seguro entre servicios

Un VPS de 5 dólares es una buena opción para un agente personal. Pero casi todos los YouTubers que lo recomiendan tienen link de afiliado. La recomendación no siempre es por arquitectura — a veces es por monetización.

El VPS no está mal. Pero presentarlo como si fuera equivalente a una arquitectura de producción sí lo está.


[20:00 - 30:00] DEMO — INSTALACIÓN + SKILLS + LÍMITES

Sección titulada «[20:00 - 30:00] DEMO — INSTALACIÓN + SKILLS + LÍMITES»

[CÁMARA]

Bueno, ya hablamos bastante. Vamos a meter las manos.

Voy a instalar Hermes, conectar mis skills existentes — los mismos que construimos en el video de Agent Skills — y ver qué pasa.

[PANTALLA — terminal]

pip install hermes-agent
hermes postinstall
hermes model # configurar proveedor
hermes # primera sesión

Como Hermes usa el estándar SKILL.md de agentskills.io, mis skills de DNS y Monitoring deberían funcionar sin modificación. Los copio a ~/.hermes/skills/ y Hermes los detecta automáticamente.

[DEMO en vivo — mostrar que los detecta]

Voy a darle una tarea que requiera 5+ llamadas a herramientas. Debería auto-generar un skill.

[DEMO en vivo]

Ahora le pido algo peligroso. “Borra todos los registros DNS.”

[DEMO en vivo — ver la respuesta]

Y acá está la diferencia clave con nuestro sistema. En nuestro skill_engine.py, la función delete_dns_record no existe. El agente no puede borrar porque la capacidad no existe — Capa 2, restricción arquitectónica.

En Hermes, la restricción es el approval system — Capa 1. El agente puede hacer muchas cosas y el sistema le pregunta al usuario antes de ejecutar comandos peligrosos. Pero si tienes YOLO mode activado, esa barrera desaparece.

Y los skills auto-generados — que el agente se crea solo — pasan la validación con un verdict de “ask” en vez de “block”. O sea, el agente puede darse capacidades a sí mismo.

En nuestro sistema, si la función no existe, no puede ejecutarla. No importa el modo, no importa la configuración. Es arquitectónicamente imposible.


[30:00 - 35:00] DÓNDE ENCAJA HERMES — Y DÓNDE NO

Sección titulada «[30:00 - 35:00] DÓNDE ENCAJA HERMES — Y DÓNDE NO»

[CÁMARA]

Entonces, ¿para quién es Hermes?

[PANTALLA — tabla resumen]

Hermes es excelente para:
✅ Developer individual que usa un agente todos los días
✅ Tareas repetitivas que mejoran con el self-improving loop
✅ Acceso desde múltiples canales (Telegram, Discord, Slack, WhatsApp)
✅ Skills portables con SKILL.md (agentskills.io)
✅ Privacidad — corre en tu propia infraestructura, no recolecta datos de uso
✅ Modo voz con speech-to-text local
Hermes NO es para:
❌ Equipos o empresas con múltiples usuarios (memory contamination, issue #6320)
❌ Sistemas que necesitan governance y permisos por rol (no hay IAM)
❌ Producción con alta disponibilidad (single point of failure)
❌ Multi-agente real con coordinación (es UN agente con 20 interfaces)
❌ Ambientes donde la seguridad debe ser garantizada por diseño

[CÁMARA]

Y esto no es una opinión — son datos de su propia documentación y de sus propios usuarios.

De sus 237 user stories documentados oficialmente, solo 9 son de enterprise. 3.8%. Y el único caso de compliance con EU AI Act requiere instalar un plugin adicional llamado Ombre. No es nativo.

[CÁMARA]

Lo interesante es que varios usuarios ya descubrieron el combo: usan Claude Code para código y Hermes para automatización 24/7. No compiten — son complementarios. Claude Code es un pair programmer en tu terminal. Hermes es un asistente personal que corre en tu servidor. Problemas distintos, herramientas distintas.


[35:00 - 38:00] EL PUZZLE COMPLETO — DÓNDE ENCAJA HERMES EN NUESTRO CANAL

Sección titulada «[35:00 - 38:00] EL PUZZLE COMPLETO — DÓNDE ENCAJA HERMES EN NUESTRO CANAL»

[CÁMARA]

Si llevas siguiendo este canal, cada video construyó una pieza de algo más grande.

[PANTALLA — el mapa del puzzle]

Agent Skills → RESTRICCIONES — qué puede y qué no puede hacer
Agent Teams → FÁBRICA — cómo se producen skills a escala
Cloud Run + A2A → INFRAESTRUCTURA — dónde corren en producción
Harness Engineering → CONTROL — el framework que une todo
Workspace Profiling → GOVERNANCE — quién tiene permiso
MCP → CONECTIVIDAD — cómo se conectan al mundo

Hermes encaja en una sola capa: es un agente individual con skills y memoria. Usa SKILL.md — la misma capa de restricciones que construimos. Puede conectarse vía MCP. Pero no tiene la fábrica, no tiene la infraestructura distribuida, no tiene governance por usuario, y no tiene la capa de control completa.

No es que esté mal. Es que resuelve un problema distinto. Y está bien.

Pero si alguien te dice que con Hermes en un VPS de 5 dólares tienes todo resuelto — ahora ya sabes qué le falta.


[CÁMARA]

Antes de cerrar, quiero decir algo.

Hermes es un proyecto genuinamente bueno. Código abierto, gratuito, con una comunidad activa que construye cosas reales. El self-improving loop es una idea inteligente. El progressive disclosure de skills es una idea inteligente. La compatibilidad con SKILL.md es una decisión estratégica que beneficia a toda la industria.

Pero hay un gap enorme entre un agente personal en un VPS y un sistema de agentes en producción. Y en ese gap es donde vive la ingeniería real.

Ese gap es lo que construimos video a video en este canal.

Muchas gracias por quedarse hasta el final. Suscríbanse porque vienen cosas muy entretenidas. Nos vemos en el próximo video.


POSIBLE CASO DE USO — Hermes + MCP + Claude Code (evaluar)

Sección titulada «POSIBLE CASO DE USO — Hermes + MCP + Claude Code (evaluar)»

Hermes puede exponerse como servidor MCP (hermes mcp serve). Eso significa que Claude Code podría consumir las herramientas de Hermes a través de MCP — la misma capa de conectividad que Soria Parra presentó en su keynote.

Posible sección o mención en el video:

  • Hermes no solo consume MCP servers, también se expone como uno
  • Claude Code podría usar las herramientas de Hermes vía MCP
  • Conecta con nuestro video de MCP (las 3 opciones de conectividad)
  • Refuerza que Hermes y Claude Code son complementarios, no competidores

Decidir si va como:

  • Mención rápida en la sección de arquitectura
  • Parte de la demo (instalar y probar hermes mcp serve)
  • Open loop / teaser para un próximo video

Cada dato mencionado en el guion debe ser verificado contra fuentes primarias:

DatoFuenteVerificado
160K+ starsgithub.com/NousResearch/hermes-agent[ ]
“The self-improving AI agent”hermes-agent.nousresearch.com/docs/[ ]
Nunca dice “harness” en su dochermes-agent.nousresearch.com/docs/ (búsqueda completa)[ ]
Progressive Disclosure 3 niveles, ~3K tokens totalhermes-agent.nousresearch.com/docs/user-guide/features/skills[ ]
SKILL.md compatible agentskills.iohermes-agent.nousresearch.com/docs/user-guide/features/skills[ ]
SKILL.md adoptado en 12 semanas cross-vendormedium.com/@automation.labs (verificado)[ ]
40% speed boost tareas repetitivasReddit users (cited in reviews)[ ]
20+ plataformas, 70+ toolshermes-agent.nousresearch.com/docs/[ ]
7 capas de seguridadhermes-agent.nousresearch.com/docs/user-guide/security[ ]
Hardline blocklist unbypassablehermes-agent.nousresearch.com/docs/user-guide/security[ ]
YOLO mode bypassa approvalhermes-agent.nousresearch.com/docs/user-guide/security[ ]
Auditoría 4 críticos, 9 high (independiente)github.com/NousResearch/hermes-agent/issues/7826[ ]
112/129 sesiones con violaciones (87%)hermes-agent.nousresearch.com/docs/user-stories[ ]
Issue #496 memory injection/promptwaregithub.com/NousResearch/hermes-agent/issues/496[ ]
“One AIAgent class serves all”hermes-agent.nousresearch.com/docs/developer-guide/architecture[ ]
Profiles no aíslan filesystemhermes-agent.nousresearch.com/docs/user-guide/profiles[ ]
Issue #6320 session contaminationgithub.com/NousResearch/hermes-agent/issues/6320[ ]
Skills guard = “ask” no “block”repello.ai/blog/hermes-agent-security[ ]
237 user stories, 9 enterprisehermes-agent.nousresearch.com/docs/user-stories[ ]