Hermes Agent Herald: qué cambia en la versión 0.20.0

hermes agent herald

Si hay algo que cada vez tengo más claro es que un agente de IA no es mejor simplemente porque sea capaz de hacer más cosas.

Para mí hay algo casi igual de importante: poder controlarlo mientras trabaja.

Y precisamente por eso me parece interesante Hermes Agent Herald, el nombre que recibe la versión 0.20.0 de Hermes Agent.

La actualización incorpora una buena cantidad de novedades. Tenemos conversación por voz en tiempo real, interrupciones mientras el agente habla, palabras de activación, redirección de tareas durante la ejecución, investigación con citas verificables, comprobación de hechos, comunicación entre agentes mediante A2A, webhooks y varias mejoras para que las herramientas puedan recuperarse mejor cuando algo sale mal.

Podría hacer una lista de funciones, explicar cada una en un par de párrafos y dar el artículo por terminado.

Pero creo que eso dejaría fuera lo más importante.

Lo que más me llama la atención de The Herald Release es que Hermes empieza a dejarse dirigir mejor.

Cuando utilizamos un agente para una consulta sencilla, esto puede parecer secundario. Si le preguntas algo, responde mal y vuelves a preguntar, tampoco pasa demasiado.

hermes agent

El problema aparece cuando empiezas a utilizar agentes de IA para trabajos de verdad: investigaciones largas, programación, creación de contenido, automatizaciones, análisis o tareas que requieren muchos pasos.

En ese contexto no siempre quieres dos extremos: o dejar al agente completamente solo o detenerlo por completo.

Muchas veces quieres algo mucho más sencillo:

dejarlo trabajar y poder intervenir cuando sea necesario.

Herald avanza precisamente en esa dirección.

Resumen del Artículo ocultar

Qué es Hermes Agent Herald y qué cambia en la versión 0.20.0

Hermes Agent Herald es la versión 0.20.0 de Hermes Agent, el agente de IA desarrollado por Nous Research. La actualización recibe oficialmente el nombre de The Herald Release y amplía varias áreas importantes del sistema.

Algunas son muy visibles.

La nueva experiencia de voz probablemente sea una de las que más atención reciba: Hermes puede mantener conversaciones mediante voz, comenzar a responder mientras genera el contenido e incluso detenerse cuando detecta que estamos intentando interrumpirlo.

Otras novedades son mucho menos vistosas, pero en mi opinión pueden tener incluso más impacto cuando utilizamos Hermes durante períodos largos.

The Herald Release en pocas palabras

Una de las ideas centrales de Herald es que el agente pueda funcionar de una forma más interactiva incluso mientras está ejecutando una tarea.

Por ejemplo, ahora podemos redirigir una ejecución que ya está en marcha.

Si Hermes estaba trabajando en una dirección que inicialmente parecía correcta pero empieza a desviarse de lo que necesitamos, podemos enviar nuevas instrucciones para cambiar el rumbo sin tener que plantear necesariamente toda la tarea desde cero.

A esto se suman las novedades de investigación.

Herald incorpora capacidades de grounded citations, que buscan relacionar afirmaciones con fuentes verificables, además de mecanismos de fact checking para comprobar mejor si las fuentes consultadas respaldan realmente lo que se está afirmando.

También aparecen mejoras relacionadas con A2A, comunicación entre agentes, y webhooks salientes, que permiten integrar Hermes dentro de flujos de automatización más amplios.

Principales novedades de Hermes Agent 0.20.0

Si tuviera que resumir las áreas más importantes de la actualización, serían estas:

  • conversación por voz en tiempo real;
  • posibilidad de interrumpir a Hermes mientras habla;
  • palabras de activación o wake words;
  • redirección de tareas durante una ejecución;
  • investigación con citas fundamentadas;
  • comprobación de hechos;
  • comunicación entre agentes mediante A2A;
  • webhooks para integraciones externas;
  • mejoras de recuperación automática cuando determinadas herramientas fallan.

Pero para mí la clave no está en contar cuántas funcionalidades nuevas hay.

Lo interesante es observar qué tienen muchas de ellas en común.

Herald intenta hacer que Hermes sea más autónomo sin convertir esa autonomía en una caja negra que simplemente dejamos trabajar.

Podemos hablarle, interrumpirlo, corregirlo, pedirle pruebas sobre la información que encuentra y construir sistemas en los que trabaje durante más tiempo sin que cada pequeño error obligue a empezar de nuevo.

Y esa combinación me parece bastante más relevante que cualquier función aislada.

Ahora puedes corregir a Hermes mientras está trabajando

Cuando empiezas a utilizar agentes de IA para tareas largas aparece una situación bastante habitual.

Le das una instrucción.

Hermes empieza a trabajar.

Los primeros pasos son correctos.

Encuentra información, ejecuta algunas herramientas o empieza a preparar una solución.

Pero en algún momento toma una decisión que no era exactamente la que tenías en mente.

Aquí es donde normalmente aparece un problema con los agentes autónomos: cuanto más trabajo han hecho ya, menos ganas tienes de detenerlo todo y empezar otra vez.

El problema de tener que parar y reformular una tarea

En el trabajo real rara vez tengo perfectamente definida una tarea compleja desde el primer mensaje.

Muchas veces empiezo con una idea bastante clara, pero cuando veo los primeros resultados me doy cuenta de que quiero cambiar algo.

Quizá el enfoque no sea el correcto.

Quizá haya encontrado una fuente que abre una línea más interesante.

Quizá esté desarrollando demasiado una parte y demasiado poco otra.

O simplemente veo sobre la marcha una forma mejor de conseguir el objetivo.

Hasta ahora, una de las soluciones habituales consistía en detener el agente, explicarle qué había ocurrido y volver a ponerlo a trabajar.

Con Herald, esta interacción puede ser mucho más natural.

Redirigir una ejecución sobre la marcha

Una de las novedades de Hermes Agent v0.20.0 permite introducir una corrección mientras existe una tarea activa.

La idea que más me gusta se puede resumir con una frase muy sencilla:

“No, por ahí no. Mantén lo anterior, pero hazlo de esta otra forma.”

Eso es mucho más parecido a cómo trabajamos con otra persona.

Si estoy revisando un documento con alguien y veo que ha interpretado mal una parte, normalmente no tiro todo el documento y vuelvo a darle las instrucciones originales.

Le digo qué quiero cambiar y seguimos desde ahí.

Con un agente debería pasar algo parecido.

Y cuanto más largas sean las tareas, más importante se vuelve.

Por qué el steering importa especialmente en trabajos largos

En una consulta de treinta segundos, empezar otra vez no supone demasiado.

Pero imagina una investigación que lleva un buen rato ejecutándose, una tarea de programación con distintos pasos o un flujo que ya ha consultado varias fuentes y procesado información.

En ese punto, corregir es mucho más valioso que reiniciar.

Por eso creo que la capacidad de redirigir Hermes durante una ejecución es una de las novedades más importantes de Herald.

No porque sea espectacular visualmente, sino porque cambia la relación con el agente.

Dejas de tener únicamente dos opciones —dejarlo hacer o detenerlo— y aparece una tercera:

supervisarlo mientras sigue trabajando.

Para mí, ese modelo tiene mucho más sentido.

La voz de Hermes empieza a parecerse más a una conversación real

La voz es probablemente una de las novedades más llamativas de Hermes Agent Herald.

Y, al menos para mí, lo interesante no es simplemente que ahora podamos hablar con Hermes.

Los sistemas de voz con IA existen desde hace tiempo.

Lo que cambia la experiencia es la posibilidad de tener una interacción menos rígida.

Voz en tiempo real e interrupciones mientras Hermes habla

Uno de los problemas que siempre he encontrado con muchas interfaces de voz es que la conversación funciona realmente por turnos muy cerrados.

Tú hablas.

La IA escucha.

Esperas.

La IA empieza a responder.

Esperas a que termine.

Y entonces vuelves a hablar.

Muchas veces me parecía más parecido a intercambiar notas de voz que a mantener una conversación.

Herald intenta reducir esa sensación.

Hermes puede empezar a producir voz mientras está generando la respuesta y, además, puede detectar que estás intentando intervenir.

Si empiezas a hablar, el agente puede detener su respuesta y escuchar la nueva indicación.

Este tipo de interrupción suele describirse como barge-in.

El nombre técnico importa menos que la consecuencia práctica: no tienes que esperar educadamente a que una IA termine un monólogo que ya sabes que no te interesa.

Interrumpir cambia más cosas de las que parece

Imagina que estoy utilizando Hermes para preparar la estructura de un artículo.

Le explico el tema y empieza a desarrollar una propuesta.

En el segundo punto me doy cuenta de que está orientando el contenido hacia principiantes cuando yo quería escribir para un público avanzado.

No necesito escuchar otros tres minutos.

Puedo intervenir:

“Espera. Mantén la estructura inicial, pero quiero que asumamos que el lector ya conoce lo básico.”

Y seguimos.

Eso me parece mucho más natural.

Lo mismo puede funcionar mientras revisamos una estrategia, organizamos un proyecto, analizamos una idea o simplemente pensamos en voz alta.

La conversación deja de ser únicamente una interfaz para enviar prompts y empieza a convertirse en una forma de dirigir el trabajo del agente en tiempo real.

Wake words y activación por voz

Herald también incorpora palabras de activación configurables.

Esto permite plantear usos en los que Hermes permanezca disponible esperando una orden sin que tengamos que activar manualmente cada interacción.

Hay además un detalle que personalmente me gusta: la detección de la palabra de activación puede realizarse en el dispositivo mientras Hermes espera la orden.

Eso evita que el audio tenga que enviarse continuamente fuera del equipo únicamente para detectar si has pronunciado la palabra correspondiente.

No convierte automáticamente cualquier configuración en privada —hay más elementos que valorar—, pero me parece una decisión técnica acertada.

Para qué usaría realmente la voz

No creo que la voz vaya a sustituir el teclado para todo.

Para instrucciones precisas, código o configuraciones largas seguiré prefiriendo escribir.

Pero sí veo mucho sentido a la voz cuando el trabajo consiste en explorar y refinar ideas.

Preparar un artículo.

Organizar una estrategia.

Desatascar un proyecto.

Repasar una lista de opciones.

Ir pensando en voz alta mientras Hermes investiga o estructura información.

En esas situaciones, poder hablar, interrumpir y corregir convierte la voz en algo bastante más útil que un simple lector de respuestas.

Grounded citations: menos respuestas que solo parecen correctas

Hay una novedad de Herald que probablemente genere menos demostraciones espectaculares que la conversación por voz, pero que considero mucho más importante para utilizar Hermes profesionalmente.

Las grounded citations, o citas fundamentadas.

Uno de los grandes problemas de trabajar con modelos de IA es que una respuesta puede sonar impecable y, aun así, contener información incorrecta.

La redacción no siempre nos ayuda a distinguir una cosa de la otra.

Un dato inventado puede aparecer con exactamente el mismo tono de seguridad que uno perfectamente comprobado.

El problema de investigar con un agente de IA

Este problema se vuelve especialmente serio cuando delegamos investigación.

Si utilizamos Hermes para preparar documentación interna, analizar información de un cliente, investigar un mercado, redactar contenido o recopilar datos para una decisión, no basta con que la respuesta parezca buena.

Necesitamos trazabilidad.

En mi caso lo tengo bastante claro:

no quiero una respuesta que simplemente parezca convincente. Quiero poder saber de dónde ha salido la información.

Y cuanto más autónomo sea el agente, más importante se vuelve esta parte.

Si estoy haciendo una búsqueda manual y abriendo cada página personalmente, tengo bastante contexto sobre de dónde sale cada dato.

Si dejo un agente trabajando durante un período largo y después recibo un documento completo, esa trazabilidad puede desaparecer si el sistema no está diseñado para conservarla.

Qué aportan las citas fundamentadas

La investigación con grounded citations intenta relacionar las afirmaciones generadas con fuentes concretas que puedan verificarse.

El objetivo no es simplemente añadir una lista de enlaces al final de una respuesta.

La parte realmente útil es poder conectar una afirmación con el contenido que supuestamente la respalda.

Eso nos permite revisar con mucha más rapidez los puntos importantes.

Y también cambia cómo utilizamos el resultado.

Una investigación con fuentes verificables puede servir como punto de partida para un artículo, un informe o una decisión.

Una investigación llena de afirmaciones imposibles de rastrear necesita prácticamente una segunda investigación completa para poder confiar en ella.

Fact checking: citar no es lo mismo que demostrar

Herald también introduce capacidades orientadas a comprobar hechos.

Esto me parece importante porque existe una diferencia enorme entre:

“Esta afirmación tiene una cita al lado”

y

“Esta fuente realmente respalda esta afirmación”.

Las dos cosas no son equivalentes.

Un agente puede encontrar una página relacionada con un tema y utilizarla como referencia aunque el contenido concreto no confirme lo que está diciendo.

La comprobación adicional busca reducir ese problema identificando qué información ha podido verificarse, qué partes no están respaldadas o dónde existen discrepancias entre una afirmación y las fuentes consultadas.

Para mí esto apunta hacia una dirección necesaria.

Cuanto más trabajo deleguemos a agentes de IA, menos sostenible será confiar únicamente en que el texto “suena bien”.

Necesitamos poder auditarlo.

A2A y webhooks: Hermes empieza a trabajar mejor con otros sistemas

Otra parte importante de Hermes Agent Herald tiene que ver con algo que quizá resulte menos visible cuando utilizamos el agente de forma individual: la capacidad de conectarlo con otros agentes y otros sistemas.

Aquí aparecen dos piezas especialmente interesantes: A2A y los webhooks.

Qué significa A2A en Hermes Agent

A2A hace referencia a la comunicación agent-to-agent.

La idea general es que un agente no tenga que funcionar siempre como una unidad completamente aislada, sino que pueda comunicarse con otros agentes dentro de arquitecturas más amplias.

Esto abre posibilidades interesantes.

Podemos imaginar un agente especializado en investigación, otro encargado de trabajar con documentación interna, otro centrado en programación o análisis, y mecanismos que permitan que intercambien tareas o resultados.

No significa que necesitemos montar inmediatamente un sistema con diez agentes para aprovechar Hermes.

De hecho, creo que existe bastante tendencia a complicar arquitecturas multiagente sin una necesidad real.

Pero que la infraestructura exista es importante.

Porque algunos problemas sí se benefician de dividir responsabilidades.

De un agente generalista a varios agentes especializados

Hay una diferencia entre pedirle a un único agente que haga absolutamente todo y crear un flujo donde distintas partes tengan responsabilidades concretas.

Un agente puede recopilar información.

Otro puede analizarla.

Otro puede validar un resultado.

Otro puede encargarse de entregar la salida a una aplicación externa.

A2A ayuda a construir ese tipo de escenarios.

Para mí, el valor no está en poder decir “tengo muchos agentes”.

Está en poder repartir procesos complejos cuando esa división realmente mejora el resultado.

Webhooks para conectar Hermes con automatizaciones

Los webhooks son probablemente más fáciles de visualizar en un uso cotidiano.

Permiten que Hermes pueda enviar información o activar acciones en otros sistemas cuando ocurre algo determinado.

Eso encaja muy bien con automatizaciones.

Una tarea termina y envía un resultado.

Se detecta un evento y se activa otro proceso.

Un agente termina un análisis y una aplicación externa recibe la información.

Una investigación programada produce una salida y desencadena el siguiente paso del flujo.

Aquí es donde Hermes empieza a alejarse de la idea de “chat inteligente” y se acerca mucho más a una pieza dentro de una infraestructura de automatización.

Y cuando llegamos a ese punto aparece otra pregunta importante:

si Hermes tiene que recibir eventos, ejecutar automatizaciones, comunicarse con otros servicios o trabajar cuando no estamos delante del ordenador, ¿tiene sentido depender de que nuestro PC esté siempre encendido?

Para mí, cada vez menos.

Las mejoras menos visibles pueden ser las que más importan en tareas largas

Hay una categoría de mejoras de Herald que probablemente no sea la primera que enseñarías en una demostración.

No tiene el impacto visual de hablar con Hermes.

No suena tan futurista como conectar agentes entre sí.

Pero puede acabar teniendo muchísimo peso cuando utilizamos un agente durante horas.

Me refiero a las mejoras de recuperación automática de herramientas.

Herramientas que intentan recuperarse antes de rendirse

Durante una tarea larga pueden ocurrir muchísimas cosas pequeñas.

Una salida del terminal puede ser demasiado grande.

Un parche puede haberse aplicado anteriormente.

Una búsqueda puede devolver cero resultados.

Una operación de escritura puede necesitar comprobar si realmente terminó correctamente.

En un sistema poco robusto, cualquiera de estos casos puede convertirse en un punto de bloqueo.

El agente recibe algo inesperado, interpreta mal la situación o empieza a improvisar una solución que termina desviando toda la tarea.

Herald incorpora mecanismos adicionales para que determinadas herramientas puedan identificar algunos de estos estados y tratar de recuperarse antes de convertir cada pequeño problema en una nueva decisión para el modelo.

Capacidad y robustez no son lo mismo

Creo que aquí conviene distinguir dos conceptos.

Capacidad es lo que un agente sabe hacer.

Robustez es cuánto tiempo puede seguir haciéndolo correctamente cuando aparecen problemas pequeños por el camino.

Un agente podría tener veinte herramientas impresionantes y, sin embargo, resultar poco útil para tareas autónomas si se bloquea constantemente ante cualquier salida inesperada.

Por eso estas mejoras me parecen importantes.

En una demo de cinco minutos quizá no cambien demasiado.

En una ejecución larga pueden ser la diferencia entre recibir el resultado al final o descubrir que el agente se quedó atascado media hora después de empezar.

Un agente autónomo no debería necesitar vigilancia constante

Para mí, esta es una condición bastante básica.

Si utilizo un agente autónomo, no quiero tener que estar pendiente cada cinco minutos porque un comando haya devuelto algo extraño.

Eso no significa que el agente tenga que resolver absolutamente cualquier situación por su cuenta.

Habrá errores que necesiten intervención.

Habrá decisiones que debamos revisar.

Y precisamente Herald mejora también la posibilidad de intervenir.

Pero cuanto mejor sea Hermes diferenciando entre un error trivial recuperable y un problema que realmente necesita mi atención, más sentido tiene delegarle trabajos prolongados.

La autonomía útil no consiste únicamente en eliminar al usuario del proceso.

Consiste en pedir su intervención solamente cuando aporta valor.

¿Tiene sentido ejecutar Hermes Agent en un VPS?

Todas estas novedades refuerzan algo que llevo tiempo pensando: Hermes Agent tiene mucho más sentido cuando no depende de que tengas tu ordenador personal encendido.

No siempre.

Si únicamente quieres probar Hermes, experimentar durante un rato o utilizarlo ocasionalmente, instalarlo en tu propio equipo puede ser suficiente.

El escenario cambia cuando empiezas a utilizar:

  • tareas programadas;
  • automatizaciones;
  • webhooks;
  • trabajos de investigación largos;
  • integraciones;
  • procesos multiagente;
  • servicios que deberían estar disponibles de forma continua.

En esos casos, la disponibilidad se convierte en parte de la infraestructura.

Cuándo tu ordenador empieza a ser una limitación

No hablo necesariamente de potencia.

Tu ordenador puede tener recursos de sobra.

El problema es que un portátil no suele estar pensado para actuar como servidor permanente.

Lo apagas.

Te lo llevas.

Cambias de red.

Entra en suspensión.

Reinicias.

Pierdes conectividad durante un período.

Nada de esto supone un problema cuando utilizas Hermes manualmente.

Pero sí puede serlo cuando esperas que una automatización se ejecute a las cuatro de la mañana o que un webhook pueda llegar en cualquier momento.

Si queremos que el agente se comporte como un servicio, necesitamos una infraestructura que también se comporte como un servicio.

Qué aporta tener Hermes disponible 24/7

Un VPS permite separar el agente de nuestro ordenador cotidiano.

Hermes puede permanecer funcionando aunque cierres el portátil.

Puedes conectarte cuando lo necesites, configurar tareas, mantener integraciones activas y dejar determinados trabajos ejecutándose durante períodos mucho más largos.

Para mí, este tipo de configuración empieza a encajar especialmente bien con Herald.

Si ahora Hermes puede trabajar con webhooks, comunicarse con otros agentes, ejecutar tareas complejas, investigar y recuperarse mejor de determinados fallos, tenerlo disponible permanentemente multiplica las formas en las que podemos utilizar esas capacidades.

VPS para Hermes Agent en HostingTG

Precisamente por eso en HostingTG hemos preparado servidores VPS específicos para Hermes Agent, con Hermes preinstalado y un entorno pensado para tener el agente funcionando las 24 horas.

Los VPS incluyen almacenamiento NVMe, acceso root, conectividad de 1 Gbps, transferencia ilimitada y protección Anti-DDoS, con distintas configuraciones de CPU y memoria según el uso que vayamos a darle.

Pero para mí el principal beneficio no está en enumerar especificaciones.

La idea es mucho más sencilla:

que puedas dedicar el tiempo a configurar Hermes, crear automatizaciones y experimentar con el agente en lugar de empezar preparando toda la infraestructura desde cero.

¿Necesitas realmente un VPS para utilizar Hermes?

No.

Y creo que merece la pena decirlo claramente.

No necesitas contratar un servidor simplemente para empezar a utilizar Hermes Agent.

Para pruebas, aprendizaje o uso puntual, ejecutarlo localmente puede tener todo el sentido.

El VPS empieza a ser interesante cuando lo que buscas ya no es simplemente “usar Hermes”, sino mantener Hermes disponible.

Son dos necesidades diferentes.

Si quieres automatización 24/7, tareas programadas, integraciones persistentes o trabajos que no deberían depender del estado de tu ordenador, entonces sí empieza a encajar mucho mejor.

¿Merece la pena actualizar a Hermes Agent Herald?

Si ya utilizas Hermes Agent, creo que la pregunta más interesante no es si Herald tiene una lista más larga de características que la versión anterior.

La pregunta es si cambia de forma significativa cómo podemos trabajar con el agente.

Y para mí la respuesta es sí.

No porque todas las novedades sean igual de importantes para todo el mundo.

Puede que no utilices voz.

Puede que A2A todavía no tenga ningún papel en tus flujos.

Puede que los webhooks no sean necesarios para el tipo de tareas que haces.

Pero existe un patrón común en varias de las mejoras que sí me parece relevante.

Lo que más me interesa de Herald

Si tuviera que quedarme con cuatro áreas, serían:

la posibilidad de redirigir una tarea, porque no siempre sabemos formular perfectamente un trabajo complejo desde el primer momento;

las interrupciones durante la conversación por voz, porque convierten el audio en una interacción bastante menos rígida;

las citas fundamentadas y la comprobación de hechos, porque un agente que investiga necesita dejar un rastro verificable;

y las mejoras de recuperación ante errores, porque cualquier sistema autónomo resulta mucho más útil cuando no necesita supervisión constante para problemas triviales.

Son cuatro características bastante diferentes.

Sin embargo, todas apuntan hacia algo parecido:

hacer que la autonomía de Hermes sea más manejable.

Herald no solo hace que Hermes pueda hacer más

Esta es la parte que más me interesa de la actualización.

Durante mucho tiempo hemos medido los avances de los agentes principalmente preguntando cuántas cosas podían hacer.

¿Puede navegar?

¿Puede ejecutar código?

¿Puede utilizar herramientas?

¿Puede investigar?

¿Puede automatizar tareas?

Todo eso importa.

Pero llega un punto en el que añadir capacidades sin mejorar el control empieza a producir rendimientos decrecientes.

Cuantas más cosas pueda tocar un agente, más importante es que podamos intervenir cuando toma una mala decisión.

Cuanto más tiempo trabaje sin nosotros, más importante es saber si se ha recuperado correctamente de un error.

Cuanta más investigación deleguemos, más importante es comprobar de dónde han salido sus conclusiones.

Y cuanto más natural sea hablar con él, más importante es poder cortarlo cuando ya sabemos lo que queremos decirle.

Por eso creo que Herald avanza en una dirección adecuada.

No elimina la autonomía.

La hace más utilizable.

Un agente más autónomo también necesita dejarse dirigir

No creo que el futuro de los agentes de IA consista simplemente en conseguir sistemas que hagan cada vez más cosas sin preguntar nada.

De hecho, creo casi lo contrario.

Cuantas más cosas puedan hacer, más importante será poder detenerlos, corregirlos, revisar lo que hacen y cambiar su dirección cuando sea necesario.

Eso es lo que hace que Hermes Agent Herald me resulte interesante.

Sí, la voz llama la atención.

Sí, A2A abre posibilidades interesantes para arquitecturas con varios agentes.

Sí, los webhooks amplían muchísimo el terreno de las automatizaciones.

Y sí, tener mejores mecanismos de recuperación puede hacer que las ejecuciones largas sean bastante más fiables.

Pero si tuviera que quedarme con una idea de Hermes Agent v0.20.0, sería esta:

Hermes empieza a dejarse dirigir mejor mientras trabaja.

Puedo intervenir sin sentir que necesariamente estoy tirando todo el trabajo anterior.

Puedo interrumpir una conversación en lugar de esperar a que termine.

Puedo exigir referencias cuando estoy delegando investigación.

Puedo plantearme dejar tareas más largas funcionando sabiendo que algunas situaciones triviales tienen mejores mecanismos de recuperación.

Y puedo conectar Hermes con una infraestructura más amplia mediante A2A, webhooks o un servidor disponible permanentemente.

Para mí, un agente realmente útil no es el que intenta hacerlo absolutamente todo por su cuenta.

Es el que puede trabajar de forma autónoma cuando lo necesito y, al mismo tiempo, entiende cuándo quiero intervenir.

Herald acerca Hermes Agent bastante más a ese punto.

Dudas de la comunidad

¿Qué es Hermes Agent Herald?

Hermes Agent Herald es el nombre asociado a Hermes Agent v0.20.0, también denominada The Herald Release. La versión incorpora mejoras en conversación por voz, interrupciones, redirección de tareas en ejecución, investigación con citas fundamentadas, fact checking, comunicación A2A, webhooks y recuperación ante determinados errores de herramientas.

¿Qué novedades trae Hermes Agent v0.20.0?

Entre las novedades más destacadas están la voz conversacional en tiempo real, la posibilidad de interrumpir a Hermes mientras habla, las palabras de activación, los redirects durante una tarea, las grounded citations, la comprobación de hechos, A2A, webhooks y distintas mejoras de robustez en las herramientas.

¿Se puede corregir a Hermes mientras está trabajando?

Sí. Una de las novedades más interesantes de Herald es precisamente la posibilidad de redirigir una tarea activa. Esto permite introducir nuevas indicaciones mientras Hermes está trabajando, evitando en determinados casos tener que detener todo el proceso y volver a plantear la tarea desde cero.

¿Hermes Agent permite hablar por voz?

Herald amplía las capacidades de voz de Hermes Agent con conversación en tiempo real, streaming de la respuesta hablada, interrupciones o barge-in y palabras de activación configurables. Esto hace que la interacción se parezca más a una conversación que a una sucesión rígida de turnos.

¿Hermes puede citar y verificar sus fuentes?

Hermes Agent Herald incorpora capacidades de investigación con grounded citations, orientadas a relacionar afirmaciones con fuentes verificables. También incluye mecanismos de fact checking para ayudar a comprobar qué afirmaciones están respaldadas y detectar posibles discrepancias.

¿Qué es A2A en Hermes Agent?

A2A hace referencia a la comunicación agent-to-agent. Permite plantear sistemas en los que Hermes pueda comunicarse con otros agentes, facilitando arquitecturas donde diferentes agentes se especializan en tareas distintas y colaboran dentro de un mismo flujo.

¿Necesito un VPS para utilizar Hermes Agent?

No es obligatorio. Puedes utilizar Hermes Agent en tu propio equipo. Un VPS para Hermes Agent empieza a tener más sentido cuando necesitas que el agente permanezca disponible 24/7, utilice tareas programadas, reciba webhooks, ejecute automatizaciones o realice trabajos que no deberían depender de que tu ordenador personal permanezca encendido.

Opinión Personal

Hermes Agent Herald marca una evolución muy interesante en la forma de trabajar con agentes de IA. No tanto porque añada más funciones, sino porque mejora algo que considero fundamental: la capacidad de intervenir, corregir y supervisar al agente mientras está trabajando.

Funciones como la redirección de tareas, las interrupciones por voz, las citas verificables o la recuperación automática ante determinados errores hacen que Hermes no solo parezca más autónomo, sino también más fácil de controlar cuando esa autonomía necesita ajustes.

Y para mí ahí está la diferencia entre un agente que simplemente impresiona en una demostración y uno que realmente puede resultar útil en el día a día.

Cuanto más trabajo deleguemos a la IA, más importante será poder saber qué está haciendo, de dónde obtiene la información y cómo podemos cambiar su dirección sin tener que empezar desde cero.

Herald me parece un paso acertado precisamente por eso: más autonomía, sí, pero sin renunciar al control humano.

¿Y tú qué opinas? ¿Crees que el futuro de los agentes de IA pasa por darles cada vez más autonomía o por mejorar nuestra capacidad para supervisarlos y corregirlos? Te leo en los comentarios.

Deja un comentario

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *