Assistente de IA Hermes - Instalação, Configuração, Fluxo de Trabalho e Solução de Problemas
Instalação e guia rápido do Hermes Agent para desenvolvedores
O Hermes Agent é um assistente de IA auto-hospedado e agnóstico de modelos que roda em uma máquina local ou em um VPS de baixo custo, opera através de interfaces de terminal e mensagens e melhora ao longo do tempo transformando tarefas repetitivas em habilidades reutilizáveis.
Ele é muito semelhante em funcionalidade ao OpenClaw, outro stack de assistente auto-hospedado construído em torno de ferramentas, memória e controle local. Muitos desenvolvedores encontraram o caminho para o Hermes após a Anthropic bloquear o acesso da assinatura do Claude do OpenClaw em abril de 2026 — a linha do tempo da ascensão e queda do OpenClaw explica por que o Hermes emergiu como o destino natural para usuários que queriam automação persistente e auto-hospedada sem a dependência do provedor.
Se você quer a visão mais ampla de assistentes auto-hospedados, recuperação e infraestrutura local em torno do Hermes, esta visão geral de sistemas de IA vincula esses tópicos aos mesmos problemas que o Hermes está tentando resolver. Para o modelo de assistente em cinco camadas — LLM, memória, ferramentas, roteamento e observabilidade — com Hermes e OpenClaw como implementações de referência, veja Arquitetura de Assistente de IA. Para dados concretos de adoção — estrelas no GitHub, volume diário de tokens do OpenRouter, contagens de download no PyPI, histórico de CVE e sentimento da comunidade no Reddit — o OpenClaw vs Hermes Agent: Estrelas, Downloads & Uso 2026 rastreia como o Hermes se compara a 19 alternativas em todos os sinais mensuráveis.
Para compensações de implantação e escolhas de tempo de execução, Hospedagem de LLM em 2026: Local, Auto-Hospedado & Infraestrutura Nuvem Comparada fornece o mapa de hospedagem, enquanto Desempenho de LLM em 2026: Benchmarks, Gargalos & Otimização cobre o lado de throughput e latência uma vez que o Hermes está em execução. Se você rotineiramente aponta o Hermes para Qwen ou Gemma em tempos de execução locais como o Ollama, consolide predefinições de temperatura e penalidade para o uso de ferramentas em várias etapas com Parâmetros de inferência de LLM agêntico para Qwen e Gemma. Para um mapa compacto de comandos de shell (hermes gateway, hermes memory, hermes doctor, atalhos de barra e mais), use a Folha de dicas do CLI do Hermes Agent. Se o seu principal ponto de entrada for mensagens no celular, use Controle por Voz do Hermes a partir do Seu Celular para o stack de voz e configuração específica da plataforma.

Minha visão tendenciosa: O Hermes é mais interessante quando tratado como infraestrutura, não uma aba que você abre ocasionalmente. Uma vez que ele roda como um serviço e tem um diretório home estável, seus prompts começam a parecer menos “chat” e mais “ops”.
O que é o Hermes Agent e por que ele importa
O Hermes Agent é um agente de IA open-source construído pela Nous Research. Ele é projetado para rodar persistentemente, usar ferramentas (terminal, arquivos, web e mais) e melhorar seu próprio comportamento ao longo do tempo com um sistema de habilidades e memória.
Duas escolhas de design valem a pena ser explicitadas porque elas moldam tudo o resto neste guia.
Primeiro, o Hermes não é bloqueado para um único provedor de modelos. O fluxo de configuração oficial suporta múltiplos provedores e qualquer endpoint compatível com a OpenAI, e a troca é feita via comando hermes model em vez de edições de código.
Segundo, o Hermes traça uma linha dura entre “conversação” e “execução”. O agente pode conversar o dia inteiro, mas quando precisa agir, ele o faz através de ferramentas explícitas e um backend de execução configurável. É aí que moram a segurança, a reprodutibilidade e a solução de problemas.
Custo e licenciamento são refrescantemente entediantes. O próprio Hermes Agent é software livre sob a licença MIT. Se você usar modelos hospedados, o custo contínuo é o que seu provedor cobrar. Se você rodar modelos locais, pode evitar taxas de API completamente.
Se sua configuração do Hermes usa Claude através de camadas de ferramentas externas, esta mudança na assinatura da Anthropic é uma referência útil sobre por que a cobrança baseada em API agora é o caminho esperado.
Instalação do Hermes Agent
O Hermes tem um caminho de instalação rápido para Linux, macOS e WSL2. Os documentos oficiais mantêm isso intencionalmente simples.
Instalação do Hermes no Linux
sudo apt-get update
sudo apt-get upgrade
sudo apt-get curl git
curl -fsSL https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.sh | bash
Após a instalação, recarregue seu shell e inicie o CLI.
source ~/.bashrc # ou source ~/.zshrc
hermes
O instalador não é apenas uma camada fina. De acordo com o guia de instalação, ele configura dependências, o repositório, um ambiente virtual e o comando hermes, e então o leva a um estado inicial pronto para chat.
Se você está chegando de uma implantação existente do OpenClaw em vez de começar do zero, instale e valide um Hermes vazio primeiro, então siga a mudança em estágios em Como Migrar do OpenClaw para o Hermes Agent com Segurança — hermes claw migrate mapeia persona, memória, habilidades, provedores e servidores MCP, mas trabalhos cron, plugins e roteamento multi-agente precisam ser reconstruídos manualmente.
Notas para Windows e Android
Windows nativo não é suportado. Os documentos recomendam WSL2 e rodar o Hermes dentro dele.
Para Android, o Hermes suporta um caminho de instalação Termux. Ele é projetado para detectar o Termux e adaptar sua configuração de dependências e ambiente de acordo.
Início Rápido
A primeira execução mais rápida é literalmente apenas hermes, mas um início rápido significativo significa duas decisões extras: qual provedor de modelo usar e quais ferramentas devem ser habilitadas.
Escolha um provedor e modelo
O Hermes expõe três pontos de entrada complementares:
- hermes model para escolher um provedor e modelo padrão
- hermes tools para habilitar ou desabilitar conjuntos de ferramentas
- hermes setup para executar um assistente interativo através das principais áreas de configuração
Um fluxo mínimo parece com este:
hermes model
hermes tools
hermes
Em termos do que é realmente suportado, o Início Rápido oficial lista uma gama de provedores e também destaca que o Hermes funciona com APIs compatíveis com a OpenAI. Isso importa porque inclui tanto serviços hospedados quanto endpoints auto-hospedados.
Prove a execução de ferramentas cedo
Antes de criar hábitos em torno do Hermes, vale a pena verificar se o uso de ferramentas funciona no seu ambiente. O Início Rápido sugere explicitamente o uso do terminal como o primeiro recurso a tentar.
Na prática, um pequeno prompt de “teste de fumaça” faz dois trabalhos: ele verifica a ferramenta de terminal e valida os prompts de permissão.
Exemplo de prompt:
Mostre meu uso de disco e os cinco maiores diretórios.
Se o Hermes não puder executar a ferramenta de terminal, pule para Solução de Problemas. A configuração incorreta do backend de terminal é uma das causas mais comuns, e a correção é geralmente óbvia uma vez que você olha para a configuração.
Configuração que escala
O Hermes recompensa pessoas que entendem onde ele armazena estado e como ele resolve configuração. É também onde muitos problemas de “funcionava ontem” vêm.
Onde configuração e estado vivem
O Hermes armazena suas configurações e estado sob ~/.hermes. O guia de configuração oficial documenta o layout, incluindo config.yaml para configurações, .env para segredos, auth.json para credenciais OAuth, SOUL.md para identidade e pastas para memórias, habilidades, cron, sessões e logs.
Isso importa por duas razões.
- A depuração se torna mecânica porque você sabe exatamente onde procurar.
- Os backups se tornam diretos porque um diretório captura a maior parte do estado do agente com o qual você se importa.
Precedência de Configuração e Mantendo Segredos Fora do config.yaml
O Hermes resolve configuração com uma ordem de precedência. No topo estão as sobrecrituras da CLI, então o config.yaml, então o .env, com os padrões embutidos na base.
O detalhe interessante é que hermes config set roteia valores para o arquivo certo: chaves de API para .env e configurações não sigilosas para config.yaml.
hermes config set model openrouter/meta-llama/llama-3.1-70b-instruct
hermes config set terminal.backend docker
hermes config set OPENROUTER_API_KEY sk-or-v1-xxxxxxxx
O Hermes também suporta substituição de variáveis de ambiente dentro do config.yaml via sintaxe ${VAR_NAME}. Isso é útil quando você quer manter certos valores no ambiente enquanto ainda os referencia em configuração estruturada.
Sandbox e Backends de Execução
O Hermes suporta múltiplos backends de terminal que definem onde os comandos de shell realmente rodam. O guia de configuração lista local, docker, ssh, modal, daytona e singularity.
A maneira opinativa, mas não evangelizadora, de pensar sobre isso é:
- local é o mais rápido e simples, mas não é isolado
- docker é uma camada pragmática de segurança e reprodutibilidade
- ssh é uma maneira limpa de separar seu dispositivo de chat da sua caixa de computação
- modal e daytona se encaixam em fluxos de trabalho “serverless, mas persistente o suficiente”
- singularity é a opção amigável para HPC
Um exemplo mínimo de backend Docker:
# ~/.hermes/config.yaml
terminal:
backend: docker
docker_image: "nikolaik/python-nodejs:python3.11-nodejs20"
docker_volumes:
- "/home/user/projects:/workspace/projects"
docker_forward_env:
- "GITHUB_TOKEN"
Os documentos também descrevem o endurecimento de segurança para o backend Docker, como drop de capacidades e desabilitação de escalonamento de privilégios.
Habilidades, Memória e Perfis
O Hermes tem dois mecanismos relacionados para valor composto.
Habilidades são memória procedural. O Hermes pode criar, atualizar e excluir suas próprias habilidades e pode oferecer salvar uma abordagem como habilidade após completar uma tarefa complexa.
A memória embutida é armazenada como arquivos como MEMORY.md e USER.md sob ~/.hermes, e o Hermes também pode usar provedores de memória externos para recall mais profundo. Os documentos de memória listam múltiplos plugins de provedores, e o guia de provedores de memória documenta um fluxo de configuração interativo. Para uma quebra técnica completa de como a arquitetura de memória funciona — snapshots congelados, limites de caracteres, os provedores externos e a filosofia por trás da memória limitada — veja Sistema de Memória do Hermes Agent: Como a Memória de IA Persistente Realmente Funciona. Se você quer um provedor local e auto-hospedado com controle incomumente granular sobre o que é escrito automaticamente, veja Mnemosyne para Hermes Agent: Início Rápido de Memória Local — e Loop de Memória Auto-Reforçados em Agentes de IA para por que padrões de escrita conservadores importam em primeiro lugar.
Se você quer múltiplos agentes independentes na mesma máquina, os perfis do Hermes fornecem isolamento. Cada perfil recebe seu próprio diretório com sua própria configuração, segredos, memórias, sessões, habilidades, trabalhos cron e estado do gateway.
Para uma olhada mais profunda em quais habilidades funcionam bem em produção por papel — engenheiros, pesquisadores, operadores e fluxos de trabalho executivos — veja Habilidades do Assistente de IA Hermes para Configurações de Produção Reais. Quando você estiver pronto para autor ou depurar arquivos SKILL.md em si — metadados YAML, níveis de divulgação progressiva, visibilidade condicional e instalações de hub — use Autoria de Skills do Hermes Agent — Estrutura e Boas Práticas do SKILL.md.
Fluxo de Trabalho Típico
Se você trata o Hermes como um agente que você manterá por perto, o fluxo de trabalho começa a parecer com engenharia de serviços.
Uma Base Estável
Uma base que tende não a apodrecer é:
- Instale e execute um primeiro chat no CLI.
- Escolha um provedor e modelo com hermes model, então confirme custos.
- Configure conjuntos de ferramentas e decida se a execução de terminal é local ou em sandbox.
- Faça uma mudança rápida no SOUL.md apenas após você ter usado o padrão por um tempo. Mudanças de identidade importam mais do que as pessoas esperam porque é o “slot 1” no prompt do sistema.
Uso Diário que Compõe
O Hermes tem uma interface de terminal em vez de uma interface web, e é projetado para sessões longas com comandos de barra, sessões retomáveis e saída de ferramentas em streaming. As flags de shell, subcomandos e atalhos de barra para essa sessão estão na Folha de dicas do CLI do Hermes Agent.
Na prática, uma cadência útil é:
- executar trabalho em uma sessão nomeada para um projeto
- comprimir contexto quando ele cresce muito grande
- deixar o Hermes transformar rotinas repetidas em habilidades
- manter uma fronteira mental entre “pedir” e “agir” para que a execução de ferramentas permaneça auditável
Gateway de Mensagens para Acesso 24/7
O gateway de mensagens é a peça que faz o Hermes sentir como um assistente em vez de um aplicativo de terminal. Os documentos descrevem-o como um único processo que se conecta a múltiplas plataformas, lida com sessões, executa trabalhos cron e entrega mensagens.
A configuração é invocada via hermes gateway setup, e o gateway pode rodar em primeiro plano ou como um serviço de usuário. A referência da CLI documenta subcomandos de gateway como run, install, start, stop, status e restart. Se você quer este modelo de gateway rodando em um servidor dedicado enquanto se conecta de um cliente de desktop separado, use Configuração de Servidor Headless e Desktop Remoto do Hermes Agent.
Para backlogs multi-agente e agendamento controlado, veja Kanban no Hermes Agent para Fluxos de Trabalho LLM Auto-Hospedados, que cobre limites de despachante, cadeias de dependência e loteamento baseado em cron.
Segurança para um bot que usa ferramentas importa. Os documentos do gateway descrevem listas de permissões para plataformas específicas e um fluxo de pareamento de DM que emite códigos de pareamento de uso único e requer aprovação via hermes pairing approve.
Atualizações Sem Drama
As atualizações do Hermes são um comando de primeira classe. O guia de atualização documenta hermes update, verificações de migração de configuração e uma pequena rotina de validação pós-atualização incluindo hermes doctor e hermes gateway status.
hermes update
hermes doctor
hermes gateway status
Solução de Problemas e Diagnóstico
A maioria das falhas do Hermes não é misteriosa. Elas parecem misteriosas porque as pessoas só verificam a camada de modelo e ignoram a camada de tempo de execução.
Comandos de Triagem Rápida
A referência da CLI posiciona explicitamente três comandos como o loop central:
- hermes doctor para diagnósticos interativos
- hermes status para uma visão geral rápida
- hermes dump para um resumo de configuração compartilhável e redigido
Para logs, hermes logs faz o tail de arquivos armazenados sob ~/.hermes/logs.
hermes doctor --fix
hermes status
hermes dump --show-keys
hermes logs errors -f
Falhas Comuns de Instalação
O FAQ e o guia de solução de problemas lista vários problemas recorrentes e suas correções, incluindo problemas de versão Python, uv não encontrado e problemas de permissão causados por misturar instalações sudo com instalações de usuário.
Se você encontrar esses erros, os documentos fornecem etapas de remediação específicas como atualizar Python, instalar uv e reinstalar o Hermes sem sudo.
Problemas de Provedor e Modelo
Quando chaves de API não funcionam, o FAQ recomenda verificar configuração, executar hermes model novamente ou definir uma chave diretamente via hermes config set. Ele também destaca um erro comum: as chaves são específicas do provedor.
Para problemas de “modelo não encontrado”, o FAQ aponta para usar hermes model para escolher um identificador válido e mostra tanto sobrecrituras de configuração quanto por sessão.
Limitações de taxa e problemas de comprimento de contexto também são cobertos. O FAQ sugere esperar para erros 429, trocar provedores ou modelos e reduzir a pressão de contexto via compressão ou uma sessão nova.
Problemas de Backend de Terminal e Gateway
Se comandos de terminal falharem imediatamente, o guia de configuração inclui uma seção de “problemas comuns de backend de terminal” e aponta para as causas típicas por backend, incluindo Docker não rodando e variáveis SSH ausentes. Ele também nota que recorrer para local é uma jogada de depuração válida quando a configuração de sandbox está em questão.
Para problemas de gateway, o guia de mensagens destaca listas de permissões e pareamento como os padrões seguros, o que significa que muitos incidentes de “bot está silencioso” são na verdade autorização fazendo seu trabalho.