Hermes / Max · Honcho Memory
Estado verificado em 21/07/2026 · 10:18 BRT
Valores em dólar americano
Arquitetura explicada sem mistério

Local para armazenar.
API para pensar.

O Honcho e seus dados rodam na VPS. Quando precisa interpretar conversas ou criar embeddings, o Honcho chama modelos pelo OpenRouter. São duas conexões diferentes — e só a segunda usa uma chave externa.

O fluxo completo

As mensagens entram pelo Hermes, são persistidas na infraestrutura local e passam por inferência externa somente quando o Honcho precisa derivar ou recuperar contexto.

AGENTEHermes / MaxConversa com o usuário e usa o Honcho como provedor adicional de memória.
  • Modo de recall híbrido
  • Contexto limitado a 1.200 tokens
  • Gravação assíncrona
VPS · LOCALHOSTHoncho self-hostedAPI acessível apenas em 127.0.0.1:8000.
  • API + deriver em Docker
  • Postgres/pgvector para dados
  • Redis para apoio operacional
OPENROUTERNemotron 3 SuperAnálise, síntese, dialectic e derivação de memória.
OPENROUTEREmbedding 3 SmallVetores usados na busca semântica.
A chave que existe é do OpenRouter. Ela fica dentro do serviço Honcho. O Hermes não precisa de API key para falar com o Honcho local nesta instalação.

Quem faz o quê

“Honcho local” não significa “LLM local”. O armazenamento e a aplicação estão na VPS; a inferência continua sendo remota.

01

Hermes conecta localmente

O provider ativo é honcho. A URL é localhost e não há chave configurada nessa conexão.

02

Honcho guarda e organiza

Mensagens, perfis, conclusões e vetores ficam no Postgres local da VPS.

03

OpenRouter executa os modelos

Uma chave exclusiva do Honcho autentica as chamadas de LLM e embeddings.

Custos observados

Os valores abaixo vieram da API administrativa do OpenRouter para a chave dedicada chamada “honcho”. Não incluem o preço da VPS.

Acumulado da chaveUS$23,14
Mês atualUS$1,66
Semana atualUS$0,00
HojeUS$0,00

Hoje e na semana os valores arredondam para US$0,00 em duas casas; houve menos de um centavo de consumo. O acumulado histórico não deve ser atribuído integralmente à configuração gratuita atual.

ComponentePreço publicadoImpacto esperado agora
Honcho, Postgres e Redis
Self-hosted na VPS
Sem licença Honcho CloudIncluído na VPS
Nemotron 3 Super 120B A12B
LLM usado por deriver, summaries e dialectic
Endpoint gratuitoUS$0,00 por token
Text Embedding 3 Small
Busca semântica
US$0,02 / 1 milhão de tokensMuito baixo, mas não zero
OpenRouter
Roteamento e cobrança
Conforme modelo e planoCréditos e limites da conta

Qual opção escolher?

A pergunta do instalador trata da localização do servidor Honcho — não da localização do modelo usado pelo Honcho.

✓ ESTA INSTALAÇÃO

Local / self-hosted

Informe a URL local do Honcho. Token pode ficar em branco quando o servidor está com autenticação desabilitada e restrito ao localhost.

ALTERNATIVA

Cloud / API

Use quando o Honcho está hospedado pela plataforma externa. Nesse caso, o Hermes recebe uma API key do próprio Honcho Cloud.

O que não pode ser confundido

A configuração é econômica, mas “gratuito” não é sinônimo de local, ilimitado ou privado.

Privacidade

O endpoint gratuito do Nemotron informa que requisições podem ser registradas para segurança e melhoria dos produtos NVIDIA. Portanto, dados enviados à inferência saem da VPS. Evite material confidencial ou troque por um provedor/política compatível.

Disponibilidade e limites

Modelos gratuitos podem ter fila, rate limit ou mudar de disponibilidade. O OpenRouter publica limite de 50 requisições/dia no plano gratuito; contas com créditos podem ter limites globais diferentes.

Resumo em uma frase

O Honcho está auto-hospedado, mas usa modelos remotos por API.

Hermes → Honcho é local e sem chave; Honcho → OpenRouter é remoto e usa uma chave exclusiva. O LLM atual é gratuito, enquanto embeddings têm custo residual de US$0,02 por milhão de tokens.

Fontes

Documentação e preços consultados na geração do artefato.