Hermes conecta localmente
O provider ativo é honcho. A URL é localhost e não há chave configurada nessa conexão.
O Honcho e seus dados rodam na VPS. Quando precisa interpretar conversas ou criar embeddings, o Honcho chama modelos pelo OpenRouter. São duas conexões diferentes — e só a segunda usa uma chave externa.
As mensagens entram pelo Hermes, são persistidas na infraestrutura local e passam por inferência externa somente quando o Honcho precisa derivar ou recuperar contexto.
127.0.0.1:8000.“Honcho local” não significa “LLM local”. O armazenamento e a aplicação estão na VPS; a inferência continua sendo remota.
O provider ativo é honcho. A URL é localhost e não há chave configurada nessa conexão.
Mensagens, perfis, conclusões e vetores ficam no Postgres local da VPS.
Uma chave exclusiva do Honcho autentica as chamadas de LLM e embeddings.
Os valores abaixo vieram da API administrativa do OpenRouter para a chave dedicada chamada “honcho”. Não incluem o preço da VPS.
Hoje e na semana os valores arredondam para US$0,00 em duas casas; houve menos de um centavo de consumo. O acumulado histórico não deve ser atribuído integralmente à configuração gratuita atual.
| Componente | Preço publicado | Impacto esperado agora |
|---|---|---|
| Honcho, Postgres e Redis Self-hosted na VPS | Sem licença Honcho Cloud | Incluído na VPS |
| Nemotron 3 Super 120B A12B LLM usado por deriver, summaries e dialectic | Endpoint gratuito | US$0,00 por token |
| Text Embedding 3 Small Busca semântica | US$0,02 / 1 milhão de tokens | Muito baixo, mas não zero |
| OpenRouter Roteamento e cobrança | Conforme modelo e plano | Créditos e limites da conta |
A pergunta do instalador trata da localização do servidor Honcho — não da localização do modelo usado pelo Honcho.
Informe a URL local do Honcho. Token pode ficar em branco quando o servidor está com autenticação desabilitada e restrito ao localhost.
Use quando o Honcho está hospedado pela plataforma externa. Nesse caso, o Hermes recebe uma API key do próprio Honcho Cloud.
A configuração é econômica, mas “gratuito” não é sinônimo de local, ilimitado ou privado.
O endpoint gratuito do Nemotron informa que requisições podem ser registradas para segurança e melhoria dos produtos NVIDIA. Portanto, dados enviados à inferência saem da VPS. Evite material confidencial ou troque por um provedor/política compatível.
Modelos gratuitos podem ter fila, rate limit ou mudar de disponibilidade. O OpenRouter publica limite de 50 requisições/dia no plano gratuito; contas com créditos podem ter limites globais diferentes.
O Honcho está auto-hospedado, mas usa modelos remotos por API.
Hermes → Honcho é local e sem chave; Honcho → OpenRouter é remoto e usa uma chave exclusiva. O LLM atual é gratuito, enquanto embeddings têm custo residual de US$0,02 por milhão de tokens.
Documentação e preços consultados na geração do artefato.