Software
A licença MIT não cobra pelo uso do código. Infraestrutura, modelos e serviços conectados são contas separadas.
O software é gratuito sob licença MIT. A conta aparece na máquina ou servidor que mantém o agente ligado, no modelo de IA, nas ferramentas usadas e no tempo de operação. Rodar localmente elimina a mensalidade de hospedagem, mas não o consumo de energia, armazenamento e manutenção. Em cloud, o valor depende da configuração e do uso.
O Hermes Agent é distribuído sob licença MIT: você baixa, usa e modifica sem pagar licença. O gasto aparece na infraestrutura, no modelo de IA, nas ferramentas e na operação. A tabela resume três formas de usar o agente e mostra o que cada preço deixa de fora.
| Modalidade | Custo mensal | O que entra | O que fica fora |
|---|---|---|---|
| Local (máquina própria) | Sem mensalidade de software | Software MIT, seu hardware e um modelo local | Energia, armazenamento, backup, manutenção e eventual compra de hardware |
| Hospedagem própria | Variável conforme servidor e uso | VM ou servidor, sistema operacional e gateway do agente | Modelo, ferramentas, backup, tráfego e operação |
| Serviço gerenciado | Varia por fornecedor e franquia de uso | Ambiente pronto e parte da manutenção | Excedente de IA, ferramentas e limites do plano |
Uma conversa pode virar várias chamadas ao modelo. O agente planeja etapas, leva contexto e resultados de ferramentas para a próxima chamada, tenta de novo quando algo falha e pode abrir subagentes em paralelo. Cada etapa pode consumir tokens. Por isso, o preço do modelo por milhão de tokens conta só uma parte da história.
A licença MIT não cobra pelo uso do código. Infraestrutura, modelos e serviços conectados são contas separadas.
Onde ele roda: seu computador, um VPS, uma VM ou um servidor dedicado. CPU, memória, armazenamento, tráfego e tempo ligado formam essa parte da conta.
Modelos abertos locais não cobram por token. Modelos por API cobram. O Hermes exige pelo menos 64.000 tokens de contexto.
Navegador, arquivos, terminal e integrações. Algumas consomem o mesmo saldo de créditos do modelo.
Backup, atualização, monitoramento e o tempo de quem mantém o ambiente de pé. Fácil de esquecer, pesa no fim do mês.
Quando uma etapa falha, o agente pode repetir a chamada. Quando divide a tarefa, mais modelos trabalham ao mesmo tempo. A conta acompanha esse volume.
Você roda o Hermes Agent na própria máquina. Se o hardware já existe e o modelo também roda localmente, não há mensalidade de servidor nem cobrança por token.
Ainda entram energia, armazenamento, backup, atualização e o custo de comprar ou melhorar a máquina, quando necessário.
A empresa contratada entrega o ambiente pronto e cuida de parte da manutenção. A cobrança pode juntar infraestrutura com uma franquia de modelos e ferramentas.
Confira como o excedente é cobrado, o que acontece quando os créditos acabam, quais backups existem e se a configuração pode ser exportada.
Você instala o Hermes em um VPS, uma VM ou um servidor e contrata modelos e ferramentas separadamente. Assim controla recursos, localização dos dados e política de backup.
A conta depende de CPU, memória, armazenamento, tráfego e manutenção. Navegador, tarefas paralelas e modelos locais pedem mais recurso.
O Portal oficial da Nous Research vende créditos que alimentam modelos e ferramentas no mesmo saldo. O cloud agent exige US$ 10 em créditos ou uma assinatura ativa. São quatro planos:
| Plano | Preço mensal | Créditos por mês |
|---|---|---|
| Free | US$ 0 | Sem créditos |
| Plus | US$ 20 | US$ 22 |
| Super | US$ 100 | US$ 110 |
| Ultra | US$ 200 | US$ 220 |
O Hermes aceita provedor por assinatura, por API e por endpoint local. No OpenAI Codex, dá para autenticar usando uma assinatura do ChatGPT, mas a documentação oficial ainda não explica como esse uso conta na quota do plano. Não dá para tratar a assinatura como uso ilimitado.
Se você comprar créditos de modelo pelo OpenRouter, a taxa é de 5,5% na compra, com mínimo de US$ 0,80. O serviço informa que não acrescenta margem ao preço da inferência.
Não projete no chute. Rode um dia de tarefas reais e some os tokens gastos por fluxo. É a base de qualquer estimativa séria.
Classificação, resumo e formatação não precisam do modelo mais caro. Use um menor nessas etapas e reserve o forte para o que exige raciocínio.
Se o provedor oferece cache de prompt, aproveite o desconto no contexto que se repete entre chamadas.
Histórico e saídas de ferramentas entram no contexto. Corte resultados que não ajudam a próxima etapa e limite o tamanho da resposta.
Subagentes em paralelo multiplicam o consumo. Dispare apenas os que a tarefa realmente exige.
Defina um teto mensal e um alerta antes de chegar nele. O painel do provedor mostra se o desvio vem do modelo, de uma automação ou de tentativas repetidas.
A Infotécnica não vende assinatura gerenciada do Hermes Agent. Oferecemos infraestrutura brasileira para hospedagem própria, com faturamento em real. A VM e os dados armazenados nela ficam nos nossos datacenters em Florianópolis. Se o Hermes enviar conteúdo a um modelo ou ferramenta externa, esse tráfego segue as regras do provedor escolhido.
Não existe um preço único para esse uso. Modelo, contexto, navegador, tarefas paralelas, armazenamento, backup e disponibilidade mudam o tamanho do ambiente. A proposta só sai depois desse dimensionamento.
Antes de decidir, veja as avaliações de clientes da Infotécnica. Consulte também a página de Datacenter ou o índice de soluções. Para dimensionar o seu caso, fale com um especialista.
Sim. O software é distribuído sob licença MIT, então você pode baixar, usar e modificar sem pagar. O custo aparece quando você adiciona infraestrutura, modelo de IA e ferramentas.
Não existe um valor mensal único. O código não cobra licença. No uso local entram hardware, energia, armazenamento e manutenção. Em VPS ou cloud entram computação, disco, tráfego e backup. Com modelos por API, a conta inclui tokens de entrada e saída, ferramentas e novas tentativas. Serviços gerenciados adicionam a assinatura e as regras de uso do fornecedor.
Não. Você pode rodar na própria máquina. Um VPS ou uma VM fazem sentido quando o agente precisa ficar disponível sem depender do seu notebook ou da sua conexão. Nesse caso, o custo depende dos recursos contratados e do tempo ligado.
O software, sim. O que você gasta em uma instalação local é o que já mantém: energia, armazenamento, backup e o seu tempo. Se usar um modelo por API, os tokens são cobrados à parte.
O OpenAI Codex pode autenticar usando uma assinatura do ChatGPT. A documentação oficial ainda não explica como esse uso conta na quota do plano, então não dá para tratar a assinatura como uso ilimitado. O Hermes também aceita provedor por API e endpoint local.
O modelo precisa ter pelo menos 64.000 tokens de contexto, segundo a documentação oficial. O tamanho do servidor depende de onde o modelo roda, do uso de navegador, do paralelismo e do volume de arquivos. Rode tarefas representativas e meça CPU, memória e armazenamento antes de fechar um contrato.
Múltiplas chamadas por tarefa, histórico longo, resultados de ferramentas, novas tentativas após falha e subagentes em paralelo. Cada etapa pode consumir tokens. Usar um modelo caro em tarefa mecânica e deixar a conta sem limite também pesa.
Sim, por hospedagem própria. A Infotécnica oferece infraestrutura em cloud privada nos datacenters em Florianópolis, com faturamento em real e proposta após dimensionamento. O software, o modelo e as automações ficam sob responsabilidade do cliente. Os dados armazenados na VM ficam no Brasil; conteúdo enviado a APIs externas segue as regras do provedor escolhido.
Dados verificados em 30 de agosto de 2026. Preços de terceiros mudam: confira sempre a fonte antes de fechar a conta.
Conte qual modelo e quais automações você pretende usar. A gente olha o seu contexto e devolve em até 1 dia útil o perfil de infraestrutura adequado ao caso.
cloud privada · fatura em real, com dados no Brasil