Neste artigo você entende como funciona a cota de tokens de IA no Envia.Click e o que acontece quando ela é excedida.
O que são tokens?
Tokens são a unidade de medida do consumo de modelos de linguagem (LLM). Cada mensagem processada por um Agente IA consome tokens — tanto a entrada (mensagem do cliente) quanto a saída (resposta gerada).
Uma frase típica consome entre 10 e 50 tokens. Uma conversa completa pode consumir centenas de tokens.
Como funciona a cota
- Cada assento ativo inclui uma cota mensal de tokens de IA Gerenciada.
- A cota é renovada no início de cada ciclo de faturamento.
- O uso acumulado é visível em Configurações → Plano & Faturamento.
IA Gerenciada vs. BYOK
| IA Gerenciada | BYOK | |
|---|---|---|
| O que é | Tokens incluídos no plano (OpenRouter/gpt-4o-mini) | Sua própria chave de API |
| Cota | Sim — limitada pelo plano | Ilimitada (você paga ao provedor) |
| Excedente | Cobrado pela Envia.Click | Cobrado pelo seu provedor de IA |
O que acontece ao estourar a cota
- Se você usar BYOK, não há impacto — o custo vai para a sua conta no provedor de IA.
- Se você usar IA Gerenciada e ultrapassar a cota:
- O excedente é calculado por token.
- A cobrança extra aparece na próxima fatura.
- O Agente IA não para de funcionar — ele continua respondendo no excedente.
Dica: monitore o consumo semanalmente em Plano & Faturamento. Se o uso estiver alto, considere usar BYOK com um modelo econômico (gpt-4o-mini ou claude-3-haiku).
Próximos passos
- Configurando o LLM (BYOK) — configure sua própria chave para controlar os custos.
- Monitorando execuções (runs) — veja o consumo de tokens por execução.