Idioma e moeda do orçamento.
Sua operação
Cada resposta é uma chamada ao modelo.
Personalidade, regras e funções enviadas em toda chamada.
Trechos do Cérebro IA usados para responder.
Resumo, classificação, extração de dados, roteamento.
Opcional — informe para gerar o orçamento com valores.
Não sabe quantos tokens? Converta caracteres
Aproximadamente 1 token a cada 4 caracteres (~750 palavras por 1.000 tokens).
≈ 0 tokens
Consumo estimado
Tokens por mês
52.320.000
Créditos a contratar (arredondado)
53
52,32 por mês
Por conversa: 17.440 tokens · 0,0174 créditos
Informe o preço por crédito para ver os valores.
Composição do consumo
| Item | Tokens/mês | Participação |
|---|---|---|
| Instruções do agente | 16.200.000 | 31.0% |
| Base de conhecimento | 21.600.000 | 41.3% |
| Histórico | 9.000.000 | 17.2% |
| Mensagens do cliente | 1.080.000 | 2.1% |
| Respostas da IA | 3.240.000 | 6.2% |
| Extras (resumo, classificação) | 1.200.000 | 2.3% |
O que é um crédito de IA
Cada resposta de um agente de IA consome tokens: os de entrada (as instruções do agente, os trechos da base de conhecimento usados, o histórico da conversa e a mensagem do cliente) e os de saída (o texto gerado). A SimplesDesk agrupa esse consumo em créditos — 1 crédito equivale a 1 milhão de tokens do GPT-4.1 mini — para você planejar sem precisar acompanhar token a token.
O que mais consome créditos
- Instruções longas: um prompt de sistema de 2.000 tokens é reenviado em toda resposta.
- Base de conhecimento: recuperar 10 trechos quando 3 bastam triplica a entrada.
- Histórico: conversas longas reenviam mais contexto a cada turno.
- Respostas prolixas: respostas objetivas custam menos e convertem mais.
- Automações paralelas: classificação, resumo e extração de dados também consomem.
Como reduzir o consumo sem perder qualidade
- Instruções enxutas e específicas por fluxo, em vez de um prompt gigante para tudo.
- Base de conhecimento bem segmentada, para recuperar menos trechos e mais relevantes.
- Resumo automático do histórico em conversas longas.
- Respostas curtas e diretas — economizam tokens e mensagens cobradas pela Meta.