Cotas de IA
Como a cota de tokens funciona, o que a consome e o que acontece quando ela se esgota.
Como funcionam as cotas
Os tokens de IA governam o uso das funcionalidades apoiadas em modelos de linguagem. A cota é da organização inteira — todos os usuários consomem do mesmo pool — e reseta no início de cada ciclo de cobrança. Não há acúmulo: token não usado não passa para o ciclo seguinte.
Cota por plano
Plano | Tokens por ciclo |
|---|---|
Essencial | IA não inclusa |
Profissional | 7.500.000 |
Enterprise | 18.000.000 |
Degustação | 500.000 |
A cota da Degustação é deliberadamente muito menor que a do Profissional. Ela existe para dar uma volta completa pelo produto, não para operar uma carteira — os demais limites da Degustação espelham o Enterprise.
O que consome tokens
Validação de resposta PARCIAL ou NA: algumas centenas de tokens por validação, feita por um modelo rápido. Geração de relatório: da ordem de milhares a dezenas de milhares por relatório, conforme a complexidade — um fornecedor P3, que responde 257 controles, gera bem mais conteúdo que um P1, que responde 79. Conversas com a Ara: variam com quantas ferramentas a resposta precisa acionar.
O Aranis não usa um modelo só. As chamadas são roteadas por camadas — uma rápida para tarefas curtas e objetivas, uma de raciocínio para análise e redação longa — e o modelo de cada camada é definido na plataforma, podendo mudar sem alterar o seu plano ou a sua cota. O consumo acumulado do ciclo fica visível em Configurações › Assinatura.
Quando a cota se esgota
Ao atingir o limite, as operações de IA são pausadas até o próximo ciclo ou até um upgrade de plano. Na prática: validações de PARCIAL/NA ficam pendentes, a geração de relatório é bloqueada e a Ara informa que a cota acabou. Tudo que não depende de IA continua funcionando normalmente — navegar, ler dados, responder SIM e NÃO, exportar.