preáLista de espera

Perguntas frequentes

O que costuma ser perguntado antes de colocar a primeira chamada em produção. Falta alguma? Escreva para nós.

Cobrança e contrato

Como funciona a cobrança?

É pré-pago, em real. Você compra créditos e cada chamada debita do saldo pela contagem de tokens de entrada e de saída, no preço da classe do modelo. Nada é cobrado além do que você já comprou.

O que acontece quando o crédito acaba?

A chave para de responder até a recarga. É assim que o pré-pago funciona aqui: em vez de uma fatura no fim do mês, o gateway bloqueia a conta quando o saldo zera.

Sai nota fiscal?

Sim. A cobrança é feita por empresa brasileira e a nota sai na compra de créditos, não a cada chamada. Pix e cartão entram quando o self-serve abrir.

Existe plano pós-pago ou fatura mensal?

Só por contrato, nos projetos customizados. No self-serve tudo é pré-pago, o que evita inadimplência de um lado e surpresa do outro.

Vocês têm SLA?

Ainda não publicamos SLA. Disponibilidade, prioridade e suporte com prazo entram por contrato, nos projetos customizados, junto com capacidade reservada.

Dados e segurança

Vocês treinam modelos com os meus dados?

Não. O conteúdo dos seus prompts e das respostas não é usado para treinar nada, nem nosso nem de terceiros, e não fica armazenado no preá.

O que fica guardado de cada chamada?

Apenas metadados de uso: modelo, contagem de tokens, latência e custo. É o que sustenta a cobrança e a operação da frota.

Onde os meus dados são processados?

Hoje as GPUs ficam em provedores fora do Brasil, o que configura transferência internacional nos termos da LGPD. O processamento em solo brasileiro entra em seguida, para quem não pode transferir.

Como as chaves de API são guardadas?

A chave aparece uma única vez, no momento em que você a cria. Depois disso guardamos só o hash: se você perder a chave, cria outra e revoga a antiga.

API e modelos

A API é compatível com a da OpenAI?

Ela usa o mesmo formato de requisição e resposta. Na prática você troca a URL base e a chave no cliente que já usa, e o resto do código continua igual.

Quais modelos posso chamar?

O catálogo de abertura, com modelos abertos de licença permissiva, e modelos grandes por passagem, sob consulta. Você também pode servir os seus pesos como modelo privado.

Posso subir os meus próprios pesos?

Pode. Um adapter LoRA seu vira um modelo privado, cobrado pelo preço da base mais um quarto. Os pesos ficam isolados por cliente e não são compartilhados.

Há limite de uso por chave?

Há limites de requisições e de tokens por chave, para proteger a frota de picos. Eles são ajustáveis conforme o seu volume, e acima disso a conversa vira contrato.

Como eu começo hoje?

Entre na lista de espera da página inicial. Quando o self-serve abrir, você cria a conta, compra crédito e gera a chave. Se o seu caso é mais do que a API, escreva para [email protected].