AIVAX

Esta página foi traduzida automaticamente do inglês e pode estar desatualizada. Leia o original

Preços

Os preços de uso do serviço são listados abaixo em USD. M significa um milhão de tokens; 1k significa mil unidades. Preços aproximados (~) variam conforme o modelo usado e o trabalho realizado.

Veja preços de assinatura para preços mensais dos planos e Planos e limites para cotas. As taxas de uso estão sujeitas ao multiplicador do plano:

  • Free: +25% nos impostos de inferência;
  • Pro: +5% nos impostos de inferência;
  • Max: 0% nos impostos de inferência.

BYOK não são afetados pelos impostos de inferência.

Free, Pro e Max incluem cotas diárias separadas para embeddings RAG elegíveis, reranking Reflex, decisões semânticas Julia-1 e extração Fetch/OCR. As taxas abaixo se aplicam quando um item medido não está coberto. A cobertura é tudo ou nada por item, não necessariamente por requisição completa: um item que não cabe na cota restante e sua margem permitida é cobrado integralmente. Compare as cotas e verifique exclusões em Planos e limites. A cobertura de assinatura LLM está atualmente desativada.

Inferência e Moderação #

As taxas de inferência dependem do modelo selecionado, provedor, tamanho da entrada e tipo de mídia. A moderação é cobrada separadamente em Unidades de Processamento (PUs), cobrindo uso de entrada, entrada em cache e saída; seu preço por PU varia conforme o modelo e provedor usados.

DescriçãoPreço
Inferência de modelo de IA e gateway de IASelected model and provider rates
Moderação de entradaVariable price per PU; separate from the main inference charge

Testes de Agente #

Cada teste inclui as cobranças de inferência do modelo selecionado ou do gateway de IA, além do uso de usuário simulado e juiz nas taxas do perfil selecionado.

DescriçãoPreço
Modelo ou gateway de IA em testeRegular inference rates
Perfil baixo - usuário simuladoInput $0.25/M tokens; cache $0.025/M tokens; output $1.50/M tokens
Perfil baixo - juizInput $0.30/M tokens; cache $0.03/M tokens; output $2.50/M tokens
Perfil médio - usuário simuladoInput $0.75/M tokens; cache $0.075/M tokens; output $3.75/M tokens
Perfil médio - juizInput $0.75/M tokens; cache $0.075/M tokens; output $3.75/M tokens
Perfil alto - usuário simuladoInput $0.75/M tokens; cache $0.075/M tokens; output $3.75/M tokens
Perfil alto - juizInput $1.25/M tokens; cache $0.15/M tokens; output $4.25/M tokens

RAG e Coleções #

Indexação e busca são cobradas por uso de tokens. Respostas RAG geradas são cobradas separadamente da incorporação de consulta, e seu preço varia com o modelo de sumarização.

DescriçãoPreço
Incorporação de texto da coleção$0.10/M tokens
Busca semântica - falha no cache de consulta$0.10/M tokens
Busca semântica - acerto no cache de consultaZero
Geração de resposta RAG~$0.50/M tokens, excluding query rates
Reflex - falha no cache$0.015/M tokens
Reflex - acerto no cache$0.003/M tokens

Injetor de Mídia #

Converter mídia em documentos RAG é cobrado por entrada, entrada em cache, saída e uso de mídia. O arquivo fonte, contexto opcional e conteúdo gerado afetam o total. As taxas dependem do tipo de mídia e volume de tokens de entrada.

DescriçãoPreço
PDFs e imagens - até 272K tokens de entradaInput $0.30/M tokens; cache $0.03/M tokens; output $1.80/M tokens
PDFs e imagens - acima de 272K tokens de entradaInput $0.60/M tokens; cache $0.06/M tokens; output $3.60/M tokens
Áudio - até 256K tokens de entradaInput/media $0.60/M tokens; cache $0.12/M tokens; output $3.00/M tokens
Áudio - acima de 256K tokens de entradaInput/media $1.20/M tokens; cache $0.24/M tokens; output $6.00/M tokens
VídeoInput/media $0.45/M tokens; cache $0.045/M tokens; output $3.75/M tokens

Ferramentas de Texto #

Segmentação e classificação de texto são cobradas por uso de tokens.

DescriçãoPreço
Segmentação de texto$0.30/M tokens
Classificação de texto$0.10/M tokens

Voz e Mídia #

As taxas de geração e transcrição dependem do modelo selecionado. O preço da descrição de mídia é aproximado e depende do modelo de processamento disponível.

DescriçãoPreço
Sessões de vozSelected realtime model rates
Fala para textoVaries by model
Texto para falaVaries by model
Geração de imagemFixed output and reference-image tariffs by model
Descrições de mídia~$1.50/M tokens

A geração de imagem cobra cada saída entregue ao preço fixo de saída do modelo selecionado, mais seu preço por referência para cada referência enviada com essa saída. O processamento do prompt está incluído. Provedores com preços por token e megapixel usam estimativas arredondadas, não repasse exato de custo do provedor. Nenhuma marcação adicional de geração de imagem AIVAX ou multiplicador de conta e plano se aplica. As tarifas atuais estão listadas no catálogo de Modelos; veja Geração de imagem.

Busca na Web, OCR e Fetch #

Buscas na Web e X são cobradas por busca. Busca avançada na web é cobrada por uso de tokens e varia conforme o modelo e número de interações. Extração Fetch e OCR usam Unidades de Processamento (PUs), com uma cota diária gratuita por plano. Conversão JSON guiada por esquema opcional é cobrada separadamente. As cotas de extração e taxas de PU não se aplicam à conversão JSON ou moderação.

DescriçãoPreço
Busca na Web$5/1k searches
Busca X (Twitter)$5/1k searches
Busca avançada na web~$0.75/M tokens
Extração Fetch e OCR - GratuitaBase daily allowance; uncovered items $0.15/1k PUs
Extração Fetch e OCR - Pro10× Free daily allowance; uncovered items $0.05/1k PUs
Extração Fetch e OCR - Max5× Pro daily allowance; uncovered items $0.02/1k PUs
Conversão JSON Fetch (responseSchema)Variable inference-based price per PU; charged separately, with no daily extraction allowance

Para a API Fetch, processingUnits relata o uso de extração de texto/OCR e jsonProcessingUnits relata o uso adicional de conversão JSON guiada por esquema. As PUs JSON contabilizam uso de tokens de entrada, entrada em cache e saída nas taxas do modelo e provedor de processamento; elas não são precificadas à taxa OCR do plano. O multiplicador de inferência do plano se aplica à conversão JSON. Omitir responseSchema ou defini‑lo como null desativa a conversão, relata jsonProcessingUnits: 0 e não gera cobrança de conversão JSON.

Armazenamento #

Cada plano inclui armazenamento. Excedentes de Pro e Max são cobrados por hora nas taxas mensais abaixo; o armazenamento gratuito não pode ser expandido.

DescriçãoPreço
Armazenamento gratuito30 MB included; no expansion
Armazenamento Pro2 GB included; excess $0.50/GB/month
Armazenamento Max20 GB included; excess $0.20/GB/month

Outras Ferramentas #

As ferramentas a seguir não têm cobrança separada. A inferência do modelo usada para acioná‑las ainda é cobrada à sua taxa regular.

DescriçãoPreço
Memória e calendárioNo separate charge
Solicitações avançadasNo separate charge
Geração de documentoNo separate charge
Geração de página webNo separate charge

Digite para pesquisar na documentação.