IA de fronteira, infraestrutura própria, preço em reais.

Uma API compatível com OpenAI sobre Qwen3.8, MiniMax-M2.7, Step-3.7, GLM-5.3, a família Hunyuan e o Hy4 780B — rodando nas GPUs da BeansTech, sem intermediários americanos, com cobrança por token e pagamento por Pix. Dados pessoais sensíveis são bloqueados antes de sair do país.

10modelos em produção, até 780B de parâmetros
48GPUs NVIDIA L20 dedicadas (Virgínia · Singapura · Shenzhen)
R$ 0,50por milhão de tokens de entrada, a partir de
0prompts gravados — auditoria só com metadados

Modelos

Todos servidos pela nossa própria frota, com API idêntica à da OpenAI. Troque só o base_url.

IDModeloContextoRecursosTier
qwen3.8-flashQwen3.8-Flash-Next 176B MoE32kraciocíniotoolsPro
minimax-m2.7MiniMax-M2.7 230B MoE128kagentestoolsraciocínioMax
step-3.7-flashStep-3.7-Flash 198B64kimagemtoolsraciocínioPro
glm-5.3-flashGLM-5.3-Flash 320B MoE128kraciocíniotoolsMax
hy3Hy3 295B MoE (Tencent Hunyuan)32ktoolsMax
hunyuan-a13bHunyuan-A13B 80B MoE32kraciocínioPro
hunyuan-7bHunyuan-7B32krápidoFlash
ui-mate-9bUI-Mate 9B — telas e interfaces16kimagemFlash
hunyuan-ocrHunyuanOCR — documentos16kimagemFlash
hy4-780bHy4-preview 780B (Tencent)16kraciocínioEnterpriseEnterprise

Preços por token

Cobrança exata pelos tokens processados (entrada + saída), debitada do seu saldo em créditos. Sem mínimo, sem taxa de assinatura para começar. Valores em reais por 1 milhão de tokens.

TierModelosEntrada / 1MSaída / 1MImagem
Flashhunyuan-7b · ui-mate-9b · hunyuan-ocrR$ 0,50R$ 2,00+ R$ 1,00 / imagem
Proqwen3.8-flash · hunyuan-a13b · step-3.7-flashR$ 2,50R$ 10,00+ R$ 1,00 / imagem
Maxminimax-m2.7 · glm-5.3-flash · hy3R$ 5,00R$ 20,00—
Enterprisehy4-780bR$ 20,00R$ 80,00—

Referência: uma resposta de 1.000 tokens no Qwen3.8 custa R$ 0,01. Modelos com raciocínio contam os tokens de raciocínio como saída.

Planos

Créditos avulsos não expiram por 12 meses. Planos mensais incluem créditos renovados a cada ciclo, mais limite de requisições e garantias. Pagamento por Pix ou cartão.

Dev

pré-pago · a partir de R$ 50
  • Todos os modelos Flash, Pro e Max
  • 60 requisições/min
  • Créditos válidos por 12 meses
  • Pix ou cartão
Comprar créditos

Pro

R$ 297/mês
  • R$ 400 em créditos/mês
  • 60 requisições/min
  • Suporte por e-mail
  • Extrato de uso por chave
Assinar Pro

Business

R$ 997/mês
  • R$ 1.500 em créditos/mês
  • 300 requisições/min
  • SLA 99,5%
  • Logs de auditoria exportáveis
  • Residência BR sob demanda
Assinar Business

Enterprise

R$ 2.000/mês
  • R$ 3.500 em créditos/mês
  • Hy4-preview 780B incluído
  • 1.000 requisições/min
  • Residência de dados no Brasil garantida
  • DPA/contrato LGPD assinado
  • Nó dedicado opcional
Assinar Enterprise

Comprar

Informe seu e-mail e escolha. Ao confirmar o pagamento, sua chave bth_… aparece aqui — guarde-a; ela não é enviada por e-mail e só é exibida uma vez.

R$ 50R$ 50 em créditos
R$ 200R$ 220 em créditos (+10%)
R$ 1.000R$ 1.200 em créditos (+20%)

Documentação

Compatível com qualquer SDK da OpenAI. Base URL https://api.beanstech.io/v1.

Python

from openai import OpenAI
client = OpenAI(base_url="https://api.beanstech.io/v1",
                api_key="bth_...")
r = client.chat.completions.create(
    model="qwen3.8-flash",
    messages=[{"role":"user","content":"Resuma a LGPD em 3 frases."}],
    stream=True)
for chunk in r:
    print(chunk.choices[0].delta.content or "", end="")

curl

curl https://api.beanstech.io/v1/chat/completions \
  -H "Authorization: Bearer bth_..." \
  -H "Content-Type: application/json" \
  -d '{"model":"hy3",
       "messages":[{"role":"user","content":"Olá"}]}'

# imagem (step-3.7-flash, ui-mate-9b, hunyuan-ocr)
# content: [{"type":"text","text":"..."},
#           {"type":"image_url","image_url":{"url":"data:image/png;base64,..."}}]

Endpoints

GET /v1/models catálogo com preço e região · POST /v1/chat/completions (stream, tools, response_format) · GET /v1/balance saldo · GET /v1/usage extrato

Cabeçalhos de resposta

x-beans-cost-cents custo da chamada · x-beans-balance-cents saldo restante. Em stream, um evento final {"beans":{…}} antes de [DONE].

Erros

401 chave inválida · 402 saldo insuficiente · 403 modelo exige plano · 429 limite/min · 451 bloqueio por residência de dados ou dado sensível · 502 modelo indisponível (sem cobrança)

Residência de dados

Envie x-data-residency: br para exigir processamento no Brasil. Se nenhum modelo elegível estiver disponível, a chamada retorna 451 em vez de rotear para fora.

Privacidade e dados

Regras aplicadas pelo gateway, não por promessa de marketing.

Infra própria

Os modelos rodam em GPUs contratadas pela BeansTech na Alibaba Cloud (Virgínia-EUA, Singapura e Shenzhen-China). Nenhum provedor de modelo (OpenAI, Anthropic, Google etc.) recebe seus dados. Não há proxy de terceiros na frente da API.

Sem retenção de conteúdo

Prompts, respostas e imagens não são gravados. A auditoria registra apenas metadados: hash do IP, modelo, tokens, latência, resultado. Retenção de 90 dias.

Dados sensíveis não saem do país

Antes de rotear, o gateway procura CPF, CNS, CNPJ, cartão e termos de prontuário médico. Encontrou e a rota é fora do Brasil? A chamada é bloqueada (451) — o texto não é enviado. Mesma regra que aplicamos na BeansMed/RagMed para dados de saúde.

LGPD

Transferência internacional de dados não sensíveis com base no art. 33 da LGPD; DPA disponível nos planos Business e Enterprise. Controlador: Beans Tech. Contato do encarregado: privacidade@beanstech.ai.