IA de fronteira, infraestrutura própria, preço em reais.
Uma API compatível com OpenAI sobre Qwen3.8, MiniMax-M2.7, Step-3.7, GLM-5.3, a família Hunyuan e o Hy4 780B — rodando nas GPUs da BeansTech, sem intermediários americanos, com cobrança por token e pagamento por Pix. Dados pessoais sensíveis são bloqueados antes de sair do país.
Modelos
Todos servidos pela nossa própria frota, com API idêntica à da OpenAI. Troque só o base_url.
| ID | Modelo | Contexto | Recursos | Tier |
|---|---|---|---|---|
qwen3.8-flash | Qwen3.8-Flash-Next 176B MoE | 32k | raciocíniotools | Pro |
minimax-m2.7 | MiniMax-M2.7 230B MoE | 128k | agentestoolsraciocínio | Max |
step-3.7-flash | Step-3.7-Flash 198B | 64k | imagemtoolsraciocínio | Pro |
glm-5.3-flash | GLM-5.3-Flash 320B MoE | 128k | raciocíniotools | Max |
hy3 | Hy3 295B MoE (Tencent Hunyuan) | 32k | tools | Max |
hunyuan-a13b | Hunyuan-A13B 80B MoE | 32k | raciocínio | Pro |
hunyuan-7b | Hunyuan-7B | 32k | rápido | Flash |
ui-mate-9b | UI-Mate 9B — telas e interfaces | 16k | imagem | Flash |
hunyuan-ocr | HunyuanOCR — documentos | 16k | imagem | Flash |
hy4-780b | Hy4-preview 780B (Tencent) | 16k | raciocínioEnterprise | Enterprise |
Preços por token
Cobrança exata pelos tokens processados (entrada + saída), debitada do seu saldo em créditos. Sem mínimo, sem taxa de assinatura para começar. Valores em reais por 1 milhão de tokens.
| Tier | Modelos | Entrada / 1M | Saída / 1M | Imagem |
|---|---|---|---|---|
| Flash | hunyuan-7b · ui-mate-9b · hunyuan-ocr | R$ 0,50 | R$ 2,00 | + R$ 1,00 / imagem |
| Pro | qwen3.8-flash · hunyuan-a13b · step-3.7-flash | R$ 2,50 | R$ 10,00 | + R$ 1,00 / imagem |
| Max | minimax-m2.7 · glm-5.3-flash · hy3 | R$ 5,00 | R$ 20,00 | — |
| Enterprise | hy4-780b | R$ 20,00 | R$ 80,00 | — |
Referência: uma resposta de 1.000 tokens no Qwen3.8 custa R$ 0,01. Modelos com raciocínio contam os tokens de raciocínio como saída.
Planos
Créditos avulsos não expiram por 12 meses. Planos mensais incluem créditos renovados a cada ciclo, mais limite de requisições e garantias. Pagamento por Pix ou cartão.
Dev
- Todos os modelos Flash, Pro e Max
- 60 requisições/min
- Créditos válidos por 12 meses
- Pix ou cartão
Pro
- R$ 400 em créditos/mês
- 60 requisições/min
- Suporte por e-mail
- Extrato de uso por chave
Business
- R$ 1.500 em créditos/mês
- 300 requisições/min
- SLA 99,5%
- Logs de auditoria exportáveis
- Residência BR sob demanda
Enterprise
- R$ 3.500 em créditos/mês
- Hy4-preview 780B incluído
- 1.000 requisições/min
- Residência de dados no Brasil garantida
- DPA/contrato LGPD assinado
- Nó dedicado opcional
Comprar
Informe seu e-mail e escolha. Ao confirmar o pagamento, sua chave bth_… aparece aqui — guarde-a; ela não é enviada por e-mail e só é exibida uma vez.
Documentação
Compatível com qualquer SDK da OpenAI. Base URL https://api.beanstech.io/v1.
Python
from openai import OpenAI
client = OpenAI(base_url="https://api.beanstech.io/v1",
api_key="bth_...")
r = client.chat.completions.create(
model="qwen3.8-flash",
messages=[{"role":"user","content":"Resuma a LGPD em 3 frases."}],
stream=True)
for chunk in r:
print(chunk.choices[0].delta.content or "", end="")curl
curl https://api.beanstech.io/v1/chat/completions \
-H "Authorization: Bearer bth_..." \
-H "Content-Type: application/json" \
-d '{"model":"hy3",
"messages":[{"role":"user","content":"Olá"}]}'
# imagem (step-3.7-flash, ui-mate-9b, hunyuan-ocr)
# content: [{"type":"text","text":"..."},
# {"type":"image_url","image_url":{"url":"data:image/png;base64,..."}}]Endpoints
GET /v1/models catálogo com preço e região · POST /v1/chat/completions (stream, tools, response_format) · GET /v1/balance saldo · GET /v1/usage extrato
Cabeçalhos de resposta
x-beans-cost-cents custo da chamada · x-beans-balance-cents saldo restante. Em stream, um evento final {"beans":{…}} antes de [DONE].
Erros
401 chave inválida · 402 saldo insuficiente · 403 modelo exige plano · 429 limite/min · 451 bloqueio por residência de dados ou dado sensível · 502 modelo indisponível (sem cobrança)
Residência de dados
Envie x-data-residency: br para exigir processamento no Brasil. Se nenhum modelo elegível estiver disponível, a chamada retorna 451 em vez de rotear para fora.
Privacidade e dados
Regras aplicadas pelo gateway, não por promessa de marketing.
Infra própria
Os modelos rodam em GPUs contratadas pela BeansTech na Alibaba Cloud (Virgínia-EUA, Singapura e Shenzhen-China). Nenhum provedor de modelo (OpenAI, Anthropic, Google etc.) recebe seus dados. Não há proxy de terceiros na frente da API.
Sem retenção de conteúdo
Prompts, respostas e imagens não são gravados. A auditoria registra apenas metadados: hash do IP, modelo, tokens, latência, resultado. Retenção de 90 dias.
Dados sensíveis não saem do país
Antes de rotear, o gateway procura CPF, CNS, CNPJ, cartão e termos de prontuário médico. Encontrou e a rota é fora do Brasil? A chamada é bloqueada (451) — o texto não é enviado. Mesma regra que aplicamos na BeansMed/RagMed para dados de saúde.
LGPD
Transferência internacional de dados não sensíveis com base no art. 33 da LGPD; DPA disponível nos planos Business e Enterprise. Controlador: Beans Tech. Contato do encarregado: privacidade@beanstech.ai.
Termos de uso (resumo)
Serviço fornecido "como está", com SLA apenas nos planos que o declaram. Proibido uso para conteúdo ilícito, dados de terceiros sem base legal, ou para treinar modelos concorrentes com as saídas. Créditos avulsos valem 12 meses; créditos de assinatura valem no ciclo. Reembolso de chamadas que falharem antes de produzir resposta é automático. Podemos suspender chaves em caso de abuso. Foro: São Paulo/SP.