Como migrar da OpenAI para o Banana Chat?
Na maioria dos projetos, a migração é um drop-in: crie uma chave `bc_live_`, troque `OPENAI_BASE_URL` para o endpoint do Banana Chat e mantenha o restante da integração com o SDK oficial da OpenAI.
Os mesmos modelos que sua empresa já usa. Mesma qualidade, 60% mais baratos que os valores de referência, faturados em reais sem risco cambial — com cache de prompt para reduzir ainda mais o custo de prefixos repetidos.
Escolha um modelo de referência e um dos nossos. Informe seu volume mensal, ajuste quanto do prompt é reutilizado em cache e veja o custo lado a lado. Referências em USD convertidas a R$ 5.20 (câmbio de referência) + IOF. Você paga em BRL fixo, sem variação cambial.
O cache reaproveita apenas o prefixo processado; cada chamada ainda gera uma resposta nova.
O endpoint é 100% compatível com a OpenAI. SDKs oficiais (openai no Python/Node), LangChain, Vercel AI SDK, Cursor, Continue. Tudo que fala com a OpenAI fala com a gente.
# Mesma chamada, só aponta pra banana.chat
curl https://bananachat.com.br/v1/chat/completions -H "Authorization: Bearer $OPENAI_API_KEY" -H "Content-Type: application/json" -d '{
"model": "gpt-5.4",
"messages": [
{"role": "user", "content": "Explique LGPD em 3 linhas."}
],
"stream": true
}'Do flagship gpt-5.5 aos modelos rápidos e aos modelos de imagem gpt-image. Nesta fase, o catálogo público mostra somente modelos OpenAI/GPT disponíveis via Banana Chat.
R$ 10 de crédito de teste quando disponível, sem cartão e sem compromisso recorrente. Quando precisar de mais volume, recarregue em pacotes em BRL.
Esta seção resume, em linguagem direta, o que um time técnico ou comprador precisa entender para avaliar uma API de inferência OpenAI-compatible com preço em reais.
Na maioria dos projetos, a migração é um drop-in: crie uma chave `bc_live_`, troque `OPENAI_BASE_URL` para o endpoint do Banana Chat e mantenha o restante da integração com o SDK oficial da OpenAI.
Sim. A API aceita os controles de cache dos modelos compatíveis, sempre gera uma resposta nova e cobra leituras de prefixos já processados pela tarifa reduzida do cache. A calculadora permite simular quanto da entrada será reutilizado.
Vale quando o time quer previsibilidade financeira, cobrança em reais e menor fricção para controlar uso, modelos, latência e saldo sem reescrever clientes ou pipelines já compatíveis com a OpenAI.
Times de produto, atendimento, automação e plataformas internas que já operam workloads com chat completions, tools, streaming ou visão e precisam reduzir custo de inferência com menor risco de migração.
Crie sua chave, troque duas variáveis no .env e acesse os 11 modelos pelo mesmo endpoint. Sem refactor, sem SDK novo, sem dor. Faturado em reais.