# GPU BR > IA em GPU dedicada, de uma empresa brasileira, paga com PIX por período fixo (2 horas, dia, semana ou mês). Cada plano entrega um serviço pronto (chat, imagem, vídeo, voz, transcrição, música, treino de modelos, desktop ou GPU crua) com painel web e API compatível com a OpenAI. Não há cobrança por chamada. ## Para agentes de IA - Servidor MCP: `https://gpubr.com.br/mcp` (Streamable HTTP, POST JSON-RPC). Cabeçalho: `Authorization: Bearer sk-gpubr-acc-...` - API REST: `https://gpubr.com.br/v1` · descrição completa em OpenAPI: `https://gpubr.com.br/v1/openapi.json` - A chave da conta (`sk-gpubr-acc-...`) é criada pelo dono em Minha conta > Configurações > Chaves da conta, com permissões: `read` (consultar), `use` (gerar e controlar máquinas) e `spend` (assinar e renovar com o saldo, com limite de gasto por 30 dias). - A chave de assinatura (`sk-gpubr-...`) serve para uma assinatura só e funciona direto no SDK da OpenAI (`base_url=https://gpubr.com.br/v1`). ## Fluxo recomendado 1. `GET /v1/account` — saldo em R$ e permissões da chave. 2. `GET /v1/plans` — planos, preços por período e capacidades (`chat`, `image`, `video`, `speech`, `transcribe`, `music`, `train_image`, `train_llm`, `machine`). 3. `POST /v1/subscriptions` `{"plan": "imagem-essencial", "period": "dia"}` — cobra do saldo (precisa de `spend`). 4. `GET /v1/subscriptions/{id}` até `status` = `active` (a máquina baixa o modelo; leva de 3 a 20 minutos). O período só começa quando fica ativa. 5. Use a assinatura: `/v1/subscriptions/{id}/` (ou o cabeçalho `X-GPUBR-Subscription: {id}`), por exemplo `POST /v1/subscriptions/{id}/images/generations`. ## Rotas de uso - `POST /chat/completions` — chat (formato OpenAI, aceita stream) - `POST /images/generations` — imagens; devolve links válidos por 30 dias - `POST /videos`, `GET /videos/{id}`, `GET /videos/{id}/content` — vídeo (assíncrono) - `POST /audio/speech` — texto para fala (vozes pt-BR: dora, alex, santa) - `POST /audio/transcriptions` — transcrição (multipart, Whisper large-v3) - `POST /audio/music` — música (use `"async": true` e consulte `/jobs/{id}`) - A primeira geração depois que a máquina liga demora mais (o modelo inteiro é carregado na GPU): de 1 a 8 minutos conforme o tipo. As seguintes são rápidas. - `POST /train/lora`, `POST /train/llm` — treino (assíncrono) - `GET /jobs/{id}` — status de trabalhos assíncronos - `GET /machine`, `GET|DELETE /machine/files`, `GET|PUT /machine/files/content`, `POST /machine/exec` — controle da máquina em todo plano ## Regras - Uma geração por vez por assinatura (a GPU é dedicada); pedidos extras esperam na fila. - Erros no formato da OpenAI: `{"error": {"message", "code"}}`. `402` = saldo ou limite de gasto; `503` = app iniciando (tente em instantes). - Saldo é adicionado por PIX pelo dono da conta em https://gpubr.com.br/conta/saldo. ## Páginas para cada público - Criadores de conteúdo: https://gpubr.com.br/para/criadores - Empresas (chat privado, WhatsApp, Copilot para o time): https://gpubr.com.br/para/empresas - Desenvolvedores (API, GPU, treino): https://gpubr.com.br/para/desenvolvedores - Calculadora de gasto mensal: https://gpubr.com.br/calculadora - Migrar da OpenAI: https://gpubr.com.br/migrar-da-openai