Conheça o ProxyLLM
IA pode sair caro.
A maioria tenta economizar de uma de três formas.
- Otimizam o cache. Isso só vai até certo ponto.
- Cortam os prompts. Isso piora o seu produto.
- Usam modelos chineses. Isso entrega os seus segredos para Pequim.
Mas existe um jeito melhor.
Um em que:
- Você para de vigiar a taxa de cache feito falcão.
- Você continua usando prompts bem parrudos.
- Você nunca precisa mexer com provedor de modelo suspeito.
Conheça o ProxyLLM
Use a sua assinatura do ChatGPT em produção.
Seus workflows custam menos já no primeiro dia, com exatamente os mesmos prompts e os mesmos modelos.
Isso porque a assinatura oficial do ChatGPT te dá tokens com desconto em relação à API.
Ela foi pensada para tarefas de código, mas a OpenAI permite usar para gerar respostas.
100% permitido. Só que a OpenAI não deixa isso simples.
É aí que o ProxyLLM entra.
É o instrumento para usar esse desconto onde ele importa: dentro dos seus apps e dos seus workflows.
O ProxyLLM cuida da hospedagem e da configuração, então usar a sua assinatura em produção fica simples.
Você só clica e já está conectado.
O que isso significa para você?
Você economiza na hora em relação à API, mas isso é só o começo.
Com a sua assinatura rodando em produção pelo ProxyLLM, você para de olhar o medidor.
E é isso que você ganha:
Você para de cortar e de piorar o seu produto.
Você começa a construir sem olhar o custo.
Seus usuários percebem. Ficam mais tempo, falam de você, e o sucesso vai somando.
Ideias que pareciam caras demais de repente começam a fazer sentido.
Portas se abrem quando você para de se preocupar com o preço dos tokens.
Pronto para dar o primeiro passo?
Uma assinatura, tudo incluído.
O ProxyLLM é uma suíte de ferramentas para trabalhar com provedores de IA. Rode uma semana no seu próprio tráfego antes de pagar qualquer coisa.
Sem margem em cima da inferência. Cancele quando quiser.
Duas vagas para conectar ChatGPT, Claude, ou os dois.
- Codex Hosted: rode o tráfego de IA de produção na sua assinatura do ChatGPT em vez de pagar por token. Muito mais barato que o custo da API.
- Um endpoint para OpenAI, Anthropic e OpenRouter com as suas próprias chaves
- O roteamento automático escolhe o modelo mais barato que ainda dá conta de cada prompt
- Mande lotes de prompts numa chamada só, com limite de gasto por projeto
- Painel com o custo em dólar de cada requisição, dia e modelo
- Aviso no Telegram quando o uso dispara ou um fallback entra
7 dias grátis. Se cancelar dentro do teste, não cobramos nada.
Compare o ProxyLLM com as alternativas.
A API da OpenAI coloca taxímetro em cada token. Os laboratórios chineses baratos rodam outros modelos com outras regras. Este é o retrato honesto no volume de uma agência.
De relance
Do login à economia, na ordem.
O ProxyLLM é compatível com OpenAI. Conecte a sua conta do ChatGPT, aponte as suas ferramentas de sempre para o nosso endereço, e as suas requisições rodam pelo seu Codex hospedado.
Conecte a sua conta do ChatGPT
Entre no Codex pela sua máquina e rode um comando para conectar. Seu contêiner privado do Codex sobe em cerca de um minuto. Dá para adicionar uma segunda conta ou uma API key como fallback.
Aponte as suas ferramentas para um endereço só
Mande as suas requisições para https://api.proxyllm.ai/v1 usando a sua chave do ProxyLLM. Seu código de sempre continua funcionando.
Veja a conta da API cair
O trabalho que antes era cobrado por token agora roda na sua assinatura. O painel mostra quanto cada requisição teria custado no preço da API.
Feito para derrubar a sua conta de IA. E manter ela lá embaixo.
O seu plano do ChatGPT faz o trabalho pesado
Você conecta a sua conta uma vez. O tráfego de produção roda pelo Codex no plano fixo que você já paga, e o painel mostra quanto cada requisição teria custado no preço da API.
Um endpoint, sem queda
Aponte o stack inteiro para um único endereço compatível com OpenAI. No limite do seu plano, as requisições passam sozinhas para uma segunda conta ou para a sua própria API key.
O modelo mais barato que dá conta, em cada prompt
O roteamento automático dá a cada prompt o modelo mais barato que consegue resolver, então trabalho simples nunca paga preço de ponta.
Lotes com limite de gasto
Mande centenas de prompts numa chamada só e coloque um teto no que cada projeto de cliente pode gastar.
Um valor em dólar em cada requisição
Custo por requisição, por dia e por modelo, mais quanto a via da assinatura te economizou neste mês.
client-acme está em 84% do teto. Fallback pronto.
Aviso antes do susto
O Telegram te avisa quando o uso dispara ou quando um fallback entra, então nada foge do controle de madrugada.
Opinião de clientes de verdade.
Eu tenho uma agência de recepcionistas de IA e a experiência com o ProxyLLM foi incrível. Trocar da API da OpenAI para o Codex hospedado do ProxyLLM foi muito simples e derrubou muito a nossa conta de API. Recomendo.
Funciona muito bem no nosso app iOS, que bom que agora estamos economizando um monte.
Dúvidas frequentes.
Tem teste grátis?
Tem. Toda conta começa com 7 dias grátis da suíte inteira, Codex Hosted incluído. Conecte a sua conta do ChatGPT, aponte o seu stack para o endpoint, e veja quanto o plano absorve no seu próprio tráfego. Se cancelar dentro dos 7 dias você não paga nada; se ficar, são USD 129 por mês.
O que é o Codex Hosted?
O ProxyLLM roda o Codex da OpenAI nos nossos servidores, logado na sua conta do ChatGPT. Seus apps chamam um endpoint compatível com OpenAI, cada requisição roda como um job do Codex dentro do seu contêiner privado, e o trabalho entra na sua assinatura fixa do ChatGPT em vez do preço por token da API.
Por que não usar a API da OpenAI direto?
A API é ótima, até a conta crescer junto com o seu sucesso. Cada chamada tem taxímetro, então agências que entregam agentes e automações veem a margem sumir no consumo por token. O ProxyLLM move esse trabalho para o plano fixo do ChatGPT que você já paga e deixa a API como fallback em vez de opção principal.
E o DeepSeek, o Qwen e as outras APIs chinesas baratas?
Os tokens deles são baratos mesmo, e para experimento descartável dá para usar. Só que eles servem os modelos deles, não os da OpenAI, e os seus prompts viajam para laboratórios sob jurisdição chinesa, com política de treinamento que muda de laboratório para laboratório. O ProxyLLM mantém o seu trabalho nos modelos da OpenAI pela sua própria conta, operado por uma empresa dos EUA que nunca treina em cima dos seus prompts, por um preço mensal fixo.
É seguro usar?
É. Os termos do Codex permitem uso programático: codex exec é o modo não interativo documentado da CLI, feito para scripts e pipelines, e o Codex vem incluído nos planos do ChatGPT. A gente roda a CLI oficial, sem modificar, num contêiner que é só seu. Você entra direto na OpenAI pelo comando de login da própria CLI, na sua máquina, e a gente nunca vê a sua senha.
Isso vai contra os termos da OpenAI?
Uso programático é funcionalidade prevista: a OpenAI documenta codex exec para automação e recomenda entrar com a sua conta do ChatGPT. A gente construiu em cima das regras de conta: um usuário, um contêiner, uma conta, a sua própria carga, nunca compartilhada nem agrupada. A palavra final é da OpenAI. Os termos dela permitem restringir contas a critério dela, e a gente não é afiliado nem endossado pela OpenAI. Se a postura da OpenAI mudar, a gente te avisa na hora e se adequa.
O que acontece quando eu bato no limite?
As requisições continuam passando. Conecte mais de uma conta do Codex e a próxima assume como fallback, ou coloque a sua API key da OpenAI como fallback até o limite do plano resetar. O painel mostra por qual via cada requisição passou.
Posso usar o Claude Code no lugar do Codex?
Pode. A sua assinatura inclui uma ponte do Claude Code que roda num servidor seu, logada na sua própria conta do Claude. Seus apps chegam nela do mesmo jeito que chegam no Codex, então mover trabalho de um lado para o outro é mexer numa configuração, não reescrever. Como o servidor é seu, o seu login do Claude nunca sai da sua própria infraestrutura.
Quanto isso economiza?
Depende da sua conta. Uma conta de USD 3.500 por mês na API da OpenAI cabe no ChatGPT Pro 5x de USD 100 mais o ProxyLLM de USD 129. Nosso preço é USD 129 por mês, não importa quanto você rode. Coloque o seu próprio número na calculadora e veja qual nível de plano absorve.
Como funciona conectar a minha conta?
Você roda codex login na sua própria máquina; o navegador abre e você entra direto na OpenAI. Depois o proxyllm codex connect sobe o arquivo de sessão para o seu contêiner, onde ele fica guardado criptografado. A gente nunca vê a sua senha, e a sessão vive só dentro do seu contêiner isolado.
O que acontece com as minhas API keys?
Ficam criptografadas com AES-256-GCM no nosso banco. Só são descriptografadas dentro da função serverless que chama o provedor em seu nome. A gente nunca registra em log e nunca manda para ninguém além do provedor que você indicou.
Meu stack vai funcionar com isso?
Se ele consegue apontar para um endereço que não seja o da OpenAI, sim. Os SDKs oficiais da OpenAI, n8n, LangChain, Cursor e curl na unha funcionam todos. Você passa o nosso endereço e a sua chave do ProxyLLM, e o resto do seu código fica exatamente como está.
Por que USD 129 por mês?
Porque hospedar o seu contêiner do Codex, as suas chaves, os seus logs e o seu painel é software, e a gente não coloca margem em cima da inferência. Se a via da assinatura te economiza mais de USD 129 por mês, ela já se pagou. Uma conta de USD 3.500 economiza mais de USD 3.200.
Para quem é o ProxyLLM?
Para times cuja conta da OpenAI vai de centenas a milhares de dólares por mês: agências que entregam conteúdo, agentes, automações e código para clientes. Se você faz só um punhado de chamadas por dia, se cada chamada precisa responder em menos de um segundo, ou se o seu compliance exige contrato direto com o provedor, a API pura ainda é o seu caminho.
E se a OpenAI mudar a política?
Aí a gente sugere trocar para o Claude Code. A ponte já faz parte da sua assinatura, roda num servidor seu, e os seus apps chegam nela exatamente onde chegam no Codex hoje. A gente te avisaria no momento em que a postura da OpenAI mudasse, e de qualquer jeito as suas chaves, os seus logs e o seu painel continuam seus.
Pare de alugar token. Comece a crescer.
Coloque os seus agentes e as suas automações no plano que você já paga. Configura em minutos e os primeiros 7 dias são grátis.
7 dias grátis · depois USD 129 por mês · cancele quando quiser