API compatível com o padrão OpenAI
Troque a URL base do seu SDK para o nosso endpoint. As mesmas chamadas de chat, embeddings e visão que você já escreve continuam funcionando, sem SDK proprietário.
Sua aplicação já fala o padrão OpenAI. Aponte-a para a nossa base URL e ela continua funcionando, em infraestrutura própria, com custo previsível e dados que não saem daqui.
# antes: big tech
client = OpenAI(
- base_url="https://api.openai.com/v1"
+ base_url="https://tokens.4clouders.com"
api_key=ISOL_KEY)
resp = client.chat.completions.create(
model="isol-4.9", messages=msgs)
# mesmos SDKs. mesma sintaxe. dados em casa.
São 15h07 de uma terça. Alguém do seu time cola um contrato inteiro num chatbot pessoal, de boa-fé, para ganhar uma hora. O contrato agora mora num servidor que você não conhece.
Cada pessoa num chatbot pessoal, sem trilha de auditoria, sem admin, sem saber o que saiu da empresa.
Contratos, listas de clientes e código colados em nuvens de terceiros que treinam com o que recebem.
ChatGPT Team e Copilot cobram como artigo de luxo. Multiplique pelo seu quadro e veja o financeiro franzir a testa.
Ferramenta de consumo não conhece o seu negócio, e você não pode ensiná-la com os seus documentos em segurança.
Trocar de fornecedor não pode custar uma reescrita. E se custasse uma linha de código?
O mesmo contrato OpenAI que suas libs já falam, servido em infraestrutura nossa, com preço fechado.
SDKs oficiais, LangChain, n8n, o que você já usa, funciona sem adaptação.
Texto, código, visão e OCR em português e inglês, no mesmo endpoint.
Pacote mensal fechado; excedente no mesmo preço por token. Zero surpresa.
Gasto, tokens e requisições por chave, em tempo real, no portal.
Padrão aberto: entrar é uma linha, e sair também. Você fica porque quer.
Imagem e vídeo com áudio pelo mesmo gateway, quando você precisar.
O CLI de código mais famoso do mundo, aberto no dia a dia do nosso próprio time: modelo isol-4.9 ativo e cobrança por uso no nosso gateway. Sem fork, sem plugin, só a base URL trocada. Se ele roda, a sua stack roda.

A compatibilidade OpenAI corta o risco da decisão, dá para começar pequeno, do jeito que a sua operação precisa hoje.
Sua solução roda em cima da API da OpenAI ou da Anthropic? Quando o provedor oscila, o trabalho para. Configure a iSol como fallback, mesma sintaxe, outra infraestrutura, e a operação continua enquanto todo mundo espera o status page ficar verde.
Bateu no rate limit ou no teto de tokens do seu plano lá fora? Em vez de fila ou upgrade forçado, transborde o excedente para cá. Dois endpoints compatíveis no seu roteador de modelos, o seu tráfego decide qual usar.
Compliance exige que nada saia nem para a nossa infraestrutura? O iSol On Site instala o mesmo endpoint dentro das suas paredes, sob a nossa gestão, e ele continua respondendo até com o link de internet caído.
Falar sobre o On Site →Comece como plano B. É assim que a soberania vira plano A.
A integração é direta porque falamos o mesmo protocolo que você já usa. Três passos, sem reescrever sua aplicação.
Troque a URL base do seu SDK para o nosso endpoint. As mesmas chamadas de chat, embeddings e visão que você já escreve continuam funcionando, sem SDK proprietário.
Acompanhe tokens processados, latência e uso por aplicação em tempo real. Transparência total sobre o que está rodando e quanto está custando.
Você fala com quem constrói. Ajuste de modelos, dimensionamento e integração são resolvidos com os engenheiros que operam a infraestrutura, não com um chatbot de suporte.
from openai import OpenAI
# só troca a base_url, o resto do seu código fica igual
client = OpenAI(
base_url="https://tokens.4clouders.com/v1",
api_key="sk-sua-chave",
)
resp = client.chat.completions.create(
model="isol-4.9",
messages=[{"role": "user", "content": "Olá"}],
)
Atrás do endpoint
Você manda tudo para o mesmo endereço. O roteador do iSol 4.9 decide onde cada pedido roda, para que uma leitura pesada de documento não entre na fila do seu chat.
Raciocínio longo, geração de código e chamadas de ferramenta, com contexto de 1 milhão de tokens: o documento inteiro cabe na mesma conversa.
1M de contextoLeitura de documento, imagem e PDF roda em hardware separado. Não disputa fila com o texto, então um lote pesado de OCR não derruba a latência do resto.
fila própriaGeração de mídia tem placa e fila separadas, disponível como add-on no mesmo padrão de chamada.
add-onTudo em infraestrutura nossa, no Brasil e nos Estados Unidos. Nenhum pedido é repassado para nuvem de terceiro. E como o padrão é aberto, sair custa exatamente a mesma linha que entrar.
Cada cliente vira um espaço isolado, com regra própria. É o que faz a fatura parar de surpreender.
Estourou o pacote ou o limite? O gateway barra a chamada. O corte acontece antes do consumo, não na fatura. Um agente em laço durante a noite não vira conta de cinco dígitos na manhã seguinte.
Conectar leva minutos. Estes são os casos que pagam a conta: cada card abre um artigo com a receita, o vídeo da execução real e as lições de quem afinou o prompt até ficar confiável.
Todos os vídeos são execução real contra este endpoint, com os tempos medidos na hora.
Escolha a sua e copie a configuração. Todas falam o mesmo padrão OpenAI, então o passo é sempre o mesmo: trocar a base URL e colar a chave.
Todos os guias estão no blog, cada um com o teste de fumaça no final.
Não é só chat: o resultado da conversa vira arquivo pronto para as ferramentas que sua empresa já usa.
Planilhas completas, prontas para abrir no Excel, tabelas, abas e fórmulas a partir de um pedido no chat.
Apresentações prontas para o PowerPoint, estrutura, slides e conteúdo a partir da pauta da reunião.
Documentos formatados para o Word, propostas, atas, relatórios e rascunhos de contrato.
Código em dezenas de linguagens, páginas HTML, scripts, consultas SQL e automações.
O iSol 4.9 enxerga: leia PDFs digitalizados, notas fiscais e imagens direto na conversa.
Pesquisa na web de dentro do workspace, com governança, e as fontes citadas na resposta.
Base URL única: https://tokens.4clouders.com, e nada mais muda
Sem SDK novo, sem migração de dados, sem projeto.
Contrate um pacote no portal e a chave sai na hora, ou peça a degustação de 7 dias pelo WhatsApp.
Sua instância entra no ar no seu endereço, com TLS e a sua marca, e você acompanha o progresso pelo portal.
Adicione assentos pelo portal. Cada pessoa faz login e começa a trabalhar, nada para instalar nas máquinas.
Passou do pacote? O excedente sai no MESMO preço por token, sem multiplicador, sem susto.
Criar minha chave de APIPlanos com preço em R$ para o Brasil e em US$ para o exterior (tabela própria por moeda). Excedente cobrado no mesmo preço por token do seu plano. No anual, desconte 20%.
| iSol API | APIs de big tech | |
|---|---|---|
| Roda em infraestrutura do próprio fornecedor | ✓ | — |
| Seus prompts fora das nuvens de terceiros | ✓ | — |
| Mensalidade fixa com excedente no mesmo preço | ✓ | — |
| Suporte direto de quem opera o modelo | ✓ | — |
| Compatível com os SDKs que você já usa | ✓ | ✓ |
Mensal ou anual com 20% de desconto · em reais ou em dólares, cada moeda com tabela própria · excedente sempre no mesmo preço por token.
Padrão OpenAI · excedente no mesmo preço por token · a partir de R$ 490/mês
3 milhões de tokens/mês inclusos
25 milhões de tokens/mês inclusos
150 milhões de tokens/mês · mídia inclusa
Sem fidelidade · cancele em 1 clique · pague em R$ ou US$ · degustação de 7 dias sob pedido
Sem taxa de setup e sem surpresa na fatura: acabou o pool do mês, a plataforma pausa, nunca cobramos a mais sem você pedir.
Technical Lead, ele conduz o seu caso de uso real num workspace ao vivo. Suas perguntas, nossa tela, sem slides.
Respostas curtas, cada uma com o mecanismo que a sustenta.
Não. A API segue o padrão OpenAI: você troca a base URL e a chave, e os SDKs oficiais, LangChain e n8n continuam funcionando. Chat, streaming, visão e OCR usam as mesmas chamadas que o seu time já escreve.
Dá, e é o começo mais comum. Configure a iSol como fallback ou como destino do excedente no seu roteador de modelos: quando o provedor principal oscilar ou bater no limite, o tráfego segue para cá com a mesma sintaxe, e a operação não para.
Para infraestrutura nossa, no Brasil e nos Estados Unidos. Nenhum pedido é repassado a nuvem de terceiro, e nada do que passa pela API treina modelo, nosso ou de outros. Se o compliance exigir que nada saia do seu prédio, o mesmo endpoint roda lá dentro com o On Site.
Com três travas. O pacote mensal é fechado e o excedente sai no mesmo preço por token, sem multiplicador. Cada chave tem teto próprio. E o gateway barra a chamada antes do consumo, então um agente em laço durante a noite não vira conta na manhã seguinte.
Aguenta, e a arquitetura foi desenhada para isso. Leitura de documento e visão rodam em hardware separado do texto, então um lote de OCR não derruba a latência do seu chat. Para carga crítica, o Business traz latência dedicada e o Sovereign, capacidade reservada com SLA de latência.
Pode. A degustação de 7 dias sai sob pedido, com chave de avaliação, e um engenheiro que opera a plataforma roda a sua stack com você, medindo latência e qualidade. E se um dia decidir sair, a volta custa a mesma linha que a entrada.
A sua pergunta não está aqui? Pergunte direto a um engenheiro
A migração é uma linha. A volta também. Contrate um pacote e saia usando, ou peça a degustação de 7 dias antes de decidir.
Criar minha chave de API