Na era da inteligência artificial a pessoa se perde: qual modelo usar, como ligar uma API, medo de mandar a chave para o chat, medo de vazamento, de alguém gastar o limite. A Cloudflare, famosa por CDN, cache e velocidade, tem uma área só de IA. Dá para usar modelo com segurança se o site já vive em Workers. No vídeo eu mostrei duas portas que evitam o monte de chave: Workers AI, com modelo hospedado na própria Cloudflare, cobrado em neurônios; e o AI Gateway, um endpoint só para várias casas, com crédito na Cloudflare ou com a chave do provedor guardada lá. Binding no Worker. Sem API key no front. No dia da gravação eu gerei mais de quinhentas imagens para o dicionário de japonês e gastei cerca de quatro mil neurônios — no plano gratuito, dez mil por dia, isso teria saído zero.
Associe o Worker ao Workers AI e chame o modelo pelo binding, sem chave. Para OpenAI, OpenRouter e afins, use o AI Gateway: um endpoint, crédito na Cloudflare ou chaves de provedor no painel, com rota dinâmica se um modelo cair. Vectorize entra quando você quer consulta em cima do seu dado. A chave, se existir, mora no Gateway ou no secret do Worker, não no repositório e não no navegador.
- Workers AI
- Modelo hospedado na Cloudflare, cobrança por neurônio
- AI Gateway
- Um endpoint, vários provedores, crédito ou chave deles
- No teste
- 600 imagens, cerca de 4 mil neurônios no dia
O medo da chave e o Wrangler no mesmo lugar do site
Quem faz vibe coding com Codex, OpenCode ou o app da vez já cria o Worker falando com o Wrangler. Aí a tentação é colar uma API key de imagem, outra de texto, outra de voz. Cada projeto ganha um .env. Cada .env vira um vazamento em potencial. A proposta da gravação é outra: o site já está na Cloudflare, então a IA também. Você cria o Worker, cria uma associação com a inteligência artificial da plataforma e pede texto, imagem, vídeo, voz, sem API no cliente.
Na página de modelos da Cloudflare havia dezenas. Alguns com o selo de hospedado na Cloudflare — Llama, TTS, Kimi, na época o Kimi 2.7, e o que eu usei para imagem. Outros entram pelo Gateway, como se fossem a API da casa original. A diferença importa para chave e para conta.
Workers AI: neurônio, plano gratuito e as 600 imagens
Workers AI cuida dos modelos hospedados na Cloudflare. Não tem terceiro no meio da sua chave porque, para esses modelos, você não usa chave de provedor. É inferência no ecossistema, ligada por binding. A cobrança, na maior parte, é em neurônios — unidade de compute, não token da OpenAI. No plano gratuito: até dez mil neurônios por dia. No dia da gravação eu tinha um gerador para o dicionário de japonês, passei de quinhentas imagens, na fala seguinte mais de seiscentas, e a conta marcou uns quatro mil neurônios. No gratuito, aquele dia teria sido zero.
No painel de computação, planos do Workers, eu li o plano pago de cinco dólares com trezentos mil neurônios grátis por mês, e em seguida me corrigi: no gratuito são dez mil por dia, e isso no mês se parece com os trezentos mil. A documentação oficial, na época em que eu reescrevi o texto, fala em dez mil neurônios por dia no gratuito e a mesma cota diária no Workers Paid, com cobrança acima — cerca de 0,011 dólar por mil neurônios. O número da tela muda. O recado da gravação permanece: gerar imagem no Workers AI saiu ordens de grandeza mais barato do que token avulso, e no gratuito aquele lote nem furou o teto do dia.
Texto para imagem, texto para vídeo, detecção, voz: o catálogo cobre o tipo de SAS que a pessoa tenta montar colando três chaves. Eu estava curioso por modelo de resposta para interação com usuário. Binding no Worker: você pede o modelo no código; dá para limitar. Isso já era aprofundamento que eu não foquei.
- No Worker, crie o binding de Workers AI (na tela, Associações).
- No código, chame o modelo hospedado pelo binding, sem API key no front.
- Acompanhe neurônios no painel no mesmo dia em que gerar lote (imagem, TTS, texto).
- Se o lote passar de dez mil no dia, ou você espera a virada ou sobe para o pago e aceita a tarifa acima da cota.
AI Gateway: um endpoint, crédito, chave de provedor e failover
O AI Gateway é a outra porta. Uma rota, um endpoint, para várias inteligências no mesmo projeto. Quem já faz site na Cloudflare quase não configura nada. Você pode pôr crédito na conta do Gateway — no espírito de um OpenRouter, e o próprio OpenRouter entra como provedor. Em chaves de provedor você liga a conta da OpenAI, do OpenRouter e outras, e consome a API deles através da Cloudflare. A chave mora lá, não em cada repositório.
Rota dinâmica: se uma IA não responde, por limite ou por queda, o Gateway manda para outra. O site não fica mudo. Logs, análise, as funções de Gateway que eu só mostrei de relance. Isso é o contrário de cinco chaves em cinco .env, cada uma sem log.
Dá para misturar: crédito no Gateway para um modelo, chave do provedor para outro, Workers AI para o que está hospedado. O acúmulo que o título ataca é o acúmulo no seu disco e no seu Git, não a existência de provedor no mundo.
Vectorize e o resto no mesmo painel
Vectorize é o banco vetorial: a IA consulta o seu dado e acerta mais, mais rápido, gastando menos. Pesquisa, resposta com base no que você gravou, não no chute do modelo. Junto com Workers, Gateway e o catálogo de modelos, a Cloudflare junta no mesmo login o que muita gente espalha em hospedagem, banco, domínio e provedor de IA. Eu confio nisso. Não ganho afiliado. Queria ganhar. Falo porque, com vibe coding, Codex, OpenCode, MiniMax, o caminho que menos espalha chave é esse.
Grupo de WhatsApp na descrição para dúvida do ecossistema. Like no vídeo, o pedido de fechamento. A tese cabe numa frase: crie o site no Workers e use a IA pela própria Cloudflare, binding primeiro, Gateway se o modelo mora em outra casa.
- Workers AI: sem chave de provedor, neurônio, bom para lote de imagem e modelo hospedado.
- AI Gateway: uma URL, crédito ou chave do provedor, failover, log.
- Vectorize: o seu acervo em vetor, para a resposta não sair do vazio.
- Secret do Worker: só o que ainda precisar existir fora desses três.
Na sequência
- Listar as chaves que hoje estão em .env, chat e painel de terceiro.
- Passar modelo hospedado para Workers AI com binding.
- Passar OpenAI, OpenRouter e afins para o AI Gateway, com a chave no painel deles ou crédito na Cloudflare.
- Tirar a chave do JavaScript do cliente e do repositório.
- Olhar o consumo em neurônios no mesmo dia de um lote real, não só no tutorial.
Onde isso quebra
Continuar colando API key no Worker “porque é mais rápido” e versionar o arquivo.
Achar que Gateway elimina a chave do provedor: elimina do seu Git; ela ainda existe no painel da Cloudflare.
Estourar dez mil neurônios no dia no plano gratuito e surpreender com a conta no pago.
Usar Vectorize como desculpa para mandar dado sensível sem regra de acesso no Worker.
Perguntas frequentes
Workers AI e AI Gateway são a mesma coisa?
Não. Workers AI é inferência de modelo hospedado na Cloudflare, em neurônio, via binding. AI Gateway é o endpoint que agrega provedores, crédito, chave deles, log e failover.
Dez mil neurônios por dia cabem num gerador de imagem?
No meu lote, seiscentas imagens gastaram cerca de quatro mil neurônios. Modelo, tamanho e passo mudam a conta. Meça no painel no dia do lote.
Posso usar minha chave da OpenAI sem colar no projeto?
Sim, como chave de provedor no AI Gateway. O Worker fala com o Gateway; o Gateway fala com a OpenAI. O repositório fica sem a string.
Vectorize substitui um banco D1?
Não. Vectorize serve para busca por similaridade e contexto do modelo. Registro relacional, usuário, pedido — continua no D1 ou no banco que você já usa.
Isso serve se o site não está na Cloudflare?
O vídeo assume Worker e Wrangler. Gateway tem API que dá para chamar de fora, mas aí você volta a gerenciar chave no outro host. O ganho do texto é o binding no mesmo lugar do site.