Sua capacidade está de pé.Troque a baseURL e siga.
Cliente compatível com OpenAI. Nenhuma biblioteca nova, nenhuma mudança de código além do endereço base.
Endereço base
https://fullcup.ai
Mesma rota, mesmos campos, mesmas respostas do cliente que você já usa.
Sua chave
fc_live_••••••••••••••••••••••••
A chave aparece uma vez, no e-mail de liberação, e não fica guardada em lugar nenhum. Perdeu o e-mail? Reemita — a anterior para de valer no mesmo instante.
Primeira chamada
curl https://fullcup.ai/v1/chat/completions \
-H "Authorization: Bearer fc_live_..." \
-H "Content-Type: application/json" \
-H "X-FullCup-Workload: onboarding" \
-d '{
"model": "@cf/openai/gpt-oss-120b",
"messages": [{"role": "user", "content": "Hello"}],
"max_tokens": 2048
}'
X-FullCup-Workload: a etiqueta que faz o backer ver no que a capacidade foi gasta.
Teto de tokens e modelos de raciocínio
Quatro dos cinco modelos de topo devolvem conteúdo vazio quando max_tokens é baixo: o raciocínio consome o teto antes da resposta. Se a primeira chamada vier vazia, suba max_tokens. Ela não falhou.
Modelos permitidos na sua classe
Edge standard desde 2025-09-11
- @cf/meta/llama-4-scout-17b-16e-instruct
- @cf/google/gemma-4-26b-a4b-it
- @cf/openai/gpt-oss-120b
- @cf/qwen/qwen3-30b-a3b-fp8
- @cf/zai-org/glm-5.3-flash
Modelo fora da classe é recusado antes de gastar capacidade. A lista é datada: vale a versão vigente quando a cup foi financiada.
O consumo é público por desenho.
Cada request emite um receipt assinado. A página pública da sua cup mostra tokens, etiqueta e horário, sem login, em cerca de um minuto. Não é letra miúda — é a razão de alguém confiar capacidade a você.
Ver uma página de consumoPOST /v1/chat/completions · GET /v1/models