Tu capacidad ya está en pie.Cambia la baseURL y sigue.
Un cliente compatible con OpenAI. Ninguna librería nueva, ningún cambio de código más allá de la dirección base.
Dirección base
https://fullcup.ai
Misma ruta, mismos campos, mismas respuestas del cliente que ya usas.
Tu clave
fc_live_••••••••••••••••••••••••
La clave aparece una vez, en el correo de aprovisionamiento, y no queda guardada en ningún lugar. ¿Perdiste el correo? Reemítela — la anterior deja de funcionar en el mismo instante.
Primera llamada
curl https://fullcup.ai/v1/chat/completions \
-H "Authorization: Bearer fc_live_..." \
-H "Content-Type: application/json" \
-H "X-FullCup-Workload: onboarding" \
-d '{
"model": "@cf/openai/gpt-oss-120b",
"messages": [{"role": "user", "content": "Hello"}],
"max_tokens": 2048
}'
X-FullCup-Workload: la etiqueta que deja ver al backer en qué se gastó la capacidad.
Techo de tokens y modelos de razonamiento
Cuatro de los cinco modelos de punta devuelven contenido vacío cuando max_tokens es bajo: el razonamiento consume el techo antes de la respuesta. Si tu primera llamada vuelve vacía, sube max_tokens. No falló.
Modelos permitidos en tu clase
Edge standard desde 2025-09-11
- @cf/meta/llama-4-scout-17b-16e-instruct
- @cf/google/gemma-4-26b-a4b-it
- @cf/openai/gpt-oss-120b
- @cf/qwen/qwen3-30b-a3b-fp8
- @cf/zai-org/glm-5.3-flash
Un modelo fuera de la clase se rechaza antes de gastar capacidad. La lista tiene fecha: vale la versión vigente cuando la cup fue financiada.
El consumo es público por diseño.
Cada request emite un recibo firmado. La página pública de tu cup muestra tokens, etiqueta y horario, sin inicio de sesión, en cerca de un minuto. No es letra pequeña — es la razón por la que alguien te confía capacidad.
Ver una página de consumoPOST /v1/chat/completions · GET /v1/models