FullCup.ai

Integrar · /integrar

Tu capacidad ya está en pie.Cambia la baseURL y sigue.

Un cliente compatible con OpenAI. Ninguna librería nueva, ningún cambio de código más allá de la dirección base.

Dirección base

https://fullcup.ai

Misma ruta, mismos campos, mismas respuestas del cliente que ya usas.

Tu clave

fc_live_••••••••••••••••••••••••

La clave aparece una vez, en el correo de aprovisionamiento, y no queda guardada en ningún lugar. ¿Perdiste el correo? Reemítela — la anterior deja de funcionar en el mismo instante.

Reemitir la clave en el estudio

Primera llamada

curl https://fullcup.ai/v1/chat/completions \
  -H "Authorization: Bearer fc_live_..." \
  -H "Content-Type: application/json" \
  -H "X-FullCup-Workload: onboarding" \
  -d '{
    "model": "@cf/openai/gpt-oss-120b",
    "messages": [{"role": "user", "content": "Hello"}],
    "max_tokens": 2048
  }'

X-FullCup-Workload: la etiqueta que deja ver al backer en qué se gastó la capacidad.

Techo de tokens y modelos de razonamiento

Cuatro de los cinco modelos de punta devuelven contenido vacío cuando max_tokens es bajo: el razonamiento consume el techo antes de la respuesta. Si tu primera llamada vuelve vacía, sube max_tokens. No falló.

Modelos permitidos en tu clase

Edge standard desde 2025-09-11

Un modelo fuera de la clase se rechaza antes de gastar capacidad. La lista tiene fecha: vale la versión vigente cuando la cup fue financiada.

El consumo es público por diseño.

Cada request emite un recibo firmado. La página pública de tu cup muestra tokens, etiqueta y horario, sin inicio de sesión, en cerca de un minuto. No es letra pequeña — es la razón por la que alguien te confía capacidad.

Ver una página de consumo

POST /v1/chat/completions · GET /v1/models