API de gpt-6-luna
Un endpoint prepago de Model.sale para gpt-6-luna: una sola API key, límites explícitos y una comprobación de compatibilidad en vivo. El modelo solicitado nunca se sustituye en silencio.
Inicio rápido
Crea una API key, añade saldo y usa la base URL de abajo. Guarda la clave en una variable de entorno.
curl https://api.model.sale/v1/responses \
-H "Authorization: Bearer $MODEL_SALE_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"gpt-6-luna","input":"Reply exactly OK"}'import os
from openai import OpenAI
client = OpenAI(base_url="https://api.model.sale/v1", api_key=os.environ["MODEL_SALE_API_KEY"])
response = client.responses.create(model="gpt-6-luna", input="Reply exactly OK")
print(response.output_text)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.model.sale/v1", apiKey: process.env.MODEL_SALE_API_KEY });
const response = await client.responses.create({ model: "gpt-6-luna", input: "Reply exactly OK" });
console.log(response.output_text);El monedero reserva antes del envío y liquida a partir del uso final. El tratamiento de los tokens en caché y de razonamiento sigue la política de facturación vigente.
Cómo estimar una solicitud
La tarifa pública es un importe mixto en USD por cada millón de tokens cobrables. No es una tarifa separada para tokens de entrada o de salida. Para una estimación rápida, multiplica el número de tokens cobrables por la tarifa y divide entre 1.000.000. El registro de la solicitud es la fuente definitiva del uso real y de la liquidación.
| Tokens cobrables | Cargo ilustrativo |
|---|---|
| 1000 | $0.00008 |
| 10.000 | $0.0008 |
| 100.000 | $0.008 |
Son ejemplos aritméticos, no una promesa de un precio fijo por solicitud. El número real de tokens depende de tu entrada, tu salida y del uso que informe el modelo. Cualquier importe mínimo de solicitud mostrado arriba es una reserva inicial; tras recibir el uso final, el monedero liquida el cargo medido y libera los fondos reservados no utilizados.
Preguntas frecuentes
¿Cuánto cuesta la API de gpt-6-luna?
$0.08 por cada 1M de tokens facturados en Model.sale, con cargo a un saldo prepago en USD (recarga mínima de 5 US$). Los tokens de entrada en caché se cobran al 40 % de ese precio y cada solicitud muestra su cargo exacto en el panel.
¿Qué endpoints admite gpt-6-luna?
Chat Completions, Responses. La compatibilidad se verifica por modelo y el streaming se prueba por separado en cada ruta.
¿Cómo llamo a gpt-6-luna?
Crea una API key y envía solicitudes a https://api.model.sale/v1 con el ID de modelo "gpt-6-luna" usando el SDK de OpenAI, curl o cualquier cliente HTTP. Los ejemplos de curl, Python y TypeScript están arriba.
¿Model.sale sustituye el modelo que pido?
No. Se conserva el ID de modelo solicitado. Si un modelo no está disponible, la solicitud falla con un error en lugar de cambiarse a otro modelo.
Antes de usar este modelo en producción
- Confirma el ID exacto del modelo y uno de los endpoints verificados indicados arriba.
- Empieza con una API key dedicada y un tope bajo por solicitud y por día.
- Envía una solicitud JSON corta y verifica en Uso la solicitud completada y el cargo.
- Si tu cliente depende del streaming, prueba una solicitud SSE y confirma que llega a un evento final.
- Gestiona de forma explícita las respuestas 401, 429, de tiempo de espera y 5xx. Model.sale no reintenta automáticamente una solicitud fallida ni la cambia a otro modelo.
La disponibilidad es una observación reciente, no una garantía de tiempo de actividad. Consulta el catálogo completo de modelos, la tabla de precios, las guías de configuración de clientes y la metodología de facturación antes de elegir una configuración de producción.