glm-5.3-flash API
glm-5.3-flash için ön ödemeli bir Model.sale endpoint'i: tek bir API anahtarı, açık limitler ve canlı bir uyumluluk kontrolü. İstenen model asla sessizce değiştirilmez.
Hızlı başlangıç
Bir API anahtarı oluşturun, bakiye ekleyin ve aşağıdaki base URL'i kullanın. Anahtarı bir ortam değişkeninde tutun.
curl https://api.model.sale/v1/chat/completions \
-H "Authorization: Bearer $MODEL_SALE_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"glm-5.3-flash","messages":[{"role":"user","content":"Reply exactly OK"}]}'import os
from openai import OpenAI
client = OpenAI(base_url="https://api.model.sale/v1", api_key=os.environ["MODEL_SALE_API_KEY"])
response = client.chat.completions.create(model="glm-5.3-flash", messages=[{"role": "user", "content": "Reply exactly OK"}])
print(response.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.model.sale/v1", apiKey: process.env.MODEL_SALE_API_KEY });
const response = await client.chat.completions.create({ model: "glm-5.3-flash", messages: [{ role: "user", content: "Reply exactly OK" }] });
console.log(response.choices[0]?.message.content);Cüzdan gönderimden önce tutar ayırır ve nihai kullanıma göre mutabık olur. Önbellekli ve akıl yürütme token'larının işlenişi güncel faturalama politikasını izler.
Bir istek nasıl tahmin edilir
Herkese açık ücret, bir milyon ücretlendirilen token başına karma bir USD tutarıdır. Ayrı bir girdi veya çıktı token tarifesi değildir. Hızlı bir tahmin için ücretlendirilen token sayısını ücretle çarpın ve 1.000.000'a bölün. Gerçek kullanım ve mutabakat için istek kaydı esastır.
| Ücretlendirilen token | Örnek ücret |
|---|---|
| 1.000 | $0.0001 |
| 10.000 | $0.001 |
| 100.000 | $0.01 |
Bunlar aritmetik örneklerdir; istek başına sabit bir fiyat vaadi değildir. Gerçek token sayıları girdinize, çıktınıza ve modelin bildirdiği kullanıma bağlıdır. Yukarıda gösterilen herhangi bir asgari istek tutarı bir ilk ayırmadır; nihai kullanım alındıktan sonra cüzdan ölçülen ücreti mutabık hale getirir ve kullanılmayan ayrılmış tutarı serbest bırakır.
Sık sorulan sorular
glm-5.3-flash API'sinin maliyeti nedir?
Model.sale üzerinde 1M ücretlendirilen token başına $0.10; ön ödemeli USD bakiyesinden tahsil edilir (asgari yükleme 5 $). Önbellekli girdi tokenları bu fiyatın %40'ı üzerinden ücretlendirilir ve her isteğin kesin ücreti panelinizde görünür.
glm-5.3-flash hangi endpoint'leri destekler?
Chat Completions. Destek her model için ayrı doğrulanır ve akış (streaming) her rota için ayrıca test edilir.
glm-5.3-flash nasıl çağrılır?
Bir API anahtarı oluşturun, ardından "glm-5.3-flash" model kimliğiyle OpenAI SDK, curl veya herhangi bir HTTP istemcisi kullanarak https://api.model.sale/v1 adresine istek gönderin. curl, Python ve TypeScript örnekleri yukarıdadır.
Model.sale istediğim modeli değiştirir mi?
Hayır. İstenen model kimliği korunur. Bir model kullanılamıyorsa istek başka bir modele geçirilmez, hata ile sonuçlanır.
Bu modeli üretimde kullanmadan önce
- Tam model kimliğini ve yukarıda listelenen doğrulanmış endpoint'lerden birini doğrulayın.
- Ayrılmış bir API anahtarı ve düşük bir tek istek ile günlük harcama üst sınırıyla başlayın.
- Kısa bir JSON isteği gönderin, ardından tamamlanan isteği ve ücreti Kullanım'da doğrulayın.
- İstemciniz akışa dayanıyorsa bir SSE isteğini test edin ve bir nihai olaya ulaştığını doğrulayın.
- 401, 429, zaman aşımı ve 5xx yanıtlarını açıkça ele alın. Başarısız bir istek Model.sale tarafından otomatik olarak yeniden denenmez veya farklı bir modele geçirilmez.
Erişilebilirlik yakın tarihli bir gözlemdir, çalışma süresi garantisi değildir. Üretim yapılandırmasını seçmeden önce tüm model kataloğuna, fiyat tablosuna, istemci kurulum rehberlerine ve faturalama yöntemine bakın.