Cocorex AI
API

Yapay Zeka API Maliyeti Nasıl Hesaplanır? Token, Fiyat ve Tasarruf Rehberi

Token nedir, giriş ve çıkış tokenı neden farklı fiyatlanır, bir isteğin maliyeti nasıl hesaplanır ve yapay zeka API faturasını düşürmenin pratik yolları.

1 Ekim 2026 · 8 dk okuma

Yapay zeka API'leri nasıl fiyatlandırılır?

Çoğu yapay zeka API'si, kullandığınız kadar öde modeliyle çalışır ve fiyatı token üzerinden hesaplar. Aylık sabit ücret yerine, her istekte modele gönderdiğiniz ve modelin ürettiği metin miktarı kadar ödersiniz. Bu, küçük projelerde çok ekonomiktir, ama büyük ölçekte maliyetin nasıl oluştuğunu anlamak gerekir.

Token nedir?

Dil modelleri metni kelime kelime değil, token adı verilen parçalar halinde işler. Bir token; bir kelime, kelimenin bir parçası ya da bir noktalama işareti olabilir. Kabaca:

  • İngilizcede 1 token ≈ 4 karakter ya da yaklaşık ¾ kelime.
  • Türkçede kelimeler ek aldığı ve sözcük yapısı farklı olduğu için, aynı anlama gelen metin genellikle daha fazla token tutar: ortalama bir Türkçe kelime 2–3 token olabilir.
  • Kod, sayılar ve özel karakterler de token tüketir.

Kesin sayıyı bilmek için, API her yanıtın usage alanında kullanılan giriş ve çıkış token sayısını verir. Cocorex API konsolunda her isteğin token sayıları İstek günlüğünde görünür.

Giriş ve çıkış tokenı

Fiyatlandırmada iki ayrı kalem vardır:

  • Giriş (input) tokenı: Modele gönderdiğiniz her şey: sistem talimatı, konuşma geçmişi, sizin mesajınız, eklediğiniz belgeler.
  • Çıkış (output) tokenı: Modelin ürettiği cevap.

Çıkış tokenı genellikle girişten daha pahalıdır, çünkü üretmek, okumaktan daha maliyetlidir. Cocorex API'de modellerin fiyatı 1 milyon token başına şu şekilde belirtilir (kampanyasız liste fiyatı):

ModelGiriş / 1M tokenÇıkış / 1M token
cocorex-1$1.00$1.20
deepseek-4.1-flash$1.00$1.20
gpt-6-astra$1.40$1.40

Güncel fiyatlar ve süreli kampanyalar için konsolu ve API sitesini kontrol edin; kampanya indirimleri bakiyeden düşerken otomatik uygulanır.

Tek bir isteğin maliyeti

Formül basit:

maliyet = (giriş token × giriş fiyatı + çıkış token × çıkış fiyatı) / 1.000.000

Örnek: cocorex-1 modeline 1.000 token giriş gönderdiniz ve 500 token cevap aldınız:

(1.000 × 1,00 + 500 × 1,20) / 1.000.000 = 0,0016 dolar

Yani bu istek yaklaşık bir kuruşun çok altında (0,16 sent). Dolar bazlı bakiyeniz konsolda bu hassasiyetle gösterilir.

Aylık örnek: Günde 1.000 istek yapan bir uygulamanız var; her istek ortalama 1.000 giriş ve 500 çıkış tokenı tutuyor:

Günlük: 1.000 × 0,0016 = 1,60 dolar
Aylık:  1,60 × 30 = 48 dolar

Bu hesabı, konsoldaki ve API sitesindeki maliyet hesaplayıcı ile kendi rakamlarınıza göre yapabilirsiniz.

Maliyeti etkileyen faktörler

1. Konuşma geçmişi büyüdükçe giriş büyür

Sohbet API'leri durumsuzdur: model önceki mesajları hatırlamaz; her istekte tüm geçmişi yeniden göndermeniz gerekir. 20 mesajlık bir sohbette, son mesajı gönderirken önceki 19 mesajı da (giriş tokenı olarak) ödersiniz. Uzun sohbetlerde maliyet hızla artar.

2. Sistem talimatı her istekte tekrar edilir

Uzun bir sistem talimatı (ör. 800 token), her istekte giriş tokenı olarak yeniden sayılır. Talimatı gereksiz uzatmayın.

3. Modelin sabit yükleri

Bazı modeller, kendi iç talimatları veya akıl yürütme altyapısı nedeniyle her istekte belli bir sabit token yükü ekleyebilir. Örneğin gpt-6-astra modelinde, tek kelimelik bir mesajda bile yaklaşık 2.700 token giriş sayıldığını ölçtük. Bu, modelin altyapısının bildirdiği değerdir ve faturaya yansır. Küçük ve sık istekler için, bu tür modellerin maliyetini hesaba katın.

4. Çıkış uzunluğu

Uzun cevaplar daha pahalıdır. max_tokens ile üst sınır koymak ve talimatta "en fazla 100 kelime" demek, maliyeti ciddi biçimde düşürür.

5. Düşünen modeller

Akıl yürütme yapan modeller, cevaptan önce "düşünme" tokenı üretebilir ve bunlar çıkış olarak sayılabilir. Basit işler için hızlı modeli seçmek ucuzdur.

Maliyeti düşürmenin 10 yolu

  1. Doğru modeli seçin. Basit sınıflandırma veya özet için hızlı ve ekonomik model; yalnızca gerçekten zor görevler için güçlü model.
  2. Geçmişi budayın. Çok uzun sohbetlerde eski mesajları özetleyip yerine koyun. Cocorex AI uygulaması bunu otomatik yapar; kendi uygulamanızda da yapabilirsiniz.
  3. Sistem talimatını kısa tutun. Her istekte tekrar ödediğinizi unutmayın.
  4. max_tokens belirleyin. Cevabın uzunluğunu sınırlayın.
  5. Net, kısa cevap isteyin. "Kısaca yanıtla", "yalnızca JSON döndür" gibi talimatlar çıkışı küçültür.
  6. Gereksiz bağlam göndermeyin. Belgenin tamamı yerine yalnızca ilgili bölümü gönderin.
  7. Önbellekleyin. Aynı soruya aynı cevap yeterliyse, sonucu kendi tarafınızda saklayın.
  8. İstekleri birleştirin. Aynı bağlamla 10 küçük soru yerine, tek istekte 10 soruyu cevaplatın (uygun olduğunda).
  9. Hataları ve tekrarları kontrol edin. Bir döngü hatası yüzünden aynı isteği defalarca göndermek, bakiyenizi saniyeler içinde eritebilir. İstek günlüğünü düzenli kontrol edin.
  10. Anahtar başına izleyin. Her uygulama için ayrı anahtar kullanın; hangisinin ne kadar harcadığını görün.

Bakiye ve kur

Cocorex API'de fiyatlar dolar cinsinden belirtilir. Bakiye, ön ödemeli olarak yüklenir ve konsolda dolar karşılığıyla gösterilir. Bakiyeniz bittiğinde API 402 insufficient_credits hatası döndürür; sürpriz bir fatura ya da otomatik tahsilat olmaz (son istek, bakiyeyi çok küçük bir miktar eksiye indirebilir; bu, bir sonraki yüklemeden düşülür). Bu yüzden bakiyenizi düzenli kontrol etmeniz ve kritik uygulamalarda bir uyarı mekanizması kurmanız önerilir.

Ölçüm ve izleme

  • İstek günlüğü: Her isteğin token sayıları, maliyeti, süresi ve durumu.
  • Günlük grafik: Kullanım trendini görün; ani sıçramalar bir hata ya da kötüye kullanım işareti olabilir.
  • Model bazında dağılım: Bütçenizin hangi modele gittiğini görün ve gerekirse daha ekonomik bir modele geçin.
  • Playground: Üretime koymadan önce bir isteğin maliyetini ve hızını deneyin.

Sık sorulan sorular

Başarısız bir istek için ücret öder miyim? Sunucu hatası (5xx) veren isteklerde ücret alınmaz.

Akış (streaming) kesilirse ne olur? O ana kadar üretilen kısım için ücretlendirilirsiniz.

Token sayısını isteği göndermeden önce bilebilir miyim? Kesin sayıyı yalnızca yanıttan öğrenirsiniz; ancak yaklaşık hesap için İngilizcede 4 karakter, Türkçede 2–3 karakter başına 1 token varsayabilirsiniz. Bunu max_tokens ile birlikte kullanarak üst sınır hesaplayabilirsiniz.

Fiyatlar değişir mi? Evet; fiyatlar ve kampanyalar önceden duyurularak değiştirilebilir. İsteğin yapıldığı andaki fiyat uygulanır.

Üç gerçekçi maliyet senaryosu

Aşağıdaki hesaplar, cocorex-1 modelinin liste fiyatlarıyla (giriş $1,00 / çıkış $1,20, 1M token başına) yapılmıştır. Kampanya indirimi varsa tutarlar daha düşük olur.

Senaryo 1: Müşteri destek botu

  • Günde 2.000 konuşma, her konuşma ortalama 6 mesaj.
  • Her istekte ortalama 1.500 giriş (sistem talimatı + geçmiş) ve 200 çıkış tokenı.
  • Günlük istek: 12.000.
İstek başına: (1.500 × 1,00 + 200 × 1,20) / 1.000.000 = $0,00174
Günlük: 12.000 × 0,00174 ≈ $20,9
Aylık (30 gün): ≈ $626

Optimizasyon: sistem talimatını 600 tokena indirip geçmişi 4 mesajla sınırlarsanız giriş ~900 tokena düşer; aylık maliyet yaklaşık $420'ye iner.

Senaryo 2: Haber özetleme aracı

  • Günde 500 makale; her biri ortalama 3.000 giriş ve 250 çıkış tokenı.
İstek başına: (3.000 × 1,00 + 250 × 1,20) / 1.000.000 = $0,0033
Günlük: 500 × 0,0033 = $1,65
Aylık: ≈ $49,5

Senaryo 3: Kod yardımcısı (küçük ekip)

  • 10 geliştirici, her biri günde 40 istek.
  • Her istek ortalama 2.500 giriş (kod bağlamı) ve 800 çıkış tokenı.
İstek başına: (2.500 × 1,00 + 800 × 1,20) / 1.000.000 = $0,00346
Günlük: 400 × 0,00346 ≈ $1,38
Aylık (22 iş günü): ≈ $30,4

Bu rakamlar tahminidir; gerçek maliyet, kendi isteklerinizin token sayısına bağlıdır. Önce Playground'da tipik bir isteği deneyip token sayılarını ölçün.

Maliyet hesap tablosu şablonu

Kendi projeniz için basit bir tablo:

KalemDeğer
Günlük istek sayısı...
İstek başına ortalama giriş tokenı...
İstek başına ortalama çıkış tokenı...
Model giriş fiyatı (1M token)...
Model çıkış fiyatı (1M token)...
İstek başına maliyet(giriş × g.fiyat + çıkış × ç.fiyat) / 1.000.000
Günlük maliyetistek sayısı × istek maliyeti
Aylık maliyetgünlük × 30
Güvenlik payı (+%30)aylık × 1,3

Güvenlik payı, beklenmedik kullanım sıçramalarına karşı bir tampondur.

Bütçe planlama ve izleme

  • Kademeli yükleyin: Başta küçük bir kredi yükleyin, gerçek kullanımı birkaç gün izleyin, sonra ölçeklendirin.
  • Haftalık kontrol: Genel bakış'taki günlük grafiği ve model bazında harcamayı inceleyin.
  • Eşik uyarıları: Bakiyeyi düzenli kontrol edin ve belirli bir seviyenin altına düşünce kendinize bildirim gönderen bir betik yazın.
  • Ayrı anahtarlar: Her uygulama için ayrı anahtar kullanarak hangisinin ne kadar harcadığını görün.
  • Anormallik avı: Bir günde ani sıçrama = hatalı döngü veya sızıntı olabilir; hemen İstek günlüğüne bakın.

Önbellek ve tekrar kullanım

Aynı soruya tekrar tekrar cevap üretmek gereksiz maliyettir:

  • Cevap önbelleği: Sık sorulan sorular ve değişmeyen içerik için cevabı kendi veritabanınızda saklayın.
  • Önceden hesaplama: Her sayfa gösteriminde özet üretmek yerine, özeti bir kez üretip saklayın.
  • Normalize edin: Aynı anlama gelen farklı yazımları (boşluk, büyük/küçük harf) aynı anahtara dönüştürüp önbelleğe isabeti artırın.
  • Geçerlilik süresi koyun: Güncel bilgi gerektiren cevapların önbellek süresini kısa tutun.

Doğru modeli seçmek: Maliyet–kalite dengesi

GörevÖnerilen yaklaşım
Basit sınıflandırma, etiketlemeHızlı/ekonomik model, düşük sıcaklık
Kısa özet, çeviriHızlı model
Karmaşık akıl yürütme, çok adımlı işDaha güçlü model
Kod üretimiKodlamada güçlü model; zor görevde daha güçlüsü
Uzun belge analiziGeniş bağlamlı model; belgeyi bölümleyin

Bir kademeli yaklaşım da işe yarar: önce ekonomik modelle deneyin, sonuç yetersizse daha güçlü modele yönlendirin.

Sık sorulan sorular

İlk denemem ne kadara mal olur? Tek bir kısa istek bir kuruşun çok altındadır; Playground'da denemek neredeyse ücretsizdir.

Kampanya indirimi nasıl yansır? Fiyat kartında üstü çizili eski fiyat görürsünüz; indirim bakiyeden düşülürken otomatik uygulanır.

Neden aynı istek bazen farklı maliyette? Çıkış uzunluğu değişkendir; model bazen kısa, bazen uzun cevap verir. Düşünen modeller ek "düşünme" tokenı üretebilir.

Maliyeti sınırlamak için ne yapmalıyım? max_tokens, kullanıcı başına sınır, önbellek ve uygun model seçimi.

Kur değişirse? Fiyatlar dolar bazlıdır; bakiyeniz TL tutulur ve güncel kurla dolara çevrilerek gösterilir.

Sonuç

Yapay zeka API maliyeti; model fiyatı × token miktarı formülüne iner. Token miktarını azaltmak, doğru modeli seçmek ve kullanımı izlemek faturanızı belirleyen üç ana kaldıraçtır. Başlamak için API sayfasına ya da ilk istek rehberine göz atın.

Denemek ister misin?Cocorex API konsolunda bakiyenizi, harcamanızı ve her isteğin maliyetini canlı izleyin.Cocorex AI'yı aç