LLM API Fiyatlandırması

Yapay Zekâ API Maliyeti: LLM Fiyatı Gerçekte Nasıl İşler

LLM API fiyatı neyden oluşur, faturayı ne şişirir ve 15 sağlayıcıda girdi–çıktı fiyat aralıkları. Ölçüm 24 Temmuz 2026.

Oriveo TeamYayımlanma Güncelleme 12 dk okuma
  • LLM API’leri en fazla dört ayrı sayaçtan faturalandırır ve çoğu fiyat karşılaştırması yalnızca birine bakar.
  • Çıktı token’ı, ortanca olarak girdi token’ının dört katına, en uçta on iki katına mal olur.
  • 15 sağlayıcıda yayımlanmış girdi fiyatları, 24 Temmuz 2026 itibarıyla milyon token başına $0,01 ile $150 arasındadır.
iPhone’da Oriveo: sohbet listesi; her sohbetin tahmini maliyeti sağda görünür.

LLM API fiyatlandırması gerçekte nasıl işler

Yapay zekâ API maliyeti karşılaştırmalarının neredeyse hepsi model başına tek sayı verir ve bu sayı neredeyse her zaman girdi fiyatıdır. Sağlayıcının yayımladığı dört sayının en az işe yarayanı budur. Bir model ayrı sayaçlardan faturalandırır: gönderdiğiniz token’lar, geri yazdığı token’lar, önbellekten okunan token’lar ve bazı sağlayıcılarda o önbelleğe yazılan token’lar. Her sayacın kendi tarifesi vardır ve tarifeler birbirine yakın değildir.

Bir token kabaca bir İngilizce sözcüğün dörtte üçüdür, yani bir milyon token 750.000 sözcüğe yakındır. Fiyatlar milyon token başına verilir, çünkü tek tek mesajlar o kadar ucuzdur ki mesaj başı fiyat hep sıfır görünür. Bu çerçeve, gerçek bir sohbette sayaçların ne kadar çabuk biriktiğini gizler. Her tur, daha önce söylenen her şeyi yeniden gönderir.

Aşağıdaki tablo bir avuç model için dört sayacı da gösterir. Rakamlar, bu sitedeki model seçiciyi ve maliyet hesaplayıcıyı besleyen aynı veri akışındandır. Girdi sütununun ne kadar az şey anlattığına bakın. Buradaki girdi fiyatları 0,30 ile 2,50 dolar arasındayken çıktı fiyatları 1,20 ile 15,00 dolar arasında değişir; en çok hareket eden sayaç da çıktıdır.

  • Girdi — gönderdiğiniz her şey: mesajınız, o ana kadarki sohbet, varsa sistem prompt’u, eklenmiş her metin.
  • Çıktı — modelin geri yazdığı her şey; bunları üreten modellerde akıl yürütme token’ları da dahil.
  • Önbellekten girdi okuma — sağlayıcının daha önce gördüğü yinelenen bağlam. Taze girdiye göre çok daha düşük bir tarifeden kesilir.
  • Önbelleğe yazma — bazı sağlayıcıların bu bağlamı ilk kez önbelleğe koymak için aldığı ücret.
LLM API fiyatlandırması gerçekte nasıl işler
ModelGirdi (USD / 1M token)Çıktı (USD / 1M token)Önbellekten girdi okumaÖnbelleğe yazma
Claude Haiku 4.51.005.000.101.25
Claude Sonnet 52.0010.000.202.50
GPT-5.6 Luna1.006.000.101.25
GPT-5.6 Terra2.5015.000.253.125
Kimi k2.50.603.000.100.60
Qwen3.7 Plus0.503.000.050.625
MiniMax-M2.50.301.200.030.375

Pahalı yarı, çıktı token’larıdır

LLM fiyatlandırmasında en sağlam örüntü, yazmanın okumaktan pahalı olmasıdır. Bunu bir izlenim değil sayı yapmak için, Oriveo’nun veri akışında token başı fiyat yayımlayan her metin modelini aldık. 15 sağlayıcının hepsi. Her modelin çıktı tarifesini kendi girdi tarifesiyle karşılaştırdık. Tarih 24 Temmuz 2026.

Medyan model, çıktı için girdiye göre tam dört kat ücret alır. Yaklaşık on modelden biri ikisine de aynı ücreti alır ya da çıktıyı daha ucuza keser; bu, çıkarım barındırıcılarının sunduğu open-weight modellerde tipiktir. Öbür uçta kabaca yedide biri altı kattan fazla ister. Akıştaki en geniş fark on iki kattır.

Bunun harcamanıza doğrudan bir sonucu vardır. Herkesin önce uzandığı iyileştirme, prompt’u kısaltmaktır ve bu genellikle daha küçük bir kaldıraçtır. Daha kısa yanıt istemek, çıktı uzunluğuna tavan koymak ya da uzun uzun sesli düşünmeyen bir model seçmek, sorudan bir paragraf tıraşlamaktan faturayı daha çok oynatır. Akıl yürüten modellere burada ikinci kez bakın: ürettikleri düşünme token’ları, siz hiç görmeseniz de çıktı diye faturalanır.

Pahalı yarı, çıktı token’larıdır
Çıktı fiyatının girdi fiyatına oranıFiyatı yayımlanmış metin modellerinin payı
Aynı ya da daha ucuz (1× ya da altı)10%
1× ile 2×11%
2× ile 4×39%
4× ile 6×25%
6 kattan fazla15%

Faturanı asıl ne şişirir

İnsanlar ilk API faturalarına genellikle dört nedenden biri yüzünden şaşırır ve hiçbiri modelin öne çıkan fiyatı değildir. Aşağıdaki mekanikler her sağlayıcı için geçerlidir, çünkü bir satıcının politikasından değil, sohbet API’lerinin çalışma biçiminden çıkar.

En büyüğü bağlamın yeniden gönderilmesidir. Bir API çağrısı durumsuzdur. Model bir önceki turunu hatırlamaz, bu yüzden istemci her mesajda tüm sohbeti yeniden göndermek zorundadır. Kırk tur sürmüş bir dizi, kırk birinci turda kırk tur geçmişi girdi olarak gönderir. Bir sohbetin maliyeti bu yüzden kabaca uzunluğunun karesiyle büyür. Aynı işi yapan yirmi kısa sohbetten tek bir uzun dizinin daha pahalıya gelmesinin nedeni budur.

Prompt önbelleği bu tablonun dengesidir; bir kenara atmadan önce anlamaya değer. Destekleyen sağlayıcılar, yinelenen bağlamın taze girdi yerine önbellekten okuma diye faturalanmasına izin verir. Ölçtüğümüz akışta yaklaşık beş modelden biri önbellekten okuma fiyatı yayımlar. Olduğu yerde önbellek tarifesi, o modelin kendi girdi fiyatının ortanca olarak %10’udur. Bulduğumuz en düşük %1’in altındadır, en yüksek %58 civarındadır. Bazı sağlayıcılar önbelleğe yazmak için de ücret alır; bu genellikle normal girdinin üzerinde bir primdir. Önbellek, aynı bağlam birkaç kez yeniden kullanıldığında işe yarar, bir kez kullanıldığında değil.

  • Sohbet geçmişi — her turda tam olarak yeniden gönderilir, bu yüzden uzun diziler orantısız pahalıya gelir.
  • Sistem prompt’ları ve hazır ayarlar — yeniden kullanılan yönergeler her bir mesajın önüne eklenir ve token sayılarını sessizce katlar.
  • Ekler — sohbete bırakılan bir belge ya da görsel girdi token’ı olur ve o dizideki sonraki her turda bağlamda kalır.
  • Akıl yürütme token’ları — bunları üreten modellerde, akıl yürütme gösterilse de gösterilmese de çıktı diye kesilir.
  • Yeniden deneme ve yeniden üretme — yeniden üretilen bir yanıt ücretsiz bir düzeltme değil, baştan faturalanan ikinci bir istektir.

15 sağlayıcıda fiyat manzarası

Aşağıdaki tablo, Oriveo’nun bağlandığı 15 sağlayıcının her birinde yayımlanmış girdi fiyatı aralığının anlık görüntüsüdür. Yalnızca token başı fiyat yayımlayan metin modellerini sayar ve o sağlayıcıdaki en ucuz ile en pahalı olanı gösterir. Her sağlayıcının nerede durduğunun haritasıdır, bir öneri değil. Bir sağlayıcıdaki en ucuz model ile en pahalı olanı nadiren birbirinin yerine geçer.

Kaynağı ve yöntemi, sizin de denetleyebilmeniz için yazıyoruz. Her sayı Oriveo’nun üretim veri akışından gelir: api.oriveoai.com/api/metadata, contract version 47, üretim zamanı 2026-07-24T01:00:09Z. Uygulamanın mesaj fiyatlamak için kullandığı akış budur ve bu sitedeki maliyet hesaplayıcının arkasındaki de odur. Fiyatlar, 24 Temmuz 2026 itibarıyla milyon token başına ABD dolarıdır. Görsel üretim modelleri ve sağlayıcının token başına değil istek başına fiyatladığı modeller dışarıda bırakıldı, çünkü onlar için token başı bir rakam anlamsız olurdu.

İki şey göze çarpar. Birincisi yayılım. Tüm akıştaki en ucuz girdi fiyatı milyon token başına $0,01, en pahalısı $150’dir. 24 Temmuz 2026 itibarıyla aynı seçicideki iki satır arasında on beş bin kat. İkincisi, katalog genişliği ile ucuzluk farklı eksenlerdir. Aggregator’lar birçok satıcıyı yeniden sattığı için en geniş aralığı taşır. Tek satıcılı sağlayıcılar kendi katmanlarının etrafında sıkı durur.

Buradaki her sayının raf ömrü kısadır. Sağlayıcılar sürekli yeniden fiyatlar, daha ucuz katmanlar çıkarır ve modelleri emekliye ayırır. Aşağıdaki satırların birkaçı son çeyrekte değişti. Model fiyatı veren her yazı bir fotoğraftır. Canlı akış ile hesaplayıcının var olma nedeni budur ve bu sayfanın çekim tarihini söyleyip sayıları kalıcıymış gibi sunmamasının nedeni de budur.

15 sağlayıcıda fiyat manzarası
SağlayıcıYayımlanmış token fiyatı olan metin modelleriEn düşük girdi (USD / 1M)En yüksek girdi (USD / 1M)
OpenAI490.05150
Anthropic (Claude)101.0015
Google Gemini210.0752.00
xAI Grok61.002.00
DeepSeek40.140.435
Mistral320.042.00
Qwen490.0352.80
Kimi90.202.00
MiniMax70.300.60
Z.ai120.071.40
Groq70.030.59
Together AI690.023.50
Fireworks AI150.072.80
OpenRouter3050.01150
SiliconFlow490.041.74

Aynı modelin birden fazla fiyatı neden olur

İki model dizinini açınca aynı modeli farklı tarifelerde görebilirsiniz. Bu genellikle bir hata değildir. Open-weight modelleri birkaç çıkarım barındırıcısı sunar; her birinin kendi donanımı, verimi ve marjı vardır. Bir model bir barındırıcıda bir şeye, diğerinde başka bir şeye mal olabilir ve bu meşrudur. Yukarıdaki akışta aynı open-weight aile, birkaç sağlayıcıda gerçekten farklı tarifelerde görünür.

İkinci neden, modeli hangi aracı üzerinden satın aldığınızdır. Aggregator’lar sizinle alttaki sağlayıcının arasında durur ve bu konumu bir şekilde finanse etmek zorundadır. Token fiyatlarına eklenen bir makas, bakiye yükleme ücreti, istekler üzerinde bir yüzde ya da token’a dönüşümü sağlayıcının fiyat listesiyle değil platformca tanımlanan bir kredi sistemi. Bunların hiçbiri kendiliğinden kötü değildir. Önemli olan mekanizmanın yayımlanıp yayımlanmadığıdır. OpenRouter örneğin koşullarını açık yazar. 24 Temmuz 2026 itibarıyla yayımlanmış politikası, kartla yüklemede en az $0,80 ile %5,5 ücrettir. Kendinizin getirdiği anahtarlarda her ay ilk bir milyon istek ücretsizdir; bunun ötesinde modelin normal fiyatının %5’i kredi olarak düşülür.

Platformları karşılaştırırken sorulmaya değer soru “bir kredi ne kadar” değil, “sağlayıcının liste fiyatından bana kesilene yayımlanmış yol nedir”dir. Bir platform kredi ile fiyatlıyorsa ve bu dönüşümü yayımlamıyorsa, yaptığınız karşılaştırma modelin fiyatıyla değildir. Platformun fiyat politikasıyladır ve bu politika, modelin fiyatı hiç değişmeden değişebilir.

Abonelik mi, kullandıkça öde mi: sizin için hangisi daha ucuz

Çoğu kişinin aslında geldiği soru budur ve genel bir yanıtı yoktur. Sabit aylık abonelik ile ölçümlü API erişimi bir kullanım hacminde kesişir. Bu kesişim sizin kendi mesajlarınıza bağlıdır: ne kadar uzun olduklarına, yanıtların ne kadar uzun olduğuna, hangi modeli seçtiğinize ve dizilerinizin ne kadar sürdüğüne. Sizin sayılarınız olmadan bir tasarruf yüzdesi veren herkes tahmin yürütüyordur.

Yaklaşık beş dakikada çıkarabilirsiniz ve aritmetik zor değildir. En yoğun haftanızı değil, gerçekten tipik bir haftanızı alın. Mesajları sayın. Aldığınız yanıtların ortalama uzunluğunu sözcük olarak tahmin edin ve token’a varmak için kabaca 1.35 ile çarpın. Girdi tarafını ekleyin; her turun o ana kadarki diziyi yeniden gönderdiğini unutmayın. Modelin yayımlanmış girdi ve çıktı tarifeleriyle çarpın ve bunu düşündüğünüz aylık ücretle karşılaştırın. Bu sitedeki maliyet hesaplayıcı bunu canlı fiyatlara karşı yapar; tarifeleri tutmak zorunda kalmazsınız.

Sayı uydurmadan söylenecek kadar sağlam birkaç yapısal örüntü vardır. Kullanım hafif ya da dikenliyse, bir modeli ağır kullanmak yerine birkaç modeli ara sıra kullanıyorsanız ve işinizin çoğu kısa soru ile kısa yanıtsa ölçümlü erişim genellikle kazanır. Abonelikler, her gün tutarlı biçimde yüksek hacimde genellikle kazanır ve finansal olmayan gerçek bir avantajları vardır: öngörülebilir bir fatura. Mesaj başı maliyeti görünmeyen ölçümlü erişim, ikisinin de kötü yanıdır. Her mesajdaki maliyet tahmininin önlemek için olduğu bozulma tam olarak budur.

Harcamayı gerçekten nasıl düşürürsünüz

Sayaçları bir kez görünce tasarrufun çoğu, en ucuz sağlayıcıyı avlamaktan değil, az sayıda alışkanlıktan gelir. Tipik bir sohbet yükünde sayıyı ne kadar oynattıklarına göre kabaca sıra şöyledir:

Genellikle işe yaramayan şey, her şeyi katalogdaki en ucuz modele taşımaktır. Doğru yanıt için üç deneme isteyen ve fiyatın beşte biri olan bir model tasarruf değildir; üstüne zamanınızı da alır. Bu öğüdün işe yarayan hâli, modeli göreve uydurmaktır. Çıkarma, biçimlendirme, özet ve çeviri için ucuz modeller; bir insana para ödeyeceğiniz iş için pahalı olanlar.

  • Yeni bir konu için yeni bir sohbet aç. Tek başına en büyük kaldıraç budur, çünkü ilgisiz bir geçmişi yeniden göndermek için ödeme yapmanızı keser.
  • Daha kısa yanıt istediğinde daha kısa yanıt iste. Yaklaşık on modelden dokuzunda daha pahalı sayaç çıktıdır.
  • Her şey için en güçlü modele yapışmak yerine modeli göreve uydur.
  • Sistem prompt’larını ve yeniden kullanılan hazır ayarları sıkı tut. Onları kullanan her mesajda faturalanırlar.
  • Sağlayıcı destekliyorsa ve aynı uzun bağlamı tekrar tekrar kullanıyorsan prompt önbelleğini kullan.
  • Bir ekin işi bitince onu diziden çıkarın; sonraki her tura taşımaktansa.
  • Bir örüntüyü yüz kez tekrarlamadan önce mesajdaki tahmine bak.

Oriveo maliyeti size nasıl gösterir

Oriveo’daki her mesaj, yanıt bittiği anda tahmini bir maliyet taşır. Hesap, sağlayıcının yayımladığı token fiyatı ve gerçekten raporlanan token’lar üzerindendir. Bu tahmin, oturumsuz Oriveo Free dahil her planda vardır. Maliyeti yalnızca ücretli planda görebilmek, bir şeye para verip vermemeye karar vermenize yardım etmez. Yukarıdaki tablolarda kullanılan aynı veri akışı bu fiyatları verir. Uygulamanın sizden bir fiyat listesi tutmanızı istememesinin nedeni budur.

Bu bir tahmindir ve tahmin diye etiketlenir. Sağlayıcılar kendi yuvarlamalarını, faturalanabilir en küçük birimlerini, hesaba özel tarifelerini ve ara sıra promosyon fiyatlarını uygular. Token sayıları da olaydan sonra sağlayıcı tarafından raporlanır. Tahmin, ay içinde kararları yönlendirmek için oradadır. Son söz sağlayıcının faturasıdır. İkisi uyuşmazsa haklı olan faturadır.

Daha derin analiz ücretli planların arkasındadır. Usage Insights — sağlayıcı ve modele göre harcama, aylık eğilimler ve bütçe uyarıları — Pro ve Lifetime’in parçasıdır. 24 Temmuz 2026 itibarıyla bunlar ayda $9,99, yılda $59,99 ya da tek seferde $149,99 tutar. Bu planlar yalnızca yazılım özelliği satın alır. yapay zekâ kullanımı, model kredisi ya da sağlayıcı aboneliği içermezler. Uygulamanın fiyatı ile token’larının fiyatı, ayıramayacağınız tek bir sayıda hiç birleşmez.

Yapay zekâ harcamasını sağlayıcı ve modele göre ayıran bir kullanım analizi ekranı
Mesaj başı tahminler her katmanda vardır; sağlayıcı ve model dökümü ücretli planların parçasıdır.

Bu sayıların söyleyemediği şeyler

Bir fiyat tablosu başlangıçtır, karar değil. Dışarıda bıraktığı üç şeyi açık söylemeye değer, çünkü yalnızca fiyata göre kapanmış görünen bir karşılaştırmayı düzenli olarak tersine çevirirler.

Birincisi görev başına token’dır. Aynı tarifedeki iki model, aynı yanıta varmak için harcadıkları token sayısında belirgin ayrılabilir. Lafı bol ama ucuz bir model, bitmiş iş başına, az konuşan pahalı bir modelden daha pahalıya gelebilir. İkincisi yeniden üretme oranıdır. Yeniden ürettirmek zorunda kaldığınız bir yanıt iki kez faturalanır. Üçüncüsü token sayacının dışındaki her şeydir: istek sınırları, gecikme, bağlam penceresi, sizin bölgenizdeki kullanılabilirlik ve modelin çalıştığınız dosya biçimlerini okuyup okuyamadığı.

Bunun gibi bir karşılaştırmayı kullanmanın dürüst yolu, onu kısa liste süzgeci yapmaktır. Bütçenin açıkça dışında kalan satırları ele, iki ya da üç adayı kendi gerçek işiniz üzerinde deneyin ve bir milyon token’ın değil, biten bir görevin kaça geldiğine bakın. Mesaj başı tahmin tam olarak bunun için vardır: deney bir fatura dönemi değil, bir gün sürsün.

Sıkça Sorulan Sorular

Bir LLM API’sine giden tek bir mesaj gerçekte kaça mal olur?
Tek bir sayaca değil, dörde bağlıdır: gönderdiğiniz token’lar, modelin geri yazdığı token’lar, önbellekten okunan token’lar ve bazı sağlayıcılarda önbelleğe yazılan token’lar. Orta fiyatlı bir modele kısa bir soru tipik olarak bir sentin küçük bir kesrine mal olur. Aynı soru uzun bir dizinin sonunda daha pahalıya gelir, çünkü tüm sohbet her turda girdi olarak yeniden gönderilir.
Çıktı neden girdiden pahalı?
Token üretmek sıralıdır ve prompt’u okumanın olmadığı biçimde hesaba bağlıdır, bu yüzden sağlayıcılar onu daha yüksek fiyatlar. 24 Temmuz 2026’da ölçülen 15 sağlayıcıda medyan model, çıktı için girdiye göre dört kat ücret alır ve yaklaşık yedide biri altı kattan fazla ister. Daha kısa yanıt istemek, genellikle prompt’u kısaltmaktan daha büyük bir kaldıraçtır.
Prompt önbelleği faturayı gerçekten düşürür mü?
Aynı uzun bağlam birkaç kez yeniden kullanıldığında düşürebilir. Ölçülen akışta yaklaşık beş modelden biri önbellekten okuma fiyatı yayımlar ve olduğu yerde bu, o modelin kendi girdi tarifesinin ortanca olarak %10’udur. Bazı sağlayıcılar önbelleğe yazmak için de ücret alır, bu yüzden yalnızca bir kez kullandığınız bir bağlamı önbelleğe almak, hiç önbelleğe almamaktan biraz daha pahalıya gelebilir.
Kullandıkça ödenen bir API, aylık bir yapay zekâ aboneliğinden daha mı ucuz?
Hafif ya da düzensiz kullanımda genellikle öyledir. Her gün tutarlı biçimde ağır kullanımda sabit ücret çoğu zaman kazanır. Evrensel bir yüzde yoktur, çünkü kesişim mesaj hacmine, yanıt uzunluğuna ve model seçimine bağlıdır. Genel bir iddiaya güvenmek yerine tipik bir haftayı, güncel fiyatlara karşı bir maliyet hesaplayıcıyla tahmin edin.
Aynı model farklı platformlarda neden farklı tutar?
İki nedeni vardır. Open-weight modelleri, donanımı ve marjı farklı birkaç çıkarım barındırıcısı sunar; aynı ağırlıklar gerçekten farklı tarifeler taşıyabilir. Erişimi yeniden satan platformlar da kendi katmanlarını ekler: bir makas, bir yükleme ücreti, bir yüzde ya da bir kredi sistemi. Sorulacak soru, sağlayıcının liste fiyatından size kesilene giden yolun yayımlanıp yayımlanmadığıdır.
Bu yazıdaki fiyatlar ne kadar güncel?
Her rakam 24 Temmuz 2026’da Oriveo’nun üretim veri akışından alındı: contract version 47, üretim zamanı 2026-07-24T01:00:09Z. Sağlayıcı fiyatları sık değişir, bu yüzden bu sayıları o tarihin anlık görüntüsü diye görün. Sitedeki maliyet hesaplayıcı aynı akışı canlı okur; güncel bir tarifeyi kontrol edeceğiniz yer orasıdır.
Oriveo, sağlayıcıların kestiğinin üstüne pay ekler mi?
Hayır. Kendi API anahtarlarınla her sağlayıcı kendi hesabını yayımlanmış liste fiyatından faturalandırır ve Oriveo üzerine hiçbir şey almaz. Yönetilen kullanım, ön ödemeli bir bakiyeden her modelin resmi liste fiyatıyla kesilir. Ücretli Oriveo planları cihazlar arası eşitleme ve kullanım analizi gibi yazılım özelliklerini kapsar. yapay zekâ kullanımı ya da model kredisi içermezler.

İlgili yazılar

Her mesajın kaça geldiğini gönderirken görün

Oriveo her mesajda, sağlayıcının liste fiyatından tahmini bir maliyet gösterir. 15 resmi sağlayıcı ve 700+ model; iPhone, Android ve web. Sağlayıcı kullanımının üstüne pay yok.