Sabit ücretli LLM sağlayıcıları, token başına faturalandırma yerine aylık sabit bir fiyat karşılığında sınırsız model kullanımı sunar. Bu model, ajan tabanlı kodlama oturumları on milyonlarca token kullanabildiği için yaygınlaştı; bu nedenle token başına bir faturanın tahmin edilmesi zordur. Çok az sayıda sağlayıcı gerçek bir sabit ücret sunar; sabit olarak pazarlanan çoğu planın altında bir kullanım kotası bulunur. Aşağıda, sunulan modeller, eşzamanlılık limiti ve her biri için fiyatlandırma ile birlikte gerçekten sınırsız kullanım sunan sağlayıcıları karşılaştırıyoruz.
Sağlayıcı | Odak | Modeller | Eşzamanlılık | Fiyat |
|---|---|---|---|---|
Giotto.ai | AB'de barındırılan egemen dağıtım | Giotto 1 (kendi modeli) | tek seferde 1 istek | 49.90 CHF/ay, duyuruldu |
Featherless.ai | Sabit maliyetle açık ağırlıklı model çeşitliliği | 30,000'den fazla açık ağırlıklı model | plan başına 4 ila 8 birim | $25/ay'dan başlayan |
Awan LLM | Bütçe dostu sabit ücretli erişim | Açık ağırlıklı, katalog listelenmemiş | dakikada 100 ila 200 istek | $5 ila $80/ay |
Bu tablodaki sağlayıcılar iki kriteri karşılamaktadır:
- Yayınlanmış sabit bir aylık fiyat.
- Kullanımda token, prompt veya zaman penceresi kotası yoktur.
İncelenen sabit ücretli LLM sağlayıcıları
Featherless.ai
Featherless, sınırsız token ve istek ile tek bir OpenAI uyumlu API üzerinden 30.000'den fazla açık ağırlıklı model (DeepSeek, Kimi, GLM, Qwen, Llama ve ince ayarlanmış modeller) sunar.1 Token sayacı yerine, eşzamanlılık birimlerini fiyatlandırır: küçük bir model, devam eden istek başına 1 birim maliyetindedir, 70B sınıfı bir model 4 birimdir ve bütçenizi aşan istekler ücret yerine HTTP 429 hatası döndürür.
Premium plan 4 birim içerir, bu nedenle $25 bir büyük model hattı veya dört küçük model hattı satın alır. Agent planları 8 birim ve otonom iş yükleri için bir sanal alan ekler. Şirket, 04-30-2026 tarihinde AMD Ventures ve Airbus Ventures tarafından ortaklaşa yönetilen $20M Seri A yatırımı aldı; bu, bu pazardaki en güçlü finansal destektir.
En iyi kullanım durumu: Sabit bir maliyet tavanında yoğun tek akışlı ajan tabanlı kodlama ve model denemesi.
Modeller: 30.000'den fazla açık ağırlıklı model; $100 kademelerinde 229B boyut sınırı, $200 kademelerinde sınır yok.
Eşzamanlılık: 4 birim (Premium), 8 birim (Agent ve İş birimi başına).
Fiyat: Premium $25/ay. Agent $100 veya $200/ay. Business birim başına $100 veya $200/ay.
Temel özellikler:
- Her planda sınırsız token ve istek.
- İstek başına değiştirilebilir, kataloglanmış herhangi bir açık ağırlıklı model.
- OpenAI uyumlu API.
- Prompt'lar ve tamamlamalar için belgelenmiş kayıt tutmama politikası.
- Business planlarında eşzamanlılık doğrusal olarak ölçeklenir.
Sınırlamalar:
- Bir 70B sınıfı istek, tüm Premium birim bütçesini tüketir.
- Bütçeyi aşan istekler HTTP 429 ile reddedilir, bu nedenle paralel araçların kendi istek kuyruğuna ihtiyacı vardır.
- Hat başına verim yayınlanmamıştır; satıcı saniye başına token belirtmez.
Giotto.ai
Giotto, Lozan'da bulunan ve kendi muhakeme modeli Giotto 1'i sunan bir İsviçre laboratuvarıdır. Bu modeli, tek bir GPU'da çalışan en güçlü model olarak konumlandırmaktadır.2 Şirket, aynı sistemi AB'de barındırılan bulut, özel şirket içi dağıtım veya önceden kurulmuş donanım olarak ISO 27001 sertifikasıyla satmaktadır.
Sabit ücretli API, CEO Aldo Podestà tarafından 07-09-2026'da duyuruldu: aylık 49.90 CHF, bir eşzamanlı istek, sınırsız kullanım.3 07-23-2026 itibarıyla teklif giotto.ai'da yer almamaktadır; sitenin fiyatlandırma sayfası yoktur ve alıcıları bir iletişim formuna yönlendirir, bu nedenle aşağıdaki tüm koşullar geçicidir.
En iyi kullanım durumu: Sabit bir bütçede AB veri yerleşimi ve egemenlik gereksinimleri.
Modeller: Yalnızca Giotto 1.
Eşzamanlılık: Tek seferde 1 istek (tek eşzamanlılık).
Fiyat: 49.90 CHF/ay, yalnızca duyuru; belirtilmemiş API limitlerine sahip ücretsiz Giotto Open çalışma alanı.
Temel özellikler:
- Duyuruya göre, tek bir istek hattı üzerinden sınırsız kullanım.
- İsviçre ve AB ortak veri merkezlerinde AB barındırma.
- Aynı model, kendi GPU'larınızda özel dağıtım için mevcuttur.
- Ücretsiz paylaşımlı çalışma alanı API erişimi içerir.
Sınırlamalar:
- Henüz satın alınamaz; 07-23-2026 itibarıyla genel bir fiyatlandırma sayfası yoktur.
- Duyuru, Fable 5'e kıyasla 200x'e kadar ve GPT Pro'nun API'sine kıyasla 350x'e kadar tasarruf iddia etmektedir; bunlar yalnızca fiyatı karşılaştırır. Giotto'nun kendi benchmark tablosu, Giotto 1'i Gemma 4 31B ve GPT-OSS-120B gibi tek GPU'lu modellere karşı konumlandırır; fiyat iddiasındaki öncü modellere karşı değil.
- Erken aşama şirket: ürün 05-18-2026'da piyasaya sürüldü ve CEO Haziran 2026'da CHF 10M'a kadar dönüştürülebilir bir kredinin Temmuz ayına kadar kapatılmasının beklendiğini ve yıl sonu için daha büyük bir tohum turu planlandığını belirtti.
Awan LLM
Awan LLM, model boyutu sınıfına göre ölçeklenen günlük istek sınırları ve dakika başına hız limitleri ile aylık 5 dolardan başlayan "sınırsız token" satmaktadır.4 Günlük sınırlar ($20 Pro planında 30B'den 80B'e kadar istek), tek bir etkileşimli kullanıcının oluşturduğunun çok üzerindedir ve bu da planı pratikte sabit ücretli hale getirir.
Fiyatlandırma sayfası, hangi modellerin sunulduğunu veya ne kadar güncel olduklarını listelemez. Ödeme yapmadan önce kataloğu iş yükünüze göre doğrulayın.
En iyi kullanım durumu: Hafif ve orta düzey açık ağırlıklı iş yükleri için en düşük maliyetli sabit ücretli giriş.
Modeller: Açık ağırlıklı; katalog ve sürümler fiyatlandırma sayfasında belirtilmemiştir.
Eşzamanlılık: Dakikada 100 istek (Pro) ila 200 istek (Max) ile hız sınırlıdır.
Fiyat: Lite ücretsiz, Core $5/ay, Plus $10/ay, Pro $20/ay, Max $80/ay.
Temel özellikler:
- Her ücretli kademede sınırsız token.
- Küçük ölçekli testler için ücretsiz kademe mevcuttur.
- Max kademesi günlük istek sınırlarını kaldırır.
- Bu pazarda aylık 5 dolarla en ucuz ücretli giriş.
Sınırlamalar:
- Sunulan modeller ve sürümleri belgelenmemiştir; kalite doğrulanmamıştır.
- Model boyutu sınıfına göre istek sınırları, token sayacının yerini alır.
Kullanım kotalı sabit fiyatlı planlar
Sabit ücret tartışmasındaki çoğu plan, yenilenen bir kotaya sahip aboneliklerdir: fiyat sabittir ve bir prompt veya token bütçesi sizi faturalandırmak yerine durdurur. Kota sınırında ne olduğu satıcıya göre değişir ve kota boyutu kadar önemlidir. Bu planları, LLM fiyatlandırma rehberimizde kademe ele alıyoruz.
Z.ai GLM Coding Plan
- Ölçüm: 5 saatlik pencere başına ~80 ila 1.600 prompt ve kademeye göre haftada ~400 ila 8.000; her prompt tahmini 15 ila 20 model çağrısını tetikler; yoğun saatlerde 3x kota düşümü.
- Sınırda: pencere yenilenene kadar sert engelleme, kullandıkça ödemeye geçiş yok.
- Genel bakış: $18 ila $160/ay, 20'den fazla kodlama aracında Anthropic uyumlu bir endpoint üzerinden GLM-5.2 sunar.5
Kimi Code
- Ölçüm: tüm Kimi üyelik özellikleriyle paylaşılan, haftalık yenilenen ve devretmeyen bir kredi havuzu, ayrıca kayan 5 saatlik bir hız penceresi; kota hacimleri yayınlanmamıştır.
- Sınırda: sert engelleme yerine Ekstra Kullanım yoluyla ölçülü ek ücret.
- Genel bakış: 2 ila 8 eşzamanlı ajan göreviyle K2.7 Code için $19 ila $199/ay; HighSpeed modu 3x kota tüketir.6
MiniMax Coding Plan
- Ölçüm: 5 saatlik ve haftalık pencereler içinde ayda ~1.7B ila 12.5B token; kullanılmayan kota devretmez.
- Genel bakış: $20 ila $120/ay; MiniMax üretim kullanımı için kullandıkça ödemeyi önerir.7
Cerebras Code
- Ölçüm: günde 24M ila 120M token.
- Genel bakış: Cerebras donanımında GLM 4.7 için $50 veya $200/ay; 07-23-2026'da her kademe hâlâ tükenmiş görünüyordu.8
NanoGPT Pro
- Ölçüm: haftada 60M girdi token'ı; büyük modeller 2x düşer.
- Genel bakış: dahil edilen açık kaynak model setinde web ve API ile $12/ay.9
Synthetic
- Ölçüm: 5 saatte 500 istek, model başına 1 eşzamanlı istek.
- Genel bakış: yedi sürekli açık açık ağırlıklı model için $30/ay, arayüz ve API.10
Chutes
- Ölçüm: dahil edilen kullanım, plan fiyatının 5x katı ile sınırlıdır, sonrasında faturalandırma token başına devam eder.
- Genel bakış: merkeziyetsiz hesaplamada $10 veya $20/ay ön ödemeli paketler; sabit ücretten ziyade bir indirim programıdır.11
Claude ve ChatGPT abonelikleri
- Ölçüm: 5 saatlik oturumlar ve haftalık sınırlar (Claude); limitli kullanım kademeleri (ChatGPT).
- Genel bakış: $20 ila $200+/ay; öncü kapalı modellere giden tek sabit fiyatlı yol, API olarak değil koltuk olarak satılır.12
Sabit ücretli fiyatlandırma nasıl çalışır
1. Eşzamanlılık hatları token sayacının yerini alır
Sabit ücretli bir sağlayıcı, kaç token tükettiğiniz yerine aynı anda kaç istek çalıştırabileceğinizi sınırlar. Bir istek hattı, bir GPU akışının çıktısından daha fazlasını çekemez, bu nedenle sağlayıcının en kötü durum sunum maliyeti sabittir. Aritmetik ayrıca sizi sınırlar: günde 24 saat saniyede 50 token akışı yapan bir hat, 30 günlük bir ayda en fazla yaklaşık 130M çıktı token'ı üretir ve gerçek kullanım, hattın çağrılar arasında boşta kalması nedeniyle bunun oldukça altında kalır. Bu nedenle saniye başına token, bir satın alma kriteri haline gelir ve üç sağlayıcıdan hiçbiri bunu yayınlamaz.
2. Açık ağırlıklı ekonomi
Her gerçek sabit ücretli sağlayıcı, ya ticari GPU'larda açık ağırlıklı modeller (Featherless, Awan) ya da kendi altyapısında kendi modelini (Giotto) sunar. Hiç kimse öncü bir kapalı modele sınırsız sabit erişim satmaz, çünkü bir satıcı token başına lisansladığı bir modelin sunum maliyetini sınırlayamaz. Anthropic ve OpenAI, yalnızca kendi modelleri için, kota sınırlı sohbet aboneliklerine dahil edilmiş sabit fiyatlar satar.
3. Token başına ödemeye karşı başa baş noktası
Sabit bir plan, aynı model için ölçülü harcama plan fiyatını aştığında kazanır ve başa baş noktası büyük ölçüde hangi ölçülü ana bilgisayarla karşılaştırdığınıza bağlıdır. Llama 3.3 70B, DeepInfra'da milyon girdi token'ı başına $0.10 ve milyon çıktı başına $0.32 iken, Together AI'da milyon başına sabit $1.04'tür.13 70:30 girdi-çıktı karışımı varsayıldığında, $25'lık Featherless Premium, DeepInfra'ya karşı ayda yaklaşık 150M token'da başa baş olurken, Together AI'a karşı yalnızca yaklaşık 24M token'da başa baş olur. Yoğun tek akışlı ajan kullanımı alt çıtayı kolayca aşar ve üsttekini de aşabilir.
Tersi durum da aynı derecede önemlidir. Ayda 5M token'lık bir iş yükü, yirmi paralel kısa oturuma yayıldığında DeepInfra'da ölçülü olarak 1 doların altında maliyete sahipken, bu eşzamanlılığı sabit ücretli hatlarda sunmak $100 veya daha fazlasına mal olur. Sabit ücret, yüksek hacimli, düşük eşzamanlılıklı işler için uygundur; token başına ödeme, düşük hacimli veya yüksek paralel trafikte kazanır. Rakamlar, belirtilen erişim tarihlerindeki örneklerdir; geçen ayın token sayılarını aynı aritmetikten geçirin.
4. Sınırsız fiyatlandırmanın sürdürülebilirliği
Sınırsız planlar en ağır kullanıcıları çeker ve piyasa zaten gerginliği göstermektedir. Cerebras Code, ilk kontrol ettiğimizden on gün sonra, 07-23-2026'da her kademede tükenmişti. NanoGPT, aboneliğini bir yıl içinde $8'dan $12'a çıkardı. Z.ai'nin %30 indirimi süreyle sınırlıdır.
Emsaller bu nişten daha büyüktür. OpenAI CEO'su Ocak 2025'te, aylık $200'lık ChatGPT Pro planının, aboneler onu öngörülenden daha fazla kullandığı için para kaybettiğini söyledi.14 GitHub, 06-01-2026'da Copilot'un premium istek birimlerini kullanım tabanlı AI Kredileri ile değiştirirken abonelik fiyatlarını değiştirmedi.15 Cursor, Haziran 2025'te 500 istek tahsisini $20'lık bir kullanım havuzuyla değiştirdi ve tepkiden sonra geri ödemeler yaptı.16 Sabit fiyatlı yapay zeka kullanımının en büyük satıcıları sayaçlara doğru geri çekilirken, küçük bir sağlayıcının sınırsız planını bir tanıtım fiyatı olarak ve başa baş matematiğini yıllar yerine aylar için geçerli olarak değerlendirin.
2026'da neden sabit ücretli bir LLM planına ihtiyacınız olsun?
1. Yoğun ajan tabanlı kodlama
Tek bir kodlama ajanı oturumu yüzlerce ardışık model çağrısı yapar ve on milyonlarca token yakabilir. Bir hat, bu modeli fatura değişikliği olmadan sürekli olarak sunar. Featherless uygundur; Giotto satın alınabilir olduğunda uygun olacaktır.
2. AB veri yerleşimi
Giotto, İsviçre ve AB veri merkezlerinde barındırma yapar, kendi modelini sunar ve aynı sistemi özel dağıtım için sunar; bu, verileri ABD'de barındırılan API'lere gönderemeyen düzenlemeye tabi ekipler için uygundur.
3. Model denemesi
Featherless, tek bir API ve tek bir ücret arkasında 30.000'den fazla açık ağırlıklı modeli sunar, böylece modelleri karşılaştırmak abonelik dışında hiçbir maliyet getirmez.
4. Maliyet sınırlı yan projeler
Ani kullanım artışları olan bir hobi projesi, sayaçta sürpriz faturalar riski taşır. Awan LLM, aylık $5 ila $20 ile olumsuzluğu abonelik fiyatında sınırlar.
5. Toplu ve arka plan işleme
Gece boyunca özetleme, sınıflandırma veya veri temizleme işleri kuyruğa almayı tolere eder, böylece bir hattın boş saatlerini sıfır marjinal maliyetle doldurabilirler. Model kalitesi yeterliyse, üç sağlayıcıdan herhangi biri uygundur.
Doğru sabit ücretli LLM planı nasıl seçilir?
İş yükünün şekli fiyattan daha fazlasını belirler. Sıralı iş (bir ajan, bir sohbet, toplu işler) tek bir hatta iyi çalışır. Paralel ajan filoları bir hattın arkasında serileşir ve daha fazla eşzamanlılığa ihtiyaç duyar: Featherless ekstra birimleri açıkça fiyatlandırır ve bütçeyi aşan istekleri HTTP 429 ile reddederken, Giotto'nun duyurulan API'si gibi tek eşzamanlılıklı bir plan hiç genişletilemez.
Model kalitesi tabanı belirler. Sabit bir plan, yalnızca sunulan model işinizi yapabiliyorsa para tasarrufu sağlar; bu nedenle fiyatları karşılaştırmadan önce belirli model için bağımsız benchmark puanlarını kontrol edin. Öncü modellere karşı belirtilen fiyat katları, farklı kalite sınıflarını karşılaştırır.
Aylık hacim ve ölçülü alternatif, sabit ve ölçülü arasındaki kararı birlikte belirler. Düşük maliyetli bir ana bilgisayara karşı $25'lık bir plan için geçiş noktası ayda yaklaşık 150M token civarındadır; premium bir ana bilgisayara karşı yaklaşık 24M'e düşer. Geçiş noktanızın altında, kullandıkça öde daha ucuzdur; çok üstünde, sabit bir plan fiyatının katlarını geri döndürür.
Abone olmadan önce kontrol edilmeye değer sınırlamalar:
- Hiçbir sağlayıcının şu anda yayınlamadığı saniye başına token ve gecikme rakamları.
- Bir büyük model isteğinin eşzamanlılık birimi cinsinden maliyeti.
- Limitteki davranış: reddedilen istekler (Featherless), kuyruğa alma veya ölçülü ek ücret.
- Sunulan model kataloğunun belgelenip belgelenmediği (Awan bunu listelemez).
- Ticari ve üretim kullanım koşulları.
Sağlayıcı dayanıklılığı bu pazarda gerçek bir kriterdir. Featherless $20M Seri A'ya sahiptir; Giotto, Haziran 2026 itibarıyla hâlâ CHF 10M'a kadar dönüştürülebilir bir krediyi kapatıyordu. Kısıtlaması kendilerine sürdürülebilir birim ekonomisi sağlayan sağlayıcıları tercih edin ve bir yıl içinde yeniden fiyatlandırılabilecek veya tükenebilecek bir plana bir ekibi standartlaştırmaktan kaçının.
SSS'ler
Temmuz 2026 itibarıyla: Featherless.ai ($25/ay'dan başlayan, eşzamanlılık sınırlı), Awan LLM ($5 ila $80/ay, istek hızı sınırlı) ve Giotto.ai'nin duyurulan ancak henüz kamuya açık olarak satın alınamayan 49.90 CHF/ay API'si. Kontrol ettiğimiz diğer tüm sabit fiyatlı planlar, yenilenen kotalar aracılığıyla kullanımı ölçer.
Eşzamanlı istekleri sınırlayarak. Bir hat, bir GPU akışının çıktısından daha fazlasını tüketemez, bu nedenle sağlayıcının en kötü durum maliyeti sabittir ve sunulan modeller açık ağırlıklı veya satıcıya aittir, bu nedenle token başına lisans maliyeti uygulanmaz.
Genellikle hayır. Verim, satın alınan hatlarda üst sınıra ulaşır, ana tablodaki hiçbir sağlayıcı bu planlar için bir SLA yayınlamaz ve kota tabanlı alternatifler üretim kullanıcılarını açıkça kullandıkça ödemeye yönlendirir.
Bu araştırmayı kaynak gösterin
Yayınlayacağınız yere uygun formatı seçin. Bağlantılı sürümü CMS'inize yapıştırmak, geri bağlantıyı korur.
@misc{kalelioglu2026,
author = {Kalelioğlu, Berk},
title = {{En İyi Sabit Ücretli LLM API Sağlayıcıları}},
year = {2026},
month = jul,
howpublished = {\url{https://aimultiple.com/flat-rate-llm-api}},
note = {AIMultiple. Erişim tarihi: 23 Temmuz 2026}
}
Yorum yapan ilk kişi olun
E-posta adresiniz yayınlanmayacak. Tüm alanlar gereklidir. Yorumlar orijinal dilinde bırakılır.