Yapay zekâ fiyatlandırması birkaç yıl boyunca bize çok tanıdık bir ölçü birimi sattı: token. Bir modelin ne kadar metin okuduğunu ve ürettiğini ölçüyor, fiyatı da buna göre hesaplıyorduk. Fakat ajanlar gerçek iş yapmaya başladıkça bu ölçü tek başına garipleşiyor. Bir müşteri destek sorununu çözmek için 4 bin token harcayan sistem ile aynı işi 40 bin token harcayarak bitiren sistem müşteriye aynı ekonomik sonucu verebilir. Kullanıcının satın almak istediği şey token değil, çözülen iştir.
Piyasada tek yönlü bir geçiş yok. Microsoft ajan kullanımını kredi, yanıt ve aksiyon gibi birimlerle ölçüyor. Salesforce Agentforce doğrudan aksiyon başına fiyatlandırma sunuyor. Intercom ise Fin’in fiyatlama mantığını çözümden daha geniş bir outcome kavramına taşıyor. Aynı haftalarda OpenAI ve Anthropic tarafında ters yönden başka bir hareket görülüyor: sabit koltuk ücretinin yanına veya yerine ölçülen kullanım geliyor. [1] [2] [3] [4] [5]
Bu tablo “token bitiyor” demiyor. Daha ilginç bir şey söylüyor: yapay zekâ şirketleri aynı ürün içinde erişimi, hesaplama maliyetini, yapılan işi ve ortaya çıkan değeri farklı birimlerle fiyatlandırmaya başlıyor.
Daha önce ChatGPT’ye neden para ödediğimizi tartışırken değerin model zekâsından hesaplama, araçlar, bellek, entegrasyon ve kullanım kolaylığına kayabileceğini yazmıştım. Ardından model değişse bile arayüzün, iş hafızasının ve iş akışlarının kalabileceğini ele aldım. Buradaki soru bunun ekonomik devamı: model ve hesaplama giderek değiştirilebilir hâle geliyorsa müşteriye hangi birim üzerinden fatura kesilecek?
Token dönemi bitmiyor; fiyatlandırmanın tek dili olmaktan çıkıyor
Token hâlâ çok işe yarayan bir teknik ölçü. Modelin giriş ve çıkış hacmini, dolayısıyla hesaplama maliyetinin önemli bir bölümünü ölçüyor. API sağlayıcısı açısından bunun ortadan kalkması için bir neden yok.
Fakat müşterinin değeri aynı şey değil. Bir satış kaydını güncellemek, bir destek talebini çözmek veya bir faturayı işlemek için kullanılan token sayısı sağlayıcının iç maliyetidir. Müşterinin derdi ise işin tamamlanıp tamamlanmadığıdır. Ajanlar daha fazla araç çağırdıkça, kontrol yaptıkça ve kendi içinde daha uzun çalıştıkça bu iki ölçü arasındaki mesafe büyüyor.
Bu nedenle 2026 baharında gördüğümüz fiyatlandırma denemelerini “tokenın yerine yeni bir şey geliyor” diye değil, maliyet ölçüsü ile müşteri değerinin birbirinden ayrılması olarak okumak daha doğru.
Microsoft: kullanım kredisi artık yanıtı ve aksiyonu da ölçüyor
Microsoft’un Nisan 2026 Copilot Studio lisanslama kılavuzu Copilot Credits’i ajan kullanımının ortak para birimi olarak tanımlıyor. Krediler yalnız metin üretimini değil; bilgi getirme, yanıta dönme, aksiyon gerçekleştirme, workflow çalıştırma ve başka araçları çağırma gibi faaliyetleri de kapsıyor. Tüketilen kredi miktarı yapılan işin karmaşıklığına göre değişiyor. Pay-as-you-go modelinde her Copilot Credit için 0,01 dolar fiyat belirtiliyor. [1]
Buradaki değişim küçük görünse de önemli. Microsoft’un müşteriye sunduğu sayaç artık yalnız “kaç token harcadın?” değil. Ajanın sistem içinde yaptığı faaliyet de faturanın parçası. Teknik maliyet hâlâ altta duruyor; ticari birim yukarı doğru genişliyor.
Salesforce daha açık: aksiyon başına öde
Salesforce Agentforce’un Flex Credits modeli bu geçişi daha doğrudan gösteriyor. Şirketin 23 Şubat 2026 tarihli rate card’ında standart ve özel Agentforce aksiyonları 20 Flex Credit olarak fiyatlanıyor. Salesforce’un yayımladığı fiyatlandırma açıklamasında 100 bin kredi 500 dolar; dolayısıyla standart bir aksiyon yaklaşık 0,10 dolara geliyor. [2]
Bu gerçek bir sonuç fiyatlandırması değil. Bir ajan birkaç adım çalışıp hedefe ulaşamazsa bile ücretli aksiyonlar gerçekleşmiş olabilir. Fakat token ile iş adımı arasındaki fark görünür hâle geliyor: Salesforce müşteriye modelin kaç kelime düşündüğünü değil, yaptığı aksiyonu satıyor.
Intercom bir katman daha yukarı çıkıyor: çözümden “outcome”a
Intercom burada şirketin adı; Fin ise ürünün adı. Intercom yıllardır Fin’i sonuç odaklı fiyatlandırıyordu. Fin 2 duyurusunda temel mantık 0,99 dolar/çözüm olarak anlatılmıştı: Fin sorunu çözerse ücret var, çözemezse yok. [3]
12 Mart 2026’da Intercom bu metriği “resolution”dan daha geniş bir outcome kavramına taşıdığını açıkladı. Gerekçe de önemli: Fin artık her zaman konuşmayı tek başına kapatmıyor; bazı süreçlerde bilgi topluyor, dış sistemlerde işlem yapıyor ve görevin tasarımına göre işi insana devrederek de değer üretebiliyor. Intercom bu yüzden “başarı”yı, Fin’in yapılandırıldığı aksiyonu başarıyla tamamlaması olarak daha geniş tanımlamaya başladı. [3]
Ölçüm problemi
Sonuç fiyatlandırması müşteriye token veya iç aksiyon sayısından daha yakın bir değer ölçüsü sunuyor. Ama yeni soru şu: “Sonuç” tam olarak ne zaman gerçekleşmiş sayılacak? Ölçüm tanımını sağlayıcı ve ürün konfigürasyonu belirliyorsa, sonuç birimi de tamamen nesnel değildir. Fiyatlandırma tartışması böylece yalnız “kaç dolar?” sorusundan “neyi başarı sayıyoruz?” sorusuna geçiyor.
| Fiyatlandırılan şey | Nisan 2026 örneği | Müşteri ne için para ödüyor? |
|---|---|---|
| Kullanıcı / seat | Klasik SaaS | Ürüne erişim |
| Token / kullanım | Model API’leri, Codex pay-as-you-go | Hesaplama tüketimi |
| Kredi / aksiyon | Microsoft Copilot Studio, Salesforce Agentforce | Ajanın yaptığı işlem |
| Outcome | Intercom Fin | Tanımlanmış iş sonucunun gerçekleşmesi |
Aynı anda ters yönde bir hareket var: sabit koltuktan ölçülen kullanıma
Burada fiyatlandırma hikâyesini tek bir “token → aksiyon → sonuç” çizgisine indirgememek gerekiyor. Çünkü aynı ay içinde bazı şirketler tam tersine sabit koltuk ücretinden daha ayrıntılı kullanım ölçümüne geçiyor.
OpenAI 2 Nisan 2026’da ChatGPT Business ve Enterprise çalışma alanları için Codex-only koltuklarını kullandıkça ödeme modeliyle açtı. Bu koltuklarda sabit kullanıcı ücreti yok; kullanım tüketilen token miktarına göre faturalanıyor. OpenAI bunu bütçe, iş akışı ve ekip bazında harcamayı daha görünür kılan bir model olarak anlatıyor. [4]
Anthropic tarafında ise 15 Nisan’da yayımlanan haberler Claude Enterprise’ın yaklaşık 20 dolar kullanıcı tabanı üzerine gerçek kullanımı ekleyen yeni bir yapıya geçtiğini bildirdi. Bu bilgi bu yazıda şirketin kendi birincil duyurusuna değil, The Information’ın haberine ve onu aktaran PYMNTS’e dayanıyor; bu nedenle birincil kaynak kadar kesin ele almıyorum. Yine de yön aynı: sabit koltuk ücretinin bütün hesaplama maliyetini tek başına taşımakta zorlandığı görülüyor. [5]
İki hareket birbiriyle çelişmiyor. Biri maliyet riskini satıcıdan müşteriye daha doğrudan geçiriyor: ne kadar kullanırsan o kadar öde. Diğeri müşterinin algıladığı değere yaklaşmaya çalışıyor: ne kadar iş veya sonuç üretildiyse ona göre öde. Aynı ürün ailesinde bu katmanların birlikte kullanılması da mümkün.
Bu ne anlama gelmiyor?
- Token fiyatlandırmasının ortadan kalktığı anlamına gelmiyor.
- Aksiyon fiyatlandırmasının mutlaka sonuç fiyatlandırmasına dönüşeceği anlamına gelmiyor.
- “Outcome” kelimesinin her zaman şirketin bilançosunda ölçülen ekonomik sonuç anlamına geldiği söylenemez; ürünün tanımladığı başarılı görev de outcome olabilir.
- Sabit aboneliklerin biteceğini de göstermiyor; erişim, yönetim ve kullanım aynı üründe farklı katmanlar olarak ücretlendirilebilir.
Peki model ucuzlarsa aksiyon fiyatı ne kadar dayanabilir?
Burada önceki iki yazıyla bağlantı yeniden önem kazanıyor. Eğer şirket aynı arayüzü, hafızayı ve iş akışını korurken arkadaki modeli değiştirebiliyorsa; ayrıca yeterince iyi açık veya yerel modeller belirli görevleri daha düşük maliyetle yapabiliyorsa, “bir aksiyon = sabit fiyat” modeli de rekabet baskısına girer.
Çünkü sağlayıcı açısından bir aksiyonun maliyeti model seçimine, context uzunluğuna, retry sayısına ve araç çağrılarına göre düşebilir. Müşteri tarafında ise aynı aksiyon aynı görünür. Sağlayıcı daha ucuz modeli arka tarafta kullanarak marjını artırabilir; rakip de aynı işi daha düşük fiyata sunabilir.
Bu yüzden aksiyon fiyatlandırması token sorununu çözmüyor; yalnız fiyatlandırmayı bir katman yukarı taşıyor. Alt katmandaki zekâ ve hesaplama ucuzladıkça o katmanın marjı da zamanla sıkışabilir.
O zaman para nerede kalacak?
Şimdilik dört alan daha dayanıklı görünüyor.
Hesaplama kapasitesi
Model ucuzlasa bile yoğun reasoning, uzun bağlam ve çok adımlı ajan görevleri gerçek işlem maliyeti yaratmaya devam ediyor.
Kurumsal bağlam ve yetki
Ajanın hangi müşteriye, dosyaya, sözleşmeye veya sisteme erişebileceğini güvenli biçimde bilmesi gerekiyor. Kimlik ve izin katmanı modelden bağımsız bir değer.
Yönetilen güvenilirlik
“Model cevap verdi” ile “iş tamamlandı” aynı şey değil. Doğrulama, tekrar deneme, loglama, hata yönetimi ve sorumluluk paylaşımı ayrıca değer yaratıyor.
Ölçülebilir sonuç
Sağlayıcı başarı kriterini güvenilir biçimde ölçebiliyor ve gerçekleşmeme riskinin bir kısmını üstlenebiliyorsa fiyatı ham hesaplamadan daha yukarıdaki bir değere bağlayabilir.
Fakat bu katmanların hiçbiri sonsuza kadar ayrıcalıklı kalmak zorunda değil. Entegrasyon standartlaşabilir, model değiştirme kolaylaşabilir, gözlemleme araçları ucuzlayabilir ve kurumsal bağlam daha taşınabilir hâle gelebilir. Bugün premium olan bir katman yarın sıradan altyapıya dönüşebilir.
Aksiyon fiyatlandırmasının kendi problemi var
Kullanıcı tek bir görev verir; ajan arkada beş veri kaynağına bakar, iki kez plan değiştirir, bir hata nedeniyle tekrar dener ve sonunda kaydı günceller. Bu iç adımların kaç tanesinin “aksiyon” sayılacağı, müşterinin faturasını doğrudan etkiler.
Teknik mimari karmaşıklaştıkça müşterinin şu soruyu sorması normal: Ben işimin yapılmasına mı para ödüyorum, yoksa sağlayıcının ajanı kaç adıma böldüğüne mi?
Bu nedenle aksiyon iyi bir ara birim olabilir ama nihai ekonomik birim olmak zorunda değil. Salesforce’un modeli iş adımını ölçüyor; Intercom’un Mart 2026’daki yön değişimi ise ölçüyü tamamlanan göreve yaklaştırmaya çalışıyor.
Sonuç fiyatlandırmasının da kolay cevabı yok
“Sonuç başına öde” ilk bakışta ideal görünüyor. Sağlayıcı başarısız olursa para kazanamıyor, müşteri de doğrudan değere ödeme yaptığını düşünüyor. Fakat sonuç ölçüsü yükseldikçe atıf problemi büyüyor.
- Bir destek konuşmasının başarıyla kapandığına kim karar veriyor?
- Bir satış fırsatının gerçekten nitelikli olup olmadığını hangi kriter belirliyor?
- Ajan görevin yarısını yaptı, insan tamamladıysa sonuç kime yazılıyor?
- Bir işlem bugün başarılı görünüp iki gün sonra geri alınırsa ilk sonuç hâlâ ücretli mi?
Bu yüzden sonuç fiyatlandırmasının asıl altyapısı yalnız iyi model değil; ölçüm, atıf ve denetlenebilirlik. Fiyatlama yukarı çıktıkça “kaç token harcandı?” sorusu azalıyor, “başarıyı nasıl kanıtlıyoruz?” sorusu büyüyor.
Sonuç: Bir merdiven değil, iki ayrı eksen
Bu tabloyu tek bir “seat → token → aksiyon → sonuç” merdiveni gibi okumak yanlış olur. Piyasada iki ayrı hareket aynı anda yaşanıyor.
Erişim
Sabit seat / abonelik
Tüketim
Token / kredi / kullandıkça öde
İş
Aksiyon
Değer
Outcome / tamamlanan görev
Birinci eksende şirketler hesaplama maliyetini sabit aboneliğin dışına çıkarıp gerçek kullanıma yaklaştırıyor. İkinci eksende ise müşteriye gösterilen birimi teknik tüketimden yapılan işe ve ölçülen değere taşımaya çalışıyor.
Bence önemli kırılma burada. Yapay zekâ şirketlerinin gelecekteki marjını yalnız hangi modelin daha zeki olduğu belirlemeyebilir. Aynı işi kim daha düşük toplam maliyetle, daha güvenilir biçimde ve müşterinin anlayabildiği bir ölçüyle fiyatlandırabiliyor? Asıl rekabet bu soruya kayabilir.
Tokenın sonu gelmiyor. Ama tokenın müşteriye anlatılan tek ekonomik gerçek olduğu dönem zayıflıyor.
Kaynaklar
- Microsoft — Microsoft Copilot Studio Licensing Guide, April 2026. Copilot Credits; yanıt/aksiyon temelli tüketim ve pay-as-you-go fiyatlandırması. Kaynak ↗
- Salesforce — Agentforce Flex Credits; 23 Şubat 2026 rate card ve Agentforce fiyatlandırma açıklaması. Rate card ↗ · Fiyatlandırma ↗
- Intercom — “From resolutions to outcomes: Evolving how Fin delivers value”, 12 Mart 2026; outcome/value-based pricing yaklaşımı. Outcomes ↗ · Pricing AI agents ↗
- OpenAI — “Codex now offers pay-as-you-go pricing for teams”, 2 Nisan 2026. Kaynak ↗
- PYMNTS — “Anthropic Switches to Usage-Based Billing for Enterprise Customers”, 15 Nisan 2026; The Information haberine dayanan ikincil kaynak. Kaynak ↗



