Claude Code'da Maliyet ve Context Yönetimi: Token Optimizasyon Rehberi
Claude Code kullanan herkes er ya da geç aynı soruyla karşılaşır: "Bu oturum bana neye mal oldu, context'imin nesi doldu?" Anthropic'in resmi maliyet dokümantasyonuna göre kurumsal dağıtımlarda geliştirici başına ortalama maliyet günde yaklaşık 13 dolar, aylık 150-250 dolar bandında; kullanıcıların yüzde 90'ında bu rakam günde 30 doların altında kalıyor. Ama bu ortalamalar, tek bir uzun oturumun ya da kontrolsüz bir agent team koşusunun bütçeyi nasıl fena halde aşabileceğini gizliyor. Daha önce CLAUDE.md ve Auto Memory yazısında context'in nasıl dolduğuna, Agent Skills yazısında da skill'lerin nasıl çalıştığına değinmiştim. Bu yazıda konuyu tersinden ele alıyorum: Claude Code'un maliyet ve context tüketimini izlemek için sunduğu komutları (/usage, /cost, /context ve yeni eklenen /skill-doctor) ve bu tüketimi azaltmak için resmi dokümantasyonda önerilen somut teknikleri, kaynağıyla birlikte tek yerde topluyorum.
Claude Code Neden Bu Kadar Token Tüketir?
Claude Code, klasik bir sohbet arayüzünden farklı çalışır: her istekte konuşmanın tamamını API'ye yeniden gönderir, Claude bir araç kullandığında da o aracın sonucunu taşıyan ayrı bir istek daha yapılır. Yani saatlerce açık kalan bir oturumda tek satırlık bir soru bile, o ana kadarki tüm bağlamın işlenmesi için ücretlendirilir. Anthropic'in dokümantasyonu bunu şöyle özetliyor: uzun context, önbellek (cache) kaçırmaları, arka planda çalışan zamanlanmış görevler (/loop), oturumlar arası mesajlaşma, aktif hedeflerin (goal) arka planda kontrol edilmesi, agent team'deki her aktif takım arkadaşı ve /compact ile yapılan sıkıştırmanın kendisi — bunların hepsi context boyutunu ve dolayısıyla token maliyetini büyütüyor. İyi haber şu ki Claude Code bu tüketimin büyük bölümünü otomatik olarak optimize ediyor: tekrar eden sistem promptu ve araç tanımları gibi içerikler prompt caching ile ucuzlatılıyor, context limite yaklaşınca da otomatik sıkıştırma (auto-compaction) devreye giriyor. Ama otomatik optimizasyon her şeyi çözmüyor; geri kalanı, aşağıdaki komutları düzenli kullanma alışkanlığına kalıyor.
/usage Komutu: Oturumunuzun Faturasını Görün
Oturum içinde /usage yazdığınızda ekranın üst kısmında bir "Session" bloğu açılır. Bu blok, o oturumdaki token tüketimini model bazında ve dolar cinsinden gösterir:
Total cost: $0.55
Total duration (API): 6m 20s
Total duration (wall): 6h 33m 10s
Total code changes: 0 lines added, 0 lines removed
Usage by model:
claude-sonnet-4-6: 1.2k input, 5.3k output, 940.0k cache read, 50.0k cache write ($0.55)
Birkaç önemli ayrıntı var:
- Bu rakam bir tahmindir, fatura değildir. Claude Code, token sayılarından liste fiyatı üzerinden yerel olarak hesap yapar; organizasyonunuzun kendi anlaşmalı fiyatları varsa yönetici
modelPricingayarını yapılandırabilir, bu durumda satırın yanında "at your organization's configured rates" notu görünür. Kesin faturalama için Claude Console'daki Usage sayfası referans alınmalıdır. - Pro/Max abonelerinde bu rakam faturaya yansımaz. Kullanım aboneliğe dahildir; Session bloğundaki dolar rakamı yalnızca API/Console kullanıcıları için anlamlıdır. Abonelerde ayrıca plan kullanım çubukları ve aktivite istatistikleri de aynı ekranda görünür.
- Toplamlar
/clearile sıfırlanır. Yeni bir konuşma başlattığınızda sayaç yeniden $0'dan başlar.
Prompt Cache İstatistikleri
Konuşmadaki ilk API yanıtından sonra Session bloğuna bir "Prompt cache (main)" satırı daha eklenir:
Prompt cache (main): 14 requests · 91% of input tokens from cache · 2 misses
(last 6m 10s ago, 310.2k tokens re-cached) · 1 expected rebuild
(compaction or tool-result clearing) · warm (1h TTL, last activity 40s ago)
Bu satırdaki her parça bir teşhis niteliğinde:
- Miss (kaçırma): Claude Code, bir isteğin önbellekten okunabilecek içeriğin yüzde 5'inden fazlasını ve en az 2.000 token'ını yeniden işlediği durumları miss sayar. Mümkün olduğunda son miss'in olası nedenini de yazar, örneğin "likely cause: tool definitions changed".
- Expected rebuild (beklenen yeniden inşa): Claude Code'un kendisinin
/compactile ya da eski tool sonuçlarını temizleyerek konuşmayı yeniden yazdığı durumlar; bu bir hata değil, beklenen bir maliyettir. - Warm/cold: Önbelleğin hâlâ geçerli ömrü (TTL) içinde olup olmadığı. Abonelikte önbellek ömrü bir saat, API anahtarında veya kullanım kredisi harcanırken varsayılan beş dakikadır.
Plan Kullanım Dökümü
Pro, Max, Team veya Enterprise planında /usage ayrıca son 24 saat veya son 7 gün için (d/w tuşlarıyla geçiş) bir kullanım dökümü gösterir:
| Bölüm | Ne gösterir |
|---|---|
| Attribution (atıf) | Son kullanımın yüzde kaçının skill'lere, subagent'lara, plugin'lere ve tek tek MCP sunucularına ait olduğu. Bir MCP sunucusunun payı yalnızca onun bir araç sonucunu tüketen istekleri sayar. |
| Behavior flags (davranış bayrakları) | Uzun context veya cache miss gibi davranışlar, son kullanımın yüzde 10'u veya daha fazlasını oluşturduğunda burada işaretlenir. |
| Loops | Son çalışan en ağır /loop ya da diğer zamanlanmış görevler; her biri için kaç kez tetiklendiği, toplam ve koşu başına token'ı, en son ne zaman çalıştığı listelenir. |
| Usage-credits satırı | Kullanım kredileri açıksa, o ayki harcamanızı (varsa aylık harcama limitinize göre) gösterir. |
Bu döküm, "kotam neden bu kadar hızlı tükeniyor" sorusunun cevabını verir: belki tek bir MCP sunucusu kullanımın yarısını yiyor, belki bir /loop görevi arka planda sessizce token yakıyor.
/cost: /usage'ın Kısayolu
Resmi komut listesinde /cost, /usage komutunun bir takma adı (alias) olarak tanımlanır — ikisi de birebir aynı ekranı açar. Alışkanlık meselesi dışında aralarında fark yoktur; bazı kullanıcılar "maliyet" kelimesiyle daha kolay hatırladığı için /cost yazmayı tercih eder.
/context: Bağlamınız Nereye Gidiyor?
Token maliyeti kadar önemli olan bir başka sınır, context penceresinin kendisidir — dolar harcamasanız bile context dolduğunda Claude Code otomatik sıkıştırmaya (auto-compact) geçer ve bu da ayrı bir maliyet kalemidir. /context komutu, o anki context kullanımını renkli bir ızgara (grid) olarak görselleştirir; hangi bileşenin (sistem promptu, araç tanımları, MCP araçları, skill listesi, konuşma geçmişi) ne kadar yer kapladığını tek bakışta gösterir. MCP sunucularının context'e etkisini merak ediyorsanız /mcp komutuyla bağlı sunucuları görüp kullanmadıklarınızı kapatabilirsiniz; MCP araç tanımları varsayılan olarak "deferred" (ertelenmiş) yüklenir, yani Claude o aracı gerçekten kullanana kadar yalnızca araç adı ve sunucu talimatları context'e girer.
/skill-doctor: Yeni Bir Teşhis Komutu
Claude Code v2.1.252 ile gelen /skill-doctor, bu yazının odaklandığı en yeni komut. Amacı net: oturumunuzdaki skill'lerin context maliyetini ve kullanım sıklığını raporlamak, hiç çağrılmamış skill'leri işaretlemek.
Ne Gösteriyor?
- Her skill'in context maliyeti — kaç token tükettiği.
- Kullanım sıklığı — skill'in oturum boyunca kaç kez çağrıldığı.
- Hiç kullanılmamış skill'ler — oturumda bir kez bile invoke edilmemiş skill'ler ayrıca işaretlenir.
- Son zamanlarda kullanılmamış plugin'ler.
Kapsam kişisel skill'ler, proje skill'leri ve plugin skill'lerini içerir; paketlenmiş (bundled) ve kurumsal skill'ler rapora dahil edilmez.
Nasıl Çalıştırılır?
İnteraktif oturumda:
/skill-doctor
Rapor, /plugin yöneticisinin Stats sekmesinde açılır. Non-interactive (-p bayraklı) modda ise rapor düz metin olarak yazdırılır:
claude -p "list skill costs"
Remote Control üzerinden (telefon veya tarayıcıdan bağlanarak) çalıştırıldığında Claude Code "Skill usage reports are not available on this connection." yanıtını verir; bu durumda komutu, oturumun fiilen çalıştığı makinenin terminalinde çalıştırmak gerekir.
Skill'ler Context'i Nasıl Tüketir?
/skill-doctor'ın var olma nedenini anlamak için skill'lerin context yaşam döngüsünü bilmek gerekir. CLAUDE.md'nin aksine bir skill'in gövdesi yalnızca çağrıldığında context'e girer; uzun referans materyali, siz onu kullanana kadar neredeyse hiçbir şeye mal olmaz. Ama skill'lerin isim ve açıklamalarından oluşan bir listeleme, Claude'un neyin mevcut olduğunu bilmesi için her oturumda context'e enjekte edilir. Bu listelemenin bir bütçesi vardır:
- Varsayılan bütçe: modelin context penceresinin yüzde 1'i.
- Bütçe taşması: Çok sayıda skill'iniz varsa Claude Code açıklamaları kısaltır; listeleme taştığında en az çağrılan skill'lerin açıklamaları önce düşürülür, en çok kullandıklarınız tam metnini korur.
Context yükünü azaltmak için üç somut mekanizma var:
- Kullanılmayan skill'i kapatma:
settings.json'daskillOverridesaltına"skill-adi": "off"yazmak. - Otomatik çağrılmayı engelleme: Skill'in kendi frontmatter'ına
disable-model-invocation: trueeklemek — skill listede görünmez, yalnızca elle çağrılabilir hale gelir. - Açıklamayı kısaltma veya bütçeyi değiştirme: Açıklamada önemli kullanım senaryolarını başa yazmak (birleşik limit: girdi başına 1.536 karakter), düşük öncelikli skill'leri
skillOverridesiçinde"name-only"yapmak, ya dasettings.json'daskillListingBudgetFractiondeğerini artırmak ya daSLASH_COMMAND_TOOL_CHAR_BUDGETortam değişkenini ayarlamak.
İlgili komutlar: /doctor genel kurulum sağlığını kontrol eder (bundled skill'ler kapalı olsa bile çalışır), /context "Skills" satırıyla listeleme boyutunu gösterir, /skills ise Space ile görünürlüğü açıp kapatabildiğiniz interaktif bir menü sunar ve seçimleri .claude/settings.local.json'a kaydeder.
Token Kullanımını Azaltmanın Yolları
Anthropic'in maliyet dokümantasyonu, context'i küçük tutmak için aşağıdaki stratejileri öneriyor. Hepsi doğrulanmış, üretimde kullanılan tekniklerdir.
1. Context'i Proaktif Yönetin
İlgisiz bir işe geçerken /clear kullanın — eski context her sonraki mesajda token israf eder. Oturumu daha sonra bulmak için önce /rename yapıp sonra temizleyin, geri dönmek isterseniz /resume kullanın. Sıkıştırmaya ne saklanacağını da söyleyebilirsiniz:
/compact Focus on code samples and API usage
CLAUDE.md dosyanıza da sıkıştırma talimatı ekleyebilirsiniz:
# Compact instructions
When you are using compact, please focus on test output and code changes
2. Doğru Modeli Seçin
Sonnet çoğu kodlama görevini iyi karşılar ve Opus'tan daha ucuzdur; Opus'u karmaşık mimari kararlar veya çok adımlı akıl yürütme için saklayın. /model ile oturum içinde model değiştirebilir, /config ile varsayılanı ayarlayabilirsiniz. Basit subagent görevlerinde subagent tanımına model: haiku yazmak yeterlidir.
3. MCP Sunucu Yükünü Azaltın
MCP araç tanımları varsayılan olarak ertelenir, yani Claude belirli bir aracı kullanana kadar context'e yalnızca araç adları ve sunucu talimatları girer. Yine de gh, aws, gcloud, sentry-cli gibi CLI araçları, hiçbir per-tool listeleme eklemedikleri için MCP sunucularından daha context-verimlidir — Claude bu komutları doğrudan çalıştırabilir. Kullanılmayan sunucuları /mcp ile kapatın.
4. Hooks ve Skill'lere Devredin
Özel hook'lar, Claude görmeden önce veriyi ön işleyebilir. Örneğin 10.000 satırlık bir log dosyasını Claude'un okumasına gerek kalmadan, bir hook ERROR içeren satırları grep'leyip yalnızca onları döndürebilir — bu, context'i on binlerce token'dan yüzlere indirir. Aşağıdaki PreToolUse hook'u, test çıktısını yalnızca hatalarla filtreler:
{
"hooks": {
"PreToolUse": [
{
"matcher": "Bash",
"hooks": [
{
"type": "command",
"command": "~/.claude/hooks/filter-test-output.sh"
}
]
}
]
}
}
#!/bin/bash
input=$(cat)
cmd=$(echo "$input" | jq -r '.tool_input.command')
if [[ "$cmd" =~ ^(npm test|pytest|go test) ]]; then
filtered_cmd="$cmd 2>&1 | grep -A 5 -E '(FAIL|ERROR|error:)' | head -100"
echo "$input" | jq --arg filtered "$filtered_cmd" \
'{hookSpecificOutput: {hookEventName: "PreToolUse", permissionDecision: "allow", updatedInput: (.tool_input + {command: $filtered})}}'
else
echo "{}"
fi
Kurulumu doğrulamak için /hooks ile hook'un PreToolUse altında göründüğünü kontrol edebilirsiniz.
5. CLAUDE.md'den Skill'lere Taşıyın
CLAUDE.md dosyanız oturum başında context'e yüklenir. İçinde PR inceleme veya veritabanı migrasyonu gibi yalnızca belirli iş akışlarına özgü ayrıntılı talimatlar varsa, bu token'lar ilgisiz bir işte bile orada durur. Skill'ler talep üzerine (on-demand) yüklendiği için, özel talimatları skill'e taşımak temel context'i küçük tutar. Hedef: CLAUDE.md'yi yalnızca gerçekten temel olanı içerecek şekilde 200 satırın altında tutmak.
6. Extended Thinking Ayarını Düzenleyin
Extended thinking varsayılan olarak açıktır çünkü karmaşık planlama ve akıl yürütme görevlerinde performansı ciddi ölçüde artırır. Thinking token'ları output token olarak faturalandırılır ve varsayılan bütçe modele göre on binlerce token olabilir. Derin akıl yürütme gerektirmeyen basit görevlerde /effort ile effort seviyesini düşürebilir, /config'ten thinking'i kapatabilir, ya da sabit thinking bütçesi olan modellerde MAX_THINKING_TOKENS ortam değişkenini (örn. MAX_THINKING_TOKENS=8000) düşürebilirsiniz. Adaptif akıl yürütme yapan modeller sıfırdan farklı bütçeleri yok sayar, bu yüzden onlarda effort seviyesi kullanılmalıdır. Fable modellerinde thinking her zaman açıktır, kapatılamaz.
7. Ayrıntılı İşleri Subagent'lara Devredin
Testleri çalıştırmak, dokümantasyon çekmek veya log dosyalarını işlemek önemli miktarda context tüketebilir. Bunları subagent'lara devredin: ayrıntılı çıktı subagent'ın kendi context'inde kalır, ana konuşmaya yalnızca bir özet döner.
8. Agent Team Maliyetlerini Yönetin
Agent teams, her biri kendi context penceresine sahip birden fazla Claude Code örneği başlatır; token kullanımı aktif takım arkadaşı sayısıyla ve her birinin ne kadar çalıştığıyla orantılıdır. Takım arkadaşları plan modunda çalışırken standart oturumlara göre yaklaşık 7 kat daha fazla token tüketilir. Maliyeti makul tutmak için:
- Takım arkadaşlarında Sonnet kullanın — koordinasyon görevleri için kapasite/maliyet dengesini korur.
- Takımları küçük tutun; her takım arkadaşı kendi context penceresini çalıştırdığı için tüketim takım büyüklüğüyle orantılıdır.
- Spawn prompt'larını odaklı yazın — takım arkadaşları CLAUDE.md, MCP sunucuları ve skill'leri otomatik yükler, spawn prompt'una eklediğiniz her şey baştan itibaren context'e eklenir.
- İşi biten takım arkadaşlarını kapatın; her aktif takım arkadaşı çıkana veya oturum bitene kadar token tüketmeye devam eder.
Agent teams varsayılan olarak kapalıdır; settings.json'da veya ortamda CLAUDE_CODE_EXPERIMENTAL_AGENT_TEAMS=1 ile açılır.
9. Net Promptlar Yazın, Erken Düzeltin
"Kod tabanını iyileştir" gibi belirsiz istekler geniş taramayı tetikler; "auth.ts'deki login fonksiyonuna girdi doğrulaması ekle" gibi spesifik istekler Claude'un az dosya okuyarak verimli çalışmasını sağlar. Karmaşık işlerde Shift+Tab ile plan moduna geçip Claude'un yaklaşımını onaylamadan önce görün — ilk yönün yanlış olması durumunda pahalı yeniden çalışmayı önler. Claude yanlış yöne gidiyorsa Esc ile hemen durdurun; /rewind veya çift Esc ile konuşmayı ve kodu önceki bir checkpoint'e geri alın. Test senaryoları verin, ekran görüntüsü yapıştırın veya beklenen çıktıyı tanımlayın — Claude kendi işini doğrulayabildiğinde, siz düzeltme istemeden önce sorunları kendisi yakalar.
Uzun Oturumlarda Kullanım Neden Hızla Artar?
Saatlerce açık kalan bir oturum, aktivitenizin ima ettiğinden çok daha fazla plan kotası tüketebilir. Resmi dokümantasyona göre başlıca nedenler şunlar:
| Neden | Açıklama |
|---|---|
| Uzun context | Claude Code her istekte konuşmanın tamamını gönderir; prompt caching ile bu geçmiş önbellek fiyatından okunur, ama önbellek fiyatı bile sıfır değildir. |
| Cache miss | Önbellek ömrünü (bir saat/beş dakika) aşan bir aradan sonraki ilk mesaj, tüm context'i tam fiyattan yeniden işler. |
| Zamanlanmış görevler | Bir /loop görevi, oturum boşta olsa bile kendi aralığında tetiklenip her seferinde tüm context'i gönderir. |
| Oturumlar arası mesajlaşma | Başka bir oturumdan gelen mesaj, bu oturum boştayken yeni bir tur olarak teslim edilir ve tüm context'i tekrar gönderir. |
| Goal check-in'leri | Arka planda çalışan bir hedef beklerken Claude Code, promptlar arası en fazla üç kez olmak üzere oturum boştayken bile durumu kontrol eder. |
| Agent takım arkadaşları | Her aktif takım arkadaşı, çıkana veya oturum bitene kadar token tüketmeye devam eder. |
| Sıkıştırma (compaction) | /compact, özetlediği konuşmayı okur; büyük bir context'i sıkıştırmak başlı başına büyük bir istektir. Sürekliliğe ihtiyacınız yoksa /clear hiçbir şeye mal olmaz. |
Pro, Max, Team veya Enterprise planında /usage dökümü, son kullanımın yüzde 10'u veya fazlasını oluşturan davranışları (uzun context, cache miss gibi) otomatik olarak işaretler ve her biri için bir azaltma önerisi sunar.
Takımlar ve Organizasyonlar İçin Kısa Not
Bireysel bir Pro/Max kullanıcısıysanız yönetecek bir organizasyonunuz yok; yukarıdaki alışkanlıklar yeterli. Ama bir ekibi yönetiyorsanız kontrol noktaları kurulumunuza göre değişir: Claude for Teams/Enterprise'da kullanım, beş saatlik ve haftalık pencerede sıfırlanan koltuk bazlı bir tahsisten düşer ve harcama limitleri admin ayarlarından belirlenir; Claude Console (API) kullanıcıları workspace harcama limitleri koyabilir; Amazon Bedrock, Google Cloud'un Agent Platform'u veya Microsoft Foundry üzerinden gidenlerde ise fatura tamamen bulut sağlayıcının konsolunda görünür ve Anthropic'in analiz panelleri bu kullanımı kapsamaz. Her kurulumda OpenTelemetry ile metrik dışa aktarımı çalışır ve kullanıcı bazlı token/maliyet verisini kendi gözlemlenebilirlik altyapınıza akıtmanın tek yoludur.
Örnek Workflow: Haftalık Maliyet Denetimi
Aşağıdaki adımlar, bir projede haftada bir kez uygulanabilecek somut bir denetim akışıdır:
/usage(veya/cost) çalıştırın ve w ile son 7 günü açın. Attribution dökümünde beklenmedik şekilde büyük bir pay tutan bir skill, subagent, plugin veya MCP sunucusu var mı bakın.- Behavior flags'i kontrol edin. "Long context" veya "cache misses" yüzde 10'u geçmişse, hangi görevlerin oturumu uzun açık tuttuğunu gözden geçirin; ilgisiz işler arasında
/clearalışkanlığını hatırlayın. - Loops satırlarını inceleyin. Bir
/loopgörevi beklenenden sık tetikleniyorsa aralığını gözden geçirin veya görevi durdurun. /skill-doctorçalıştırın (terminalde, Remote Control üzerinden değil). Hiç kullanılmamış skill'leriskillOverridesile"off"yapın veyadisable-model-invocation: trueekleyin./contextile listelemeyi görün. Skill listesi veya MCP araç tanımları context'in orantısız bir kısmını kaplıyorsa, adım 4'ü tekrarlayın ve/mcp'den kullanılmayan sunucuları kapatın.- CLAUDE.md'nizi ölçün. 200 satırı aşıyorsa, yalnızca belirli iş akışlarında gereken bölümleri ayrı skill'lere taşımayı değerlendirin.
- Model ve effort ayarlarını gözden geçirin. Rutin, düşük riskli görevlerde varsayılan olarak Opus mu kullanılıyor? Gerekmiyorsa
/modelile Sonnet'e, subagent'lardamodel: haiku'ya geçin.
Bu döngüyü haftalık uygulamak, hem Pro/Max kotasının erken tükenmesini hem de API/Console faturasının sürpriz yapmasını büyük ölçüde önler.
Sıkça Sorulan Sorular
Claude Code'da /cost ve /usage arasındaki fark nedir?
Fark yok — /cost, /usage komutunun bir takma adıdır. İkisi de aynı ekranı, aynı Session bloğunu ve aynı plan kullanım dökümünü açar.
/skill-doctor komutu hangi Claude Code sürümünde kullanılabilir?
v2.1.252 ve sonrasında. Kişisel, proje ve plugin skill'lerini kapsar; bundled ve kurumsal skill'ler rapora dahil edilmez. Remote Control üzerinden çalıştırıldığında rapor üretmez, terminalde çalıştırılması gerekir.
Prompt cache neden "miss" oluyor?
Bir istek, önbellekten okunabilecek içeriğin yüzde 5'inden fazlasını ve en az 2.000 token'ını yeniden işlediğinde miss sayılır. En sık neden, önbellek ömrünü (abonelikte bir saat, API'de veya kullanım kredisiyle beş dakika) aşan bir moladır; araç tanımlarının değişmesi gibi durumlar da önbelleği geçersiz kılabilir.
CLAUDE.md dosyamı skill'e mi taşımalıyım?
CLAUDE.md tamamen oturum başında yüklenir ve orada kalır; skill'lerin gövdesi yalnızca çağrıldığında yüklenir. Yalnızca belirli iş akışlarında (PR inceleme, migrasyon vb.) gereken uzun talimatları skill'e taşımak ve CLAUDE.md'yi 200 satırın altında tutmak, temel context'i küçültür.
Agent teams neden bu kadar pahalı?
Her takım arkadaşı kendi context penceresine sahip ayrı bir Claude Code örneğidir; plan modunda çalışan takım arkadaşları standart bir oturuma göre yaklaşık 7 kat daha fazla token tüketir. Sonnet kullanmak, takımları küçük tutmak ve işi biten takım arkadaşlarını kapatmak maliyeti sınırlar.
Pro/Max aboneliğinde token maliyetini neden takip edeyim?
Kullanım faturaya değil beş saatlik ve haftalık kotalara dayanır, ama /usage'daki attribution ve behavior flags dökümü hangi skill, subagent, MCP sunucusu veya arka plan görevinin kotanızı hızla tükettiğini gösterir — bu, haftalık limitin erken dolmasını önlemenin en pratik yoludur.
Özet
Claude Code'da maliyet ve context yönetimi, tek bir sihirli ayardan değil, birkaç komutu düzenli çalıştırma alışkanlığından ibaret: /usage (veya kısayolu /cost) oturumunuzun faturasını ve prompt cache sağlığını gösterir; /context context penceresinin nereye gittiğini renkli bir ızgarada özetler; yeni /skill-doctor ise hangi skill'in gerçekten kullanıldığını, hangisinin sessizce context yediğini ortaya çıkarır. Bunların üzerine model seçimini görevle eşleştirmek, MCP ve CLAUDE.md yükünü azaltmak, ayrıntılı işleri hook/skill/subagent'lara devretmek ve agent team'leri küçük tutmak, hem Pro/Max kotasının hem de API faturasının kontrol altında kalmasını sağlar. Skill'lerin ve subagent'ların altyapısını daha derinden öğrenmek isterseniz Agent Skills ve Slash Komutları yazısına, context'in CLAUDE.md ile nasıl doldurulduğunu görmek isterseniz CLAUDE.md ve Auto Memory yazısına göz atabilirsiniz.
Bu yazı Ahmet Bilgiç tarafından ahmetbilgic.com için yazılmıştır. Diğer yazılar için: medium.com/@ahmet_bilgic07