Aynı Claude Code aboneliğiyle limitini boşa yakmadan çok daha fazla iş çıkarmak için, Anthropic'in kendi dokümanından sade Türkçeyle toplanmış token tasarrufu ayarları ve pro caching taktikleri.
Önce tek cümlede: token nedir? Claude'a her yazdığında, o ana kadarki bütün sohbeti baştan okur. İşte harcanan şey bu. Yani sohbet ne kadar küçükse, o kadar az token harcanır ve limitin o kadar uzun gider.
Abonelikte (Pro/Max) bu cebinden para çıkması değil, kullanım limitinden yemek demek. Az token = işler hızlı akar, limit erken bitmez. Aşağıdaki 6 ayarın tek amacı: sohbeti gereksiz şişirme.
Token'ı boşa harcamayı bitiren altı temel ayar. Her biri tek bakışta: ne yapacaksın, neden, hangi komut.
Çoğu işte Sonnet, basit ufak işlere Haiku, Opus'u sadece gerçekten zor işe. Ve modeli iş ortasında değiştirme.
Her modelin ayrı hafızası (cache) var. İş ortasında model değiştirince Claude bütün sohbeti baştan okur. Hatta uzun bir oturumda ucuz modele geçmek bile çoğu zaman daha pahalıya gelir (Anthropic'in kendi blogu).
ile baştan seç · varsayılan
Claude'a bağladığın dış araçlardan (MCP = GitHub, Slack gibi eklentiler) o an kullanmadığını kapat.
Her bağlı araç, sen hiç kullanmasan bile sohbette yer kaplar. Boşuna yük taşımış olursun.
neyin yer kapladığını gösterir · ile kapat
Proje hafıza dosyanı (CLAUDE.md) 200 satırın altında tut. Uzun, özel talimatları skill'lere taşı.
Bu dosya her açılışta tamamen yüklenir. Şişerse, alakasız bir işte bile her seferinde token yakar.
Sayfalarca çıktı üreten işleri bir alt-ajana (ayrı bir yardımcı) yaptır. Mesela: testleri çalıştırmak, koca bir hata kaydını (log) okumak, yüzlerce dosyada aramak.
Bu işlerin çıktısı sayfalarca sürer ve sohbetini şişirir. Alt-ajan o uzun çıktıyı kendi penceresinde okur; sana sadece kısa özet döner, ana sohbetin küçük kalır.
"Bunu bir alt-ajana yaptır, sadece özetini ver" de.
Kolay işlerde Claude'un derin düşünmesini azalt. Çaba seviyesini düşür.
Claude varsayılan olarak uzun uzun düşünür ve bu düşünme de token olarak yazılır. Basit işe bu kadar düşünme gerekmez.
ile seviyeyi düşür (basit iş için "low").
Dosya ve fonksiyon adı vererek iste. "Şu projeyi iyileştir" gibi belirsiz şeyler deme.
Belirsiz istek tüm kodu taratır = dağ kadar token. Net istek, sadece gerekeni okutur.
✗ "Şu projeyi iyileştir." ✓ "auth.ts'deki login fonksiyonuna kontrol ekle."
Videoya sığmayan, ama limitini gerçekten uzatan ekstra tüyolar. Hepsi resmi dokümandan.
Yeni, alakasız bir işe eski sohbetle devam etme. Eski sohbet her mesajda boşuna token yakar.
Tek bir uzun işte sohbet doldukça özetletip küçült. Neye odaklanacağını da söyle.
Claude'un kısa süreli hafızası (cache) bir süre sonra kaybolur. Uzun bir ara verip geri dönersen dönüşte her şeyi baştan okur; uzun molada yeni oturuma geç.
Modeli değiştirince Claude bütün sohbeti baştan okur. "Planda Opus, kodda Sonnet" ayarı da aynı sebepten token yakar.
Claude önce planı sunar; yanlış yöne gidip her şeyi baştan yazma maliyetini önlersin.
10.000 satırlık log'u olduğu gibi verme. Bir hook ile sadece hata satırlarını süzdür (binlerce token → birkaç yüz).
Ne kadar kullandığını ve ne durumda olduğunu kontrol et. Ezberleme, ölç.
Uzayınca yeni sohbet aç, işleri tek mesajda topla, çok dokümanı her sohbete yapıştırmak yerine Projects'e koy.
Asıl fark buradan gelir: caching'in derin mekaniği. Çoğu Anthropic'in resmi dokümanından; bir kısmı toplulukta doğrulanan pratik gözlem.
Herkes "kolaylaşınca ucuz modele geç" der. Ama uzun bir oturumun ortasında ucuz modele (ör. Opus'tan Haiku'ya) geçmek, pahalı modele sordurmaktan daha pahalıya gelebilir. Çünkü her modelin ayrı cache'i var; değişince Claude bütün sohbeti baştan okur. Anthropic'in kendi örneği: 100 bin token Opus oturumunda kolay bir soru için Haiku'ya geçmek, Opus'a sordurmaktan pahalı.
→ Pro: Modeli ve effort'u oturumun başında seç, sonra dokunma.
Claude'un hafızası çalıştığın klasöre, makineye ve git durumuna bağlı. ile alt klasöre inmek, açmak veya branch / commit değiştirmek cache'i bozar → Claude baştan okur. Tersi süper: aynı klasörde açtığın 2 Claude penceresi cache'i paylaşır (biri ötekinin işini hızlandırır).
→ Pro: Bir iş boyunca aynı klasörde kal; paralel işleri ayrı worktree değil, aynı klasörde yürüt.
geçmişi özetler ama cache'i baştan kurar. (çift Esc) ise seni zaten hazır olan eski bir noktaya geri götürür → daha ucuz ve daha hızlı.
→ Pro: Kötü giden bir denemeyi atmak için /compact yerine /rewind.
Günler önceki uzun bir oturumu ile geri açmak, özellikle bu arada Claude Code güncellendiyse, dönüşte her şeyi baştan okutur. Gönderdiğin en pahalı tek istek bu olabilir.
→ Pro: Eski uzun oturumu diriltme; kısa bir özet çıkar, yeni oturuma yapıştır.
sohbetin özetini ekler, cache'i bozmaz. ise geçmişi siler ve cache'i resetler. "Nerede kaldık" demek için compact'a gerek yok.
→ Pro: Hatırlatma için /recap; gerçekten küçültmek gerekince /compact.
Aklında kalmasın, buraya geri dön. Çipe tıkla → kopyalanır.
| Komut | Ne işe yarar |
|---|---|
| Modeli değiştir (çoğu iş Sonnet; ⚠️ oturum ortasında oynatma token yakar) | |
| Sohbette neyin yer kapladığını gösterir | |
| Bağlı dış araçları yönet, kullanmadığını kapat | |
| Düşünme çabasını ayarla (basit işte düşür) | |
| Sohbeti tamamen sıfırla (proje hafızası kalır) | |
| Sohbeti özetleyip küçült | |
| Kullanım ve limit durumu | |
| Varsayılan model ve ayarlar |
Token = Claude her mesajda o ana kadarki tüm sohbeti baştan okur; sohbet küçükse limit uzar.
Doğru modeli baştan seç (çoğu iş Sonnet, basit iş Haiku, zor iş Opus) ve oturum ortasında değiştirme.
Kullanmadığın MCP araçlarını /mcp ile kapat; /context ile neyin yer kapladığını gör.
CLAUDE.md'yi 200 satır altında tut, uzun talimatları skill'lere taşı.
Uzun çıktılı işleri (test, log okuma, geniş arama) alt-ajana yaptır, sadece özet al.
Basit işte /effort ile düşünmeyi kıs; isteklerini dosya/fonksiyon adı vererek net yaz.
İş bitince /clear, uzun iş şişince /compact, yanlış yola saptıysan /rewind kullan.
Ucuz modele geçmek uzun oturumda pahalı olabilir; cache klasör + git durumuna yapışıktır.
Sadece hatırlatma için /recap (cache'i bozmaz), gerçekten küçültmek için /compact.
Komutları ezberleme, /usage ve /context ile kendi durumunu ölç.
Kaynaklar: code.claude.com/docs (costs · prompt-caching · best-practices · memory · commands · sub-agents) · platform.claude.com · resmi Anthropic dokümanıyla doğrulandı (2026-06-25). Komutlar ve sayılar zamanla değişebilir; ezberleme, /usage ve /context ile kendi durumunu ölç.