Doğan Mert ZENFELT.
Rehberler İçerik Hakkımda İş için
Bana yaz
Rehberler Verimlilik

Az Token Harcama Rehberi

Aynı Claude Code aboneliğiyle limitini boşa yakmadan çok daha fazla iş çıkarmak için, Anthropic'in kendi dokümanından sade Türkçeyle toplanmış token tasarrufu ayarları ve pro caching taktikleri.

Ücretsiz · tamamı bu sayfada, indirmeye gerek yok
6 ana ayar Bonus tüyolar Pro caching Uydurma yok

Önce tek cümlede: token nedir? Claude'a her yazdığında, o ana kadarki bütün sohbeti baştan okur. İşte harcanan şey bu. Yani sohbet ne kadar küçükse, o kadar az token harcanır ve limitin o kadar uzun gider.

Abonelikte (Pro/Max) bu cebinden para çıkması değil, kullanım limitinden yemek demek. Az token = işler hızlı akar, limit erken bitmez. Aşağıdaki 6 ayarın tek amacı: sohbeti gereksiz şişirme.

Günlük 6 ayar

Token'ı boşa harcamayı bitiren altı temel ayar. Her biri tek bakışta: ne yapacaksın, neden, hangi komut.

01

Doğru modeli baştan seç

Ne yap

Çoğu işte Sonnet, basit ufak işlere Haiku, Opus'u sadece gerçekten zor işe. Ve modeli iş ortasında değiştirme.

Neden

Her modelin ayrı hafızası (cache) var. İş ortasında model değiştirince Claude bütün sohbeti baştan okur. Hatta uzun bir oturumda ucuz modele geçmek bile çoğu zaman daha pahalıya gelir (Anthropic'in kendi blogu).

Komut

ile baştan seç · varsayılan

Herkes "kolaylaşınca ucuz modele geç" der; oysa tam da bu cache'i bozar. Baştan seç, sonra dokunma.
02

Kullanmadığın araçları kapat

Ne yap

Claude'a bağladığın dış araçlardan (MCP = GitHub, Slack gibi eklentiler) o an kullanmadığını kapat.

Neden

Her bağlı araç, sen hiç kullanmasan bile sohbette yer kaplar. Boşuna yük taşımış olursun.

Komut

neyin yer kapladığını gösterir · ile kapat

İşini gören bir komut satırı aracı (gh, aws) varsa onu tercih et: daha ucuz.
03

Hafıza dosyanı kısa tut

Ne yap

Proje hafıza dosyanı (CLAUDE.md) 200 satırın altında tut. Uzun, özel talimatları skill'lere taşı.

Neden

Bu dosya her açılışta tamamen yüklenir. Şişerse, alakasız bir işte bile her seferinde token yakar.

Dosya

Skill = sadece çağrıldığında yüklenir → taban hafıza küçük kalır.
04

Çıktısı uzun işi yardımcıya yaptır

Ne yap

Sayfalarca çıktı üreten işleri bir alt-ajana (ayrı bir yardımcı) yaptır. Mesela: testleri çalıştırmak, koca bir hata kaydını (log) okumak, yüzlerce dosyada aramak.

Neden

Bu işlerin çıktısı sayfalarca sürer ve sohbetini şişirir. Alt-ajan o uzun çıktıyı kendi penceresinde okur; sana sadece kısa özet döner, ana sohbetin küçük kalır.

Nasıl

"Bunu bir alt-ajana yaptır, sadece özetini ver" de.

05

Basit işte düşünmeyi kıs

Ne yap

Kolay işlerde Claude'un derin düşünmesini azalt. Çaba seviyesini düşür.

Neden

Claude varsayılan olarak uzun uzun düşünür ve bu düşünme de token olarak yazılır. Basit işe bu kadar düşünme gerekmez.

Komut

ile seviyeyi düşür (basit iş için "low").

06

Ne istediğini net söyle

Ne yap

Dosya ve fonksiyon adı vererek iste. "Şu projeyi iyileştir" gibi belirsiz şeyler deme.

Neden

Belirsiz istek tüm kodu taratır = dağ kadar token. Net istek, sadece gerekeni okutur.

Örnek

✗ "Şu projeyi iyileştir."   ✓ "auth.ts'deki login fonksiyonuna kontrol ekle."

Reel'de anlatmadıklarım

Videoya sığmayan, ama limitini gerçekten uzatan ekstra tüyolar. Hepsi resmi dokümandan.

İş bitince temizle

Yeni, alakasız bir işe eski sohbetle devam etme. Eski sohbet her mesajda boşuna token yakar.

Uzun iş şişerse özetle

Tek bir uzun işte sohbet doldukça özetletip küçült. Neye odaklanacağını da söyle.

Uzun ara vereceksen yeni oturum

Claude'un kısa süreli hafızası (cache) bir süre sonra kaybolur. Uzun bir ara verip geri dönersen dönüşte her şeyi baştan okur; uzun molada yeni oturuma geç.

Oturum ortasında model değiştirme

Modeli değiştirince Claude bütün sohbeti baştan okur. "Planda Opus, kodda Sonnet" ayarı da aynı sebepten token yakar.

Büyük işe plan moduyla başla

Claude önce planı sunar; yanlış yöne gidip her şeyi baştan yazma maliyetini önlersin.

Koca log'u yapıştırma

10.000 satırlık log'u olduğu gibi verme. Bir hook ile sadece hata satırlarını süzdür (binlerce token → birkaç yüz).

Limitini gözle

Ne kadar kullandığını ve ne durumda olduğunu kontrol et. Ezberleme, ölç.

Tarayıcıda (claude.ai) kullanıyorsan

Uzayınca yeni sohbet aç, işleri tek mesajda topla, çok dokümanı her sohbete yapıştırmak yerine Projects'e koy.

Çoğu kişinin bilmediği

Asıl fark buradan gelir: caching'in derin mekaniği. Çoğu Anthropic'in resmi dokümanından; bir kısmı toplulukta doğrulanan pratik gözlem.

Az bilinen

Ucuz modele geçmek pahalı olabilir

Herkes "kolaylaşınca ucuz modele geç" der. Ama uzun bir oturumun ortasında ucuz modele (ör. Opus'tan Haiku'ya) geçmek, pahalı modele sordurmaktan daha pahalıya gelebilir. Çünkü her modelin ayrı cache'i var; değişince Claude bütün sohbeti baştan okur. Anthropic'in kendi örneği: 100 bin token Opus oturumunda kolay bir soru için Haiku'ya geçmek, Opus'a sordurmaktan pahalı.

→ Pro: Modeli ve effort'u oturumun başında seç, sonra dokunma.

Az bilinen

Cache, klasörüne ve git durumuna yapışık

Claude'un hafızası çalıştığın klasöre, makineye ve git durumuna bağlı. ile alt klasöre inmek, açmak veya branch / commit değiştirmek cache'i bozar → Claude baştan okur. Tersi süper: aynı klasörde açtığın 2 Claude penceresi cache'i paylaşır (biri ötekinin işini hızlandırır).

→ Pro: Bir iş boyunca aynı klasörde kal; paralel işleri ayrı worktree değil, aynı klasörde yürüt.

Az bilinen

Yanlış yola saptıysan /compact değil /rewind

geçmişi özetler ama cache'i baştan kurar. (çift Esc) ise seni zaten hazır olan eski bir noktaya geri götürür → daha ucuz ve daha hızlı.

→ Pro: Kötü giden bir denemeyi atmak için /compact yerine /rewind.

Az bilinen

En pahalı tek tur: eski uzun oturumu --resume

Günler önceki uzun bir oturumu ile geri açmak, özellikle bu arada Claude Code güncellendiyse, dönüşte her şeyi baştan okutur. Gönderdiğin en pahalı tek istek bu olabilir.

→ Pro: Eski uzun oturumu diriltme; kısa bir özet çıkar, yeni oturuma yapıştır.

Az bilinen

Sadece özet istiyorsan /recap, /compact değil

sohbetin özetini ekler, cache'i bozmaz. ise geçmişi siler ve cache'i resetler. "Nerede kaldık" demek için compact'a gerek yok.

→ Pro: Hatırlatma için /recap; gerçekten küçültmek gerekince /compact.

Komut kopya kağıdı

Aklında kalmasın, buraya geri dön. Çipe tıkla → kopyalanır.

KomutNe işe yarar
Modeli değiştir (çoğu iş Sonnet; ⚠️ oturum ortasında oynatma token yakar)
Sohbette neyin yer kapladığını gösterir
Bağlı dış araçları yönet, kullanmadığını kapat
Düşünme çabasını ayarla (basit işte düşür)
Sohbeti tamamen sıfırla (proje hafızası kalır)
Sohbeti özetleyip küçült
Kullanım ve limit durumu
Varsayılan model ve ayarlar

Özet

Token = Claude her mesajda o ana kadarki tüm sohbeti baştan okur; sohbet küçükse limit uzar.

Doğru modeli baştan seç (çoğu iş Sonnet, basit iş Haiku, zor iş Opus) ve oturum ortasında değiştirme.

Kullanmadığın MCP araçlarını /mcp ile kapat; /context ile neyin yer kapladığını gör.

CLAUDE.md'yi 200 satır altında tut, uzun talimatları skill'lere taşı.

Uzun çıktılı işleri (test, log okuma, geniş arama) alt-ajana yaptır, sadece özet al.

Basit işte /effort ile düşünmeyi kıs; isteklerini dosya/fonksiyon adı vererek net yaz.

İş bitince /clear, uzun iş şişince /compact, yanlış yola saptıysan /rewind kullan.

Ucuz modele geçmek uzun oturumda pahalı olabilir; cache klasör + git durumuna yapışıktır.

Sadece hatırlatma için /recap (cache'i bozmaz), gerçekten küçültmek için /compact.

Komutları ezberleme, /usage ve /context ile kendi durumunu ölç.

Buraya kadar geldiysen…

Faydalı olduysa takip et: @doganmertai. "Şunu da anlat" dersen ya da takılırsan, yorumdan yaz.
@doganmertai takip et

Kaynaklar: code.claude.com/docs (costs · prompt-caching · best-practices · memory · commands · sub-agents) · platform.claude.com · resmi Anthropic dokümanıyla doğrulandı (2026-06-25). Komutlar ve sayılar zamanla değişebilir; ezberleme, /usage ve /context ile kendi durumunu ölç.

← Tüm rehberler © 2026 Zenfelt · Doğan Mert Saatçı · zenfelt.com