Claude "neredeyse düşündü" durumunda takılı kalmışsa ve bir şeyin bozulup bozulmadığını merak ediyorsanız — bozulmamıştır. Bu durum, Claude'un extended thinking (akıl yürütme modu) içinde olduğu anlamına gelir: yazmaya başlamadan önce cevabı planlıyordur. Bunun birkaç saniye, hatta 20–30 saniye sürmesi normaldir. Normal olmayan şey, hiçbir şey geri dönmeden dakikalarca beklemektir. Bunlar iki farklı sorundur ve bu kılavuz onları ayırır ve her biri için çözümü verir.
"Neredeyse düşünmeyi bitirdim" aslında ne anlama gelir
"Neredeyse düşünmeyi bitirdi" ifadesi, Claude'un uzatılmış akıl yürütme aşaması çalışırken gösterdiği etikettir. Model, token token hemen yanıt vermek yerine, bir plan oluşturmak için "düşünme" token bütçesi harcar ve ardından görünür yanıtı üretir. Bu, Claude Code’daki "yüksek çabayla düşünme" ve Claude uygulamalarındaki akıl yürütme göstergelerinin arkasındaki aynı mekanizmadır.
Bunu okumanın en net yolu şu: bu ifade bir ilerleme sinyalidir, bir hata değil. Bir r/ClaudeCode başlığının dediği gibi, bu uzun akıl yürütme duraksaması "Claude'un yürütmeden önce plan yapmasıdır, bir sunucu sorunu değil." Yani claude almost done thinking gördüğünüzde, model çalışıyordur — tek soru, bunun fazla uzun sürüp sürmediğidir.
Çizilecek kabaca bir çizgi:
Saniyeler ile ~30 saniye düşünme → normaldir, özellikle zor muhakeme veya kodlama görevlerinde.
Çıktı olmadan dakikalarca, tekrar tekrar → bir sorun var; aşağıdaki düzeltmelere geçin.
Neden bu kadar uzun sürüyor (veya tamamen takılıyor)
Yavaşlık ve gerçek bir takılma farklı nedenlere sahiptir. Yavaşlık durumunu üç şey etkiler:
Genişletilmiş düşünme derinliği. Hızlı bir aramada Claude, görev için gerekenden daha fazla akıl yürütme çabasına yönelebilir — ihtiyacı olmayan bir soruyu "derinlemesine düşünür".
Ardışık araç çağrıları. Aracı kullanımda (Claude Code), gerçek zamanlı sürenin çoğu modelin akıl yürütmesi değildir — araç çağrılarıdır. Claude Code gecikmesine ilişkin bir döküm, her dosya okuma, arama veya test çalıştırmasının senkron bir gidiş-dönüş olarak yaklaşık 300–800ms sürdüğünü ölçtü ve bunların varsayılan olarak paralel çalışmadığını belirtti — bu nedenle, bir düzineyi aşan keşif amaçlı çağrıyı tetikleyen belirsiz bir istem, gerçek iş başlamadan önce bu gidiş-dönüşleri on saniyenin üzerine yığar.
Bağlam şişmesi. Tüm transkript her turda modele yeniden gönderilir. Oturum doldukça, yanıtlar yavaşlar ve kalite düşer — aynı analiz, bir oturum bağlam penceresinin yaklaşık %60 seviyesini aştığında belirgin bir yavaşlama gözlemlendiğini, ancak tam noktanın değiştiğini belirtti (bu, konuşmanın derinliklerine gömülü ayrıntılar için "ortada kaybolma" etkisidir).
Gerçek takılma ayrı bir arızadır. Takip edilen bir Claude Code sorunu (#32526), yeni oturumların "thinking" aşamasında takılıp kalmasını ve asla çıktı üretmemesini — hatta düz bir "hello"ya bile yanıt vermemesini — anlatıyor; buna karşın önceden açık olan bir oturum sorunsuz çalışmaya devam ediyor. Bu rapor ağır bir yapılandırmadan geldi: çok sayıda PreToolUse hook'u, birden fazla MCP sunucusu, 80'den fazla kayıtlı skill ve özel bir (Bedrock) sağlayıcı. Sizinkisi tek bir token bile döndürmüyorsa, bunu yavaşlık değil takılma olarak değerlendirin.
Nasıl düzeltilir
Hızlı çözümler (önce bunları deneyin)
Konuşmayı bırakıp temiz bir başlangıç yapmak için
/clear— bağlam şişkinliğine karşı en hızlı çözüm.Bağlamı özetleyip küçültmek için
/compact. Tasarım gereği kayıplı olduğunu unutmayın; bu yüzden önemli olan her şeyi önce bir dosyaya kaydedin.Oturumu yeniden başlatın veya hâlâ yanıt veren daha eski bir oturuma geri dönün — takılma durumunda çoğu kullanıcının başvurduğu geçici çözüm budur.
Çaba seviyesini kontrol edin
En çok göz ardı edilen hız kolu efordur. Claude, varsayılan olarak yüksek/maksimum akıl yürütmeye yönelme eğilimindedir; eforu göreve uydurmak, rutin işlerde kalite kaybı olmadan büyük hız kazanımları sağlar. İşe yarar bir kısa rehber:
Görev | Çaba | Neden |
|---|---|---|
Hızlı arama, özet, biçimlendirme |
| Derin akıl yürütme gerekmez; neredeyse anında |
Standart kodlama, taslak hazırlama |
| Dengeli |
Mimari, zor hata ayıklama, matematik |
| Beklemeye değer |
Eğer şeffaflık sizi rahatsız ediyorsa (Claude varsayılan olarak düşünme ayrıntılarını gizler), Claude Code en azından ne yaptığını görebilmeniz için bir düşünme özeti gösterebilir.
Gerçekten takıldığında, sadece yavaş olmadığında
Eğer sıfır çıktı alıyorsanız, bu derinlik değil, bir kilitlenmedir:
Başlangıç yükünü azaltın — ek
PreToolUsehook'larını, kullanılmayan MCP sunucularını ve becerileri geçici olarak devre dışı bırakın, ardından oturumu yeniden açın.Sağlayıcınızı kontrol edin — özel model kimlikleri ve geçitler (Bedrock ve benzerleri) birçok takılma raporunda görünür.
Gerçekte ne yaptığını görmek için
--verboseile çalıştırın: uzun bir dosya okuma dizisi bir araç çağrısı sorununa işaret eder; araç çağrısı olmayan yavaş bir ilk yanıt ise gecikme veya bağlama işaret eder.
İleri Seviye: düşünmeyi API'den kontrol edin
Uygulamalar, düşünme üzerinde size sınırlı kontrol sağlar. API bu kontrolü doğrudan size verir — ve öngörülebilir gecikmeye ihtiyacınız varsa bu pratik çözümdür. Yukarıdaki hile sayfasındaki aynı çaba seviyeleri bir API parametresidir ve genişletilmiş düşünmeyi tamamen de kapatabilirsiniz:
message = client.messages.create(
model="claude-opus-4-6",
max_tokens=4096,
thinking={"type": "adaptive"}, # Claude ne kadar düşüneceğine karar verir
output_config={"effort": "low"}, # low | medium | high | max — derinliği sınırlar
# veya, genişletilmiş düşünmeyi tamamen atlamak için:
# thinking={"type": "disabled"},
messages=[{"role": "user", "content": "..."}],
)Mevcut Claude modellerinde (Opus 4.6 ve üzeri) sabit bir token bütçesi ayarlamazsınız — bir çaba düzeyi belirlersiniz (low hızlı iş için, max'e kadar), ya da extended thinking'i tamamen devre dışı bırakırsınız. Bu, uygulamaların gizlediği aynı kontrol aracıdır; sizin kontrol ettiğiniz bir parametre olarak sunulur. (Güncel referans için resmî extended-thinking belgelerine bakın — parametre adları SDK sürümleri arasında değişebilir, bu yüzden kendi sürümünüzü kontrol edin.)
Herhangi bir Anthropic uyumlu uç nokta bu çağrıları yapabilir — resmi API ya da AIReiter gibi uyumlu bir yansıtma; burada yukarıdaki istek aynen çalışır. Hangisini kullandığınızdan çok, çıkarılacak ders önemlidir: düşünme denetimi API katmanında bulunur ve uygulamalar bunu açığa çıkarmaz.
Claude “kötüleşiyor” mu?
Bu, çoğu "why is claude almost done thinking forever" aramasının ardındaki sorudur ve dürüst cevap şudur: genellikle kalıcı değildir. Algılanan gerilemenin büyük bir kısmı varsayılan davranış değişikliklerine dayanır — düşünme bütçelerinde sunucu taraflı ayarlamalar ya da güncellemelerde devreye alınan muhafazakâr varsayılanlar — modelin daha aptal hale gelmesinden ziyade. Bu konuda topluluk içinde çok fazla ileri geri tartışma var ve yinelenen sonuç hep aynı: kontrolü geri aldığınızda deneyim düzelir — çaba seviyesini ayarlayın, şişkin oturumları temizleyin ve yapılandırılmış istemler verin. Claude bu hafta daha kötü hissediliyorsa, bozuk olduğuna karar vermeden önce bu üç şeyi değiştirin.
SSS
"Düşünmeyi neredeyse bitirdi" ne anlama geliyor?
Bu, Claude’un genişletilmiş akıl yürütme modunda olduğu ve yanıtı yazmadan önce bir plan üzerinde çalıştığı anlamına gelir — bu normal bir ilerleme durumudur, bir hata değildir. Ancak hiç çözülmediğinde bir sorun olduğunu gösterir.
Claude neden bu kadar uzun süre düşünür?
Üç yaygın neden: yüksek varsayılan çaba seviyesi, agentic oturumlarda yavaş ardışık araç çağrıları (her biri ~300–800ms) ve şişmiş bir bağlam penceresi. Çaba seviyesini düşürmek, araç çağrılarının sayısını azaltmak ve bağlamı temizlemek yardımcı olur.
Claude hiç düşünürken takılıp kalır mı?
Evet — yavaşlıktan farklıdır. Yeni oturumlar "thinking" aşamasında takılı kalabilir ve hiç çıktı döndürmeyebilir; bu durum çoğunlukla ağır hook/MCP/skill kurulumları veya özel sağlayıcılarla ilişkilidir. Oturumu yeniden başlatın ya da çalışan birine geri dönün.
Claude yanıtı tamamlamıyor — ne yapmalıyım?
Bunu takılma olarak değerlendirin: /clear kullanın veya yeniden başlatın, başlangıç yükünü azaltın ve sağlayıcınızı kontrol edin. Eğer durmaktan ziyade yavaşsa, çaba seviyesini düşürün ve bağlamı küçültün.
Claude’un daha hızlı düşünmesini sağlayabilir miyim?
Evet. Rutin görevler için çabayı low/medium olarak ayarlayın, oturumları kısa tutun ve tam kontrol için API'yi daha düşük bir çaba seviyesiyle veya genişletilmiş düşünme devre dışı bırakılmış olarak çağırın.