Sade anlatım
Birine zor bir aritmetik sorusu sorup anında yanıt isterseniz çoğu zaman yanılır. Kâğıt verirseniz doğru yapar. Chain of thought modele kâğıt verir: model ara adımları yazar ve her adım bir sonrakinde okuduğunun parçası olduğu için son yanıt tek bir sıçramaya değil, yazılmış bir akıl yürütmeye dayanır.
Neden önemli
Nasıl sorduğunuzun modelin akıl yürütme başarısını değiştirdiğini gösteren ilk örneklerden biriydi ve standart modellerde çok adımlı problemlerde doğruluğu artırmanın hâlâ en ucuz yoludur. Yanıtları denetlenebilir de kılar: adımlar yazılıysa inceleyen kişi mantığın nerede bozulduğunu görebilir. Bedeli daha fazla çıktı token'ı ve daha yavaş yanıttır.
Örnek
Modele, bir müşterinin dört koşullu bir politikaya göre iade hakkı olup olmadığı soruluyor. Doğrudan yanıtladığında evet diyor. Her koşulu sırayla kontrol edip sonra karar vermesi istendiğinde, alışverişin 30 günlük sınıra karşılık 34 gün önce yapıldığını buluyor ve doğru biçimde hayır diyor.
Bununla en çok karıştırılan kavram
CoT ve Reasoning Model arasındaki fark
Chain of thought bir talimattır: “adım adım düşün, sonra yanıtla”. Akıl yürüten modelde bu davranış eğitimle yerleşiktir ve model düşünmesini kendi yönetir. Akıl yürüten modellerde adım adım talimatı eklemek genellikle gereksizdir, sonucu kötüleştirebilir de; hedefi net biçimde belirtmek daha iyi çalışır.
Köken: 2022'de Google'dan Wei ve arkadaşları tarafından tanıtıldı; zero-shot türü olan “Let's think step by step” aynı yıl geldi.
Teknik katman
Türleri: zero-shot CoT (önce akıl yürütme talimatı), few-shot CoT (akıl yürütme içeren örnekler) ve düşünmeyi yanıttan etiketlerle ayıran, böylece akıl yürütmenin gösterimden önce çıkarılabildiği yapılandırılmış CoT. İşe yaramasının nedeni, özbağlanımlı modellerin kendi çıktılarını koşul olarak kullanmasıdır: yazılan adımlar çalışma belleğine dönüşür. En çok aritmetik, mantık ve çok koşullu kararlarda, en az basit hatırlamada işe yarar. Bir uyarı: yazılan akıl yürütme, yanıta nasıl ulaşıldığının her zaman sadık bir anlatımı değildir; incelemeyi destekler, doğruluğu kanıtlamaz.