KonuAnlatım.com

ChatGPT nasıl çalışır?

Yapay Zekâ · Bölüm 51Yapay ZekâDers

Bu derste ChatGPT'nin arkasındaki mekanizmayı sıfırdan anlatıyoruz: modelin temelindeki "sıradaki kelimeyi tahmin etme" fikrini, üç aşamalı eğitim sürecini ve mesajının karşılık bulana kadarki yolculuğunu adım adım izliyoruz. Amaç yalnızca aracı kullanmayı öğretmek değil; ne yaptığını ve neden bazen hata yaptığını anlamanı sağlamak. Bu ders, Yapay Zekâ dersleri kategorisindeki Üretken Yapay Zekâ ünitesinin ikinci konusudur.

ChatGPT nedir, neye dayanır?

ChatGPT, OpenAI'ın geliştirdiği bir yapay zekâ sohbet uygulamasıdır; Kasım 2022'de yayımlanması, üretken yapay zekâyı milyonlarca insanın günlük hayatına sokan kırılma noktası sayılır. Soruları yanıtlar, metin ve kod yazar, çeviri yapar; yeni sürümleri sesli konuşabilir ve görselleri yorumlayabilir. Önemli ayrım şudur: ChatGPT bir üründür, onu çalıştıran ise GPT ailesindeki büyük dil modelleridir (LLM). GPT-4 ve GPT-4o gibi sürümler bu ailenin üyeleridir; 2024'te adım adım akıl yürütmesine odaklanan o1 gibi modeller de aileye eklenmiştir. Motor ile uygulama ilişkisini şöyle özetleyebiliriz: GPT motor, ChatGPT ise o motorun üzerine kurulmuş araçtır. Üretken yapay zekânın bütünsel tanımı için Üretken yapay zekâ nedir? dersine göz atabilirsin.

Temel ilke: sıradaki token'ı tahmin etmek

ChatGPT'nin çalışma mantığı tek bir hedefe dayanır: verilen metnin sıradaki birimini tahmin etmek. Model, metni önce token denen parçalara böler; bir token çoğu zaman bir kelimenin tamamı ya da bir parçası, bazen de bir noktalama işaretidir. "Gökyüzü bugün çok ..." öbeğinden sonra "mavi" gelme olasılığı yüksektir, "kalem" gelme olasılığı ise düşüktür; model, bu olasılıkları milyarlarca örnekten öğrenmiş devasa bir istatistiksel yapıdır.

Bu basit görünen hedefin sonucu çarpıcıdır: sıradaki kelimeyi üst üste milyarlarca kez doğru tahmin etmek için dilbilgisini, yazımı, konu akışını ve mantık örüntülerini yakalamak gerekir. ChatGPT'nin akıcı cevaplar verebilmesinin sırrı budur; o bir bilgi bankası değil, son derece başarılı bir örüntü tahmincisidir.

Model nasıl eğitilir? Üç aşama

1. Ön eğitim (pre-training)

Model, kitaplardan, makalelerden ve web metinlerinden oluşan devasa bir havuzda yalnızca "sıradaki token'ı tahmin et" göreviyle eğitilir. Bu aşama büyük maliyet ve zaman gerektirir; modelin genel dil yeteneği burada oluşur.

2. İnce ayar ve insan geri bildirimi (RLHF)

Ön eğitimden çıkan model hamdır; iyi bir sohbet ortağı olmayı bilmez. İnsan eğitmenler sorular yazar, modelin ürettiği cevapları kaliteye göre sıralar ve tercih edilen cevaplar ödüllendirilir. Bu yönteme insan geri bildirimiyle pekiştirmeli öğrenme (RLHF) denir. ChatGPT'nin konuyla ilgili, kibar ve güvenlik kurallarına uygun cevap verme alışkanlığı büyük ölçüde bu aşamanın ürünüdür.

3. Çıkarım (inference): konuşma anı

Eğitim bittikten sonra model yeni bilgi öğrenmez; senin girdine göre token token cevap üretir. Günlük kullanımda gördüğün parça parça yazma efekti, cevabın tek seferde değil, bir token eklenip hesap yenilenerek üretilmesindendir.

Bir mesaj gönderdiğinde adım adım ne olur?

ChatGPT'ye bir soru yazdığında arka planda kabaca şu sıra işler:

  1. İstem hazırlanır: Senin yazdığın mesaj, sistem talimatı ve önceki konuşma turları birleştirilerek modele sunulur. Sistem talimatının rolünü Sistem mesajı dersinde, iyi istem yazmayı ise Prompt nedir? dersinde bulursun.
  2. Metin token'lara bölünür: Girdi parçalara ayrılır ve her parça sayıya çevrilir; model kelimelerle değil sayılarla çalışır.
  3. Model hesaplar: Girdideki tüm token'lar dikkat (attention) mekanizmasıyla birbirine bağlanır; her pozisyon, diğerlerinin ne kadar önemli olduğunu hesaplar. Bunu mümkün kılan mimari, 2017'de tanıtılan Transformer'dır.
  4. Cevap token token üretilir: Model olasılık dağılımından bir token seçer, cevaba ekler ve hesabı güncel girdiyle yeniler. Karakterlerin ekranda art arda belirmesi bundandır. Cevap kalitesini yönlendirmenin yollarını merak ediyorsan Prompt engineering dersine bakabilirsin.
  5. Üretim durur: Cevap tamamlandığında model özel bir "dur" işareti üretir ve sıra yeniden sana döner.

Modelin tek seferde "aklında tutabildiği" metin miktarı sınırlıdır; sohbet uzadıkça en baştaki kısımlar bu pencerenin dışında kalabilir. Bu sınırın adı, boyutu ve sonuçları Context window nedir? dersinde anlatılır.

Neden bazen yanlış veya uydurma cevap verir?

Çalışma biçimi bilindiğinde hatalar da anlam kazanır. Model bilgi aramaz; öğrendiği örüntülerden olası metin üretir. Bu yüzden kaynağı olmayan ama kulağa inandırıcı bilgiler üretebilir; buna hallüsinasyon denir, ayrıntısı Hallüsinasyon nedir? dersindedir. Ayrıca modelin eğitim verisi belirli bir tarihte kesilir; en güncel olayları kendi başına bilemez. Yeni sürümler bunun için ayrı bir web arama aracını devreye sokabilir; ama aramayı yapan modelin kendisi değil, modelin çağırdığı dış araçtır. Bir şeye daha dikkat: model cevap vermek üzere kuruludur ve "bunu bilmiyorum" demesi gereken yerde bile olası bir cevap üretebilir.

Sık yapılan hatalar ve yanılgılar

  • "ChatGPT internette arama yapıyor." Temel model arama yapmaz; eğitimde gördüğü örüntülerden üretir. Arama, yalnızca bu özelliği destekleyen sürümlerde devreye giren ayrı bir araçtır.
  • "Cevapları bir veritabanından kopyalıyor." Hazır cevap deposu yoktur; her cevap o an olasılıklar hesaplanarak üretilir.
  • "İnsan gibi anlıyor, bilinçli düşünüyor." Model istatistiksel örüntülerle çalışır; insan benzeri anlama ve bilinç iddiası taşımaz.
  • "Uzun ve akıcı cevap doğrudur." Akıcılık doğruluğu garanti etmez; kritik bilgiyi mutlaka bağımsız bir kaynaktan kontrol et.
  • "Aynı soru hep aynı cevabı alır." Model olasılık dağılımından seçim yapar; aynı soru farklı denemelerde farklı cevaplar alabilir.
  • "Konuşmanın tamamını sonsuza dek hatırlar." Hatırlama, bağlam penceresiyle sınırlıdır; çok uzun sohbetlerde en baştaki bilgiler etkiyi yitirebilir.

Sık Sorulan Sorular

ChatGPT ile GPT arasındaki fark nedir?

GPT, OpenAI'ın geliştirdiği büyük dil modeli ailesinin adıdır; ChatGPT ise bu modellerin üzerine kurulmuş sohbet uygulamasıdır. Kısacası GPT motor, ChatGPT ise o motorla çalışan araçtır.

ChatGPT internette arama yapıyor mu?

Temel model arama yapmaz; cevabı eğitim verisinde öğrendiği örüntülerle üretir. Bazı sürümlerde web arama, ayrı bir araç olarak eklenebilir; bu durumda bile aramayı yapan model değil, modelin çağırdığı dış araçtır.

ChatGPT neden her seferinde farklı cevap verir?

Model sıradaki token'ı seçerken olasılık dağılımından yararlanır; bu seçim her seferinde birebir aynı olmak zorunda değildir. Bu yüzden aynı soruya benzer ama farklı cevaplar alınabilir.

Dersler

Tümü →