Sözlüğe dön

Büyük dil modeli

Large language model

D2

Büyük dil modeli, çok büyük bir metin veri kümesi üzerinde eğitilen derin öğrenme tabanlı bir dil modelidir; üretken bir büyük dil modeli metni yaygın olarak sonraki tokeni veya sözcüğü tahmin ederek üretir.

İnceleme durumu: 2026-11-26

Teknik açıklama

Üretken bir büyük dil modeli, bir cümle veya ifadede sonraki tokeni ya da sözcüğü tahmin ederek metin üretebilir.

Kavramsal sınırlar

Büyük dil modeli Transformer mimarisinin kendisi değildir; NIST, Mart 2025 tarihli yayınında Transformer tabanlı GPT modellerini o tarihte baskın LLM mimarisi olarak tanımladı.

Sağlayıcıdan bağımsız örnek

Bir yardım masası iş akışı, çalışanın göndermeden önce düzenlemesi için sonraki yanıt cümlesini önermek üzere büyük dil modeli kullanabilir.

Sınırlılıklar

Sonraki tokeni veya sözcüğü tahmin etme yaygın bir üretim mekanizmasıdır ve her dil modeli mimarisini tanımlamaz.

İlişkili kavramlar

Atomik iddialar ve kanıt

  1. 1.1NIST SP 1500-29, Artificial Intelligence in the Fire Service: Considerations for Implementing Artificial Intelligence into Electronic Safety Equipment
    Kaynak
    NIST SP 1500-29, Artificial Intelligence in the Fire Service: Considerations for Implementing Artificial Intelligence into Electronic Safety Equipment
    Kaynak rolü
    Yetkili kaynak
    Tam konum
    Section 1.1, p. 5: Large Language Models (LLM) bullet; sentences distinguishing Generative LLMs from Discriminatory LLMs
    Desteklenen iddia
    NIST SP 1500-29, büyük dil modelini çok büyük bir metin veri kümesi üzerinde eğitilen derin öğrenme tabanlı bir dil modeli olarak tanımlar ve üretken büyük dil modellerini ayrımcı büyük dil modellerinden ayırır; NIST AI 600-1 ise üretken yapay zekâ riskleri bağlamında büyük dil modellerinin bir cümle veya ifadede sonraki tokeni ya da sözcüğü tahmin ettiğini belirtir.
    Son doğrulama
    Gözden geçirme tarihi
    Kapsam sınırlaması
    Bu, geniş LLM kategorisini üretken büyük dil modellerinden ayırır ve parametre sayısı eşiği koymaz.
    1.2NIST AI 600-1, Artificial Intelligence Risk Management Framework: Generative Artificial Intelligence Profile
    Kaynak
    NIST AI 600-1, Artificial Intelligence Risk Management Framework: Generative Artificial Intelligence Profile
    Kaynak rolü
    Yetkili kaynak
    Tam konum
    Confabulation pp. 5-6: LLMs predict the next token or word in a sentence or phrase
    Desteklenen iddia
    NIST SP 1500-29, büyük dil modelini çok büyük bir metin veri kümesi üzerinde eğitilen derin öğrenme tabanlı bir dil modeli olarak tanımlar ve üretken büyük dil modellerini ayrımcı büyük dil modellerinden ayırır; NIST AI 600-1 ise üretken yapay zekâ riskleri bağlamında büyük dil modellerinin bir cümle veya ifadede sonraki tokeni ya da sözcüğü tahmin ettiğini belirtir.
    Son doğrulama
    Gözden geçirme tarihi
    Kapsam sınırlaması
    Bu, geniş LLM kategorisini üretken büyük dil modellerinden ayırır ve parametre sayısı eşiği koymaz.
  2. 2.1NIST AI 100-2e2025, Adversarial Machine Learning: A Taxonomy and Terminology of Attacks and Mitigations
    Kaynak
    NIST AI 100-2e2025, Adversarial Machine Learning: A Taxonomy and Terminology of Attacks and Mitigations
    Kaynak rolü
    Yetkili kaynak
    Tam konum
    Appendix A p. 108: generative pre-trained transformer (GPT)
    Desteklenen iddia
    NIST, Mart 2025 tarihli yayınında GPT’yi Transformer tabanlı bir model ailesi ve o tarihte büyük dil modelleri için baskın mimari olarak tanımladı.
    Son doğrulama
    Gözden geçirme tarihi
    Kapsam sınırlaması
    Baskın ifadesi evrensel anlamına gelmez; iddia büyük dil modelini mimarisiyle özdeşleştirmez.