Büyük dil modeli
Large language model
D2
Büyük dil modeli, çok büyük bir metin veri kümesi üzerinde eğitilen derin öğrenme tabanlı bir dil modelidir; üretken bir büyük dil modeli metni yaygın olarak sonraki tokeni veya sözcüğü tahmin ederek üretir.
İnceleme durumu: 2026-11-26
Teknik açıklama
Üretken bir büyük dil modeli, bir cümle veya ifadede sonraki tokeni ya da sözcüğü tahmin ederek metin üretebilir.
Kavramsal sınırlar
Büyük dil modeli Transformer mimarisinin kendisi değildir; NIST, Mart 2025 tarihli yayınında Transformer tabanlı GPT modellerini o tarihte baskın LLM mimarisi olarak tanımladı.
Sağlayıcıdan bağımsız örnek
Bir yardım masası iş akışı, çalışanın göndermeden önce düzenlemesi için sonraki yanıt cümlesini önermek üzere büyük dil modeli kullanabilir.
Sınırlılıklar
Sonraki tokeni veya sözcüğü tahmin etme yaygın bir üretim mekanizmasıdır ve her dil modeli mimarisini tanımlamaz.
İlişkili kavramlar
Atomik iddialar ve kanıt
1.1NIST SP 1500-29, Artificial Intelligence in the Fire Service: Considerations for Implementing Artificial Intelligence into Electronic Safety Equipment
- Kaynak
- NIST SP 1500-29, Artificial Intelligence in the Fire Service: Considerations for Implementing Artificial Intelligence into Electronic Safety Equipment
- Kaynak rolü
- Yetkili kaynak
- Tam konum
- Section 1.1, p. 5: Large Language Models (LLM) bullet; sentences distinguishing Generative LLMs from Discriminatory LLMs
- Desteklenen iddia
- NIST SP 1500-29, büyük dil modelini çok büyük bir metin veri kümesi üzerinde eğitilen derin öğrenme tabanlı bir dil modeli olarak tanımlar ve üretken büyük dil modellerini ayrımcı büyük dil modellerinden ayırır; NIST AI 600-1 ise üretken yapay zekâ riskleri bağlamında büyük dil modellerinin bir cümle veya ifadede sonraki tokeni ya da sözcüğü tahmin ettiğini belirtir.
- Son doğrulama
- Gözden geçirme tarihi
- Kapsam sınırlaması
- Bu, geniş LLM kategorisini üretken büyük dil modellerinden ayırır ve parametre sayısı eşiği koymaz.
1.2NIST AI 600-1, Artificial Intelligence Risk Management Framework: Generative Artificial Intelligence Profile
- Kaynak
- NIST AI 600-1, Artificial Intelligence Risk Management Framework: Generative Artificial Intelligence Profile
- Kaynak rolü
- Yetkili kaynak
- Tam konum
- Confabulation pp. 5-6: LLMs predict the next token or word in a sentence or phrase
- Desteklenen iddia
- NIST SP 1500-29, büyük dil modelini çok büyük bir metin veri kümesi üzerinde eğitilen derin öğrenme tabanlı bir dil modeli olarak tanımlar ve üretken büyük dil modellerini ayrımcı büyük dil modellerinden ayırır; NIST AI 600-1 ise üretken yapay zekâ riskleri bağlamında büyük dil modellerinin bir cümle veya ifadede sonraki tokeni ya da sözcüğü tahmin ettiğini belirtir.
- Son doğrulama
- Gözden geçirme tarihi
- Kapsam sınırlaması
- Bu, geniş LLM kategorisini üretken büyük dil modellerinden ayırır ve parametre sayısı eşiği koymaz.
2.1NIST AI 100-2e2025, Adversarial Machine Learning: A Taxonomy and Terminology of Attacks and Mitigations
- Kaynak
- NIST AI 100-2e2025, Adversarial Machine Learning: A Taxonomy and Terminology of Attacks and Mitigations
- Kaynak rolü
- Yetkili kaynak
- Tam konum
- Appendix A p. 108: generative pre-trained transformer (GPT)
- Desteklenen iddia
- NIST, Mart 2025 tarihli yayınında GPT’yi Transformer tabanlı bir model ailesi ve o tarihte büyük dil modelleri için baskın mimari olarak tanımladı.
- Son doğrulama
- Gözden geçirme tarihi
- Kapsam sınırlaması
- Baskın ifadesi evrensel anlamına gelmez; iddia büyük dil modelini mimarisiyle özdeşleştirmez.