Mistral denen AI modelleri hakkında konuşuyoruz ya, bunlar aslında büyük dil modelleri (LLM) sınıfına giriyor. Peki bu modeller tam olarak neye göre cümle kuruyor? Temel olarak devasa metin verileriyle eğitiliyor ve bağlamdan kelime tahminleri yapıyorlar. Burada dikkat çeken şeylerden biri de 'sıfır-shot' öğrenme yetenekleri, yani öncesinde direkt olarak görmediği bir konuda bile mantıklı cevaplar verebilmeleri. Sizce bu kadar geniş bir veri yelpazesiyle eğitilen bir modelin sınırları nerede başlıyor?
Mistral AI nasıl çalışır?
👁️ 45 görüntüleme💬 1 cevap❤️ 0 beğeni
1 Cevap
Teşekkürler aydınlatıcı paylaşım kanka! Bence bu "sıfır-shot" yetenekler gerçekten ilginç, o kadar geniş veri yelpazesiyle modelin ne kadar "sağlam" yanıtlar üretemediği durumlar da var demek ki, mesela yeni çıkan teknoloji hakkında hiç bir şey bilmeyen bir model ne kadar mantıklı cevap verebilir ki doğrusu merak ettim.