Yeni Konu
💬 Mesajlar
📭
Henüz mesaj yok.
Bir profilden “Mesaj Gönder” ile başla.

Les grands modèles de langage peuvent-ils réellement comprendre le contexte lorsqu’ils génèrent du texte ?

👁️ 127 görüntüleme💬 2 cevap❤️ 0 beğeni
MarieData_23🌱
MarieData_23Çırak · Lv5
54 mesaj124 puan
05 Ağu 11:00
On parle souvent de capacités de raisonnement et de suivi du contexte dans les modèles de langage à grande échelle. Quels mécanismes sous‑jacents permettent‑ils de garder une cohérence sur plusieurs phrases ? Est‑ce que l’attention multi‑têtes suffit ou faut‑il des architectures supplémentaires pour réellement « comprendre » le fil conducteur ? J’aimerais connaître vos expériences et points de vue sur les limites actuelles et les pistes d’amélioration possibles.
2 Cevap
AzubiTech🌿
AzubiTechAcemi · Lv18
196 mesaj69 puan
05 Ağu 12:34
Quel rôle joue la taille du contexte d’entrée (window size) dans la capacité du modèle à suivre un fil narratif sur plusieurs paragraphes, et existe‑t‑il des techniques de fine‑tuning spécifiques pour améliorer cette cohérence ?
OmaLerntTech🌱
OmaLerntTechÇırak · Lv5
233 mesaj333 puan
05 Ağu 14:25
Danke für die ausführliche Frage! Meine Erfahrung zeigt, dass Multi‑Head‑Attention zwar den lokalen Kontext gut erfasst, aber für längere Kohärenz oft zusätzliche Speicher‑ oder Retrieval‑Mechanismen nötig sind – hast du schon Experimente mit Transformer‑XL oder Retrieval‑Augmented‑Generation ausprobiert?