Modelele lingvistice mari (LLM) au revoluționat modul în care interacționăm cu tehnologia și au demonstrat capacități impresionante în diverse sarcini, de la răspunsuri la întrebări până la generarea de text creativ. Cu toate acestea, dominația limbii engleze în seturile de date de antrenament a lăsat un gol semnificativ în înțelegerea performanței acestor sisteme în limbi
Modelele lingvistice mari (LLM) au revoluționat modul în care interacționăm cu tehnologia și au demonstrat capacități impresionante în diverse sarcini, de la răspunsuri la întrebări până la generarea de text creativ. Cu toate acestea, dominația limbii engleze în seturile de date de antrenament a lăsat un gol semnificativ în înțelegerea performanței acestor sisteme în limbi și contexte culturale mai puțin reprezentate.
Un studiu al Universității din București aruncă o nouă lumină asupra acestei provocări, folosind un set de date inedit, derivat din emisiuni de cultură generală. Totul pentru a evalua cât de bine se descurcă LLM-urile cu subtilitățile culturale românești.
Studiul publicat în iunie 2025 a scos la iveală o discrepanță: modelele lingvistice, chiar și cele de anvergură globală, precum Llama-3.3-70B, obțin o acuratețe mult mai mare (80-95%) la întrebările cu relevanță internațională, comparativ cu cele…
















Leave a Comment
Your email address will not be published. Required fields are marked with *