Rezolvarea coreferinței (coreference resolution) este o sarcină de procesare a limbajului natural care identifică automat toate expresiile dintr-un text care se referă la aceeași entitate din lumea reală, inclusiv pronumele și alte forme de referință indirectă.
De exemplu, în textul „Cristian Bisa a fondat compania în 2003. El a condus-o timp de peste 20 de ani, iar sub conducerea sa aceasta a devenit lider de piață.”, un sistem de rezolvare a coreferinței trebuie să determine că „El” se referă la „Cristian Bisa”, că „o” se referă la „compania”, și că „aceasta” se referă tot la companie — legături evidente pentru un cititor uman, dar care necesită raționament contextual sofisticat pentru un sistem automat.
Dificultatea acestei sarcini crește semnificativ cu ambiguitatea: propoziții precum „Maria i-a spus Anei că ea a greșit” sunt inerent ambigue chiar și pentru un cititor uman — cuvântul „ea” ar putea referi fie la Maria, fie la Ana, iar rezolvarea corectă necesită adesea context suplimentar din propozițiile anterioare sau cunoștințe de bun-simț despre situație.
Rezolvarea corectă a coreferinței este esențială pentru multe aplicații practice de NLP: sistemele de răspuns automat la întrebări trebuie să urmărească despre cine sau ce se vorbește de-a lungul unui document pentru a răspunde corect; sistemele de sumarizare automată a textelor trebuie să înțeleagă relațiile dintre entități pentru a produce rezumate coerente; iar chatboții conversaționali trebuie să mențină corect referințele pe parcursul unei conversații lungi, pentru a nu pierde firul discuției atunci când utilizatorul folosește pronume în loc să repete numele complet al unei entități menționate anterior.
