Published September 24, 2026 | Version v1

TURLI MANBALARDAGI XORIJIY TALABALAR YOZUVLARINI IDENTIFIKATSIYALASH VA MOSLASHTIRISH ALGORITMI

  • 1. Buxoro davlat texnika universiteti o'qituvchisi, i.f.f.d. (PhD)

Description

Xorijiy talabalarning ism-familiyalari turli manbalarda lotin va kirill yozuvlarida, turli transliteratsiya an’analariga ko‘ra yoziladi. Bu bir shaxsga tegishli yozuvlarni avtomatik moslashtirishni qiyinlashtiradi. Maqolada ism-familiyalarni yagona shaklga keltiruvchi normallashtirish qoidalari va Jaro–Winkler o‘xshashlik o‘lchoviga asoslangan moslashtirish algoritmi taklif etilgan. Sakkiz juftlikdan iborat nazorat to‘plamida normallashtirishdan keyin bir shaxsga tegishli juftliklar o‘xshashligi 0,964–1,000 oralig‘iga ko‘tarilgani, turli shaxslar esa 0,85 dan oshmagani ko‘rsatilgan.

Files

318-321.pdf

Files (170.5 kB)

Name Size Download all
md5:2fa22c0a79391342da0c4af47f3b49c0
170.5 kB Preview Download

Additional details

References

  • 1.O'zbekiston Respublikasining 1993-yil 2-sentyabrdagi "Lotin yozuviga asoslangan o'zbek alifbosini joriy etish to'g'risida"gi Qonuni (1995-yil 6-maydagi o'zgartirishlar bilan).
  • 2.Fellegi I.P., Sunter A.B. A theory for record linkage // Journal of the American Statistical Association. – 1969. – Vol. 64, No. 328. – P. 1183–1210. – DOI: 10.1080/01621459.1969.10501049.
  • 3.Winkler W.E. String comparator metrics and enhanced decision rules in the Fellegi-Sunter model of record linkage // Proceedings of the Section on Survey Research Methods. – American Statistical Association, 1990. – P. 354–359.
  • 4.Elmagarmid A.K., Ipeirotis P.G., Verykios V.S. Duplicate record detection: A survey // IEEE Transactions on Knowledge and Data Engineering. – 2007. – Vol. 19, No. 1. – P. 1–16. – DOI: 10.1109/TKDE.2007.250581.
  • 5.Christen P. Data Matching: Concepts and Techniques for Record Linkage, Entity Resolution, and Duplicate Detection. – Berlin; Heidelberg: Springer, 2012. – 270 p. – DOI: 10.1007/978-3-642-31164-2.