Azərbaycan dilinin süni intellekt texnologiyalarında tanınması və tətbiqi ilə bağlı məsələlərin gecikməsi yenidən gündəmə gəlib.
Baku TV-nin efirində məsələ müzakirə olunarkən uzun müddətdir Azərbaycan dilini emal etməyə imkan verən milli dil korpusunun hazırlanıb ərsəyə gəlmədiyi bildirilib.
Müzakirənin gedişində Azərbaycanın Milli Elmlər Akademiyasının (AMEA) Nəsimi adına Dilçilik İnstitutunun Süni intellekt və kompüter dilçiliyi şöbəsinin müdiri Məsud Mahmudov rəhbərlik etdiyi şöbədə dörd işçinin kompüterinin olmadığını və həmin əməkdaşların evdən notbuk gətirdiklərini qeyd edib.
Belə vacib qurumda işçilər müvafiq avadanlıqlarla niyə təmin olunmurlar?
"AzPolitika" xəbər verir ki, məsələ ilə bağlı yaranan suallara aydınlıq gətirmək üçün Oxu.Az Azərbaycanın Milli Elmlər Akademiyası (AMEA) Nəsimi adına Dilçilik İnstitutunun direktoru, professor Nadir Məmmədli ilə həmsöhbət olub. O bildirib ki, ildə bir dəfə keçirilən tenderlə hissə-hissə kompüterlər alınır:
"200 nəfər işləyən yerdə hər kəsə eyni anda kompüter çatdırmaq olmur. Bir aydan sonra xeyli yeni nəsil kompüter paylanacaq. Onların şöbəsi adi kompüterlərlə işləyə bilməz, yaddaşı gərək böyük olsun".
N.Məmmədli milli dil korpusunun yaradılması mərhələsindən də bəhs edib:
"Milli dil korpusunun mahiyyətini bilmək lazımdır, bir dəfəyə yaradılan bir şey deyil. Birinci mərhələdə söz bazası toplanır və yaradılır. Bizim həm də dialekt və terminologiyamız var, bunları emal etmək elə də asan işlər deyil. Müntəzəm işləmək lazımdır. Proqramçılar gərəkdir. Bu, böyük bir layihədir. Mədəniyyət Nazirliyi bizə kömək əlini uzatmaq istəyir, danışıqlar aparırıq. Dövlət Proqramında da dilin korpusunun yaradılması məsələsi var.
Milli dil korpusunun yaradılması cümlə təhlili deyil ki, "elədim bitdi" deyək. Bu, illərlə onillərlə, ömür boyu uzanan sistemli bir işdir.
Nümunə üçün onomastika məsələsinə baxın. Dilçilik İnstitutunda əvvəllər Toponimika şöbəsi var idi, indi onu Onomastika şöbəsi etmişik. İstər insan adları, istər yer, istərsə də çay adları - hər şey haqqında mütəxəssislər məlumat topladıqdan sonra dil korpusunun yeni bir forması yaranır. Biz birinci fazanı görmüşük, Dilçilik İnstitutunun buna gücü çatıb. AMEA-nın prezidenti İsa Həbibbəyli sağ olsun, bizə dəstək oldu. Yoxsa, bu vaxta qədər AMEA rəhbərliyinə nə qədər demişdik, heç kim yaxın durmurdu. Başa düşmürdülər ki, bu, dünyada gedən prosesdir, bütün dillərdə milli dil korpusu var. Biz müraciət etdik, dərhal səsimizə cavab verdilər, bizə proqramçılar ayırdılar. Ancaq bu, bir günün işi deyil. Bu işin içindəyik, dünya sivilizasiyasını görürük. İndi yeni baxış lazımdır.
Köhnə lüğətlərdə sözün qabağında izah verilirdi. Bununla kifayətlənmək olmaz. Müasir, modern lüğətlər belə olmur. Elektron sistemlərdən istifadə etmək lazımdır. Bunun üçün dilin söz bazası və milli dil korpusu olmalıdır".
O əlavə edib ki, dil korpusu mərhələ-mərhələ hazırlanır:
"Biz birinci mərhələdə dilin söz yığımına - dildə olan sözlərin sayına başladıq. Bunun əsasını orfoqrafiya lüğəti ilə qoyduq. İkinci və üçüncü fazalarda terminologiyanın unifikasiyası, terminoloji bazanın, dialektoloji bazanın yaradılması gəlir. Bu minvalla proses illərlə davam edəcək. Ancaq kömək lazımdır. Proqramçılardan ibarət heyətlə dilin tədqiqatı aparılmalıdır, digər elmi sahələri də bura qoşmaq mütləqdir.
Azərbaycan dilinin izahlı lüğəti cəmi 4 cild hazırlanıb, üzərində 40 il əziyyət çəkilib. Dil korpusu yaradılandan, konkordanslar ediləndən, süni intellekt dilçilikdə tətbiq olunandan sonra bu işə 40 il yox, cəmi 4 ay vaxt lazımdır. Görün, bu nə dərəcədə böyük sürətdir, dilçiliyə proqram təminatı qoşulanda hansı işlər görülür.
Sadəcə Dilçilik İnstitutunda proqramçı yoxdur. Rəhbərlik sağ olsun, başqa institutların proqramçılarını qoşdu və biz dil korpusunun birinci mərhələsini yerinə yetirdik. İndi növbəti mərhələ üçün yenə də dilçilərlə paralel işləyəcək proqramçılar lazımdır. Bizdə bütün dilçi kadrlar var.
Ali məktəblərdə nə "Kompüter dilçiliyi", nə də "Süni intellekt və Kompüter dilçiliyi" şöbəsi var. Bir Dilçilik İnstitutunda mövcuddur. Dilçilik İnstitutunda kifayət qədər baza və formalaşmış elmi potensial var. Ona görə də Böyük Türk Dilləri Modelinin hazırlanmasında Dilçilik İnstitutu çox böyük məmnuniyyətlə iştirak edəcək.
Çağırış etmək lazımdır ki, çuvaşların, saxurların da dil korpusu var, niyə bizimki olmasın? Buna görə bizə kömək lazımdır.
Biz Orfoqrafiya lüğətini təkmilləşdiririk. İndiyə qədər kağızları yığıb lüğət hazırlayırdılar, indi isə dövrlə ayaqlaşmaq lazımdır.
Nə qədər biznesmen var, pullarını heç bilmirlər nəyə xərcləyirlər. Biri çıxıb desin ki, mən dilçiliyin inkişafı üçün kömək etmək istəyirəm. Əməkdaşlara güclü yaddaşlı kompüter lazımdır. İlk mərhələdə dil korpusunun yaradılmasında 550 milyon sözdən istifadə etmişik. Buna adi kompüter yaddaşı dözməz. Ona görə də çalışırıq ki, yeni kompüterlər olsun, onlar işləyə bilsinlər. İndi biz bu göstəricini 2 milyarda çatdırmaq istəyirik ki, onu saf-çürük edib tapaq. İngilislər 6-7 milyon sözün içindən seçim edirlər. Biz də bunlarla ayaqlaşmalıyıq.
Biznesmenlər gedib bahalı kitablar buraxdırırlar. Onlar gəlib öz loqosunu qoyub Dilçilik İnstitutuna bir kompüter alsa və ya bir layihəyə sponsorluq etsələr, o loqo bizim saytda həmişəlik qalacaq. Bu, onlar üçün daha faydalıdır.
Mədəniyyət Nazirliyinin əsasnaməsində dil korpusu məsələsi var. Amma bunu bizdən başqa icra edə biləcək mütəxəssis bazası yoxdur. Bizə kömək olunmalıdır".


Şərhlər