გიორგი კეკელიძე - ქართული ენის სტრუქტურის გაცნობა AI-ისთვის ფუნდამენტური სამუშაოს დასაწყისია

ბიზნესისა და ტექნოლოგიების უნივერსიტეტში (BTU) ქართული ენის ციფრული სუვერენიტეტის პროექტის მორიგი ეტაპი დასრულდა. პროექტის ფარგლებში მომზადდა სახელმძღვანელო ქართული ენის გრამატიკა ხელოვნური ინტელექტისთვის, რომელიც ქართული ენის გრამატიკული სისტემის ტექნოლოგიური გამოყენებისთვისაა განკუთვნილი.

პროექტის მიზანია, თანამედროვე ხელოვნური ინტელექტისა და ენობრივი ტექნოლოგიების განვითარებაში ქართულ ენას ჰქონდეს არა მხოლოდ ტექსტური წარმოდგენა, არამედ მისი გრამატიკული სტრუქტურის, ენობრივი კავშირებისა და კონტექსტის უფრო ზუსტი აღწერა.

ქართული ენის სტრუქტურის გაცნობა ხელოვნური ინტელექტისთვის მნიშვნელოვანი ეტაპი და ფუნდამენტური სამუშაოს დასაწყისია. ქართული ენის გრამატიკის ძირითადი სახელმძღვანელოების დამუშავება და დასწავლა ახალი საფეხურების მოსინჯვას ნიშნავს“, აღნიშნავს გიორგი კეკელიძე, მწერალი და ქართული ენის ციფრული სუვერენიტეტის პროექტის ამბასადორი.

პროექტის პირველ ეტაპზე BTU-მ დაამუშავა მილიონობით ქართულენოვანი ტექსტი, შექმნა ქართული ენის ციფრული რესურსები და ისინი ღია წვდომით საერთაშორისო პლატფორმა GitHub-ზე განათავსა. ამ ეტაპმა AI სისტემებისთვის ქართული ენის მონაცემთა ბაზების განვითარებას საფუძველი ჩაუყარა.

მეორე ეტაპზე კვლევის ფოკუსი ენის სტრუქტურულ ანალიზზე გადავიდა. 7 მილიარდზე მეტი ტოკენის მოცულობის ქართულენოვანი კორპუსის საფუძველზე განხორციელდა გრამატიკული, მორფოლოგიური და სინტაქსური თავისებურებების კვლევა, რომლის შედეგების შეჯერებით მომზადდა სახელმძღვანელო.

სახელმძღვანელოს მიზანია, ხელი შეუწყოს ქართული ენის უფრო ეფექტიან დამუშავებას დიდი ენობრივი მოდელების (LLM), მანქანური თარგმანისა და სხვა ენობრივი ტექნოლოგიების განვითარების პროცესში.

ნაშრომი ეფუძნება ქართველი ენათმეცნიერების მრავალწლიან სამეცნიერო მემკვიდრეობას და ამ ცოდნის თანამედროვე ტექნოლოგიური ინტერპრეტაციის მცდელობას წარმოადგენს.

კვლევის განხორციელებისას გამოყენებული იყო BTU-ს ხელოვნური ინტელექტის პლატფორმა BTUAI, რომელმაც დიდი მოცულობის მონაცემების დამუშავება და ანალიზი უზრუნველყო. კვლევის მეთოდოლოგია, შეფასება და საბოლოო ინტერპრეტაცია კი ქართველმა მკვლევრებმა განსაზღვრეს.

ავტორების განმარტებით, ნაშრომი არ წარმოადგენს ქართული ენის სრულ მანქანურ მოდელს. იგი ქართული ენის ინფორმაციულ-მათემატიკური მოდელირების საწყისი ეტაპია, რომელიც შემდგომი სამეცნიერო და ტექნოლოგიური განვითარების საფუძველს ქმნის.

სახელმძღვანელოს პირველი ვერსია უკვე ხელმისაწვდომია ღია წვდომით საერთაშორისო რეპოზიტორებზე. მისი გამოყენება შეუძლიათ მკვლევრებს, დეველოპერებს, უნივერსიტეტებსა და ენობრივი ტექნოლოგიების მიმართულებით მომუშავე ორგანიზაციებს.

(R)

გიორგი კობერიძე - მოსკოვის სიტყვას ფასი არ აქვს, თუ მას ზურგს არ უმაგრებს უხეში ძალა და შეკავების რეალური მექანიზმები
ქართული პრესის მიმოხილვა 31.08.2026
„არდი“ და Amadeo ბიზნესების ფინანსური მართვის გასაძლიერებლად პარტნიორობას იწყებენ
Skillwill-ი Anthropic-ის Claude Partner Network-ს შეუერთდა - AI Literacy ყველა აკადემიური პროგრამის განუყოფელი ნაწილი იქნება