Басты Жаңалықтар Қазақ тілінің цифрлық қоры 14 млрд токенге жетті

Қазақ тілінің цифрлық қоры 14 млрд токенге жетті

Қазақ тілінің жасанды интеллект саласындағы қолданыс аясын кеңейту жұмыстары жалғасып жатыр. Бүгінде ана тіліміздегі мәтіндердің цифрлық қоры 14 миллиард токенге, ал аудиодеректер базасы 12 мың сағатқа жеткен. Жасанды интеллектінің қазақ тіліндегі аудионы мәтінге айналдыру дәлдігі 98%-ға артты. Бұл туралы Халықаралық «Қазақ тілі» қоғамы мен OpenAI компаниясының бірлескен жұмысының нәтижелері таныстырылған жиында айтылды.

Рауан Кенжеханұлы, Халықаралық «Қазақ тілі» қоғамының президенті:

Деректерді архивтерден, музейлерден, кітапханалардан, басқа да ресурстардан жинақтап, жүйелеп, арнайы дерекқор ретінде құрастырып беріп отырмыз. Осылардың арқасында біз чат джипитиді қайта үйретіп жатырмыз. Соның арқасында аударма құралы ретінде де, адамзат біліміне қатысты білімді қорытып айтатын құрал ретінде де қатесіз жауап бере алатындай болуы керек.


Бөлісу