Ұлттық тіл моделі

Жасанды интеллект дәуіріндегі қазақ тілінің мәселесі де – өзекті. Әлемдік тілдік модельдерде қазақ тілінің сапалы деңгейде қолданылуы, қазақша мәтінді автоматты тану, интернет контентті қазақшалау, қазақ тіліне қатысты IT шешімдерді бір жолға түсіру қажеттілігін көріп жүрміз. Түптің түбінде жасанды интеллектінің қазақ тілін толық игеруіне баса назар аударуымыз керек. Бұл мәселе бойынша әзірге нақты бір қадам бар. Ол – AI негізінде ұлттық тіл моделі іске қосу үдерісі. Мемлекет басшысының айтуынша, дербес тіл моделін әзірлеу – жасанды интеллект саласындағы болашағы зор бағыттың бірі. Қазір қазақ тілі моделін жасау жұмысы қолға алынып жатыр. Осы жұмысқа сегіз ғылыми-зерттеу институты мен жоғары оқу орнынан тұратын консорциум тартылды. Бұл бастама цифрлық дербестігімізді қамтамасыз етеді. Сондай-ақ мемлекеттік тілді дамытуға мықты серпін бермек.

– Жасанды интеллект көмекшілері арасында тілді білу бойынша ресми градация жоқ, өйткені модельдер тез және бір­келкі емес. Қазіргі тіл моделін қолайлы дең­гейде оқыту үшін кем дегенде 10-100 ТБ­ таза мәтіндік деректер қажет деп есеп­теймін. Интернетте мұндай көлем жоқ, өйткені желідегі қазақ тіліндегі материал­дар­дың 70 пайызы қате жазылған. Сон­дық­тан ғылыми орталықтардың көме­гінсіз мұндай жұмыс мүмкін емес. Логика­лық тізбек құратын лингвистер қажет, олар бәрін кодқа оңтайландырады. Бұл үлкен қаржылық инвестицияны қажет етеді. Ақпарат сақталатын бұлтты серверлер әлі де қажет, – деп талдап берді практик-профессор және NeoAI компаниясының негізін қалаушы Айдын Маутан.

Предыдущая статья
Следующая статья

Ұқсас мақалалар | Статьи по теме

Жаңалықтар | Новости

instagram
@nurlyolke