У штучнага інтэлекту ёсць асаблівасць, звязаная з мовай
3- 21.07.2026, 16:02
- 2,542
Адна з моў пераважае ў навучанні мадэляў.
Сучасныя сістэмы штучнага інтэлекту развіваюцца пераважна вакол англійскай мовы, з-за чаго карыстальнікі многіх краін атрымліваюць доступ да ШІ, які горш разумее іх мову, часцей памыляецца і менш надзейна абараняе ад небяспечных запытаў, піша эксперт Крысціян Шлепфер для CEPA (пераклад — сайт Charter97.org).
Праблема асабліва прыкметная для так званых моў з нізкім аб’ёмам лічбавых дадзеных — напрыклад, суахілі або бірманскай. Нягледзячы на тое, што імі карыстаюцца мільёны людзей, у ШІ значна менш матэрыялаў для навучання, чым на англійскай мове.
«Бягучыя сістэмы ШІ менш даступныя, менш карысныя і менш бяспечныя для карыстальнікаў моў з нізкім рэсурсным забеспячэннем», — адзначае аўтар.
Даследчыкі звяртаюць увагу на так званы «падатак токенаў»: некаторыя мовы патрабуюць больш вылічальных адзінак для апрацоўкі таго ж аб’ёму інфармацыі, што павышае кошт выкарыстання мадэляў і зніжае хуткасць іх працы.
Акрамя таго, алгарытмы часцей лепш разважаюць па-англійску, што прыводзіць да памылак і культурных скажэнняў. Напрыклад, ШІ можа няправільна трактаваць значэнні слоў у розных моўных асяроддзях.
Моўны дысбаланс стварае і пагрозы бяспецы. Навукоўцы выявілі, што ахоўныя механізмы ШІ лягчэй абыходзіць з дапамогай запытаў на некаторых мала прадстаўленых мовах.
Вырашыць праблему толькі сіламі рынку не атрымаецца. Яны заклікаюць урады інвеставаць у развіццё шматмоўных мадэляў, падтрымліваць лакальныя дадзеныя і прыцягваць носьбітаў моў да стварэння новых сістэм.
«Шматлікія рэгіёны свету рызыкуюць не атрымаць выгаду ад рэвалюцыі штучнага інтэлекту», — папярэджваюць эксперты.