В Татарстане собирают данные (датасет) для создания голосовых ИИ-помощников на татарском языке. На данный момент заинтересованным компаниям готовы передать порядка 500 часов голосовой информации. Об этом сообщил директор Института прикладной семиотики Академии наук РТ Ринат Гильмуллин на пресс-конференции ко Дню языков народов России. Среди компаний-интересантов он назвал «Сбербанк», «Яндекс».
«На сегодня нам поручено подготовить единый голосовой датасет (структурированный набор данных, подготовленный для какой-то задачи – РБК Татарстан), который в будущем, надеюсь, в ближайшем, будет использован в различных сценариях. Это и «ГигаЧат» «Сбера», и умные устройства. Еще есть сценарий, связанный с так называемыми ИИ-операторами – это различные кол-центры. На сегодня они очень хорошо реализованы для русского языка, есть примеры, когда пользователь звонит и общается с искусственным интеллектом, практически не подозревая, что все автоматизировано, настолько высок уровень», — рассказал Гильмуллин на пресс-конференции в ИА «Татар-информ».









































