Татарстане собирают данные (датасет) для создания голосовых ИИ-помощников на татарском языке
В Татарстане собирают данные (датасет) для создания голосовых ИИ-помощников на татарском языке. На данный момент заинтересованным компаниям готовы передать порядка 500 часов голосовой информации. Об этом сообщил директор Института прикладной семиотики Академии наук РТ Ринат Гильмуллин на пресс-конференции ко Дню языков народов России. Среди компаний-интересантов он назвал Сбербанк, Яндекс.
На сегодня нам поручено подготовить единый голосовой датасет (структурированный набор данных, подготовленный для какой-то задачи РБК Татарстан), который в будущем, надеюсь, в ближайшем, будет использован в различных сценариях. Это и ГигаЧат Сбера, и умные устройства. Еще есть сценарий, связанный с так называемыми ИИ-операторами это различные кол-центры. На сегодня они очень хорошо реализованы для русского языка, есть примеры, когда пользователь звонит и общается с искусственным интеллектом, практически не подозревая, что все автоматизировано, настолько высок уровень, рассказал Гильмуллин на пресс-конференции в ИА Татар-информ.
РБК Татарстан в MAКС | TG | ВК