Портал Prochukotku.ru
·
1 минута
Языки коренных народов Чукотки, включая эскимосский и эвенский, интегрируют в "Яндекс.Переводчик"
Сетевое издание Информационное агентство «Чукотка»
Двадцать четвертого сентября, в четверг, в Анадыре подходит к своему логическому завершению вторая Межрегиональная научно-практическая конференция под названием "Родные языки Чукотки: образование, культура, цифровизация, сохранение". Свой финальный день форум начал с предметной дискуссии о переводе национальных наречий в цифровой формат. Как передает информационное агентство "Чукотка", в ближайшем будущем функционал сервиса "Яндекс.Переводчик" пополнится чукотским языком, а следом за ним в систему будут интегрированы эскимосский и эвенский.
Масштабная работа по оцифровке языков коренных малочисленных народов Чукотки была инициирована в 2024 году. Изначально соответствующая инициатива была презентована на управленческой мастерской "Сенеж" командой, в состав которой вошла представительница автономного округа Людмила Данилова.
"Проект по созданию цифровых платформ стал победителем конкурса и был поддержан Министерством по развитию Дальнего Востока и Арктики. На Чукотке ему помогают правительство региона, Фонд "Купол". Создан специальный сайт – "Национальный корпус чукотского языка". К началу этого года команда Чукотского арктического научного центра собрала, обработала и разместила там 100 тысяч словоформ на чукотском языке", – сообщила Людмила Данилова.
Существенную помощь в реализации задуманного оказало чукотское отделение Сбербанка: banka приобрела и передала активистам специализированное сканирующее оборудование. Благодаря ему удалось перевести в цифровой вид более тридцати изданий, выпущенных в период с 1940-х по 1980-е годы. Однако большинство существующих сегодня шрифтов не адаптированы под уникальные символы чукотской азбуки, из-за чего этап ручной коррекции пока остается неизбежным.
"Дальше мы приводим всё к единообразию – ставим наши значки, буквы и символы. Затем в программе Excel размещаем параллельный перевод, который потом передаём в "Яндекс.Переводчик". Каждое предложение переводится в точности, как оно написано", – поделилась деталями работы председатель общественной организации "Чычеткин вэтгав", сотрудник Чукотского арктического научного центра Виктория Кавры.
О ходе реализации масштабной инициативы "Языки народов России" в формате видеообращения поведал ее заместитель руководителя Андрей Михеев. Он уточнил, что активная фаза стартовала в 2024 году, и тогда возможности "Яндекс.Переводчика" были расширены за счет семи языков малых народов. На сегодняшний день их число возросло до двадцати четырех, и данный перечень продолжает неуклонно расти.
"В ближайших планах у нас некоторые языки Дагестана, которых очень много. И, не секрет, что в списке чукотский и корякский язык. Это не случайность и не только естественное следствие развития технологий искусственного интеллекта. Это следствие целенаправленной деятельности, которую Яндекс введёт совместно с Федеральным агентством по делам национальностей и с многочисленными партнёрами в разных регионах России. Чаще всего спрашивают, когда "Алиса" заговорит на том или ином языке, но это очень сложная задача. Большое спасибо вам и вашим коллегам, которые предоставили данные для того, чтобы мы могли попробовать обучать эти модели", – отметил Андрей Михеев.
В настоящее время энтузиасты, занимающиеся чукотским направлением, уже приступили к обработке второй сотни тысяч словоформ. Параллельно с этим развернулась работа и над эскимосским языком, для которого также удалось подготовить первоначальную базу из ста тысяч слов. Как подчеркнул руководитель Чукотского арктического научного центра Денис Литовка, в самое ближайшее время специалисты начнут формировать и лингвистический корпус эвенского языка.
Фото: Чукотский арктический научный центр
Масштабная работа по оцифровке языков коренных малочисленных народов Чукотки была инициирована в 2024 году. Изначально соответствующая инициатива была презентована на управленческой мастерской "Сенеж" командой, в состав которой вошла представительница автономного округа Людмила Данилова.
"Проект по созданию цифровых платформ стал победителем конкурса и был поддержан Министерством по развитию Дальнего Востока и Арктики. На Чукотке ему помогают правительство региона, Фонд "Купол". Создан специальный сайт – "Национальный корпус чукотского языка". К началу этого года команда Чукотского арктического научного центра собрала, обработала и разместила там 100 тысяч словоформ на чукотском языке", – сообщила Людмила Данилова.
Существенную помощь в реализации задуманного оказало чукотское отделение Сбербанка: banka приобрела и передала активистам специализированное сканирующее оборудование. Благодаря ему удалось перевести в цифровой вид более тридцати изданий, выпущенных в период с 1940-х по 1980-е годы. Однако большинство существующих сегодня шрифтов не адаптированы под уникальные символы чукотской азбуки, из-за чего этап ручной коррекции пока остается неизбежным.
"Дальше мы приводим всё к единообразию – ставим наши значки, буквы и символы. Затем в программе Excel размещаем параллельный перевод, который потом передаём в "Яндекс.Переводчик". Каждое предложение переводится в точности, как оно написано", – поделилась деталями работы председатель общественной организации "Чычеткин вэтгав", сотрудник Чукотского арктического научного центра Виктория Кавры.
О ходе реализации масштабной инициативы "Языки народов России" в формате видеообращения поведал ее заместитель руководителя Андрей Михеев. Он уточнил, что активная фаза стартовала в 2024 году, и тогда возможности "Яндекс.Переводчика" были расширены за счет семи языков малых народов. На сегодняшний день их число возросло до двадцати четырех, и данный перечень продолжает неуклонно расти.
"В ближайших планах у нас некоторые языки Дагестана, которых очень много. И, не секрет, что в списке чукотский и корякский язык. Это не случайность и не только естественное следствие развития технологий искусственного интеллекта. Это следствие целенаправленной деятельности, которую Яндекс введёт совместно с Федеральным агентством по делам национальностей и с многочисленными партнёрами в разных регионах России. Чаще всего спрашивают, когда "Алиса" заговорит на том или ином языке, но это очень сложная задача. Большое спасибо вам и вашим коллегам, которые предоставили данные для того, чтобы мы могли попробовать обучать эти модели", – отметил Андрей Михеев.
В настоящее время энтузиасты, занимающиеся чукотским направлением, уже приступили к обработке второй сотни тысяч словоформ. Параллельно с этим развернулась работа и над эскимосским языком, для которого также удалось подготовить первоначальную базу из ста тысяч слов. Как подчеркнул руководитель Чукотского арктического научного центра Денис Литовка, в самое ближайшее время специалисты начнут формировать и лингвистический корпус эвенского языка.
Фото: Чукотский арктический научный центр
Нет комментариев
Чтобы написать комментарий, нужно зарегистрироваться!
Войти