NLab Marker — платформа для разметки данных для машинного обучения

NLab Marker — платформа для разметки данных для машинного обучения

Компания «Наносемантика» запустила сервис NLab Marker для подготовки данных к распознаванию нейронными сетями.

NLab Marker – это промышленная платформа, готовая к внедрению и эксплуатации на задачах с большими объемами данных, которые нуждаются в специальной ручной обработке: разметке и подготовке специалистами обучающих примеров для алгоритмов машинного обучения. NLab Marker позволяет выделять объекты на видео, расшифровывать аудиозаписи, размечать медицинские снимки. Сервис максимально сокращает время работы специалистов по подготовке данных и количество ошибок при формировании набора обучающих данных.

Станислав Ашманов, генеральный директор компании «Наносемантика», отметил: «Машинное обучение невозможно без обучающих данных – примеров, по которым алгоритмы учатся. Мы, как разработчики алгоритмов ИИ, знаем, насколько важны качественно размеченные данные. Наша команда разработала платформу NLab Marker для себя. Но теперь мы готовы предложить этот продукт рынку, так как видим спрос на промышленные платформы разметки данных, которые позволяют гибко реализовывать любые задачи по разметке и самостоятельно администрировать этот процесс компаниям с сильным отделом Data Science».

Ошибки в датасете критически влияют на качество обучения нейронной сети. Например, обученная нейросеть для видеоаналитики будет пропускать брак на производственной линии или неверно переносить персональные данные из заполненной анкеты в МФЦ. В NLab Marker внедрена система автоматической проверки работы разметчиков на примерах-ловушках (ханипотах). Также контролируются время и объём выполненных заданий. Кроме того, в NLab Marker встроены различные модули для работы с текстом и аудио. Например, модуль для дикторов позволяет им записывать аудио для синтеза речи, а модуль категоризации дает возможность присвоить категорию определенному тексту.

В отличие от аналогов, NLab Marker гарантирует высокую точность подготовки данных, контроль качества на всех этапах процесса разметки и защиту персональных данных, поскольку платформу можно развернуть в защищенном контуре заказчика. Также NLab Marker позволяет вычистить из готового датасета персональные данные, чтобы они не попали в открытый доступ.

В NLab Marker разработана удобная система для организации и управления командой разметки: куратор распределяет задачи и инструкции по руководителям проектов или исполнителям, а также устанавливает индивидуальные сроки выполнения задач под конкретный проект. Это экономит временные и денежные ресурсы компании. Сервис позволяет работать жителям самых отдалённых регионов, безработным, людям с ограниченными возможностями. Не важно, в какой точке мира находится разметчик, главное, чтобы у него был компьютер и доступ в интернет. Это сейчас особенно актуально, ведь в тренде удаленная работа с гибким графиком без привязки к рабочему месту.


Источник: Инновационный центр «Сколково», Пресс-релизы, 8 сентября 2020, Платформа резидента «Сколково» поможет собрать данные для обучения искусственного интеллекта