Созданные наборы данных представлены в таблице на странице . Некоторые таблицы можно упорядочить, нажав на заголовки столбцов. Нажатие на имя набора данных открывает для выбранного элемента. Наборы данных можно переименовать или удалить из меню с тремя точками на странице обзора.
Меню можно использовать для открытия , отображения фильтров очистки и истории очистки, а также для загрузки или удаления набора данных.
В случае, если очистка завершается с ошибкой и имеет статус ошибки, нажмите «Повторить» в меню , чтобы предпринять еще одну попытку.
Обзор предоставляет информацию об очистке с вкладками для просмотра примененных фильтров и истории очистки выбранного набора данных. Распределение фильтров очистки отображается вместе со всеми метаданными.
Вкладки:
-
Отображает обзор этого набора данных и распределение фильтров очистки.
-
Если очистка выполнялась только один раз, отображаются результаты фильтров, выбранных для первоначального обучения. Если было выполнено несколько очисток, отображается конфигурация для последней очистки.
Чтобы изменить фильтры, выполните следующие действия:
-
В правой части страницы нажмите редактировать фильтры .
Откроется страница .
-
Нажмите редактировать на фильтре, который требует изменения.
Откроются параметры фильтра.
-
Внесите необходимые изменения и нажмите сохранить.
Изменения отображаются, и кнопка активируется.
-
Нажмите Reclean, чтобы обновить очистку.
-
-
Представлена таблица очисток.
Оценочный набор данных
Это отображается только в том случае, если целью набора данных является обучение машинного перевода (МТ). Количество сегментов, выбранных для оценки пользовательской модели машинного перевода (МТ), определяется меньшим из двух следующих критериев:
-
10% от общего набора данных.
-
Фиксированное количество в 3 000 сегментов.
Эти сегменты предназначены исключительно для оценки и не используются во время этапа обучения модели.