Перейти к содержанию

Читайте оценки сходства как подсказки

Для кого: Для тех, кто сравнивает оценки результатов между вкладками. Задача: Предотвратить ошибочное смешение шкал. Тип: Понятие

Оценка отвечает на вопрос: «Каких кандидатов первыми проверить с этими настройками?» Внутри одного поиска она показывает, что один трек оказался выше другого. Она не оценивает музыкальное качество и не обещает удачный переход. У разных вкладок также нет общей шкалы.

Практический результат оценки — порядок прослушивания. Начните сверху, сохраняйте полезные исключения и остановитесь, когда кандидатов достаточно.

Поиск MERT по референсным трекам

MERT сравнивает сохранённые аудиоэмбеддинги выбранных референсных треков (seed) и кандидатов. Оценка полезна для ранжирования ближайших треков по сходству аудио с референсными треками.

Поиск SONARA

SONARA сравнивает значения признаков, применяет веса микшера и необязательное направленное смещение. Её легче объяснить, чем MERT, но это всё ещё модель сходства. Повышая вес, вы меняете вопрос ранжирования.

Текстовый поиск CLAP

CLAP сравнивает текстовые эмбеддинги с сохранёнными аудиоэмбеддингами. Исходные оценки текст–аудио часто ниже оценок аудио–аудио по референсному треку. В зависимости от запросов и содержимого фонотеки полезные совпадения могут находиться около 0.35..0.55.

При включённом наборе Negative видимая оценка выражает контраст, а не вероятность.

Оценки SET

Smart Set Builder сочетает MERT, аудиосигнал CLAP, эмбеддинг MAEST, широкое сходство SONARA, уверенность перехода, разнообразие, кривые энергии и BPM, давление повторов исполнителя и необязательные предпочтения классификаторов. Итоговая оценка нужна для упорядочивания предварительного списка при выбранных настройках.

Оценки Hybrid

Hybrid использует взвешенное слияние взаимных рангов (reciprocal-rank fusion) по включённым источникам, необязательный штраф за риск перехода и настройки классификаторов. Панель подробностей объясняет поддержку источников и риск, но не доказывает качество окончательного сведения.

Оценки Reference Compare

LAB Reference Compare показывает результаты CLAP, MERT, MuQ, MAEST и SONARA отдельными группами для одного референсного трека. Сначала сравнивайте оценки внутри группы одной модели. Высокие оценки MERT, CLAP audio и SONARA — связанные подсказки для прослушивания, но не одно и то же измерение.

Сохранённые вердикты LAB — ручные метки обратной связи для пары и конкретного источника модели. Они фиксируют услышанное, не становятся автоматической истиной и не переписывают оценку модели.

Пороги Audio Dedup

min_similarity в Audio Dedup — порог фильтрации аудиосодержимого по сохранённым эмбеддингам MERT, MAEST и CLAP. Его нельзя сравнивать со сходством в текстовом поиске CLAP.

Как читать оценки на практике

  • Сравнивайте баллы внутри одной вкладки при одинаковых настройках.
  • Будьте осторожны после изменения порогов, весов или запросов.
  • Прослушивайте аудио до добавления в сет.
  • Не переносите порог одной вкладки как правило безопасности в другую.
  • Используйте LAB, чтобы сравнить семейства моделей на слух до выбора сигнала для референсного трека.

Документация локального инструмента анализа музыкальной библиотеки.