Читайте оценки сходства как подсказки
Для кого: Для тех, кто сравнивает оценки результатов между вкладками. Задача: Предотвратить ошибочное смешение шкал. Тип: Понятие
Оценка отвечает на вопрос: «Каких кандидатов первыми проверить с этими настройками?» Внутри одного поиска она показывает, что один трек оказался выше другого. Она не оценивает музыкальное качество и не обещает удачный переход. У разных вкладок также нет общей шкалы.
Практический результат оценки — порядок прослушивания. Начните сверху, сохраняйте полезные исключения и остановитесь, когда кандидатов достаточно.
Поиск MERT по референсным трекам
MERT сравнивает сохранённые аудиоэмбеддинги выбранных референсных треков (seed) и кандидатов. Оценка полезна для ранжирования ближайших треков по сходству аудио с референсными треками.
Поиск SONARA
SONARA сравнивает значения признаков, применяет веса микшера и необязательное направленное смещение. Её легче объяснить, чем MERT, но это всё ещё модель сходства. Повышая вес, вы меняете вопрос ранжирования.
Текстовый поиск CLAP
CLAP сравнивает текстовые эмбеддинги с сохранёнными аудиоэмбеддингами. Исходные оценки текст–аудио часто ниже оценок аудио–аудио по референсному треку. В зависимости от запросов и содержимого фонотеки полезные совпадения могут находиться около 0.35..0.55.
При включённом наборе Negative видимая оценка выражает контраст, а не вероятность.
Оценки SET
Smart Set Builder сочетает MERT, аудиосигнал CLAP, эмбеддинг MAEST, широкое сходство SONARA, уверенность перехода, разнообразие, кривые энергии и BPM, давление повторов исполнителя и необязательные предпочтения классификаторов. Итоговая оценка нужна для упорядочивания предварительного списка при выбранных настройках.
Оценки Hybrid
Hybrid использует взвешенное слияние взаимных рангов (reciprocal-rank fusion) по включённым источникам, необязательный штраф за риск перехода и настройки классификаторов. Панель подробностей объясняет поддержку источников и риск, но не доказывает качество окончательного сведения.
Оценки Reference Compare
LAB Reference Compare показывает результаты CLAP, MERT, MuQ, MAEST и SONARA отдельными группами для одного референсного трека. Сначала сравнивайте оценки внутри группы одной модели. Высокие оценки MERT, CLAP audio и SONARA — связанные подсказки для прослушивания, но не одно и то же измерение.
Сохранённые вердикты LAB — ручные метки обратной связи для пары и конкретного источника модели. Они фиксируют услышанное, не становятся автоматической истиной и не переписывают оценку модели.
Пороги Audio Dedup
min_similarity в Audio Dedup — порог фильтрации аудиосодержимого по сохранённым эмбеддингам MERT, MAEST и CLAP. Его нельзя сравнивать со сходством в текстовом поиске CLAP.
Как читать оценки на практике
- Сравнивайте баллы внутри одной вкладки при одинаковых настройках.
- Будьте осторожны после изменения порогов, весов или запросов.
- Прослушивайте аудио до добавления в сет.
- Не переносите порог одной вкладки как правило безопасности в другую.
- Используйте LAB, чтобы сравнить семейства моделей на слух до выбора сигнала для референсного трека.