Страница 2761 из 2800

Cообщение от   Telegram-канал anonymous

Добавлено: 23 июн 2026, 12:43
notify_ded_bot

Дмитрий подводит к выбору рабочей конфигурации: по демозаписи K-средние и спектральная кластеризация дали одинаковую картину и метрики, а VBx оказался чуть лучше по частоте, DR и confusion, поэтому в итоге выбрали именно его. Отдельно он отмечает важный практический момент: в open-source есть готовые варианты с PLDA, но тюнинг обычно завязан на конкретный эмбеддер, поэтому PLDA от одной модели не всегда корректно переносится на другую — и это может повлиять на качество, если заменить Redimnet на ResNet101.

Подключайтесь к прямой трансляции по ссылке: https://voxlink.ru/webinars/kak-obognat-kommerческие-api

Задавайте спикеру вопросы в чате с хэштэгом #вопрос

Cообщение от   Telegram-канал anonymous

Добавлено: 23 июн 2026, 12:47
notify_ded_bot
Дмитрий подводит к выбору рабочей конфигурации: по демозаписи K-средние и спектральная кластеризация дали одинаковую картину и метрики, а VBx оказался чуть лучше по частоте, DR и confusion, поэтому в итоге выбрали именно его. Отдельно он отмечает важный практический момент: в open-source есть готовые варианты с PLDA, но тюнинг обычно завязан на конкретный эмбеддер, поэтому PLDA от одной модели не всегда корректно переносится на другую — и это может повлиять на качество, если заменить Redimnet на ResNet101.

Подключайтесь к прямой трансляции по ссылке: https://voxlink.ru/webinars/kak-obognat-kommerческие-api

Задавайте спикеру вопросы в чате с хэштэгом #вопрос

#вопрос а точнее вопросы:

- при сравнении RTF фактора на VAD указывалось что Pyannote VAD запускался на GPU, получается, сравнение не корректное с производительностью остальных моделей, которые запускались на CPU?
- VAD всегда использовали с параметрами по умолчанию или каким-то образом подстраивали их? если подстраивали то как подбирали наиболее универсальные параметры
- производится ли какая-либо нормализация аудио перед обработкой?
- как вы боретесь с тем, что еще и сама модель STT дает неверные временные метки слов? отдельный прогон aligment модели поверх результата STT или как-то еще?

ну и главный #вопрос: как объяснить людям далеким от всех этих тонкостей, почему для диаризации не достаточно просто разделить аудио на левый и правый каналы и распознать их по отдельности, а надо заморачиваться с этими всеми VAD, векторами, кластеризацией и прочими страшными для рядового гражданина словами? систематически сталкиваюсь с тем, что люди искренне не верят что нельзя так просто взять и распознать все поканально и получить идеальную траснкрибацию с диаризацией (даже без VAD, просто разрезать аудио на два канала и скормить условному висперу отдельно левый и отдельно правый)

Cообщение от   Telegram-канал anonymous

Добавлено: 23 июн 2026, 12:51
notify_ded_bot

#вопрос А есть ли у вас локальный синтезатор Тext to Speech (TTS), уровня и качества Яндекса ? ?

Cообщение от   Telegram-канал anonymous

Добавлено: 23 июн 2026, 12:57
notify_ded_bot

#вопрос Дмитрий как считаете на каком обьеме записей, локальная речевая аналитика становиться выгоднее для бизнеса, при прочих равных условиях чем API ?

Cообщение от   Telegram-канал Ping_TTL

Добавлено: 23 июн 2026, 13:14
notify_ded_bot

#Вопрос
Не была затронута тема "рапознавание эмоций" и подобное, планируется ли доклад на эту тему?

Cообщение от   Telegram-канал Ping_TTL

Добавлено: 23 июн 2026, 13:21
notify_ded_bot

#Вопрос
Слышал про распределенные LLM - это распараллеливание одной задачи между многими ПК в локальной сети предприятия.
Имеется ли опыт в этом?

Cообщение от   Telegram-канал anonymous

Добавлено: 23 июн 2026, 13:25
notify_ded_bot

Вебинар «У нас есть речевая аналитика дома: как обогнать коммерческие API и не разориться » подошел к концу

Спасибо, что были с нами!

Запись вебинара будет доступна по ссылке: https://voxlink.ru/webinars/kak-obognat-kommercheskie-api

Напоминаем, что 4 июля собираем IT-комьюнити на день без созвонов, рабочих чатов и бесконечного контекста - https://getnet.pro/paintball26/

Уже совсем скоро - с 24 по 26 сентября, состоится большой трёх-дневный форум Asterconf`26
Если у вас есть интересная тема, пишите нам, или оставляйте заявку на сайте!

Cообщение от   Telegram-канал Itservice46

Добавлено: 23 июн 2026, 13:35
notify_ded_bot

Больше нет решений чтобы атс работала с белыми списками на мобильных ?

Cообщение от   Telegram-канал anonymous

Добавлено: 23 июн 2026, 16:55
notify_ded_bot

Лучшим вопросом вебинара "У нас есть речевая аналитика дома: как обогнать коммерческие API и не разориться " спикер выбрал вопрос участника под ником — Artem R !

" Замеряли ли качество VBx-подхода для детекции оверлэпов? Сравнивали ли непосредственно с моделям детекции оверлэпов или SpeakerCount моделями? "

Мерч-набор от VoxLink в скором времени будет отправлен победителю!

Благодарим всех за активное участие!
Следите за новостями, чтобы не пропустить анонс следующего вебинара

Cообщение от   Telegram-канал Uncle_Ra

Добавлено: 23 июн 2026, 18:37
notify_ded_bot

Пришло письмо-рассылка от Flavio Goncalves. Может кому-то пригодится книжечка.