Вы находитесь в общественном пространстве, а не в личном чате. Излагаете свои мысли для всех, но не персонально. Научитесь общаться, и никто к вам невежливо не будет относиться.
ага...Не вежливо (той же монетой) по отношению к другим
Модератор: Glukinho
Вы находитесь в общественном пространстве, а не в личном чате. Излагаете свои мысли для всех, но не персонально. Научитесь общаться, и никто к вам невежливо не будет относиться.
Что то слишком много телодвижений и хайпа. Ощущение что stt + ai + tts не может чего то важного
оно не может в “человеческий” голос. И не может быстро, есть неприятные задержки. С speech-to-speech этого нет.
второе. RAG вам не нужен, если у вас голосовой секретарь, который заявки принимает. Например.
Вот хороший аргумент, я тоже о нём думал. Что можно такой подход использовать в каких то общих задачах где не требуется анализ по базе знаний. Но... Всё же рассчитывал, что затяну народ в обсуждение, как можно использовать RAG с speech to speech =)
https://platform.openai.com/docs/guides/realtime-sip
Теперь и по SIP
Так tools же. Модель подготовит данные и отдаст в tools. Или попросить весь запрос отдать в tools, где в беке будет другая модель, которая сделает всю работу и вернет в первый нужный контекст…
господи, костыли то какие…
и опять же, задержка вернется практически по любому, если только вы не потратили кучу денег на нормальный pipeline…