RealtimeSTT(20ms単位でWebSocketで送信) → LLM → RealtimeTTS のそれぞれのモジュールがカスタマイズできて、割り込みなども実装されているっぽい?
これWhisperとLLM箇所をOpenAIのバックエンド叩いてもリアルタイム性担保できるのかな?GPU非依存で外部サービスつなぎこむことで、どこまでできるか試してみたい。そもそも日本語いけるのかも含めて
github.com/KoljaB/Realt...
RealtimeSTT(20ms単位でWebSocketで送信) → LLM → RealtimeTTS のそれぞれのモジュールがカスタマイズできて、割り込みなども実装されているっぽい?
これWhisperとLLM箇所をOpenAIのバックエンド叩いてもリアルタイム性担保できるのかな?GPU非依存で外部サービスつなぎこむことで、どこまでできるか試してみたい。そもそも日本語いけるのかも含めて
github.com/KoljaB/Realt...
🔗 aidailypost.com/news/inworld...
🔗 aidailypost.com/news/inworld...