Artwork

المحتوى المقدم من Team PolyAI. يتم تحميل جميع محتويات البودكاست بما في ذلك الحلقات والرسومات وأوصاف البودكاست وتقديمها مباشرة بواسطة Team PolyAI أو شريك منصة البودكاست الخاص بهم. إذا كنت تعتقد أن شخصًا ما يستخدم عملك المحمي بحقوق الطبع والنشر دون إذنك، فيمكنك اتباع العملية الموضحة هنا https://ar.player.fm/legal.
Player FM - تطبيق بودكاست
انتقل إلى وضع عدم الاتصال باستخدام تطبيق Player FM !

040: The multilayered anatomy of a generative AI voice assistant

25:40
 
مشاركة
 

Manage episode 428408490 series 3533896
المحتوى المقدم من Team PolyAI. يتم تحميل جميع محتويات البودكاست بما في ذلك الحلقات والرسومات وأوصاف البودكاست وتقديمها مباشرة بواسطة Team PolyAI أو شريك منصة البودكاست الخاص بهم. إذا كنت تعتقد أن شخصًا ما يستخدم عملك المحمي بحقوق الطبع والنشر دون إذنك، فيمكنك اتباع العملية الموضحة هنا https://ar.player.fm/legal.

Send us a text

It's getting technical up in here! Kylie welcomes PolyAI CTO & Co-Founder Shawn Wen to the show to discuss the complexities of building high-quality voice AI systems. From the limitations of large language models (LLMs) to the nuances across each layer of the tech stack, they'll cover setting up audio channels, streaming speech recognition, voice activity detection, and the uniquely global challenge of handling different accents and languages. Shawn gives away a bit of our secret sauce, while underscoring the importance of adapting technology to user characteristics and enterprise demands.

Follow PolyAI on LinkedIn
Watch this and other episodes of the Deep Learning pod on YouTube

  continue reading

51 حلقات

Artwork
iconمشاركة
 
Manage episode 428408490 series 3533896
المحتوى المقدم من Team PolyAI. يتم تحميل جميع محتويات البودكاست بما في ذلك الحلقات والرسومات وأوصاف البودكاست وتقديمها مباشرة بواسطة Team PolyAI أو شريك منصة البودكاست الخاص بهم. إذا كنت تعتقد أن شخصًا ما يستخدم عملك المحمي بحقوق الطبع والنشر دون إذنك، فيمكنك اتباع العملية الموضحة هنا https://ar.player.fm/legal.

Send us a text

It's getting technical up in here! Kylie welcomes PolyAI CTO & Co-Founder Shawn Wen to the show to discuss the complexities of building high-quality voice AI systems. From the limitations of large language models (LLMs) to the nuances across each layer of the tech stack, they'll cover setting up audio channels, streaming speech recognition, voice activity detection, and the uniquely global challenge of handling different accents and languages. Shawn gives away a bit of our secret sauce, while underscoring the importance of adapting technology to user characteristics and enterprise demands.

Follow PolyAI on LinkedIn
Watch this and other episodes of the Deep Learning pod on YouTube

  continue reading

51 حلقات

كل الحلقات

×
 
Loading …

مرحبًا بك في مشغل أف ام!

يقوم برنامج مشغل أف أم بمسح الويب للحصول على بودكاست عالية الجودة لتستمتع بها الآن. إنه أفضل تطبيق بودكاست ويعمل على أجهزة اندرويد والأيفون والويب. قم بالتسجيل لمزامنة الاشتراكات عبر الأجهزة.

 

دليل مرجعي سريع