این بخش بهصورت خودکار گردآوری شده است. برای مطالعه کامل خبر، به منبع اصلی مراجعه کنید.
به گزارش خبرگزاری خبرآنلاین و براساس گزارش دیجیاتو، متا مدل جدیدی برای رونویسی لحظهای صدا با نام Muse Voice Transcribe معرفی کرد که به گفته این شرکت میتواند گفتار بیش از ۲۰ گوینده را تشخیص دهد و همزمان با چند زبان کار کند. این مدل همچنین میتواند هنگام تغییر زبان در میانه جمله، زبانهای مختلف را تشخیص دهد و متن را بر همان اساس رونویسی کند.Muse Voice Transcribe اولین مدل پردازش صوتی بلادرنگ متا است و برای تبدیل گفتار به متن در حالت استریم طراحی شده است. این مدل قابلیتهایی مانند تفکیک گویندگان و تشخیص زمان پایان گفتار را در یک مدل واحد ارائه میکند. مدل تبدیل گفتار به متن متا: Muse Voice Transcribe
«مارک زاکربرگ»، مدیرعامل متا، نمونهای از عملکرد این مدل را در شبکه اجتماعی ایکس منتشر کرده است. در این ویدیو، سیستم میتواند چند گوینده را از یکدیگر تشخیص دهد و هنگام صحبتکردن افراد به زبانهای مختلف، زبان گفتار را بهصورت خودکار تغییر دهد.
این مدل همچنین از قابلیتی موسوم به تغییر زبانی پشتیبانی میکند؛ به این معنا که اگر فردی در یک جمله از واژههای چند زبان استفاده کند، سیستم میتواند این تغییر را تشخیص دهد و جمله را رونویسی کند.
زاکربرگ درباره نحوه عملکرد مدل توضیح … …





















