مایکروسافت از سه مدل هوش مصنوعی مقرون‌به‌صرفه برای تبدیل گفتار به متن، تولید صدا و تصویر رونمایی کرد
مایکروسافت از سه مدل هوش مصنوعی پیشرفته و مقرون‌به‌صرفه رونمایی کرد: MAI-Transcribe-۱ (تبدیل گفتار به متن با دقت بالا در ۲۵ زبان)، MAI-Voice-۱ (تولید صدای طبیعی) و MAI-Image-۲ (تولید تصاویر با سرعت دو برابر).

مایکروسافت از سه مدل هوش مصنوعی مقرون‌به‌صرفه برای تبدیل گفتار به متن، تولید صدا و تصویر رونمایی کرد.

مایکروسافت از سه مدل هوش مصنوعی پیشرفته و مقرون‌به‌صرفه رونمایی کرد: MAI-Transcribe-۱ (تبدیل گفتار به متن با دقت بالا در ۲۵ زبان)، MAI-Voice-۱ (تولید صدای طبیعی) و MAI-Image-۲ (تولید تصاویر با سرعت دو برابر). مدل Transcribe در آزمون FLEURS از Whisper-large-v3 اوپن‌ای‌آی و گوگل پیشی گرفته است.

منبع: رادیو پیام