هوش مصنوعی Eleven v3 معرفی شد؛ تولید طبیعی‌ترین صدا برای انتقال احساسات [تماشا کنید]

مدل Eleven v3 که از فارسی هم پشتیبانی می‌کند، امکان بیان طبیعی احساسات مانند خنده و نجوا را در گفتار مصنوعی فراهم می‌سازد.

کد خبر: 10907

زمان انتشار: 30 دسامبر 2025 - 03:56 ق.ظ -

2 بازدید

شرکت Elevenlabs جدیدترین مدل تبدیل متن به گفتار خود را با نام Eleven v3 (Alpha) معرفی کرده است که تمرکز اصلی آن بر تولید صداهای مصنوعی با بیان احساسات طبیعی‌تر و واقعی‌تر است. این مدل از فارسی هم پشتیبانی می‌کند.

این مدل توانایی بازسازی طبیعی‌تر احساسات متنوعی مانند نجوا، خنده، آه‌کشیدن و واکنش‌های هیجانی را نسبت به نسخه‌های قبلی دارد. هدف اصلی Elevenlabs در این نسخه برطرف‌کردن مشکل انتقال احساسات در صداهای مصنوعی بوده است؛ زیرا پیشتر فقط کیفیت صدا اهمیت داشت اما اکنون با بازطراحی کامل، این مدل می‌تواند صداهایی با احساسات واقعی‌تر و واکنش‌های طبیعی‌تر تولید کند.

قابلیت‌های مدل هوش مصنوعی Eleven v3

یکی از ویژگی‌های برجسته Eleven v3 پشتیبانی از بیش از 70 زبان ازجمله فارسی همچنین امکان اجرای طبیعی و روان گفتگوهای چندنفره است. کاربران می‌توانند از طریق API جدید متن‌های ساختاریافته را که شامل نوبت هر گوینده می‌شود، به مدل ارسال کنند و مدل خودکار مدیریت تغییر نوبت گوینده، تحولات احساسی و حتی قطع کلام‌ها را بر عهده می‌گیرد. این قابلیت برای تولید دیالوگ‌های چندصدایی بسیار کاربردی است و امکان تولید گفتگوهای پیچیده و طبیعی را فراهم می‌کند.

کنترل شیوه بیان صداها از طریق برچسب‌های صوتی درون متن نیز از دیگر امکانات مهم Eleven v3 است. این برچسب‌ها که در قالب کروشه‌های کوچک و حروف کوچک نوشته می‌شوند، مانند [sighs] (آه کشیدن)، [excited] (هیجان‌زده) یا [whispers] (نجواکردن)، به کاربران اجازه می‌دهند احساسات مختلف و لحن گفتار را مستقیم تنظیم کنند. حتی می‌توان چندین برچسب را کنار هم قرار داد تا بیان دقیق‌تر و ظریف‌تری ایجاد شود؛ مثلاً We did it! [happily][shouts][laughs] («ما موفق شدیم! [شادی][فریاد][خنده]»).

به گفته شرکت Elevenlabs، این مدل بیشتر برای کاربردهای حرفه‌ای مانند تولید فیلم، کتاب صوتی و رسانه‌های دیجیتال طراحی شده است و نسخه نهایی API عمومی آن به‌زودی عرضه خواهد شد. هم‌اکنون Eleven v3 روی وب‌سایت شرکت در دسترس است و تا پایان ژوئن (خرداد) 80 درصد تخفیف برای استفاده از اپلیکیشن ارائه می‌شود. بااین‌حال، برای کاربردهای بلادرنگ یا گفتگوهای زنده، مدل‌های v2.5 Turbo یا Flash همچنان توصیه می‌شوند؛ زیرا نسخه فعلی v3 برای این موارد بهینه نشده و نسخه بلادرنگ آن در دست توسعه است.

همچنین کلون‌های صوتی حرفه‌ای (Professional Voice Clones) فعلاً با این نسخه سازگاری کامل ندارند و نسبت به نسخه‌های قبلی کیفیت کمتری ارائه می‌دهند؛ بنابراین برای پروژه‌هایی که به ویژگی‌های بیانی جدید نیاز دارند، استفاده از کلون‌های صوتی آنی (Instant Voice Clones) یا صداهای ساخته‌شده پیشنهاد می‌شود.

نوشته شده توسط: دیجیاتو

اخبار مرتبط

کپی شد

اشتراک گذاری

برترین مطالب روز

امروز جدید
پربازدید اخیر
پربحث این هفته

پردیس نیوز

پردیس نیوز

اسکوچیچ از تراکتور جدا شد

تبریک سخنگوی وزارت خارجه به مناسبت انتخابات پارلمانی در بنگلادش

دیدار وزیر کشور با سفیر امارات

پاسخ رئیس‌جمهور به پرسش‌های شمس‌الواعظین، عبدالکریمی و جلائی‌پور

سردار تنگسیری: اشراف ۲۴ ساعته بر تنگه هرمز داریم

سقف تسهیلات ازدواج و فرزندآوری در بودجه ۱۴۰۵ به ۴۷۵ همت رسید

دعوت ستادکل نیروهای مسلح ازمردم برای حضور در گرامیداشت شهدای فتنه اخیر

جشن بهار یادآور پیوندهای دیرینه فرهنگی دو تمدن کهن ایران و چین است

ماجرای مشکوک زمین‌لرزه‌های پی در پی در عسلویه چیست؟

جزئیات آتش‌سوزی گسترده در حوالی پالایشگاه نیک گاز تبریز / ماجرا چیست؟

درباره مـا

به‌روز فان از سال ۱۳۹۱ رسانه‌ای در حوزه ارائه روزانه مطالب سرگرم‌کننده و فان است که با انتشار محتوای جذاب، متنوع و مناسب برای علاقه‌مندان به سرگرمی و تفریح سالم در فضای دیجیتال، لحظه‌های شاد، خلاق و اجتماعی و ترندهای روز را برای مخاطبان روایت می‌کند.

اطلاعات به‌روز فان

مطالب مدرن روز

اخبار فرهنگ و جامعه

خبرنامه و شبکه های اجتماعی

برای دریافت جدیدترین مطالب ایمیل خود را وارد کنید.
هیچ ایمیل تبلیغاتی ارسال نخواهد شد.

عضویت در خبرنامه

آخرین خبرها را میتوانید از طریق اپلیکیشن موبایل دریافت کنید

تمامی حقوق مادی و معنوی این وب‌سایت متعلق به مجله «به‌روز فان» است و استفاده از مطالب آن تنها برای مقاصد غیرتجاری و با ذکر منبع بلامانع می‌باشد.