تولید نریشن طبیعی، دوبله و ساخت صدای اختصاصی دیگر تنها قابلیتهای سایت ElevenLabs نیستند. این پلتفرم اکنون مجموعهای از ابزارهای صوتی را برای تبدیل متن به گفتار، تبدیل گفتار به متن، شبیهسازی و طراحی صدا، تولید موسیقی و افکت صوتی و ساخت عاملهای مکالمهای ارائه میدهد.
مهمتر اینکه مدل Eleven v3 از زبان فارسی پشتیبانی میکند و میتواند متن فارسی را با لحنها و صداهای مختلف بخواند. البته کیفیت تلفظ کلمات، اعداد و نامهای خاص به متن ورودی، صدای انتخابشده و مدل مورد استفاده بستگی دارد.
در ادامه بررسی میکنیم هوش مصنوعی ElevenLabs چیست، چه امکاناتی دارد، کدام مدل برای فارسی مناسب است و نسخه رایگان و پلنهای آن چه تفاوتی دارند.
مشاوره رایگان با ثبتنام در کافه ارز
هوش مصنوعی ElevenLabs چیست؟
ElevenLabs یک پلتفرم هوش مصنوعی برای تولید، پردازش و درک صداست. این سرویس ابتدا با تولید صدای طبیعی و شبیهسازی صدا شناخته شد؛ اما اکنون محصولات آن فقط به Text to Speech محدود نیستند.
کاربر میتواند در سایت ElevenLabs متن را به گفتار تبدیل کند، صدای خودش را شبیهسازی کند، صدایی کاملا جدید بسازد، فایل صوتی را به متن تبدیل کند، ویدئو را به زبان دیگری دوبله کند یا برای پروژه خود موسیقی و افکت صوتی تولید کند.
محصولات اصلی این شرکت در سه مجموعه قرار میگیرند:
- ElevenCreative: ابزارهای تولید و ویرایش صدا، موسیقی، تصویر و ویدئو
- ElevenAgents: ساخت عاملهای هوشمند برای مکالمه صوتی و متنی
- ElevenAPI: اتصال قابلیتهای صوتی ElevenLabs به سایت، اپلیکیشن و نرمافزار
بنابراین، تعریف دقیق هوش مصنوعی ElevenLabs امروز «پلتفرم هوش مصنوعی صوتی و ارتباطی» است، نه صرفا یک سایت تقلید صدا.
همچنین، دیگر هوش مصنوعی در زمینه صوت و صدا که میتوان به آن اشاره کرده هوش مضنوعی Cleanvoice.ai است. کار این ربات حذف نویز و صداهای اضافه از فایل صوتی شماست. برای خرید اکانت Cleanvoice میتوانید از طریق سایت کافه ارز اقدام کنید.
ElevenLabs چگونه صدا تولید میکند؟
مدل تبدیل متن به گفتار، متن ورودی را از نظر ساختار جمله، نشانهگذاری، زبان و زمینه بررسی میکند. سپس براساس صدای انتخابشده، ویژگیهایی مانند آهنگ گفتار، مکث، ریتم، شدت و حالت عاطفی را تولید میکند.
این روش با سیستمهای قدیمی متنخوان تفاوت دارد. ابزارهای قدیمی معمولا کلمات را با الگوی ثابتی تلفظ میکردند؛ اما مدلهای جدید سایت ElevenLabs تلاش میکنند ارتباط میان کلمات و لحن جمله را نیز در خروجی منعکس کنند.
بااینحال، صدای تولیدشده همچنان مصنوعی است. نامهای خاص، اعداد، مخففها و کلمات دارای چند تلفظ ممکن است به اصلاح متن یا چند بار تولید خروجی نیاز داشته باشند.
همچنین، برای آشناشدن با محبوبترین هوش مصنوعی تغییر صدا میتوانید به وبلاگ کافه ارز سر بزنید و در مقاله هوش مصنوعی voice ai اطلاعات کامل را بدست آورید.

امکانات اصلی هوش مصنوعی الون لبز
تبدیل متن به گفتار
Text to Speech اصلیترین قابلیت هوش مصنوعی ElevenLabs است. کاربر متن را وارد و یکی از صداهای موجود را انتخاب میکند تا فایل گفتاری ساخته شود.
این قابلیت برای موارد زیر کاربرد دارد:
- نریشن ویدئوهای یوتیوب و شبکههای اجتماعی
- کتاب و مقاله صوتی
- پادکست
- محتوای آموزشی
- تبلیغات صوتی
- شخصیتهای بازی و انیمیشن
- دستیارها و چتباتهای صوتی
مدل Eleven v3 از گفتار چندگویندهای و اجرای احساسی پشتیبانی میکند و برای دیالوگ، کتاب صوتی و صداگذاری شخصیتها مناسب است.
شبیهسازی صدا
سایت ElevenLabs دو روش متفاوت برای ساخت نسخه دیجیتال صدا ارائه میدهد:
| قابلیت | Instant Voice Cloning | Professional Voice Cloning |
|---|---|---|
| روش ساخت | استفاده مستقیم از نمونه کوتاه | آموزش اختصاصی با فایل صوتی بیشتر |
| زمان آمادهسازی | تقریبا فوری | نیازمند پردازش و آموزش |
| حجم نمونه پیشنهادی | حداقل حدود یک دقیقه | حداقل ۳۰ دقیقه؛ برای نتیجه بهتر بیشتر |
| کیفیت و ثبات | مناسب استفاده عمومی | دقیقتر و مناسب پروژه حرفهای |
| دسترسی | از پلن Starter | از پلن Creator |
| احراز صدا | تأیید داشتن حق استفاده | احراز هویت صوتی الزامی |
در Instant Voice Cloning باید تأیید کنید که حق و رضایت لازم برای استفاده از صدا را دارید. Professional Voice Cloning نیز با فرایند احراز صوتی ساخته میشود و نباید برای تقلید بدون اجازه صدای دیگران استفاده شود.
طراحی صدا با Voice Design
اگر نمیخواهید صدای فرد مشخصی را شبیهسازی کنید، Voice Design امکان ساخت یک صدای جدید را از روی توضیح متنی فراهم میکند. برای مثال، میتوانید سن، جنس صدا، لهجه، ریتم یا حالت گویندگی را توصیف کنید.
این قابلیت برای ساخت شخصیت بازی، انیمیشن، پادکست داستانی و هویت صوتی برند مناسب است.
تبدیل صدا به صدای دیگر + نمونه صدای فارسی
Voice Changer یا Speech to Speech اجرای صوتی کاربر را دریافت و آن را با صدای دیگری بازتولید میکند. در این روش، لحن، ریتم و نحوه اجرای فایل اصلی بهتر از تبدیل مستقیم متن حفظ میشود.
این قابلیت زمانی کاربرد دارد که بازیگر یا تولیدکننده محتوا اجرای مناسبی ضبط کرده، اما میخواهد جنس صدای خروجی تغییر کند.
دوبله و ترجمه ویدئو
Dubbing v2 میتواند محتوای صوتی یا ویدئویی را ترجمه و دوبله کند. این قابلیت تلاش میکند ویژگیهای صدای گوینده و زمانبندی گفتگو را حفظ کند. فارسی نیز در فهرست زبانهای پشتیبانیشده Dubbing v2 قرار دارد.
بنابراین، در سایت ElevenLabs امکان استفاده از فارسی فقط به دریافت فایل فارسی محدود نیست و این زبان در مدلهای جدید تبدیل متن به گفتار، تبدیل گفتار به متن و دوبله پشتیبانی میشود.
تبدیل گفتار به متن با Scribe
Scribe v2 ابزار Speech to Text پلتفرم است و فایل صوتی یا ویدئویی را به متن تبدیل میکند. این مدل بیش از ۹۰ زبان، از جمله فارسی، را پوشش میدهد و امکاناتی مانند تشخیص چند گوینده، ثبت زمان کلمات و تشخیص خودکار زبان را ارائه میکند.
طبق ارزیابی منتشرشده در مستندات هوش مصنوعی ElevenLabs، فارسی در گروه زبانهای دارای دقت بالا در Scribe v2 قرار گرفته است. نتیجه واقعی همچنان به کیفیت ضبط، نویز، لهجه و همزمان صحبتکردن افراد بستگی دارد.
حذف نویز و جداسازی صدا
Voice Isolator صدای گوینده را از موسیقی، نویز محیط و صداهای مزاحم جدا میکند. این قابلیت میتواند پیش از دوبله، شبیهسازی صدا یا تبدیل گفتار به متن استفاده شود.
ساخت افکت صوتی
Sound Effects امکان تولید صداهایی مانند باران، صدای محیط، حرکت خودرو، بازشدن در یا افکت سینمایی را از روی توضیح متنی فراهم میکند.
ساخت موسیقی
Eleven Music برای تولید قطعه موسیقی با یا بدون کلام ساخته شده است. کاربر میتواند سبک، ساختار، فضای احساسی و نوع سازها را در پرامپت مشخص کند. حقوق استفاده تجاری موسیقی به پلن و شرایط حساب وابسته است.
ساخت عامل صوتی
ElevenAgents برای ساخت دستیارهای صوتی و متنی کاربرد دارد. این عاملها میتوانند در تماس تلفنی، چت، ایمیل و واتساپ با مشتری ارتباط برقرار کنند و به سیستمهای کسبوکار متصل شوند.
این بخش بیشتر برای پشتیبانی مشتری، رزرو، فروش، پاسخگویی خودکار و خدمات تلفنی طراحی شده است.
اگه میخوای اشتراک ElevenLabs رو روی اکانت خودت فعال کنی، کافیه هزینه پرداخت با ویزا یا مسترکارت رو ریالی به کافه ارز بسپری و اشتراکت رو فعال کنی.
آیا ElevenLabs از زبان فارسی پشتیبانی میکند؟
بله؛ زبان فارسی بهصورت رسمی در مدل Eleven v3 پشتیبانی میشود. بنابراین کاربران میتوانند متن فارسی را وارد کنند و از آن نریشن، گفتوگو، محتوای آموزشی یا فایل صوتی بسازند. در فهرست رسمی Eleven v3، فارسی با کد fas در میان ۷۴ زبان پشتیبانیشده قرار دارد.
قابلیتهای فارسی هوش مصنوعی ElevenLabs شامل موارد زیر میشوند:
- تبدیل متن فارسی به صدا: با انتخاب مدل Eleven v3 میتوانید متن فارسی را به گفتار تبدیل کنید. این مدل برای تولید صدای احساسی، نریشن و دیالوگ چندگوینده مناسب است.
- تولید گفتوگوی فارسی: قابلیت Text to Dialogue در Eleven v3 امکان ساخت مکالمه میان چند شخصیت را فراهم میکند. نتیجه نهایی به صداهای انتخابشده، نشانهگذاری و ساختار متن بستگی دارد.
- تبدیل صدای فارسی به متن: مدل Scribe v2 میتواند فایل صوتی یا ویدئویی فارسی را رونویسی کند. این ابزار قابلیتهایی مانند تشخیص چند گوینده، ثبت زمان کلمات و شناسایی خودکار زبان را نیز ارائه میدهد.
- دوبله محتوای فارسی: فارسی در فهرست زبانهای پشتیبانیشده Dubbing v2 قرار دارد. بااینحال، بهتر است پیش از اجرای پروژه کامل، یک بخش کوتاه را آزمایش کنید؛ زیرا کیفیت ترجمه و حفظ صدای گوینده ممکن است با توجه به نوع محتوا متفاوت باشد.
- شبیهسازی صدای فارسی: میتوانید صدای خود را با داشتن حق و رضایت لازم شبیهسازی و سپس از آن همراه مدل سازگار با فارسی استفاده کنید. طبیعیبودن نتیجه به کیفیت نمونه صوتی، وضوح ضبط و سبک صحبتکردن بستگی دارد.
نکته مهم این است که همه مدلهای ElevenLabs از فارسی پشتیبانی نمیکنند. برای تولید صدای فارسی باید Eleven v3 را انتخاب کنید؛ زیرا فارسی در فهرست زبانهای Multilingual v2 و Flash v2.۵ قرار ندارد.
وجود پشتیبانی رسمی نیز به معنای تلفظ بینقص تمام کلمات نیست. نامهای خاص، واژههای خارجی، مخففها و اعداد ممکن است به اصلاح نیاز داشته باشند. برای گرفتن خروجی بهتر، جملهها را کوتاه بنویسید، از علائم نگارشی استفاده کنید و اعداد مهم را به حروف تبدیل کنید.
کیفیت صدای فارسی ElevenLabs چگونه است؟
Eleven v3 میتواند متن فارسی را با صدایی طبیعی و حالتهای عاطفی مختلف تولید کند؛ اما کیفیت تمام خروجیها یکسان نیست. صدای انتخابشده، رسمی یا محاورهایبودن متن و وجود واژههای خارجی روی نتیجه اثر میگذارند.
برای بهترشدن خروجی فارسی:
- جملهها را کوتاه و دارای نشانهگذاری صحیح بنویسید
- اعداد مهم را به حروف تبدیل کنید
- مخففها را به شکل تلفظشونده بنویسید
- نامهای خارجی را در صورت نیاز آوانویسی کنید
- برای هر پاراگراف خروجی جداگانه بگیرید
- کلمات چندتلفظی را با شکل سادهتر جایگزین کنید
- پیش از انتشار، کل فایل را با هدفون کنترل کنید
برای مثال، نوشتن «۲۱/۰۷/۲۰۲۶» ممکن است تلفظ نامناسبی ایجاد کند؛ اما عبارت «بیستویک ژوئیه دو هزار و بیستوشش» کنترل بیشتری روی خروجی میدهد.
مقایسه مدلهای تبدیل متن به صدای ElevenLabs

حداکثر متن در هر درخواست نیز به مدل وابسته است:
- Eleven v3: حداکثر ۵ هزار کاراکتر
- Multilingual v2: حداکثر ۱۰ هزار کاراکتر
- Flash v2.۵: حداکثر ۴۰ هزار کاراکتر
این محدودیت مربوط به یک درخواست است و با میزان اعتبار ماهانه حساب تفاوت دارد.
آموزش کار با هوش مصنوعی ElevenLabs
کار با هوش مصنوعی ElevenLabs از طریق مرورگر انجام میشود و برای تولید صدا نیازی به نصب نرمافزار ندارید. کاربران میتوانند متن فارسی را وارد کنند، یکی از صداهای آماده یا شبیهسازیشده را انتخاب کنند و خروجی را در قالب فایل صوتی دریافت کنند.
در ادامه، نحوه استفاده از ElevenLabs فارسی برای تبدیل متن به صدا را مرحلهبهمرحله توضیح میدهیم.
مرحله اول؛ ورود و ثبتنام در سایت ElevenLabs
ابتدا وارد آدرس رسمی elevenlabs.io شوید و گزینه Sign Up را انتخاب کنید. سپس با ایمیل یا حساب گوگل، حساب کاربری خود را بسازید.
پس از ورود، پلن رایگان با ۱۰ هزار اعتبار ماهانه در دسترس قرار میگیرد. این اعتبار برای آزمایش تبدیل متن به گفتار و تولید حدود ۱۰ دقیقه صدا مناسب است.
برای حفظ امنیت حساب، فقط از سایت ElevenLabs یا اپلیکیشن رسمی آن استفاده کنید و اطلاعات ورود یا API Key خود را در اختیار برنامههای غیررسمی قرار ندهید.
مرحله دوم؛ ورود به ابزار Text to Speech
پس از ورود به داشبورد، از بخش ElevenCreative وارد Playground شوید و ابزار Text to Speech را انتخاب کنید. این قسمت برای تبدیل متن نوشتاری به صدای هوش مصنوعی کاربرد دارد.
اگر پروژهای طولانی مانند کتاب صوتی، پادکست یا دوره آموزشی دارید، میتوانید از Studio استفاده کنید؛ اما برای ساخت نریشنهای کوتاه، Text to Speech محیط سادهتر و سریعتری دارد.
مرحله سوم؛ انتخاب مدل Eleven v3 برای زبان فارسی
از بخش انتخاب مدل، Eleven v3 را انتخاب کنید. این مدل از بیش از ۷۰ زبان، از جمله فارسی، پشتیبانی میکند و برای ساخت نریشن احساسی، دیالوگ و صدای چند شخصیت مناسب است.
فارسی در فهرست زبانهای Multilingual v2 و Flash v2.۵ قرار ندارد؛ بنابراین برای تبدیل متن فارسی به صدا نباید این مدلها را انتخاب کنید.
حداکثر ظرفیت Eleven v3 در هر درخواست ۵ هزار کاراکتر است. اگر متن شما طولانیتر است، آن را به چند بخش منطقی تقسیم کنید یا برای مدیریت بهتر پروژه از Studio کمک بگیرید.
مرحله چهارم؛ انتخاب صدای مناسب فارسی
در پایین صفحه روی بخش Voices کلیک کنید و صدای موردنظر خود را انتخاب کنید. صداهای پیشفرض، صداهای موجود در Voice Library، صداهای طراحیشده با Voice Design و صداهای شبیهسازیشده در این بخش قرار میگیرند.
برای گرفتن خروجی طبیعیتر، صدایی را انتخاب کنید که با زبان یا لهجه هدف هماهنگی داشته باشد. طبق راهنمای رسمی ElevenLabs، زبان و لهجه نمونهای که صدا با آن ساخته شده است، روی تلفظ خروجی تأثیر زیادی دارد. ممکن است یک صدای انگلیسی بتواند متن فارسی را بخواند، اما آن را با لهجهای غیرطبیعی اجرا کند.
بهتر است چند صدای مختلف را با یک متن کوتاه فارسی آزمایش کنید و سپس صدایی را که تلفظ و لحن مناسبتری دارد برای پروژه اصلی انتخاب کنید.
مرحله پنجم؛ واردکردن متن فارسی
متن موردنظر را داخل کادر Text to Speech بنویسید یا جایگذاری کنید. ساختار متن، علائم نگارشی و املای کلمات مستقیما روی نحوه خواندن آن تأثیر میگذارند.
برای گرفتن خروجی بهتر از ElevenLabs فارسی نکات زیر را رعایت کنید:
- جملههای بسیار بلند را به چند جمله کوتاهتر تقسیم کنید
- از ویرگول، نقطه، علامت سؤال و علامت تعجب استفاده کنید
- اعداد مهم را به حروف بنویسید
- مخففها را بهشکل قابلتلفظ وارد کنید
- نامهای خارجی را در صورت نیاز به فارسی آوانویسی کنید
- ایموجیها و نمادهای غیرضروری را از متن حذف کنید
- متن را قبل از تولید صدا از نظر غلط املایی بررسی کنید
برای مثال، بهجای نوشتن «۰۲۱۹۱۰۱۴۹۲۰»، بهتر است بنویسید «صفر بیستویک، نهصد و ده، چهارده، نهصد و بیست» یا شماره را متناسب با شیوه خواندن موردنظر بخشبندی کنید.
مرحله ششم؛ تنظیم لحن و نحوه اجرا
تنظیمات در دسترس به مدل انتخابی بستگی دارند. در مدلهای قدیمیتر گزینههایی مانند Stability، Similarity، Style و Speed وجود دارند؛ اما طبق مستندات فعلی، تنظیمات Speed، Similarity و Speaker Boost برای Eleven v3 در دسترس نیستند.
در Eleven v3 میتوانید از علائم نگارشی و Audio Tags برای هدایت نحوه اجرا استفاده کنید. برای مثال:
[whispers]برای زمزمه[laughs]یا[giggles]برای خنده[sarcastically]برای لحن کنایهآمیز- علامت تعجب برای تأکید بیشتر
- سهنقطه برای ایجاد مکث یا اجرای کشیدهتر
تگها را فقط زمانی استفاده کنید که به اجرای خاصی نیاز دارید. استفاده بیشازحد از آنها ممکن است خروجی را شلوغ یا غیرطبیعی کند. همچنین بهتر است ابتدا عملکرد هر تگ را روی یک متن کوتاه آزمایش کنید.
مرحله هفتم؛ ساخت و بررسی صدا
پس از انتخاب صدا و مدل، روی گزینه Generate Speech کلیک کنید. سایت ElevenLabs فایل صوتی را تولید و امکان پخش آن را در همان صفحه فراهم میکند.
قبل از دانلود، کل خروجی را گوش دهید و این موارد را بررسی کنید:
- تلفظ نام افراد و برندها
- خواندن صحیح اعداد و تاریخها
- طبیعیبودن مکثها
- هماهنگی لحن با موضوع
- یکسانبودن سرعت اجرا
- تلفظ کلمات فارسی و انگلیسی
- وجود نویز یا اشکال صوتی
خروجیهای ElevenLabs قطعی و کاملا یکسان نیستند؛ یعنی ممکن است با همان متن و صدا، اجرای کمی متفاوتی تولید شود. اگر متن و تنظیمات را تغییر ندهید، طبق مستندات رسمی ممکن است برای هر محتوا تا دو بازتولید رایگان در اختیار شما قرار بگیرد. وضعیت رایگانبودن بازتولید پیش از تولید نمایش داده میشود.
مرحله هشتم؛ دریافت فایل صوتی
اگر از نتیجه راضی هستید، گزینه Download را انتخاب کنید. صفحه رسمی ElevenLabs فارسی امکان دریافت خروجی MP3 یا انتقال آن به Studio را ارائه میدهد.
فرمت و کیفیت قابل دریافت به پلن و روش استفاده بستگی دارد. MP3 فرمت معمول برای پادکست، نریشن و شبکههای اجتماعی است. خروجیهای حرفهایتر مانند PCM و MP3 با نرخ ۱۹۲ کیلوبیتبرثانیه در پلنهای بالاتر و بعضی روشهای API ارائه میشوند.
ElevenLabs رایگان چه امکاناتی دارد؟
پلن ElevenLabs رایگان ماهانه ۱۰ هزار اعتبار در اختیار کاربر قرار میدهد. این میزان برای حدود ۱۰ دقیقه تبدیل متن به گفتار کافی است؛ اما مصرف واقعی به مدل و ابزار انتخابشده بستگی دارد.
نسخه رایگان شامل امکاناتی مانند موارد زیر است:
- تبدیل متن به گفتار
- تبدیل گفتار به متن
- طراحی صدا
- تولید افکت صوتی
- تولید موسیقی
- دسترسی محدود به Studio
- استفاده از API
اعتبارها میان تمام محصولات مشترکاند. اگر بخشی از اعتبار را برای دوبله، موسیقی یا Voice Changer مصرف کنید، اعتبار کمتری برای Text to Speech باقی میماند.
پلن رایگان مجوز تجاری کامل ندارد. برای کسب درآمد از فایل تولیدشده یا استفاده از آن در پروژه تجاری باید شرایط پلن پولی و مالکیت متن، صدا و محتوای ورودی را بررسی کنید.
همچنین، با استفاده از هوش مصنوعی Fliki میتوانید ایدههای خلاقانهتری را به واقعیت تبدیل کنید و محتوای صوتی و تصویری با کیفیت بالا ایجاد کنید. این ابزار قدرتمند امکانات بسیاری برای ایجاد محتوای منحصر بهفرد فراهم میکند و به شما کمک میکند تا در هنر و خلاقیت خود به اوج برسید. پیشنهاد میکنیم با مطالعه مقاله مرتبط به آن، کار با این ابزار را نیز یاد بگیرید.

مزایای هوش مصنوعی ElevenLabs
- پشتیبانی Eleven v3 از فارسی و بیش از ۷۰ زبان
- تولید صدای طبیعی و دارای حالت عاطفی
- شبیهسازی فوری و حرفهای صدا
- امکان طراحی صدای کاملا جدید
- دوبله و ترجمه ویدئو
- تبدیل گفتار فارسی به متن
- تولید موسیقی و افکت صوتی
- ابزار Studio برای پروژههای طولانی
- API برای توسعهدهندگان
- اپلیکیشن رسمی موبایل
- ابزارهای ایمنی و احراز صدا
محدودیتهای ElevenLabs
- اعتبار نسخه رایگان محدود است
- مجوز تجاری از پلن Starter آغاز میشود
- شبیهسازی حرفهای صدا به پلن Creator نیاز دارد
- تلفظ نامها و اعداد فارسی همیشه دقیق نیست
- کیفیت شبیهسازی به کیفیت نمونه صوتی وابسته است
- مدلهای سریع Flash فعلا فارسی را پوشش نمیدهند
- تولید چندباره یک متن میتواند اعتبار مصرف کند
- استفاده بدون رضایت از صدای دیگران مجاز نیست
- صدای AI جایگزین قطعی گوینده انسانی در تمام پروژهها نیست
قیمت و مقایسه پلنهای هوش مصنوعی ElevenLabs
ElevenLabs یک پلن رایگان و چند اشتراک پولی برای تولیدکنندگان محتوا، کاربران حرفهای، تیمها و سازمانها ارائه میدهد. قیمتهای زیر براساس صفحه رسمی ElevenLabs و در تاریخ ۱۵ ژوئیه ۲۰۲۶ بررسی شدهاند.
| پلن | پرداخت ماهانه | پرداخت سالانه | اعتبار ماهانه | امکانات و کاربرد |
|---|---|---|---|---|
| Free | رایگان | رایگان | ۱۰ هزار | حدود ۱۰ دقیقه تولید صدا، تبدیل متن به گفتار، تبدیل گفتار به متن، طراحی صدا، موسیقی، افکت صوتی و ۳ پروژه Studio؛ مناسب آزمایش سرویس و استفاده شخصی |
| Starter | ۶ دلار | ۶۰ دلار در سال؛ معادل ماهانه ۵ دلار | ۳۰ هزار | حدود ۳۰ دقیقه تولید صدا، مجوز تجاری، شبیهسازی فوری صدا، Dubbing Studio، استفاده تجاری از موسیقی و ۲۰ پروژه Studio؛ مناسب تولیدکنندگان محتوای کمحجم |
| Creator | ۲۲ دلار؛ در حال حاضر ماه اول ۱۱ دلار | ۲۲۰ دلار در سال؛ معادل ماهانه ۱۸.۳۳ دلار | ۱۲۱ هزار | حدود ۱۲۱ دقیقه تولید صدا، تمام امکانات Starter، شبیهسازی حرفهای صدا و امکان تهیه اعتبار اضافه؛ مناسب پادکسترها، گویندگان و تولیدکنندگان حرفهای |
| Pro | ۹۹ دلار | ۹۹۰ دلار در سال؛ معادل ماهانه ۸۲.۵۰ دلار | ۶۰۰ هزار | حدود ۶۰۰ دقیقه تولید صدا، خروجی ۱۹۲ کیلوبیتبرثانیه و فایل PCM با نرخ ۴۴.1kHz از طریق API؛ مناسب استودیوها و کاربران پرمصرف |
| Scale | ۲۹۹ دلار | ۲۹۹۰ دلار در سال؛ معادل ماهانه ۲۴۹.۱۷ دلار | ۱.۸ میلیون | حدود ۱۸۰۰ دقیقه تولید صدا، ۳ حساب کاربری، همکاری تیمی و امکان ساخت ۳ صدای حرفهای؛ مناسب آژانسها و تیمهای تولید محتوا |
| Business | ۹۹۰ دلار | ۹۹۰۰ دلار در سال؛ معادل ماهانه ۸۲۵ دلار | ۶ میلیون | حدود ۶ هزار دقیقه تولید صدا، ۱۰ حساب کاربری، ۱۰ صدای حرفهای و پردازش گستردهتر؛ مناسب شرکتها و مجموعههای بزرگ |
| Enterprise | قیمت سفارشی | قیمت سفارشی | سفارشی | تعداد کاربر و اعتبار سفارشی، SSO، ظرفیت پردازش بیشتر، پشتیبانی اولویتدار و شرایط اختصاصی امنیتی؛ مناسب سازمانهای بزرگ |
کدام پلن ElevenLabs را انتخاب کنیم؟
- اگر فقط میخواهید کیفیت ElevenLabs فارسی و مدل Eleven v3 را آزمایش کنید، پلن Free کافی است.
- اگر قصد انتشار نریشن در یوتیوب، اینستاگرام، تبلیغات یا پروژههای درآمدزا را دارید، حداقل Starter لازم است؛ چون مجوز تجاری از این پلن آغاز میشود.
- اگر به Professional Voice Cloning نیاز دارید، باید Creator یا پلن بالاتر را انتخاب کنید.
- اگر کیفیت ۱۹۲ کیلوبیتبرثانیه یا خروجی PCM از طریق API برایتان اهمیت دارد، Pro گزینه مناسبتری است.
- برای کار چندنفره، Scale یا Business انتخاب منطقیتری هستند؛ زیرا حسابهای تیمی و چند صدای حرفهای ارائه میدهند.
اعتبارهای هر پلن میان تمام ابزارها مشترکاند. بنابراین استفاده از دوبله، موسیقی، Voice Changer، Voice Isolator یا تبدیل گفتار به متن از همان اعتبار ماهانه کم میکند. مقدار دقیقههای جدول نیز تقریبی است و براساس استفاده از Text to Speech محاسبه شده؛ مدل و ابزار انتخابی میتواند میزان مصرف را تغییر دهد.
در اشتراک سالانه، هزینه ۱۰ ماه را پرداخت میکنید و عملا دو ماه رایگان دریافت میشود. قیمتها به دلار هستند و مالیات، عوارض و هزینههای احتمالی پرداخت در آنها محاسبه نشدهاند. تخفیف ماه اول Creator نیز پیشنهاد موقت است و ممکن است تغییر کند.
برای خرید اشتراک ElevenLabs میتوانید هزینه پلن موردنظر را با ویزا کارت یا مسترکارت پرداخت کنید. اگر کارت بانکی بینالمللی ندارید، با خدمت ویزاکارت و مسترکارت کافه ارز هزینه را ریالی بپردازید و اکانت خود را ارتقا دهید.
شبیهسازی صدا در ElevenLabs قانونی است؟
قانونیبودن به مالکیت صدا، رضایت فرد و نوع استفاده بستگی دارد. داشتن فایل صوتی یک شخص به معنی داشتن اجازه شبیهسازی صدای او نیست.
در زمان ساخت Instant Voice Clone باید داشتن حق و رضایت لازم را تأیید کنید. Professional Voice Cloning نیز احراز صوتی دارد. سایت ElevenLabs اعلام کرده است که شبیهسازی بعضی صداهای مشهور یا پرخطر را مسدود میکند و برای شناسایی خروجیهای خود از AI Speech Classifier استفاده میکند.
از صدای شبیهسازیشده نباید برای جعل هویت، کلاهبرداری، انتشار اطلاعات گمراهکننده یا آسیبزدن به دیگران استفاده کرد.
آیا خرید اشتراک ElevenLabs ارزش دارد؟
اگر فقط میخواهید کیفیت صدای فارسی را آزمایش کنید، ابتدا از پلن رایگان و مدل Eleven v3 استفاده کنید. برای نریشن تجاری، شبیهسازی فوری صدا و دوبله حرفهای، Starter نقطه شروع کاربردیتری است.
Creator زمانی ارزش دارد که به شبیهسازی حرفهای صدای خود و اعتبار بیشتر نیاز داشته باشید. پلنهای Pro، Scale و Business بیشتر برای تولید مستمر، خروجی استودیویی، کار تیمی یا استفاده سازمانی طراحی شدهاند.
پیش از خرید، این چهار مورد را مشخص کنید:
- چند دقیقه صدا در ماه تولید میکنید؟
- آیا استفاده شما تجاری است؟
- به شبیهسازی فوری نیاز دارید یا حرفهای؟
- فقط TTS میخواهید یا دوبله، موسیقی و Voice Changer نیز استفاده میکنید؟
نتیجهگیری
ElevenLabs هوش مصنوعی یک پلتفرم جامع برای تولید و پردازش صداست. تبدیل متن به گفتار، شبیهسازی و طراحی صدا، دوبله، تبدیل گفتار به متن، ساخت موسیقی، افکت صوتی و عامل مکالمهای از مهمترین امکانات آن هستند.
مهمترین تغییر برای کاربران ایرانی، پشتیبانی رسمی Eleven v3 از زبان فارسی است. برای استفاده از ElevenLabs فارسی باید مدل سازگار را انتخاب و تلفظ نامها، اعداد و اصطلاحات تخصصی را پیش از انتشار بررسی کنید.
پلن رایگان برای ارزیابی کیفیت مناسب است؛ اما مجوز تجاری، شبیهسازی صدا و ظرفیت بیشتر در پلنهای پولی ارائه میشوند. برای تهیه اشتراک نیز میتوانید از خدمات خرید اکانت هوش مصنوعی کافه ارز استفاده کنید.
سوالات متداول
۱.آیا ElevenLabs از فارسی پشتیبانی میکند؟
بله. Eleven v3 از متن و گفتار فارسی پشتیبانی میکند. Scribe v2 نیز میتواند صدای فارسی را به متن تبدیل کند و فارسی در Dubbing v2 هم وجود دارد.
۲.بهترین مدل ElevenLabs برای فارسی کدام است؟
Eleven v3 مدل مناسب تولید صدای فارسی است. Multilingual v2 و Flash v2.۵ در فهرست فعلی زبانهای خود فارسی ندارند.
۳.آیا ElevenLabs رایگان است؟
بله. پلن رایگان ماهانه ۱۰ هزار اعتبار ارائه میدهد؛ اما مجوز تجاری و Instant Voice Cloning از پلن Starter در دسترس قرار میگیرند.
۴.آیا میتوان صدای هر فردی را شبیهسازی کرد؟
فقط در صورتی که حق قانونی و رضایت لازم را داشته باشید. Professional Voice Cloning نیز به احراز صوتی نیاز دارد.
۵.آیا ElevenLabs برنامه موبایل دارد؟
بله. اپلیکیشن رسمی آن برای Android و iOS منتشر شده و نسخه تحت وب نیز در سایت ElevenLabs در دسترس است.
۶.آیا نسخه مودشده ElevenLabs اعتبار نامحدود میدهد؟
خیر. اعتبار و پردازش روی سرورهای ElevenLabs کنترل میشوند. نسخههای غیررسمی ممکن است اطلاعات حساب، فایلهای صوتی یا API Key کاربر را سرقت کنند.
منبع:
- مدلها و زبانهای پشتیبانیشده ElevenLabs
- قیمت رسمی ElevenLabs
- راهنمای Voice Cloning
- قوانین شبیهسازی حرفهای صدا
- مجوز استفاده تجاری از خروجیها



4 پاسخ
سلام وقت بخیر
من توی سایت elevenlab میرم موقع ثبت نام قبول نمیکنه با جیمیل وارد شه
سلام وقت بخیر.
میتونید برای کسب اطلاع در این خصوص با تیم پشتیبانی در ارتباط باشید.
https://cafearz.com/chat
درود، با خرید اکانت کریتور elevenlabs ویدئو با حداکثر چند دقیقه و چقدر حجم رو میتونم به انگلیسی دوبله کنم؟ تشکر
سلام وقت بخیر
با توجه به اینکه امکانات و قیمت هر پلن متفاوته بهتره به سایت اصلی مراجعه کنید.