تابلوی رتبه‌بندی تبدیل گفتار مغولی به متن
ElevenLabs Scribe v1Operating point: scribe_v1

ElevenLabs Scribe v1 — معیار تبدیل گفتار مغولی به متن

نتایج واقعی از ElevenLabs Scribe v1 Batch API (نقطه عملیاتی بهبودیافته، زبان mn) ارزیابی‌شده روی 4 مجموعه داده مغولی و 265 نمونه صوتی. هر عدد زیر اندازه‌گیری شده است — بازاریابی نیست. WER، سرعت و قیمت همان‌گونه که هستند نمایش داده می‌شوند، با صداقتی بی‌پرده.

زبان:MNتفکیک گویندگان:noneنمونه‌ها:265اجرا:Aug 19, 2026, 4:48 PMاندپوینت:https://api.elevenlabs.io/v1/speech-to-text
06710072.9%
دقت

265/265 نمونه پیاده‌سازی شد · ۱۰۰٪ موفقیت

06710027.1%
نرخ خطای کلمه

کمتر بهتر است · روی 265 نمونه

معیارهای اصلی
نرخ خطای نویسه10.8%
میانگین ضریب سرعت2.14×ضریب زمان واقعی
ضریب سرعت کل2.14×
میانگین تأخیر به ازای نمونه3.3s
کل صوت پردازش‌شده1849.3s30.8 دقیقه

قیمت

قیمت فهرست ElevenLabs Scribe v1 برای پیاده‌سازی دسته‌ای. بدون تخفیف یا نرخ توافقی — نرخ خام به ازای هر دقیقه.

به ازای ۱۰۰۰ دقیقه
$6.7
دسته‌ای
به ازای دقیقه
$0.0067
موثر
به ازای ۱۰۰۰ دقیقه (این 30.8 دقیقه)
$12.39
هزینه
متن‌باز؟
انحصاری

منبع قیمت: قیمت‌های عمومی ElevenLabs Scribe v1. Duudlaga Flow فقط برای زمینه نمایش داده می‌شود — این صفحه ElevenLabs Scribe v1 را جدا می‌کند تا عدد با محصول ما بزرگ‌نمایی نشود.

WER و CER به ازای مجموعه داده

نرخ‌های خطای کلمه و نویسه به ازای مجموعه داده. کمتر بهتر است — و این اعداد واقعی ElevenLabs Scribe v1 هستند که در Common Voice 24 ضعیف‌اند.

Common Voice 24 (MN)
Source dataset →
WER
30%
CER
10.9%
Shunya Labs Mongolian Speech
Source dataset →
WER
18.7%
CER
5.9%
Common Voice 20 (MN)
Source dataset →
WER
31.3%
CER
13.1%
Modern Voice
WER
28.3%
CER
12.4%
WERCER

خلاصه مجموعه داده‌ها

دقت، سرعت و زمان تجمیعی برای هر مجموعه داده.

مجموعه دادهSourceنمونه‌هاموفقیتWERCERدقتسرعتصوت (ث)پردازش (ث)
Common Voice 24 (MN)Hugging Face →5959/5930%10.9%70.0%2.35×330.6s140.9s
Shunya Labs Mongolian SpeechHugging Face →6060/6018.7%5.9%81.3%2.02×645.1s319.9s
Common Voice 20 (MN)Hugging Face →5454/5431.3%13.1%68.7%2.41×269.8s111.8s
Modern Voice9292/9228.3%12.4%71.7%2.06×603.8s293.2s

WER در برابر سرعت — به ازای نمونه

هر نقطه یک نمونه صوتی است. جای ایده‌آل پایین-چپ است (خطای کم، سریع). ElevenLabs Scribe v1 در بسیاری از نمونه‌های Common Voice 24 خطای بالایی دارد.

نتایج به ازای نمونه

حقیقت مرجع همان‌گونه که هست در ستون «مورد انتظار» نمایش داده می‌شود. ستون نتیجه فقط کلماتی را که ElevenLabs Scribe v1 اشتباه کرده قرمز برجسته می‌کند — بدون خط‌خوردگی/جابه‌جایی، فقط اشتباه‌ها.

265 ردیف
قرمزکلمه اشتباه در نتیجهسادهدرست پیاده‌سازی شدستون «مورد انتظار» همان‌گونه که هست به عنوان حقیقت مرجع نمایش داده می‌شود
#صدانمونهمجموعه دادهمورد انتظار (حقیقت مرجع)نتیجه ElevenLabs Scribe v1WERCERI/D/S
1btsee_0001Common Voice 24 (MN)Гэхдээ амьсгал хураахаасаа өмнө танд мэдэж байгаагаа хэлье.Гэхдээ амьсгал хураахаасаа өмнө танд мэдэж байгаагаа хэлье0.0%0.0%0/0/0
2btsee_0002Common Voice 24 (MN)Надад заяасан аз жаргал гэдэг ердөө гуравхан сарын хугацаатай байсан гэж үү?Надад заяасан аж чиргал гэдэг ердөө гуравхан сарын хугацаатай байсан гэж үү?16.7%4.0%0/0/2
3btsee_0003Common Voice 24 (MN)Одоо бид өөрсдөө өвчин эмгэгээсээ салахыг хичээцгээе.Одоо бид өөрсдөө өвчийн эмнэлгээсээ салхийг хичээцгээе.42.9%11.5%0/0/3
4btsee_0004Common Voice 24 (MN)Би бол голдуу хээрээр гэр, хэцээр дэр хийж явдаг хүн.Би бол голдуй хээрээр гэр, хицээр дэр хийж явдаг хүн20.0%3.9%0/0/2
5btsee_0005Common Voice 24 (MN)Хан хурмаст уурлаж, Болдоггүй Бор өвгөнийг хор луугаараа ниргүүлэхээр явуулжээ.Хан хурмаст уулзсан болдоггүй бор өвгөнө хоёр луугаар нэргүүлэхээр явагджээ60.0%18.2%0/0/6
6btsee_0006Common Voice 24 (MN)Алив наашаа ороод ир гээд гэртээ оров.Алив наашаа ороод ир гээд гэртээ оров.0.0%0.0%0/0/0
7btsee_0007Common Voice 24 (MN)Өө өндөр дээдэс таны тухайд би баталж чадахгүй.Өө, өндөр дээдс таны тухайд би бодол ч чадахгүй37.5%13.0%1/0/2
8btsee_0008Common Voice 24 (MN)Харин гурав дахь удаагаас эхлэн хүмүүсийг сонирхож эхлэв.Харин гурав дахь удаагаас эхлэн хүмүүсийг сонирхож эхлэв.0.0%0.0%0/0/0
9btsee_0009Common Voice 24 (MN)Та нар очингуутаа шөл л өгч үз.Та нар очингуутаа шүлэл өгч үз28.6%6.7%0/1/1
10btsee_0010Common Voice 24 (MN)Ерөөсөө литр үйлдвэрээсээ салаагүй явсан юм чинь.Эрүүлсээл үйлдвэрээсээ салаагүй явсан юм чинь.28.6%20.8%0/1/1
صفحه 1 از 27

روش‌شناسی

این اعداد چگونه به دست آمدند.

ارائه‌دهنده: ElevenLabs Scribe v1 (ElevenLabs Scribe v1 hosted transcription (language_code=mn).).

اندپوینت https://api.elevenlabs.io/v1/speech-to-text. زبان mn. Operating point scribe_v1. تفکیک گویندگان none.

مجموعه‌های داده: Common Voice 24 (MN), Shunya Labs Mongolian Speech, Common Voice 20 (MN), Modern Voice — 265 نمونه، مجموعاً 1849.3s صوت.

Dataset source URLs:

معیارها: WER و CER با هم‌ترازی استاندارد لون‌اشتاین کلمه/نویسه و با نرمال‌سازی حروف بزرگ‌/کوچک و نقطه‌گذاری محاسبه می‌شوند. دقت = ۱۰۰ − WER. ضریب سرعت = مدت صوت ÷ زمان پردازش (× زمان واقعی). همه درخواست‌ها فراخوانی واقعی Batch API ElevenLabs Scribe v1 هستند، نه کش‌شده یا شبیه‌سازی‌شده.

برجسته‌سازی تفاوت‌ها: ستون نتیجه با حقیقت مرجع هم‌تراز می‌شود و هر جایگزینی و درجی را قرمز می‌کند. حذف‌ها (کلمات غایب در نتیجه) در ستون نتیجه نمایش داده نمی‌شوند — ستون «مورد انتظار» کل حقیقت مرجع را همان‌گونه که هست دربردارد.

تولیدشده توسط ElevenLabs Scribe v1 Benchmark Runner · ElevenLabs Scribe v1 Batch API v2 · اجرا Aug 19, 2026, 4:48 PM