تابلوی رتبه‌بندی تبدیل گفتار مغولی به متن
ElevenLabs Scribe v2Operating point: scribe_v2

ElevenLabs Scribe v2 — معیار تبدیل گفتار مغولی به متن

نتایج واقعی از ElevenLabs Scribe v2 Batch API (نقطه عملیاتی بهبودیافته، زبان mn) ارزیابی‌شده روی 4 مجموعه داده مغولی و 265 نمونه صوتی. هر عدد زیر اندازه‌گیری شده است — بازاریابی نیست. WER، سرعت و قیمت همان‌گونه که هستند نمایش داده می‌شوند، با صداقتی بی‌پرده.

زبان:MNتفکیک گویندگان:noneنمونه‌ها:265اجرا:Aug 19, 2026, 6:13 PMاندپوینت:https://api.elevenlabs.io/v1/speech-to-text
06710072.9%
دقت

265/265 نمونه پیاده‌سازی شد · ۱۰۰٪ موفقیت

06710027.1%
نرخ خطای کلمه

کمتر بهتر است · روی 265 نمونه

معیارهای اصلی
نرخ خطای نویسه10.6%
میانگین ضریب سرعت1.51×ضریب زمان واقعی
ضریب سرعت کل1.51×
میانگین تأخیر به ازای نمونه4.7s
کل صوت پردازش‌شده1849.3s30.8 دقیقه

قیمت

قیمت فهرست ElevenLabs Scribe v2 برای پیاده‌سازی دسته‌ای. بدون تخفیف یا نرخ توافقی — نرخ خام به ازای هر دقیقه.

به ازای ۱۰۰۰ دقیقه
$3.7
دسته‌ای
به ازای دقیقه
$0.0037
موثر
به ازای ۱۰۰۰ دقیقه (این 30.8 دقیقه)
$6.84
هزینه
متن‌باز؟
انحصاری

منبع قیمت: قیمت‌های عمومی ElevenLabs Scribe v2. Duudlaga Flow فقط برای زمینه نمایش داده می‌شود — این صفحه ElevenLabs Scribe v2 را جدا می‌کند تا عدد با محصول ما بزرگ‌نمایی نشود.

WER و CER به ازای مجموعه داده

نرخ‌های خطای کلمه و نویسه به ازای مجموعه داده. کمتر بهتر است — و این اعداد واقعی ElevenLabs Scribe v2 هستند که در Common Voice 24 ضعیف‌اند.

Common Voice 24 (MN)
Source dataset →
WER
28.5%
CER
10.6%
Shunya Labs Mongolian Speech
Source dataset →
WER
19.2%
CER
6.3%
Common Voice 20 (MN)
Source dataset →
WER
29.4%
CER
11.4%
Modern Voice
WER
29.8%
CER
13%
WERCER

خلاصه مجموعه داده‌ها

دقت، سرعت و زمان تجمیعی برای هر مجموعه داده.

مجموعه دادهSourceنمونه‌هاموفقیتWERCERدقتسرعتصوت (ث)پردازش (ث)
Common Voice 24 (MN)Hugging Face →5959/5928.5%10.6%71.5%1.33×330.6s248.1s
Shunya Labs Mongolian SpeechHugging Face →6060/6019.2%6.3%80.8%1.74×645.1s370.3s
Common Voice 20 (MN)Hugging Face →5454/5429.4%11.4%70.6%1.41×269.8s190.7s
Modern Voice9292/9229.8%13%70.2%1.45×603.8s416s

WER در برابر سرعت — به ازای نمونه

هر نقطه یک نمونه صوتی است. جای ایده‌آل پایین-چپ است (خطای کم، سریع). ElevenLabs Scribe v2 در بسیاری از نمونه‌های Common Voice 24 خطای بالایی دارد.

نتایج به ازای نمونه

حقیقت مرجع همان‌گونه که هست در ستون «مورد انتظار» نمایش داده می‌شود. ستون نتیجه فقط کلماتی را که ElevenLabs Scribe v2 اشتباه کرده قرمز برجسته می‌کند — بدون خط‌خوردگی/جابه‌جایی، فقط اشتباه‌ها.

265 ردیف
قرمزکلمه اشتباه در نتیجهسادهدرست پیاده‌سازی شدستون «مورد انتظار» همان‌گونه که هست به عنوان حقیقت مرجع نمایش داده می‌شود
#صدانمونهمجموعه دادهمورد انتظار (حقیقت مرجع)نتیجه ElevenLabs Scribe v2WERCERI/D/S
1btsee_0001Common Voice 24 (MN)Гэхдээ амьсгал хураахаасаа өмнө танд мэдэж байгаагаа хэлье.Гэхдээ амьсгал хураахаасаа өмнө танд мэдэж байгаагаа хэлье0.0%0.0%0/0/0
2btsee_0002Common Voice 24 (MN)Надад заяасан аз жаргал гэдэг ердөө гуравхан сарын хугацаатай байсан гэж үү?Надад заяасан аж жаргал гэдэг ердөө гуравхан сарын хугацаатай байсан гэж үү?8.3%1.3%0/0/1
3btsee_0003Common Voice 24 (MN)Одоо бид өөрсдөө өвчин эмгэгээсээ салахыг хичээцгээе.Одоо бид өөрсдөө өвчин эмнэлгээсээ салахыг хичээцгээе.14.3%3.8%0/0/1
4btsee_0004Common Voice 24 (MN)Би бол голдуу хээрээр гэр, хэцээр дэр хийж явдаг хүн.Би бол голдуй хээрээр гэр, хэцээр дэр хийж явдаг хүн.10.0%2.0%0/0/1
5btsee_0005Common Voice 24 (MN)Хан хурмаст уурлаж, Болдоггүй Бор өвгөнийг хор луугаараа ниргүүлэхээр явуулжээ.Хан хурмаст уулс болдоггүй бороо өгнө. Хоёр луугаар нэргүүлэхээр явагч70.0%26.0%0/0/7
6btsee_0006Common Voice 24 (MN)Алив наашаа ороод ир гээд гэртээ оров.Алив наашаа ороод ир гээд гэртээ оров.0.0%0.0%0/0/0
7btsee_0007Common Voice 24 (MN)Өө өндөр дээдэс таны тухайд би баталж чадахгүй.Өө, өндөр дээдс таны тухайд би ботолг чадахгүй25.0%8.7%0/0/2
8btsee_0008Common Voice 24 (MN)Харин гурав дахь удаагаас эхлэн хүмүүсийг сонирхож эхлэв.Харин гурав дахь удаагаас эхлэн хүмүүсийг сонирхож эхлэв.0.0%0.0%0/0/0
9btsee_0009Common Voice 24 (MN)Та нар очингуутаа шөл л өгч үз.Та нар очгондоо шүлэл өгч үз42.9%30.0%0/1/2
10btsee_0010Common Voice 24 (MN)Ерөөсөө литр үйлдвэрээсээ салаагүй явсан юм чинь.Эрүүлсээл үйлдвэрээсээ салаагүй явсан юм чинь28.6%20.8%0/1/1
صفحه 1 از 27

روش‌شناسی

این اعداد چگونه به دست آمدند.

ارائه‌دهنده: ElevenLabs Scribe v2 (ElevenLabs Scribe v2 hosted transcription (language_code=mn).).

اندپوینت https://api.elevenlabs.io/v1/speech-to-text. زبان mn. Operating point scribe_v2. تفکیک گویندگان none.

مجموعه‌های داده: Common Voice 24 (MN), Shunya Labs Mongolian Speech, Common Voice 20 (MN), Modern Voice — 265 نمونه، مجموعاً 1849.3s صوت.

Dataset source URLs:

معیارها: WER و CER با هم‌ترازی استاندارد لون‌اشتاین کلمه/نویسه و با نرمال‌سازی حروف بزرگ‌/کوچک و نقطه‌گذاری محاسبه می‌شوند. دقت = ۱۰۰ − WER. ضریب سرعت = مدت صوت ÷ زمان پردازش (× زمان واقعی). همه درخواست‌ها فراخوانی واقعی Batch API ElevenLabs Scribe v2 هستند، نه کش‌شده یا شبیه‌سازی‌شده.

برجسته‌سازی تفاوت‌ها: ستون نتیجه با حقیقت مرجع هم‌تراز می‌شود و هر جایگزینی و درجی را قرمز می‌کند. حذف‌ها (کلمات غایب در نتیجه) در ستون نتیجه نمایش داده نمی‌شوند — ستون «مورد انتظار» کل حقیقت مرجع را همان‌گونه که هست دربردارد.

تولیدشده توسط ElevenLabs Scribe v2 Benchmark Runner · ElevenLabs Scribe v2 Batch API v2 · اجرا Aug 19, 2026, 6:13 PM