تابلوی رتبه‌بندی تبدیل گفتار مغولی به متن
OmniASR LLM-1BOperating point: omniASR_LLM_1B_v2 (lang=khk_Cyrl)

OmniASR LLM-1B — معیار تبدیل گفتار مغولی به متن

نتایج واقعی از OmniASR LLM-1B Batch API (نقطه عملیاتی بهبودیافته، زبان mn) ارزیابی‌شده روی 4 مجموعه داده مغولی و 265 نمونه صوتی. هر عدد زیر اندازه‌گیری شده است — بازاریابی نیست. WER، سرعت و قیمت همان‌گونه که هستند نمایش داده می‌شوند، با صداقتی بی‌پرده.

زبان:MNتفکیک گویندگان:noneنمونه‌ها:265اجرا:Aug 25, 2026, 4:14 AMاندپوینت:local (omnilingual-asr)
06710066.2%
دقت

265/265 نمونه پیاده‌سازی شد · ۱۰۰٪ موفقیت

06710033.8%
نرخ خطای کلمه

کمتر بهتر است · روی 265 نمونه

معیارهای اصلی
نرخ خطای نویسه14.2%
میانگین ضریب سرعت0.27×ضریب زمان واقعی
ضریب سرعت کل0.27×
میانگین تأخیر به ازای نمونه26.6s
کل صوت پردازش‌شده1849.3s30.8 دقیقه

قیمت

قیمت فهرست OmniASR LLM-1B برای پیاده‌سازی دسته‌ای. بدون تخفیف یا نرخ توافقی — نرخ خام به ازای هر دقیقه.

به ازای ۱۰۰۰ دقیقه
$0
دسته‌ای
به ازای دقیقه
$0.0000
موثر
به ازای ۱۰۰۰ دقیقه (این 30.8 دقیقه)
$0.00
هزینه
متن‌باز؟
انحصاری

منبع قیمت: قیمت‌های عمومی OmniASR LLM-1B. Duudlaga Flow فقط برای زمینه نمایش داده می‌شود — این صفحه OmniASR LLM-1B را جدا می‌کند تا عدد با محصول ما بزرگ‌نمایی نشود.

WER و CER به ازای مجموعه داده

نرخ‌های خطای کلمه و نویسه به ازای مجموعه داده. کمتر بهتر است — و این اعداد واقعی OmniASR LLM-1B هستند که در Common Voice 24 ضعیف‌اند.

Common Voice 24 (MN)
Source dataset →
WER
36.6%
CER
15.5%
Shunya Labs Mongolian Speech
Source dataset →
WER
22.9%
CER
6.9%
Common Voice 20 (MN)
Source dataset →
WER
37.2%
CER
18%
Modern Voice
WER
36.9%
CER
15.8%
WERCER

خلاصه مجموعه داده‌ها

دقت، سرعت و زمان تجمیعی برای هر مجموعه داده.

مجموعه دادهSourceنمونه‌هاموفقیتWERCERدقتسرعتصوت (ث)پردازش (ث)
Common Voice 24 (MN)Hugging Face →5959/5936.6%15.5%63.4%0.3×330.6s1088.7s
Shunya Labs Mongolian SpeechHugging Face →6060/6022.9%6.9%77.1%0.25×645.1s2583.1s
Common Voice 20 (MN)Hugging Face →5454/5437.2%18%62.8%0.29×269.8s931.7s
Modern Voice9292/9236.9%15.8%63.1%0.26×603.8s2304.1s

WER در برابر سرعت — به ازای نمونه

هر نقطه یک نمونه صوتی است. جای ایده‌آل پایین-چپ است (خطای کم، سریع). OmniASR LLM-1B در بسیاری از نمونه‌های Common Voice 24 خطای بالایی دارد.

نتایج به ازای نمونه

حقیقت مرجع همان‌گونه که هست در ستون «مورد انتظار» نمایش داده می‌شود. ستون نتیجه فقط کلماتی را که OmniASR LLM-1B اشتباه کرده قرمز برجسته می‌کند — بدون خط‌خوردگی/جابه‌جایی، فقط اشتباه‌ها.

265 ردیف
قرمزکلمه اشتباه در نتیجهسادهدرست پیاده‌سازی شدستون «مورد انتظار» همان‌گونه که هست به عنوان حقیقت مرجع نمایش داده می‌شود
#صدانمونهمجموعه دادهمورد انتظار (حقیقت مرجع)نتیجه OmniASR LLM-1BWERCERI/D/S
1btsee_0001Common Voice 24 (MN)Гэхдээ амьсгал хураахаасаа өмнө танд мэдэж байгаагаа хэлье.гэхдээ амьсгал хураахаасаа өмнө танд мэдэж айгаагаа хэлье12.5%1.7%0/0/1
2btsee_0002Common Voice 24 (MN)Надад заяасан аз жаргал гэдэг ердөө гуравхан сарын хугацаатай байсан гэж үү?და́დ წე́ი სა́ნათ ჭირალო̆ გე́ტდეგერ და ყო́რუხ უ̂ნ სარენ ხო́ხ წათდა́ ბჵაჲსნი̆ გეჩუ́ჲნი̆108.3%104.0%1/0/12
3btsee_0003Common Voice 24 (MN)Одоо бид өөрсдөө өвчин эмгэгээсээ салахыг хичээцгээе.одоо бид өөрсдөө өвчин эмгэгээсээ салахыг ч хэвцгээв28.6%9.6%1/0/1
4btsee_0004Common Voice 24 (MN)Би бол голдуу хээрээр гэр, хэцээр дэр хийж явдаг хүн.би бол голдуу хээрээр гэр хэцээр дэр хийж явдаг хүн0.0%0.0%0/0/0
5btsee_0005Common Voice 24 (MN)Хан хурмаст уурлаж, Болдоггүй Бор өвгөнийг хор луугаараа ниргүүлэхээр явуулжээ.хан хурамч дуурлаж болдохгүй бор өгнө хоёр луугаар нэргүүлэхээр явуулжээ70.0%18.2%0/0/7
6btsee_0006Common Voice 24 (MN)Алив наашаа ороод ир гээд гэртээ оров.алив нашаа ороодор гээд гэртээ оров42.9%8.1%0/1/2
7btsee_0007Common Voice 24 (MN)Өө өндөр дээдэс таны тухайд би баталж чадахгүй.өө өндөр дээд таны тухайд би ботолж чадахгүй25.0%8.7%0/0/2
8btsee_0008Common Voice 24 (MN)Харин гурав дахь удаагаас эхлэн хүмүүсийг сонирхож эхлэв.харин гурав дахь удаагаас эхлэн хүмүүсийг сонирхож эхлэв0.0%0.0%0/0/0
9btsee_0009Common Voice 24 (MN)Та нар очингуутаа шөл л өгч үз.та нар очингуутаа шүлэл өгч үз28.6%6.7%0/1/1
10btsee_0010Common Voice 24 (MN)Ерөөсөө литр үйлдвэрээсээ салаагүй явсан юм чинь.эрөөсөө л үйлдвэрээсээ салуугүй явсан юм чинь42.9%12.5%0/0/3
صفحه 1 از 27

روش‌شناسی

این اعداد چگونه به دست آمدند.

ارائه‌دهنده: OmniASR LLM-1B (Meta Omnilingual ASR (omniASR_LLM_1B_v2) run locally — 1,600+ languages, decoding Halh Mongolian (khk_Cyrl).).

اندپوینت local (omnilingual-asr). زبان mn. Operating point omniASR_LLM_1B_v2 (lang=khk_Cyrl). تفکیک گویندگان none.

مجموعه‌های داده: Common Voice 24 (MN), Shunya Labs Mongolian Speech, Common Voice 20 (MN), Modern Voice — 265 نمونه، مجموعاً 1849.3s صوت.

Dataset source URLs:

معیارها: WER و CER با هم‌ترازی استاندارد لون‌اشتاین کلمه/نویسه و با نرمال‌سازی حروف بزرگ‌/کوچک و نقطه‌گذاری محاسبه می‌شوند. دقت = ۱۰۰ − WER. ضریب سرعت = مدت صوت ÷ زمان پردازش (× زمان واقعی). همه درخواست‌ها فراخوانی واقعی Batch API OmniASR LLM-1B هستند، نه کش‌شده یا شبیه‌سازی‌شده.

برجسته‌سازی تفاوت‌ها: ستون نتیجه با حقیقت مرجع هم‌تراز می‌شود و هر جایگزینی و درجی را قرمز می‌کند. حذف‌ها (کلمات غایب در نتیجه) در ستون نتیجه نمایش داده نمی‌شوند — ستون «مورد انتظار» کل حقیقت مرجع را همان‌گونه که هست دربردارد.

تولیدشده توسط OmniASR LLM-1B Benchmark Runner · OmniASR LLM-1B Batch API v2 · اجرا Aug 25, 2026, 4:14 AM