منگولین speech-to-text لیڈر بورڈ
GPT-4o TranscribeOperating point: gpt-4o-transcribe

GPT-4o Transcribe — منگولین speech-to-text بینچ مارک

GPT-4o Transcribe Batch API (بہتر آپریٹنگ پوائنٹ، زبان mn) کے 4 منگولین ڈیٹاسیٹ اور 265 آڈیو نمونوں پر جانچے گئے حقیقی نتائج۔ نیچے کا ہر عدد ناپا گیا ہے — مارکیٹنگ نہیں۔ WER، رفتار اور قیمت جیسی ہے ویسی ہی، سخت ایمانداری سے دکھائے گئے ہیں۔

زبان:MNاسپیکر علیحدگی:noneنمونے:265چلانا:Aug 14, 2026, 4:21 PMاینڈپوائنٹ:https://api.openai.com/v1/audio/transcriptions
06710047%
درستگی

265/265 نمونے ٹرانسکرائب · 100% کامیابی

06710053%
لفظ غلطی کی شرح

کم بہتر ہے · 265 نمونوں پر

اہم میٹرکس
حرف غلطی کی شرح27.6%
اوسط رفتار فیکٹر2.11×ریئل ٹائم گنا
کل رفتار فیکٹر2.11×
فی نمونہ اوسط تاخیر3.7s
کل پروسیس شدہ آڈیو1849.3s30.8 منٹ

قیمت

بیچ ٹرانسکرپشن کے لیے GPT-4o Transcribe کی فہرستی قیمت۔ کوئی رعایت یا بات چت کی شرح نہیں — فی منٹ خام شرح۔

فی 1000 منٹ
$6
بیچ
فی منٹ
$0.0060
موثر
فی 1000 منٹ (یہ 30.8 منٹ)
$11.10
لاگت
اوپن سورس؟
مالکیتی

قیمت کا ذریعہ: GPT-4o Transcribe عوامی قیمتیں۔ Duudlaga Flow صرف سیاق کے لیے دکھایا گیا ہے — یہ صفحہ GPT-4o Transcribe کو الگ رکھتا ہے تاکہ عدد ہماری مصنوعات سے پھولا نہ ہو۔

ڈیٹاسیٹ کے حساب سے WER اور CER

ڈیٹاسیٹ کے حساب سے لفظ اور حرف غلطی کی شرحیں۔ کم بہتر ہے — اور یہ GPT-4o Transcribe کے حقیقی اعداد ہیں، جو Common Voice 24 پر کمزور ہیں۔

Common Voice 24 (MN)
Source dataset →
WER
61.3%
CER
31.1%
Shunya Labs Mongolian Speech
Source dataset →
WER
41.7%
CER
19.4%
Common Voice 20 (MN)
Source dataset →
WER
65.9%
CER
36.4%
Modern Voice
WER
47.4%
CER
25.5%
WERCER

ڈیٹاسیٹ خلاصہ

ہر ڈیٹاسیٹ کی مجموعی درستگی، رفتار اور وقت۔

ڈیٹاسیٹSourceنمونےکامیابیWERCERدرستگیرفتارآڈیو (سیکنڈ)پروسیس (سیکنڈ)
Common Voice 24 (MN)Hugging Face →5959/5961.3%31.1%38.7%2.73×330.6s121.2s
Shunya Labs Mongolian SpeechHugging Face →6060/6041.7%19.4%58.3%1.67×645.1s386.8s
Common Voice 20 (MN)Hugging Face →5454/5465.9%36.4%34.1%2.01×269.8s133.9s
Modern Voice9292/9247.4%25.5%52.6%2.59×603.8s233.4s

WER بمقابلہ رفتار — فی نمونہ

ہر نقطہ ایک آڈیو نمونہ ہے۔ بہترین جگہ نیچے بائیں (کم غلطی، تیز) ہے۔ GPT-4o Transcribe کئی Common Voice 24 نمونوں پر زیادہ غلطی رکھتا ہے۔

فی نمونہ نتائج

متوقع کالم میں حقیقی حوالہ جیسا ہے ویسی ہی دکھایا گیا ہے۔ نتائج کالم صرف ان الفاظ کو سرخ میں نمایاں کرتا ہے جو GPT-4o Transcribe غلط کر گیا — کوئی اسٹرائیک تھرو/تبدیلی نہیں، صرف غلطیاں۔

265 قطاریں
سرخنتیجے میں غلط لفظعامدرست ٹرانسکرائبمتوقع کالم حقیقی حوالہ کے طور پر جیسا ہے دکھایا گیا
#آڈیونمونہڈیٹاسیٹمتوقع (حقیقی حوالہ)GPT-4o Transcribe نتیجہWERCERI/D/S
1btsee_0001Common Voice 24 (MN)Гэхдээ амьсгал хураахаасаа өмнө танд мэдэж байгаагаа хэлье.Гэхдээ амьсгал хураахаасаа өмнө танд мэдэж яваагаа хэлье.12.5%6.9%0/0/1
2btsee_0002Common Voice 24 (MN)Надад заяасан аз жаргал гэдэг ердөө гуравхан сарын хугацаатай байсан гэж үү?Надад сая санагдаж байгаа гэхэд ердөө гурван сарийн хугацаатай байсан л гэж үү?58.3%22.7%1/0/6
3btsee_0003Common Voice 24 (MN)Одоо бид өөрсдөө өвчин эмгэгээсээ салахыг хичээцгээе.Одоо би дуртай хүнтэйгээ салахыг хүсч байгаа.85.7%51.9%0/0/6
4btsee_0004Common Voice 24 (MN)Би бол голдуу хээрээр гэр, хэцээр дэр хийж явдаг хүн.Би бас голдуу хэрээр гэр, хэцэр дээр хийж явдаг хүн.40.0%9.8%0/0/4
5btsee_0005Common Voice 24 (MN)Хан хурмаст уурлаж, Болдоггүй Бор өвгөнийг хор луугаараа ниргүүлэхээр явуулжээ.Хаварын сүүлчээс барлагийн хоёр зоогоор нэргүүл шарив.100.0%66.2%0/3/7
6btsee_0006Common Voice 24 (MN)Алив наашаа ороод ир гээд гэртээ оров.Айсин наашаараад ир, гэж гэртээ оров.57.1%24.3%0/1/3
7btsee_0007Common Voice 24 (MN)Өө өндөр дээдэс таны тухайд би баталж чадахгүй.Оо, өндөртэд таныг тохойод би баталж чадахгүй.62.5%23.9%0/1/4
8btsee_0008Common Voice 24 (MN)Харин гурав дахь удаагаас эхлэн хүмүүсийг сонирхож эхлэв.Харин 33 дахь удаагаас эхлэн хүмүүсийг сонирхож эхлэв.12.5%8.9%0/0/1
9btsee_0009Common Voice 24 (MN)Та нар очингуутаа шөл л өгч үз.Та нар орчлонгоудаа шүүлт өгч үз.42.9%30.0%0/1/2
10btsee_0010Common Voice 24 (MN)Ерөөсөө литр үйлдвэрээсээ салаагүй явсан юм чинь.Ирүүсөөл үлдүүрээсээ салаагүй явсна юм чинь.57.1%25.0%0/1/3
صفحہ 1 / 27

طریقہ کار

یہ اعداد کیسے حاصل ہوئے۔

فراہم کنندہ: GPT-4o Transcribe (OpenAI gpt-4o-transcribe hosted transcription (Mongolian prompt hint; 'mn' is not an accepted language code).).

اینڈپوائنٹ https://api.openai.com/v1/audio/transcriptions. زبان mn. Operating point gpt-4o-transcribe. اسپیکر علیحدگی none.

ڈیٹاسیٹ: Common Voice 24 (MN), Shunya Labs Mongolian Speech, Common Voice 20 (MN), Modern Voice — 265 نمونے، کل 1849.3s آڈیو۔

Dataset source URLs:

میٹرکس: WER اور CER معیاری لفظ/حرف لیونشٹائن المنت سے، حروف کے حجم اور اوقاف کے لیے نارملائز کر کے حساب کیے جاتے ہیں۔ درستگی = 100 − WER۔ رفتار فیکٹر = آڈیو دورانیہ ÷ پروسیسنگ وقت (× ریئل ٹائم)۔ تمام درخواستیں حقیقی GPT-4o Transcribe Batch API کالز ہیں، کیشڈ یا سمیولیٹڈ نہیں۔

فرق نمایاں کرنا: نتائج کالم حقیقی حوالہ کے ساتھ منتظم ہوتا ہے اور ہر متبادل اور شامل شدہ کو سرخ کرتا ہے۔ حذف شدہ (نتائج سے غائب الفاظ) نتائج کالم میں نہیں دکھائے جاتے — متوقع کالم پہلے ہی پوری حقیقی حوالہ جیسا ہے رکھتا ہے۔

GPT-4o Transcribe Benchmark Runner کے ذریعے تیار · GPT-4o Transcribe Batch API v2 · چلایا گیا Aug 14, 2026, 4:21 PM