> ## Documentation Index
> Fetch the complete documentation index at: https://veniceai-mintlify-86b9f77a.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# نماذج تحويل الكلام إلى نص

> نماذج تحويل الكلام إلى نص في Venice لنسخ الصوت إلى نص مع دعم متعدد اللغات، والطوابع الزمنية، وendpoint /audio/transcriptions المتوافق مع OpenAI.

<div id="model-search-placeholder" data-filter="asr">
  استخدم قيمة `id` كمعامل `model` في طلبات API. عدد النماذج المتوفرة حاليًا: 5.

  | النموذج               | المعرّف                       | لكل ثانية صوت | الخصوصية   |
  | --------------------- | ----------------------------- | ------------- | ---------- |
  | ElevenLabs Scribe V2  | `elevenlabs/scribe-v2`        | \$0.0002      | Anonymized |
  | Parakeet ASR          | `nvidia/parakeet-tdt-0.6b-v3` | \$0.0001      | Private    |
  | Whisper Large V3      | `openai/whisper-large-v3`     | \$0.0001      | Private    |
  | Wizper (Whisper v3)   | `fal-ai/wizper`               | \$0.0001      | Private    |
  | xAI Speech to Text v1 | `stt-xai-v1`                  | \$0.0000      | Anonymized |
</div>

***

## الاستخدام

تقوم نماذج تحويل الكلام إلى نص بنسخ الصوت المنطوق إلى نص مكتوب. يتم الوصول إليها عبر [واجهة Audio Transcriptions API](/api-reference/endpoint/audio/transcriptions).

### صيغ الصوت المدعومة

`mp3`, `mp4`, `mpeg`, `mpga`, `m4a`, `wav`, `webm`, `flac`, `ogg`

### صيغ الاستجابة

| الصيغة         | الوصف                                                         |
| -------------- | ------------------------------------------------------------- |
| `json`         | الافتراضي. يُرجع `{ "text": "..." }`.                         |
| `text`         | نص منسوخ عادي.                                                |
| `srt`          | صيغة الترجمة SubRip مع طوابع زمنية.                           |
| `vtt`          | صيغة الترجمة WebVTT مع طوابع زمنية.                           |
| `verbose_json` | استجابة كاملة مع طوابع زمنية على مستوى المقاطع وبيانات وصفية. |

<Note>
  يتم احتساب التسعير لكل ثانية من الصوت المُدخَل. راجع [واجهة Audio Transcriptions API](/api-reference/endpoint/audio/transcriptions) للحصول على أمثلة الطلبات وتفاصيل المعاملات.
</Note>
