> ## Documentation Index
> Fetch the complete documentation index at: https://veniceai-mintlify-ec5539c9.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# تحويل النص إلى كلام

> أنشئ صوتًا منطوقًا من النص باستخدام نماذج تحويل النص إلى كلام في Venice، واختر صوتًا خاصًا بالنموذج، واحفظ الاستجابة الثنائية من نقطة النهاية /audio/speech.

يحوّل تحويل النص إلى كلام النصَّ المكتوب إلى صوت منطوق. اختر نموذج TTS، وحدّد صوتًا يدعمه هذا النموذج، وأرسل النص إلى `/audio/speech`، ثم احفظ استجابة الصوت الثنائية.

استخدم هذا الدليل لتوليد الأصوات القياسية. إذا كنت تريد إنشاء كلام من صوت مرجعي مخصص، فراجع [استنساخ الصوت](/guides/media/voice-cloning).

## الاستخدام الأساسي

<CodeGroup>
  ```python Python theme={null}
  import os
  from pathlib import Path

  import requests

  response = requests.post(
      "https://api.venice.ai/api/v1/audio/speech",
      headers={
          "Authorization": f"Bearer {os.environ['VENICE_API_KEY']}",
          "Content-Type": "application/json",
      },
      json={
          "model": "tts-kokoro",
          "voice": "af_sky",
          "input": "Hello, welcome to Venice Voice.",
      },
  )

  response.raise_for_status()
  Path("speech.mp3").write_bytes(response.content)
  ```

  ```javascript Node.js theme={null}
  import { writeFile } from "node:fs/promises";

  const response = await fetch("https://api.venice.ai/api/v1/audio/speech", {
    method: "POST",
    headers: {
      Authorization: `Bearer ${process.env.VENICE_API_KEY}`,
      "Content-Type": "application/json",
    },
    body: JSON.stringify({
      model: "tts-kokoro",
      voice: "af_sky",
      input: "Hello, welcome to Venice Voice.",
    }),
  });

  if (!response.ok) {
    throw new Error(await response.text());
  }

  await writeFile("speech.mp3", Buffer.from(await response.arrayBuffer()));
  ```

  ```bash cURL theme={null}
  curl https://api.venice.ai/api/v1/audio/speech \
    -H "Authorization: Bearer $VENICE_API_KEY" \
    -H "Content-Type: application/json" \
    -d '{
      "model": "tts-kokoro",
      "voice": "af_sky",
      "input": "Hello, welcome to Venice Voice."
    }' \
    --output speech.mp3
  ```
</CodeGroup>

يكون جسم الاستجابة الناجحة صوتًا ثنائيًا بالصيغة الافتراضية للنموذج، وليس JSON. يستخدم `tts-kokoro` حاليًا صيغة MP3 كإعداد افتراضي.

## اختيار النموذج والصوت

الأصوات خاصة بكل نموذج. يجب أن تكون قيمة `voice` صالحة لـ `model` الذي تختاره.

استخدم صفحة [نماذج تحويل النص إلى كلام](/models/text-to-speech) لتصفّح النماذج والأصوات المتاحة. يعرض منتقي الأصوات معرّفات الأصوات الدقيقة التي تُمرّرها في طلبك.

<Note>
  معرّفات الأصوات حسّاسة لحالة الأحرف. إذا بدّلت نموذج TTS، فحدِّث قيمة `voice` في الوقت نفسه.
</Note>

## بنية الطلب

| المعامِل          | النوع  | مطلوب | الوصف                                                                                                                          |
| ----------------- | ------ | ----- | ------------------------------------------------------------------------------------------------------------------------------ |
| `model`           | string | نعم   | معرّف نموذج تحويل النص إلى كلام.                                                                                               |
| `voice`           | string | نعم   | معرّف الصوت المدعوم من النموذج المُختار.                                                                                       |
| `input`           | string | نعم   | النص المراد تحويله إلى كلام، حتى 4096 حرفًا.                                                                                   |
| `response_format` | string | لا    | صيغة الإخراج المطلوبة: `mp3` أو `opus` أو `aac` أو `flac` أو `wav` أو `pcm`. الصيغ المدعومة والإعداد الافتراضي خاصة بكل نموذج. |

## صيغة الإخراج

يمكنك حذف `response_format` لاستخدام الإعداد الافتراضي للنموذج. قبل اختيار امتداد الملف أو تجاوز الصيغة، استعلم عن واجهة برمجة النماذج للحصول على قيمتَي `default_format` و`supported_formats` الحاليتين للنموذج:

```bash theme={null}
curl "https://api.venice.ai/api/v1/models?type=tts" \
  -H "Authorization: Bearer $VENICE_API_KEY" |
  jq '.data[] | select(.id == "tts-kokoro") | .model_spec | {default_format, supported_formats}'
```

يحدد `Content-Type` في الاستجابة صيغة الصوت المُعادة. طلب صيغة لا يدعمها النموذج المُختار يُعيد الحالة HTTP `400`.

## نصائح الإنتاج

* خزّن الصوت المُولَّد مؤقتًا عند إعادة استخدام النص المصدر والصوت.
* طبِّع النص وراجعه قبل التوليد. تؤثر علامات الترقيم في الإيقاع والتنغيم.
* خزّن المخرجات بامتداد الملف الصحيح المطابق لصيغة استجابة النموذج.

## موارد ذات صلة

* [واجهة برمجة تطبيقات الكلام الصوتي](/api-reference/endpoint/audio/speech)
* [نماذج تحويل النص إلى كلام](/models/text-to-speech)
* [دليل استنساخ الصوت](/guides/media/voice-cloning)
