Skip to content
Closed
Show file tree
Hide file tree
Changes from all commits
Commits
File filter

Filter by extension

Filter by extension

Conversations
Failed to load comments.
Loading
Jump to
Jump to file
Failed to load files.
Loading
Diff view
Diff view
39 changes: 24 additions & 15 deletions comfyui_embedded_docs/docs/ElevenLabsSpeechToSpeech/ar.md
Original file line number Diff line number Diff line change
@@ -1,30 +1,39 @@
# تحويل الكلام إلى كلام من ElevenLabs

هذه ترجمة الوثيقة التقنية لعقدة ElevenLabs Speech to Speech في ComfyUI إلى العربية، مع الالتزام بقواعد الترجمة المحددة:

> تم إنشاء هذه الوثائق بواسطة الذكاء الاصطناعي. إذا وجدت أي أخطاء أو لديك اقتراحات للتحسين، فلا تتردد في المساهمة! [تحرير على GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/ElevenLabsSpeechToSpeech/en.md)

تقوم عقدة ElevenLabs Speech to Speech بتحويل ملف صوتي مدخل من صوت إلى آخر. تستخدم واجهة برمجة تطبيقات ElevenLabs لتحويل الكلام مع الحفاظ على المحتوى الأصلي والنبرة العاطفية للصوت.
عقدة ElevenLabs لتحويل الكلام إلى كلام تحوّل ملفًا صوتيًا مُدخلًا من صوت إلى آخر. تستخدم واجهة برمجة تطبيقات ElevenLabs لتحويل الكلام مع الحفاظ على المحتوى الأصلي والنبرة العاطفية للصوت.

## المدخلات

### المدخلات العامة

| المعامل | الوصف | نوع البيانات | إلزامي | النطاق |
| --- | --- | --- | --- | --- |
| `الصوت` | الصوت المستهدف للتحويل. قم بالتوصيل من محدد الصوت أو استنساخ الصوت الفوري. | CUSTOM | نعم | - |
| `الصوت` | الصوت المصدر المراد تحويله. | AUDIO | نعم | - |
| `الثبات` | استقرار الصوت. القيم المنخفضة تعطي نطاقًا عاطفيًا أوسع، بينما تنتج القيم الأعلى كلامًا أكثر اتساقًا ولكن قد يكون رتيبًا (الافتراضي: 0.5). | FLOAT | لا | 0.0 - 1.0 |
| `النموذج` | النموذج المستخدم لتحويل الكلام إلى كلام. يوفر كل خيار مجموعة محددة من إعدادات الصوت (تعزيز التشابه، الأسلوب، استخدام تعزيز المتحدث، السرعة). | DYNAMICCOMBO | لا | `eleven_multilingual_sts_v2`<br>`eleven_english_sts_v2` |
|-----------|-------------|-----------|----------|-------|
| `النموذج` | النموذج المستخدم لتحويل الكلام إلى كلام. يوفر كل خيار نموذج مجموعة مطابقة من إعدادات الصوت (similarity_boost، style، use_speaker_boost، speed). | DYNAMIC_COMBO | لا | `eleven_multilingual_sts_v2`<br>`eleven_english_sts_v2` |
| `الصوت` | الصوت الهدف للتحويل. قم بتوصيله من محدد الصوت أو استنساخ الصوت الفوري. | CUSTOM | نعم | - |
| `الصوت` | الصوت المصدر المطلوب تحويله. | AUDIO | نعم | - |
| `الثبات` | ثبات الصوت. القيم الأقل تعطي نطاقًا عاطفيًا أوسع، والقيم الأعلى تنتج كلامًا أكثر اتساقًا لكنه قد يكون رتيبًا (الافتراضي: 0.5). | FLOAT | لا | 0.0 - 1.0 |
| `صيغة الإخراج` | تنسيق إخراج الصوت (الافتراضي: "mp3_44100_192"). | COMBO | لا | `"mp3_44100_192"`<br>`"opus_48000_192"` |
| `البذرة` | البذرة لإمكانية إعادة إنتاج النتائج (الافتراضي: 0). | INT | لا | 0 - 4294967295 |
| `إزالة الضوضاء الخلفية` | إزالة الضوضاء الخلفية من الصوت المدخل باستخدام عزل الصوت (الافتراضي: False). | BOOLEAN | لا | - |
| `البذرة` | بذرة التكرار (الافتراضي: 0). | INT | لا | 0 - 4294967295 |
| `إزالة الضوضاء الخلفية` | إزالة الضوضاء الخلفية من الصوت المُدخل باستخدام عزل الصوت (الافتراضي: False). | BOOLEAN | لا | - |

### إعدادات الصوت (مشتركة بين `eleven_multilingual_sts_v2` و `eleven_english_sts_v2`)

عند تحديد نموذج، تصبح إعدادات الصوت هذه متاحة للتحويل.

| المعامل | الوصف | نوع البيانات | إلزامي | النطاق |
|-----------|-------------|-----------|----------|-------|
| `speed` | سرعة الكلام. 1.0 طبيعية، <1.0 أبطأ، >1.0 أسرع (الافتراضي: 1.0). | FLOAT | لا | 0.7 - 1.3 |
| `similarity_boost` | تعزيز التشابه. القيم الأعلى تجعل الصوت أكثر شبهاً بالصوت الأصلي (الافتراضي: 0.75). | FLOAT | لا | 0.0 - 1.0 |
| `use_speaker_boost` | تعزيز التشابه مع صوت المتحدث الأصلي (الافتراضي: False). | BOOLEAN | لا | - |
| `style` | المبالغة في الأسلوب. القيم الأعلى تزيد التعبير الأسلوبي لكنها قد تقلل الثبات (الافتراضي: 0.0). | FLOAT | لا | 0.0 - 0.2 |

## المخرجات

| اسم المخرج | الوصف | نوع البيانات |
| --- | --- | --- |
| `الصوت` | الملف الصوتي المحول بالتنسيق المحدد للإخراج. | AUDIO |
|-------------|-------------|-----------|
| `audio` | الملف الصوتي المحوَّل بالتنسيق المحدد للإخراج. | AUDIO |

> تم إنشاء هذه الوثيقة بواسطة الذكاء الاصطناعي. إذا وجدت أي أخطاء أو لديك اقتراحات للتحسين، فلا تتردد في المساهمة! [تحرير على GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/ElevenLabsSpeechToSpeech/ar.md)

---
**Source fingerprint (SHA-256):** `118fe6e85b146d0649b104d814abb518d37f69ade2e53becac365a0ec90146fd`
**Source fingerprint (SHA-256):** `a3cd602181d134b9ab517bfac092ea30b62ef5a9942a905c0c3e6959b34370ca`
15 changes: 14 additions & 1 deletion comfyui_embedded_docs/docs/ElevenLabsSpeechToSpeech/en.md
Original file line number Diff line number Diff line change
Expand Up @@ -4,16 +4,29 @@ The ElevenLabs Speech to Speech node transforms an input audio file from one voi

## Inputs

### Common Inputs

| Parameter | Description | Data Type | Required | Range |
|-----------|-------------|-----------|----------|-------|
| `model` | Model to use for speech-to-speech transformation. Each model option provides a matching set of voice settings (similarity_boost, style, use_speaker_boost, speed). | DYNAMIC_COMBO | No | `eleven_multilingual_sts_v2`<br>`eleven_english_sts_v2` |
| `voice` | Target voice for the transformation. Connect from Voice Selector or Instant Voice Clone. | CUSTOM | Yes | - |
| `audio` | Source audio to transform. | AUDIO | Yes | - |
| `stability` | Voice stability. Lower values give broader emotional range, higher values produce more consistent but potentially monotonous speech (default: 0.5). | FLOAT | No | 0.0 - 1.0 |
| `model` | Model to use for speech-to-speech transformation. Each option provides a specific set of voice settings (similarity_boost, style, use_speaker_boost, speed). | DYNAMICCOMBO | No | `eleven_multilingual_sts_v2`<br>`eleven_english_sts_v2` |
| `output_format` | Audio output format (default: "mp3_44100_192"). | COMBO | No | `"mp3_44100_192"`<br>`"opus_48000_192"` |
| `seed` | Seed for reproducibility (default: 0). | INT | No | 0 - 4294967295 |
| `remove_background_noise` | Remove background noise from input audio using audio isolation (default: False). | BOOLEAN | No | - |

### Voice Settings (Shared by `eleven_multilingual_sts_v2` and `eleven_english_sts_v2`)

When a model is selected, these voice settings become available for the transformation.

| Parameter | Description | Data Type | Required | Range |
|-----------|-------------|-----------|----------|-------|
| `speed` | Speech speed. 1.0 is normal, <1.0 slower, >1.0 faster (default: 1.0). | FLOAT | No | 0.7 - 1.3 |
| `similarity_boost` | Similarity boost. Higher values make the voice more similar to the original (default: 0.75). | FLOAT | No | 0.0 - 1.0 |
| `use_speaker_boost` | Boost similarity to the original speaker voice (default: False). | BOOLEAN | No | - |
| `style` | Style exaggeration. Higher values increase stylistic expression but may reduce stability (default: 0.0). | FLOAT | No | 0.0 - 0.2 |

## Outputs

| Output Name | Description | Data Type |
Expand Down
37 changes: 25 additions & 12 deletions comfyui_embedded_docs/docs/ElevenLabsSpeechToSpeech/es.md
Original file line number Diff line number Diff line change
@@ -1,26 +1,39 @@
# ElevenLabs Conversión de Voz a Voz

El nodo ElevenLabs Speech to Speech transforma un archivo de audio de entrada de una voz a otra. Utiliza la API de ElevenLabs para convertir el habla preservando el contenido original y el tono emocional del audio.
El nodo ElevenLabs Speech to Speech transforma un archivo de audio de entrada de una voz a otra. Utiliza la API de ElevenLabs para convertir el habla, preservando el contenido original y el tono emocional del audio.

## Entradas

| Parámetro | Descripción | Tipo de dato | Obligatorio | Rango |
| --- | --- | --- | --- | --- |
| `voz` | Voz de destino para la transformación. Conéctelo desde el Selector de Voz o Clonación Instantánea de Voz. | CUSTOM | Sí | - |
### Entradas comunes

| Parámetro | Descripción | Tipo de datos | Requerido | Rango |
|-----------|-------------|---------------|-----------|-------|
| `modelo` | Modelo a utilizar para la transformación de voz a voz. Cada opción de modelo proporciona un conjunto correspondiente de ajustes de voz (similarity_boost, style, use_speaker_boost, speed). | DYNAMIC_COMBO | No | `eleven_multilingual_sts_v2`<br>`eleven_english_sts_v2` |
| `voz` | Voz de destino para la transformación. Conectar desde Voice Selector o Instant Voice Clone. | CUSTOM | Sí | - |
| `audio` | Audio de origen a transformar. | AUDIO | Sí | - |
| `estabilidad` | Estabilidad de la voz. Valores más bajos brindan un rango emocional más amplio; valores más altos producen un habla más consistente pero potencialmente monótona (predeterminado: 0.5). | FLOAT | No | 0.0 - 1.0 |
| `modelo` | Modelo a utilizar para la transformación de voz a voz. Cada opción proporciona un conjunto específico de ajustes de voz (similarity_boost, style, use_speaker_boost, speed). | DYNAMICCOMBO | No | `eleven_multilingual_sts_v2`<br>`eleven_english_sts_v2` |
| `formato_de_salida` | Formato de salida de audio (predeterminado: "mp3_44100_192"). | COMBO | No | `"mp3_44100_192"`<br>`"opus_48000_192"` |
| `semilla` | Semilla para reproducibilidad (predeterminado: 0). | INT | No | 0 - 4294967295 |
| `eliminar_ruido_de_fondo` | Eliminar el ruido de fondo del audio de entrada mediante aislamiento de audio (predeterminado: Falso). | BOOLEAN | No | - |
| `estabilidad` | Estabilidad de la voz. Los valores más bajos ofrecen un rango emocional más amplio; los valores más altos producen una voz más consistente pero potencialmente monótona (por defecto: 0.5). | FLOAT | No | 0.0 - 1.0 |
| `formato_de_salida` | Formato de audio de salida (por defecto: "mp3_44100_192"). | COMBO | No | `"mp3_44100_192"`<br>`"opus_48000_192"` |
| `semilla` | Semilla para reproducibilidad (por defecto: 0). | INT | No | 0 - 4294967295 |
| `eliminar_ruido_de_fondo` | Elimina el ruido de fondo del audio de entrada mediante aislamiento de audio (por defecto: False). | BOOLEAN | No | - |

### Ajustes de voz (compartidos por `eleven_multilingual_sts_v2` y `eleven_english_sts_v2`)

Cuando se selecciona un modelo, estos ajustes de voz quedan disponibles para la transformación.

| Parámetro | Descripción | Tipo de datos | Requerido | Rango |
|-----------|-------------|---------------|-----------|-------|
| `speed` | Velocidad del habla. 1.0 es normal, <1.0 más lenta, >1.0 más rápida (por defecto: 1.0). | FLOAT | No | 0.7 - 1.3 |
| `similarity_boost` | Refuerzo de similitud. Los valores más altos hacen que la voz sea más similar a la original (por defecto: 0.75). | FLOAT | No | 0.0 - 1.0 |
| `use_speaker_boost` | Refuerza la similitud con la voz del hablante original (por defecto: False). | BOOLEAN | No | - |
| `style` | Exageración del estilo. Los valores más altos aumentan la expresión estilística pero pueden reducir la estabilidad (por defecto: 0.0). | FLOAT | No | 0.0 - 0.2 |

## Salidas

| Nombre de salida | Descripción | Tipo de dato |
| --- | --- | --- |
| Nombre de salida | Descripción | Tipo de datos |
|------------------|-------------|---------------|
| `audio` | El archivo de audio transformado en el formato de salida especificado. | AUDIO |

> Esta documentación fue generada por IA. Si encuentra algún error o tiene sugerencias de mejora, ¡no dude en contribuir! [Editar en GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/ElevenLabsSpeechToSpeech/es.md)

---
**Source fingerprint (SHA-256):** `118fe6e85b146d0649b104d814abb518d37f69ade2e53becac365a0ec90146fd`
**Source fingerprint (SHA-256):** `a3cd602181d134b9ab517bfac092ea30b62ef5a9942a905c0c3e6959b34370ca`
37 changes: 24 additions & 13 deletions comfyui_embedded_docs/docs/ElevenLabsSpeechToSpeech/fa.md
Original file line number Diff line number Diff line change
@@ -1,28 +1,39 @@
# تبدیل گفتار به گفتار ElevenLabs

### گره تبدیل گفتار به گفتار ElevenLabs

گره تبدیل گفتار به گفتار ElevenLabs یک فایل صوتی ورودی را از یک صدا به صدای دیگر تبدیل می‌کند. این گره از API ElevenLabs برای تبدیل گفتار استفاده می‌کند و محتوای اصلی و لحن احساسی صدا را حفظ می‌نماید.
گره «ElevenLabs Speech to Speech» یک فایل صوتی ورودی را از یک صدا به صدای دیگر تبدیل می‌کند. این گره با استفاده از ElevenLabs API گفتار را تبدیل می‌کند و محتوای اصلی و لحن احساسی صدا را حفظ می‌نماید.

## ورودی‌ها

| پارامتر | توضیحات | نوع داده | اجباری | محدوده |
| --- | --- | --- | --- | --- |
| `voice` | صدای هدف برای تبدیل. از انتخاب‌گر صدا یا کلون صوتی فوری متصل کنید. | CUSTOM | بله | - |
### ورودی‌های عمومی

| پارامتر | توضیحات | نوع داده | الزامی | محدوده |
|-----------|-------------|-----------|----------|-------|
| `model` | مدل مورد استفاده برای تبدیل گفتار به گفتار. هر گزینه مدل، مجموعه متناظری از تنظیمات صدا (similarity_boost, style, use_speaker_boost, speed) را فراهم می‌کند. | DYNAMIC_COMBO | خیر | `eleven_multilingual_sts_v2`<br>`eleven_english_sts_v2` |
| `voice` | صدای هدف برای تبدیل. از Voice Selector یا Instant Voice Clone متصل کنید. | CUSTOM | بله | - |
| `audio` | صدای منبع برای تبدیل. | AUDIO | بله | - |
| `stability` | پایداری صدا. مقادیر پایین‌تر دامنه احساسی گسترده‌تری می‌دهند، مقادیر بالاتر گفتاری یکنواخت‌تر اما احتمالاً خسته‌کننده تولید می‌کنند (پیش‌فرض: 0.5). | FLOAT | خیر | 0.0 - 1.0 |
| `model` | مدل مورد استفاده برای تبدیل گفتار به گفتار. هر گزینه مجموعه‌ای خاص از تنظیمات صدا (افزایش شباهت، سبک، استفاده از تقویت صدا، سرعت) را ارائه می‌دهد. | DYNAMICCOMBO | خیر | `eleven_multilingual_sts_v2`<br>`eleven_english_sts_v2` |
| `output_format` | فرمت خروجی صدا (پیش‌فرض: "mp3_44100_192"). | COMBO | خیر | `"mp3_44100_192"`<br>`"opus_48000_192"` |
| `seed` | دانه (seed) برای تکرارپذیری (پیش‌فرض: 0). | INT | خیر | 0 - 4294967295 |
| `stability` | پایداری صدا. مقادیر پایین‌تر دامنه احساسی گسترده‌تری می‌دهند و مقادیر بالاتر گفتاری سازگارتر اما احتمالاً یکنواخت تولید می‌کنند (پیش‌فرض: 0.5). | FLOAT | خیر | 0.0 - 1.0 |
| `output_format` | قالب خروجی صدا (پیش‌فرض: "mp3_44100_192"). | COMBO | خیر | `"mp3_44100_192"`<br>`"opus_48000_192"` |
| `seed` | مقدار seed برای تکرارپذیری (پیش‌فرض: 0). | INT | خیر | 0 - 4294967295 |
| `remove_background_noise` | حذف نویز پس‌زمینه از صدای ورودی با استفاده از جداسازی صدا (پیش‌فرض: False). | BOOLEAN | خیر | - |

### تنظیمات صدا (مشترک بین `eleven_multilingual_sts_v2` و `eleven_english_sts_v2`)

وقتی مدلی انتخاب شود، این تنظیمات صدا برای تبدیل در دسترس قرار می‌گیرند.

| پارامتر | توضیحات | نوع داده | الزامی | محدوده |
|-----------|-------------|-----------|----------|-------|
| `speed` | سرعت گفتار. 1.0 عادی، <1.0 کندتر و >1.0 سریع‌تر است (پیش‌فرض: 1.0). | FLOAT | خیر | 0.7 - 1.3 |
| `similarity_boost` | افزایش شباهت. مقادیر بالاتر صدا را به صدای اصلی شبیه‌تر می‌کنند (پیش‌فرض: 0.75). | FLOAT | خیر | 0.0 - 1.0 |
| `use_speaker_boost` | افزایش شباهت به صدای گوینده اصلی (پیش‌فرض: False). | BOOLEAN | خیر | - |
| `style` | میزان اغراق سبک. مقادیر بالاتر بیان سبکی را افزایش می‌دهند اما ممکن است پایداری را کاهش دهند (پیش‌فرض: 0.0). | FLOAT | خیر | 0.0 - 0.2 |

## خروجی‌ها

| نام خروجی | توضیحات | نوع داده |
| --- | --- | --- |
| `audio` | فایل صوتی تبدیل‌شده در فرمت خروجی مشخص‌شده. | AUDIO |
|-------------|-------------|-----------|
| `audio` | فایل صوتی تبدیل‌شده در قالب خروجی مشخص‌شده. | AUDIO |

> این مستند با هوش مصنوعی تهیه شده است. اگر خطایی دیدید یا پیشنهادی برای بهبود دارید، خوشحال می‌شویم مشارکت کنید! [ویرایش در GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/ElevenLabsSpeechToSpeech/fa.md)

---
**Source fingerprint (SHA-256):** `118fe6e85b146d0649b104d814abb518d37f69ade2e53becac365a0ec90146fd`
**Source fingerprint (SHA-256):** `a3cd602181d134b9ab517bfac092ea30b62ef5a9942a905c0c3e6959b34370ca`
Loading
Loading