Generate audio from text using OpenAI – text-to-speech Workflow

Dieser Workflow konvertiert Text in Audio unter Verwendung des OpenAI Text-to-Speech-Modells.

Generate audio from text using OpenAI – text-to-speech Workflow

Die Website nutzt die Wordpress-Infrastruktur.

Server: Unser Server befindet sich in einem Unternehmen mit Sitz in Deutschland. Er hat eine hohe und schnelle Internetverbindung. Es gibt eine Generatorunterstützung für ununterbrochenen Strom.

Workflow Beschreibung

Dieser Workflow nutzt die OpenAI API, um Text, der über einen Webhook empfangen wird, in Audio umzuwandeln. Dies geschieht in mehreren Schritten durch unterschiedliche Nodes.

1. Respond to Webhook

  • Typ: n8n-nodes-base.respondToWebhook
  • Funktion: Diese Node verarbeitet die Antwort an den Webhook und gibt die Audioausgabe zurück.
    Sie wird aktiviert, wenn der Workflow eine POST-Anforderung erhält.
  • Einstellungen: respondWith: binary
    Diese Einstellung ermöglicht es, die Audioausgabe als binäre Daten zurückzugeben, was notwendig ist, um die Audioergebnisse an den Anforderer zurückzusenden.

2. Sticky Note

  • Typ: n8n-nodes-base.stickyNote
  • Funktion: Diese Node dient als geduldiger Notizblock für Hinweise zur Nutzung des Webhooks.
  • Inhalt: „Dieser Webhook-Node löst den Workflow aus, wenn er eine POST-Anforderung erhält.“
    Sie beschreibt, wie der Workflow in den Test- und Produktionsmodus verwendet werden kann.

3. Sticky Note1

  • Typ: n8n-nodes-base.stickyNote
  • Funktion: Eine weitere Notiz, die Informationen zur Konfiguration des OpenAI-API-Keys enthält.
  • Inhalt: „Konfigurieren Sie die OpenAI-Node mit Ihrem API-Schlüssel“
    Hier wird darauf hingewiesen, dass der Nutzer seinen API-Schlüssel in n8n einfügen muss, um die OpenAI-Nodes zu verwenden.

4. Webhook

  • Typ: n8n-nodes-base.webhook
  • Funktion: Diese Node stellt den Webhook zur Verfügung, der den Workflow auslöst, wenn eine POST-Anforderung an die definierte URL gesendet wird.
  • Einstellungen:
    • path: generate_audio – dies definiert den spezifischen Endpunkt, an den die Anfrage gesendet wird.
    • httpMethod: POST – dies gibt an, dass der Webhook nur auf POST-Anfragen reagiert.
    • responseMode: responseNode – diese Einstellung ermöglicht es der Node, eine Antwort zurückzugeben, die vom Workflow verarbeitet wurde.

5. OpenAI

  • Typ: @n8n/n8n-nodes-langchain.openAi
  • Funktion: Mit dieser Node wird die OpenAI API aufgerufen, um den Text in Audio umzuwandeln.
  • Einstellungen: input:={{ $json.body.text_to_convert }}
    Dies bedeutet, dass die Node den Text aus dem Body der eingehenden Anfrage entnimmt.
    Die voice Parameter ist auf „fable“ gesetzt, was bedeutet, dass diese spezifische Stimme verwendet wird, um den Text vorzulesen.
    Die resource Parameter ist auf „audio“ gesetzt, was angibt, dass die Ressource Audio ist.
  • Credentials:
    openAiApi: Hier sollten die Anmeldeinformationen für die OpenAI API konfiguriert werden.

Ergebnis

Dieser Workflow ermöglicht es, Text, der über eine POST-Anforderung an den Webhook gesendet wird, nahtlos in Audio umzuwandeln. Dies kann in verschiedenen Anwendungen genutzt werden, wie z.B. für Sprachausgaben, Podcasts oder andere Audioinhalte.

Sie können den Workflow hier herunterladen: Download Link

Facebook
Twitter
LinkedIn

Andere Projekte