Workflow Übersicht
Dieser Workflow demonstriert, wie man mit n8n ein Bild lädt, ein AI-Modell zur Generierung einer Bildunterschrift verwendet und die unformatted text caption auf das Bild überlagert. Es nutzt die Edit Image Nodes dazu, um die Caption über dem Bild anzuzeigen.
1. Trigger: Testworkflow auslösen
Name: When clicking ‘Test workflow’
Typ: Manual Trigger
Beschreibung: Dies ist der Ausgangspunkt des Workflows. Er wird manuell aktiviert, um den gesamten Workflow auszulösen. Es ist notwendig, um die nachfolgenden Schritte zu starten.
2. Get Image: Bild abrufen
Name: Get Image
Typ: HTTP Request
Beschreibung: Dieser Node verwendet einen HTTP-Anfrage-Node, um ein Bild von einer externen Quelle (Pexels) abzurufen.
Einstellungen: url: „https://images.pexels.com/photos/1267338/pexels-photo-1267338.jpeg?auto=compress&cs=tinysrgb&w=600“. Das Bild wird als Input für den nächsten Node verwendet.
3. Resize For AI: Bildgröße anpassen
Name: Resize For AI
Typ: Edit Image
Beschreibung: Dieser Node passt die Größe des Bildes auf 512×512 Pixel an, um sicherzustellen, dass das Bild für das AI-Modell geeignet ist.
Einstellungen: width: 512, height: 512.
4. Image Captioning Agent: Beschriftung generieren
Name: Image Captioning Agent
Typ: Chain LLM
Beschreibung: Hier wird das Google Gemini-Modell verwendet, um eine Beschriftung für das Bild zu generieren.
Einstellungen: text: „Generate a caption for this image.“ und messages: mit den Anweisungen für die AI.
5. Structured Output Parser: Ausgabe analysieren
Name: Structured Output Parser
Typ: Output Parser
Beschreibung: Dieser Node analysiert die Ausgabe des AI-Modells und strukturiert sie gemäß dem festgelegten JSON-Schema.
Einstellungen: jsonSchemaExample: definiert die Struktur der erwarteten Antwort.
6. Merge Image & Caption: Bild und Beschriftung kombinieren
Name: Merge Image & Caption
Typ: Merge
Beschreibung: Dieser Node verbindet das Bild und die generierte Beschriftung zu einem Datensatz.
Einstellungen: mode: combine, combineBy: combineByPosition.
7. Get Info: Bildinformationen abrufen
Name: Get Info
Typ: Edit Image
Beschreibung: Dieser Node ruft Informationen über die Bildgröße ab, die später für die Positionierung der Beschriftung verwendet werden.
Einstellungen: operation: information.
8. Calculate Positioning: Position berechnen
Name: Calculate Positioning
Typ: Code
Beschreibung: Hier wird JavaScript verwendet, um die Position zu berechnen, an der die Beschriftung auf dem Bild angezeigt werden soll.
Einstellungen: jsCode: Definiert eine Logik zur Ermittlung der Textposition.
9. Apply Caption to Image: Beschriftung auf Bild anwenden
Name: Apply Caption to Image
Typ: Edit Image
Beschreibung: Dieser Node ist verantwortlich für das Überlagern der generierten Beschriftung auf dem Bild.
Einstellungen: Verwendet Parameter zum Zeichnen und Hinzufügen von Text.
Ergebnis
Am Ende des Workflows erhältst du ein bearbeitetes Bild mit einer passenden, vom AI-Modell generierten Beschriftung, die über dem Bild platziert ist. Dies kann für verschiedene Anwendungen gemäß deinen Anforderungen verwendet werden.