Workflow zur Bildobjekterkennung mit n8n

Dieser Workflow zeigt, wie man mit n8n und der Gemini 2.0 API Objekte in Bildern erkennen kann.

Workflow zur Bildobjekterkennung mit n8n

Die Website nutzt die Wordpress-Infrastruktur.

Server: Unser Server befindet sich in einem Unternehmen mit Sitz in Deutschland. Er hat eine hohe und schnelle Internetverbindung. Es gibt eine Generatorunterstützung für ununterbrochenen Strom.

Workflow zur Bildobjekterkennung mit n8n

In diesem Workflow gehen wir durch die einzelnen Schritte zur Erkennung von Objekten in einem Bild mithilfe der Gemini 2.0 API. Der Workflow besteht aus mehreren Knoten, die zusammenarbeiten, um das Ziel der Objekterkennung zu erreichen.

Node 1: When clicking ‘Test workflow’

Typ: n8n-nodes-base.manualTrigger

Beschreibung: Dieser Knoten fungiert als Auslöser für den Workflow. Wenn der Benutzer auf „Test workflow“ klickt, wird der gesamte Workflow ausgeführt.

Node 2: Get Test Image

Typ: n8n-nodes-base.httpRequest

Beschreibung: Dieser Knoten lädt ein Testbild von einer angegebenen URL herunter. Das Bild wird später für die Objekterkennung verwendet.

URL: https://www.stonhambarns.co.uk/wp-content/uploads/jennys-ark-petting-zoo-for-website-6.jpg

Node 3: Get Image Info

Typ: n8n-nodes-base.editImage

Beschreibung: Mit diesem Knoten extrahieren wir Informationen über das Bild, insbesondere die Breite und Höhe, die für spätere Schritte notwendig sind.

Node 4: Gemini 2.0 Object Detection

Typ: n8n-nodes-base.httpRequest

Beschreibung: Hier wird das Bild an die Gemini 2.0 API gesendet, um Objekte zu erkennen. Im JSON-Body wird der Prompt definiert, um die gewünschten Objekte zu erkennen.

Parameter: Die Anfrage an die API enthält das Bild und den Text, der das zu erkennende Objekt beschreibt.

Node 5: Get Variables

Typ: n8n-nodes-base.set

Beschreibung: Dieser Knoten legt Variablen, wie die Koordinaten der erkannten Objekte (Bounding Boxes), sowie die Breite und Höhe des Bildes fest.

Node 6: Scale Normalised Coords

Typ: n8n-nodes-base.code

Beschreibung: In diesem Knoten wird der Code verwendet, um die Koordinaten der erkannten Objekte zu skalieren, damit sie zur originalen Bildgröße passen. Dies ist nötig, da die von der API zurückgegebenen Koordinaten normalisiert sind.

Node 7: Draw Bounding Boxes

Typ: n8n-nodes-base.editImage

Beschreibung: Hier werden die erkannten Objekte in Form von Bounding Boxes auf das original Bild gezeichnet. Die Farbe der Rechtecke ist auf ein auffälliges Gelb (#ff00f277) eingestellt.

Ergebnis

Dieser Workflow zeigt, wie man die Möglichkeiten der Objekterkennung in Bildern mit der Gemini 2.0 API in n8n nutzen kann. Jeder Schritt ist wichtig für den gesamten Prozess, von dem Herunterladen eines Bildes bis hin zum Zeichnen der Bounding Boxes.

Um den Workflow auszuprobieren oder mehr darüber zu erfahren, können Sie den Workflow hier herunterladen.

Facebook
Twitter
LinkedIn

Andere Projekte