Alle Tools

Ein PDF mit KI zusammenfassen und dann illustrieren

Ein PDF, das auf die Arbeitsfläche gezogen wird, zwei Text-Nodes, die es vollständig lesen: einer fasst es in fünf Punkten zusammen, der andere leitet daraus einen Bild-Prompt ab, und ein Image-Node erstellt das Bild. Das Briefing der Demo ist inklusive. Der gesamte Workflow ist ohne Konto sichtbar.

Interaktive Demo

Echter Workflow, echte Ergebnisse. Beweg dich frei und zoome nach Belieben.

Diesen Workflow verwenden

Der echte Workflow: ein Launch-Briefing als PDF in einem Media-Node, verbunden mit zwei Text-Nodes, Claude Haiku für die Zusammenfassung, GPT-5 Mini für den Prompt, und ein Image-Node mit Seedream, der das beschriebene Bild erstellt.

Auf einen Blick

Was der Workflow liefert
1 Bild in 1:1
Aufbau des Canvas
5 Nodes, verbunden durch 3 Kabel
Verdrahtete Modelle
Claude Haiku 4.5, GPT-5 Mini, Seedream 5 Pro
Kosten eines kompletten Durchlaufs
rund 8 Credits, also 0,08 €

Ein PDF ist kein Bild: Es ist ein Dokument, das Sprachmodelle vollständig lesen, Tabellen eingeschlossen. Ziehen Sie es auf die Arbeitsfläche, es landet in einem Media-Node, und jeder Text-Node, der auf ein Modell eingestellt ist, das Dateien lesen kann (GPT, Claude, Gemini, Kimi K3 und die anderen entsprechend markierten), empfängt es über seinen Port „Bild oder PDF zur Analyse“.

Die Demo startet mit einem vierseitigen Launch-Briefing. Ein erster Text-Node auf Claude Haiku 4.5 fasst es in fünf Punkten zusammen; ein zweiter auf GPT-5 Mini leitet daraus einen Bild-Prompt ab, der der visuellen Ausrichtung des Dokuments treu bleibt; ein Image-Node mit Seedream 5 Pro erstellt dieses Bild. Ein Bericht wird zu einem Bild, in drei Nodes.

Der Preis richtet sich nach der Größe des Dokuments: Er wird bei der Übermittlung der Datei reserviert und dann auf Basis der tatsächlich gelesenen Tokens angepasst, wobei die Differenz auf das Guthaben zurückfließt. Bis zu drei Dokumente pro Node. Protokoll, Produktdatenblatt, Vertrag, Kursunterlage, Lastenheft: Alles, was sich lesen lässt, lässt sich zusammenfassen, umschreiben, illustrieren oder in ein Karussell verwandeln.

So geht's

  1. 1

    Ziehen Sie Ihr PDF auf die Arbeitsfläche

    Ein Media-Node empfängt es, genau wie ein Bild oder ein Video. Der Dateiname wird angezeigt, und der Node zeigt Ihnen, an welchen Port er angeschlossen werden soll.

  2. 2

    Verbinden Sie es mit einem Text-Node, der Dokumente liest

    Der Port „Bild oder PDF zur Analyse“ erscheint, sobald das gewählte Modell eine Datei lesen kann. Schreiben Sie die Anweisung: zusammenfassen, extrahieren, umschreiben, übersetzen, planen.

  3. 3

    Erstellen Sie die Zusammenfassung, dann den Prompt

    Jeder Text-Node arbeitet mit dem gesamten Dokument. Der Preis, der für die Dateigröße reserviert wurde, wird an das tatsächlich Gelesene angepasst. Die Antwort erscheint im Node.

  4. 4

    Machen Sie daraus ein Bild, oder mehr

    Der vom zweiten Node geschriebene Prompt speist einen Image-Node über seinen Prompt-Port. Fügen Sie weitere Image-Nodes für die anderen Bildserien des Briefings hinzu.

Varianten und Anwendungsfälle

Derselbe Canvas, anders eingestellt: jede Variante kostet zwei bis drei geänderte Prompt-Zeilen.

Das Briefing, das zur Kampagne wird

Das ist die Demo: Zusammenfassung für das Team, Prompt für das Bild, fertiges Bild. Fügen Sie einen Image-Node pro im Briefing angeforderter Serie hinzu, und einen Video-Node für die vertikalen Formate.

Der Bericht als Karussell

Fassen Sie einen Bericht in sechs Punkten zusammen, einen pro Slide, und knüpfen Sie an den Karussell-Workflow an: Der Text jeder Slide stammt aus dem Dokument, nicht aus einer Umschreibung aus dem Gedächtnis.

Die Anleitung als Video-Tutorial

Eine Produktanleitung als PDF, ein Text-Node, der daraus ein Skript in drei Schritten macht, ein Voice-over-Node, der es liest, ein Image-Node pro Schritt und der Montage-Node, der alles zusammenfügt. Das Tutorial basiert auf dem offiziellen Dokument.

Der erklärte Vertrag

Verbinden Sie einen Vertrag oder allgemeine Geschäftsbedingungen und fragen Sie nach den fünf Punkten, die den Unterzeichner binden, oder nach den Unterschieden zu einer früheren Version, die als zweites Dokument angeschlossen ist.

Der Kurs als Lernkarten

Ein dreißigseitiger Kurs wird zu einer Lernkarte pro Kapitel und dann zu Kontrollfragen. Ein Node pro Anweisung, dasselbe PDF an jeden angeschlossen.

Das übersetzte und illustrierte Produktdatenblatt

Ein technisches Datenblatt auf Englisch, zusammengefasst und ins Deutsche übersetzt von einem Text-Node, dann ein Produktbild, das anhand seiner Merkmale erstellt wird. Der Produktfoto-Workflow übernimmt anschließend.

Häufige Fehler

Ein Modell wählen, das keine Dateien liest

Ohne den Port „Bild oder PDF zur Analyse“ wird das Dokument nicht gesendet, und die Antwort ist erfunden. Prüfen Sie vor dem Generieren, ob der Port erscheint.

Eine vage Anweisung

„Analysiere dieses Dokument“ liefert einen allgemeinen Text. „Fünf Punkte, einer pro Zeile, ohne Einleitung“ liefert genau das, was Sie wollen, wie in der Demo.

Ein gescanntes PDF ohne Text

Ein Bildscan ohne Textebene lässt sich schlecht lesen. Führen Sie es zuerst durch ein Zeichenerkennungstool, oder exportieren Sie das PDF aus dem Originaldokument.

Hundert Seiten für eine einzige Frage senden

Der Preis richtet sich nach der Dateigröße. Für eine gezielte Frage zu einem langen Dokument exportieren Sie die relevanten Seiten als separates PDF, bevor Sie es auf die Arbeitsfläche ziehen.

Empfohlene Modelle

Häufige Fragen

Welche Modelle lesen ein PDF?

Diejenigen, die den Port „Bild oder PDF zur Analyse“ anzeigen: GPT-5 und seine Varianten, Claude, Gemini, Kimi K3, Grok 4.6, DeepSeek V4 und die anderen, die als dateilesend markiert sind. Die anderen Text-Nodes ignorieren das Dokument.

Wie viel kostet das Lesen eines Dokuments?

Der Preis richtet sich nach der Größe des PDFs und dem Tarif des Modells: Er wird zu Beginn anhand der Dateigröße reserviert und dann auf Basis der tatsächlich gelesenen Tokens angepasst. Der Betrag wird vor dem Klick angezeigt.

Wird das Dokument gespeichert?

Es wird in Ihrer Mediathek gespeichert, wie ein hochgeladenes Bild, und erst dann an das Modell gesendet, wenn Sie generieren. Löschen Sie es jederzeit aus der Mediathek.

Kann man mehrere PDFs anschließen?

Bis zu drei Dokumente pro Text-Node. Das Modell empfängt sie alle, und Ihre Anweisung kann sie vergleichen, zusammenführen oder daraus eine Synthese ableiten.

Welche PDF-Größe wird akzeptiert?

Die Upload-Grenze entspricht der der Mediathek, und das Lesen ist auf eine angemessene Textmenge pro Generierung begrenzt. Ein dreißigseitiger Bericht wird problemlos verarbeitet.

Ist die Zusammenfassung dem Dokument treu?

Das Modell liest den tatsächlichen Text, Tabellen eingeschlossen, und arbeitet nicht aus dem Gedächtnis. Prüfen Sie Zahlen trotzdem noch einmal nach, bevor Sie sie veröffentlichen, wie bei jedem Assistenten.

Kann ich mehrere Fragen zu demselben PDF stellen?

Ja: ein Text-Node pro Anweisung, alle mit demselben Media-Node verbunden. Jede Generierung wird separat bezahlt, je nachdem, was gelesen wird.

Kann das PDF einen Image-Node direkt speisen?

Nein, ein Image-Node erwartet einen Prompt. Lassen Sie diesen Prompt von einem Text-Node schreiben, der das Dokument liest, wie in der Demo, und verbinden Sie ihn dann mit dem Image-Node.

Ein PDF mit KI zusammenfassen und dann illustrieren

Diesen Workflow verwenden

Kostenloses Konto, ohne Kreditkarte. Der Workflow öffnet sich vorausgefüllt in deinem Canvas.