Fotografieren. Beschreiben lassen. Übernehmen.

Leistungsbeschreibung aus Fotos

die KI beschreibt die sichtbare Leistung als Rechnungsposition

Leistungsbeschreibung

Nach dem Auftrag fehlt der Text zur erbrachten Leistung. Er entsteht spät am Abend aus dem Gedächtnis, wird vage („diverse Arbeiten“) oder gerät in Vergessenheit. Das Baustellenfoto – die beste Vorlage – bleibt ungenutzt.

Genau hier setzt die Leistungsbeschreibung aus Fotos an: Der Monteur schickt ein Foto über Telegram, WhatsApp oder Threema. Eine Vision-KI beschreibt die sichtbare Leistung als knappe, sachliche Rechnungsposition – der Text kommt auf demselben Kanal zum Übernehmen zurück

Client

Alle Betriebe mit Lexware Office

Datum

2026 / Q3

Projekt type

n8n-Workflow · Vision-KI (Cloud oder lokal) · Telegram/WhatsApp/Threema · Lexware Office

Showcase

PDF

Handbuch

Step 1

Das Problem

Das beste Gedächtnis für den Auftrag ist ein Foto – nur nutzt es niemand.

Der Text zur erbrachten Leistung entsteht abends aus dem Kopf und wird ungenau. Vage Positionen wie „diverse Arbeiten“ führen zu Rückfragen und mindern die Aussagekraft der Rechnung.

Ausgangslage

Fotos vom fertigen Auftrag liegen auf dem Handy, die Rechnungsposition wird später frei formuliert. Zwischen Arbeit und Text liegen Stunden – Details gehen verloren.

Ziele

Aus dem Foto soll direkt ein brauchbarer, sachlicher Positionstext werden, den man ohne Nacharbeit in die Rechnung übernehmen kann.

Ergebnis

Ein knapper, geschäftsdeutscher Vorschlag für die Rechnungsposition kommt auf demselben Kanal zurück – bereit zum Kopieren. Der direkte Schreibzugriff auf die Rechnung ist bewusst nicht aktiv: geprüft übernehmen ist sicherer als automatisch ändern.

 

Step 2

Die Lösung

Ein Foto rein – der Positionstext kommt zurück.

Alle drei Messenger münden in denselben Ablauf: Das Foto wird normalisiert und an eine Vision-KI übergeben – wahlweise Cloud oder lokales Modell im eigenen Netz. Der Textvorschlag geht über den Messenger-Baustein auf demselben Kanal zurück, von dem das Foto kam. Bildunterschriften dienen der KI als zusätzlicher Kontext.

Call Now Button