Leistungsbeschreibung
Nach dem Auftrag fehlt der Text zur erbrachten Leistung. Er entsteht spät am Abend aus dem Gedächtnis, wird vage („diverse Arbeiten“) oder gerät in Vergessenheit. Das Baustellenfoto – die beste Vorlage – bleibt ungenutzt.
Genau hier setzt die Leistungsbeschreibung aus Fotos an: Der Monteur schickt ein Foto über Telegram, WhatsApp oder Threema. Eine Vision-KI beschreibt die sichtbare Leistung als knappe, sachliche Rechnungsposition – der Text kommt auf demselben Kanal zum Übernehmen zurück
Client
Alle Betriebe mit Lexware Office
Datum
2026 / Q3
Projekt type
n8n-Workflow · Vision-KI (Cloud oder lokal) · Telegram/WhatsApp/Threema · Lexware Office
Showcase
Handbuch
Step 1
Das Problem
Das beste Gedächtnis für den Auftrag ist ein Foto – nur nutzt es niemand.
Der Text zur erbrachten Leistung entsteht abends aus dem Kopf und wird ungenau. Vage Positionen wie „diverse Arbeiten“ führen zu Rückfragen und mindern die Aussagekraft der Rechnung.
Ausgangslage
Fotos vom fertigen Auftrag liegen auf dem Handy, die Rechnungsposition wird später frei formuliert. Zwischen Arbeit und Text liegen Stunden – Details gehen verloren.
Ziele
Aus dem Foto soll direkt ein brauchbarer, sachlicher Positionstext werden, den man ohne Nacharbeit in die Rechnung übernehmen kann.
Ergebnis
Ein knapper, geschäftsdeutscher Vorschlag für die Rechnungsposition kommt auf demselben Kanal zurück – bereit zum Kopieren. Der direkte Schreibzugriff auf die Rechnung ist bewusst nicht aktiv: geprüft übernehmen ist sicherer als automatisch ändern.
Step 2
Die Lösung
Ein Foto rein – der Positionstext kommt zurück.
Alle drei Messenger münden in denselben Ablauf: Das Foto wird normalisiert und an eine Vision-KI übergeben – wahlweise Cloud oder lokales Modell im eigenen Netz. Der Textvorschlag geht über den Messenger-Baustein auf demselben Kanal zurück, von dem das Foto kam. Bildunterschriften dienen der KI als zusätzlicher Kontext.


