Hi,
versuche über Kamera und LLM VISION eine Art Mülltonnenerkennung zum Laufen zu bekommen. Die Erkennung ob 4 Mülltonnen vorhanden sind und eine Ausgabe erfolgt, klappt soweit.
Ich würde aber gern eine Meldung bekommen (1,2,3,4) wenn eine Mülltonnen fehlt. Dazu würde ich ein Bild der KI zur Verfügung stellen wollen, wo alle 4 Tonnen drauf sind, dadurch wäre erkennbar, wie und welche Tonnen wo stehen.
Danach kann dann abgefragt werden (alle 6 Stunden) ob eben eine Tonne fehlt und wenn ja, welche.
Hat da einer eine Idee wie ich das einbauen kann?
So sieht es bisher aus:
alias: AI Mülltonnenerkennung für Alexa
description: Integration
triggers:
- trigger: time_pattern
minutes: "1"
conditions: []
actions:
- action: llmvision.image_analyzer
data:
use_memory: true
include_filename: true
target_width: 1280
max_tokens: 20
provider: 01JZHZT8WA77TN3C6W3X6JVKGM
message: >+
Auf den erfassten Bildern, die in kurzen Abständen aufgenommen wurden,
konzentriere dich nur auf die 4 Mülltonnen im unteren Bereich.
Bewegliche Objekte wie Menschen, Fahrzeuge, Tiere und andere sind zu
ignorieren. Erwähne nicht das Vorhandensein von Bildern und stelle die
Informationen so dar, als ob du die Ereignisse direkt beobachtet
hättest. Gebe nur eine einfach Zahl aus. Sind alle 4 Mülltonnen
vorhanden, melde eine einfach Zahl 0. Fehlt eine Mülltonne, dann führe
diese genau auf.
image_entity:
- camera.erker_hinten
remember: true
expose_images: true
generate_title: true
response_variable: muelltonne
- choose:
- conditions:
- condition: template
value_template: |
{{ muelltonne.response_text | int == 0 }}
sequence:
- data:
title: Alle 4 Mülltonnen sind da
message: Überprüfung der Mülltonnen hat stattgefunden
action: notify.mobile_app_s25ultra
mode: single
Könnte ich im Prompt auf ein Bild unter /config/llmvision/memory/ hinweisen, dass er als Vergleich nehmen soll? Oder hat sie keinen Zugriff? Wie kann ich das lösen?