Im Schlamm ruht sich ein großes Nilpferd aus
Virtuelle Videosafaris für blinde und sehbehinderte Personen
Oliver Bendel und Doris Jovic

Inclusive AI ist ein junges Forschungsfeld und zugleich ein Anwendungsgebiet, wo KI-Systeme aller Art verwendet werden, um behinderte und beeinträchtigte Personen zu unterstützen und ihnen Teilhabe zu ermöglichen. Dabei spielt u.a. generative KI eine Rolle, etwa in Form von Multimodal Large Language Models (MLLM). Diese sind auch in die Animal-Computer Interaction eingezogen, etwa innerhalb von Apps, die Verhaltenstipps für Benutzer geben, die auf Tiere treffen. Im VISUAL-Projekt an der Hochschule für Wirtschaft FHNW wurden beide Disziplinen kombiniert, um neues Potenzial zu erschließen.
Der Prototyp erlaubt es blinden und sehbehinderten Personen, auf virtuelle Videosafaris zu gehen. Es werden öffentlich verfügbare Wildtier-Webcams integriert und die Live-Bilder mit Hilfe eines MLLM analysiert und evaluiert. Für unterschiedliche Bedürfnisse sind unterschiedliche Profile und Modes verfügbar. Ein Text-to-Speech-System vermittelt die Beschreibungen und Erklärungen. Der Prototyp zeigt die technische Machbarkeit und das Potenzial für Inclusive AI und ACI. Es gilt allerdings auch Einschränkungen zu berücksichtigen, etwa mit Blick auf kommerzielle MLLMs und punktuell unzutreffende Beschreibungen, und es muss weitere Forschung und Entwicklung stattfinden, um das Erlebnis wirklich inklusiv und autonom zu machen.
Weiterlesen mit kostenfreier Registrierung
Registrieren Sie sich jetzt kostenfrei und Sie erhalten vollen Zugriff auf alle exklusiven Beiträge. Mit unserem Newsletter senden wir Ihnen Top-Meldungen aus der Automatisierung, Bildverarbeitung und Licht- und Lasertechnik im Industrieumfeld. Außerdem erhalten Sie regelmässig Zugriff auf unsere aktuellen E-Paper.
Meist gelesen

„Alles wird kleiner und erhält mehr Intelligenz“
Die Intralogistik gewinnt für Baumer immer mehr an Bedeutung. Über aktuelle Trends sprechen wir mit Peter Jürgen Tittes.

Industrielle Bildverarbeitung auf der Logimat 2026
Auf der Logimat 2026, die vom 24. bis 26. März in Stuttgart stattfindet, präsentieren 1.600 Aussteller aus über 40 Ländern Lösungen für effiziente, automatisierte und datengestützte Prozesse der Intralogistik.

Der Turbo für die Intralogistik
Fahrerlose Transportsysteme können die Effizienz von Intralogistikprozessen deutlich steigern. Die Antriebe der Fahrzeuge müssen dabei kompakt, leistungsstark und präzise zugleich sein.

Supercaps: Die bessere Alternative zur Batterie?
Bei welchen Anwendungen liegen Supercaps vorn und was sind deren Vorteile?

Was Anwender und Hersteller über den Cyber Resilience Act wissen müssen
Sicherheitsexperte Thomas Hopfner vom Softwarehersteller MVTec erklärt, warum vernetzte Produktionsumgebungen ein bevorzugtes Ziel für Angriffe sind.







