Im Schlamm ruht sich ein großes Nilpferd aus
Virtuelle Videosafaris für blinde und sehbehinderte Personen
Oliver Bendel und Doris Jovic

Inclusive AI ist ein junges Forschungsfeld und zugleich ein Anwendungsgebiet, wo KI-Systeme aller Art verwendet werden, um behinderte und beeinträchtigte Personen zu unterstützen und ihnen Teilhabe zu ermöglichen. Dabei spielt u.a. generative KI eine Rolle, etwa in Form von Multimodal Large Language Models (MLLM). Diese sind auch in die Animal-Computer Interaction eingezogen, etwa innerhalb von Apps, die Verhaltenstipps für Benutzer geben, die auf Tiere treffen. Im VISUAL-Projekt an der Hochschule für Wirtschaft FHNW wurden beide Disziplinen kombiniert, um neues Potenzial zu erschließen.
Der Prototyp erlaubt es blinden und sehbehinderten Personen, auf virtuelle Videosafaris zu gehen. Es werden öffentlich verfügbare Wildtier-Webcams integriert und die Live-Bilder mit Hilfe eines MLLM analysiert und evaluiert. Für unterschiedliche Bedürfnisse sind unterschiedliche Profile und Modes verfügbar. Ein Text-to-Speech-System vermittelt die Beschreibungen und Erklärungen. Der Prototyp zeigt die technische Machbarkeit und das Potenzial für Inclusive AI und ACI. Es gilt allerdings auch Einschränkungen zu berücksichtigen, etwa mit Blick auf kommerzielle MLLMs und punktuell unzutreffende Beschreibungen, und es muss weitere Forschung und Entwicklung stattfinden, um das Erlebnis wirklich inklusiv und autonom zu machen.
Weiterlesen mit kostenfreier Registrierung
Registrieren Sie sich jetzt kostenfrei und Sie erhalten vollen Zugriff auf alle exklusiven Beiträge. Mit unserem Newsletter senden wir Ihnen Top-Meldungen aus der Automatisierung, Bildverarbeitung und Licht- und Lasertechnik im Industrieumfeld. Außerdem erhalten Sie regelmässig Zugriff auf unsere aktuellen E-Paper.
Meist gelesen

Qualitätsrelevante Daten aus der Punktwolke
Wie 3D-Sensorik die Kleberaupenkontrolle verändert

Dieser Roboter steht Ihnen aber gut!
Über das Phänomen der Wearable Social Robots

inspect award 2025: Smartkamera für Aufgaben in Logistik und Produktion
Der NS42 von Zebra ist eine Smartkamera, die für KI-basierte Bildverarbeitungsanwendungen optimiert ist. Im Interview erläutert Laith Marmash, Global Channel Strategy Lead, wie genau die Anomalieerkennung funktioniert.

Warum Autovimation der Exaktera-Gruppe beitrat
Peter Neuhaus erläutert die Beweggründe für den Verkauf von Autovimation an Exaktera. Im Vordergrund stand die strategische Weiterentwicklung durch internationale Vertriebsstrukturen und zusätzliche Marketingressourcen.

AR-gestützte Qualitätskontrolle von Kranteilen
Bauteilprüfung mit Augmented Reality direkt in der Fertigung







