Im Schlamm ruht sich ein großes Nilpferd aus
Virtuelle Videosafaris für blinde und sehbehinderte Personen
Oliver Bendel und Doris Jovic

Inclusive AI ist ein junges Forschungsfeld und zugleich ein Anwendungsgebiet, wo KI-Systeme aller Art verwendet werden, um behinderte und beeinträchtigte Personen zu unterstützen und ihnen Teilhabe zu ermöglichen. Dabei spielt u.a. generative KI eine Rolle, etwa in Form von Multimodal Large Language Models (MLLM). Diese sind auch in die Animal-Computer Interaction eingezogen, etwa innerhalb von Apps, die Verhaltenstipps für Benutzer geben, die auf Tiere treffen. Im VISUAL-Projekt an der Hochschule für Wirtschaft FHNW wurden beide Disziplinen kombiniert, um neues Potenzial zu erschließen.
Der Prototyp erlaubt es blinden und sehbehinderten Personen, auf virtuelle Videosafaris zu gehen. Es werden öffentlich verfügbare Wildtier-Webcams integriert und die Live-Bilder mit Hilfe eines MLLM analysiert und evaluiert. Für unterschiedliche Bedürfnisse sind unterschiedliche Profile und Modes verfügbar. Ein Text-to-Speech-System vermittelt die Beschreibungen und Erklärungen. Der Prototyp zeigt die technische Machbarkeit und das Potenzial für Inclusive AI und ACI. Es gilt allerdings auch Einschränkungen zu berücksichtigen, etwa mit Blick auf kommerzielle MLLMs und punktuell unzutreffende Beschreibungen, und es muss weitere Forschung und Entwicklung stattfinden, um das Erlebnis wirklich inklusiv und autonom zu machen.
Weiterlesen mit Login
Noch nicht registriert?
Registrieren Sie sich jetzt kostenfrei und Sie erhalten vollen Zugriff auf alle exklusiven Beiträge. Mit unserem Newsletter senden wir Ihnen Top-Meldungen aus der Automatisierung, Bildverarbeitung und Licht- und Lasertechnik im Industrieumfeld. Außerdem erhalten Sie regelmässig Zugriff auf unsere aktuellen E-Paper.
RegistrierenMeist gelesen

Praxisnahe Tests und starke Kundenbindung
Aerotech schafft mit Laserlabor am Standort Fürth zentralen Anlaufpunkt für Applikations- und Entwicklungstests

Wie klassische KI-Systeme intelligenter werden
Vom maschinellen Sehen zur maschinellen Wahrnehmung

Humanoide Roboter erreichen den Mittelstand
Sinkende Kosten, schnelle Einsatzbereitschaft und steigende Flexibilität eröffnen neue Anwendungen jenseits klassischer Insellösungen.

Chatbots für tote, gefährdete und ausgestorbene Sprachen
Möglichkeiten und Grenzen generativer KI für die Weiterbildung.

Mehr Kreislauf durch PCR-Spouts
Standbodenbeutel mit Ausgießer kommen in immer mehr Anwendungen zum Einsatz. Setzen Hersteller auf Monomaterial-Konzepte, lassen sich Verpackungen besser recyceln und in den Kreislauf zurückführen.







