Im Schlamm ruht sich ein großes Nilpferd aus
Virtuelle Videosafaris für blinde und sehbehinderte Personen
Oliver Bendel und Doris Jovic

Inclusive AI ist ein junges Forschungsfeld und zugleich ein Anwendungsgebiet, wo KI-Systeme aller Art verwendet werden, um behinderte und beeinträchtigte Personen zu unterstützen und ihnen Teilhabe zu ermöglichen. Dabei spielt u.a. generative KI eine Rolle, etwa in Form von Multimodal Large Language Models (MLLM). Diese sind auch in die Animal-Computer Interaction eingezogen, etwa innerhalb von Apps, die Verhaltenstipps für Benutzer geben, die auf Tiere treffen. Im VISUAL-Projekt an der Hochschule für Wirtschaft FHNW wurden beide Disziplinen kombiniert, um neues Potenzial zu erschließen.
Der Prototyp erlaubt es blinden und sehbehinderten Personen, auf virtuelle Videosafaris zu gehen. Es werden öffentlich verfügbare Wildtier-Webcams integriert und die Live-Bilder mit Hilfe eines MLLM analysiert und evaluiert. Für unterschiedliche Bedürfnisse sind unterschiedliche Profile und Modes verfügbar. Ein Text-to-Speech-System vermittelt die Beschreibungen und Erklärungen. Der Prototyp zeigt die technische Machbarkeit und das Potenzial für Inclusive AI und ACI. Es gilt allerdings auch Einschränkungen zu berücksichtigen, etwa mit Blick auf kommerzielle MLLMs und punktuell unzutreffende Beschreibungen, und es muss weitere Forschung und Entwicklung stattfinden, um das Erlebnis wirklich inklusiv und autonom zu machen.
Weiterlesen mit kostenfreier Registrierung
Registrieren Sie sich jetzt kostenfrei und Sie erhalten vollen Zugriff auf alle exklusiven Beiträge. Mit unserem Newsletter senden wir Ihnen Top-Meldungen aus der Automatisierung, Bildverarbeitung und Licht- und Lasertechnik im Industrieumfeld. Außerdem erhalten Sie regelmässig Zugriff auf unsere aktuellen E-Paper.
Meist gelesen

Digitales Vision-Messsystem für die Qualitätskontrolle in der Fertigung
Das QM-Fit-System ist ein Bildverarbeitungsmessgerät speziell für die schnelle und exakte Prüfung kleiner Bauteile. Es reduziert den Aufwand in der Qualitätssicherung und liefert reproduzierbare Ergebnisse.

Daten verstehen und für sich nutzen
Wenn Maschinen ausfallen, Gasflaschen leer sind oder Netze im Verborgenen Energie verlieren, wird es für Betreiber industrieller Anlagen teuer.

Was Anwender und Hersteller über den Cyber Resilience Act wissen müssen
Sicherheitsexperte Thomas Hopfner vom Softwarehersteller MVTec erklärt, warum vernetzte Produktionsumgebungen ein bevorzugtes Ziel für Angriffe sind.

„Flexibilität ist einer unserer größten Pluspunkte.“
Im Gespräch: Claudia Zimmer, Vorständin bei Delphin Technology

„Wachstum durch Automatisierung, Robotik und KI-Integration“
Mit Matthias Göhner sprechen wir über die Bedeutung der Intralogistik für Leuze, die Rolle von Sicherheitslösungen, Nachhaltigkeit und KI in diesem Bereich sowie Schwerpunkte in F&E.







