ZUR SOFORTIGEN VERÖFFENTLICHUNG

São Paulo, 19. August 2026

VISIONAUTA ERHÄLT ECHTZEIT-GESPRÄCH MIT KÜNSTLICHER INTELLIGENZ UND ERSCHEINT IN ELF SPRACHEN – DARUNTER DEUTSCH, ARABISCH, RUSSISCH, CHINESISCH, JAPANISCH UND ITALIENISCH

Die kostenlose App eines blinden Softwareentwicklers, der bei Google und Samsung gearbeitet hat, bekommt einen Assistenten, der sieht: Er spricht ununterbrochen per Sprache, beschreibt Umgebungen, sagt der Person, wo sie sich befindet, sucht Informationen im Internet, liest und spielt Notenblätter vor und hilft blinden Menschen, gut ausgerichtete Fotos aufzunehmen. Verfügbar für iPhone und Android.

Visionauta, die Barrierefreiheits-App, die künstliche Intelligenz einsetzt, um blinden und sehbehinderten Menschen mehr Selbstständigkeit zu geben, kündigt ihr bislang größtes Update an – und spricht nun elf Sprachen: Portugiesisch, Englisch, Spanisch, Französisch, Koreanisch, Deutsch, Japanisch, Italienisch, Arabisch, Russisch und vereinfachtes Chinesisch. Die Übersetzung gilt für die gesamte App und ebenso für die Antworten der künstlichen Intelligenz, die sich mit der Nutzerin oder dem Nutzer in deren Sprache unterhält.

Die App ist kostenlos und für das iPhone im App Store sowie für Android bei Google Play erhältlich.

ECHTZEIT-GESPRÄCH: EIN ASSISTENT, DER SIEHT UND MITSPRICHT

Die zentrale Funktion von Visionauta ist das Echtzeit-Gespräch. Dabei spricht die Person ganz natürlich – ohne Tastendruck, ohne auf einen Signalton zu warten – mit einer künstlichen Intelligenz, die durch die Handykamera sieht und sofort per Sprache antwortet. Wie ein sehender Freund, der neben einem steht und die Welt beschreibt.

Während dieses Gesprächs kann Visionauta:

• Umgebungen und Szenen beschreiben – was im Raum steht, wer in der Nähe ist, wie der Tisch gedeckt ist, welche Kleidung auf dem Bett liegt, ob das Licht brennt.

• Sagen, wo sich die Person befindet und was es in der Umgebung gibt – aktuelle Adresse, Straßen, Orientierungspunkte, Apotheken, Bäckereien und die nächste Bushaltestelle, anhand von Kartendaten in Echtzeit.

• Informationen im Internet suchen – Nachrichten, Öffnungszeiten, Preise, aktuelle Angaben, ohne das Gespräch zu verlassen.

• Notenblätter lesen und abspielen – einfach die Kamera auf gedruckte Noten richten. Visionauta erkennt die Noten, liest das Stück laut vor und spielt es direkt auf dem Gerät ab; dabei entstehen MusicXML- und MIDI-Dateien. Eine neuartige Funktion für blinde Musikerinnen und Musiker, die bislang auf fremde Hilfe oder auf seltene und teure Braille-Ausgaben angewiesen waren.

• Blinden Menschen beim Fotografieren helfen – der Foto-Assistent leitet die Bildausrichtung an, meldet, wenn der Ausschnitt stimmt, zählt herunter und löst die Kamera aus, damit Familienfotos, Dokumente oder Bilder für soziale Netzwerke gelingen.

• Per Sprache ein Auto rufen – man nennt einfach das Ziel, und die App öffnet Uber, 99, Bolt oder Lyft mit bereits eingetragener Fahrt; es bleibt nur noch die Bestätigung.

• Jede Frage zu dem beantworten, was vor der Kamera liegt – welches Produkt ist das, wie lange ist es haltbar, welche Farbe hat dieses Kleidungsstück, was steht auf diesem Schild.

VISIONAUTA MAGIC: DIE KI, DIE BILDER BESCHREIBT UND AUFGABEN AUF DEM HANDY ERLEDIGT

Visionauta Magic ist exklusiv für Android und für Abonnentinnen und Abonnenten von Visionauta Plus verfügbar. Es arbeitet mit dem Screenreader des Geräts zusammen, etwa mit TalkBack, und löst zwei alte Probleme der Community:

Erstens beschreibt es unbeschriftete Bilder, die in beliebigen Apps auftauchen. Sobald der Fokus des Screenreaders auf einem Bild, einem Symbol oder einer Karte ohne Beschreibung stehen bleibt, analysiert Visionauta genau dieses Element und sagt laut an, was darauf zu sehen ist.

Zweitens erledigt es Aufgaben auf dem Handy. Die Person sagt etwa „Öffne WhatsApp und schicke Ana eine Nachricht“, und Visionauta erstellt einen Plan, liest ihn laut vor und handelt erst nach der Zustimmung der Nutzerin oder des Nutzers – dabei kommentiert es jeden Schritt und lässt sich jederzeit über eine Not-Aus-Taste oder durch ein Doppeltippen mit zwei Fingern unterbrechen. Ohne Bestätigung geschieht nichts.

DIE FUNKTIONEN FÜR DEN ALLTAG

Neben dem Gespräch behält Visionauta jene Werkzeuge, die es in der Community blinder und sehbehinderter Menschen beliebt gemacht haben – viele davon funktionieren ohne Internet:

• Texterkennung offline – die Kamera auf Dokumente, Verpackungen, Briefe oder Schilder richten und den Inhalt vorgelesen bekommen.
• Geldscheinerkennung – brasilianischer Real, US-Dollar, Euro, mexikanischer Peso, Yen, kanadischer und australischer Dollar, ohne Verbindung.
• Objektsuche – „Hilf mir, mein Handy zu finden“ sagen, und die App durchsucht die Umgebung und meldet den Fund per Vibration und Sprache.
• Elektronische Lupe für Sehbehinderte – mit Zoom und Modi für hohen Kontrast, invertierte Farben, Weiß auf Schwarz, Schwarz auf Weiß und Gelb auf Blau.
• Taschenlampe mit Vibrationserinnerung.
• Eigene natürliche Stimmen – systemweit nutzbar, als Stimme für TalkBack unter Android und für VoiceOver auf dem iPhone, nach dem Herunterladen auch offline.

Die iPhone-Version ist vollständig in VoiceOver und die Bedienungshilfen von iOS integriert.

ZITATE

„Das Echtzeit-Gespräch hat verändert, was Visionauta ist. Es ist keine App mehr, in der man ein Foto macht und auf eine Antwort wartet: Es ist ein fortlaufendes Gespräch mit jemandem, der für dich sieht und immer da ist – ob um die Straße zu beschreiben, die nächste Apotheke zu finden oder die Noten vorzulesen, die du gleich spielst.“ – Jonathan Santos

„Die App ins Arabische, Russische, Chinesische, Japanische, Deutsche und Italienische zu übersetzen, war keine Marktentscheidung, sondern eine Frage der Gerechtigkeit. Assistive Technologie kam immer zuerst auf Englisch, und wer kein Englisch spricht, wartete jahrelang. Dieses Mal nicht.“ – Jonathan Santos

„Ich danke den Professoren Ismar Frango und Nizam Omar von der Universidade Presbiteriana Mackenzie, die mich ermutigt haben, aus einem akademischen Projekt ein echtes Werkzeug für die Community zu machen.“ – Jonathan Santos

ÜBER DEN ENTWICKLER

Jonathan Santos ist Softwareentwickler mit Schwerpunkt künstliche Intelligenz und war bei Google und Samsung tätig. Er ist Forscher und Doktorand im Fach Computertechnik an der Universidade Presbiteriana Mackenzie sowie Gastdozent an der Medizinischen Fakultät der Santa Casa de São Paulo, wo er generative künstliche Intelligenz in der Medizin unterrichtet. Er ist blind und widmet sich der Entwicklung barrierefreier Technologien, die blinden und sehbehinderten Menschen Unabhängigkeit ermöglichen.

Visionauta entstand während seines Masterstudiums in Computertechnik, in den Lehrveranstaltungen zu Computational Thinking und künstlicher Intelligenz.

INFORMATIONEN

App: Visionauta
Preis: kostenlos, mit optionalem Abonnement Visionauta Plus
Plattformen: iOS und Android
Sprachen: Portugiesisch, Englisch, Spanisch, Französisch, Koreanisch, Deutsch, Japanisch, Italienisch, Arabisch, Russisch und vereinfachtes Chinesisch
Download iOS: https://apps.apple.com/app/visionauta/id6780104967
Download Android: https://play.google.com/store/apps/details?id=br.com.alphamob.aie
Pressemitteilung online: https://www.tensorial.com.br/visionauta/press-release/
Pressemappe: https://www.tensorial.com.br/visionauta/press-release/visionauta-media-kit-de.zip
Kontakt: contato@tensorial.com.br

###
