THÔNG CÁO BÁO CHÍ PHÁT HÀNH NGAY

São Paulo, ngày 2 tháng 9 năm 2026

VISIONAUTA CÓ MẶT Ở MƯỜI SÁU NGÔN NGỮ, GỒM TIẾNG HINDI, BENGALI, VIỆT, THỔ NHĨ KỲ VÀ INDONESIA, ĐỒNG THỜI BỔ SUNG TÍNH NĂNG QUAY VIDEO DẪN DẮT BẰNG GIỌNG NÓI TRONG TRÒ CHUYỆN THỜI GIAN THỰC VỚI TRÍ TUỆ NHÂN TẠO

Ứng dụng miễn phí do một kỹ sư phần mềm khiếm thị từng làm việc tại Google và Samsung tạo ra có một trợ lý biết nhìn: trò chuyện bằng giọng nói không gián đoạn, mô tả không gian xung quanh, cho biết người dùng đang ở đâu, tìm thông tin trên internet, đọc và chơi bản nhạc, quay video có âm thanh và giúp người khiếm thị chụp những bức ảnh đúng khung hình. Có sẵn cho iPhone và Android.

Visionauta, ứng dụng hỗ trợ tiếp cận dùng trí tuệ nhân tạo để mang lại nhiều tự chủ hơn cho người mù và người thị lực kém, công bố phiên bản mới — và giờ đây nói được mười sáu ngôn ngữ: Bồ Đào Nha, Anh, Tây Ban Nha, Pháp, Hàn, Đức, Nhật, Ý, Ả Rập, Nga, Trung giản thể, Hindi, Bengali, Việt, Thổ Nhĩ Kỳ và Indonesia. Bản dịch bao trùm toàn bộ ứng dụng, các lệnh thoại, tính năng đọc văn bản và cả câu trả lời của trí tuệ nhân tạo, vốn trò chuyện với người dùng bằng chính ngôn ngữ của họ. Với năm ngôn ngữ mới, ứng dụng vươn tới hơn một tỷ người nói ở Nam Á, Đông Nam Á và Thổ Nhĩ Kỳ.

Ứng dụng miễn phí và có sẵn cho iPhone trên App Store, cho Android trên Google Play.

TRÒ CHUYỆN THỜI GIAN THỰC: MỘT TRỢ LÝ BIẾT NHÌN VÀ NÓI CÙNG BẠN

Tính năng chính của Visionauta là Trò chuyện thời gian thực. Người dùng nói chuyện tự nhiên, không cần bấm nút hay chờ đến lượt, với một trí tuệ nhân tạo nhìn qua camera điện thoại và trả lời ngay bằng giọng nói — như có một người bạn sáng mắt ở bên, mô tả thế giới cho bạn.

Trong cuộc trò chuyện, Visionauta có thể:

• Mô tả không gian và khung cảnh — trong phòng có gì, ai đang ở gần, bàn ăn bày biện ra sao, bộ quần áo nào đang đặt trên giường, đèn có đang bật không.

• Cho biết người dùng đang ở đâu và xung quanh có gì — địa chỉ hiện tại, các con phố, điểm mốc, hiệu thuốc, tiệm bánh và trạm xe buýt gần nhất, dựa trên dữ liệu bản đồ thời gian thực.

• Tìm thông tin trên internet — tin tức, giờ giấc, giá cả, dữ liệu cập nhật, mà không cần rời cuộc trò chuyện.

• Đọc và chơi bản nhạc — chỉ cần hướng camera vào một bản nhạc in. Visionauta nhận diện nốt nhạc, đọc to bản nhạc và phát ngay trên thiết bị, đồng thời tạo tệp MusicXML và MIDI. Một tính năng chưa từng có dành cho nhạc sĩ khiếm thị, những người lâu nay phải phụ thuộc vào người khác hoặc vào các ấn bản chữ nổi Braille hiếm và đắt đỏ.

• Giúp người khiếm thị chụp ảnh — trợ lý chụp ảnh hướng dẫn căn khung, báo khi đã đẹp, đếm ngược và bấm máy, để ảnh gia đình, ảnh giấy tờ hay ảnh đăng mạng xã hội đều đạt.

• Quay video có âm thanh — người dùng yêu cầu bằng giọng nói, trợ lý hướng dẫn căn khung và quay; có thể tạm dừng, tiếp tục, kết thúc hoặc hủy bằng các nút điều khiển dễ tiếp cận, và video được lưu trong mục Hoạt động, sẵn sàng để xem lại và chia sẻ.

• Gọi xe bằng giọng nói — chỉ cần nói điểm đến, ứng dụng mở Uber, 99, Bolt hoặc Lyft với chuyến đi đã điền sẵn, chỉ còn việc xác nhận.

• Trả lời mọi câu hỏi về thứ đang ở trước camera — đây là sản phẩm gì, hạn sử dụng đến khi nào, chiếc áo này màu gì, tấm biển này ghi gì.

VISIONAUTA MAGIC: TRÍ TUỆ NHÂN TẠO MÔ TẢ HÌNH ẢNH VÀ THỰC HIỆN TÁC VỤ TRÊN ĐIỆN THOẠI

Chỉ có trên Android và dành cho người đăng ký Visionauta Plus, Visionauta Magic hoạt động cùng trình đọc màn hình của thiết bị, như TalkBack, và giải quyết hai vấn đề tồn tại từ lâu của cộng đồng:

Thứ nhất, nó mô tả những hình ảnh không có nhãn xuất hiện trong bất kỳ ứng dụng nào. Khi tiêu điểm của trình đọc màn hình dừng trên một hình ảnh, biểu tượng hay thẻ không có mô tả, Visionauta phân tích riêng phần tử đó và đọc to nội dung bên trong.

Thứ hai, nó thực hiện tác vụ trên điện thoại. Người dùng yêu cầu chẳng hạn "mở WhatsApp và nhắn tin cho Ana", Visionauta lập kế hoạch, đọc to kế hoạch và chỉ hành động sau khi người dùng chấp thuận — thuật lại từng bước và có thể bị ngắt bất cứ lúc nào bằng nút khẩn cấp hoặc chạm hai lần bằng hai ngón tay. Không có gì diễn ra khi chưa được xác nhận.

CÁC TÍNH NĂNG HẰNG NGÀY

Ngoài trò chuyện, Visionauta giữ nguyên bộ công cụ đã làm nên tên tuổi của ứng dụng trong cộng đồng người khiếm thị, phần lớn hoạt động không cần internet:

• Đọc văn bản ngoại tuyến — hướng camera vào tài liệu, bao bì, thư từ hay biển báo và nghe đọc to nội dung.
• Nhận diện tiền giấy — real Brazil, đô la Mỹ, euro, peso Mexico, yên Nhật, đô la Canada và đô la Úc, không cần kết nối.
• Tìm đồ vật — nói "giúp tôi tìm điện thoại" và ứng dụng quét không gian, báo bằng rung và giọng nói khi tìm thấy.
• Kính lúp điện tử cho người thị lực kém — có thu phóng và các chế độ tương phản cao: đảo màu, trắng trên đen, đen trên trắng và vàng trên xanh.
• Đèn pin có nhắc nhở bằng rung.
• Giọng nói tự nhiên riêng — dùng được trên toàn hệ thống, làm giọng của TalkBack trên Android và VoiceOver trên iPhone, hoạt động ngoại tuyến sau khi tải về.

Phiên bản iPhone tích hợp trọn vẹn với VoiceOver và các tính năng trợ năng của iOS.

PHÁT BIỂU

"Trò chuyện thời gian thực đã thay đổi bản chất của Visionauta. Nó không còn là ứng dụng để bạn chụp một tấm ảnh rồi chờ câu trả lời: đó là một cuộc trò chuyện liên tục với một người nhìn thay bạn và luôn ở đó, dù là để mô tả con phố, tìm hiệu thuốc gần nhất, quay một đoạn video hay đọc bản nhạc bạn sắp chơi." — Jonathan Santos

"Đưa ứng dụng đến tiếng Hindi, Bengali, Việt, Thổ Nhĩ Kỳ và Indonesia là một quyết định vì công bằng, không phải vì thị trường. Công nghệ hỗ trợ luôn đến với tiếng Anh trước, và ai không nói tiếng Anh thì phải chờ nhiều năm. Giờ đây hơn một tỷ người có thể trò chuyện với Visionauta bằng chính tiếng mẹ đẻ của mình." — Jonathan Santos

"Tôi cảm ơn hai giáo sư Ismar Frango và Nizam Omar của Universidade Presbiteriana Mackenzie, những người đã khích lệ tôi biến một đề tài học thuật thành công cụ thực sự cho cộng đồng." — Jonathan Santos

VỀ NHÀ PHÁT TRIỂN

Jonathan Santos là kỹ sư phần mềm chuyên về trí tuệ nhân tạo, từng làm việc tại Google và Samsung. Là nhà nghiên cứu và nghiên cứu sinh tiến sĩ ngành Kỹ thuật Máy tính tại Universidade Presbiteriana Mackenzie, anh cũng là giảng viên thỉnh giảng tại Khoa Y Santa Casa de São Paulo, nơi anh giảng dạy môn Trí tuệ Nhân tạo Tạo sinh Ứng dụng trong Y tế. Anh là người khiếm thị và dành tâm huyết phát triển các công nghệ trợ năng nhằm nâng cao sự độc lập cho người khiếm thị.

Visionauta ra đời trong thời gian anh học thạc sĩ Kỹ thuật Máy tính, ở các môn Tư duy Tính toán và Trí tuệ Nhân tạo.

THÔNG TIN

Ứng dụng: Visionauta
Giá: Miễn phí, có gói đăng ký tùy chọn Visionauta Plus
Nền tảng: iOS và Android
Ngôn ngữ: Bồ Đào Nha, Anh, Tây Ban Nha, Pháp, Hàn, Đức, Nhật, Ý, Ả Rập, Nga, Trung giản thể, Hindi, Bengali, Việt, Thổ Nhĩ Kỳ và Indonesia
Tải cho iOS: https://apps.apple.com/app/visionauta/id6780104967
Tải cho Android: https://play.google.com/store/apps/details?id=br.com.alphamob.aie
Thông cáo báo chí trực tuyến: https://www.tensorial.com.br/visionauta/press-release/
Bộ tài liệu báo chí: https://www.tensorial.com.br/visionauta/press-release/visionauta-media-kit-vi.zip
Liên hệ: contato@tensorial.com.br

###
