Temps de lecture : 3 min
Lancée en 2015, BeMyEyes est une application pour smartphone qui regroupe une communauté mondiale de personnes malvoyantes ou aveugles et de bénévoles voyants. L’utilisateur qui demande de l’aide via l’application est mis en contact vidéo avec un volontaire, selon la géolocalisation et le fuseau horaire. L’assistance visuelle ainsi fournie permet par exemple de distinguer les couleurs des vêtements, vérifier si les lumières sont allumées ou préparer le dîner.
Les développeurs de l’application, qui compte plus de 6 millions de volontaires, souhaitent améliorer l’accessibilité de leur outil avec l’intégration d’un « volontaire virtuel », géré par l’intelligence artificielle (IA) de deep learning GPT-4*. Un nouveau modèle de l’outil ChatGPT qui fait beaucoup parler de lui et que nous avions d’ailleurs soumis à un exercice du BTS-OL.
Le but : fournir aux personnes malvoyantes ou aveugles de « nouvelles ressources pour mieux naviguer dans les environnements physiques, répondre aux besoins quotidiens et gagner en indépendance ».
Convertir l'image en texte
Mais comment ça marche concrètement ? Le nouveau modèle de langage GPT-4 contient un générateur dynamique qui convertit l’image en texte. Les utilisateurs peuvent donc envoyer des images via l’application et le « volontaire virtuel » répond à toute question concernant cette image. Par exemple, si l’utilisateur envoie une photo de l’intérieur de son réfrigérateur, l’application pourra identifier ce qui se trouve à l’intérieur et même extrapoler en proposant des recettes à partir des ingrédients identifiés.
L’application ne va néanmoins pas se séparer des volontaires en chair et en os qui seront sollicités si l’intelligence artificielle ne parvient pas à répondre à une question ou à apporter une solution. La fonctionnalité « volontaire virtuel » est actuellement en bêta et devrait être disponible « plus tard cette année ».
*Sur le site du développeur OpenAI, l’outil GPT-4 est ainsi décrit : GPT-4 est un modèle multimodal (acceptant des entrées d’image et de texte, émettant des sorties de texte) qui, bien que moins capable que les humains dans de nombreux scénarios du monde réel, présente des performances de niveau humain sur diverses références professionnelles et académiques.
Vous avez la parole !
pour pouvoir poster des commentaires
Nos lecteurs ont aussi lu...
Zeiss muscle ses investissements dans la santé connectée
Publié le 17 août 2026
Le groupe allemand accélère dans les lunettes intelligentes. Sa branche de capital-risque, Zeiss Ventures, vient de mener une levée de fonds de 2,2 millions d’euros pour…
Meta restreint l'accès gratuit à la fonction d'amplification audio sur ses lunettes connectées
Publié le 13 juillet 2026
Meta a récemment modifié les conditions d'utilisation de ses lunettes connectées, conçues en partenariat avec Ray-Ban et Oakley. La fonctionnalité « Conversation Focus »…
Des scientifiques conçoivent une lentille de contact contre la dépression
Publié le 23 juin 2026
Une équipe de chercheurs sud-coréens a conçu une lentille de contact capable de soulager la dépression. Ce dispositif expérimental transmet des signaux électriques…
Les dernières news
Opéré de la myopie au Lasik, il garde des séquelles : les Quinze-Vingts condamnés
Publié le 21 août 2026
Près de douze ans après une opération de la myopie, le contentieux opposant un patient au Centre hospitalier national d’ophtalmologie (CHNO) des Quinze-Vingts connaît un…
Un OVNI dans les rues de Toulouse pour faire connaître son magasin d’optique
Publié le 21 août 2026
« Chaque fois que je le sors, on me prend toujours en photo. » Difficile, il est vrai, de passer inaperçu à bord de l'engin utilisé depuis quelques mois par Thierry…
Le marché des verres de freination de la myopie pourrait tripler d’ici 2034
Publié le 21 août 2026
Encore relativement récent, le marché des verres destinés à freiner la progression de la myopie chez les enfants et adolescents pourrait connaître une forte accélération…