Je suis la conférence Google I/O en ligne depuis 2015. Il s’agit de leur événement phare dédié à tous les acteurs du secteur technologique, y compris les professionnels de l’accessibilité. Cette année, j’ai réalisé un rêve d’enfance en assistant en personne à l’I/O 2024. Le fait d’y participer en tant qu’ambassadeur d’ Deque— une entreprise engagée en faveur de l’accessibilité numérique — a rendu cette expérience d’autant plus spéciale.
Google fait figure de pionnier en matière d'accessibilité depuis le lancement de TalkBack en 2009. La conférence de cette année coïncidant avec la Journée mondiale de sensibilisation à l'accessibilité (GAAD), j'avais de grandes attentes.
Je n'ai pas été déçu. Des améliorations apportées à TalkBack avec Gemini Nano au projet Gameface, en passant par les mises à jour de Google Maps et de Lookout, l'engagement de Google en faveur de l'accessibilité était manifeste tout au long de l'événement principal.
Il y avait un sujet en particulier qui m'intéressait tout particulièrement : la génération de code.
Génération de code accessible avec Gemini
En tant que passionné d’IA et utilisateur de la première heure de grands modèles linguistiques (LLM) tels que ChatGPT, GitHub Copilot et Gemini, il m’apparaît clairement que nous avons là une occasion unique de rendre l’accessibilité accessible aux développeurs. La génération de code à l’aide de modèles puissants comme Gemini Pro 1.5 peut transformer de manière significative notre capacité à développer des applications accessibles dès le départ.
Lors de la conférence I/O, Google a annoncé l'intégration de Gemini dans Android Studio, qui sera disponible dans le courant de l'année. Grâce à la multimodalité de Gemini, il est désormais possible de simplement importer une image représentant une maquette d'écran d'application et de demander à Gemini de générer automatiquement le code correspondant à cette application.
Cela m'a tout de suite fait réfléchir : Gemini est-il capable de générer du code accessible pour cet écran ?
Sur le stand de démonstration Android, j’ai testé cette fonctionnalité. J’ai demandé à Gemini de veiller à générer du code accessible, et j’ai été très surpris par la qualité des résultats. J’ai également eu le privilège d’échanger sur ce sujet avec plusieurs employés de Google passionnés par l’accessibilité. Ils m’ont fait part de leurs expériences en matière d’accessibilité sur Android et m’ont expliqué comment de simples erreurs, comme l’absence de descriptions de contenu (contentDescription), trouvent souvent leur origine dans des exemples de code.
Mes annonces préférées de la Google I/O
L'intégration de Gemini n'était qu'une des nombreuses annonces importantes. Voici quelques-unes de mes autres préférées :
Intégration de Gemini Nano avec TalkBack
Google a annoncé une intégration prometteuse de Gemini Nano à TalkBack pour Android, une avancée majeure pour les utilisateurs de TalkBack aveugles ou malvoyants, qui peuvent être confrontés chaque jour à près de 90 images non étiquetées. Grâce aux capacités multimodales de Gemini Nano et à sa capacité à fonctionner entièrement en local sur votre appareil, TalkBack est désormais en mesure de fournir des descriptions d'images plus détaillées et plus claires. La mise à jour améliorée de TalkBack commencera à être déployée dans le courant de l'année.
Project Gameface pour Android
En tant que passionné de jeux vidéo, cette initiative m'a particulièrement enthousiasmé. « Project Gameface », un projet open source, permet aux joueurs de contrôler le curseur de leur souris à l'aide de mouvements de la tête et de gestes faciaux. Google s'est associé à des entreprises sociales telles qu'Incluzza afin d'explorer des applications plus larges de « Project Gameface » et de développer des intégrations avec Android, dans le but de proposer de nouvelles façons d'interagir avec les applications dans les environnements éducatifs et professionnels.
Nouvelles fonctionnalités de Lookout
Google a lancé le « Find Mode » dans Lookout, actuellement en version bêta, qui permet aux utilisateurs d'utiliser l'appareil photo de leur téléphone pour obtenir davantage d'informations sur leur environnement. Le « Find Mode » aide à localiser des objets spécifiques et fournit des descriptions générées par l'IA, aidant ainsi les utilisateurs à s'orienter plus efficacement dans leur environnement.
Améliorations apportées à l'accessibilité dans Google Maps
Google Maps propose désormais des itinéraires piétonniers plus détaillés pour les utilisateurs aveugles ou malvoyants, accompagnés d'instructions vocales pour faciliter la navigation. De plus, Maps fournit des informations d'accessibilité pour plus de 50 millions de lieux, signalés par une icône représentant un fauteuil roulant et indiquant les places de stationnement, les places assises et les toilettes accessibles. La nouvelle prise en charge d'Auracast dans Maps permet aux établissements de diffuser des informations audio d'aide aux visiteurs équipés d'appareils compatibles avec Auracast.
Plusieurs autres annonces ont été faites, notamment concernant un mode « sans texte » pour Look to Speak, le projet Astra, Circle to Search, ainsi que de nouvelles façons d'interagir avec NotebookLM, qui permettront à tous les utilisateurs de profiter des innovations en matière d'IA à venir.
L'avenir de l'accessibilité grâce à l'IA générative s'annonce prometteur
Des entreprises comme Google ne se contentent pas de montrer la voie, elles ouvrent également la voie à l'avenir des technologies accessibles. Grâce aux progrès de l'IA générative, il existe une formidable opportunité d'intégrer l'accessibilité par défaut. Les modèles innovants de Google, tels que Gemini 1.5 Pro, peuvent garantir que l'accessibilité fasse partie intégrante de tout nouveau code.
Comme nous aimons le dire sur Deque: « Les amis ne laissent pas leurs amis publier du code inaccessible ! » Ensemble, nous pouvons faire en sorte que l'avenir de l'innovation numérique soit inclusif et accessible à tous.