L'intelligence artificielle de Google commence à interpréter les images
Google continue d'améliorer son expérience de recherche basée sur l'intelligence artificielle. Le chatbot axé sur la recherche de l'entreprise, baptisé AI Mode, est désormais capable d'interagir non seulement avec du texte, mais aussi avec des images. Grâce à cette nouvelle fonctionnalité, les utilisateurs peuvent poser des questions sur des images et obtenir des réponses détaillées. Google a déployé cette mise à jour auprès de millions d'utilisateurs sur les plateformes Android et iOS via l'application Google.
La mise à jour repose sur la combinaison d'une version spéciale du modèle d'intelligence artificielle Gemini et de la technologie Google Lens. Les utilisateurs peuvent poser des questions sur le contenu à l'IA en prenant une photo ou en téléchargeant une image depuis leur appareil. Le système ne se contente pas de reconnaître les objets présents dans l'image, il évalue également le contexte de ces objets. Ainsi, les utilisateurs obtiennent non seulement des informations sur les objets figurant dans l'image, mais ils accèdent également à des connaissances approfondies sur les relations qui les entourent et sur la signification globale de l'image.
Robby Stein, chef de produit chez Google Search, décrit cette mise à jour comme une étape plus avancée des travaux précédents sur la recherche visuelle. L'intelligence artificielle lit désormais des éléments tels que la forme, la couleur, le matériau et la disposition pour comprendre l'ensemble de la scène. Chaque objet de l'image est traité non pas comme une entité isolée, mais comme un tout en relation avec les autres éléments. Cette fonctionnalité permet à l'AI Mode d'offrir aux utilisateurs des réponses plus naturelles et plus pertinentes.
Lorsqu'elle analyse des images, l'intelligence artificielle utilise une approche appelée 'fan-out'. Grâce à cette méthode, de nombreuses requêtes parallèles sont générées pour chaque objet présent dans l'image. Cela permet de fournir une réponse stratifiée et cohérente sur le plan contextuel concernant tous les détails de l'image. Par exemple, lors de l'examen d'une photo d'une bibliothèque, le système est capable de reconnaître les livres, de suggérer des contenus similaires et de proposer des recommandations de lecture.

Cette innovation ne se limite pas à la reconnaissance visuelle ; elle interagit également avec les utilisateurs pour répondre à leurs questions. Lorsqu'un utilisateur demande plus d'informations sur une image, le système génère des requêtes supplémentaires et propose de nouvelles suggestions. Cette fonctionnalité transforme l'AI Mode, qui passe d'un simple outil d'analyse statique à un assistant dynamique. Chaque image devient un point de départ pour accéder à l'information via le système.
Google avait initialement proposé l'AI Mode le mois dernier avec un accès limité aux abonnés Google One AI Premium. Cependant, avec cette mise à jour, la fonctionnalité n'est plus réservée aux seuls abonnés payants. L'entreprise a annoncé qu'elle offrait un accès à des millions d'utilisateurs dans le cadre du programme Labs. Cela signifie qu'un plus grand nombre de personnes pourra bénéficier de cette expérience de recherche visuelle avancée.
Source de l'actualité: 12punto
Les plus lus
Enquête sur une « agence de casting » lors d'un événement du CHP
Réponse du YENİ Parti à Uçum
Le « brouillon » de Lausanne de la présidence... Le nouveau parti d'Özgür Özel...
Si vous n'aviez pas d'argent, vous ne pouviez pas vous faire soigner ; désormais, vous ne pouvez même plus devenir médecin
Qu'ont-ils exigé d'İsmet Pacha à Lausanne ?
Les « Sultanes du Filet » sont championnes de la Ligue des Nations FIVB 2026 !
Allégation de « démission de 10 députés » au sein du YENİ Parti
Le problème des missiles de la marine américaine à l'ombre de la guerre contre l'Iran
Le suspect ayant tué trois personnes à Adana a été incarcéré
Révélation fracassante sur la polémique des figurants au CHP !