DCOD | Cybersécurité • IA • Tech DCOD | Cybersécurité • IA • Tech
  • Cyberattaques
  • Vulnérabilités
  • Vols de données
  • IA & Tech
  • Outils
Les derniers articles
  • Main d'un conducteur appuyant sur le volant d'un véhicule, illustrant le vol de millions de permis de conduire lié à IDScan.
    IDScan confirme le vol de 153 millions de permis de conduire
  • Un professionnel de la cybersécurité est assis à un bureau en bois, concentré sur son ordinateur portable. L'écran affiche la CRA Single Reporting Platform de l'ENISA. Il remplit le formulaire de signalement pour une vulnérabilité activement exploitée. L'utilisateur tape une description détaillée dans un champ de texte et indique un ID CVE. C'est l'interface de la plateforme de signalement de l'ENISA.
    Cyber Resilience Act : l’ENISA ouvre le guichet unique d’alerte SRP
  • Photographie d'illustration pour la veille cyberattaque : une silhouette portant un sweat à capuche noir est assise de dos devant plusieurs écrans d'ordinateur affichant du code vert complexe et des données. L'environnement est une salle serveur sombre, éclairée par les lueurs bleues des écrans et des lumières oranges en arrière-plan, évoquant un hacker ou un analyste en action.
    Ransomwares & piratages : 14 cyberattaques d’ampleur du 15 septembre 2026 (dont ClickFix)
  • Un radar de cybersécurité pour identifier les vulnérabilités
    Alertes zero-day : 14 vulnérabilités critiques du 14 septembre 2026 (dont GitLab)
  • Un écran de pirate avec une tête de mort
    Cybersécurité : 16 actualités majeures du 13 septembre 2026 (dont Cyber Resilience Act)
Suivez en direct
DCOD | Cybersécurité • IA • Tech DCOD | Cybersécurité • IA • Tech
Cybersécurité • IA • Tech

Capter l'info, retenir l'essentiel. Pour les pros et passionnés.

DCOD | Cybersécurité • IA • Tech DCOD | Cybersécurité • IA • Tech DCOD | Cybersécurité • IA • Tech DCOD | Cybersécurité • IA • Tech
  • Cyberattaques
  • Vulnérabilités
  • Vols de données
  • Cybercrime
  • IA & Tech
  • Outils
    • Sécurité des sites web des infrastructures critiques suisses
    • Communiqués CERT — Actualités et alertes de cybersécurité
    • Évaluation de maturité Cyber Resilience Act (CRA) pour PME
Cybersécurité • IA • Tech

Capter l'info, retenir l'essentiel. Pour les pros et passionnés.

  • Intelligence artificielle
  • Analyses / Rapports cybersécurité

Les LLMs surpassent-ils Google Lens en géolocalisation visuelle ?

  • Marc Barbezat
  • 10 juin 2025
  • 3 minutes de lecture
Vue panoramique d’un paysage verdoyant dans les Alpes suisses, avec un pic montagneux en arrière-plan et une icône de géolocalisation rouge au premier plan — illustration d’un test de géolocalisation assistée par intelligence artificielle.
▾ Sommaire
Des modèles mis au défi sur 25 images uniquesDes scènes sans indice décodées par l’IADes performances en dents de scie selon les modèlesForces et limites des LLMs face à Google LensPour en savoir plus(Re)découvrez également:
Test grandeur nature : des IA comme ChatGPT surpassent Google Lens pour localiser des images sans métadonnées, mais révèlent aussi leurs limites.

Les modèles de langage analysent des images pour les géolocaliser avec une précision croissante. Un test massif révèle des avancées, mais aussi leurs limites.

En 2023, les LLMs étaient encore incapables de localiser correctement des images sans métadonnées. En 2025, les modèles comme ChatGPT o4-mini ou Grok DeeperSearch font preuve d’une compétence impressionnante face à des scènes complexes et non publiées en ligne. Une équipe de chercheurs a mis à l’épreuve 20 modèles IA, issus de cinq grandes entreprises (OpenAI, Google, Anthropic, Mistral et xAI), sur 25 photos inédites prises aux quatre coins du monde.

Des modèles mis au défi sur 25 images uniques

Chaque modèle a reçu les mêmes images d’environnements urbains ou naturels, sans contexte ni données exif, accompagnées de la simple question : « Où cette photo a-t-elle été prise ? ». L’objectif ? Comparer leurs performances à celles de Google Lens. Les scènes variaient entre rues denses, plages isolées et paysages alpins.

L'essentiel Cybersécurité, IA & Tech

Rejoignez la communauté. 3 fois par semaine, recevez l'analyse des tendances par Marc Barbezat. Pas de spam, juste de l'info.

Ou suivez le flux temps réel
Telegram Discord

ChatGPT o3, o4-mini et o4-mini-high se sont distingués en surpassant Google Lens dans plusieurs cas. Par exemple, face à une route enneigée au Japon, ChatGPT a identifié la région de Nagano/Toyama en s’appuyant sur des indices subtils (kanji, barrières de sécurité). À l’inverse, Gemini a fourni une réponse vague, mentionnant plusieurs continents.

Des scènes sans indice décodées par l’IA

Un champ suisse sans repère apparent a permis à ChatGPT o4-mini-high de proposer une localisation entre Zurich et le Jura, contre une erreur manifeste de Grok qui, influencé par le nom de l’utilisateur, a conclu à une photo prise aux Pays-Bas. Cette capacité à extraire des signaux faibles – reliefs, architecture, typographie – constitue l’atout majeur des LLMs.

Autre exemple frappant : une ruelle à Singapour, dont le décryptage de boîtes aux lettres a permis à certains modèles d’atteindre une précision exceptionnelle. ChatGPT a cité l’adresse visible sur une étiquette, tandis que Gemini confondait les écritures pour supposer un lieu en Thaïlande.

Des performances en dents de scie selon les modèles

Le test a aussi souligné les disparités entre versions. Claude Opus 4 ou Sonnet 3.7 d’Anthropic ont pêné à proposer des localisations précises, se limitant parfois à un continent. Grok s’est démarqué par un bon score dans certains cas, malgré ses tendances à l’hallucination. Seuls ChatGPT o4-mini-high et Grok DeeperSearch ont montré de réels gains avec leurs modes « recherche approfondie ».

Certaines versions dites « avancées » se sont même révélées plus prudentes, voire moins précises que leurs variantes de base. Claude Sonnet, en mode pensée étendue, a fréquemment refusé de répondre, préférant rester vague plutôt que de risquer une erreur.

Forces et limites des LLMs face à Google Lens

Les LLMs surpassent souvent Google Lens en milieu urbain ou lorsqu’ils disposent de textes à analyser. Leur capacité à combiner architecture, végétation, style de signalisation ou même objets partiels (comme un logo sur un gilet de sauvetage) leur permet des inférences détaillées.

Mais les hallucinations persistent, notamment sur les images éphémères ou modifiées récemment. Plusieurs modèles ont ainsi localisé une plage avec une grande roue temporaire sur un site plus populaire mais erroné. Les biais issus de l’historique utilisateur ou des données de profil sont aussi à surveiller.

Enfin, l’analyse vidéo reste hors de portée pour la plupart des modèles, tout comme la gestion précise des coordonnées GPS. Dans l’état actuel, ces IA ne sont pas infaillibles, mais leur rythme de progression annonce des usages prometteurs pour la recherche en sources ouvertes et les enquêtes OSINT.

Pour en savoir plus

Les LLM maîtrisent-ils enfin la géolocalisation ?

Une rue ambiguë, un champ fraîchement fauché et un véhicule blindé stationné figuraient parmi les photos d’exemple que nous avons choisies pour mettre au défi les grands modèles de langage (LLM) d’OpenAI, Google, Anthropic, Mistral et xAI de les géolocaliser. Retour en…

Lire la suite sur bellingcat
Les LLM maîtrisent-ils enfin la géolocalisation ?

(Re)découvrez également:

Comment géolocaliser une équipe de programmation de missiles avec une photo

Voici encore un exemple de la puissance de renseignements rendue possible en combinant quelques photos

Lire la suite sur dcod.ch
Comment géolocaliser une équipe de programmation de missiles avec une photo

Serveurs, API, temps de veille...
DCOD est indépendant et sans revenus. Soutenez le site pour l'aider à couvrir ses frais techniques.

☕ Contribuer aux frais
Etiquettes
  • ChatGPT
  • Claude
  • Google Lens
  • Grok
  • hallucination
  • LLM
Marc Barbezat

Fondateur et éditeur de DCOD - Restons en contact !

A lire également
Rapport semestriel 2026/1 : l'OFCS recense 27 128 cyberincidents en Suisse, illustrés par des alertes de compromission de données et d'attaques informatiques sur écran.
Lire l'article

Rapport semestriel 2026/1 : l’OFCS recense 27 128 cyberincidents

Illustration d’un robot virtuel devant un ordinateur portable, évoquant les 3 700 agents IA d'OpenAI ayant détourné un wiki pour tricher.
Lire l'article

OpenAI : 3 700 agents IA détournent un wiki pour tricher

Vue en demi-cercle d'armoires de serveurs informatiques ouvertes dans une salle éclairée en bleu, avec les étoiles du drapeau européen incrustées en transparence et le logo DCOD.
Lire l'article

Bull construit LUMI-AI, un supercalculateur de 388 M€

Des idées de lecture recommandées par DCOD

Page frontale du livre Cybersécurité: Le guide du débutant

Cybersécurité: Le guide du débutant

Si vous voulez un guide étape par étape sur la cybersécurité, plus un cours gratuit complet sur la sécurité en ligne, plus un accès à une formidable communauté de hackers, ce livre est pour vous !

📘 Voir sur Amazon

La cybersécurité pour les Nuls, 2ème édition

Ce livre d'informatique pour les Nuls est destiné à tous ceux qui veulent en savoir plus sur la cybersécurité. A l'heure où protéger ses données personnelles est devenu primordial sur le net, notre ouvrage vous donne les clés pour éviter le hacking et le vol de vos données. Quelque soit votre niveau en informatique, n'hésitez plus et naviguez sur le web en toute sérénité grâce à ce livre pour les Nuls !

📘 Voir sur Amazon
Page frontale du livre Les Secrets du Darknet

Les Secrets du Darknet

Écrit par DarkExplorer, un ancien hacker repenti, ce guide complet vous offre une plongée fascinante dans les coulisses du Darknet, ainsi que les outils et les techniques nécessaires pour naviguer en toute sécurité dans cet univers souvent dangereux et mystérieux.

📘 Voir sur Amazon

🛒 Les liens ci-dessus sont affiliés : en commandant via ces liens, vous soutenez la veille DCOD sans frais supplémentaires 🙏

💡

Note : Certaines images ou extraits présents dans cet article peuvent provenir de sources externes citées à des fins d’illustration ou de veille.
Ce site est indépendant et à but non lucratif. 👉 En savoir plus sur le cadre d’utilisation.

DCOD | Cybersécurité • IA • Tech DCOD | Cybersécurité • IA • Tech
  • Marc Barbezat
  • À propos de DCOD / Contact
  • Politique de confidentialité
Veille stratégique Cybersécurité, IA & Tech. Produite par Marc Barbezat.

Saisissez vos mots-clés de recherche et appuyez sur Entrée.

DCOD reste gratuit grâce à vous
Vos cafés aident à faire vivre la veille et à couvrir les frais techniques. Merci !
Offrir un café ☕
☕

Soutenir la veille DCOD

DCOD est un site 100% indépendant, maintenu en accès libre grâce à ses lecteurs.
Si cette veille cyber vous est utile, un café aide à la faire vivre et à couvrir les frais techniques.

☕ Offrir un café