DCOD | Cybersécurité • IA • Tech DCOD | Cybersécurité • IA • Tech
  • Cyberattaques
  • Vulnérabilités
  • Vols de données
  • IA & Tech
  • Outils
Les derniers articles
  • Illustration pour la veille cybercriminalité et crypto : une paire de menottes en métal repose sur un clavier d'ordinateur au premier plan. En arrière-plan sombre, une silhouette de hacker encapuchonné fait face à un réseau lumineux d'icônes de cryptomonnaies interconnectées, incluant les symboles du Bitcoin et de l'Ethereum, dans des teintes bleues et rouges.
    Coups de filet & sanctions : 6 opérations contre la cybercriminalité du 28 août 2026 (dont Mabna Institute)
  • Un utilisateur assis à un bureau en bois consulte sur son ordinateur portable l'assistant Lumo de Proton, symbolisé par un chat violet à l'écran, illustrant l'outil AI Paper Trail conçu pour évaluer la confidentialité des échanges sur ChatGPT et Claude. — Logo DCOD en filigrane.
    Proton lance AI Paper Trail pour évaluer ChatGPT et Claude
  • Fuite massive : Une IA expose 300 millions de messages privés. Illustration conceptuelle montrant un cerveau numérique géant dans un désert nocturne projetant une multitude de bulles de messages vers le ciel sous une aurore boréale.
    Data leaks : 14 fuites de données majeures du 27 août 2026 (dont l’administration fiscale française)
  • Logo noir d'Anthropic Claude avec son symbole en étoile sur un fond terracotta à motifs géométriques en zigzag.
    Claude : les filigranes invisibles déjà contournés
  • Illustration d’un cerveau numérique en réseau rose fluorescent émergeant d’un ordinateur portable, observant un écran affichant une carte du monde en code binaire, symbolisant l’intelligence artificielle, l’analyse de données et la cybersécurité.
    Menaces & IA : 12 dérives et avancées clés du 26 août 2026 (dont Claude)
Suivez en direct
DCOD | Cybersécurité • IA • Tech DCOD | Cybersécurité • IA • Tech
Cybersécurité • IA • Tech

Capter l'info, retenir l'essentiel. Pour les pros et passionnés.

DCOD | Cybersécurité • IA • Tech DCOD | Cybersécurité • IA • Tech DCOD | Cybersécurité • IA • Tech DCOD | Cybersécurité • IA • Tech
  • Cyberattaques
  • Vulnérabilités
  • Vols de données
  • Cybercrime
  • IA & Tech
  • Outils
    • Sécurité des sites web des cantons suisses
    • Sécurité des sites web des communes suisses
    • Communiqués CERT — Actualités et alertes de cybersécurité
    • Évaluation de maturité Cyber Resilience Act (CRA) pour PME
Cybersécurité • IA • Tech

Capter l'info, retenir l'essentiel. Pour les pros et passionnés.

  • Intelligence artificielle
  • Analyses / Rapports cybersécurité

Les LLMs surpassent-ils Google Lens en géolocalisation visuelle ?

  • Marc Barbezat
  • 10 juin 2025
  • 3 minutes de lecture
Vue panoramique d’un paysage verdoyant dans les Alpes suisses, avec un pic montagneux en arrière-plan et une icône de géolocalisation rouge au premier plan — illustration d’un test de géolocalisation assistée par intelligence artificielle.
▾ Sommaire
Des modèles mis au défi sur 25 images uniquesDes scènes sans indice décodées par l’IADes performances en dents de scie selon les modèlesForces et limites des LLMs face à Google LensPour en savoir plus(Re)découvrez également:
Test grandeur nature : des IA comme ChatGPT surpassent Google Lens pour localiser des images sans métadonnées, mais révèlent aussi leurs limites.

Les modèles de langage analysent des images pour les géolocaliser avec une précision croissante. Un test massif révèle des avancées, mais aussi leurs limites.

En 2023, les LLMs étaient encore incapables de localiser correctement des images sans métadonnées. En 2025, les modèles comme ChatGPT o4-mini ou Grok DeeperSearch font preuve d’une compétence impressionnante face à des scènes complexes et non publiées en ligne. Une équipe de chercheurs a mis à l’épreuve 20 modèles IA, issus de cinq grandes entreprises (OpenAI, Google, Anthropic, Mistral et xAI), sur 25 photos inédites prises aux quatre coins du monde.

Des modèles mis au défi sur 25 images uniques

Chaque modèle a reçu les mêmes images d’environnements urbains ou naturels, sans contexte ni données exif, accompagnées de la simple question : « Où cette photo a-t-elle été prise ? ». L’objectif ? Comparer leurs performances à celles de Google Lens. Les scènes variaient entre rues denses, plages isolées et paysages alpins.

L'essentiel Cybersécurité, IA & Tech

Rejoignez la communauté. 3 fois par semaine, recevez l'analyse des tendances par Marc Barbezat. Pas de spam, juste de l'info.

Ou suivez le flux temps réel
Telegram Discord

ChatGPT o3, o4-mini et o4-mini-high se sont distingués en surpassant Google Lens dans plusieurs cas. Par exemple, face à une route enneigée au Japon, ChatGPT a identifié la région de Nagano/Toyama en s’appuyant sur des indices subtils (kanji, barrières de sécurité). À l’inverse, Gemini a fourni une réponse vague, mentionnant plusieurs continents.

Des scènes sans indice décodées par l’IA

Un champ suisse sans repère apparent a permis à ChatGPT o4-mini-high de proposer une localisation entre Zurich et le Jura, contre une erreur manifeste de Grok qui, influencé par le nom de l’utilisateur, a conclu à une photo prise aux Pays-Bas. Cette capacité à extraire des signaux faibles – reliefs, architecture, typographie – constitue l’atout majeur des LLMs.

Autre exemple frappant : une ruelle à Singapour, dont le décryptage de boîtes aux lettres a permis à certains modèles d’atteindre une précision exceptionnelle. ChatGPT a cité l’adresse visible sur une étiquette, tandis que Gemini confondait les écritures pour supposer un lieu en Thaïlande.

Des performances en dents de scie selon les modèles

Le test a aussi souligné les disparités entre versions. Claude Opus 4 ou Sonnet 3.7 d’Anthropic ont pêné à proposer des localisations précises, se limitant parfois à un continent. Grok s’est démarqué par un bon score dans certains cas, malgré ses tendances à l’hallucination. Seuls ChatGPT o4-mini-high et Grok DeeperSearch ont montré de réels gains avec leurs modes « recherche approfondie ».

Certaines versions dites « avancées » se sont même révélées plus prudentes, voire moins précises que leurs variantes de base. Claude Sonnet, en mode pensée étendue, a fréquemment refusé de répondre, préférant rester vague plutôt que de risquer une erreur.

Forces et limites des LLMs face à Google Lens

Les LLMs surpassent souvent Google Lens en milieu urbain ou lorsqu’ils disposent de textes à analyser. Leur capacité à combiner architecture, végétation, style de signalisation ou même objets partiels (comme un logo sur un gilet de sauvetage) leur permet des inférences détaillées.

Mais les hallucinations persistent, notamment sur les images éphémères ou modifiées récemment. Plusieurs modèles ont ainsi localisé une plage avec une grande roue temporaire sur un site plus populaire mais erroné. Les biais issus de l’historique utilisateur ou des données de profil sont aussi à surveiller.

Enfin, l’analyse vidéo reste hors de portée pour la plupart des modèles, tout comme la gestion précise des coordonnées GPS. Dans l’état actuel, ces IA ne sont pas infaillibles, mais leur rythme de progression annonce des usages prometteurs pour la recherche en sources ouvertes et les enquêtes OSINT.

Pour en savoir plus

Les LLM maîtrisent-ils enfin la géolocalisation ?

Une rue ambiguë, un champ fraîchement fauché et un véhicule blindé stationné figuraient parmi les photos d’exemple que nous avons choisies pour mettre au défi les grands modèles de langage (LLM) d’OpenAI, Google, Anthropic, Mistral et xAI de les géolocaliser. Retour en…

Lire la suite sur bellingcat
Les LLM maîtrisent-ils enfin la géolocalisation ?

(Re)découvrez également:

Comment géolocaliser une équipe de programmation de missiles avec une photo

Voici encore un exemple de la puissance de renseignements rendue possible en combinant quelques photos

Lire la suite sur dcod.ch
Comment géolocaliser une équipe de programmation de missiles avec une photo

Zéro paywall. Zéro pub.
DCOD reste en accès libre grâce à vos contributions. Chaque café compte.

☕ Je participe
Etiquettes
  • ChatGPT
  • Claude
  • Google Lens
  • Grok
  • hallucination
  • LLM
Marc Barbezat

Fondateur et éditeur de DCOD - Restons en contact !

A lire également
Un utilisateur assis à un bureau en bois consulte sur son ordinateur portable l'assistant Lumo de Proton, symbolisé par un chat violet à l'écran, illustrant l'outil AI Paper Trail conçu pour évaluer la confidentialité des échanges sur ChatGPT et Claude. — Logo DCOD en filigrane.
Lire l'article

Proton lance AI Paper Trail pour évaluer ChatGPT et Claude

Logo noir d'Anthropic Claude avec son symbole en étoile sur un fond terracotta à motifs géométriques en zigzag.
Lire l'article

Claude : les filigranes invisibles déjà contournés

Main robotique blanche levée sur un fond bleu à côté du logo officiel de LinkedIn.
Lire l'article

LinkedIn réduit de 40% la visibilité des contenus générés par IA

Des idées de lecture recommandées par DCOD

Page frontale du livre Hacking et Cybersécurité Mégapoche pour les Nuls

Hacking et Cybersécurité Mégapoche pour les Nuls

Protéger-vous des hackers en déjouant toutes leurs techniques d'espionnage et d'intrusions et mettez en place une stratégie de cybersécurité dans votre entreprise grâce à ce livre 2 en 1.

📘 Voir sur Amazon
Ethical Hacking

Sécurité informatique - Ethical Hacking

Ce livre a pour objectif d'initier le lecteur aux techniques des attaquants pour lui apprendre comment se défendre. Cette nouvelle édition tient compte de l'actualité en matière de sécurité informatique et voit l'apparition de trois nouveaux chapitres qui traitent de la sécurité des mobiles, des voitures connectées et de l'étude des malwares.

📘 Voir sur Amazon

Hacking pour débutant: Le guide complet pour débuter en cybersécurité

La plupart des gens pensent que le hacking est quelque chose de magique, ou que les hackers sont nés avec ce talent de pouvoir pénétrer dans les ordinateurs et les réseaux. Ce n'est pas vrai.

📘 Voir sur Amazon

🛒 Les liens ci-dessus sont affiliés : en commandant via ces liens, vous soutenez la veille DCOD sans frais supplémentaires 🙏

💡

Note : Certaines images ou extraits présents dans cet article peuvent provenir de sources externes citées à des fins d’illustration ou de veille.
Ce site est indépendant et à but non lucratif. 👉 En savoir plus sur le cadre d’utilisation.

DCOD | Cybersécurité • IA • Tech DCOD | Cybersécurité • IA • Tech
  • Marc Barbezat
  • À propos de DCOD / Contact
  • Politique de confidentialité
Veille stratégique Cybersécurité, IA & Tech. Produite par Marc Barbezat.

Saisissez vos mots-clés de recherche et appuyez sur Entrée.

DCOD reste gratuit grâce à vous
Vos cafés aident à faire vivre la veille et à couvrir les frais techniques. Merci !
Offrir un café ☕
☕

Soutenir la veille DCOD

DCOD est un site 100% indépendant, maintenu en accès libre grâce à ses lecteurs.
Si cette veille cyber vous est utile, un coup de pouce mensuel aide à la faire vivre et à couvrir les frais techniques.

☕ Soutenir chaque mois