Agents IA

Agents IA qui utilisent les logiciels comme un humain : ce que ça change pour les portails sans API

Portail fournisseur, extranet d’un grossiste, site administratif, vieux logiciel de gestion : beaucoup d’outils du quotidien n’offrent aucune API. Jusqu’ici, les automatiser relevait du bricolage. Les agents IA capables de « voir » un écran et d’utiliser souris et clavier ouvrent une nouvelle voie — à condition de les encadrer sérieusement.

Publié le · 6 min de lecture · Par Titouan Bedos, fondateur de Groupe Solution

Ce que c’est : une IA qui regarde l’écran et agit

On parle d’agents de type « computer use » (utilisation d’ordinateur) ou d’agents de navigation. Le principe : un modèle d’IA reçoit des captures d’écran d’un ordinateur ou d’un navigateur, comprend ce qui est affiché (boutons, champs, tableaux, messages d’erreur), puis décide de l’action suivante — cliquer à tel endroit, saisir un texte, faire défiler, ouvrir un menu. Il observe le résultat, et recommence jusqu’à atteindre l’objectif qu’on lui a fixé.

Anthropic a ouvert cette capacité en version bêta publique en octobre 2024 ; d’autres éditeurs, dont OpenAI, ont ensuite proposé des agents comparables capables de piloter un navigateur. Depuis, la fiabilité de ces agents progresse, mais ils restent plus lents et moins prévisibles qu’une intégration par API.

La différence avec l’automatisation « classique »

L’automatisation robotisée des processus (souvent appelée RPA) existe depuis longtemps : un robot rejoue une séquence de clics enregistrée. Son point faible est connu : si le bouton change de place, si une fenêtre inattendue s’ouvre, le script casse. Un agent IA, lui, interprète l’écran à chaque étape. Il peut s’adapter à une mise en page modifiée, lire un message d’erreur et réagir, ou retrouver un champ dont l’intitulé a légèrement changé. En contrepartie, son comportement n’est pas totalement déterministe : deux exécutions peuvent emprunter des chemins différents.

La hiérarchie reste donc la suivante : quand une API existe, on l’utilise. Elle est plus rapide, plus fiable, plus sûre. L’agent qui manipule l’écran est une solution pour les cas où aucune autre porte n’est ouverte.

Pourquoi c’est important maintenant

Les petites entreprises sont souvent prisonnières d’outils qu’elles ne maîtrisent pas : le portail de commande d’un fournisseur, l’extranet d’une centrale de réservation, l’espace professionnel d’un organisme, un logiciel installé il y a quinze ans. Ces outils n’offrent ni export automatisé ni API, et l’éditeur n’a aucune raison d’en développer une pour un client de petite taille.

Résultat : des heures de ressaisie, de téléchargements manuels de factures, de copier-coller de numéros de suivi. Les agents capables d’utiliser une interface graphique rendent enfin automatisables des tâches qui ne l’étaient pas économiquement. Ils s’ajoutent aux autres briques qui ont mûri récemment — lecture de documents par l’IA, connecteurs standardisés comme MCP — pour construire des chaînes de traitement complètes.

Il faut toutefois garder la tête froide : ces agents sont encore en progression. Ils conviennent aux tâches répétitives, bien définies et à faible enjeu unitaire, sous supervision. Ils ne sont pas prêts à gérer seuls des opérations critiques.

Cas d’usage concrets pour une TPE/PME

Récupérer factures et bons de livraison sur des portails fournisseurs

Un restaurateur ou un commerce qui travaille avec une dizaine de fournisseurs passe du temps chaque mois à se connecter à chaque espace client pour télécharger les factures. Un agent peut effectuer cette tournée, déposer les fichiers dans le bon dossier et signaler ceux qui manquent.

Passer des commandes répétitives

Un artisan qui commande régulièrement les mêmes fournitures chez un distributeur peut faire préparer le panier par l’agent à partir d’une liste validée, puis valider lui-même la commande finale.

Reporter des informations entre un portail et votre logiciel

Un hébergeur touristique reçoit des réservations sur un extranet sans connecteur vers son planning : l’agent relève les nouvelles réservations et les recopie dans l’outil interne, en signalant toute incohérence (dates qui se chevauchent, nombre de personnes inhabituel).

Suivre des démarches administratives

Un cabinet peut faire vérifier l’état de dossiers sur des espaces en ligne et recevoir un récapitulatif des changements de statut, plutôt que de se connecter manuellement à chaque portail.

Domaine viticole et export

Relever des informations de suivi d’expédition sur plusieurs sites de transporteurs et les consolider dans un tableau unique pour répondre aux clients.

Le bon critère : une tâche répétitive, sur un portail stable, avec un résultat facile à vérifier. Plus l’enjeu d’une erreur est élevé, plus la supervision doit être serrée.

Limites, sécurité et précautions

Respecter les conditions d’utilisation des sites

Certains portails interdisent explicitement l’accès automatisé dans leurs conditions générales. Avant toute automatisation, il faut les lire et, en cas de doute, demander l’accord de l’éditeur ou du partenaire. Utiliser vos propres identifiants pour vos propres données n’autorise pas pour autant à ignorer ces conditions.

Isoler l’agent

Un agent qui pilote un ordinateur doit travailler dans un environnement dédié — une machine virtuelle ou un navigateur isolé — et jamais sur le poste principal d’un collaborateur avec toutes ses sessions ouvertes. Il ne doit disposer que des accès nécessaires à sa mission.

Se protéger contre l’injection d’instructions

L’agent lit tout ce qui s’affiche. Une page web ou un document peut contenir un texte conçu pour le détourner. Les éditeurs de modèles alertent eux-mêmes sur ce risque. Parades : limiter la navigation aux sites prévus, interdire les actions sensibles sans validation, surveiller les journaux.

Gérer les identifiants avec soin

Les mots de passe ne doivent pas être écrits dans les instructions données à l’IA. On utilise un coffre-fort d’identifiants, des comptes dédiés quand le portail le permet, et on garde la main sur l’authentification forte : un agent ne doit pas contourner une double authentification.

Superviser et tracer

Chaque exécution doit laisser une trace : captures, actions réalisées, résultat. Les actions irréversibles (validation d’une commande, envoi d’un message, paiement) passent par une confirmation humaine. Un tableau de bord signale les échecs, car un portail modifié peut faire échouer l’agent.

Accepter les limites de performance

Un agent visuel est plus lent qu’un humain entraîné sur certaines tâches et consomme des ressources de calcul à chaque étape. Il est pertinent pour des volumes réguliers et fastidieux, moins pour des opérations ponctuelles.

Par où commencer

  1. Recensez les portails sur lesquels vous passez du temps chaque semaine, et estimez ce temps honnêtement.
  2. Vérifiez s’il existe une alternative plus robuste : API, export automatique, flux EDI, connecteur officiel. C’est souvent le cas, et c’est toujours préférable.
  3. Lisez les conditions d’utilisation des portails restants.
  4. Choisissez une tâche pilote à faible enjeu, dont le résultat se vérifie facilement (par exemple, le téléchargement de factures).
  5. Faites fonctionner l’agent en mode supervisé pendant plusieurs semaines, analysez les erreurs, puis élargissez prudemment.

Groupe Solution privilégie toujours l’intégration la plus fiable disponible. Quand un portail n’offre vraiment aucune autre possibilité, nous pouvons étudier un agent supervisé, isolé et journalisé, en commençant par un périmètre réduit.

Questions fréquentes

Un agent IA peut-il remplacer un collaborateur sur ces tâches ?

Il peut prendre en charge des tâches répétitives et bien définies, mais il doit rester supervisé. Les erreurs restent possibles, surtout quand l’interface change. Le collaborateur passe de la saisie au contrôle.

Est-ce légal d’automatiser l’accès à un portail avec mes identifiants ?

Cela dépend des conditions d’utilisation du portail. Certaines interdisent l’accès automatisé. Il faut les vérifier et, en cas de doute, demander l’accord de l’éditeur ou du partenaire concerné.

Quelle différence avec un robot RPA ?

Un robot RPA rejoue une séquence figée et casse si l’écran change. Un agent IA interprète l’écran à chaque étape et s’adapte mieux, mais son comportement est moins prévisible et demande davantage de contrôle.

Et si le portail propose une API ?

Il faut alors utiliser l’API : c’est plus rapide, plus fiable et plus sûr. L’agent qui manipule l’interface est une solution de dernier recours pour les outils fermés.

Réponse sous 24 h

Quelle tâche vous prend le plus de temps ?

Décrivez-la en deux phrases. Je vous réponds avec une première piste concrète — gratuitement, sans engagement.

Vous préférez parler ? 07 82 29 85 59 · Réserver une visio de 10 min