Aller au contenu
Automatisation Bêta

Connecter l'agent navigateur à l'IA : l'assistant ouvre vraiment le site

Oui. IntraGPT peut piloter un vrai navigateur sur un serveur dédié. L'assistant ne fait donc pas semblant de lire une page : il l'ouvre, s'y repère, remplit des formulaires, lit le contenu et peut conserver une image de ce qu'il voit. Cette partie figure en bêta dans la plateforme et nous la mettons en place avec le client.

Un fournisseur ne publie ses délais de livraison que sur son propre portail. Une autorité met en ligne un registre auquel rien d'autre n'est rattaché. Un tarif figure dans un tableau qui change chaque semaine. Dans tous ces cas, aucune intégration n'est possible, faute de porte d'entrée. Ce qui existe, en revanche, c'est un site qu'un humain sait très bien utiliser. L'agent navigateur, c'est exactement cela : un vrai navigateur qui tourne sur un serveur dédié et que l'assistant pilote. Il ouvre la page, regarde ce qui s'y trouve, poursuit la navigation, remplit un formulaire, lit le contenu et peut conserver une image de ce qu'il voit à cet instant. Parce qu'il regarde avant d'agir, il ne se bloque pas dès qu'un bouton se déplace ou qu'un champ change de nom. Chaque session démarre à vide et aucune session connectée ne subsiste après coup. La fonction n'opère que sur les assistants où elle a été activée. La plateforme classe cette partie en bêta : nous choisissons les premières tâches avec le client et élargissons dès que cela tourne bien.

Ce que l'agent navigateur sait faire sur un site

Ouvrir vraiment, pas deviner

L'assistant ouvre le site dans un vrai navigateur et voit la page comme la voit un visiteur. Il travaille donc sur ce qui s'y trouve maintenant, pas sur une copie ancienne ni sur un résumé venu d'ailleurs.

Regarder d'abord, agir ensuite

Avant de cliquer, l'assistant prend la mesure de la page : quels titres, liens, boutons et champs s'y trouvent. C'est pour cela qu'il retrouve le bon endroit même quand la mise en page a changé.

Naviguer et remplir

Chercher, poursuivre la navigation, remplir un formulaire, faire un choix et valider : les gestes qu'un collaborateur ferait aussi. Ce qu'il rencontre, il le dit dans la conversation, de sorte que vous pouvez suivre où il en est.

Lire et conserver une trace

L'assistant récupère le contenu de la page et peut en conserver une image. Pratique quand vous voudrez pouvoir montrer plus tard ce que cette page affichait à ce moment-là.

Se connecter là où c'est permis

Pour les sites dont vous souhaitez enregistrer les identifiants, l'assistant peut se connecter lui-même puis poursuivre. Si rien n'est enregistré pour un site, il ne va pas au-delà de la partie publique et le dit simplement.

Du travail qui ne se fait plus à la main

Industrie et production

Situation
Le délai de livraison d'une pièce ne figure que dans le portail du fournisseur, derrière une connexion.
Ce que fait l’agent
L'assistant ouvre le portail, se connecte avec les identifiants enregistrés pour cela, cherche la référence et relève la semaine de livraison.
Résultat
La préparation du travail obtient la réponse dans la conversation et n'a plus à cliquer dans le portail.

Secteur public

Situation
Un agent doit consulter un registre public dont la mise en page diffère à chaque recherche.
Ce que fait l’agent
L'assistant remplit le formulaire de recherche, le valide et observe d'abord la page de résultats avant de la lire.
Résultat
Une réponse accompagnée d'une image de l'écran, pour que la source reste vérifiable.

Juridique

Situation
Un dossier doit conserver la trace de ce qu'affichait une page publique à un moment précis.
Ce que fait l’agent
L'assistant ouvre la page, en extrait le texte et conserve l'image dans la même session.
Résultat
Texte et image du même instant, sans que personne ne fasse de copier-coller.

Achats

Situation
Un tarif figure sous forme de tableau sur un site et change régulièrement sans que personne ne prévienne.
Ce que fait l’agent
L'assistant ouvre la page, lit le tableau et le compare à ce qui avait été relevé auparavant.
Résultat
Une liste des écarts dans la conversation plutôt que deux écrans côte à côte et une loupe.

Comment cela se passe en pratique

  1. 1

    Activer par assistant

    La fonction navigateur est activée ou non pour chaque assistant. Si elle est désactivée, cet assistant ne peut ouvrir aucun site.

  2. 2

    Régler droits et identifiants

    Vous décidez quels collaborateurs peuvent utiliser l'assistant et pour quels sites des identifiants sont enregistrés. Sans identifiants enregistrés, il reste sur la partie publique.

  3. 3

    Ce que voit l'assistant

    Uniquement la page qu'il a ouverte à cet instant. Chaque session démarre à vide et rien ne reste connecté ensuite.

  4. 4

    Ce qui est enregistré

    Ce que l'assistant ouvre et fait figure dans la conversation et est enregistré. Comme cette partie est en bêta dans la plateforme, nous suivons les premières tâches avec le client.

Une connexion sécurisée

Connexion, visibilité et limites de l'assistant

Un assistant capable de cliquer et de se connecter pour de vrai a besoin de limites claires. Elles se trouvent dans la plateforme elle-même, pas dans une consigne polie adressée au modèle.

Où résident les données: France

Le mot de passe reste hors de la conversation

Les identifiants que vous enregistrez servent à se connecter, mais n'arrivent jamais dans la conversation. Celle-ci indique tout au plus qu'une connexion a eu lieu sur ce site.

Seulement sur le site prévu

Les identifiants enregistrés appartiennent à un site et ne servent que là. Pour un site sans identifiants enregistrés, l'assistant reste sur la partie publique.

Pas pour tout le monde

Vous décidez quels assistants disposent de cette fonction et quels rôles peuvent s'en servir. Pour le reste de l'organisation, la fonction n'existe tout simplement pas.

Retraçable après coup

Ce qui est ouvert et fait est enregistré. Le modèle tourne sur un serveur en France, donc ce que l'assistant lit sur une page ne part pas chez un fournisseur de modèles américain et ne sert jamais à l'entraînement.

Questions sur l'agent navigateur

IntraGPT fonctionne-t-il avec un agent navigateur ?

Oui. L'assistant peut piloter un vrai navigateur sur un serveur dédié, et cette fonction s'active assistant par assistant. La plateforme classe cette partie en bêta et nous la mettons en place avec le client, afin de suivre les premières tâches.

L'assistant voit-il mon mot de passe ?

Non. Les identifiants que vous enregistrez servent à la connexion sur le site auquel ils appartiennent, mais n'apparaissent pas dans la conversation. Celle-ci indique tout au plus qu'une connexion a eu lieu. Si rien n'est enregistré pour un site, rien ne se passe et l'assistant dit qu'il ne peut pas aller plus loin.

Que se passe-t-il si le site change ?

La conception le prévoit. L'assistant ne suit pas un script figé écrit pour une seule mise en page, il regarde chaque fois à nouveau à quoi ressemble la page. Si un bouton se déplace ou si un champ change de nom, il le retrouve en général quand même. Si tout l'enchaînement change, il signale qu'il n'y arrive pas au lieu de cliquer au hasard.

Puis-je connecter un agent navigateur à ChatGPT ?

ChatGPT sait récupérer des pages, mais ce n'est ni votre navigateur ni votre session, donc se connecter à un portail fournisseur est exclu. Avec IntraGPT, le navigateur tourne dans notre propre dispositif, vous décidez quels assistants peuvent s'en servir, et les identifiants proviennent d'un espace que vous remplissez et pouvez vider vous-même.

Quelle est la différence avec l'extension Chrome ?

L'agent navigateur fait tourner son propre navigateur sur notre serveur et démarre chaque session à vide. L'extension Chrome utilise le navigateur du collaborateur, avec les sessions où il est déjà connecté. Pour le web public et pour un portail dont les identifiants peuvent être enregistrés, l'agent navigateur est le bon choix.

Que signifie bêta pour cette partie ?

La plateforme classe l'agent navigateur en bêta. Cela veut dire que nous le mettons en place avec le client : nous choisissons les premières tâches, observons comment l'assistant se déplace sur ces pages et élargissons dès que cela tourne bien. Les réglages ne diffèrent pas du reste de la plateforme, l'accompagnement si.

Les données restent-elles chez vous ?

Le navigateur tourne dans le même dispositif que le reste de la plateforme et le modèle tourne sur un serveur en France. Ce que l'assistant lit sur une page ne part pas chez un fournisseur de modèles américain et ne sert jamais à l'entraînement. Ce qui a été consulté reste par ailleurs retraçable.

Combien coûte un agent navigateur ?

Il n'y a pas de tarif séparé. Le travail se trouve dans le parcours que nous menons ensemble : combien de sites sont concernés, faut-il se connecter, quels identifiants sont enregistrés pour cela et quels collaborateurs peuvent utiliser l'assistant. Un entretien de trente minutes permet de le préciser.

Combien de temps prend la mise en place ?

Activer la fonction prend quelques minutes. Le temps se passe à choisir les premières tâches et à enregistrer les identifiants par site. Pour un portail avec une connexion simple, comptez une après-midi. Pour un site avec vérification en deux étapes, nous examinons d'abord si l'assistant a vraiment sa place là.

Pour quels secteurs

Autres connecteurs

Voir tous les connecteurs

Envie de savoir ce que ce connecteur vous apporterait ?

Planifiez une consultation IA gratuite de trente minutes. Nous examinons vos systèmes, les droits qui les entourent et le premier cas d'usage qui fait gagner du temps ou de l'argent.

Planifiez une consultation IA gratuite