Comment automatiser un site web sans API
Utilise l'interface qu'un site propose déjà sans endpoint : portails fournisseurs, consoles d'administration, systèmes legacy qu'un agent peut piloter.
Quand un site n'a pas d'API, l'interface devient la surface d'intégration. Un agent de navigateur lit la page, effectue les mêmes actions qu'une personne, et vérifie le résultat, ce qui rend automatisables les portails fournisseurs, les consoles d'administration et les outils internes legacy, sans attendre un endpoint qui n'arrivera peut-être jamais.
L'intégration qui n'arrive jamais
La plupart des logiciels métier n'ont qu'une couverture API partielle, au mieux. Le workflow dont tu as besoin est souvent celui caché derrière un tableau, un écran d'administration, un portail fournisseur ou un outil interne legacy, et l'endpoint est soit manquant, soit non documenté, soit limité en débit, soit verrouillé derrière un palier tarifaire que tu n'as pas.
Le navigateur est la couche commune à tout cela. Tout ce qu'une personne peut faire dans un onglet est automatisable, ce qui fait du navigateur la surface d'intégration de dernier recours et, souvent, la seule disponible.
- Portails fournisseurs et partenaires sans API publique
- Consoles d'administration où l'API omet exactement l'action dont tu as besoin
- Systèmes internes legacy que personne ne va re-plateformiser
- Paliers SaaS qui réservent l'accès API à un plan supérieur
Le faire de façon responsable
Accéder au navigateur ne te donne pas la permission d'ignorer les règles d'un site. N'utilise un agent que là où tu es autorisé, et respecte les conditions d'utilisation, les instructions robots le cas échéant, les limites de débit, les obligations de confidentialité et la loi applicable. C'est un outil pour du travail légitime, pas un moyen de contourner des contrôles d'accès ou une protection anti-bot.
En pratique, cela veut dire : tes propres comptes, tes propres portails fournisseurs, des systèmes que ton organisation a le droit d'utiliser, et un humain qui vérifie tout ce qui compte.
La rendre fiable
Donne à l'agent la portée la plus étroite qui suffit à accomplir la tâche, démarre depuis la page plutôt que de lui demander de trouver le site, et exige une validation avant toute écriture. Vérifie le résultat comme le ferait une personne : relis la page après l'action et vérifie que le changement a réellement eu lieu.
- Démarre sur l'onglet qui contient déjà la fiche concernée
- Garde la portée sur Cet onglet, sauf si la tâche couvre vraiment plusieurs onglets
- Valide avant tout envoi, publication, paiement ou suppression
- Demande la preuve, pas seulement la conclusion
Questions fréquentes
Est-ce la même chose que le web scraping ?
C'est lié, mais plus large. Le scraping lit. Un agent de navigateur peut aussi agir : remplir un formulaire, mettre à jour une fiche, faire circuler l'information entre systèmes. Les deux portent la même responsabilité de respecter les conditions et la loi.
Va-t-il casser quand le fournisseur refond le portail ?
Bien moins souvent qu'un script à sélecteurs, parce que l'agent cible le sens plutôt que la structure du DOM. Une refonte qui casserait un script se résume en général à une simple relecture pour un agent.
Peut-il fonctionner derrière une connexion ?
Oui. Il tourne dans ton vrai navigateur sur un onglet auquel tu l'attaches, il utilise donc la session où tu es déjà connecté. Il ne saisit jamais de mot de passe.
