Le 6 octobre 2026, OpenAI a détaillé comment l’éditeur Ironclad fait travailler ses agents d’IA directement dans son logiciel de gestion des contrats, sans passer par une interface dédiée. Derrière l’annonce technique se cache une question très concrète pour un dirigeant : jusqu’où laisser une machine agir seule dans vos outils métier ? La réponse tient moins à la puissance du modèle qu’aux garde-fous que vous posez.
Que s’est-il passé le 6 octobre 2026 ?
OpenAI a publié un point d’étape sur une collaboration de recherche avec Ironclad, présentée comme une référence dans les contrats assistés par IA. L’ambition dépasse la simple conversation : il s’agit d’entraîner des agents à utiliser eux-mêmes des logiciels métier spécialisés, en comprenant les règles de l’entreprise et en menant des enchaînements d’actions. Ironclad est le premier d’un petit nombre d’éditeurs avec lesquels OpenAI travaille sur ce sujet.
Ironclad, c’est quoi exactement ?
Ironclad est un éditeur de logiciel de gestion du cycle de vie des contrats. Ses clients, directions juridiques et services achats, y rédigent, valident et suivent des accords. Ce n’est pas un outil grand public : c’est un logiciel métier, pensé pour un usage professionnel précis. La société collabore avec les outils d’OpenAI depuis 2023, et son cofondateur a rejoint OpenAI pour y piloter une activité tournée vers le juridique.
Concrètement, que fait un agent dans un logiciel métier ?
Il le manipule comme un salarié, en enchaînant les écrans et les actions au lieu d’attendre qu’on lui dicte chaque clic. Chez Ironclad, les tâches retenues incluent la mise en place d’accords de confidentialité, la création de circuits d’approbation pour les achats, ou encore la mise à jour d’une clause réutilisable selon la juridiction choisie. Pour s’entraîner, les modèles ont travaillé dans des environnements hébergés du produit, avec des exercices bâtis autour de flux réels. L’enjeu n’est pas de réussir une action isolée, mais de mener le processus complet du début à la fin.
Ces agents sont-ils prêts à travailler sans surveillance ?
Non, et OpenAI présente lui-même ce chantier comme de la recherche. Sur 11 tâches évaluées, la firme annonce un score moyen de 55 % pour GPT-6 Astra, contre 41,6 % pour le modèle précédent, avec un temps par tentative estimé qui tombe de 37 à 19,2 minutes. Ces chiffres sont ceux d’OpenAI : les durées sont simulées et les tâches ont été co-définies avec le partenaire. Un score proche de la moitié ne suffit pas pour un usage sans relecture. Chaque tâche était jugée sur 8 à 50 critères, ce qui montre où le modèle réussit et où il échoue.
Quelles précautions avant de laisser un agent agir ?
La règle tient en une phrase : l’agent prépare, l’humain valide. Sur les opérations sensibles, une validation par une personne reste indispensable : approbation d’une dépense, acceptation d’une clause, engagement contractuel, envoi d’un document au client. Il faut aussi savoir quelles données l’agent consulte et alimente, et limiter ses accès à ce qui est nécessaire. Les acteurs du secteur insistent sur ce point : un agent utile s’insère dans les contrôles déjà en place dans l’entreprise, sans les court-circuiter.
Et votre site, dans tout ça ?
Un agent travaille sur ce qui existe déjà : si vos process sont flous, il reproduira le flou. Un site bien structuré, avec des formulaires clairs et des demandes qui arrivent déjà qualifiées, simplifie tout ce que vous automatiserez ensuite, à Auxerre comme ailleurs.