L'automatisme le plus coûteux de la plateforme
Chaque document que vous téléversez dans un dossier est — sauf exclusion volontaire — automatiquement lu, classifié et intégré au graphe des faits du dossier. C'est exactement le cœur « copilote » de notre plateforme : vous n'avez rien à déclencher, l'analyse se fait d'elle-même. Mais c'est justement ce qui fait de cet automatisme le déclencheur d'IA le plus fréquent et le plus coûteux de toute la plateforme — chaque téléversement peut déclencher une exécution en arrière-plan, y compris lors d'un import volumineux avec de nombreux fichiers à la fois.
La question que nous nous sommes posée
Un automatisme qui s'exécute à chaque téléversement doit répondre à une question simple : ne relit-il que lorsque c'est vraiment nécessaire ? Nous avons passé notre propre architecture au crible sur exactement ce point. Le résultat était nuancé. À plusieurs endroits centraux — votre assistant IA, les projets de conclusions et de contrats, le résumé global du dossier — l'IA s'appuie déjà depuis longtemps sur des faits déjà extraits et des résumés de documents enregistrés plutôt que sur le texte intégral ; le texte intégral n'est rechargé de façon ciblée que lorsqu'une question précise l'exige. À un endroit qui s'exécute très fréquemment, ce n'était pas le cas : l'exécution automatique qui met à jour le graphe des faits d'un dossier à chaque nouveau document générait, pour chaque document concerné, un résumé propre et éphémère — même lorsque ce document précis avait déjà été intégralement résumé peu de temps auparavant.
Ce qui fonctionne autrement désormais
Avant qu'une analyse automatique ne résume un document, le système vérifie d'abord si un résumé récent, dans la même langue, existe déjà — peu importe quel processus antérieur l'a généré. S'il en existe un, il est repris directement : aucun nouvel appel à l'IA, aucun coût supplémentaire. S'il n'en existe pas, il est généré une seule fois et enregistré pour tous les consommateurs futurs — votre assistant IA, le système de gestion documentaire, chaque autre exécution automatique. Dans cette évolution, nous avons étendu ce principe aux trois exécutions d'analyse automatique qui lisent un dossier dans son intégralité — y compris la plus coûteuse de loin, celle qui traite un dossier section par section dans son ensemble : un succès de cache y épargne non seulement un unique appel à l'IA, mais toute la chaîne de traitement à plusieurs étapes pour ce document.
En toute franchise sur les limites
Un résumé enregistré n'est jamais réutilisé aveuglément. Il doit correspondre à la langue demandée, être suffisamment détaillé — un résumé très succinct ne suffit pas pour une analyse portant sur l'ensemble du dossier — et être à jour : si vous téléversez une nouvelle version d'un document, l'entrée de cache existante est automatiquement considérée comme obsolète. Et si une reconnaissance de texte est encore en cours pour un scan volumineux, le résultat intermédiaire n'est délibérément PAS enregistré — sinon, une première tranche incomplète évincerait durablement le résumé complet ultérieur. Nous avons profité de l'occasion pour combler cette lacune exactement à l'endroit où elle est apparue en premier.
L'efficacité n'est que la moitié de l'histoire
Moins d'appels à l'IA inutiles ne répond pas à la deuxième question : qui décide de la façon dont votre cabinet gère automatiquement son quota ? C'est pourquoi votre cabinet dispose en plus de trois réglages. Une intensité d'automatisation à l'échelle du cabinet — Économe, Standard ou Maximale — détermine la façon dont la plateforme réagit lorsque le quota se fait rare ; elle ne décide jamais si les agents travaillent automatiquement, cela reste actif à chaque niveau. Une notification échelonnée à 80 % et 90 % du quota mensuel vous avertit bien avant l'arrêt strict. Et un plafond de tokens librement réglable par dossier permet, si besoin, de limiter séparément un dossier particulièrement volumineux ou sensible — indépendamment du reste du cabinet. À cela s'ajoute, depuis un certain temps déjà, un plafond fixe de 15 exécutions automatiques par dossier et par heure, afin qu'un téléversement massif ne déclenche pas des dizaines d'exécutions simultanées.
En conclusion
Un outil d'IA qui traite chaque requête de manière isolée devient inutilement coûteux lorsqu'un même dossier fait l'objet d'un travail récurrent. La réutilisation plutôt que la répétition n'est donc pas un effet secondaire, mais un principe architectural que nous intégrons dans chaque nouvelle fonction automatique — et que nous vérifions régulièrement par rapport à l'état réel du code, pas seulement une fois lors de la construction.
→ Pour les avocat(e)s : /fuer-anwaelte · Démarrer la vérification : /lawyer/onboarding




