Veille
Fil conducteur
Tous les articles01 · Comprendre02 · Relier03 · Décider04 · Transmettre
Lecture
Publications

ArxyA à l'épreuve des sources officielles : citer ne suffit pas

J'ai testé ArxyA sur des cas fiscaux et juridiques vérifiables : erreur fiscale, réforme 2026, autocorrection, sources officielles et confidentialité.

Illustration éditoriale Kachouri sur le test d'ArxyA, avec une réponse IA, des documents officiels et une loupe symbolisant la vérification des sources.
Partager
LinkedIn ↗WhatsApp ↗Courriel
Plus
Ma lectureCommencer la lectureSources et vérifications
Nature
Analyse éditoriale
Mis à jour
30/09/2026
Méthode, sources et limites ↓
Ma lectureReprendre, écouter et annoter localementDonnées conservées sur cet appareil · sans compte
Ouvrir
Vos repères restent sur cet appareilComment ça marche

Favoris, progression, repères et préférences de lecture restent dans ce navigateur. Kachouri ne crée pas de profil de lecture distant pour ces données. Vous pouvez les exporter pour les conserver ou les effacer depuis Ma lecture. Comme pour toute page web, la consultation de la page reste visible par le serveur.

Dans cet article 12 repères

Le porteur du projet m'a proposé de tester ArxyA sans scénario préparé et sans accès privilégié. C'était la bonne manière de faire : créer un compte comme n'importe quel utilisateur, poser des questions dont je pouvais contrôler les réponses, puis remonter jusqu'aux textes qui auraient dû les soutenir.

Je n'ai donc pas cherché à savoir si l'IA écrivait bien. J'ai cherché à savoir ce qui se passe lorsqu'une réponse plausible rencontre une règle fiscale, sociale ou juridique qui, elle, ne peut pas être approximative. Une IA spécialisée peut donner l'impression d'être experte très vite. La difficulté commence au moment où l'utilisateur doit agir à partir de ce qu'elle affirme.

Le test a été réalisé le 18 septembre 2026 avec un compte gratuit, sur les trois modes alors accessibles : Fiscalité, Administratif et Diagnostic Entreprise. Entre ce test et la publication, la page d'accueil d'ArxyA a aussi commencé à mettre en avant une offre distincte, ArxyA Expert, présentée comme une "IA fiscale vérifiable" avec sources officielles datées, niveau d'incertitude et mode contradictoire. Je ne l'ai pas testée. Les constats qui suivent portent donc uniquement sur le parcours gratuit effectivement observé le 18 septembre.

Autre précision de méthode : le rapport de consolidation technique utilisé en parallèle a été produit par Koperateur Consulting dans le cadre de ce test. Il reprend un export automatisé de 52 contrôles. Cette proximité est déclarée parce qu'elle compte pour la lecture. Elle ne transforme ni le score obtenu en verdict, ni les constats favorables en preuve de sécurité globale.

La vraie promesse d'ArxyA n'est pas de répondre vite

ArxyA se présente comme un assistant fiscal, comptable et administratif spécialisé en droit français. Sa page publique annonce des réponses sourcées en quelques secondes, la citation de sources officielles à chaque réponse et treize références de travail, parmi lesquelles le BOFiP, impots.gouv.fr, l'Urssaf, Légifrance, Service Public, l'INPI, l'ANC et EUR-Lex.

Cette promesse change complètement la manière de tester le produit. Si ArxyA n'était qu'un assistant généraliste, une réponse prudente et correctement formulée pourrait déjà être utile. Ici, la valeur annoncée repose sur une chaîne plus exigeante : retrouver la bonne règle, utiliser la version applicable, restituer son effet sans la déformer et permettre à l'utilisateur de vérifier immédiatement d'où vient l'affirmation.

C'est exactement le déplacement que j'ai récemment étudié avec l'Answer Engineering : une sortie peut être propre, structurée et convaincante tout en restant factuellement fausse. La présence d'un champ "source" ou du nom d'une administration ne résout donc pas le problème. Elle ne fait que le rendre vérifiable, à condition que le lien entre l'affirmation et la source soit réellement construit.

Premier test : le bon statut social, puis la mauvaise règle

La première question était volontairement simple à contrôler. Un associé unique, également gérant de son EURL soumise à l'impôt sur les sociétés, ne se verse aucune rémunération en 2026. Je demande s'il est assimilé salarié ou travailleur non salarié, s'il doit malgré tout payer des cotisations et je réclame les sources officielles exactes avec leurs liens et références.

ArxyA identifie correctement le statut : le gérant associé unique relève bien du régime des travailleurs non salariés. Puis la réponse bascule sur le point qui comptait réellement. Elle indique qu'en l'absence de rémunération et de dividendes, aucune cotisation minimale n'est généralement due sur la rémunération, avant de conseiller de vérifier auprès de l'Urssaf si une cotisation minimale pourrait subsister.

La fiche officielle Service Public vérifiée en 2026 dit l'inverse : le gérant associé unique d'une EURL doit verser des cotisations sociales minimales obligatoires même en l'absence de rémunération, notamment au titre des indemnités journalières, de la retraite de base et de l'invalidité-décès.

Ce n'est pas une petite imprécision autour d'un taux. C'est le type de phrase qui peut modifier le comportement d'un dirigeant. Une réponse qui "sonne juste" peut alors devenir plus dangereuse qu'une absence de réponse, précisément parce qu'elle réduit l'envie de vérifier. C'est aussi ce que montre plus largement mon travail sur l'IA et la prise de décision : une recommandation convaincante n'améliore pas automatiquement la décision humaine qui suit.

Nommer une administration n'est pas encore sourcer une réponse

Le point le plus révélateur arrive à la fin de la réponse. J'avais demandé des pages précises, des URL, des dates et les références juridiques applicables. ArxyA termine en renvoyant vers impots.gouv.fr, le BOFiP et Légifrance, tout en invitant à vérifier la référence exacte et à jour sur le site officiel.

Autrement dit, l'outil connaît les bons territoires documentaires, mais il laisse encore à l'utilisateur une partie du travail qui justifie précisément l'existence du produit : retrouver le texte qui prouve ou contredit l'affirmation.

Une source officielle n'est pas une décoration de fin de réponse. Pour devenir utile, elle doit permettre de remonter de l'affirmation au texte, du texte à sa version, puis de cette version au cas réellement posé. Le test de DEPOSIUM sur la mémoire, les contradictions et les hallucinations documentaires mène au même mécanisme par un autre chemin : retrouver un document ne suffit pas si le système ne sait pas distinguer ce qui est actuel, ancien, contradictoire ou insuffisant.

Quand je demande une autocorrection, le produit s'arrête avant la réponse

J'ai ensuite repris l'affirmation litigieuse en demandant explicitement à ArxyA de la revérifier, de préciser les cotisations minimales applicables en 2026 et, si la première réponse était incorrecte, de le dire clairement.

L'interface a accepté la demande, affiché ses phases d'analyse puis de rédaction, avant de terminer sur une erreur serveur. J'ai renvoyé exactement la même requête une seconde fois. Le comportement a été identique.

Ce constat est limité mais solide : je ne peux pas conclure que le modèle sous-jacent est incapable de corriger son erreur, puisque aucune correction n'a été produite. Je peux en revanche établir que sur cette demande précise, le parcours d'autocorrection a échoué deux fois de manière reproductible.

Pour une IA métier, ce point compte autant que la première réponse. La qualité d'un système ne se mesure pas seulement à ce qu'il produit quand tout se passe bien, mais à sa capacité à supporter la contradiction, revenir sur une affirmation et montrer ce qui a changé entre deux états de connaissance.

Le droit 2026 montre pourquoi la date d'une source fait partie de la réponse

Le deuxième scénario portait sur une société de 60 salariés dotée d'un CSE et sur un projet de cession de plus de 50 % de son capital. La question demandait quelles obligations d'information ou de consultation s'appliquaient après les modifications législatives de 2026.

ArxyA donne une réponse qui va dans la direction attendue pour une entreprise disposant d'un CSE exerçant les attributions des entreprises d'au moins 50 salariés, mais son raisonnement conserve un ancien repère : il présente encore le seuil de 250 salariés comme critère structurant de l'information individuelle.

Or la loi n° 2026-403 du 26 mai 2026 a précisément modifié ce cadre. L'article L23-10-1 du Code de commerce ne raisonne plus sur l'ancien seuil de 250 salariés mais sur l'obligation de disposer d'un CSE exerçant les attributions prévues pour les entreprises d'au moins 50 salariés. Pour les sociétés qui ne relèvent pas de ce régime, le délai d'information préalable est désormais d'un mois. La loi a également abrogé plusieurs anciens articles du dispositif et s'applique aux ventes conclues au moins deux mois après sa promulgation.

Je reste volontairement prudent sur la qualification juridique complète du cas, car l'objectif du test n'est pas de remplacer un conseil en droit social ou en cession d'entreprise. Le point démontré est ailleurs : une réponse peut conserver la bonne intuition tout en embarquant une règle devenue obsolète. C'est exactement le problème de la continuité temporelle que j'ai abordé avec OAM, l'architecture de mémoire conçue pour relier ce qui change dans le temps. Dans les métiers réglementés, mémoriser une règle sans mémoriser sa période de validité revient à préparer une future erreur.

Le "Diagnostic Entreprise" calcule correctement, mais ne diagnostique pas le problème posé

Le troisième test partait d'une SAS au capital de 100 000 euros, avec 35 000 euros de capitaux propres, 80 000 euros de trésorerie et des dettes exigibles réglées à échéance. La question demandait de distinguer deux notions différentes : la perte de la moitié du capital et la cessation des paiements.

Le mode Diagnostic Entreprise lance un questionnaire en sept étapes, mais ne conserve pas les variables centrales du scénario. Il demande le chiffre d'affaires, les charges, le nombre de salariés, la TVA, le secteur et l'ancienneté. Avec 500 000 euros de chiffre d'affaires et 430 000 euros de charges, il calcule un résultat estimé de 70 000 euros puis un impôt sur les sociétés d'environ 13 250 euros sous conditions.

Le calcul arithmétique est cohérent avec le taux réduit d'IS de 15 % sur la première tranche de 42 500 euros lorsque les conditions sont réunies. Mais ce n'était pas le diagnostic demandé. Le parcours n'a posé aucune question complémentaire sur le passif exigible, l'actif disponible ou la mécanique juridique de perte de la moitié du capital.

Service Public rappelle pourtant qu'une SAS dont les capitaux propres deviennent inférieurs à la moitié du capital social entre dans une procédure spécifique, avec notamment une consultation des associés dans les quatre mois suivant l'approbation des comptes ayant fait apparaître la perte.

Le problème n'est donc pas qu'un questionnaire guidé soit mauvais. Il est qu'un mot comme "diagnostic" laisse imaginer une capacité à qualifier la situation soumise, alors que le moteur suit ici un arbre beaucoup plus étroit. Un calcul peut être exact et répondre à la mauvaise question.

Un 70/100 technique ne dit pas si l'IA est fiable

En parallèle, le rapport de consolidation technique daté du 18 septembre agrège 52 contrôles et affiche 70/100, grade C. Ce nombre est utile pour hiérarchiser des vérifications. Il ne constitue ni une note générale de sécurité, ni une mesure de la qualité des réponses fiscales. J'avais déjà rencontré la même limite en analysant SEOPlus! et son 90/100 puis Mozilla Observatory appliqué aux acteurs français de la cybersécurité : un score aide à prioriser, mais ne transforme pas mécaniquement un constat de configuration en preuve de sécurité globale.

Le rapport relève un certificat valide, TLS 1.3 observé, DNSSEC actif, une redirection HTTP vers HTTPS et aucun traceur détecté sur le périmètre public examiné. Il signale aussi un durcissement HTTP incomplet sur l'accueil, notamment l'absence de CSP et de plusieurs en-têtes de protection au moment du contrôle.

Aucun de ces constats ne démontre une compromission. À l'inverse, aucun score public ne permet d'affirmer qu'une application est "sécurisée" dans son ensemble. Le test n'a pas couvert l'isolation entre deux comptes, les politiques Supabase, les autorisations réelles de chaque API, l'effacement des sauvegardes ni un test d'intrusion autorisé.

"Confidentiel" ne veut pas dire "reste uniquement chez ArxyA"

La page publique indique que les conversations et données d'entreprise sont stockées de manière sécurisée et ne sont jamais vendues. La politique de confidentialité détaille davantage la chaîne technique : Supabase pour la base et l'authentification, Anthropic pour le traitement des requêtes, Stripe pour les paiements et Vercel pour l'application. Elle prévoit également des transferts vers les États-Unis encadrés par des mécanismes contractuels ou le Data Privacy Framework.

Ce constat ne contredit pas, à lui seul, le mot "confidentiel". Une donnée peut être traitée par plusieurs sous-traitants tout en restant couverte par des obligations de confidentialité. Il empêche en revanche de comprendre "confidentiel" comme "la donnée ne sort jamais de l'environnement ArxyA".

Anthropic indique par ailleurs que les entrées et sorties de ses offres commerciales ne sont pas utilisées par défaut pour entraîner ses modèles. Pour l'API, la durée standard annoncée est une suppression des entrées et sorties du backend dans les 30 jours, sauf accord différent, nécessité de faire respecter la politique d'usage ou obligation légale. Des accords de rétention zéro existent pour certains clients API, mais aucun élément public examiné ne permet d'affirmer qu'ArxyA en bénéficie.

Ce point rejoint directement l'analyse sur l'IA et la dépendance technologique : localisation, confidentialité, rétention, réversibilité et contrôle des fournisseurs sont des dimensions différentes. C'est également la distinction défendue dans Souveraineté numérique ou semi-souveraineté : mesurer le contrôle réel, où le contrôle se mesure couche par couche plutôt qu'à travers un seul qualificatif. Les fusionner sous un mot rassurant fait perdre de l'information utile.

Ce qu'ArxyA fait déjà correctement

Un test critique n'a d'intérêt que s'il conserve aussi ce qui fonctionne. L'interface est claire, les trois modes sont immédiatement compréhensibles et le parcours d'inscription reste léger. Le mode Fiscalité a correctement identifié le statut TNS du gérant associé unique. Le mode Administratif a capté la logique générale d'un régime modifié en 2026, même si son explication conservait un ancien seuil. Le diagnostic a réalisé correctement son calcul arithmétique et a présenté le taux réduit d'IS comme conditionnel.

J'ai également supprimé le compte depuis les paramètres. L'interface demande de saisir explicitement SUPPRIMER, annonce la suppression définitive du compte et des données, met fin à la session puis renvoie vers la partie publique. C'est un parcours visible, clair et accessible à l'utilisateur. Il démontre que la commande existe et que la session est révoquée. Il ne démontre pas, à lui seul, l'effacement physique de chaque sauvegarde ou copie technique en arrière-plan.

Les CGU vont aussi dans le bon sens sur un point essentiel : elles précisent que les réponses peuvent contenir des erreurs ou des imprécisions et ne remplacent pas un professionnel qualifié. La difficulté vient de la coexistence entre cette prudence contractuelle et une promesse commerciale plus forte autour de la précision, des sources officielles et, désormais pour l'offre Expert, de la vérifiabilité.

Plus la promesse devient précise, plus elle devient testable. C'est plutôt sain : un produit qui revendique la preuve peut être évalué sur la qualité de sa chaîne de preuve.

Ce que ce test ne permet pas de conclure

Ce protocole a été réalisé le 18 septembre 2026 sur un compte gratuit et avec un nombre volontairement limité de scénarios. Il ne mesure pas un taux d'erreur global d'ArxyA, ne permet pas de comparer statistiquement le service à ChatGPT, Claude, Gemini ou à un expert humain et ne prouve pas que les mêmes erreurs se reproduisent sur toutes les sessions.

L'erreur serveur a été reproduite deux fois sur la même demande, mais sa cause n'est pas connue. Elle peut provenir du backend, du fournisseur de modèle, d'un délai d'attente, d'une étape de recherche documentaire ou d'un autre composant. Sans journaux applicatifs, lui attribuer une cause serait spéculatif.

Le rapport technique n'est pas un pentest. La politique de confidentialité décrit des fournisseurs et des durées annoncées, mais je n'ai pas vérifié les contrats, les régions réellement configurées, les mécanismes de sauvegarde, les accès de support ni l'exécution complète d'une demande d'effacement.

Enfin, l'offre ArxyA Expert actuellement mise en avant n'a pas été testée dans ce protocole. Il serait incorrect d'étendre automatiquement à cette offre des constats observés sur le compte gratuit dix jours plus tôt.

Le produit le plus important n'est peut-être pas la réponse, mais la chaîne de preuve

ArxyA a un positionnement lisible et un intérêt évident : réduire le temps nécessaire pour orienter une question fiscale, comptable ou administrative vers les bons textes. Le test montre aussi pourquoi cette ambition est plus difficile qu'elle n'en a l'air.

Dans une IA spécialisée, la source ne devrait pas arriver comme une note de bas de page ajoutée après la génération. Elle fait partie du produit. Elle doit permettre de répondre à des questions simples : de quel texte vient cette affirmation, quelle version était applicable, à quelle date, quel passage la soutient, quelles hypothèses ont été utilisées et qu'est-ce qui manque encore pour conclure ?

Le premier scénario montre qu'une mauvaise conclusion peut rester crédible lorsqu'elle est entourée de noms de sources officielles. Le second montre qu'une autocorrection peut échouer avant même d'être produite. Le troisième montre qu'un repère juridique ancien peut survivre dans une réponse qui paraît pourtant actualisée. Le quatrième montre qu'un parcours peut calculer correctement tout en perdant la question initiale. Pris ensemble, ces écarts illustrent aussi le problème développé dans IA et pensée complexe : la fiabilité ne dépend pas d'une seule brique, mais des interactions entre modèle, mémoire, sources, interface, règles métier et comportement humain.

Ce n'est pas un réquisitoire contre ArxyA. C'est un cas d'école pour toutes les IA verticales qui promettent une expertise métier. La spécialisation ne se démontre pas par le vocabulaire du domaine ni par la liste des bases consultées. Elle se démontre lorsque la réponse reste traçable, datée, contestable, corrigible et capable de dire où s'arrête ce que le système sait réellement.

ArxyA est encore jeune et sa promesse évolue déjà entre le test et la publication. C'est justement ce qui rendra un nouveau passage intéressant : reposer les mêmes questions plus tard, conserver le protocole et mesurer ce qui a réellement changé.

Sources et références

Sources utilisées pour le test du 18 septembre et vérifications éditoriales mises à jour le 28 septembre 2026 :

Matériaux de test conservés : export PDF de la première réponse Fiscalité, enregistrements vidéo des parcours Fiscalité et Administratif, export JSON technique du 18 septembre 2026 et rapport Koperateur Consulting KC-ARXYA-20260918 v1.0.

Dossier de vérification

Sources et vérifications

La bibliographie de l’article reste visible juste au-dessus. Ce dossier ajoute une couche structurée pour retrouver la provenance, suivre les références et faciliter une future mise à jour, sans transformer leur présence en validation automatique de leur contenu.

11 références
Références structurées11URLs conservées explicitement
Domaines distincts5Origines documentaires différentes
Sources externes11Références hors de Kachouri
Liens Kachouri0Contexte et analyses internes reliés
Consulter le dossier des sourcesProvenance structurée, domaine et dates disponibles11 entrées
webArxyA, accueil et présentation des offres

www.arxya.fr · consulté le 28/09/2026

Ouvrir
webArxyA, conditions générales d'utilisation

www.arxya.fr · consulté le 28/09/2026

Ouvrir
webArxyA, politique de confidentialité

www.arxya.fr · consulté le 28/09/2026

Ouvrir
webArxyA, mentions légales

www.arxya.fr · consulté le 28/09/2026

Ouvrir
officialService Public Entreprendre, EURL : régime social du gérant

entreprendre.service-public.fr · consulté le 28/09/2026

Ouvrir
lawLégifrance, loi n° 2026-403 du 26 mai 2026, article 22

www.legifrance.gouv.fr · consulté le 28/09/2026

Ouvrir
lawLégifrance, Code de commerce, article L23-10-1

www.legifrance.gouv.fr · consulté le 28/09/2026

Ouvrir
officialService Public Entreprendre, perte de la moitié des capitaux propres

entreprendre.service-public.fr · consulté le 28/09/2026

Ouvrir
officialimpots.gouv.fr, imposition des résultats et taux réduit d'IS

www.impots.gouv.fr · consulté le 28/09/2026

Ouvrir
documentationAnthropic Privacy Center, conservation des données des offres commerciales et de l'API

privacy.anthropic.com · consulté le 28/09/2026

Ouvrir
documentationAnthropic Privacy Center, utilisation des données des offres commerciales pour l'entraînement

privacy.anthropic.com · consulté le 28/09/2026

Ouvrir

Prolonger la lecture

Du constat à une action maîtrisable

Reliez cette analyse à votre situation : un besoin à cadrer, une architecture à éprouver ou un outil à tester. Ces projets montrent les prolongements possibles de la démarche.

Parler d’un problème concretExplorer l’écosystème
Koperateur ConsultingCadrer, bâtir, opérer, mesurer RoastMyURLAuditer les fondations d’un site ItylosCollaborer sans exposer les données 0blaLa privacy utile, pas cosmétique

Continuer la lecture

Web, audit & visibilitéRoastMyUrl affiche 68/100. Non, cela ne veut pas dire que le site est sécurisé à 68 %04/10/2026 Veille & analyseFormateur IA en 2026 : prouver et maintenir son expertise03/10/2026 Veille & analyseStart-up françaises : cinq freins au passage à l'échelle03/10/2026