Comment les agents IA accèdent-ils aux données onchain ?
Mis à jour en août 2026
Via une couche indexée et interrogeable plutôt que la blockchain directement. Un agent a besoin de poser des questions du type « qu'a fait ce wallet récemment » — ce qui est une recherche, pas une requête ponctuelle, et donc pas quelque chose que le RPC brut peut répondre.
En pratique, cela signifie placer des données indexées derrière une interface que l'agent peut appeler : un serveur MCP, une API, ou une base de données qu'il peut interroger.
Pourquoi un agent ne peut-il pas simplement appeler le RPC ?
Trois raisons, qui se cumulent.
La mauvaise forme de question. Le RPC répond à « quel est l'état de X en ce moment ». Les agents posent des questions ouvertes, historiques, agrégées. Y répondre via RPC signifie de nombreux appels et un filtrage côté client — coûteux en tokens et en latence, et peu fiable.
Des données non décodées. Le RPC renvoie du binaire. Sans l'ABI ou l'IDL appliqué, un agent voit des octets plutôt que « un transfert de 500 USDC ». Il ne peut pas raisonner sur ce qu'il ne peut pas lire.
Aucune agrégation. « Quel volume ce pool a-t-il fait la semaine dernière » ne peut pas du tout être exprimé comme un appel RPC. Quelque chose doit d'abord le calculer.
À quoi ressemble une bonne configuration ?
| Couche | Rôle |
|---|---|
| Extraction | Obtenir les données de chaîne complètes, y compris les transactions internes et les changements d'état |
| Transformation | Décoder et façonner en enregistrements exploitables |
| Stockage | Une base de données que l'outillage de l'agent peut interroger |
| Interface | Serveur MCP, API, ou accès SQL que l'agent appelle |
Les deux premières sont de l'indexation classique — Substreams vers une base de données. Le travail de conception intéressant se situe dans la dernière couche : quelles questions l'agent peut-il réellement poser, et comment l'empêcher de construire des requêtes qui scannent tout.
Pourquoi l'exhaustivité des données compte-t-elle davantage pour les agents ?
Parce qu'un agent ne peut pas détecter qu'il manque quelque chose.
Un humain qui interroge des transferts et ne voit rien pour un wallet pourrait soupçonner que le pipeline ne capture que les logs d'événements. Un agent rapportera qu'aucun transfert n'a eu lieu, avec assurance, puis raisonnera à partir de là. La valeur déplacée par des appels internes, des changements d'état et des ajustements de solde n'apparaît jamais dans les logs — donc un pipeline basé sur les logs donne à un agent une image partielle qu'il traitera comme complète.
Une extraction capturant le détail d'exécution complet — arbres d'appels, changements d'état, changements de solde — compte davantage ici que dans un tableau de bord destiné à des humains, précisément parce qu'il n'y a personne pour remarquer le manque.
Qu'en est-il de la fraîcheur des données ?
Les agents qui interrogent l'activité « récente » ont besoin de données proches de la tête de chaîne, ce qui implique un pipeline de diffusion plutôt qu'une tâche par lots périodique. Cela implique aussi d'être explicite sur la finalité : un agent ne devrait pas agir sur des données provenant d'un bloc susceptible de subir une réorganisation de chaîne, et il n'a aucune intuition à ce sujet à moins que votre interface ne le lui indique.
Questions fréquentes
Un agent peut-il interroger la blockchain sans indexeur ? Pour de simples requêtes d'état courant, oui. Pour tout ce qui est historique ou agrégé, il a besoin d'une couche indexée.
Quelle est la meilleure interface pour un agent ? Ce qui convient le mieux à votre stack — une API, MCP, ou une interface SQL bien délimitée fonctionnent toutes si vous contraignez ce qui peut être interrogé.
L'agent a-t-il besoin des données brutes ou d'un résumé ? Généralement un résultat façonné et filtré. Transmettre des blocs bruts gaspille du contexte et invite aux erreurs.
Obtenez une clé API sur thegraph.market — aucune information personnelle requise.
Voir aussi : Qu'est-ce qu'un serveur MCP pour les données blockchain ? · Un LLM peut-il interroger directement des données blockchain ? · Comment diffuser des données onchain vers une base de données ?