Retour aux questions fréquentes

Ai-je besoin d'un archive node pour obtenir des données historiques ?

Mis à jour en août 2026

Généralement non. Un archive node répond à une question précise — « quel était l'état de ce contrat au bloc N » — mais la plupart des pipelines de données ont besoin d'autre chose : le registre de ce qui s'est passé dans chaque bloc, que l'extraction en flat files fournit à un coût bien moindre.

Les équipes se tournent souvent vers un archive node parce que c'est la réponse familière à « j'ai besoin de l'historique », puis découvrent que c'est coûteux à faire tourner et que cela ne rend toujours pas les données historiques recherchables.

Que vous donne réellement un archive node ?

L'état historique complet. Un full node classique élague l'ancien état et ne garde que les blocs récents ; un archive node conserve l'intégralité du state trie, ce qui permet d'interroger le storage à n'importe quel bloc passé.

C'est réellement nécessaire pour certaines choses :

  • Quel était le storage de ce contrat au bloc 15000000 ?
  • Quel était le solde de cette adresse à un bloc historique précis ?
  • Simuler une transaction sur un état passé

Si vous avez besoin de reconstituer un état à un instant précis, un archive node est le bon outil.

De quoi la plupart des pipelines ont-ils réellement besoin ?

Du registre d'exécution — ce qui s'est passé dans chaque bloc, dans l'ordre. Chaque transaction, chaque appel, chaque transfert, chaque changement d'état, tel qu'il s'est produit.

C'est une forme de données différente. Vous ne demandez pas « à quoi ressemblait le monde au bloc N », vous demandez « que s'est-il passé entre le bloc A et le bloc B », ce à quoi se ramène presque tout cas d'usage analytique, de surveillance ou de données applicatives.

Archive nodeExtraction en flat files
Répond àL'état à un bloc donnéCe qui s'est passé dans chaque bloc
AccèsRequêtes ponctuelles RPCLectures séquentielles ou parallèles
RecherchableNonOui, une fois transformé
Coût d'exploitationÉlevé — grand stockage, continuExtraire une fois, lire plusieurs fois
Consommateurs en parallèleSe disputent la capacité du nœudIndépendants

Pourquoi la voie de l'archive node est-elle pénible ?

Les besoins de stockage sont importants et croissent en permanence. Les temps de synchronisation sont longs. Et surtout, même avec le nœud qui tourne, vous ne pouvez toujours pas rechercher — le RPC donne des requêtes ponctuelles, donc « chaque swap de cette adresse l'an dernier » signifie encore récupérer un très grand nombre de blocs et filtrer vous-même.

Vous finissez par payer pour exploiter une infrastructure coûteuse, puis par construire quand même une couche d'indexation par-dessus.

Quelle est l'alternative ?

Extraire le registre d'exécution une seule fois dans des flat files, puis lire ces fichiers autant de fois que nécessaire. C'est ce que fait Firehose, et cela capture plus que ce qu'exposent les logs — arbres d'appels, changements d'état et changements de solde, de sorte que les transactions internes sont visibles plutôt qu'absentes.

Substreams transforme ensuite ce registre en ce dont vous avez besoin, traitant l'historique en parallèle et continuant vers les données en direct avec le même code.

Quand a-t-on encore besoin d'un archive node ?

Quand vous avez réellement besoin d'un état à un instant précis : simuler des transactions historiques, reconstituer le storage d'un contrat à un bloc passé, ou une analyse forensique nécessitant le state trie. Ce sont de vrais besoins — simplement plus étroits que ce que « j'ai besoin de données historiques » implique habituellement.


Questions fréquentes

Puis-je obtenir des données historiques sans faire tourner de nœud ? Oui. Les endpoints hébergés servent l'historique complet sans que vous ayez à exploiter d'infrastructure.

Les transactions internes nécessitent-elles un archive node ? Non. Elles nécessitent une extraction qui capture les traces d'appels. L'indexation basée sur les logs les manque, quel que soit le type de nœud.

Les données en flat files sont-elles aussi complètes que celles d'un archive node ? Pour le registre d'exécution, oui — sans doute même plus, puisqu'il inclut des détails jamais émis en tant qu'événements. Pour la reconstitution d'un état à un instant précis, un archive node est le bon outil.


Obtenez l'historique complet sans exploiter de nœud — clé API sur thegraph.market, aucune information personnelle requise.

Voir aussi : Qu'est-ce qu'un jeu de données blockchain en flat files ? · RPC vs indexation · Comment remplir un historique de données blockchain (backfill) ?