Pular para o conteúdo
Todos os documentos da biblioteca

Medição da sobreposição de tokens entre processos de dados da plataforma Solana

Artigo arXiv papers · Autor: Arati Uday Kamat

Resumo

Este estudo investiga se dois coletores de dados configurados de forma independente observam os mesmos tokens na plataforma de lançamento pump.fun da Solana. Um processo detecta grupos associados a carteiras coordenadas de compradores iniciais; o outro registra decisões de um filtro de rejeição pré-negociação do lado do trader. Os autores comparam conjuntos de tokens criados em duas janelas consecutivas, restringindo os registros de rejeição à janela de cada grupo e aplicando quatro regras de marcação de tempo. Eles relatam contagens, proporções observadas e medidas de sobreposição de Jaccard e Dice.

Os resultados mostram pouquíssima sobreposição, mas a cobertura difere bastante entre as janelas. Na segunda janela, 5 de 623 tokens criados dos grupos também aparecem entre os 1,742 tokens criados rejeitados. Na primeira, uma lacuna na coleta deixa apenas as 14.25 horas finais cobertas; um token coincide entre os conjuntos completos, mas nenhum coincide dentro do intervalo coberto. Essa cobertura curta torna a primeira comparação pouco informativa. Por isso, o estudo alerta que a configuração do coletor molda as amostras de tokens observadas e recomenda relatar a cobertura junto com a sobreposição entre coletores. As comparações dizem respeito a esses processos e janelas, e não a todos os coletores de dados da Solana.

Ideias principais

  • O estudo compara conjuntos de tokens criados por um detector de grupos e um registrador de rejeições pré-negociação.
  • Os processos apresentam sobreposição muito limitada nas duas janelas de observação.
  • Uma lacuna na coleta torna pequena demais para interpretação a comparação dentro do período coberto na primeira janela.
  • A configuração do coletor pode moldar os tokens incluídos em amostras de pesquisa on-chain.
  • Os autores recomendam relatar a cobertura dos coletores e a sobreposição entre eles.

Tags

Texto completo
# Do Two On-Chain Observation Pipelines See the Same Tokens? Cross-Pipeline Coverage on the Solana pump.fun Launchpad


# Do Two On-Chain Observation Pipelines See the Same Tokens? Cross-Pipeline Coverage on the Solana pump.fun Launchpad









On-chain studies of memecoin launchpads usually rely on one data-collection pipeline, yet whether differently configured pipelines observe the same tokens is rarely measured. This paper compares the output mint sets of two separately configured pipelines from one research programme on the Solana pump.fun launchpad: a cohort-detection pipeline that flags coordinated early-buyer wallets, and a rejection-filtering pipeline that logs a trader-side observer's pre-trade filter decisions. Two consecutive, non-overlapping windows are analysed (v1: June 2026; v2: June-July 2026); in each, the rejection data are restricted to the interval spanned by the cohort detections under four timestamp rules. Only raw counts, observed proportions and Jaccard/Dice indices are reported. In v2, where the rejection stream covers the whole 17.5-day window, the cohort set contains 623 mints and the rejection set 1,742, with 5 overlapping mints (0.803% of cohort; 0.287% of rejection). In v1 a collection gap means the rejection stream covers only the final 14.25 hours (4.4%) of the 13.4-day cohort window; the 20,162 cohort and 53 rejection mints share 1 mint, and within the covered interval none, a count too small to be informative. Both windows show nearly disjoint outputs, agreeing in direction but not in magnitude. Collector configuration, not only market behaviour, therefore shapes which tokens an on-chain study observes, and the paper proposes reporting cross-collector overlap and collector coverage as a routine check. Data and a script that re-derives every number are openly available.

Exibido na íntegra, com atribuição conforme a licença da fonte. Licença: abstract CC0

Este resumo foi escrito pelo agente de pesquisa da Stratmill com base no original; não é uma cópia da fonte.