Chuyển đến nội dung
Tất cả tài liệu trong thư viện

Đo mức trùng lặp token giữa các luồng dữ liệu Solana

Bài viết arXiv papers · Tác giả: Arati Uday Kamat

Tóm tắt

Nghiên cứu đặt câu hỏi liệu hai bộ thu thập dữ liệu được cấu hình độc lập có quan sát cùng các token trên bệ phóng pump.fun của Solana hay không. Một luồng phát hiện các nhóm ví người mua sớm có dấu hiệu phối hợp; luồng kia ghi lại quyết định từ bộ lọc loại bỏ trước giao dịch phía nhà giao dịch. Các tác giả so sánh tập mint trong hai khoảng thời gian liên tiếp, giới hạn bản ghi từ chối theo từng khoảng của nhóm và áp dụng bốn quy tắc dấu thời gian. Họ báo cáo số lượng, tỷ lệ quan sát được và các thước đo trùng lặp Jaccard và Dice.

Kết quả cho thấy mức trùng lặp rất thấp, nhưng độ bao phủ giữa hai khoảng thời gian chênh lệch đáng kể. Trong khoảng thứ hai, 5 trên 623 mint của nhóm cũng xuất hiện trong số 1,742 mint bị từ chối. Trong khoảng thứ nhất, một gián đoạn thu thập khiến chỉ 14.25 giờ cuối được bao phủ; có một mint trùng nhau trong toàn bộ các tập, nhưng không có mint nào trùng trong khoảng được bao phủ. Thời gian bao phủ ngắn khiến phép so sánh thứ nhất không có ý nghĩa. Vì vậy, nghiên cứu lưu ý rằng cấu hình bộ thu thập định hình mẫu token được quan sát và khuyến nghị báo cáo độ bao phủ cùng với mức trùng lặp giữa các bộ thu thập. Các phép so sánh chỉ áp dụng cho những luồng dữ liệu và khoảng thời gian này, không phải tất cả bộ thu thập dữ liệu Solana.

Ý chính

  • Nghiên cứu so sánh tập mint token từ bộ phát hiện nhóm và bộ ghi nhận lệnh từ chối trước giao dịch.
  • Hai luồng dữ liệu có mức trùng lặp rất thấp trong cả hai khoảng quan sát.
  • Gián đoạn thu thập khiến phép so sánh trong phạm vi bao phủ của khoảng thứ nhất quá nhỏ để diễn giải.
  • Cấu hình bộ thu thập có thể định hình những token được đưa vào mẫu nghiên cứu trên chuỗi.
  • Các tác giả khuyến nghị báo cáo độ bao phủ của bộ thu thập và mức trùng lặp giữa các bộ.

Thẻ

Toàn văn
# Do Two On-Chain Observation Pipelines See the Same Tokens? Cross-Pipeline Coverage on the Solana pump.fun Launchpad


# Do Two On-Chain Observation Pipelines See the Same Tokens? Cross-Pipeline Coverage on the Solana pump.fun Launchpad









On-chain studies of memecoin launchpads usually rely on one data-collection pipeline, yet whether differently configured pipelines observe the same tokens is rarely measured. This paper compares the output mint sets of two separately configured pipelines from one research programme on the Solana pump.fun launchpad: a cohort-detection pipeline that flags coordinated early-buyer wallets, and a rejection-filtering pipeline that logs a trader-side observer's pre-trade filter decisions. Two consecutive, non-overlapping windows are analysed (v1: June 2026; v2: June-July 2026); in each, the rejection data are restricted to the interval spanned by the cohort detections under four timestamp rules. Only raw counts, observed proportions and Jaccard/Dice indices are reported. In v2, where the rejection stream covers the whole 17.5-day window, the cohort set contains 623 mints and the rejection set 1,742, with 5 overlapping mints (0.803% of cohort; 0.287% of rejection). In v1 a collection gap means the rejection stream covers only the final 14.25 hours (4.4%) of the 13.4-day cohort window; the 20,162 cohort and 53 rejection mints share 1 mint, and within the covered interval none, a count too small to be informative. Both windows show nearly disjoint outputs, agreeing in direction but not in magnitude. Collector configuration, not only market behaviour, therefore shapes which tokens an on-chain study observes, and the paper proposes reporting cross-collector overlap and collector coverage as a routine check. Data and a script that re-derives every number are openly available.

Hiển thị toàn văn kèm ghi nguồn theo giấy phép của tài liệu gốc. Giấy phép: abstract CC0

Bản tóm tắt này do tác nhân nghiên cứu của Stratmill biên soạn từ tài liệu gốc; đây không phải bản sao của tài liệu.