{"as_of":"2026-08-15T05:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:aac3e314d4f078b75a06d06f77b0a1eaf591bb26cb7e007f50e3c0a0c6805857","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T05:20:28.737198Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.13515/citation-record","integrity":"/paper/2608.13515/integrity","json":"/paper/2608.13515/citation-record.json","paper":"/paper/2608.13515"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:29.142995Z","title":"Towards tracing knowledge in language models back to the training data","venue":null,"work_id":"051a25d1-daac-4984-9a6d-e346e09b4a0b","year":2022},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T05:16:21.503796Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.657844Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:539b6a814f3a73137a9c03e42b99e823e1520618abe532422180655e0f51a4ba","observation_id":"cb8a18f1-432a-409a-b1a4-6f3869eafcdd","resolution":{"observed_at":"2026-08-14T05:20:29.147563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16235","last_updated":"2024-09-24T16:51:36Z","snapshot_observed_at":"2026-08-12T22:38:28.195671Z","submitted_at":"2024-09-24T16:51:36Z","title":"EuroLLM: Multilingual Language Models for Europe","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16235","snapshot_observed_at":"2026-08-14T05:20:28.694299Z","title":"org/abs/2409.16235","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T05:16:21.503796Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.694299Z"},"links":{"cited_paper":"/paper/2409.16235","citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:1686ba096393c4225d37fa160c35d4e84beeaabe345f69c7a003233695c4f373","observation_id":"6d0b2c6f-a56e-4984-9758-300680aca8e1","resolution":{"observed_at":"2026-08-14T05:20:28.694299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:28.698559Z","title":"URLhttps://arxiv.org/abs/2502.11411","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T05:16:21.503796Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.698559Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:9e9721a8efbffacdb7eae9f26547597eeac588082f1dcc48c743e111e93ad5f6","observation_id":"d218f962-31f0-4602-871d-c2376e182341","resolution":{"observed_at":"2026-08-14T05:20:28.698559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:29.091090Z","title":"Oskar van der Wal, Pietro Lesci, Max M¨uller-Eberstein, Naomi Saphra, Hailey Schoelkopf, Willem Zuidema, and Stella Biderman","venue":null,"work_id":"7ba8eb0f-fe4a-4047-adb1-e7d57ee55a2c","year":2020},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T05:16:21.503796Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.703300Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:a63da0ce09972de5092ec3dd5beea8ff84a851cee4bda70d522f9f743955092b","observation_id":"fa9d9395-6e8c-494e-b3e4-4986ced792a9","resolution":{"observed_at":"2026-08-14T05:20:29.095785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:28.707297Z","title":"doi: 10.1109/TPAMI.2021.3069908","venue":null,"work_id":null,"year":1939},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T05:16:21.503796Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.707297Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:40a8a1ade6062f4e2788fb83c485c19c62a74dacb9a7cac7e2f26712293f611f","observation_id":"8d856abe-b6e7-47be-8115-05c62a9ea4ef","resolution":{"observed_at":"2026-08-14T05:20:28.707297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:29.078074Z","title":"\" href=\"../../../demos/logger-strategy/","venue":null,"work_id":"14902fac-fd81-4ee9-9d5e-83c0bacffd6a","year":2026},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T05:16:21.503796Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.711666Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:d1f216602d481a5bd9cac39fd96ecc3f93e851256b807031e6e1c7315beca021","observation_id":"c578e055-de09-4170-9685-ec8240171b38","resolution":{"observed_at":"2026-08-14T05:20:29.082250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:29.063773Z","title":null,"venue":null,"work_id":"e512a2bc-b075-4181-8418-c26e7e6b147a","year":2026},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T05:16:21.503796Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.716145Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:721f1de462ad09503f93f8bf9a4734549627d5f3462efce7bbbf6377f5f2ea61","observation_id":"258acba8-215b-4d4f-93d0-5d35a484308e","resolution":{"observed_at":"2026-08-14T05:20:29.068566Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:29.049506Z","title":null,"venue":null,"work_id":"ee293b53-1ead-4235-9f46-e9dfd37e7133","year":2025},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T05:16:21.503796Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.720172Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:bb3d439afc6d241c72b65d1dd8be4d13d650b0e76132782114f2ea56bd65f6c2","observation_id":"ca37c418-b7f5-420c-b82d-ddd73a4782a4","resolution":{"observed_at":"2026-08-14T05:20:29.053692Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:29.035677Z","title":"This suggests that the observed domain-level contribution dynamics may be somewhat more sensitive to data ordering than to weight initialization","venue":null,"work_id":"775b26f4-65b7-4f8d-922b-e077b20a3378","year":2026},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T05:16:21.503796Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.723934Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:cd3e0b495eb58eefc2670e3db2a96047df3d245072d192ede2a41ce8e7a45c6e","observation_id":"fc5bf851-4661-47a5-8239-40495b457c12","resolution":{"observed_at":"2026-08-14T05:20:29.040395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:29.020585Z","title":"Because our analysis uses only within-interval rankings, we omit this common factor","venue":null,"work_id":"3609f736-45e5-4469-9495-345c50118d27","year":2026},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T05:16:21.503796Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.727543Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:6ac81cfb1c367a101b15b4c8630061164c9d730db72366c8ac389d0e265f4849","observation_id":"c31447d2-8a5a-43f5-a03c-1826a049fccf","resolution":{"observed_at":"2026-08-14T05:20:29.025487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:29.006169Z","title":"Each model size includes three runs with different weight initializations and data orderings","venue":null,"work_id":"4545982a-b223-4e3c-aa8b-9bcfbaeedbb1","year":2026},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T05:16:21.503796Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.732402Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:01dedc4e9dfc1351d22c0c0f8e1a5162a0890ebcef68238666f64cf01924c064","observation_id":"3c01101b-9942-402e-a428-7f692fa76874","resolution":{"observed_at":"2026-08-14T05:20:29.011482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:28.991079Z","title":null,"venue":null,"work_id":"c6677069-fc3c-4146-a446-74194dca59dc","year":2026},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T05:16:21.503796Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.737198Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:a83c7e404b8850eab31202574213022b5af165ed5d4dd7ca35b131183e937a06","observation_id":"b4bc89d8-ab11-4a53-98b1-07397bfbcf95","resolution":{"observed_at":"2026-08-14T05:20:28.996538Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:28.667170Z","title":"ISBN 9781605585161","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T05:16:21.503796Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.667170Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:39461c833049c1e19aa54f700a19839649a5ffa2bd7c54c502ebf63a60d80580","observation_id":"aaeafa3f-d093-4f83-9d69-6ba705f130f2","resolution":{"observed_at":"2026-08-14T05:20:28.667170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:29.104964Z","title":"Dai Liu, Jindong Gu, Hu Cao, Carsten Trinitis, and Martin Schulz","venue":null,"work_id":"caf61230-d43b-4a7a-9164-b2ecc845f6a9","year":2024},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T05:16:21.503796Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.689431Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:85916f81ead6422661108aeaaa34468859ef734d0102481de759d3e2df70b0d4","observation_id":"dc305538-20ed-446f-a9d7-e1c4f9facbb6","resolution":{"observed_at":"2026-08-14T05:20:29.109241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-14T05:20:28.680296Z","title":"Amirata Ghorbani and James Zou","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T05:16:21.503796Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.680296Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:87f9d20ea0df3138a3287b5367f545e305fc686d56b764959758c44f9c0be583","observation_id":"e5a72114-3e1b-4d26-b72d-af051fad4dcc","resolution":{"observed_at":"2026-08-14T05:20:28.680296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:28.662687Z","title":"doi: 10.18653/v1/ 2022.findings-emnlp.180","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T05:16:21.503796Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.662687Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:ca32e263a919ca4334f9b35cedb2badcd1e09467b7759594dd23e72b66d6b382","observation_id":"f8c20293-97c8-4e21-b1c4-02832031fd02","resolution":{"observed_at":"2026-08-14T05:20:28.662687Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:29.129801Z","title":null,"venue":null,"work_id":"76103adf-1198-4787-a2d2-29cadc57ed61","year":2026},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T05:16:21.503796Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.671423Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:7bd6c262bdbdfc895117767861499c8bd28039c5a75bdd34b2ea65217ee24155","observation_id":"78da8903-2e55-4ef1-9706-b55926bf4754","resolution":{"observed_at":"2026-08-14T05:20:29.134154Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:28.684958Z","title":"doi: 10.1007/ s10994-023-06495-7","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T05:16:21.503796Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.684958Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:6589f3e139cc8ccebea5403c61114849cfa5a3878c65df24d8715b781afa53e4","observation_id":"57d97440-b48c-4802-a743-40fc3e5f0ed0","resolution":{"observed_at":"2026-08-14T05:20:28.684958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:20:29.117813Z","title":"ISBN 978-9908-53-109-0","venue":null,"work_id":"64e07d16-6760-42ca-be5f-34d39908cac5","year":2025},"citing_paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","snapshot_observed_at":"2026-08-15T05:16:21.503796Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-14T05:20:28.676035Z"},"links":{"citing_paper":"/paper/2608.13515"},"observation_digest":"sha256:ac176bc8e9fb8630077c5a08734693d4eea4eed11c398e592d2251f77e87222d","observation_id":"f0d73867-dcbd-47d0-94bd-c41741f543b0","resolution":{"observed_at":"2026-08-14T05:20:29.121569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.13515","last_updated":"2026-08-13T17:36:49Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T05:16:21.503796Z","submitted_at":"2026-08-13T17:36:49Z","title":"Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":8},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:2608.13515."}