{"as_of":"2026-08-08T04:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a79bc1de190e236f705220846c57d0dd21fdcdc66c297c6504982c9a5db3ba0a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":3,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":3,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T06:04:53.020257Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T16:49:57.314679Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.21248","last_updated":"2024-07-30T23:43:59Z","snapshot_observed_at":"2026-07-06T18:54:45.806747Z","submitted_at":"2024-07-30T23:43:59Z","title":"Adaptive Pre-training Data Detection for Large Language Models via Surprising Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21248","snapshot_observed_at":"2026-08-07T06:04:53.020257Z","title":"Adaptive pre-training data detection for large language models via surprising tokens.CoRR, abs/2407.21248, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06112","last_updated":"2025-06-06T14:22:18Z","snapshot_observed_at":"2026-08-07T05:57:57.324277Z","submitted_at":"2025-06-06T14:22:18Z","title":"Towards Lifecycle Unlearning Commitment Management: Measuring Sample-level Unlearning Completeness","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T06:04:53.020257Z"},"links":{"cited_paper":"/paper/2407.21248","citing_paper":"/paper/2506.06112"},"observation_digest":"sha256:ceaa6977ebc8c6d8ed373f3be0d94cf7989eaf6d01a6159195c86c9218d49190","observation_id":"a98a9ab1-6b8a-4b80-9c24-153edb60978f","resolution":{"observed_at":"2026-08-07T06:04:53.020257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21248","last_updated":"2024-07-30T23:43:59Z","snapshot_observed_at":"2026-07-06T18:54:45.806747Z","submitted_at":"2024-07-30T23:43:59Z","title":"Adaptive Pre-training Data Detection for Large Language Models via Surprising Tokens","version":1},"cited_work":{"arxiv_id":"2407.21248","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.21248","snapshot_observed_at":"2026-07-04T16:49:57.314679Z","title":"Adaptive pre-training data detection for large language models via surprising tokens.arXiv preprint arXiv:2407.21248,","venue":null,"work_id":"846a84b6-8dbb-4b28-9dfd-ad259d5b3c09","year":2024},"citing_paper":{"arxiv_id":"2606.24408","last_updated":"2026-06-23T10:45:11Z","snapshot_observed_at":"2026-08-07T16:17:26.384608Z","submitted_at":"2026-06-23T10:45:11Z","title":"Natural Identifiers for Privacy and Data Audits in Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T00:16:34.961376Z"},"links":{"cited_paper":"/paper/2407.21248","citing_paper":"/paper/2606.24408"},"observation_digest":"sha256:374bb4609c079aceb96a1634a69baf6588d23ed170c2b034f306866592caa4d9","observation_id":"4bf2253b-178e-4c61-8585-dbfa2db9c286","resolution":{"observed_at":"2026-07-04T16:49:57.316421Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21248","last_updated":"2024-07-30T23:43:59Z","snapshot_observed_at":"2026-07-06T18:54:45.806747Z","submitted_at":"2024-07-30T23:43:59Z","title":"Adaptive Pre-training Data Detection for Large Language Models via Surprising Tokens","version":1},"cited_work":{"arxiv_id":"2407.21248","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.21248","snapshot_observed_at":"2026-07-04T16:49:57.314679Z","title":"Adaptive pre-training data detection for large language models via surprising tokens.arXiv preprint arXiv:2407.21248,","venue":null,"work_id":"846a84b6-8dbb-4b28-9dfd-ad259d5b3c09","year":2024},"citing_paper":{"arxiv_id":"2606.26257","last_updated":"2026-06-24T18:02:42Z","snapshot_observed_at":"2026-08-08T03:11:41.941488Z","submitted_at":"2026-06-24T18:02:42Z","title":"Dataset Usage Inference without Shadow Models or Held-out Data","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-26T01:51:20.215114Z"},"links":{"cited_paper":"/paper/2407.21248","citing_paper":"/paper/2606.26257"},"observation_digest":"sha256:955ee91084c995654d2bead411d61a9efae40c0b8f46a7a8beabeb44a3068d9d","observation_id":"b2e09395-5936-4da2-a409-2b3afc24ed94","resolution":{"observed_at":"2026-07-04T15:09:54.801543Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2407.21248/citation-record","integrity":"/paper/2407.21248/integrity","json":"/paper/2407.21248/citation-record.json","paper":"/paper/2407.21248"},"outbound":[],"paper":{"arxiv_id":"2407.21248","last_updated":"2024-07-30T23:43:59Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T18:54:45.806747Z","submitted_at":"2024-07-30T23:43:59Z","title":"Adaptive Pre-training Data Detection for Large Language Models via Surprising Tokens"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 3 inbound Pith citation observations for arXiv:2407.21248."}