{"as_of":"2026-08-07T08:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1e28a10719cdb575d18c4cabb493b773d41819efa087a4080fdc65f3d5b055e8","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:15:21.466217Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.16414/citation-record","integrity":"/paper/2507.16414/integrity","json":"/paper/2507.16414/citation-record.json","paper":"/paper/2507.16414"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:17.084177Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.084177Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:ffd3f7e71322cbd099b65e04f836898fc540656443ad1cf512609133593d019f","observation_id":"8144160a-2914-48fc-a7d9-2e7d8b3cd0e8","resolution":{"observed_at":"2026-08-06T15:15:17.084177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:17.138656Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.138656Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:be696f2502466942284b4747db1aeee0ff05abee9dd32bb43b308439a94a8c0d","observation_id":"c87933e2-06b5-4f30-bf97-4cb3d7dcf7c5","resolution":{"observed_at":"2026-08-06T15:15:17.138656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.886133Z","title":null,"venue":null,"work_id":"9d3f06ef-35c0-4b7b-a8f7-9d113b7a53f4","year":2016},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.199733Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:af5d92c2d5d50711626c0f38ff4d2a2aed0813710a0b311888ee69d00bffb5b6","observation_id":"6f4c17df-c22f-4417-aa20-d332fd73fce5","resolution":{"observed_at":"2026-08-06T15:15:22.901254Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T15:15:17.287649Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.287649Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:7a12938f81dd669983439f7ef53ac00772241d7d1099b66ee8af3462ec2fbb21","observation_id":"fbb54b05-598a-4ebd-ad6c-1000b9ed04a8","resolution":{"observed_at":"2026-08-06T15:15:17.287649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-06T15:15:17.373299Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.373299Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:6b6c07527871d0a2a71e87b56f27aa6fa05596a93b7a7ad1e7b35e33a875aab4","observation_id":"1135129c-f8a5-4c67-8fbf-9907836dd7fa","resolution":{"observed_at":"2026-08-06T15:15:17.373299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:17.447239Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.447239Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:d8c28ded72c7d8c56272ec699b422de1989e217ef73b68a99ffbe08dd72ce558","observation_id":"eab82540-ef32-4634-beeb-25ecd1037d10","resolution":{"observed_at":"2026-08-06T15:15:17.447239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.849149Z","title":null,"venue":null,"work_id":"980d5123-0725-4bf5-99e2-e8e97ac2201d","year":2021},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.545600Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:5471d2100db6d81ac6aba8df6c16721dd35fd3cb7c23cd377e3e4cc55021993e","observation_id":"b94792c4-3610-4758-838f-57fb799a7471","resolution":{"observed_at":"2026-08-06T15:15:22.853804Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:17.610114Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.610114Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:42d08ad87a3dfb072fb876eb301c95432611ae26b8f3a945656099514d0459ca","observation_id":"37117ec8-c6e8-4eb6-a31c-267e0d3b1666","resolution":{"observed_at":"2026-08-06T15:15:17.610114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.811556Z","title":null,"venue":null,"work_id":"99205a4d-3c97-4bb8-b965-54efe01be0cc","year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.682374Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:dbffe6ee56cbe217dd3f4b83b70e969b10c654a62b8e5f5b7824b0d0370a01ec","observation_id":"1481e8fd-88f5-464b-b5c5-1a3ffb6a0701","resolution":{"observed_at":"2026-08-06T15:15:22.817152Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.00118","last_updated":"2023-10-20T21:23:21Z","snapshot_observed_at":"2026-07-06T15:21:23.714725Z","submitted_at":"2023-04-28T22:35:03Z","title":"Speak, Memory: An Archaeology of Books Known to ChatGPT/GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.00118","snapshot_observed_at":"2026-08-06T15:15:17.773210Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.773210Z"},"links":{"cited_paper":"/paper/2305.00118","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:ed112a331543f6776a0f356a78bf3fcd5086b1adb86f9ede23eb7a2051438bba","observation_id":"025d5f51-e5a6-4821-b71c-50fdb4c62278","resolution":{"observed_at":"2026-08-06T15:15:17.773210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.792742Z","title":null,"venue":null,"work_id":"65a0d866-ab4a-4321-9eff-c68f67215756","year":2020},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.853493Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:efe559706770116ad6dc4399458b045e2573dd4f0da589c14ba8744562d18a4f","observation_id":"5faa0212-ee17-4295-a32f-756285f56ba1","resolution":{"observed_at":"2026-08-06T15:15:22.798133Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.772290Z","title":null,"venue":null,"work_id":"18710bd6-6b2a-431c-82dc-ec645604c019","year":2021},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.924884Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:d4f0389aefa17f8737983ea46daea40786fab613aac6d1725f4434c4a1fe4ca6","observation_id":"987e16f8-f7e8-4ec2-be42-2cae58252370","resolution":{"observed_at":"2026-08-06T15:15:22.779455Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05335","last_updated":"2023-04-11T16:53:54Z","snapshot_observed_at":"2026-07-06T15:14:28.574778Z","submitted_at":"2023-04-11T16:53:54Z","title":"Toxicity in ChatGPT: Analyzing Persona-assigned Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05335","snapshot_observed_at":"2026-08-06T15:15:17.984754Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:17.984754Z"},"links":{"cited_paper":"/paper/2304.05335","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:f6a058f290a9e545ab8238d798c581f45afa969c471b488d37fcb2a9d139df57","observation_id":"d0a38afe-6aa1-4af0-86c3-74970dcba164","resolution":{"observed_at":"2026-08-06T15:15:17.984754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:18.045952Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:18.045952Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:5ed99500251ecef2e7bf3657dd2ca2d4b0a74808f4fa924e25acd9f801475516","observation_id":"76911d89-6aab-483a-b405-bddcb24fdd25","resolution":{"observed_at":"2026-08-06T15:15:18.045952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07841","last_updated":"2024-09-16T13:18:23Z","snapshot_observed_at":"2026-08-07T03:58:21.441544Z","submitted_at":"2024-02-12T17:52:05Z","title":"Do Membership Inference Attacks Work on Large Language Models?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07841","snapshot_observed_at":"2026-08-06T15:15:18.142763Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:18.142763Z"},"links":{"cited_paper":"/paper/2402.07841","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:c8b09d0b6eb4adccb75d229e2a9717c3f442fd233511aa70068a3a4a2f94aba7","observation_id":"40fd2cbc-f0cf-464c-afea-9b1f38bfd8ba","resolution":{"observed_at":"2026-08-06T15:15:18.142763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.727191Z","title":null,"venue":null,"work_id":"61aa2440-88d5-4fd5-b31f-701e00a548c8","year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:18.252796Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:a46ec5af27e38e944e3a76c2b6eecdf4c7f21ab620958f8187afb1a672d4281a","observation_id":"395913aa-cc76-442d-b2df-617c841b8709","resolution":{"observed_at":"2026-08-06T15:15:22.733774Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09910","last_updated":"2024-06-25T10:33:41Z","snapshot_observed_at":"2026-07-06T17:30:34.153488Z","submitted_at":"2024-02-15T12:17:15Z","title":"DE-COP: Detecting Copyrighted Content in Language Models Training Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09910","snapshot_observed_at":"2026-08-06T15:15:18.313771Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:18.313771Z"},"links":{"cited_paper":"/paper/2402.09910","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:6599d34c26e853ff857c239fc802c280cdb2e5046908bc8320d9585162c3f387","observation_id":"d7c1395e-899e-4af7-9412-f6c2b33f51fb","resolution":{"observed_at":"2026-08-06T15:15:18.313771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03738","last_updated":"2023-11-13T17:50:22Z","snapshot_observed_at":"2026-08-07T07:55:04.700807Z","submitted_at":"2023-04-07T17:14:00Z","title":"Should ChatGPT be Biased? Challenges and Risks of Bias in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03738","snapshot_observed_at":"2026-08-06T15:15:18.466696Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:18.466696Z"},"links":{"cited_paper":"/paper/2304.03738","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:90f8cccf2b846a54f149fda41904d9c139325521e908e1ee774e3cc83e978cba","observation_id":"bc02a5e6-873b-464e-bc47-27d0e7a17e36","resolution":{"observed_at":"2026-08-06T15:15:18.466696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-06T15:15:18.651918Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:18.651918Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:0bf3c87dd4df7958f974b222847e1f147a8e03f74b8e743aead7a24e382ed480","observation_id":"692c2af9-c2a7-4706-9c96-3f5dca66df41","resolution":{"observed_at":"2026-08-06T15:15:18.651918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.11462","last_updated":"2020-09-25T20:22:26Z","snapshot_observed_at":"2026-07-06T09:58:19.547859Z","submitted_at":"2020-09-24T03:17:19Z","title":"RealToxicityPrompts: Evaluating Neural Toxic Degeneration in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.11462","snapshot_observed_at":"2026-08-06T15:15:18.772021Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:18.772021Z"},"links":{"cited_paper":"/paper/2009.11462","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:b33a10aeced06e43351743853b2fed1897e4ba2bb42882bed3d140d42bd6fcb8","observation_id":"2af41a3d-b36d-4aa4-9a50-7cacef7c2023","resolution":{"observed_at":"2026-08-06T15:15:18.772021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.701211Z","title":null,"venue":null,"work_id":"d690a664-b21e-4437-aa97-48e95e2138a9","year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:18.863401Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:525a7dc7ccddd275289fe2e22095f5203420dbc8a4401a3a63345799682ad62a","observation_id":"8651eff8-19a0-4d8f-bde4-0e1396b0e912","resolution":{"observed_at":"2026-08-06T15:15:22.708309Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:19.010658Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:19.010658Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:bb8531ad8972a67664974b2aaa4b38f39505470df0165918be22b2f604d9688a","observation_id":"f0f231f3-d5ae-467e-bdfe-2cc316b417f9","resolution":{"observed_at":"2026-08-06T15:15:19.010658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.678004Z","title":null,"venue":null,"work_id":"ecb807ce-6b43-4654-a6eb-115f167bf1ca","year":2008},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:19.109984Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:dd06d43ed62c9d1dc4d03369fc92f544a01221c3fc8ae433d161fab112de37aa","observation_id":"4874d50f-37e0-4d0b-9d45-d446bf0b1a3b","resolution":{"observed_at":"2026-08-06T15:15:22.685604Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.658082Z","title":null,"venue":null,"work_id":"fcda4645-3953-4532-a8d8-78e850db4b03","year":2022},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:19.278980Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:cfec0f38c0185d65dae7ace59fd9848afe1d43fb3eecc9a5b19ac48d487b6b72","observation_id":"781c780b-f77e-4b81-bcc7-4369180cf863","resolution":{"observed_at":"2026-08-06T15:15:22.663814Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.634232Z","title":null,"venue":null,"work_id":"ae7ff80c-f98f-4495-bb38-0847b2c00923","year":2019},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:19.407680Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:36484d2c9885610eb0fbe4c7e9e7852d1c916aead3fb4375ad4233c7f4981e7d","observation_id":"29b9541b-1985-471d-8136-cec0e4a67d46","resolution":{"observed_at":"2026-08-06T15:15:22.640112Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-06T15:15:19.553442Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:19.553442Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:20d2660f8b1d5a03494326b41f8e4163beee0472b4af817a7c463ba56adc53e3","observation_id":"3f449154-a1c9-4add-86fc-362537ba6154","resolution":{"observed_at":"2026-08-06T15:15:19.553442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:19.713705Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:19.713705Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:9a5a36d4535fee0159a9cb9cab8bbde09e46cb48c7ba5ab3946b3b44e97925ab","observation_id":"b3614382-b290-4911-96bc-be4357897221","resolution":{"observed_at":"2026-08-06T15:15:19.713705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:19.864453Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:19.864453Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:af9c5d6072703b73df47a43bcdc9a28895ab55eb095245db6935041208be3b9a","observation_id":"139f2341-6de8-461f-90fd-aec325a98e46","resolution":{"observed_at":"2026-08-06T15:15:19.864453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.596175Z","title":null,"venue":null,"work_id":"d1b6bc16-f98b-4a11-8d8e-695080992abd","year":2021},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:20.019031Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:9015f57326090aede2690f97b74eaddc7431c90a5f117c3c7f4f95a86bde1118","observation_id":"b738dd76-661e-46b2-995a-8d9b1fa54e26","resolution":{"observed_at":"2026-08-06T15:15:22.603324Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14690","last_updated":"2025-02-25T21:00:50Z","snapshot_observed_at":"2026-07-06T19:06:19.400102Z","submitted_at":"2024-08-26T23:30:15Z","title":"Training-Free Activation Sparsity in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14690","snapshot_observed_at":"2026-08-06T15:15:20.119238Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:20.119238Z"},"links":{"cited_paper":"/paper/2408.14690","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:43f09c7007007069fb790bdeb6d66853071ef3d60381f79947ec6022eeffca09","observation_id":"6dd825a6-8241-4e40-9fc7-d789cffa74ad","resolution":{"observed_at":"2026-08-06T15:15:20.119238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18041","last_updated":"2024-02-28T04:35:51Z","snapshot_observed_at":"2026-07-06T17:36:36.437597Z","submitted_at":"2024-02-28T04:35:51Z","title":"Datasets for Large Language Models: A Comprehensive Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18041","snapshot_observed_at":"2026-08-06T15:15:20.243366Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:20.243366Z"},"links":{"cited_paper":"/paper/2402.18041","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:76a1b055029e5b91790e43759680167dfde749a90ac6509f73ae24b8606e8b5a","observation_id":"ad3912c7-80c3-47f6-90b1-1d3898063494","resolution":{"observed_at":"2026-08-06T15:15:20.243366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.573573Z","title":null,"venue":null,"work_id":"ca02613d-7e80-4a79-a30e-0d9f96d6d999","year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:20.388002Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:cdf17222d1c3f62ad0045d51ef3555abc1d7e1dbf8691017d304de098ec6fafb","observation_id":"c0305eca-9b7c-4de4-87fe-14710a4ff3f4","resolution":{"observed_at":"2026-08-06T15:15:22.581279Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.544939Z","title":null,"venue":null,"work_id":"6184b994-b427-48f8-a90b-1530a799541e","year":2022},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:20.543238Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:15a8e4042a035afcbaa899c08fa7f0a8825675f4101d52d24557184837fa2d85","observation_id":"baff0da6-c466-49e9-98f9-5e6e90c3dc74","resolution":{"observed_at":"2026-08-06T15:15:22.554674Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.519610Z","title":null,"venue":null,"work_id":"c36ce04c-3d72-46e7-a15c-9de00e4e838d","year":2025},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:20.640744Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:5efd6e13fa165cb1915aad07563720e95f1f43827e21bcebe81e3472a690c40e","observation_id":"8dd09ae9-d9d2-4bc6-94e7-98c67cad3591","resolution":{"observed_at":"2026-08-06T15:15:22.525642Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18462","last_updated":"2023-08-07T06:32:56Z","snapshot_observed_at":"2026-07-06T15:34:59.457879Z","submitted_at":"2023-05-29T07:06:03Z","title":"Membership Inference Attacks against Language Models via Neighbourhood Comparison","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18462","snapshot_observed_at":"2026-08-06T15:15:20.774106Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:20.774106Z"},"links":{"cited_paper":"/paper/2305.18462","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:299ae607f67fee0f6e0cf5d932870f2eef22990f9cbc54404d6a4b170bd9bccf","observation_id":"23c460cb-3729-4bac-8d8a-5b6c16654f02","resolution":{"observed_at":"2026-08-06T15:15:20.774106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.495016Z","title":null,"venue":null,"work_id":"75cd88cc-7212-4c09-af20-a71d074f4bb2","year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:20.928493Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:36151b3d303d149705c03d4cd62308853fd029f5704ba1307a272dd148dd6566","observation_id":"cad612e0-a611-4f7e-9e32-3f25ffb9f4e2","resolution":{"observed_at":"2026-08-06T15:15:22.502090Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.03929","last_updated":"2022-11-04T02:47:37Z","snapshot_observed_at":"2026-08-04T22:11:06.299984Z","submitted_at":"2022-03-08T08:50:34Z","title":"Quantifying Privacy Risks of Masked Language Models Using Membership Inference Attacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.03929","snapshot_observed_at":"2026-08-06T15:15:21.088346Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.088346Z"},"links":{"cited_paper":"/paper/2203.03929","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:7db7ef9a01b98fd2a3f37e128917024d53fe43c32fdc2c62f19375fbb344b3f1","observation_id":"48a1f3ee-32bc-4984-b236-b03b208ae675","resolution":{"observed_at":"2026-08-06T15:15:21.088346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.460620Z","title":null,"venue":null,"work_id":"28176263-fc10-4512-b2a8-892a5dbf1463","year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.210084Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:03394fa77758b82ee0952e8f99b1af6c6b39352060d14e9b0d7026b9f17bc53c","observation_id":"08dba54b-6ee3-43c8-9d51-d4b1c33d78a7","resolution":{"observed_at":"2026-08-06T15:15:22.467285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12833","last_updated":"2023-08-24T14:45:50Z","snapshot_observed_at":"2026-07-06T16:09:59.750388Z","submitted_at":"2023-08-24T14:45:50Z","title":"Use of LLMs for Illicit Purposes: Threats, Prevention Measures, and Vulnerabilities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12833","snapshot_observed_at":"2026-08-06T15:15:21.317329Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.317329Z"},"links":{"cited_paper":"/paper/2308.12833","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:ede68288e22fac9f2f3e25f0820d3b932422fd35ad3230bb58e5e3aa8e240c5a","observation_id":"7587ae3b-1737-4ace-ae01-7df9eb24a1e6","resolution":{"observed_at":"2026-08-06T15:15:21.317329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17035","last_updated":"2023-11-28T18:47:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T18:47:03Z","title":"Scalable Extraction of Training Data from (Production) Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17035","snapshot_observed_at":"2026-08-06T15:15:21.323446Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.323446Z"},"links":{"cited_paper":"/paper/2311.17035","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:ae89077311e03745b2e1bf28d23465f5e7e18c1fa87fc53bbfdc03bcd2661d60","observation_id":"8d63d4f0-abe0-4ea2-8fc1-97a8109754db","resolution":{"observed_at":"2026-08-06T15:15:21.323446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.435665Z","title":null,"venue":null,"work_id":"a777845c-a258-473b-832f-f215f1165470","year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.328780Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:4ed6fa3badd332c2723990c745c1559503d032b92bb3c4a0ebc11259228bba69","observation_id":"15bdd3fb-174d-432b-b0a1-776c63e982c9","resolution":{"observed_at":"2026-08-06T15:15:22.443203Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.412048Z","title":null,"venue":null,"work_id":"1d5a757f-d5cc-449a-ad16-88b6e62bfac7","year":2020},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.334535Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:bf7326ca20cffd3a6b9992514fe9ea2a9af0de0bee3bf85a32ee4d75cb5f970f","observation_id":"d89d0385-fad5-4282-ad54-00aa53f94bd9","resolution":{"observed_at":"2026-08-06T15:15:22.420533Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.06145","last_updated":"2017-11-29T11:47:25Z","snapshot_observed_at":"2026-08-03T09:36:04.246232Z","submitted_at":"2017-08-21T10:50:24Z","title":"Knock Knock, Who's There? Membership Inference on Aggregate Location Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.06145","snapshot_observed_at":"2026-08-06T15:15:21.342344Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.342344Z"},"links":{"cited_paper":"/paper/1708.06145","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:a218db573f65a5a095e1bbd54aefbcd459ebe34e5b27ed07e0b77472e2a39fc0","observation_id":"fd0302b5-eff2-46e5-b927-9088ed65d887","resolution":{"observed_at":"2026-08-06T15:15:21.342344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.388727Z","title":null,"venue":null,"work_id":"903b4c76-03fd-469e-a061-37bc963702ad","year":2019},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.350065Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:dd6a5d7e1c48332deebe6cef30322abec71f09a20a3a7066a3e8f06387c98621","observation_id":"7ecb1209-9b63-42a9-b3b6-fe5c38f80e9f","resolution":{"observed_at":"2026-08-06T15:15:22.395410Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.01246","last_updated":"2018-12-14T19:39:43Z","snapshot_observed_at":"2026-07-06T06:42:52.124532Z","submitted_at":"2018-06-04T17:38:42Z","title":"ML-Leaks: Model and Data Independent Membership Inference Attacks and Defenses on Machine Learning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.01246","snapshot_observed_at":"2026-08-06T15:15:21.355346Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.355346Z"},"links":{"cited_paper":"/paper/1806.01246","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:709116eebc231831a3babe638dc9d11821cd3df2c4ccc22317dcd4200c7e662c","observation_id":"0dcaf560-7be9-4129-b7ab-e3ef41fe4b1f","resolution":{"observed_at":"2026-08-06T15:15:21.355346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16789","last_updated":"2024-03-09T22:26:06Z","snapshot_observed_at":"2026-07-06T16:38:29.188225Z","submitted_at":"2023-10-25T17:21:23Z","title":"Detecting Pretraining Data from Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16789","snapshot_observed_at":"2026-08-06T15:15:21.359622Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.359622Z"},"links":{"cited_paper":"/paper/2310.16789","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:0edc360b7737270818b2d5396c033f060032b15709f8a6ed65822632b4d03df8","observation_id":"941a7ee8-a499-4769-a8e8-35812a52994f","resolution":{"observed_at":"2026-08-06T15:15:21.359622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.371699Z","title":null,"venue":null,"work_id":"6c125ea8-7245-4322-a4bc-3da15cc7245e","year":2023},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.364917Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:9fc731d76de0b33c3d74f22badbfb29efcbdc8a5264e9e6b8a71099f934d49e7","observation_id":"81b06794-b492-495e-9d06-c06d4e28da54","resolution":{"observed_at":"2026-08-06T15:15:22.376821Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.353519Z","title":null,"venue":null,"work_id":"74987a44-f607-4f89-8720-045d05b2d819","year":2017},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.371003Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:08b8d17194364f324578bf95e7580d90931df8e3099f2dee4bf1798c4667d960","observation_id":"83ea9fa1-8233-4ae4-b98f-381d1aa2ef77","resolution":{"observed_at":"2026-08-06T15:15:22.359031Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.331581Z","title":"o rg Tiedemann, Mikko Aulamo, Daria Bakshandaeva, Michele Boggia, Stig-Arne Gr \\","venue":null,"work_id":"a158bc53-756f-4fbb-a303-14b761f55293","year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.376328Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:4910420ea42510b0dc75f50b927a50662274539594ac872813953bf28aa55669","observation_id":"15477c2e-63db-41a7-bacc-54e161ec2a59","resolution":{"observed_at":"2026-08-06T15:15:22.337142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:21.381344Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.381344Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:7ae2376ba2b910e944d8331aedd8d817e1cc305f15865e7ee27a934fc778fce2","observation_id":"5f59f0fe-b27d-4939-afed-c38db0274ce0","resolution":{"observed_at":"2026-08-06T15:15:21.381344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10969","last_updated":"2024-07-24T14:57:48Z","snapshot_observed_at":"2026-08-06T20:50:27.431298Z","submitted_at":"2024-07-15T17:59:29Z","title":"Q-Sparse: All Large Language Models can be Fully Sparsely-Activated","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10969","snapshot_observed_at":"2026-08-06T15:15:21.387745Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.387745Z"},"links":{"cited_paper":"/paper/2407.10969","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:18ed651cf1de411b05ec390027ddaaa67c7ee1575a02f67692252b9ae9a3abeb","observation_id":"d48a10fb-c0ee-4a3d-8ee3-d0842025ec77","resolution":{"observed_at":"2026-08-06T15:15:21.387745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.08440","last_updated":"2022-04-11T09:23:43Z","snapshot_observed_at":"2026-07-06T12:09:00.789234Z","submitted_at":"2021-11-15T12:32:20Z","title":"On the Importance of Difficulty Calibration in Membership Inference Attacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.08440","snapshot_observed_at":"2026-08-06T15:15:21.392711Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.392711Z"},"links":{"cited_paper":"/paper/2111.08440","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:a1a02184099b1fadd456d6105662c2ad7f2719b851da0f84c4360533d9596e28","observation_id":"c6fc312a-8422-42c6-8614-90c873970e16","resolution":{"observed_at":"2026-08-06T15:15:21.392711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04244","last_updated":"2024-06-06T16:41:39Z","snapshot_observed_at":"2026-07-30T15:43:06.151242Z","submitted_at":"2024-06-06T16:41:39Z","title":"Benchmark Data Contamination of Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04244","snapshot_observed_at":"2026-08-06T15:15:21.400435Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.400435Z"},"links":{"cited_paper":"/paper/2406.04244","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:d9fd050f22c09dbd9b617c0d5e7c503246b97fead4c7c98e40477661d8fa95ad","observation_id":"54687662-3ac0-4b9a-af5e-f2e9e59178b6","resolution":{"observed_at":"2026-08-06T15:15:21.400435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.295679Z","title":null,"venue":null,"work_id":"5089a8a3-0ebc-41ab-b62c-edfc75b03ffc","year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.405660Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:5ea4cb8781119f7d789ec02bf1da98806a6509fe68f9e4ed1beef71fcfc4e99f","observation_id":"ec7c574a-b0ab-41a7-8dad-170a87bfaf48","resolution":{"observed_at":"2026-08-06T15:15:22.301790Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.276197Z","title":null,"venue":null,"work_id":"b13813e1-bd11-428d-8e09-4a790d5af1b9","year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.411144Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:f0d454afe3e89ad7526360daac520c0fd95795e969c7ecac9342eaa9adfc67a2","observation_id":"88badfd7-2710-490f-b840-365823371139","resolution":{"observed_at":"2026-08-06T15:15:22.281475Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:22.257192Z","title":null,"venue":null,"work_id":"aab09b80-2b74-49a3-9e22-24ab2d7ab760","year":2018},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.416693Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:b5d40c1136a96f45de619dacc19c33ea1857fe8e37ccea959fc1523f22e82c22","observation_id":"f139b92d-d25e-4c50-891b-9883eb40ad1c","resolution":{"observed_at":"2026-08-06T15:15:22.263314Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19798","last_updated":"2025-03-07T14:20:23Z","snapshot_observed_at":"2026-07-06T19:24:12.811792Z","submitted_at":"2024-09-29T21:49:32Z","title":"Membership Inference Attacks Cannot Prove that a Model Was Trained On Your Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19798","snapshot_observed_at":"2026-08-06T15:15:21.422233Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.422233Z"},"links":{"cited_paper":"/paper/2409.19798","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:92049cf719fed52b5cb04abfd72e412292e63f012662c4560a66606767d367e6","observation_id":"21032e1b-e41d-4d7a-bfb3-785fb5e58b9e","resolution":{"observed_at":"2026-08-06T15:15:21.422233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02936","last_updated":"2025-02-12T04:41:34Z","snapshot_observed_at":"2026-08-06T22:02:50.460833Z","submitted_at":"2024-04-03T04:25:01Z","title":"Min-K%++: Improved Baseline for Detecting Pre-Training Data from Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02936","snapshot_observed_at":"2026-08-06T15:15:21.428831Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.428831Z"},"links":{"cited_paper":"/paper/2404.02936","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:2588a1d226786f155c45791ebd92ad3c6f3fcf5c3be48c19e6c9c5dc10e5fb82","observation_id":"27c22f6c-8553-4cf2-9002-a8896860bd67","resolution":{"observed_at":"2026-08-06T15:15:21.428831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02385","last_updated":"2024-06-04T02:05:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-04T17:54:59Z","title":"TinyLlama: An Open-Source Small Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02385","snapshot_observed_at":"2026-08-06T15:15:21.435568Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.435568Z"},"links":{"cited_paper":"/paper/2401.02385","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:eeb05653a009898d7d1e6d92beb15606daf62e40026db6a525ae923382271668","observation_id":"7972e3e3-bc8b-4329-aac6-c5a90b069a0a","resolution":{"observed_at":"2026-08-06T15:15:21.435568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-06T15:15:21.443099Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.443099Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:dd2689f9b404387c76226fb9c9fdc1f451ea47c89b97bc209b9eddd049a60d11","observation_id":"3b6d82fc-fe0e-48da-befa-c406b312725c","resolution":{"observed_at":"2026-08-06T15:15:21.443099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14781","last_updated":"2025-05-21T03:41:29Z","snapshot_observed_at":"2026-08-04T05:37:22.827625Z","submitted_at":"2024-09-23T07:55:35Z","title":"Pretraining Data Detection for Large Language Models: A Divergence-based Calibration Method","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.14781","snapshot_observed_at":"2026-08-06T15:15:21.454509Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.454509Z"},"links":{"cited_paper":"/paper/2409.14781","citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:b3100fe7ad60fad2ad18dae6fe774f8513635bfde4b46488f1c27395cdaca40a","observation_id":"637cefb0-2249-407d-885f-c228f6cf9551","resolution":{"observed_at":"2026-08-06T15:15:21.454509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:15:21.466217Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-06T15:15:21.466217Z"},"links":{"citing_paper":"/paper/2507.16414"},"observation_digest":"sha256:f8a0addeacf5715a8e7b763b6f3c66f76cea8ac5a47b88bfafaff3a22c04833b","observation_id":"2da56f65-d7db-4481-a430-15bd819d647f","resolution":{"observed_at":"2026-08-06T15:15:21.466217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.16414","last_updated":"2025-07-22T10:05:30Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-06T15:07:39.822622Z","submitted_at":"2025-07-22T10:05:30Z","title":"Identifying Pre-training Data in LLMs: A Neuron Activation-Based Detection Framework"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":61,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 0 inbound Pith citation observations for arXiv:2507.16414."}