{"as_of":"2026-08-06T17:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bda5bf8be0fb4636925af8b0d895514c5fb292b47c3a19a272a41336cf0bb1d6","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T19:53:10.396785Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.03199/citation-record","integrity":"/paper/2604.03199/integrity","json":"/paper/2604.03199/citation-record.json","paper":"/paper/2604.03199"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep learning with differential privacy","venue":null,"work_id":"51aa5eac-2bf2-49d2-bd12-a113f6d8ad82","year":2016},"citing_paper":{"arxiv_id":"2604.03199","last_updated":"2026-04-03T17:17:51Z","snapshot_observed_at":"2026-08-02T10:19:39.008617Z","submitted_at":"2026-04-03T17:17:51Z","title":"Learning the Signature of Memorization in Autoregressive Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T19:53:10.396785Z"},"links":{"citing_paper":"/paper/2604.03199"},"observation_digest":"sha256:fead44c9a244457a6dba8cb438f277dcf4e35c33e38a8af89903431e6122ab89","observation_id":"71097c6e-cd46-4e68-8128-83900b97c22a","resolution":{"observed_at":"2026-05-13T19:53:11.990354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":"2309.16609","doi":"10.48550/arxiv.2309.16609","metadata_source":"pith","pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen Technical Report","venue":"cs.CL","work_id":"bb1fd52f-6b2f-437c-9516-37bdf6eb9be8","year":2023},"citing_paper":{"arxiv_id":"2604.03199","last_updated":"2026-04-03T17:17:51Z","snapshot_observed_at":"2026-08-02T10:19:39.008617Z","submitted_at":"2026-04-03T17:17:51Z","title":"Learning the Signature of Memorization in Autoregressive Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T19:53:10.396785Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2604.03199"},"observation_digest":"sha256:5567740e0452eee089877d009693a16d976e6d0be3aa3e26d0b220cb5aab326c","observation_id":"bb76322d-c104-43e8-92a0-591d4375a5e7","resolution":{"observed_at":"2026-05-13T19:53:11.457782Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-15T23:50:15.620681+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T23:50:15.620681+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07839","last_updated":"2024-08-28T15:05:42Z","snapshot_observed_at":"2026-07-06T17:58:56.081219Z","submitted_at":"2024-04-11T15:27:22Z","title":"RecurrentGemma: Moving Past Transformers for Efficient Open Language Models","version":2},"cited_work":{"arxiv_id":"2404.07839","doi":"10.48550/arxiv.2404.07839","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.07839","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"L., Fernando, A., Muraru, G.- C., Haroun, R., Berrada, L., Pascanu, R., Sessa, P","venue":"arXiv (Cornell University)","work_id":"103f0b8c-9dd6-4002-93b8-d59b79b11d15","year":2024},"citing_paper":{"arxiv_id":"2604.03199","last_updated":"2026-04-03T17:17:51Z","snapshot_observed_at":"2026-08-02T10:19:39.008617Z","submitted_at":"2026-04-03T17:17:51Z","title":"Learning the Signature of Memorization in Autoregressive Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T19:53:10.396785Z"},"links":{"cited_paper":"/paper/2404.07839","citing_paper":"/paper/2604.03199"},"observation_digest":"sha256:1cf4c7aa701dc391272212ccf1003c70d391b8e5473486dc95e9cbd0363d6cdf","observation_id":"ff1adcdf-7730-4c02-b1b1-1c0011e20be1","resolution":{"observed_at":"2026-05-13T19:53:11.460881Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Membership inference attacks from first principles","venue":null,"work_id":"7f02e184-c8b7-4234-89f5-f5ed0db35cd4","year":1914},"citing_paper":{"arxiv_id":"2604.03199","last_updated":"2026-04-03T17:17:51Z","snapshot_observed_at":"2026-08-02T10:19:39.008617Z","submitted_at":"2026-04-03T17:17:51Z","title":"Learning the Signature of Memorization in Autoregressive Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T19:53:10.396785Z"},"links":{"citing_paper":"/paper/2604.03199"},"observation_digest":"sha256:9cf3df0fe7320054402726337e049578743b1eab06eac911d065594fadc3c958","observation_id":"615c0538-ea5e-4b8e-8dfa-d21b2536ed8e","resolution":{"observed_at":"2026-05-13T19:53:11.988024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.02751","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T09:25:40.756018Z","title":"Window-based membership inference attacks against fine-tuned large language models","venue":null,"work_id":"f5d352fc-3b2c-44c9-addd-f8d85636e7aa","year":null},"citing_paper":{"arxiv_id":"2604.03199","last_updated":"2026-04-03T17:17:51Z","snapshot_observed_at":"2026-08-02T10:19:39.008617Z","submitted_at":"2026-04-03T17:17:51Z","title":"Learning the Signature of Memorization in Autoregressive Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-13T19:53:10.396785Z"},"links":{"citing_paper":"/paper/2604.03199"},"observation_digest":"sha256:8eb4d05d376009c2362f4af834c0f286f6c832ecac2513d3062616db2dd6a13f","observation_id":"a2219091-bada-401b-b396-bbd2032c0d77","resolution":{"observed_at":"2026-05-13T19:53:11.463853Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03208","last_updated":"2023-04-06T16:43:16Z","snapshot_observed_at":"2026-07-06T15:13:02.077291Z","submitted_at":"2023-04-06T16:43:16Z","title":"Cerebras-GPT: Open Compute-Optimal Language Models Trained on the Cerebras Wafer-Scale Cluster","version":1},"cited_work":{"arxiv_id":"2304.03208","doi":"10.48550/arxiv.2304.03208","metadata_source":"arxiv_reference","pith_arxiv_id":"2304.03208","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Chen, Z., Khachane, H., Marshall, W., Pathria, R., Tom, M., and Hestness, J","venue":"arXiv (Cornell University)","work_id":"146665a8-e124-465b-aa7f-84693124b019","year":2023},"citing_paper":{"arxiv_id":"2604.03199","last_updated":"2026-04-03T17:17:51Z","snapshot_observed_at":"2026-08-02T10:19:39.008617Z","submitted_at":"2026-04-03T17:17:51Z","title":"Learning the Signature of Memorization in Autoregressive Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T19:53:10.396785Z"},"links":{"cited_paper":"/paper/2304.03208","citing_paper":"/paper/2604.03199"},"observation_digest":"sha256:cb36d01c43fff8259f2b14e684096fa502c2f245ae7511bf094bf293a3bf8dc5","observation_id":"3030597b-90d3-49d4-b542-8bcf4d65b7e0","resolution":{"observed_at":"2026-05-13T19:53:11.472570Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07841","last_updated":"2024-09-16T13:18:23Z","snapshot_observed_at":"2026-07-06T17:29:00.943463Z","submitted_at":"2024-02-12T17:52:05Z","title":"Do Membership Inference Attacks Work on Large Language Models?","version":2},"cited_work":{"arxiv_id":"2402.07841","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.07841","snapshot_observed_at":"2026-07-04T10:59:46.006014Z","title":"arXiv preprint arXiv:2402.07841 , year=","venue":null,"work_id":"ed6b0b8c-85ff-481a-bf05-90b8c3feab4e","year":2024},"citing_paper":{"arxiv_id":"2604.03199","last_updated":"2026-04-03T17:17:51Z","snapshot_observed_at":"2026-08-02T10:19:39.008617Z","submitted_at":"2026-04-03T17:17:51Z","title":"Learning the Signature of Memorization in Autoregressive Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-13T19:53:10.396785Z"},"links":{"cited_paper":"/paper/2402.07841","citing_paper":"/paper/2604.03199"},"observation_digest":"sha256:49fd424a5698259b858c3c0c4d4276c093278f1d7c5ff5e682dcc215f8687967","observation_id":"5707179e-171e-4abf-b374-8dc48447e387","resolution":{"observed_at":"2026-05-13T19:53:11.488922Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":"2403.08295","doi":"10.48550/arxiv.2403.08295","metadata_source":"pith","pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemma: Open Models Based on Gemini Research and Technology","venue":"cs.CL","work_id":"a9ea2870-df28-40b8-a9e0-a7e9a116f793","year":2024},"citing_paper":{"arxiv_id":"2604.03199","last_updated":"2026-04-03T17:17:51Z","snapshot_observed_at":"2026-08-02T10:19:39.008617Z","submitted_at":"2026-04-03T17:17:51Z","title":"Learning the Signature of Memorization in Autoregressive Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-13T19:53:10.396785Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2604.03199"},"observation_digest":"sha256:f00cb6d4a84256261e98398dfc77f2cc297ce585b7e905aede30ef8104c6a233","observation_id":"3ca9c5d3-7b1e-45f0-a0ad-fd487426efcd","resolution":{"observed_at":"2026-05-13T19:53:11.469482Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":"2312.00752","doi":"10.48550/arxiv.2312.00752","metadata_source":"pith","pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","venue":"cs.LG","work_id":"4ee75248-1199-492c-a52f-6661e0f4adff","year":2023},"citing_paper":{"arxiv_id":"2604.03199","last_updated":"2026-04-03T17:17:51Z","snapshot_observed_at":"2026-08-02T10:19:39.008617Z","submitted_at":"2026-04-03T17:17:51Z","title":"Learning the Signature of Memorization in Autoregressive Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T19:53:10.396785Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2604.03199"},"observation_digest":"sha256:9bca440a75343be1b72bd0058bdc5b875df19ea1203a63519ea3c9e44441b9f2","observation_id":"b3acad32-6f7e-4bfa-8f58-5aa2f39dc8e7","resolution":{"observed_at":"2026-05-13T19:53:11.505734Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-30T19:25:31.081761+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-30T19:25:31.081761+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.12104","last_updated":"2026-04-13T15:25:39Z","snapshot_observed_at":"2026-07-06T22:42:03.665045Z","submitted_at":"2026-01-17T16:59:41Z","title":"Powerful Training-Free Membership Inference Against Autoregressive Language Models","version":2},"cited_work":{"arxiv_id":"2601.12104","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.12104","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Powerful Training-Free Membership Inference Against Autoregressive Language Models","venue":"cs.CL","work_id":"b8c4c2b4-5d62-4f61-b3bc-69f30e31d890","year":2026},"citing_paper":{"arxiv_id":"2604.03199","last_updated":"2026-04-03T17:17:51Z","snapshot_observed_at":"2026-08-02T10:19:39.008617Z","submitted_at":"2026-04-03T17:17:51Z","title":"Learning the Signature of Memorization in Autoregressive Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-13T19:53:10.396785Z"},"links":{"cited_paper":"/paper/2601.12104","citing_paper":"/paper/2604.03199"},"observation_digest":"sha256:9a6d71195357146ee9e3fb6776e9ac64f7f40b3d6a8253e8f21719478fa27297","observation_id":"e540784e-32ee-4109-8732-7b1df5be7304","resolution":{"observed_at":"2026-05-13T19:53:11.503252Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Membership inference attacks against language models via neigh- bourhood comparison","venue":null,"work_id":"d6fa1f3c-7700-4ea4-80ba-91bae21fb7f1","year":2023},"citing_paper":{"arxiv_id":"2604.03199","last_updated":"2026-04-03T17:17:51Z","snapshot_observed_at":"2026-08-02T10:19:39.008617Z","submitted_at":"2026-04-03T17:17:51Z","title":"Learning the Signature of Memorization in Autoregressive Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T19:53:10.396785Z"},"links":{"citing_paper":"/paper/2604.03199"},"observation_digest":"sha256:6e70715c5816b9b4a2976da0c35a223fd9af40939941ac8112e0b3b906187c20","observation_id":"81ffa46e-b802-4912-bb22-810abd055fb0","resolution":{"observed_at":"2026-05-13T19:53:11.996967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07843","last_updated":"2016-09-26T04:06:13Z","snapshot_observed_at":"2026-07-06T05:12:10.387914Z","submitted_at":"2016-09-26T04:06:13Z","title":"Pointer Sentinel Mixture Models","version":1},"cited_work":{"arxiv_id":"1609.07843","doi":"10.1007/978-3-030-62077-6","metadata_source":"pith","pith_arxiv_id":"1609.07843","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pointer Sentinel Mixture Models","venue":"cs.CL","work_id":"fef3833e-dc80-42a3-a1e0-ffbfafee6fff","year":2016},"citing_paper":{"arxiv_id":"2604.03199","last_updated":"2026-04-03T17:17:51Z","snapshot_observed_at":"2026-08-02T10:19:39.008617Z","submitted_at":"2026-04-03T17:17:51Z","title":"Learning the Signature of Memorization in Autoregressive Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T19:53:10.396785Z"},"links":{"cited_paper":"/paper/1609.07843","citing_paper":"/paper/2604.03199"},"observation_digest":"sha256:dc1c6b9f4a247556064c60c96fbf9cd3b477beadcc23d221284319ca61453a44","observation_id":"c7f2d055-7286-45b0-98f8-5497bab5e5fd","resolution":{"observed_at":"2026-05-13T19:53:11.480752Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11429","last_updated":"2022-10-06T20:43:53Z","snapshot_observed_at":"2026-08-04T18:01:18.545904Z","submitted_at":"2022-09-23T06:13:16Z","title":"News Category Dataset","version":3},"cited_work":{"arxiv_id":"2209.11429","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2209.11429","snapshot_observed_at":"2026-07-01T19:36:08.261990Z","title":"News category dataset","venue":null,"work_id":"9e72fc85-d280-4f6c-bc5b-78dbc7187097","year":2022},"citing_paper":{"arxiv_id":"2604.03199","last_updated":"2026-04-03T17:17:51Z","snapshot_observed_at":"2026-08-02T10:19:39.008617Z","submitted_at":"2026-04-03T17:17:51Z","title":"Learning the Signature of Memorization in Autoregressive Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-13T19:53:10.396785Z"},"links":{"cited_paper":"/paper/2209.11429","citing_paper":"/paper/2604.03199"},"observation_digest":"sha256:efc9fbc362fc2e3aefd5d4baafa845e4a57c702ea59cfe63c3c3a23a7b27100f","observation_id":"1bdc74ed-7cc6-4323-a1c8-0a8ff364f69a","resolution":{"observed_at":"2026-05-13T19:53:11.475329Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Don’t give me the details, just the summary! topic-aware convolutional neural networks for extreme summarization","venue":null,"work_id":"3d5af2df-cc20-47ec-9b23-034c6c4dec18","year":2018},"citing_paper":{"arxiv_id":"2604.03199","last_updated":"2026-04-03T17:17:51Z","snapshot_observed_at":"2026-08-02T10:19:39.008617Z","submitted_at":"2026-04-03T17:17:51Z","title":"Learning the Signature of Memorization in Autoregressive Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-13T19:53:10.396785Z"},"links":{"citing_paper":"/paper/2604.03199"},"observation_digest":"sha256:00db46664be4afb2a6ff8ec3a06b3888739112358805729205ca8826041f14fd","observation_id":"c11c878c-d4f5-412d-af88-179eb203a0b2","resolution":{"observed_at":"2026-05-13T19:53:11.992672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01116","last_updated":"2023-06-01T20:03:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-01T20:03:56Z","title":"The RefinedWeb Dataset for Falcon LLM: Outperforming Curated Corpora with Web Data, and Web Data Only","version":1},"cited_work":{"arxiv_id":"2306.01116","doi":"10.48550/arxiv.2306.01116","metadata_source":"pith","pith_arxiv_id":"2306.01116","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The RefinedWeb Dataset for Falcon LLM: Outperforming Curated Corpora with Web Data, and Web Data Only","venue":"cs.CL","work_id":"edfb45ee-84c2-4531-b3cd-bd8eb830f4e1","year":2023},"citing_paper":{"arxiv_id":"2604.03199","last_updated":"2026-04-03T17:17:51Z","snapshot_observed_at":"2026-08-02T10:19:39.008617Z","submitted_at":"2026-04-03T17:17:51Z","title":"Learning the Signature of Memorization in Autoregressive Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-13T19:53:10.396785Z"},"links":{"cited_paper":"/paper/2306.01116","citing_paper":"/paper/2604.03199"},"observation_digest":"sha256:ca50147621ae9fd510804811bc1ffd0f278842f915d7c10e90eec50837c4a1ea","observation_id":"87c9fc22-7149-4a0f-90b9-b5a3f35097b2","resolution":{"observed_at":"2026-05-13T20:43:45.999902Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"RWKV: Reinventing RNNs for the transformer era","venue":null,"work_id":"8934f17d-e6ab-453b-8dac-3efe06b0568b","year":2023},"citing_paper":{"arxiv_id":"2604.03199","last_updated":"2026-04-03T17:17:51Z","snapshot_observed_at":"2026-08-02T10:19:39.008617Z","submitted_at":"2026-04-03T17:17:51Z","title":"Learning the Signature of Memorization in Autoregressive Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-13T19:53:10.396785Z"},"links":{"citing_paper":"/paper/2604.03199"},"observation_digest":"sha256:947f680dce773f34bfa402730fb966c8729685ef7dc2765c99fcd6499e237219","observation_id":"978c21b7-fbc5-482d-9a29-50cd64b4af70","resolution":{"observed_at":"2026-05-13T19:53:11.994852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":"2305.18290","doi":"10.48550/arxiv.2305.18290","metadata_source":"pith","pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","venue":"cs.LG","work_id":"62105b61-411f-46e5-970a-bd322c6adbbc","year":2023},"citing_paper":{"arxiv_id":"2604.03199","last_updated":"2026-04-03T17:17:51Z","snapshot_observed_at":"2026-08-02T10:19:39.008617Z","submitted_at":"2026-04-03T17:17:51Z","title":"Learning the Signature of Memorization in Autoregressive Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-13T19:53:10.396785Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2604.03199"},"observation_digest":"sha256:9e7ba5dfa01c0fb7e5278477b3ac0957922dcd5790ce56fb09d44c04527dfc9f","observation_id":"c181ec07-3a77-48f4-8bbe-e4e1709fbbfa","resolution":{"observed_at":"2026-05-13T19:53:11.486197Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:53:49.179087+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:53:49.179087+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-03T03:32:02.223426Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":"1910.01108","doi":"10.48550/arxiv.1910.01108","metadata_source":"pith","pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-07-11T02:57:46.620845Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","venue":"cs.CL","work_id":"756f9764-ecd6-4672-8043-b37c698c7ad2","year":2019},"citing_paper":{"arxiv_id":"2604.03199","last_updated":"2026-04-03T17:17:51Z","snapshot_observed_at":"2026-08-02T10:19:39.008617Z","submitted_at":"2026-04-03T17:17:51Z","title":"Learning the Signature of Memorization in Autoregressive Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-13T19:53:10.396785Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2604.03199"},"observation_digest":"sha256:653a5dd865167ee2c7b8366c5f373a6b56a82e68f724a642abb100694ed088cb","observation_id":"2e54abf3-93d9-416e-bb5b-ef76d5a5afa4","resolution":{"observed_at":"2026-05-13T19:53:11.499708Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16789","last_updated":"2024-03-09T22:26:06Z","snapshot_observed_at":"2026-07-06T16:38:29.188225Z","submitted_at":"2023-10-25T17:21:23Z","title":"Detecting Pretraining Data from Large Language Models","version":3},"cited_work":{"arxiv_id":"2310.16789","doi":"10.48550/arxiv.2310.16789","metadata_source":"pith","pith_arxiv_id":"2310.16789","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Detecting Pretraining Data from Large Language Models","venue":"cs.CL","work_id":"1ff0530f-0b29-487b-ba43-d22a740293b1","year":2023},"citing_paper":{"arxiv_id":"2604.03199","last_updated":"2026-04-03T17:17:51Z","snapshot_observed_at":"2026-08-02T10:19:39.008617Z","submitted_at":"2026-04-03T17:17:51Z","title":"Learning the Signature of Memorization in Autoregressive Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-13T19:53:10.396785Z"},"links":{"cited_paper":"/paper/2310.16789","citing_paper":"/paper/2604.03199"},"observation_digest":"sha256:e9a06e3343cd9f29fd8ec4d908497f5c6e2d19437e1d0224e000e8e1f4af99d6","observation_id":"e5f13f10-6cd0-45a1-af2d-621e6b817598","resolution":{"observed_at":"2026-05-17T18:07:25.061786Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02936","last_updated":"2025-02-12T04:41:34Z","snapshot_observed_at":"2026-07-06T17:55:16.774337Z","submitted_at":"2024-04-03T04:25:01Z","title":"Min-K%++: Improved Baseline for Detecting Pre-Training Data from Large Language Models","version":4},"cited_work":{"arxiv_id":"2404.02936","doi":"10.48550/arxiv.2404.02936","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.02936","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Min-k%++: Improved baseline for detecting pre-training data from large language models","venue":"arXiv (Cornell University)","work_id":"c265805c-ef58-480e-b29b-f3dcaa510aa5","year":2025},"citing_paper":{"arxiv_id":"2604.03199","last_updated":"2026-04-03T17:17:51Z","snapshot_observed_at":"2026-08-02T10:19:39.008617Z","submitted_at":"2026-04-03T17:17:51Z","title":"Learning the Signature of Memorization in Autoregressive Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-13T19:53:10.396785Z"},"links":{"cited_paper":"/paper/2404.02936","citing_paper":"/paper/2604.03199"},"observation_digest":"sha256:1f33e07e108bd6571449bcce62c03e54854e8f4ee8e61c81ba8265368206effc","observation_id":"a7adb287-207d-4551-b810-bc240ae08fef","resolution":{"observed_at":"2026-05-13T19:53:11.478145Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7900.9600","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Table 4: Full results on held-out transformers: AUC","venue":null,"work_id":"beb6b944-3b54-4137-b8ee-86e2b8755e0a","year":2080},"citing_paper":{"arxiv_id":"2604.03199","last_updated":"2026-04-03T17:17:51Z","snapshot_observed_at":"2026-08-02T10:19:39.008617Z","submitted_at":"2026-04-03T17:17:51Z","title":"Learning the Signature of Memorization in Autoregressive Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-13T19:53:10.396785Z"},"links":{"citing_paper":"/paper/2604.03199"},"observation_digest":"sha256:c4f19b69433f3a98f7ad5db54c6a026f6f99c4713f45a644b57f8e36f87c44ce","observation_id":"9d7ae684-5f37-4491-aed8-86d02d731f0e","resolution":{"observed_at":"2026-05-13T19:53:11.466678Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0080.1240","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"D Classifier Architecture Ablation Table 11 presents full results for the classifier architecture comparison","venue":null,"work_id":"d5fe5cf5-d9cf-4ccd-9c55-2398708ac372","year":2020},"citing_paper":{"arxiv_id":"2604.03199","last_updated":"2026-04-03T17:17:51Z","snapshot_observed_at":"2026-08-02T10:19:39.008617Z","submitted_at":"2026-04-03T17:17:51Z","title":"Learning the Signature of Memorization in Autoregressive Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-13T19:53:10.396785Z"},"links":{"citing_paper":"/paper/2604.03199"},"observation_digest":"sha256:f2bce6ca9876b3abb7f236a1432eaa9241f3c32f70514f4f57c43b3feb2c4452","observation_id":"d30daedb-cb05-4dc2-87bd-d58276eacdc6","resolution":{"observed_at":"2026-05-13T19:53:11.483651Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.03199","last_updated":"2026-04-03T17:17:51Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-02T10:19:39.008617Z","submitted_at":"2026-04-03T17:17:51Z","title":"Learning the Signature of Memorization in Autoregressive Language Models"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":0,"verified_exact":15,"verified_fuzzy":5},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 0 inbound Pith citation observations for arXiv:2604.03199."}