{"as_of":"2026-08-17T19:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a822571dba2b30016a13c7c5fd3d8040a709bfcda152fd844ac159812d18dc9a","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:39:04.641425Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.06284/citation-record","integrity":"/paper/2505.06284/integrity","json":"/paper/2505.06284/citation-record.json","paper":"/paper/2505.06284"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:04.457313Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.457313Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:76eaf698d35bed544abd75301d19bd97f33ab15102ee0f366bc09c4e6faae5a5","observation_id":"e1d7eeb1-b463-48fc-9c01-d22917479c94","resolution":{"observed_at":"2026-08-15T23:39:04.457313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:04.461585Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.461585Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:d25a7856c58b7cdccdf7c14cf1092938190777a81ab31f2989128169b3360137","observation_id":"4e7f6344-02ad-4cab-807f-548d5b6bd192","resolution":{"observed_at":"2026-08-15T23:39:04.461585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1605.05362","last_updated":"2016-05-17T20:52:33Z","snapshot_observed_at":"2026-08-17T06:32:48.628839Z","submitted_at":"2016-05-17T20:52:33Z","title":"Yelp Dataset Challenge: Review Rating Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1605.05362","snapshot_observed_at":"2026-08-15T23:39:04.465762Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.465762Z"},"links":{"cited_paper":"/paper/1605.05362","citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:236a527aefe0370334b08639341e46fb9cf9b435259a555b9b96a62775a4a044","observation_id":"29e127dd-6ea0-448f-a466-f15275bc9c70","resolution":{"observed_at":"2026-08-15T23:39:04.465762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-15T23:39:04.469796Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.469796Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:43d1fbdeaab8bafe612c7086e7bc3769cc65ac327540387f48e3374ea902a38d","observation_id":"d88d3cb3-e4bc-464a-abcf-66dd8bb0a939","resolution":{"observed_at":"2026-08-15T23:39:04.469796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10305","last_updated":"2025-04-17T08:34:42Z","snapshot_observed_at":"2026-08-14T19:59:05.307983Z","submitted_at":"2023-09-19T04:13:22Z","title":"Baichuan 2: Open Large-scale Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10305","snapshot_observed_at":"2026-08-15T23:39:04.473604Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.473604Z"},"links":{"cited_paper":"/paper/2309.10305","citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:a020315b71f95fda08ef205086f97791988d7a496ee1eff6198908a932a449f0","observation_id":"4932c4dd-7e71-404d-8cdb-e266a645fad5","resolution":{"observed_at":"2026-08-15T23:39:04.473604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:05.146679Z","title":null,"venue":null,"work_id":"59a9e5e2-8ebd-49f2-95d5-c273f87db1d8","year":2025},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.477128Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:5cb37be49a185570bf904bec5e8222281b6a74bbe7893d3cea1accbaea5a9e53","observation_id":"50793b11-d42d-4dd6-a124-7243f9100ae6","resolution":{"observed_at":"2026-08-15T23:39:05.149866Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:04.480564Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.480564Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:62f2c8a98151639e28de2910ba03c34734462c876f4d70dcdb94309043bf09e9","observation_id":"1ef7cd50-4d48-4e3d-bef8-e7327f50adba","resolution":{"observed_at":"2026-08-15T23:39:04.480564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:04.483889Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.483889Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:989f1c57634556e0ab31972d95ff8c1f26b772e03db265d9c424001ff67b181c","observation_id":"ef7ad25e-7668-47ea-b82f-cf774fdd06b8","resolution":{"observed_at":"2026-08-15T23:39:04.483889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.02059","last_updated":"2019-06-05T14:56:06Z","snapshot_observed_at":"2026-08-14T16:20:27.189690Z","submitted_at":"2019-06-05T14:56:06Z","title":"Neural Legal Judgment Prediction in English","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.02059","snapshot_observed_at":"2026-08-15T23:39:04.487300Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.487300Z"},"links":{"cited_paper":"/paper/1906.02059","citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:28e38608b9624a3f83d833c6ff459fc2d57451f3525465d862b9108e61f2f0da","observation_id":"34eed6f2-825d-4e7f-b923-04336f9b3846","resolution":{"observed_at":"2026-08-15T23:39:04.487300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:05.124727Z","title":null,"venue":null,"work_id":"912475e1-8ffa-4963-af12-3de8055157fa","year":2025},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.494110Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:09849c0f753b672e319dd07416466de88df5db1e061b4a57fcaa6908a8168e22","observation_id":"35f351b9-ae24-4542-8a2a-78f126e4c45c","resolution":{"observed_at":"2026-08-15T23:39:05.128137Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18371","last_updated":"2024-11-02T10:00:52Z","snapshot_observed_at":"2026-08-16T13:06:25.940470Z","submitted_at":"2024-10-24T02:26:57Z","title":"Gibberish is All You Need for Membership Inference Detection in Contrastive Language-Audio Pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18371","snapshot_observed_at":"2026-08-15T23:39:04.497355Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.497355Z"},"links":{"cited_paper":"/paper/2410.18371","citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:9456b8b85e5c5af93e6fb305eb5f0c8bab58b571cb5f3687f18c81d576201d1a","observation_id":"b768bc67-380c-44e9-b288-60e2377e64f4","resolution":{"observed_at":"2026-08-15T23:39:04.497355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10160","last_updated":"2024-08-16T12:20:22Z","snapshot_observed_at":"2026-08-16T17:37:50.657720Z","submitted_at":"2024-04-15T22:18:50Z","title":"Reinforcement Learning from Multi-role Debates as Feedback for Bias Mitigation in LLMs","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10160","snapshot_observed_at":"2026-08-15T23:39:04.501096Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.501096Z"},"links":{"cited_paper":"/paper/2404.10160","citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:bd3da4f33b5ff4c9398f5192f39441c8b50eea0f5b4286e647c4e810175db685","observation_id":"034bfd2e-9c15-4bc4-a705-19dcf4e7f151","resolution":{"observed_at":"2026-08-15T23:39:04.501096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:04.504533Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.504533Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:fc7025390a5f3bbe7c054448fd98cbbf3d64ae99414018587047b1fa14f23fde","observation_id":"4b873466-2852-4ffe-b4f0-879ba74078d5","resolution":{"observed_at":"2026-08-15T23:39:04.504533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:04.507504Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.507504Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:2aa7ce2fe970698549cbad1f3f56bcf9e0bbd47985757b25befb03e244e9255b","observation_id":"d3dcbfd1-b99a-44f6-afa9-d36a2907aabd","resolution":{"observed_at":"2026-08-15T23:39:04.507504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12793","last_updated":"2024-07-30T03:58:11Z","snapshot_observed_at":"2026-08-14T09:56:00.692687Z","submitted_at":"2024-06-18T16:58:21Z","title":"ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12793","snapshot_observed_at":"2026-08-15T23:39:04.510607Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.510607Z"},"links":{"cited_paper":"/paper/2406.12793","citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:70dd20964850f41aac561abb5d9210e2f76ad0a3e8a5b5899d4f5a9940f8ffa5","observation_id":"232640c4-2297-45f0-af11-d329903fd17e","resolution":{"observed_at":"2026-08-15T23:39:04.510607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T23:39:04.514067Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.514067Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:5ca25fb22e3030e42ebbc1a8d89e1186b63d64bb5feaa507d31f8bbc00d7b04e","observation_id":"2bbdf3bb-9a31-4673-901c-443605bc29d5","resolution":{"observed_at":"2026-08-15T23:39:04.514067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.01403","last_updated":"2021-04-02T20:27:44Z","snapshot_observed_at":"2026-08-16T19:08:34.377987Z","submitted_at":"2020-11-03T01:10:39Z","title":"Supervised Contrastive Learning for Pre-trained Language Model Fine-tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.01403","snapshot_observed_at":"2026-08-15T23:39:04.517664Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.517664Z"},"links":{"cited_paper":"/paper/2011.01403","citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:8267e6ea857e0731d9eb3f02dd62c7b38e889f54a98c10b6008361a3d933f727","observation_id":"63394824-2a46-4a70-9655-97948711b3c3","resolution":{"observed_at":"2026-08-15T23:39:04.517664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-15T23:39:04.522083Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.522083Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:540a7eb961357b001f92f4937c4e4cf617566a76e5379e65fd942f940562818b","observation_id":"1a73e93b-3a55-494c-a66a-5f2563fa23f1","resolution":{"observed_at":"2026-08-15T23:39:04.522083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:05.107946Z","title":null,"venue":null,"work_id":"20bab143-7d66-4ce3-a429-fd3100bcd284","year":2024},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.525578Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:5c034e98dea9f4c0fa9baf7fe6b9189228165fe6a4b575f361679ebf38539fdc","observation_id":"de95eea4-198e-4f93-a001-a4c26cf28bf1","resolution":{"observed_at":"2026-08-15T23:39:05.111253Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.05405","last_updated":"2021-02-22T23:53:08Z","snapshot_observed_at":"2026-08-17T16:53:39.094762Z","submitted_at":"2021-01-14T00:57:32Z","title":"Training Data Leakage Analysis in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.05405","snapshot_observed_at":"2026-08-15T23:39:04.528843Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.528843Z"},"links":{"cited_paper":"/paper/2101.05405","citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:6b08a53972c15a28f976cd41a1d93c922f47e257f2cae1a367fd12549bd4e4da","observation_id":"6f712e05-036e-4e1d-a116-a46589878d2c","resolution":{"observed_at":"2026-08-15T23:39:04.528843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.00099","last_updated":"2023-05-09T14:08:17Z","snapshot_observed_at":"2026-08-16T16:49:06.318226Z","submitted_at":"2022-06-30T20:48:26Z","title":"Measuring Forgetting of Memorized Training Examples","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.00099","snapshot_observed_at":"2026-08-15T23:39:04.533270Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.533270Z"},"links":{"cited_paper":"/paper/2207.00099","citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:d95805945405220dd47f590f4911ca3a5d4a81bff206b84d1b53757efd0967f1","observation_id":"8f45686f-7a91-44f8-a0b6-6f73bbd1e5ca","resolution":{"observed_at":"2026-08-15T23:39:04.533270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:05.097634Z","title":null,"venue":null,"work_id":"4269d317-ce64-4278-94b2-39c92044b949","year":2024},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.537285Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:4cbdd1cc01564f1426f3dd50adc9f9301149ce934d666a97be363392702a68a8","observation_id":"d7099288-ef38-4037-8fc1-ffd689207ac4","resolution":{"observed_at":"2026-08-15T23:39:05.101337Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:04.540249Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.540249Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:08cd4c171a931846b35bfad92d74b398aba9fc6643b814e795a754f92b688bdf","observation_id":"c56af638-3299-40fd-80de-656b4f89dca3","resolution":{"observed_at":"2026-08-15T23:39:04.540249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:04.543291Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.543291Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:31bd2d01e462f65bccb92967f4bb65d8d8e3533e85634c35a7c18a8ffe79daa9","observation_id":"2b603f1e-ed03-41fe-aa9e-cd52bf9a0bd3","resolution":{"observed_at":"2026-08-15T23:39:04.543291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:04.546265Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.546265Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:2f54b9657e7f809214a3e392c69a5ce13d119854703f2d892afa18bfd3f843a3","observation_id":"206378ca-cd9d-4f03-9d93-fb6493062bdd","resolution":{"observed_at":"2026-08-15T23:39:04.546265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.02231","last_updated":"2023-09-06T21:13:28Z","snapshot_observed_at":"2026-08-16T17:35:08.472912Z","submitted_at":"2022-06-05T17:58:02Z","title":"Models of human preference for learning reward functions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.02231","snapshot_observed_at":"2026-08-15T23:39:04.549420Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.549420Z"},"links":{"cited_paper":"/paper/2206.02231","citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:8288c1e47e9660c654f0249ebe44a00f1a89b75f542413755a7fbe87d07f0aae","observation_id":"32592992-01cb-4497-a287-6d56e90f44a0","resolution":{"observed_at":"2026-08-15T23:39:04.549420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.07762","last_updated":"2021-04-22T22:57:03Z","snapshot_observed_at":"2026-08-16T19:27:40.613403Z","submitted_at":"2021-04-15T20:40:05Z","title":"Does BERT Pretrained on Clinical Notes Reveal Sensitive Data?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.07762","snapshot_observed_at":"2026-08-15T23:39:04.552704Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.552704Z"},"links":{"cited_paper":"/paper/2104.07762","citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:fd324d26dfd36166a47b134d1d446b72ed1e0467911c3dbae4e524c421b06ed1","observation_id":"0e70d11f-103d-4448-ac26-2bf7cf4802e8","resolution":{"observed_at":"2026-08-15T23:39:04.552704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:05.068801Z","title":null,"venue":null,"work_id":"446bc4fb-e6e1-4c41-8200-5b26f537d2ba","year":2020},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.555888Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:5231cbbb0a84ee0afcfdf035a7a2115dd6d195a4e75c6d83308637d62f3802a8","observation_id":"06eb2465-f36d-4ff4-89aa-66242f99055d","resolution":{"observed_at":"2026-08-15T23:39:05.072149Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:05.058561Z","title":null,"venue":null,"work_id":"0db43181-cbec-49b7-a7bc-75835da3c794","year":2024},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.558899Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:7f1ee317b81f3b3efd757fc434dc6b83e164c8886d060562f37e2570ef56bc20","observation_id":"4d62aedb-c229-472f-97f1-672273eb6c61","resolution":{"observed_at":"2026-08-15T23:39:05.062072Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14517","last_updated":"2025-03-25T01:47:37Z","snapshot_observed_at":"2026-08-16T17:37:50.058568Z","submitted_at":"2024-05-23T12:54:25Z","title":"TUNI: A Textual Unimodal Detector for Identity Inference in CLIP Models","version":2},"cited_work":{"arxiv_id":"2405.14517","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.14517","snapshot_observed_at":"2026-08-15T23:39:04.762683Z","title":"TUNI: A Textual Unimodal Detector for Identity Inference in CLIP Models","venue":"cs.LG","work_id":"e78ff31c-64ad-49e2-b21d-fc3c381319f6","year":2024},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.561946Z"},"links":{"cited_paper":"/paper/2405.14517","citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:b6c68102b73d04f84f4efc5308d793e287a866bb5cdab7329c3093ba52a0c2a7","observation_id":"9665581d-ecd3-450f-943f-53670a5a7ea8","resolution":{"observed_at":"2026-08-15T23:39:04.768336Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:05.048682Z","title":"note bloat","venue":null,"work_id":"731c8126-8088-40ac-89cc-86243a24b308","year":2022},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.565309Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:e810078cc0f75850ca076900190743b6f595a83b47e7ce8ab0345ec058c80a0a","observation_id":"5dbc892d-a385-4f60-a3d4-176ca4a7344b","resolution":{"observed_at":"2026-08-15T23:39:05.051949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:04.568305Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.568305Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:4412cfa4b3fa47b1142216675ed56f6218389daa9e2014d52a5a9f4418017105","observation_id":"519ad9db-0f9d-4aea-a96e-b5d503063391","resolution":{"observed_at":"2026-08-15T23:39:04.568305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17035","last_updated":"2023-11-28T18:47:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T18:47:03Z","title":"Scalable Extraction of Training Data from (Production) Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17035","snapshot_observed_at":"2026-08-15T23:39:04.571444Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.571444Z"},"links":{"cited_paper":"/paper/2311.17035","citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:5805ad8104962b0e97ce9130be267196bf988c1b1ec4c60934c7bd16c130d05d","observation_id":"bbdce563-d3dd-4b5d-bdff-9d1455f41857","resolution":{"observed_at":"2026-08-15T23:39:04.571444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:05.032796Z","title":null,"venue":null,"work_id":"675b8e85-15f2-419c-8e70-a82812f3cd42","year":2000},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.575094Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:ec4d5ab6247b43165244aebb87973f33158932b63f9bbfdfe442665bc59033c7","observation_id":"2a4d3b75-120b-41a8-bd8d-f688c5ee8e4e","resolution":{"observed_at":"2026-08-15T23:39:05.036278Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05734","last_updated":"2025-08-08T09:27:21Z","snapshot_observed_at":"2026-08-15T09:43:09.015019Z","submitted_at":"2024-12-07T20:09:01Z","title":"LeakAgent: RL-based Red-teaming Agent for LLM Privacy Leakage","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05734","snapshot_observed_at":"2026-08-15T23:39:04.578072Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.578072Z"},"links":{"cited_paper":"/paper/2412.05734","citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:860a2c5e8ca6a2a10cbc5676df65b49c171f226ef7afbef7949fef9526bdffd7","observation_id":"9c18248a-c9b9-43c6-8403-269d70772a45","resolution":{"observed_at":"2026-08-15T23:39:04.578072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:04.581556Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.581556Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:8cfa0e439166c4a4065ab719a2a2e83f694adf0883bf5a1832b695917aebbfc8","observation_id":"cd7861f2-49a3-4ecc-93f4-aa614d15a2fa","resolution":{"observed_at":"2026-08-15T23:39:04.581556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00765","last_updated":"2024-12-01T10:58:53Z","snapshot_observed_at":"2026-08-15T13:31:26.141984Z","submitted_at":"2024-12-01T10:58:53Z","title":"SelfPrompt: Autonomously Evaluating LLM Robustness via Domain-Constrained Knowledge Guidelines and Refined Adversarial Prompts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00765","snapshot_observed_at":"2026-08-15T23:39:04.589952Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.589952Z"},"links":{"cited_paper":"/paper/2412.00765","citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:56aed1a8d2cab3f802ca71de096cea4114a8e2d442ea2a67192ee212c564135a","observation_id":"944a99ab-8976-4dc0-b89f-61bbc2178f63","resolution":{"observed_at":"2026-08-15T23:39:04.589952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:04.594330Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.594330Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:34ff69925ebc635dc4e03cee44c6f2ef5a439476c1a254c32c4b44b468a6272c","observation_id":"5d1af099-603a-4257-8fbc-1b813e669d0b","resolution":{"observed_at":"2026-08-15T23:39:04.594330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:04.597532Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.597532Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:b067ff6d46c3f3ff7b22eccfacf4908a799b164d5ac2c9682af087cd70346dc7","observation_id":"2adee9b4-b7e3-4521-a674-f34024fb777a","resolution":{"observed_at":"2026-08-15T23:39:04.597532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:04.600881Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.600881Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:756f26480f65e428739059ce870875f9a9353f6a82fdbfae6d701d350fbb7599","observation_id":"c9481b93-da40-4f44-852f-f17a2ef9f004","resolution":{"observed_at":"2026-08-15T23:39:04.600881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:04.997659Z","title":null,"venue":null,"work_id":"fc3befeb-7034-4552-9072-ebaa92b9236c","year":2011},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.604160Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:7bf5331a8df7a83800f96e160be405d6028cd84c2edd893b19879d69e3e08866","observation_id":"11374d0e-88e1-4338-a95f-61be6617e568","resolution":{"observed_at":"2026-08-15T23:39:05.001079Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1508.07909","last_updated":"2016-06-10T14:45:08Z","snapshot_observed_at":"2026-08-17T07:28:37.146698Z","submitted_at":"2015-08-31T16:37:31Z","title":"Neural Machine Translation of Rare Words with Subword Units","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1508.07909","snapshot_observed_at":"2026-08-15T23:39:04.607490Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.607490Z"},"links":{"cited_paper":"/paper/1508.07909","citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:3216b4a8aabf50600d08a33c9dba02478e7e8c563258f25419f33044597cd4cb","observation_id":"e03fc48e-bba8-4f5a-b8f5-5ef2716f2aa4","resolution":{"observed_at":"2026-08-15T23:39:04.607490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-15T23:39:04.611030Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.611030Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:8199b6ca9dbda3cc572d711c1d730f1c231b0475c9f6f0f851fa8fc52711ac7f","observation_id":"7c897ac8-3555-44c3-b84f-c057702da972","resolution":{"observed_at":"2026-08-15T23:39:04.611030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:04.614370Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.614370Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:aac1df36c505ff88779036ee9ff62d8736fc3f79f5cd1342ab9d7149eafc971d","observation_id":"da9d2a0a-bed2-4e99-a730-9f7e5de6e995","resolution":{"observed_at":"2026-08-15T23:39:04.614370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14525","last_updated":"2023-09-25T20:59:33Z","snapshot_observed_at":"2026-08-15T23:42:34.277075Z","submitted_at":"2023-09-25T20:59:33Z","title":"Aligning Large Multimodal Models with Factually Augmented RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14525","snapshot_observed_at":"2026-08-15T23:39:04.617630Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.617630Z"},"links":{"cited_paper":"/paper/2309.14525","citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:f23d8324f626eb04bf3dfeb9e01151f60f585d2d79e12ebb56232782c4ca9c67","observation_id":"b19bc193-932d-4eb5-8407-f99fd1bd8ab1","resolution":{"observed_at":"2026-08-15T23:39:04.617630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:04.981601Z","title":null,"venue":null,"work_id":"3b88249a-dc83-4751-b4e4-1f11bf90514d","year":2020},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.621043Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:412dffb8dab59bad93feaa03da29f4465f4d8f27fdc59c17279ebc2477a90c01","observation_id":"074983fb-27c1-496c-8869-2a8d55bc88dd","resolution":{"observed_at":"2026-08-15T23:39:04.985070Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-15T23:39:04.624178Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.624178Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:463df106a34817098b9e37bc0e6daa5572335b3315c1ed7470549b5d70c070e9","observation_id":"9008bd6f-6915-482c-8bec-acf8ee915d9a","resolution":{"observed_at":"2026-08-15T23:39:04.624178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06500","last_updated":"2022-07-14T22:14:17Z","snapshot_observed_at":"2026-08-16T17:49:45.358995Z","submitted_at":"2021-10-13T05:15:00Z","title":"Differentially Private Fine-tuning of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06500","snapshot_observed_at":"2026-08-15T23:39:04.627594Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.627594Z"},"links":{"cited_paper":"/paper/2110.06500","citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:afbe13407ed75ade8f58695640459ec997b427efcb26aabb0675c63ce3269b02","observation_id":"c73e3805-2381-4811-9ad3-1c1406b5dd60","resolution":{"observed_at":"2026-08-15T23:39:04.627594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11538","last_updated":"2024-05-25T05:32:39Z","snapshot_observed_at":"2026-08-16T14:41:58.337813Z","submitted_at":"2023-11-20T04:56:46Z","title":"Assessing Prompt Injection Risks in 200+ Custom GPTs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11538","snapshot_observed_at":"2026-08-15T23:39:04.631255Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.631255Z"},"links":{"cited_paper":"/paper/2311.11538","citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:4cc197d713922760eb52f695247f21ffc29e9d9f15c6cbb4e09a72ea15bce74f","observation_id":"36a57df2-7c08-49db-96cb-4718ccc7ad37","resolution":{"observed_at":"2026-08-15T23:39:04.631255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:04.971549Z","title":null,"venue":null,"work_id":"0c2b181b-f562-4faf-9a35-2cf78a03b346","year":2023},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.634916Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:300b7d3a160bfa565148f2655ebae3c0352f7d6703deb05a0a45ad23b6d55c04","observation_id":"94687acb-66e8-4171-bed0-1544a715a9f0","resolution":{"observed_at":"2026-08-15T23:39:04.974969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:39:04.961591Z","title":null,"venue":null,"work_id":"f69d2873-4b34-4010-ba91-616aa9af9fb8","year":2022},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.638270Z"},"links":{"citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:1b38778ef75733bb7282f5e5b517278625c018ab25aba1da49b00c0e425f5afd","observation_id":"2d982d1a-a949-4b68-afce-71f9f0510975","resolution":{"observed_at":"2026-08-15T23:39:04.965018Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13538","last_updated":"2025-03-15T20:53:46Z","snapshot_observed_at":"2026-08-16T17:37:48.529028Z","submitted_at":"2025-03-15T20:53:46Z","title":"From Demonstrations to Rewards: Alignment Without Explicit Human Preferences","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13538","snapshot_observed_at":"2026-08-15T23:39:04.641425Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:04.641425Z"},"links":{"cited_paper":"/paper/2503.13538","citing_paper":"/paper/2505.06284"},"observation_digest":"sha256:dc65e29f826af5a571b34db24ef7c013176eb761e1ce04c0281da87e25145939","observation_id":"f956bd2d-24cd-455b-99d4-92ce6b352209","resolution":{"observed_at":"2026-08-15T23:39:04.641425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.06284","last_updated":"2025-05-07T07:21:37Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T06:33:37.325126Z","submitted_at":"2025-05-07T07:21:37Z","title":"DMRL: Data- and Model-aware Reward Learning for Data Extraction"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":50,"verified_exact":1,"verified_fuzzy":1},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2505.06284."}