{"as_of":"2026-08-08T01:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b462d2f76f47e00df8b5b604dc85fb83ae17233c906124018cd6d78acf6b811e","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:37:31.442193Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:38:15.928177Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T17:38:20.641277Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2505.14585","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.14585","snapshot_observed_at":"2026-08-06T17:38:20.641277Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","venue":"cs.CL","work_id":"e4406a92-3faf-4c7e-b375-09ea09a8f711","year":2025},"citing_paper":{"arxiv_id":"2507.11502","last_updated":"2025-07-14T15:09:05Z","snapshot_observed_at":"2026-08-06T23:37:13.918770Z","submitted_at":"2025-07-14T15:09:05Z","title":"HKGAI-V1: Towards Regional Sovereign Large Language Model for Hong Kong","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:15.928177Z"},"links":{"cited_paper":"/paper/2505.14585","citing_paper":"/paper/2507.11502"},"observation_digest":"sha256:9be02a2dd36a6ae05da80d4b04447e8eb43cbf0fb5608315c9da4889448b3f23","observation_id":"48e6a4e1-d5b3-4f4b-bdc1-1603a6fae1b6","resolution":{"observed_at":"2026-08-06T17:38:20.745079Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14585","snapshot_observed_at":"2026-08-05T10:39:07.039355Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03871","last_updated":"2025-09-04T04:12:31Z","snapshot_observed_at":"2026-08-06T11:50:02.157285Z","submitted_at":"2025-09-04T04:12:31Z","title":"A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models","version":1},"reference_index":156,"source":"pdf_text","source_observed_at":"2026-08-05T10:39:07.039355Z"},"links":{"cited_paper":"/paper/2505.14585","citing_paper":"/paper/2509.03871"},"observation_digest":"sha256:5fe4aa45f8c9d0a54f5a1714dacc9b55dadbf1b4cb8bf9de30d39c8b8c36b0c7","observation_id":"b83fe0b0-dcaa-4c11-b003-c3021ae15ad2","resolution":{"observed_at":"2026-08-05T10:39:07.039355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.14585/citation-record","integrity":"/paper/2505.14585/integrity","json":"/paper/2505.14585/citation-record.json","paper":"/paper/2505.14585"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.09704","last_updated":"2024-03-08T21:26:49Z","snapshot_observed_at":"2026-08-07T21:21:25.965063Z","submitted_at":"2024-03-08T21:26:49Z","title":"Alignment Studio: Aligning Large Language Models to Particular Contextual Regulations","version":1},"cited_work":{"arxiv_id":"2403.09704","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.09704","snapshot_observed_at":"2026-08-07T15:37:33.721497Z","title":"Alignment Studio: Aligning Large Language Models to Particular Contextual Regulations","venue":"cs.CL","work_id":"1ae02ac2-e8e0-4f0f-a66a-7fc7dcba12dc","year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:24.568421Z"},"links":{"cited_paper":"/paper/2403.09704","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:b032cf27a45b6f1bd59326037295a6a4532a9168e48b6725e5092425cb93dcfd","observation_id":"39372ee0-310d-4014-9563-c6249e5ce4f3","resolution":{"observed_at":"2026-08-07T15:37:33.808468Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:24.652966Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:24.652966Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:8439bcfd431930caff315e165cc26c1bbf28f29fab56259267f4d6e6d29ab888","observation_id":"98d5261d-aec7-41d1-87e6-b061f686cbd0","resolution":{"observed_at":"2026-08-07T15:37:24.652966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:24.786439Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:24.786439Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:6ee263e91aef40b398ab913942eb102c9991b5588c32494ecd2930bc471c6391","observation_id":"e8775409-1e12-4eb4-8e46-f34f00afda2b","resolution":{"observed_at":"2026-08-07T15:37:24.786439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.08232","last_updated":"2019-07-16T17:05:32Z","snapshot_observed_at":"2026-08-06T23:45:16.145644Z","submitted_at":"2018-02-22T18:42:41Z","title":"The Secret Sharer: Evaluating and Testing Unintended Memorization in Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.08232","snapshot_observed_at":"2026-08-07T15:37:24.927576Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:24.927576Z"},"links":{"cited_paper":"/paper/1802.08232","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:411b2433428c9840e21a060c82f426b758490bf9ca2a0aeb7b3ad7fcf4a53b99","observation_id":"ba1cd59e-96f6-4094-8274-c9999a2bab12","resolution":{"observed_at":"2026-08-07T15:37:24.927576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-07T15:37:25.072025Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:25.072025Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:aa849bedc54e735d94645e056a3206b47b8ab9f9ee259ad4a8dfb5878cec5d24","observation_id":"73256e9c-8ad7-463d-8010-e673d7e5b027","resolution":{"observed_at":"2026-08-07T15:37:25.072025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-07T15:37:25.204373Z","title":"Pappas, and Eric Wong","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:25.204373Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:b92f294da8d6493d33bec3437b01901611f08b3ed671727e14ca36d540c7e5f6","observation_id":"990725b1-be1d-46c1-914d-3fc89abcb71c","resolution":{"observed_at":"2026-08-07T15:37:25.204373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:25.308495Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:25.308495Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:dd9d3ed638043cdfb71ad57302f8e8dddc1114838a62cdddf65ca5b4b06200d9","observation_id":"479f46f2-999d-4390-b4b3-e682553bf8d2","resolution":{"observed_at":"2026-08-07T15:37:25.308495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:25.421845Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:25.421845Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:cf9252e08269bcf310f2afdf5c40c36ddb59be4784d516506f99dfd34139fe6b","observation_id":"9465ff60-eece-440f-b092-eaf26ede060d","resolution":{"observed_at":"2026-08-07T15:37:25.421845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:25.578725Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:25.578725Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:1d6f980f458aa07c2d1a9c4c575be322afb0cf0266b6951cfd32fb86b1d80b4b","observation_id":"b4c83403-ada1-4f8e-a984-2e5013396b1b","resolution":{"observed_at":"2026-08-07T15:37:25.578725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13903","last_updated":"2024-09-20T21:14:36Z","snapshot_observed_at":"2026-08-07T11:52:47.531997Z","submitted_at":"2024-09-20T21:14:36Z","title":"CI-Bench: Benchmarking Contextual Integrity of AI Assistants on Synthetic Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13903","snapshot_observed_at":"2026-08-07T15:37:25.713365Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:25.713365Z"},"links":{"cited_paper":"/paper/2409.13903","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:2e9e04717d6c69969387b05004aa39fbcce01768b01f5ea6c0b1b73bc25e8460","observation_id":"6f69d212-7e44-4e3a-b3e3-18fa67d7dd94","resolution":{"observed_at":"2026-08-07T15:37:25.713365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01456","last_updated":"2025-09-26T09:25:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-03T15:43:48Z","title":"Process Reinforcement through Implicit Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01456","snapshot_observed_at":"2026-08-07T15:37:25.785540Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:25.785540Z"},"links":{"cited_paper":"/paper/2502.01456","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:9ac15f8910cfad2df6bd28bfdc461f9c87e9340774c8c2752b9018da8a2ae0d8","observation_id":"fc839245-d41b-4f72-8890-306b4f6ff67d","resolution":{"observed_at":"2026-08-07T15:37:25.785540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T15:37:25.789933Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:25.789933Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:3d0e43bd7ac7170d969682fbcd15127c25cf3d3ad05b351924a953c7ceb059fa","observation_id":"e587ec70-73d8-4fe2-9bc2-04b660216276","resolution":{"observed_at":"2026-08-07T15:37:25.789933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.12257","last_updated":"2025-08-17T06:41:40Z","snapshot_observed_at":"2026-08-06T16:22:19.007607Z","submitted_at":"2025-08-17T06:41:40Z","title":"Structuring the Unstructured: A Systematic Review of Text-to-Structure Generation for Agentic AI with a Universal Evaluation Framework","version":1},"cited_work":{"arxiv_id":"2508.12257","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.12257","snapshot_observed_at":"2026-08-07T15:37:33.066787Z","title":"Structuring the Unstructured: A Systematic Review of Text-to-Structure Generation for Agentic AI with a Universal Evaluation Framework","venue":"cs.CL","work_id":"3d1afb3d-0a84-4967-9611-0ec01beded9c","year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:25.794251Z"},"links":{"cited_paper":"/paper/2508.12257","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:986fda1ca86dc48bab6b4f8b4428b7d2b2eeef42e366315764442a31afdef99d","observation_id":"9dab7cdd-f49e-4fbf-b733-b9dc94183f9e","resolution":{"observed_at":"2026-08-07T15:37:33.205897Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-07T15:37:25.866924Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:25.866924Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:a08a706cb8def71d585239400a4e7cc2c36d7ce0989f2cd9faac88c7b0c5f91a","observation_id":"bacdce3f-568c-49a5-ae88-18e3e8131156","resolution":{"observed_at":"2026-08-07T15:37:25.866924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11149","last_updated":"2024-10-04T03:00:43Z","snapshot_observed_at":"2026-07-06T18:31:53.591578Z","submitted_at":"2024-06-17T02:27:32Z","title":"GoldCoin: Grounding Large Language Models in Privacy Laws via Contextual Integrity Theory","version":2},"cited_work":{"arxiv_id":"2406.11149","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.11149","snapshot_observed_at":"2026-08-07T15:37:32.813331Z","title":"GoldCoin: Grounding Large Language Models in Privacy Laws via Contextual Integrity Theory","venue":"cs.CL","work_id":"bcf80dfd-447c-4a66-b24a-a5c7f3dabfc0","year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:26.009555Z"},"links":{"cited_paper":"/paper/2406.11149","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:078f8a9b0301f1529d689a2d432bb63cdc854555b589d2ef80e9a44ba87d4d43","observation_id":"cbfdfc53-e9ef-4cc5-a835-1b4a994e05e0","resolution":{"observed_at":"2026-08-07T15:37:32.892279Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.09825","last_updated":"2024-04-03T19:47:54Z","snapshot_observed_at":"2026-07-06T16:20:01.109566Z","submitted_at":"2023-09-18T14:47:24Z","title":"Bias of AI-Generated Content: An Examination of News Produced by Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.09825","snapshot_observed_at":"2026-08-07T15:37:26.097347Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:26.097347Z"},"links":{"cited_paper":"/paper/2309.09825","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:ef5b2fe622da30fe07a71e450d680d457e4334012ef7884471b92f5b51215fe0","observation_id":"b702bf90-def5-4573-a119-0451594a1add","resolution":{"observed_at":"2026-08-07T15:37:26.097347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16289","last_updated":"2023-09-28T09:35:59Z","snapshot_observed_at":"2026-08-07T18:48:25.719201Z","submitted_at":"2023-09-28T09:35:59Z","title":"LawBench: Benchmarking Legal Knowledge of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16289","snapshot_observed_at":"2026-08-07T15:37:26.187600Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:26.187600Z"},"links":{"cited_paper":"/paper/2309.16289","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:cbf613230b9e7c663d7b7a7509a0e955969baae4b4a03be717b32babd5fe6582","observation_id":"27fb1375-bff2-4cba-a340-09b8db6da751","resolution":{"observed_at":"2026-08-07T15:37:26.187600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02373","last_updated":"2024-09-13T13:09:41Z","snapshot_observed_at":"2026-07-06T18:56:53.237634Z","submitted_at":"2024-08-05T10:53:51Z","title":"Operationalizing Contextual Integrity in Privacy-Conscious Assistants","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02373","snapshot_observed_at":"2026-08-07T15:37:26.304358Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:26.304358Z"},"links":{"cited_paper":"/paper/2408.02373","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:8c3a673c9c4b9731b73e0f0be616f98bb33d56a65a8297ff99083c76c19e274e","observation_id":"fef6c64a-e147-43c6-a8b0-824ba5572579","resolution":{"observed_at":"2026-08-07T15:37:26.304358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08567","last_updated":"2024-06-03T14:15:03Z","snapshot_observed_at":"2026-07-06T17:29:34.813390Z","submitted_at":"2024-02-13T16:06:17Z","title":"Agent Smith: A Single Image Can Jailbreak One Million Multimodal LLM Agents Exponentially Fast","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08567","snapshot_observed_at":"2026-08-07T15:37:26.435481Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:26.435481Z"},"links":{"cited_paper":"/paper/2402.08567","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:97daa5c44aa05942583feb34082ed5ecfbbfc1762248b21d5b6f41139e54c22c","observation_id":"b7a153d4-0757-4f75-a5ea-f25b1c108195","resolution":{"observed_at":"2026-08-07T15:37:26.435481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11462","last_updated":"2023-08-20T22:08:03Z","snapshot_observed_at":"2026-08-03T20:35:47.668090Z","submitted_at":"2023-08-20T22:08:03Z","title":"LegalBench: A Collaboratively Built Benchmark for Measuring Legal Reasoning in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.11462","snapshot_observed_at":"2026-08-07T15:37:26.528544Z","title":"Ho, Christopher Ré, Adam Chilton, Aditya Narayana, Alex Chohlas-Wood, Austin Peters, Brandon Waldon, Daniel N","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:26.528544Z"},"links":{"cited_paper":"/paper/2308.11462","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:fb58929137ac883d757a0b514558446fefa03a8b767b2f02018a74a955f709d2","observation_id":"067804ab-144d-4d0d-9762-7e1ba74c4a27","resolution":{"observed_at":"2026-08-07T15:37:26.528544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T15:37:26.628909Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:26.628909Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:54d6b8dbc793af94173a709a80eff30c10e4624fb8e30f255626037aa9793007","observation_id":"6ba1bf51-3967-4541-bdd5-a3c618b1d5cc","resolution":{"observed_at":"2026-08-07T15:37:26.628909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11143","last_updated":"2025-10-09T12:22:46Z","snapshot_observed_at":"2026-07-31T12:28:37.704994Z","submitted_at":"2024-05-20T01:04:40Z","title":"OpenRLHF: An Easy-to-use, Scalable and High-performance RLHF Framework","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11143","snapshot_observed_at":"2026-08-07T15:37:26.704153Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:26.704153Z"},"links":{"cited_paper":"/paper/2405.11143","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:416a63d06291145b895f87c4c817769d4d1d7e6c45d4e49bef4db912b2506897","observation_id":"a2333286-0158-4099-8106-2cacae11a345","resolution":{"observed_at":"2026-08-07T15:37:26.704153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:26.780649Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:26.780649Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:fd71080b4645c028f009112afb4fab18f69736b32a97a8cb26c3a28506f30bbb","observation_id":"ec8375de-bade-4e2e-8ce2-8b5f1a83e83e","resolution":{"observed_at":"2026-08-07T15:37:26.780649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-07T15:37:26.913997Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:26.913997Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:2ac2f9568a9a2bf033031b5c7a950ab81d7fa3eeafb955e4b44a349e12b2cf29","observation_id":"4487fc13-7444-4f37-89e3-8d559c0be63a","resolution":{"observed_at":"2026-08-07T15:37:26.913997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:27.029278Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:27.029278Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:fde4c8240edb74799ead4a27d62e99ae4089cac316944d9169e071fc71dfbeff","observation_id":"d1853068-8c23-40ec-bdd7-29e702130f21","resolution":{"observed_at":"2026-08-07T15:37:27.029278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10383","last_updated":"2024-09-30T11:58:27Z","snapshot_observed_at":"2026-08-03T23:12:05.533433Z","submitted_at":"2023-10-16T13:23:54Z","title":"Privacy in Large Language Models: Attacks, Defenses and Future Directions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10383","snapshot_observed_at":"2026-08-07T15:37:27.148812Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:27.148812Z"},"links":{"cited_paper":"/paper/2310.10383","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:84cf9877dd6b13f94788e38bcd66aa111d2142dc68939f9af4a84497b38d4a1a","observation_id":"c59c179e-81a5-45a2-afc1-87ed334df0df","resolution":{"observed_at":"2026-08-07T15:37:27.148812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10053","last_updated":"2025-02-13T11:43:39Z","snapshot_observed_at":"2026-07-06T19:02:56.021845Z","submitted_at":"2024-08-19T14:48:04Z","title":"Privacy Checklist: Privacy Violation Detection Grounding on Contextual Integrity Theory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10053","snapshot_observed_at":"2026-08-07T15:37:27.233556Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:27.233556Z"},"links":{"cited_paper":"/paper/2408.10053","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:49d3ca1464bdb367a1425b2d43f3a75909e428b4f774cc2ab458aaa0e5e4efdf","observation_id":"58eb9242-5b8c-4f41-9903-b5fdadd27428","resolution":{"observed_at":"2026-08-07T15:37:27.233556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05197","last_updated":"2023-11-01T05:14:01Z","snapshot_observed_at":"2026-07-06T15:14:24.794122Z","submitted_at":"2023-04-11T13:05:04Z","title":"Multi-step Jailbreaking Privacy Attacks on ChatGPT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05197","snapshot_observed_at":"2026-08-07T15:37:27.312304Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:27.312304Z"},"links":{"cited_paper":"/paper/2304.05197","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:ae76e82ed66f687f963c8bdb09bcb913aa25b246d1897099d80fdfefae7c75c8","observation_id":"f7e18a7c-af09-43e7-a55d-7dc2e77a5963","resolution":{"observed_at":"2026-08-07T15:37:27.312304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17041","last_updated":"2025-05-23T06:53:04Z","snapshot_observed_at":"2026-08-07T17:53:39.865069Z","submitted_at":"2025-02-24T10:49:34Z","title":"PrivaCI-Bench: Evaluating Privacy with Contextual Integrity and Legal Compliance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17041","snapshot_observed_at":"2026-08-07T15:37:27.419956Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:27.419956Z"},"links":{"cited_paper":"/paper/2502.17041","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:a1f175949883f60179f9daa19d7f3f73a04b2bd4268a925ba98038576160d279","observation_id":"7ba95d35-7c49-42cb-9484-dd87661f6893","resolution":{"observed_at":"2026-08-07T15:37:27.419956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03191","last_updated":"2024-11-28T13:43:50Z","snapshot_observed_at":"2026-08-04T19:12:56.970085Z","submitted_at":"2023-11-06T15:29:30Z","title":"DeepInception: Hypnotize Large Language Model to Be Jailbreaker","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03191","snapshot_observed_at":"2026-08-07T15:37:27.502326Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:27.502326Z"},"links":{"cited_paper":"/paper/2311.03191","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:4a48eab946aba5632abe91f576f63766350d8d502e76bf48c55085b82068cfab","observation_id":"5980dbd6-2928-4bbf-800a-fc9376c9a236","resolution":{"observed_at":"2026-08-07T15:37:27.502326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05459","last_updated":"2024-05-08T06:16:23Z","snapshot_observed_at":"2026-08-02T13:57:57.119489Z","submitted_at":"2024-01-10T09:25:45Z","title":"Personal LLM Agents: Insights and Survey about the Capability, Efficiency and Security","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05459","snapshot_observed_at":"2026-08-07T15:37:27.632302Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:27.632302Z"},"links":{"cited_paper":"/paper/2401.05459","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:72f2d4ed37be7c9eca7b35c96cc39385360bb5840cded4da0064c1582ffada3c","observation_id":"5094c26d-9c13-4d18-bba0-2b2d99d36fcb","resolution":{"observed_at":"2026-08-07T15:37:27.632302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18438","last_updated":"2023-07-03T13:08:46Z","snapshot_observed_at":"2026-07-06T15:34:59.457879Z","submitted_at":"2023-05-29T01:18:39Z","title":"Reinforcement Learning with Human Feedback: Learning Dynamic Choices via Pessimism","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18438","snapshot_observed_at":"2026-08-07T15:37:27.735776Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:27.735776Z"},"links":{"cited_paper":"/paper/2305.18438","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:cf66183e55e307e99b088524c8cb351f9f2c840217cc601edf8d74f5e69d6ad0","observation_id":"b87d7704-760f-4733-9942-2bbf1c04246f","resolution":{"observed_at":"2026-08-07T15:37:27.735776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.07958","last_updated":"2022-05-08T02:43:02Z","snapshot_observed_at":"2026-08-03T16:26:48.747700Z","submitted_at":"2021-09-08T17:15:27Z","title":"TruthfulQA: Measuring How Models Mimic Human Falsehoods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.07958","snapshot_observed_at":"2026-08-07T15:37:27.835124Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:27.835124Z"},"links":{"cited_paper":"/paper/2109.07958","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:6cc4e4d14b02337cc7a57cd6a41e818a80714c6c7900c703c39fe04c00844029","observation_id":"c30a8834-e4ad-45dd-a616-498d642e8474","resolution":{"observed_at":"2026-08-07T15:37:27.835124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05499","last_updated":"2025-12-29T02:25:27Z","snapshot_observed_at":"2026-07-06T15:40:27.639368Z","submitted_at":"2023-06-08T18:43:11Z","title":"Prompt Injection attack against LLM-integrated Applications","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05499","snapshot_observed_at":"2026-08-07T15:37:27.924319Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:27.924319Z"},"links":{"cited_paper":"/paper/2306.05499","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:68b8e58a9475709de7dc569543c80a1db548d4fa0f3ed9db66d9ba96edf05379","observation_id":"aa9fa9bf-f5d7-4496-8632-368ff503d553","resolution":{"observed_at":"2026-08-07T15:37:27.924319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17884","last_updated":"2024-06-28T23:27:10Z","snapshot_observed_at":"2026-08-07T22:36:46.691875Z","submitted_at":"2023-10-27T04:15:30Z","title":"Can LLMs Keep a Secret? Testing Privacy Implications of Language Models via Contextual Integrity Theory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.17884","snapshot_observed_at":"2026-08-07T15:37:28.028759Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:28.028759Z"},"links":{"cited_paper":"/paper/2310.17884","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:8bea492d0c2439901a3f3af5472a012e427af4460e73c7e2fb4fb2ea6f1b3f06","observation_id":"3d6c3987-3ffe-4eb9-9cc3-45ea47f9aea6","resolution":{"observed_at":"2026-08-07T15:37:28.028759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:34.123096Z","title":null,"venue":null,"work_id":"e6ebe1b4-1da7-4838-ad3e-c63beb10637d","year":2009},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:28.162230Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:aa71d7b7055e5758752351b1fc47a65e1033e25ba78c5e7ebcd8fc44a8aac813","observation_id":"11479c46-247c-49e9-a952-b96ccdbb76b9","resolution":{"observed_at":"2026-08-07T15:37:34.235599Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T15:37:28.278624Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:28.278624Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:b5edf33961dc1115b9013e51b21ba4b5da11684acdf24575ac116882f3f4fc8d","observation_id":"de1ba10a-b695-469b-8824-53816953cf6f","resolution":{"observed_at":"2026-08-07T15:37:28.278624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:33.951446Z","title":null,"venue":null,"work_id":"6df5668a-d45d-4723-bbe7-b94ee0322379","year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:28.400443Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:eded8b1f1a696560638dbe8c5d422ce4f03553f5731ab6300101b91461289b93","observation_id":"62b6b9ae-bcd5-4c87-8601-37f27a930680","resolution":{"observed_at":"2026-08-07T15:37:34.042678Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-07T15:37:28.515613Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:28.515613Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:50d37ba5ba3f1e06ddb385c0e6d18048db865b7455d2fc064e9e6beb14cbb11a","observation_id":"6618858b-b737-4f8a-92d8-c33b401ca31a","resolution":{"observed_at":"2026-08-07T15:37:28.515613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:28.688518Z","title":"Brendan McMahan, Sergei Vassilvitskii, Steve Chien, and Abhradeep Guha Thakurta","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:28.688518Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:d77697d76fa07d26ca29a4cd0fe9bbe0f8b37cb605beb995f009309c2b0e1c39","observation_id":"486809dd-1a11-4bb1-8fa9-8b0e89c82e63","resolution":{"observed_at":"2026-08-07T15:37:28.688518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T15:37:28.876330Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:28.876330Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:3426072dfbd48347e47ff979535e84f5e7a62d6ba28e3edbcc7d479d482f483e","observation_id":"5cb2798a-9944-4a40-8031-4ef46e772760","resolution":{"observed_at":"2026-08-07T15:37:28.876330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.10641","last_updated":"2019-11-21T19:01:32Z","snapshot_observed_at":"2026-07-06T08:09:59.842324Z","submitted_at":"2019-07-24T18:11:59Z","title":"WinoGrande: An Adversarial Winograd Schema Challenge at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.10641","snapshot_observed_at":"2026-08-07T15:37:29.013764Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:29.013764Z"},"links":{"cited_paper":"/paper/1907.10641","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:87df637196e1f14a40fe9eab4dffca9776b4fb5451b536592ab7ebb6758108ab","observation_id":"f3a04e38-52b1-4441-8be7-adac42b2cf39","resolution":{"observed_at":"2026-08-07T15:37:29.013764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1502.05477","last_updated":"2017-04-20T18:04:12Z","snapshot_observed_at":"2026-07-06T04:09:39.172428Z","submitted_at":"2015-02-19T06:44:25Z","title":"Trust Region Policy Optimization","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1502.05477","snapshot_observed_at":"2026-08-07T15:37:29.124059Z","title":"Jordan, and Pieter Abbeel","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:29.124059Z"},"links":{"cited_paper":"/paper/1502.05477","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:709603534194b72ec896c179b8983246dd579549037039e5f7fade2deb68a673","observation_id":"62e3c68a-c131-4125-af26-f5768d6306aa","resolution":{"observed_at":"2026-08-07T15:37:29.124059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-07T15:37:29.274966Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:29.274966Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:ac463ec3ead007cf3b2421cca60e1dd6dd4d2bae5edcac8f45e2e33a93198557","observation_id":"92e376a2-5fe9-4744-831c-413a80925506","resolution":{"observed_at":"2026-08-07T15:37:29.274966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T15:37:29.386957Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:29.386957Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:62aca7738f55ca309f55e4c138ab6ea7e79aa19b24e7f017b98d6ddbf966a7d2","observation_id":"66cd6366-c2e6-4c65-8bf3-be3220eeb346","resolution":{"observed_at":"2026-08-07T15:37:29.386957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.12557","last_updated":"2021-06-17T14:10:57Z","snapshot_observed_at":"2026-07-06T09:31:38.165161Z","submitted_at":"2020-06-22T18:34:08Z","title":"Just How Toxic is Data Poisoning? A Unified Benchmark for Backdoor and Data Poisoning Attacks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.12557","snapshot_observed_at":"2026-08-07T15:37:29.522948Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:29.522948Z"},"links":{"cited_paper":"/paper/2006.12557","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:a07b9cfb7d89f18b615518c965c66392c98308a645270d6b67927000639fc417","observation_id":"1576fe6c-af4c-432b-af4e-5c1b6d7860b0","resolution":{"observed_at":"2026-08-07T15:37:29.522948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03825","last_updated":"2024-05-15T12:06:31Z","snapshot_observed_at":"2026-07-06T16:03:34.432602Z","submitted_at":"2023-08-07T16:55:20Z","title":"\"Do Anything Now\": Characterizing and Evaluating In-The-Wild Jailbreak Prompts on Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03825","snapshot_observed_at":"2026-08-07T15:37:29.632571Z","title":"do anything now","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:29.632571Z"},"links":{"cited_paper":"/paper/2308.03825","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:dd0099857d9082545199520dbfbb5651e9934abd8f1c118145d3757b5989038e","observation_id":"eb02cbac-84df-4a97-b20f-a9093090f566","resolution":{"observed_at":"2026-08-07T15:37:29.632571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16303","last_updated":"2025-05-22T06:56:51Z","snapshot_observed_at":"2026-08-07T15:01:33.906225Z","submitted_at":"2025-05-22T06:56:51Z","title":"INFERENCEDYNAMICS: Efficient Routing Across LLMs through Structured Capability and Knowledge Profiling","version":1},"cited_work":{"arxiv_id":"2505.16303","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.16303","snapshot_observed_at":"2026-08-07T15:37:32.300110Z","title":"INFERENCEDYNAMICS: Efficient Routing Across LLMs through Structured Capability and Knowledge Profiling","venue":"cs.CL","work_id":"0ea7b769-5dbc-48fe-bea5-e479e45301dc","year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:29.724188Z"},"links":{"cited_paper":"/paper/2505.16303","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:cea61f918df1f224898104593436313ccad04503b0a55b07b2366c7b173032ba","observation_id":"c1636e9e-1bc9-45b0-b391-92f2a876e4e8","resolution":{"observed_at":"2026-08-07T15:37:32.326115Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1610.05820","last_updated":"2017-03-31T22:17:07Z","snapshot_observed_at":"2026-07-06T05:15:08.120372Z","submitted_at":"2016-10-18T22:38:33Z","title":"Membership Inference Attacks against Machine Learning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.05820","snapshot_observed_at":"2026-08-07T15:37:29.827094Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:29.827094Z"},"links":{"cited_paper":"/paper/1610.05820","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:13ddb4829afb467b7fc3e56feb05a891a6a56790f8463c7839ef761c07a63aca","observation_id":"4c6097ab-0a34-4a5b-9dee-9d50b7b73b76","resolution":{"observed_at":"2026-08-07T15:37:29.827094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2409.03735","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:32.125970Z","title":null,"venue":null,"work_id":"db990fb2-41c5-4267-9c12-75fc1a7da181","year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:29.969859Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:b219d5a113a16a332f1d2f58faa15ccde74bcbbfc68813f33ce76b3f420895de","observation_id":"fa043073-fcc7-4bcc-a37c-2c236a655372","resolution":{"observed_at":"2026-08-07T15:37:32.205258Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03691","last_updated":"2017-11-24T01:00:57Z","snapshot_observed_at":"2026-08-07T21:20:30.975264Z","submitted_at":"2017-06-09T16:26:49Z","title":"Certified Defenses for Data Poisoning Attacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03691","snapshot_observed_at":"2026-08-07T15:37:30.109588Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:30.109588Z"},"links":{"cited_paper":"/paper/1706.03691","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:c377931a3d9675b6a9b38238f9d9ccb7699dc90a6e4e2b224c2eb193d6040ded","observation_id":"6d6c5988-c25c-4d7a-9a8e-699ac05660b6","resolution":{"observed_at":"2026-08-07T15:37:30.109588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.08432","last_updated":"2020-08-11T19:10:13Z","snapshot_observed_at":"2026-08-06T12:49:28.976255Z","submitted_at":"2020-07-16T16:16:57Z","title":"Data Poisoning Attacks Against Federated Learning Systems","version":2},"cited_work":{"arxiv_id":"2007.08432","doi":null,"metadata_source":"pith","pith_arxiv_id":"2007.08432","snapshot_observed_at":"2026-08-07T15:37:31.898373Z","title":"Data Poisoning Attacks Against Federated Learning Systems","venue":"cs.LG","work_id":"df295801-8864-4b66-8266-503b1d5d5331","year":2020},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:30.222364Z"},"links":{"cited_paper":"/paper/2007.08432","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:49e064494a4e2b9793bcf32a880f02345c3ab92993f522ce4bfd4949831eefba","observation_id":"a820e140-31ed-415a-bd95-f9abb0ac5a3b","resolution":{"observed_at":"2026-08-07T15:37:31.937855Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T15:37:30.290138Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:30.290138Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:03e4493690ca03e86fd1f2fb8e4454bbf7e23270188ee9e50c53b66797800757","observation_id":"b1eb8f5e-018f-4d87-a30f-b8e88e93bda9","resolution":{"observed_at":"2026-08-07T15:37:30.290138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:30.379542Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:30.379542Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:94232ef79af84f8e8d13f6b766e7571212076ff49288ffa5956e103c8910e62e","observation_id":"a4b6069e-05b6-4e2b-b0f4-b60cb5c7be29","resolution":{"observed_at":"2026-08-07T15:37:30.379542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08935","last_updated":"2024-02-19T14:07:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-14T13:41:54Z","title":"Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08935","snapshot_observed_at":"2026-08-07T15:37:30.498244Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:30.498244Z"},"links":{"cited_paper":"/paper/2312.08935","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:b36bc5fb425d6893a4c48a53b90fa84c9f2330f20f80d7dca8244c5b40ee0e4f","observation_id":"1fbee1af-5bd7-48d0-a783-857fd091681a","resolution":{"observed_at":"2026-08-07T15:37:30.498244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15589","last_updated":"2024-11-01T16:39:36Z","snapshot_observed_at":"2026-08-05T10:26:07.839736Z","submitted_at":"2024-05-24T14:20:09Z","title":"Efficient Adversarial Training in LLMs with Continuous Attacks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15589","snapshot_observed_at":"2026-08-07T15:37:30.568678Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:30.568678Z"},"links":{"cited_paper":"/paper/2405.15589","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:6e669e625c1f8970e74c7da3c3325f8668bb85ad5ed81110c0d0990d2d94eb7e","observation_id":"bbcee3d7-8de2-4d4f-a310-df21ca0b17e2","resolution":{"observed_at":"2026-08-07T15:37:30.568678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07864","last_updated":"2023-09-19T08:29:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-14T17:12:03Z","title":"The Rise and Potential of Large Language Model Based Agents: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07864","snapshot_observed_at":"2026-08-07T15:37:30.637518Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:30.637518Z"},"links":{"cited_paper":"/paper/2309.07864","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:efd8d4accac385fc5df272f344ef6b4246213b286a6fb48be874cf311fb90280","observation_id":"90cd7ff6-f1eb-4947-b4cd-1eaf29f02015","resolution":{"observed_at":"2026-08-07T15:37:30.637518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14768","last_updated":"2025-02-20T17:49:26Z","snapshot_observed_at":"2026-08-04T12:32:53.090165Z","submitted_at":"2025-02-20T17:49:26Z","title":"Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14768","snapshot_observed_at":"2026-08-07T15:37:30.734019Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:30.734019Z"},"links":{"cited_paper":"/paper/2502.14768","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:fe126ae5dda73df887e98be0f7b81e2139704051545cba8326dd971f9a72bb46","observation_id":"69f8b6ff-4719-4c93-b8b6-64d6c4e0eca4","resolution":{"observed_at":"2026-08-07T15:37:30.734019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:30.835377Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:30.835377Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:6fd59c6d4e15e198c90ca07ecad062225b3ac635918e0d376945112dcb1a9fea","observation_id":"04bd2685-fe14-4ac5-a7de-b0ab2e454d5e","resolution":{"observed_at":"2026-08-07T15:37:30.835377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:30.925687Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:30.925687Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:add9217631f3b23b8e5e87906a1efb9a4e92a56bcb039266d9ea8355354f530e","observation_id":"39ef9557-10bf-46a0-a162-fdd838650712","resolution":{"observed_at":"2026-08-07T15:37:30.925687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02790","last_updated":"2025-01-06T06:17:56Z","snapshot_observed_at":"2026-08-07T05:09:26.931291Z","submitted_at":"2025-01-06T06:17:56Z","title":"Segmenting Text and Learning Their Rewards for Improved RLHF in Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02790","snapshot_observed_at":"2026-08-07T15:37:31.014205Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:31.014205Z"},"links":{"cited_paper":"/paper/2501.02790","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:fb82451dd3c886e7c69642a685905747ca0c3f56645b35e3d795081fd7628321","observation_id":"c7e0e76c-dfb0-42dd-a0ac-40850cb5cca2","resolution":{"observed_at":"2026-08-07T15:37:31.014205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06500","last_updated":"2022-07-14T22:14:17Z","snapshot_observed_at":"2026-07-06T11:57:21.548494Z","submitted_at":"2021-10-13T05:15:00Z","title":"Differentially Private Fine-tuning of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06500","snapshot_observed_at":"2026-08-07T15:37:31.106379Z","title":"Inan, Gautam Kamath, Janardhan Kulkarni, Yin Tat Lee, Andre Manoel, Lukas Wutschitz, Sergey Yekhanin, and Huishuai Zhang","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:31.106379Z"},"links":{"cited_paper":"/paper/2110.06500","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:4499993f264ca6f3419937f83ce255a2c4cb925d6e308fc484d81a1e6ce5f4df","observation_id":"bde7067d-2eb5-44ca-bf9c-a58bf81fefe1","resolution":{"observed_at":"2026-08-07T15:37:31.106379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:31.194994Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:31.194994Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:0745d8a6ea41d5778f2d89b0bbaa44148ce9dfffec1dc062b1810cb22b664ec3","observation_id":"fd6fddfe-7dd6-4593-9f8e-389c59ea9d33","resolution":{"observed_at":"2026-08-07T15:37:31.194994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-07T15:37:31.261817Z","title":"Zico Kolter, and Matt Fredrikson","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:31.261817Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:00ed9b9e0bbe2daf3f23e44085d39ba230267837c6c3dacc085f1ac81aef8568","observation_id":"97a2a604-06e6-4a7c-ba26-a760461be9bd","resolution":{"observed_at":"2026-08-07T15:37:31.261817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:31.367911Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:31.367911Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:d600e2a7501505f494722527935d29dc9d28483c590d01f3eec263e8c32625c4","observation_id":"1563a4df-d57c-4a8b-a89d-2a75f427ff5f","resolution":{"observed_at":"2026-08-07T15:37:31.367911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:31.442193Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:31.442193Z"},"links":{"citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:89324a92d92a802ee8851beb34d1da0189038f4021f95fbcf62330648b8da32f","observation_id":"2c0c20cf-47b3-4045-9497-cdbe27181b09","resolution":{"observed_at":"2026-08-07T15:37:31.442193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T21:21:35.164318Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":60,"verified_exact":5,"verified_fuzzy":0},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 2 inbound Pith citation observations for arXiv:2505.14585."}