{"as_of":"2026-08-08T13:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8dbc64530f35caa272b8e1647765fc7441dbac0c42f2d07bd5bcdccb72440924","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:37:06.683217Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T10:46:17.055047Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.05209","last_updated":"2025-07-24T21:34:54Z","snapshot_observed_at":"2026-07-06T20:33:01.960703Z","submitted_at":"2025-02-03T18:59:16Z","title":"Model Tampering Attacks Enable More Rigorous Evaluations of LLM Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05209","snapshot_observed_at":"2026-08-07T04:37:06.683217Z","title":"Zora Che, Stephen Casper, Robert Kirk, Anirudh Satheesh, Stewart Slocum, Lev E","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10236","last_updated":"2025-08-14T05:03:53Z","snapshot_observed_at":"2026-08-08T09:47:01.651509Z","submitted_at":"2025-06-11T23:36:30Z","title":"Prompt Attacks Reveal Superficial Knowledge Removal in Unlearning Methods","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T04:37:06.683217Z"},"links":{"cited_paper":"/paper/2502.05209","citing_paper":"/paper/2506.10236"},"observation_digest":"sha256:f7e1eefa60783c714dddf66fa9cab798cbee32a820df7c7c5ea5e5f5e0ce3c08","observation_id":"9ac562e3-c5b1-46c0-8e04-7102890168a9","resolution":{"observed_at":"2026-08-07T04:37:06.683217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05209","last_updated":"2025-07-24T21:34:54Z","snapshot_observed_at":"2026-07-06T20:33:01.960703Z","submitted_at":"2025-02-03T18:59:16Z","title":"Model Tampering Attacks Enable More Rigorous Evaluations of LLM Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05209","snapshot_observed_at":"2026-08-04T23:10:21.212266Z","title":"Model tampering attacks enable more rigorous evaluations of llm capabilities,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06795","last_updated":"2025-09-08T15:24:33Z","snapshot_observed_at":"2026-08-06T11:18:33.345942Z","submitted_at":"2025-09-08T15:24:33Z","title":"Anchoring Refusal Direction: Mitigating Safety Risks in Tuning via Projection Constraint","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T23:10:21.212266Z"},"links":{"cited_paper":"/paper/2502.05209","citing_paper":"/paper/2509.06795"},"observation_digest":"sha256:634bc1551f73e1f763aa47b90347bdc2ffe1ff2e809e4fa04c64fe85fc063403","observation_id":"5b691c14-d0ac-4408-84b3-1a983d3c9287","resolution":{"observed_at":"2026-08-04T23:10:21.212266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05209","last_updated":"2025-07-24T21:34:54Z","snapshot_observed_at":"2026-07-06T20:33:01.960703Z","submitted_at":"2025-02-03T18:59:16Z","title":"Model Tampering Attacks Enable More Rigorous Evaluations of LLM Capabilities","version":4},"cited_work":{"arxiv_id":"2502.05209","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05209","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Model tampering attacks enable more rigorous evaluations of llm capabilities","venue":null,"work_id":"77e8b969-5539-43b7-8791-064456162179","year":2025},"citing_paper":{"arxiv_id":"2510.00761","last_updated":"2026-04-18T07:30:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-01T10:50:14Z","title":"Downgrade to Upgrade: Optimizer Simplification Enhances Robustness in LLM Unlearning","version":5},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-18T10:44:53.516653Z"},"links":{"cited_paper":"/paper/2502.05209","citing_paper":"/paper/2510.00761"},"observation_digest":"sha256:4e45974336208e81d6818ecba95467e7178c98af4fa42ba388daf951506fc8d6","observation_id":"0abc5024-ef5d-4655-95da-9c9b68ade291","resolution":{"observed_at":"2026-05-18T10:46:17.058220Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05209","last_updated":"2025-07-24T21:34:54Z","snapshot_observed_at":"2026-07-06T20:33:01.960703Z","submitted_at":"2025-02-03T18:59:16Z","title":"Model Tampering Attacks Enable More Rigorous Evaluations of LLM Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05209","snapshot_observed_at":"2026-08-03T18:41:33.209039Z","title":"Model tampering attacks enable more rigorous evaluations of llm capabilities.arXiv preprint arXiv:2502.05209, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.04144","last_updated":"2026-07-14T05:13:06Z","snapshot_observed_at":"2026-08-08T13:08:29.843209Z","submitted_at":"2025-12-03T18:57:59Z","title":"RippleBench: Capturing Ripple Effects Using Existing Knowledge Repositories","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T18:41:33.209039Z"},"links":{"cited_paper":"/paper/2502.05209","citing_paper":"/paper/2512.04144"},"observation_digest":"sha256:cb717f8ca38167ad7a0fc4b00f6eee10766308f8d0aa0d28a78516b4ede2bd24","observation_id":"9195ab00-e824-41a4-9ef9-dd9eb8448c61","resolution":{"observed_at":"2026-08-03T18:41:33.209039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05209","last_updated":"2025-07-24T21:34:54Z","snapshot_observed_at":"2026-07-06T20:33:01.960703Z","submitted_at":"2025-02-03T18:59:16Z","title":"Model Tampering Attacks Enable More Rigorous Evaluations of LLM Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05209","snapshot_observed_at":"2026-08-03T19:59:01.358929Z","title":"E., Gandikota, R., Ewart, A., Rosati, D., Wu, Z., et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.11815","last_updated":"2026-05-23T23:07:49Z","snapshot_observed_at":"2026-08-03T19:58:58.153442Z","submitted_at":"2025-11-26T18:59:43Z","title":"Video Deepfake Abuse: How Company Choices Predictably Shape Misuse Patterns","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T19:59:01.358929Z"},"links":{"cited_paper":"/paper/2502.05209","citing_paper":"/paper/2512.11815"},"observation_digest":"sha256:7049e3fcd818a9ffed50b592a4a4250116421e279667672af13b5a6aef8931a5","observation_id":"5ba3b8fb-a6c3-43a7-8dbe-1d7aa8abb55a","resolution":{"observed_at":"2026-08-03T19:59:01.358929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05209","last_updated":"2025-07-24T21:34:54Z","snapshot_observed_at":"2026-07-06T20:33:01.960703Z","submitted_at":"2025-02-03T18:59:16Z","title":"Model Tampering Attacks Enable More Rigorous Evaluations of LLM Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05209","snapshot_observed_at":"2026-08-02T22:49:13.999922Z","title":"Brown, T., Mann, B., Ryder, N., Subbiah, M., Kaplan, J","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2602.15829","last_updated":"2026-06-08T15:32:04Z","snapshot_observed_at":"2026-08-08T10:24:00.819062Z","submitted_at":"2026-02-17T18:59:39Z","title":"Operationalising the Superficial Alignment Hypothesis via Task Complexity","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T22:49:13.999922Z"},"links":{"cited_paper":"/paper/2502.05209","citing_paper":"/paper/2602.15829"},"observation_digest":"sha256:1f9958fffaec544d27fe45a98b662c4486d635eebf5a387ea0f2397360b9922f","observation_id":"735466bb-16e9-47f0-ad25-d74394d5c890","resolution":{"observed_at":"2026-08-02T22:49:13.999922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05209","last_updated":"2025-07-24T21:34:54Z","snapshot_observed_at":"2026-07-06T20:33:01.960703Z","submitted_at":"2025-02-03T18:59:16Z","title":"Model Tampering Attacks Enable More Rigorous Evaluations of LLM Capabilities","version":4},"cited_work":{"arxiv_id":"2502.05209","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05209","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Model tampering attacks enable more rigorous evaluations of llm capabilities","venue":null,"work_id":"77e8b969-5539-43b7-8791-064456162179","year":2025},"citing_paper":{"arxiv_id":"2604.03121","last_updated":"2026-04-03T15:45:35Z","snapshot_observed_at":"2026-07-06T22:52:20.577677Z","submitted_at":"2026-04-03T15:45:35Z","title":"An Independent Safety Evaluation of Kimi K2.5","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-13T19:38:18.674355Z"},"links":{"cited_paper":"/paper/2502.05209","citing_paper":"/paper/2604.03121"},"observation_digest":"sha256:13f07c5214e9f3b293f0e15ebf94e7a3443dfc69b0a24607deebea3c6f507957","observation_id":"9f63ce60-b49b-432b-94be-3091cd96bea2","resolution":{"observed_at":"2026-05-13T19:43:11.577719Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05209","last_updated":"2025-07-24T21:34:54Z","snapshot_observed_at":"2026-07-06T20:33:01.960703Z","submitted_at":"2025-02-03T18:59:16Z","title":"Model Tampering Attacks Enable More Rigorous Evaluations of LLM Capabilities","version":4},"cited_work":{"arxiv_id":"2502.05209","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05209","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Model tampering attacks enable more rigorous evaluations of llm capabilities","venue":null,"work_id":"77e8b969-5539-43b7-8791-064456162179","year":2025},"citing_paper":{"arxiv_id":"2604.07962","last_updated":"2026-04-09T08:24:52Z","snapshot_observed_at":"2026-07-06T22:57:09.435331Z","submitted_at":"2026-04-09T08:24:52Z","title":"Is your algorithm unlearning or untraining?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T18:06:08.962042Z"},"links":{"cited_paper":"/paper/2502.05209","citing_paper":"/paper/2604.07962"},"observation_digest":"sha256:2a4bb3a47835fd5a8ff1f552ef7dd02ad219584df762f64a08cf785437e3c84a","observation_id":"ec539424-962b-4ec3-b385-e3a4912b5b1d","resolution":{"observed_at":"2026-05-11T05:30:59.104808Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.05209/citation-record","integrity":"/paper/2502.05209/integrity","json":"/paper/2502.05209/citation-record.json","paper":"/paper/2502.05209"},"outbound":[],"paper":{"arxiv_id":"2502.05209","last_updated":"2025-07-24T21:34:54Z","latest_version":4,"primary_category":"cs.CR","snapshot_observed_at":"2026-07-06T20:33:01.960703Z","submitted_at":"2025-02-03T18:59:16Z","title":"Model Tampering Attacks Enable More Rigorous Evaluations of LLM Capabilities"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2502.05209."}