{"as_of":"2026-08-21T14:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bea68ea9072dbbe38087065d6a7a0799fee0362fb56997a3f6ec7756d1def89b","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":26,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:58:23.401769Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":8,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":"2406.02622","doi":"10.48550/arxiv.2406.02622","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Safeguarding large language models: A survey","venue":"arXiv (Cornell University)","work_id":"03ccacc8-ea7f-4307-95dd-b8856abe3324","year":2024},"citing_paper":{"arxiv_id":"2409.18169","last_updated":"2026-04-23T18:48:49Z","snapshot_observed_at":"2026-08-14T15:55:00.676298Z","submitted_at":"2024-09-26T17:55:22Z","title":"Harmful Fine-tuning Attacks and Defenses for Large Language Models: A Survey","version":6},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-23T20:58:16.237327Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2409.18169"},"observation_digest":"sha256:ff20a7576eb5603f7869aea5e1c94fa0ad7d5d145efaa6aab25944f395e00998","observation_id":"ea39e46d-0ebf-4b3c-93e8-b8b0a6da34fe","resolution":{"observed_at":"2026-05-23T20:58:25.775933Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-12T21:54:43.918501Z","title":"Safeguarding la rge language models: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:43.918501Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:9874e1d0f1fe851076fdcc30bff28d6f5ac0cbe148e67c7ed6ce4eb85d5c03ae","observation_id":"cb7f38ab-7832-4f35-845e-3c7167ec926e","resolution":{"observed_at":"2026-08-12T21:54:43.918501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-12T17:05:25.192147Z","title":"Safeguarding large language models: A survey, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12946","last_updated":"2025-04-09T08:59:26Z","snapshot_observed_at":"2026-08-15T13:35:40.325298Z","submitted_at":"2024-11-20T00:31:23Z","title":"A Flexible Large Language Models Guardrail Development Methodology Applied to Off-Topic Prompt Detection","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:25.192147Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2411.12946"},"observation_digest":"sha256:7a82f6140b19d405d2170b074c0662e5cfe64b5bf5a076a951cba96a66330334","observation_id":"48ebb702-e662-4876-b6cc-c828a4ae7860","resolution":{"observed_at":"2026-08-12T17:05:25.192147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-10T13:53:10.933726Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18626","last_updated":"2025-05-31T11:52:11Z","snapshot_observed_at":"2026-08-19T15:38:33.580340Z","submitted_at":"2025-01-27T12:48:47Z","title":"The TIP of the Iceberg: Revealing a Hidden Class of Task-in-Prompt Adversarial Attacks on LLMs","version":4},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T13:53:10.933726Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2501.18626"},"observation_digest":"sha256:25e6a30814d73204132454e0bc5aec1ae1ed04788aeffcbb9c5d0da32661cfb3","observation_id":"c8989374-b901-4edf-9035-23c83495dff9","resolution":{"observed_at":"2026-08-10T13:53:10.933726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-08T11:20:48.457016Z","title":"Safeguarding Large Language Models: A Survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07956","last_updated":"2025-02-11T21:09:24Z","snapshot_observed_at":"2026-08-20T04:39:09.418555Z","submitted_at":"2025-02-11T21:09:24Z","title":"Bridging HCI and AI Research for the Evaluation of Conversational SE Assistants","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T11:20:48.457016Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2502.07956"},"observation_digest":"sha256:7c34bd2e1311d94fe07d522e17885ffd4aa31f35ae90ab93b36b1bf20bdc9da1","observation_id":"32d914df-89e9-4282-a656-032a9425cd88","resolution":{"observed_at":"2026-08-08T11:20:48.457016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":"2406.02622","doi":"10.48550/arxiv.2406.02622","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Safeguarding large language models: A survey","venue":"arXiv (Cornell University)","work_id":"03ccacc8-ea7f-4307-95dd-b8856abe3324","year":2024},"citing_paper":{"arxiv_id":"2503.18666","last_updated":"2025-07-31T04:00:48Z","snapshot_observed_at":"2026-08-13T11:09:53.274921Z","submitted_at":"2025-03-24T13:31:48Z","title":"AgentSpec: Customizable Runtime Enforcement for Safe and Reliable LLM Agents","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-14T21:24:32.615129Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2503.18666"},"observation_digest":"sha256:da42d7987b3fdab3b27c3f83a0a7c5194519395db8f514d63be63419ed3296ac","observation_id":"598a2eba-0a84-4d01-901b-00357cb2ee92","resolution":{"observed_at":"2026-05-14T21:24:32.636615Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-16T11:58:23.401769Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14212","last_updated":"2025-09-03T03:06:20Z","snapshot_observed_at":"2026-08-19T20:07:46.894930Z","submitted_at":"2025-04-19T07:36:02Z","title":"Bias Analysis and Mitigation through Protected Attribute Detection and Regard Classification","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-16T11:58:23.401769Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2504.14212"},"observation_digest":"sha256:e62585976a504b77bffadf888184a2c03144a2c560d0e7dc7735f420a24027c6","observation_id":"18cf9d4e-b37d-4332-9ad9-c8d27532a5c4","resolution":{"observed_at":"2026-08-16T11:58:23.401769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-16T11:24:12.103750Z","title":"Safeguarding large language models: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15585","last_updated":"2025-06-09T02:36:20Z","snapshot_observed_at":"2026-08-17T21:55:02.668814Z","submitted_at":"2025-04-22T05:02:49Z","title":"A Comprehensive Survey in LLM(-Agent) Full Stack Safety: Data, Training and Deployment","version":4},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T11:24:12.103750Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2504.15585"},"observation_digest":"sha256:399628408bc4b94c5979766be608a8ddfddadf8e8bd04a26adb5c105643774d1","observation_id":"9b5100ce-d1a3-468b-a8c3-d0c10efc8503","resolution":{"observed_at":"2026-08-16T11:24:12.103750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-15T20:41:29.119914Z","title":"arXiv:2406.02622 [cs.CR] https://arxiv.org/abs/2406.02622","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.12287","last_updated":"2025-05-18T07:51:19Z","snapshot_observed_at":"2026-08-16T15:35:30.606101Z","submitted_at":"2025-05-18T07:51:19Z","title":"The Tower of Babel Revisited: Multilingual Jailbreak Prompts on Closed-Source Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:29.119914Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2505.12287"},"observation_digest":"sha256:20c0fbcd3fda4cf26ad305199af485749d8a204c795d9a840160614e13049e52","observation_id":"5123397a-c1c2-43cf-9d1c-94c9042bd145","resolution":{"observed_at":"2026-08-15T20:41:29.119914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":"2406.02622","doi":"10.48550/arxiv.2406.02622","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Safeguarding large language models: A survey","venue":"arXiv (Cornell University)","work_id":"03ccacc8-ea7f-4307-95dd-b8856abe3324","year":2024},"citing_paper":{"arxiv_id":"2505.16120","last_updated":"2026-05-04T12:54:07Z","snapshot_observed_at":"2026-08-15T05:11:46.464906Z","submitted_at":"2025-05-22T01:52:15Z","title":"LLM-Powered AI Agent Systems and Their Applications in Industry","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-22T14:05:54.535411Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2505.16120"},"observation_digest":"sha256:968bc0fbb1adf7d9e13085073f29ed64eb4e592b4c8571a67a7da9e6b1260a75","observation_id":"c81138ce-edf2-4b90-98d0-f3cdb4f2ae42","resolution":{"observed_at":"2026-05-22T14:06:37.983709Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-07T13:17:52.423688Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05368","last_updated":"2025-05-28T09:13:41Z","snapshot_observed_at":"2026-08-13T16:23:56.745186Z","submitted_at":"2025-05-28T09:13:41Z","title":"Speaking images. A novel framework for the automated self-description of artworks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:52.423688Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2506.05368"},"observation_digest":"sha256:9ed7e1f0fc2ea79f207d160fce933eb6c7296196515ba01a1c8e94c33f481a9e","observation_id":"54620ad4-529f-4d99-a217-a596124b7f88","resolution":{"observed_at":"2026-08-07T13:17:52.423688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-07T05:42:43.574246Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07211","last_updated":"2025-06-08T16:24:11Z","snapshot_observed_at":"2026-08-18T15:47:08.150849Z","submitted_at":"2025-06-08T16:24:11Z","title":"Sword and Shield: Uses and Strategies of LLMs in Navigating Disinformation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:42:43.574246Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2506.07211"},"observation_digest":"sha256:cbd0f780b9e4c4b28b4223a4d221661936dd33d23ef814c9876912585079b38d","observation_id":"da8bb34e-cc54-471c-ac13-dcc80ec6eb27","resolution":{"observed_at":"2026-08-07T05:42:43.574246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-06T22:23:08.161276Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22521","last_updated":"2025-06-26T22:02:01Z","snapshot_observed_at":"2026-08-17T10:14:30.703303Z","submitted_at":"2025-06-26T22:02:01Z","title":"A Survey on Model Extraction Attacks and Defenses for Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T22:23:08.161276Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2506.22521"},"observation_digest":"sha256:73679e9fae5c3cc721994b07f216d28359aabf8ee8c666ed3ac516e1ee1cf38e","observation_id":"f027d4f4-8682-4088-8642-ca1e89009efc","resolution":{"observed_at":"2026-08-06T22:23:08.161276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-06T21:54:43.406674Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23111","last_updated":"2025-06-29T06:31:06Z","snapshot_observed_at":"2026-08-16T16:30:47.734438Z","submitted_at":"2025-06-29T06:31:06Z","title":"FairI Tales: Evaluation of Fairness in Indian Contexts with a Focus on Bias and Stereotypes","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T21:54:43.406674Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2506.23111"},"observation_digest":"sha256:7a2c12254960b1d0f0424170a066cb73cc4dfa28968d2a1f2a34b9b79e43d9ab","observation_id":"8f15604c-bf97-45e0-9a35-44986b27c7d8","resolution":{"observed_at":"2026-08-06T21:54:43.406674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-06T20:00:41.256371Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04105","last_updated":"2025-07-05T17:26:08Z","snapshot_observed_at":"2026-08-16T09:30:39.986580Z","submitted_at":"2025-07-05T17:26:08Z","title":"Enhancing Robustness of LLM-Driven Multi-Agent Systems through Randomized Smoothing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:00:41.256371Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2507.04105"},"observation_digest":"sha256:b0a93625daec89b50ebad27c5ea285d98451ae2a4b37906032f30577ae73f725","observation_id":"8fa32afa-929e-42f6-bd85-521963fd7ed4","resolution":{"observed_at":"2026-08-06T20:00:41.256371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-05T10:39:08.229433Z","title":"Safeguarding large language models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03871","last_updated":"2025-09-04T04:12:31Z","snapshot_observed_at":"2026-08-17T17:37:38.616375Z","submitted_at":"2025-09-04T04:12:31Z","title":"A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models","version":1},"reference_index":269,"source":"pdf_text","source_observed_at":"2026-08-05T10:39:08.229433Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2509.03871"},"observation_digest":"sha256:43f5d08536251eeda2dbd1c1934bf59fb0168b65d64d6221ffc3eda4ddc2d4d1","observation_id":"e9c870e8-2021-488e-9b6a-bae749d1296d","resolution":{"observed_at":"2026-08-05T10:39:08.229433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-04T09:55:53.383379Z","title":"URL:http://arxiv.org/abs/2406.02622, doi:https://doi.org/10.48550/arXiv.2406.02622","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.12993","last_updated":"2026-07-27T14:02:49Z","snapshot_observed_at":"2026-08-16T12:30:23.271372Z","submitted_at":"2025-10-14T21:10:50Z","title":"Tailored untruths: How personalisation challenges LLM safeguards","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T09:55:53.383379Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2510.12993"},"observation_digest":"sha256:e9ce737b1288a154fd8df2bb70ebb6a3a67d896fadf434a376e31b949063a32f","observation_id":"07fa4d6f-25a8-460a-b643-a0350afdd30e","resolution":{"observed_at":"2026-08-04T09:55:53.383379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-04T09:40:44.396113Z","title":"arXiv:2406.02622 [cs.CR] https://arxiv.org/abs/2406.02622","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.14207","last_updated":"2026-06-29T03:28:16Z","snapshot_observed_at":"2026-08-13T07:44:10.852942Z","submitted_at":"2025-10-16T01:27:44Z","title":"Echoes of Human Malice in Agents: Benchmarking LLMs for Multi-Turn Online Harassment Attacks","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T09:40:44.396113Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2510.14207"},"observation_digest":"sha256:0a3cf9f1cc440232dcb77714d6375b3f1d252652d4a83cffefa1ada54d96f94b","observation_id":"6d02c81b-ab5d-4824-b7ca-8f7de9a736ae","resolution":{"observed_at":"2026-08-04T09:40:44.396113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":"2406.02622","doi":"10.48550/arxiv.2406.02622","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Safeguarding large language models: A survey","venue":"arXiv (Cornell University)","work_id":"03ccacc8-ea7f-4307-95dd-b8856abe3324","year":2024},"citing_paper":{"arxiv_id":"2512.05929","last_updated":"2026-06-29T18:18:24Z","snapshot_observed_at":"2026-08-16T07:11:14.391624Z","submitted_at":"2025-12-05T18:12:21Z","title":"LLM Harms: A Taxonomy and Discussion","version":2},"reference_index":214,"source":"pdf_text","source_observed_at":"2026-05-17T00:29:07.951709Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2512.05929"},"observation_digest":"sha256:8ad9695420a80a387b8c1459399aac97d1b82eb53fe185fb5367ec8958e7d293","observation_id":"f6d173ed-a532-47f8-91c3-80d4f1d2d754","resolution":{"observed_at":"2026-05-17T00:31:24.867780Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-03T18:19:30.420092Z","title":"Safeguarding Large Language Models: A Survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.05929","last_updated":"2026-06-29T18:18:24Z","snapshot_observed_at":"2026-08-16T07:11:14.391624Z","submitted_at":"2025-12-05T18:12:21Z","title":"LLM Harms: A Taxonomy and Discussion","version":4},"reference_index":214,"source":"pdf_text","source_observed_at":"2026-08-03T18:19:30.420092Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2512.05929"},"observation_digest":"sha256:fabb85d1df9a6b42121d675b349cce9edd6da06a0046111308e299eba4377422","observation_id":"d286cf62-9298-42e4-92d1-666116b4b6cc","resolution":{"observed_at":"2026-08-03T18:19:30.420092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":"2406.02622","doi":"10.48550/arxiv.2406.02622","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Safeguarding large language models: A survey","venue":"arXiv (Cornell University)","work_id":"03ccacc8-ea7f-4307-95dd-b8856abe3324","year":2024},"citing_paper":{"arxiv_id":"2602.07954","last_updated":"2026-04-20T08:43:04Z","snapshot_observed_at":"2026-08-14T21:32:16.633611Z","submitted_at":"2026-02-08T12:57:04Z","title":"Bielik Guard: Efficient Polish Language Safety Classifiers for LLM Content Moderation","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T06:07:23.060966Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2602.07954"},"observation_digest":"sha256:e0930a0814d2ffe25ee88d9b40bbdf773216d1903bcf9abba9c05e820692c4bf","observation_id":"0ee03ff2-c705-4cca-9977-da9ffb59cd7a","resolution":{"observed_at":"2026-05-16T06:07:25.577605Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":"2406.02622","doi":"10.48550/arxiv.2406.02622","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Safeguarding large language models: A survey","venue":"arXiv (Cornell University)","work_id":"03ccacc8-ea7f-4307-95dd-b8856abe3324","year":2024},"citing_paper":{"arxiv_id":"2604.05229","last_updated":"2026-04-06T22:49:28Z","snapshot_observed_at":"2026-08-12T17:47:23.301971Z","submitted_at":"2026-04-06T22:49:28Z","title":"From Governance Norms to Enforceable Controls: A Layered Translation Method for Runtime Guardrails in Agentic AI","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T18:47:09.928166Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2604.05229"},"observation_digest":"sha256:7fd87c577965bcd2ab62d8618dcaaea80e7a7c51d1fe811bc927e36308bb5052","observation_id":"5c35d94a-549e-41a0-9f55-5b1c394d7d25","resolution":{"observed_at":"2026-05-10T23:55:51.825116Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":"2406.02622","doi":"10.48550/arxiv.2406.02622","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Safeguarding large language models: A survey","venue":"arXiv (Cornell University)","work_id":"03ccacc8-ea7f-4307-95dd-b8856abe3324","year":2024},"citing_paper":{"arxiv_id":"2604.07655","last_updated":"2026-04-08T23:47:29Z","snapshot_observed_at":"2026-08-02T09:41:13.361711Z","submitted_at":"2026-04-08T23:47:29Z","title":"Guardian-as-an-Advisor: Advancing Next-Generation Guardian Models for Trustworthy LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T17:27:13.339411Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2604.07655"},"observation_digest":"sha256:fe8bea20c61d5d2834ae26ffe027b4983011a7927a39069757817e763cb20d13","observation_id":"c6dca80f-bd59-46b3-87fd-a703bcd64c11","resolution":{"observed_at":"2026-05-11T06:46:39.524396Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":"2406.02622","doi":"10.48550/arxiv.2406.02622","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Safeguarding large language models: A survey","venue":"arXiv (Cornell University)","work_id":"03ccacc8-ea7f-4307-95dd-b8856abe3324","year":2024},"citing_paper":{"arxiv_id":"2605.31073","last_updated":"2026-05-29T09:42:08Z","snapshot_observed_at":"2026-08-14T22:18:46.997625Z","submitted_at":"2026-05-29T09:42:08Z","title":"ConsisGuard: Aligning Safety Deliberation with Policy Enforcement in LLM Guardrails","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-28T23:03:01.151745Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2605.31073"},"observation_digest":"sha256:f1d03354d6ff81c259e986694f5f6059d001ceafe3d08cbb0496edabfcfd89fa","observation_id":"02fddf65-530a-41fb-8964-d3f1aab5b460","resolution":{"observed_at":"2026-06-28T23:12:46.492824Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-02T07:06:19.372134Z","title":"Safeguarding large language models: A survey, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13078","last_updated":"2026-07-12T22:34:02Z","snapshot_observed_at":"2026-08-09T02:07:52.896888Z","submitted_at":"2026-07-12T22:34:02Z","title":"Operational Evidence Gaps for LLMs in Fraud Detection and Trust-and-Safety Workflows","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T07:06:19.372134Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2607.13078"},"observation_digest":"sha256:5691fde6653250b8483a16665abceacd43563844008041d347f28f5fb3a579b6","observation_id":"9945c231-4833-45d2-801a-6200a58d1a14","resolution":{"observed_at":"2026-08-02T07:06:19.372134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02622","snapshot_observed_at":"2026-08-15T14:21:41.957376Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10530","last_updated":"2026-08-11T06:11:26Z","snapshot_observed_at":"2026-08-21T14:32:23.610712Z","submitted_at":"2026-08-11T06:11:26Z","title":"On Understanding, Identifying, and Mitigating Vulnerabilities in Agentic Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T14:21:41.957376Z"},"links":{"cited_paper":"/paper/2406.02622","citing_paper":"/paper/2608.10530"},"observation_digest":"sha256:5b1f15031a07f3e7bcb08732927464f16204bc96477db828e2e6bcf6eb6cab8f","observation_id":"692f1e92-cfde-4121-a3b6-811b0bb08bd2","resolution":{"observed_at":"2026-08-15T14:21:41.957376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.02622/citation-record","integrity":"/paper/2406.02622/integrity","json":"/paper/2406.02622/citation-record.json","paper":"/paper/2406.02622"},"outbound":[],"paper":{"arxiv_id":"2406.02622","last_updated":"2024-06-03T19:27:46Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-19T03:06:14.133584Z","submitted_at":"2024-06-03T19:27:46Z","title":"Safeguarding Large Language Models: A Survey"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 26 inbound Pith citation observations for arXiv:2406.02622."}