{"as_of":"2026-08-19T06:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7d71ffd67911e486508fa3f7356445e6f2b0b2583e94c0fa6b2a87824c4f86ed","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":35,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T10:20:46.651107Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":12,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.01822","doi":"10.48550/arxiv.2402.01822","metadata_source":"pith","pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Building guardrails for large language models","venue":"cs.CL","work_id":"5bf683de-2e80-45b1-a579-415ba56a7de1","year":2024},"citing_paper":{"arxiv_id":"2402.19173","last_updated":"2024-02-29T13:53:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-29T13:53:35Z","title":"StarCoder 2 and The Stack v2: The Next Generation","version":1},"reference_index":196,"source":"arxiv_source","source_observed_at":"2026-05-12T17:28:22.353355Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2402.19173"},"observation_digest":"sha256:310de83ddecc35e884add8d2de9e73f6a412117829474d5f70beb3d25782362f","observation_id":"e8548ce0-5563-4ae2-b06d-6cfce9f1131c","resolution":{"observed_at":"2026-05-12T17:28:22.690985Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-02T19:38:15.441579+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T19:38:15.441579+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-12T21:54:44.032244Z","title":"Building guardrails for large language mod els,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.08181","last_updated":"2024-12-04T16:55:18Z","snapshot_observed_at":"2026-08-14T11:20:53.014041Z","submitted_at":"2024-11-12T20:57:12Z","title":"Challenges in Guardrailing Large Language Models for Science","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T21:54:44.032244Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2411.08181"},"observation_digest":"sha256:1925b52331fdced72b5e8209cae7aee47c515422d31fcc9af6e7cd988e8f2691","observation_id":"f0513262-d87a-4f9b-8918-e4b95bd43a03","resolution":{"observed_at":"2026-08-12T21:54:44.032244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-11T21:52:52.338575Z","title":"Building guardrails for large language mode ls","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.04029","last_updated":"2024-12-05T10:05:53Z","snapshot_observed_at":"2026-08-14T09:16:00.714973Z","submitted_at":"2024-12-05T10:05:53Z","title":"Considerations Influencing Offense-Defense Dynamics From Artificial Intelligence","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T21:52:52.338575Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2412.04029"},"observation_digest":"sha256:0a237156e896aeb0776b506d3e68d7fd295bf43e8c6c297a0f908349dd0a1fcc","observation_id":"43f0954e-7294-4976-949f-fcf536852d1e","resolution":{"observed_at":"2026-08-11T21:52:52.338575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-10T22:19:35.863283Z","title":"L., Zheng, L., Sheng, Y., Angelopoulos, A","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2501.03266","last_updated":"2025-05-16T01:23:54Z","snapshot_observed_at":"2026-08-18T06:54:55.696801Z","submitted_at":"2025-01-04T06:36:44Z","title":"LLM Content Moderation and User Satisfaction: Evidence from Response Refusals in Chatbot Arena","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T22:19:35.863283Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2501.03266"},"observation_digest":"sha256:19c69fc83f32bcb772ef0e639e4d86b9ebf4b8e9cb00a9fa974ab192efc50654","observation_id":"9225d55d-acaf-4068-b031-94dc66779f43","resolution":{"observed_at":"2026-08-10T22:19:35.863283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-10T16:19:47.980860Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13302","last_updated":"2025-01-23T01:04:00Z","snapshot_observed_at":"2026-08-16T10:43:05.407066Z","submitted_at":"2025-01-23T01:04:00Z","title":"Watching the AI Watchdogs: A Fairness and Robustness Analysis of AI Safety Moderation Classifiers","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T16:19:47.980860Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2501.13302"},"observation_digest":"sha256:6eaaef62b758fc0b66d7170728c7f8dd9e0f7d39c8438a4a16c2dd5879769dff","observation_id":"fd54c1ef-1759-49df-99fb-9369e50a2a02","resolution":{"observed_at":"2026-08-10T16:19:47.980860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-10T13:53:10.930539Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18626","last_updated":"2025-05-31T11:52:11Z","snapshot_observed_at":"2026-08-17T19:23:27.552380Z","submitted_at":"2025-01-27T12:48:47Z","title":"The TIP of the Iceberg: Revealing a Hidden Class of Task-in-Prompt Adversarial Attacks on LLMs","version":4},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T13:53:10.930539Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2501.18626"},"observation_digest":"sha256:2c296fdd4b8371f505d325430c2a9ed10535f5a52e28ac46dc945e0da4fe23f2","observation_id":"e1bd78ad-d57e-4e45-a751-bbc4dda800c5","resolution":{"observed_at":"2026-08-10T13:53:10.930539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-09T19:32:34.214414Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00306","last_updated":"2025-06-30T16:37:59Z","snapshot_observed_at":"2026-08-17T19:54:13.581996Z","submitted_at":"2025-02-01T04:01:18Z","title":"Riddle Me This! Stealthy Membership Inference for Retrieval-Augmented Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T19:32:34.214414Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2502.00306"},"observation_digest":"sha256:f02ec71b43b0d48de5325c7caa9def5a05c47e6597e53a46f9be9f1b8e117877","observation_id":"8601cc05-8c12-40ad-970b-aa93445726d1","resolution":{"observed_at":"2026-08-09T19:32:34.214414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-16T10:20:46.651107Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18369","last_updated":"2025-04-25T14:11:42Z","snapshot_observed_at":"2026-08-18T10:03:42.402968Z","submitted_at":"2025-04-25T14:11:42Z","title":"ThreMoLIA: Threat Modeling of Large Language Model-Integrated Applications","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T10:20:46.651107Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2504.18369"},"observation_digest":"sha256:f93b7ead7be6ef757cdb6b249aa45dbfedf6928ccae168e0e1b1ff0d607969cb","observation_id":"16d85f67-27d2-4334-90fd-f219076de0d6","resolution":{"observed_at":"2026-08-16T10:20:46.651107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.01822","doi":"10.48550/arxiv.2402.01822","metadata_source":"pith","pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Building guardrails for large language models","venue":"cs.CL","work_id":"5bf683de-2e80-45b1-a579-415ba56a7de1","year":2024},"citing_paper":{"arxiv_id":"2505.16120","last_updated":"2026-05-04T12:54:07Z","snapshot_observed_at":"2026-08-15T05:11:46.464906Z","submitted_at":"2025-05-22T01:52:15Z","title":"LLM-Powered AI Agent Systems and Their Applications in Industry","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-22T14:05:54.535411Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2505.16120"},"observation_digest":"sha256:4837879a55ccc2dce8380cc7483bd3808c03ed394bb24a75811962b28866e057","observation_id":"bdc9b118-0983-40b8-892d-4a21f835c312","resolution":{"observed_at":"2026-05-22T14:06:37.849546Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-02T19:38:15.441579+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T19:38:15.441579+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-07T14:44:23.169749Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17716","last_updated":"2025-05-23T10:33:14Z","snapshot_observed_at":"2026-08-16T17:10:52.194207Z","submitted_at":"2025-05-23T10:33:14Z","title":"Get Experience from Practice: LLM Agents with Record & Replay","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:23.169749Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2505.17716"},"observation_digest":"sha256:d5e9f52291279d722a407a5e644b1d66b4e9721a7b3c2b7da9cf86ada4271c4e","observation_id":"7b6c9bad-d0d5-4c83-be8e-559423637ada","resolution":{"observed_at":"2026-08-07T14:44:23.169749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-07T13:17:52.357564Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05368","last_updated":"2025-05-28T09:13:41Z","snapshot_observed_at":"2026-08-13T16:23:56.745186Z","submitted_at":"2025-05-28T09:13:41Z","title":"Speaking images. A novel framework for the automated self-description of artworks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:52.357564Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2506.05368"},"observation_digest":"sha256:cf547121ca03cc0bc6bd2a671d7d2be1ddaec62ab3fd7301782dc35474a16a20","observation_id":"e85f8422-b54c-4a7a-b4f1-28f4e2fa8918","resolution":{"observed_at":"2026-08-07T13:17:52.357564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-06T20:45:53.265935Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02057","last_updated":"2025-07-02T18:00:49Z","snapshot_observed_at":"2026-08-15T22:05:52.834121Z","submitted_at":"2025-07-02T18:00:49Z","title":"MGC: A Compiler Framework Exploiting Compositional Blindness in Aligned LLMs for Malware Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:53.265935Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2507.02057"},"observation_digest":"sha256:908dda06682ed90f4f69b6c76cfe4a31417f6fa4fd242e02ad76afddee5374e1","observation_id":"7026cd90-588b-41ad-9ef7-672336983bdf","resolution":{"observed_at":"2026-08-06T20:45:53.265935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-06T21:05:17.019897Z","title":"Building guardrails for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02990","last_updated":"2025-07-01T18:00:04Z","snapshot_observed_at":"2026-08-08T08:11:38.202399Z","submitted_at":"2025-07-01T18:00:04Z","title":"`For Argument's Sake, Show Me How to Harm Myself!': Jailbreaking LLMs in Suicide and Self-Harm Contexts","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T21:05:17.019897Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2507.02990"},"observation_digest":"sha256:70f26d81bb7b853c5705b26513f2233465dfeeba510c7789de1740da4e27f44f","observation_id":"1c8f77b9-b467-405b-a8f3-edf6aecc1fd8","resolution":{"observed_at":"2026-08-06T21:05:17.019897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-06T20:09:17.288317Z","title":"et al.: Building Guardrails for Large Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03620","last_updated":"2025-07-04T14:46:56Z","snapshot_observed_at":"2026-08-18T13:15:48.994766Z","submitted_at":"2025-07-04T14:46:56Z","title":"Is It Time To Treat Prompts As Code? A Multi-Use Case Study For Prompt Optimization Using DSPy","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:09:17.288317Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2507.03620"},"observation_digest":"sha256:b195f009bc737744b549330075345bfbf63edeb15643c844bcd74d6301d37757","observation_id":"ce73c044-1664-4028-ab1c-a38b782638e1","resolution":{"observed_at":"2026-08-06T20:09:17.288317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-06T17:03:15.710001Z","title":"Building guardrails for large language models.arXiv preprint arXiv:2402.01822,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11878","last_updated":"2026-07-06T01:46:44Z","snapshot_observed_at":"2026-08-13T20:49:32.387386Z","submitted_at":"2025-07-16T03:48:03Z","title":"LLMs Encode Harmfulness and Refusal Separately","version":5},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:03:15.710001Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2507.11878"},"observation_digest":"sha256:dad2ba44668d18a0bf76ebc81d8ce6ec345a08328606cef125e73581a72476c1","observation_id":"bb3a35ed-fc71-4851-8ca8-1b85dbbed7bd","resolution":{"observed_at":"2026-08-06T17:03:15.710001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-15T17:47:15.336216Z","title":"Building guardrails for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20503","last_updated":"2025-07-28T03:45:34Z","snapshot_observed_at":"2026-08-19T06:38:54.518951Z","submitted_at":"2025-07-28T03:45:34Z","title":"Customize Multi-modal RAI Guardrails with Precedent-based predictions","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:15.336216Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2507.20503"},"observation_digest":"sha256:d9f7922db2548015069c08c05f914900fbb4ea048cf7efc55d04071a694c6f89","observation_id":"051f8d6d-780b-43d3-a49d-2461fbd135d8","resolution":{"observed_at":"2026-08-15T17:47:15.336216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-06T05:29:11.155918Z","title":"Building guardrails for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01781","last_updated":"2025-08-03T14:37:16Z","snapshot_observed_at":"2026-08-16T21:33:59.230032Z","submitted_at":"2025-08-03T14:37:16Z","title":"A comprehensive taxonomy of hallucinations in Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T05:29:11.155918Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2508.01781"},"observation_digest":"sha256:4caa772437c6a8c39aa775a5e0632aed11eeda0bc438254e3185d502c3e59798","observation_id":"04d3d285-a050-4f72-aa3b-2c810a150714","resolution":{"observed_at":"2026-08-06T05:29:11.155918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-05T17:26:48.595039Z","title":"Building guardrails for large language models.arXiv preprint arXiv:2402.01822, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.16318","last_updated":"2025-09-01T08:35:27Z","snapshot_observed_at":"2026-08-17T17:13:15.654762Z","submitted_at":"2025-08-22T11:57:55Z","title":"SATORI: Static Test Oracle Generation for REST APIs","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T17:26:48.595039Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2508.16318"},"observation_digest":"sha256:25ab5e46d3a6a26106fb4cbe1bda72958133414f99055829ca01151c45e834ed","observation_id":"64c906db-950c-4e08-847b-b4d4073094be","resolution":{"observed_at":"2026-08-05T17:26:48.595039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.01822","doi":"10.48550/arxiv.2402.01822","metadata_source":"pith","pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Building guardrails for large language models","venue":"cs.CL","work_id":"5bf683de-2e80-45b1-a579-415ba56a7de1","year":2024},"citing_paper":{"arxiv_id":"2603.22868","last_updated":"2026-05-08T19:13:57Z","snapshot_observed_at":"2026-08-12T23:14:46.333754Z","submitted_at":"2026-03-24T07:12:53Z","title":"Agent-Sentry: Bounding LLM Agents via Execution Provenance","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T01:17:40.860439Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2603.22868"},"observation_digest":"sha256:39ffb63d4f2f93a8730d53a62dd35f4a116e4dce40c0ebe9271ac94f93d74131","observation_id":"1893f54c-a1ca-463a-a32e-7abe2f85ed59","resolution":{"observed_at":"2026-05-15T01:18:26.427914Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-02T19:38:15.441579+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T19:38:15.441579+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.01822","doi":"10.48550/arxiv.2402.01822","metadata_source":"pith","pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Building guardrails for large language models","venue":"cs.CL","work_id":"5bf683de-2e80-45b1-a579-415ba56a7de1","year":2024},"citing_paper":{"arxiv_id":"2604.11666","last_updated":"2026-07-23T14:55:50Z","snapshot_observed_at":"2026-08-11T01:20:08.392180Z","submitted_at":"2026-04-13T16:14:41Z","title":"Playing Along: Learning a Double-Agent Defender for Belief Steering via Theory of Mind","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T15:06:23.420768Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2604.11666"},"observation_digest":"sha256:c9d593f942106c484a3a2f66d25aa8ac0272b41bc75efe86e43922c76ac1b58f","observation_id":"6fbb7b5b-4d66-4434-96d9-3506c8b73eae","resolution":{"observed_at":"2026-05-10T15:10:31.620684Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-02T19:38:15.441579+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T19:38:15.441579+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-02T16:26:54.261479Z","title":"Kanishk Gandhi, Jan-Philipp Fr¨anken, Tobias Gerstenberg, and Noah Goodman","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.11666","last_updated":"2026-07-23T14:55:50Z","snapshot_observed_at":"2026-08-11T01:20:08.392180Z","submitted_at":"2026-04-13T16:14:41Z","title":"Playing Along: Learning a Double-Agent Defender for Belief Steering via Theory of Mind","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T16:26:54.261479Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2604.11666"},"observation_digest":"sha256:ccfb554e62a10444f5264d97e49116aaaf7039d32c895c7c91cb8e2f4ecebd30","observation_id":"48e95ec2-0e00-4bc8-8b12-1bda454ea968","resolution":{"observed_at":"2026-08-02T16:26:54.261479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.01822","doi":"10.48550/arxiv.2402.01822","metadata_source":"pith","pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Building guardrails for large language models","venue":"cs.CL","work_id":"5bf683de-2e80-45b1-a579-415ba56a7de1","year":2024},"citing_paper":{"arxiv_id":"2605.01462","last_updated":"2026-05-02T14:25:26Z","snapshot_observed_at":"2026-08-12T13:55:10.968516Z","submitted_at":"2026-05-02T14:25:26Z","title":"LocalAlign: Enabling Generalizable Prompt Injection Defense via Generation of Near-Target Adversarial Examples for Alignment Training","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-09T14:17:57.772960Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2605.01462"},"observation_digest":"sha256:e44e17d2700343072aeb4f005b02bc114c003a0107344fd91c347f6639c0b02a","observation_id":"05dc1be7-5487-401d-a7d0-dfd3b8b3ac01","resolution":{"observed_at":"2026-05-11T17:01:08.514550Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-02T19:38:15.441579+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T19:38:15.441579+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.01822","doi":"10.48550/arxiv.2402.01822","metadata_source":"pith","pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Building guardrails for large language models","venue":"cs.CL","work_id":"5bf683de-2e80-45b1-a579-415ba56a7de1","year":2024},"citing_paper":{"arxiv_id":"2605.04446","last_updated":"2026-05-06T03:21:38Z","snapshot_observed_at":"2026-08-19T00:18:34.554155Z","submitted_at":"2026-05-06T03:21:38Z","title":"Misrouter: Exploiting Routing Mechanisms for Input-Only Attacks on Mixture-of-Experts LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-08T18:07:00.247161Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2605.04446"},"observation_digest":"sha256:99ae9ee0b05bffaadc97b074cf47b87c03f90bd9686b358d822cdaeb8e8be5f5","observation_id":"fb1661d6-69e1-4c65-a6e7-5e3e9ad99c57","resolution":{"observed_at":"2026-05-09T06:45:44.543140Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-02T19:38:15.441579+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T19:38:15.441579+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.01822","doi":"10.48550/arxiv.2402.01822","metadata_source":"pith","pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Building guardrails for large language models","venue":"cs.CL","work_id":"5bf683de-2e80-45b1-a579-415ba56a7de1","year":2024},"citing_paper":{"arxiv_id":"2605.05329","last_updated":"2026-05-06T18:01:40Z","snapshot_observed_at":"2026-07-06T23:17:58.119336Z","submitted_at":"2026-05-06T18:01:40Z","title":"Understanding Annotator Safety Policy with Interpretability","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-05-08T17:41:00.933594Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2605.05329"},"observation_digest":"sha256:2a52e4923a2844ecb328f56a9edf3fbf0ff6379f79e24e6e6adfa5338ddde02d","observation_id":"1b31a8ec-323b-4d71-b2f0-5e6d0f7e4060","resolution":{"observed_at":"2026-05-11T17:21:08.659993Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-02T19:38:15.441579+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T19:38:15.441579+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.01822","doi":"10.48550/arxiv.2402.01822","metadata_source":"pith","pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Building guardrails for large language models","venue":"cs.CL","work_id":"5bf683de-2e80-45b1-a579-415ba56a7de1","year":2024},"citing_paper":{"arxiv_id":"2605.10990","last_updated":"2026-05-09T11:41:53Z","snapshot_observed_at":"2026-08-14T15:57:59.538152Z","submitted_at":"2026-05-09T11:41:53Z","title":"Skill Drift Is Contract Violation: Proactive Maintenance for LLM Agent Skill Libraries","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-13T07:29:20.993146Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2605.10990"},"observation_digest":"sha256:4651b79b6b8f3b90de7c7dee0a77c959b6e360c7679f71db2d4cfdb9de9b8c84","observation_id":"8a62028b-35ed-4e7a-ae8b-efca31157c9a","resolution":{"observed_at":"2026-05-13T07:32:29.973070Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-02T19:38:15.441579+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T19:38:15.441579+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.01822","doi":"10.48550/arxiv.2402.01822","metadata_source":"pith","pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Building guardrails for large language models","venue":"cs.CL","work_id":"5bf683de-2e80-45b1-a579-415ba56a7de1","year":2024},"citing_paper":{"arxiv_id":"2605.19035","last_updated":"2026-08-07T08:13:03Z","snapshot_observed_at":"2026-08-15T09:05:15.962456Z","submitted_at":"2026-05-18T18:57:54Z","title":"Trustworthy Agent Network: Trust in Agent Networks Must Be Baked In, Not Bolted On","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-20T10:31:16.368065Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2605.19035"},"observation_digest":"sha256:fd9180eb4464262b6ac8ff71995d9a5d6558767d9b01c55eca40167b2d40a341","observation_id":"d0b7986d-ce4c-4623-be5a-598e04735b07","resolution":{"observed_at":"2026-05-20T10:33:12.366076Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-02T19:38:15.441579+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T19:38:15.441579+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.01822","doi":"10.48550/arxiv.2402.01822","metadata_source":"pith","pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Building guardrails for large language models","venue":"cs.CL","work_id":"5bf683de-2e80-45b1-a579-415ba56a7de1","year":2024},"citing_paper":{"arxiv_id":"2605.19940","last_updated":"2026-05-19T15:00:06Z","snapshot_observed_at":"2026-08-14T22:35:04.181649Z","submitted_at":"2026-05-19T15:00:06Z","title":"Robotics-Inspired Guardrails for Foundation Models in Socially Sensitive Domains","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T05:45:02.563352Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2605.19940"},"observation_digest":"sha256:d186b059e934c17cef12a7c5edee9898a82f2db2c0c052e0d02f37e9544391ca","observation_id":"f613d1b3-5913-453e-947e-81ed7718ae98","resolution":{"observed_at":"2026-05-20T05:48:04.550266Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-02T19:38:15.441579+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T19:38:15.441579+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.01822","doi":"10.48550/arxiv.2402.01822","metadata_source":"pith","pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Building guardrails for large language models","venue":"cs.CL","work_id":"5bf683de-2e80-45b1-a579-415ba56a7de1","year":2024},"citing_paper":{"arxiv_id":"2605.26942","last_updated":"2026-05-29T12:41:29Z","snapshot_observed_at":"2026-08-08T23:59:34.511470Z","submitted_at":"2026-05-26T12:32:17Z","title":"Neuro-Symbolic Verification of LLM Outputs for Data-Sensitive Domains (extended preprint)","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T16:59:53.490989Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2605.26942"},"observation_digest":"sha256:d42884cc5cfc75caecac2c3e4f6caac3e6527c4623f5d22a9116bd1cce41ee56","observation_id":"0dde6652-3202-42ac-bb8f-ee7238751793","resolution":{"observed_at":"2026-06-29T17:03:40.883974Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-02T19:38:15.441579+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T19:38:15.441579+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.01822","doi":"10.48550/arxiv.2402.01822","metadata_source":"pith","pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Building guardrails for large language models","venue":"cs.CL","work_id":"5bf683de-2e80-45b1-a579-415ba56a7de1","year":2024},"citing_paper":{"arxiv_id":"2607.08028","last_updated":"2026-07-09T01:08:33Z","snapshot_observed_at":"2026-08-18T01:04:37.508273Z","submitted_at":"2026-07-09T01:08:33Z","title":"From Prompts to Contracts: Harness Engineering for Auditable Enterprise LLM Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-10T13:27:21.622491Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2607.08028"},"observation_digest":"sha256:48c63c47c54f73d628abfa06c4ed66e81666d12aaf9e500bee94794094fe2e12","observation_id":"c1575f6a-e6c8-4972-aacb-e9caf5ff0934","resolution":{"observed_at":"2026-07-10T13:37:06.719403Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-02T19:38:15.441579+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T19:38:15.441579+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-02T13:21:53.682526Z","title":"Abdelkarim El-Hajjami and Camille Salinesi","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18268","last_updated":"2026-05-22T16:05:50Z","snapshot_observed_at":"2026-08-13T10:06:23.598812Z","submitted_at":"2026-05-22T16:05:50Z","title":"Fence: Specialized SLM Guardrails for LLM Applications","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T13:21:53.682526Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2607.18268"},"observation_digest":"sha256:5533249f6f1cd18e09c7e34a73b5f8e69c114d0f1830808231e75b179ea4d6f8","observation_id":"53e7fd48-a315-427b-8174-fcecb8e6ff37","resolution":{"observed_at":"2026-08-02T13:21:53.682526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-01T08:17:05.798352Z","title":"arXiv preprint arXiv:2402.01822 (Feb 2024).https://doi.org/10.48550/ARXIV.2402.01822","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21180","last_updated":"2026-07-23T11:09:56Z","snapshot_observed_at":"2026-08-18T23:43:52.446943Z","submitted_at":"2026-07-23T11:09:56Z","title":"Safeguards for Speech2Speech LLM-Assistants: A Case Study in Automotive Applications","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T08:17:05.798352Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2607.21180"},"observation_digest":"sha256:4bd73907522572fe90d5786615913c0bd63ec6bf5e3d6b53017164c398636255","observation_id":"21c12ef6-3af5-4919-a4cb-a3a10109790d","resolution":{"observed_at":"2026-08-01T08:17:05.798352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-07-31T16:43:59.026072Z","title":"Building Guardrails for Large Language Models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28137","last_updated":"2026-07-30T12:45:50Z","snapshot_observed_at":"2026-08-18T08:40:21.780854Z","submitted_at":"2026-07-30T12:45:50Z","title":"Asymmetric Communication: Large Language Models and Language Games","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-07-31T16:43:59.026072Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2607.28137"},"observation_digest":"sha256:b081a53ec26366cac28ef5570fc769be31614207821dca86d3534ca19c1dd835","observation_id":"a4717bb7-2d3a-4720-8a79-daeaeec47fe4","resolution":{"observed_at":"2026-07-31T16:43:59.026072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-15T14:54:50.640631Z","title":"(2025, August 26)","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.03361","last_updated":"2026-08-14T20:34:26Z","snapshot_observed_at":"2026-08-19T06:12:14.177901Z","submitted_at":"2026-08-04T09:09:31Z","title":"The Evolutionary Origin of Values: implications for AI alignment, sentience and existential risk","version":1},"reference_index":1631,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:50.640631Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2608.03361"},"observation_digest":"sha256:9b79721b0ae6e0e23177331959133fd4a8a951a8872b90de8111021135b1244b","observation_id":"de748d11-3bdd-4e6f-b974-90c2506d1f14","resolution":{"observed_at":"2026-08-15T14:54:50.640631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-12T00:37:59.095718Z","title":"arXiv preprint arXiv:2402.01822 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.08029","last_updated":"2026-08-08T09:34:22Z","snapshot_observed_at":"2026-08-18T12:48:38.561230Z","submitted_at":"2026-08-08T09:34:22Z","title":"Do All LLMs Know When They're Being Harmful? A Reproducibility Study of Latent-Space Safety Probes Across Model Families","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-12T00:37:59.095718Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2608.08029"},"observation_digest":"sha256:da1c682fa678b84fbc3ac21335581c571a139dcf0ea5eef019f2322a690980c2","observation_id":"5ad8465c-c8be-45a3-a110-f651cb5e2067","resolution":{"observed_at":"2026-08-12T00:37:59.095718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01822","snapshot_observed_at":"2026-08-14T04:39:29.999443Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08471","last_updated":"2026-08-09T04:31:05Z","snapshot_observed_at":"2026-08-16T13:43:24.220333Z","submitted_at":"2026-08-09T04:31:05Z","title":"Yesterday's Shield, Today's Spear: A Self-Evolving Safety Guardrail in Production","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T04:39:29.999443Z"},"links":{"cited_paper":"/paper/2402.01822","citing_paper":"/paper/2608.08471"},"observation_digest":"sha256:30da8c9096602d8af27d48234013dc229c297f7340ae78c42726d308ac87b87c","observation_id":"ec70cb2b-5b99-452e-ae5e-014cc4940bdc","resolution":{"observed_at":"2026-08-14T04:39:29.999443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.01822/citation-record","integrity":"/paper/2402.01822/integrity","json":"/paper/2402.01822/citation-record.json","paper":"/paper/2402.01822"},"outbound":[],"paper":{"arxiv_id":"2402.01822","last_updated":"2024-05-29T12:57:01Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T14:22:04.577037Z","submitted_at":"2024-02-02T16:35:00Z","title":"Building Guardrails for Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 35 inbound Pith citation observations for arXiv:2402.01822."}