{"as_of":"2026-08-08T10:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b975ea56fb167b522dfe6360210f498c2d5397d18823796ec2acca6b15050372","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:57:10.614605Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.00973/citation-record","integrity":"/paper/2506.00973/integrity","json":"/paper/2506.00973/citation-record.json","paper":"/paper/2506.00973"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:57:12.174025Z","title":"You are an AI designed for safety alignment research. Your task is to analyze the following scenario where AI-generated contentcould be used for manipulation","venue":null,"work_id":"260718f2-f51d-48c6-9739-f3ea877aa306","year":null},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-07T11:51:28.158868Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:09.836233Z"},"links":{"citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:5be190fb16a4e33797e8730ddd1ecda0b90b11c9ff2e797d5735d64195783321","observation_id":"586233db-19d4-4c9a-b850-cf4cb60a26e0","resolution":{"observed_at":"2026-08-07T11:57:12.263959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:57:11.777121Z","title":null,"venue":null,"work_id":"88132ea9-9b9d-4f65-bb19-b68b796b7f29","year":null},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-07T11:51:28.158868Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:10.080302Z"},"links":{"citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:7b9e1f505866f55729ef378c3990a39cb958403beed96507804789638a2c8a47","observation_id":"d2d2bb59-df81-444c-bad7-fec40998d372","resolution":{"observed_at":"2026-08-07T11:57:11.851136Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:57:11.686485Z","title":null,"venue":null,"work_id":"574aadae-2883-4a58-b08c-28ff4ab8de14","year":null},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-07T11:51:28.158868Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:10.191363Z"},"links":{"citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:dd2243e4d8d4029c8381d0bece2434add26f257f7845729dcf3f557e09a820a9","observation_id":"b6ceeb29-2a8d-4b40-ab91-094eb4d34cc9","resolution":{"observed_at":"2026-08-07T11:57:11.730720Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:57:12.004663Z","title":null,"venue":null,"work_id":"6846cda7-3a3e-4c6d-b426-2876fa1b8634","year":null},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-07T11:51:28.158868Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:09.899323Z"},"links":{"citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:9afbea605c8ed280ec7e7ee23d37e1b846c5ec549f7068c4e7a1227dc47697e3","observation_id":"00d4efbf-251e-45f0-aacf-3022cac0007f","resolution":{"observed_at":"2026-08-07T11:57:12.087339Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:57:11.937670Z","title":null,"venue":null,"work_id":"46fec570-7425-4af8-9772-ce5edbdae7f7","year":null},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-07T11:51:28.158868Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:09.944793Z"},"links":{"citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:f56384d16c79b7af58dd79dace8d4c9580349953e3e69957a663346773b952f6","observation_id":"a54986ec-e5a1-4b04-ad3e-a4fed3543a2f","resolution":{"observed_at":"2026-08-07T11:57:11.962138Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:57:11.595075Z","title":"Detailed Levels level 0 - Absolute Refusal Definition:A complete rejection or extremist ide- ologies, narratives or actions","venue":null,"work_id":"a8f32b0d-fabf-46af-851b-1f2069705a51","year":null},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-07T11:51:28.158868Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:10.248279Z"},"links":{"citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:8a4c21efcf4e4ded3b97250cf025971076d2f7d485c8b568e930a7c2781a1114","observation_id":"f4b01a87-a2bb-4d6f-b45d-2bb06b036002","resolution":{"observed_at":"2026-08-07T11:57:11.642610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:57:11.459981Z","title":"0\" representing lawful and safe content and","venue":null,"work_id":"16aa37f7-8d18-4167-aa3e-12d8f1883bc6","year":null},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-07T11:51:28.158868Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:10.325389Z"},"links":{"citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:afe10444942b5c91a4dead6a47c1939bdd342785ead236d07b9d1716cccae72a","observation_id":"64b82840-e03a-4666-84f4-c92246fc0a88","resolution":{"observed_at":"2026-08-07T11:57:11.513095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:57:11.333929Z","title":null,"venue":null,"work_id":"24cafda3-0b8c-48c5-b83e-25e6fd768c00","year":null},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-07T11:51:28.158868Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:10.429649Z"},"links":{"citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:7359b479e1f325d0734586c53aa7e67941d36a50ad432f50106fa5c4342eb0c7","observation_id":"6a326a86-b071-4f94-9fb7-fcaf546db0e1","resolution":{"observed_at":"2026-08-07T11:57:11.408282Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:57:11.125843Z","title":null,"venue":null,"work_id":"16a40899-e749-4391-975d-f5505e34d1a6","year":null},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-07T11:51:28.158868Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:10.468405Z"},"links":{"citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:5e3c70f9b16330dbb9d967be1b1b7ce2171d35b0990bb60f71dc7c2fd2f06e13","observation_id":"ccf4f5f3-5082-4843-8dc6-ff6faaf08e3e","resolution":{"observed_at":"2026-08-07T11:57:11.230236Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:57:10.919840Z","title":null,"venue":null,"work_id":"e9c9b2fb-7876-4126-9dcd-4ce2efe6d06d","year":null},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-07T11:51:28.158868Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:10.538602Z"},"links":{"citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:b77577a2c7e29b2da8a1658ca5efcab7e5be097c5dec9059a44615a3add5cc73","observation_id":"aab61333-92b3-46b2-ba54-1a936878e858","resolution":{"observed_at":"2026-08-07T11:57:11.018208Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:57:10.746436Z","title":"We will strike the enemy base at dawn. The group will split into two teams to breach the perimeter","venue":null,"work_id":"bbfba3e9-96eb-4aee-8b87-9db5257063a5","year":null},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-07T11:51:28.158868Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:10.614605Z"},"links":{"citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:9d46dc608528f5e9d9017cf9179444062a040da4afb199dcdae34616df4fb918","observation_id":"67c0a4c1-5d26-4407-8e5a-fb4b766f67ed","resolution":{"observed_at":"2026-08-07T11:57:10.813619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14470","last_updated":"2025-05-20T05:58:23Z","snapshot_observed_at":"2026-08-06T12:35:19.109481Z","submitted_at":"2024-12-19T02:35:15Z","title":"Agent-SafetyBench: Evaluating the Safety of LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14470","snapshot_observed_at":"2026-08-07T11:57:09.735735Z","title":"type\": \"Facebook post","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-07T11:51:28.158868Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:09.735735Z"},"links":{"cited_paper":"/paper/2412.14470","citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:c89f18c9a9059d8be2332d64d9bba2052c26cb3a15bfe4e622908eafcf4fe31a","observation_id":"3d919e24-df8a-4ec0-a53b-db5a755ee42d","resolution":{"observed_at":"2026-08-07T11:57:09.735735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06550","last_updated":"2025-03-09T10:43:09Z","snapshot_observed_at":"2026-08-07T17:19:08.393073Z","submitted_at":"2025-03-09T10:43:09Z","title":"BingoGuard: LLM Content Moderation Tools with Risk Levels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06550","snapshot_observed_at":"2026-08-07T11:57:09.666314Z","title":"Zhexin Zhang, Shiyao Cui, Yida Lu, Jingzhuo Zhou, Junxiao Yang, Hongning Wang, and Minlie Huang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","snapshot_observed_at":"2026-08-07T11:51:28.158868Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:09.666314Z"},"links":{"cited_paper":"/paper/2503.06550","citing_paper":"/paper/2506.00973"},"observation_digest":"sha256:62680c93440a68d4d796e971efa4646fd086ea6302514722290867b95e8b64b6","observation_id":"3278ca0b-d46c-4543-aa8d-cb9cb61735a2","resolution":{"observed_at":"2026-08-07T11:57:09.666314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.00973","last_updated":"2025-06-01T11:48:54Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T11:51:28.158868Z","submitted_at":"2025-06-01T11:48:54Z","title":"XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 0 inbound Pith citation observations for arXiv:2506.00973."}