{"as_of":"2026-08-07T22:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d51a3a4c9ec4fb30173cb3c4dd58f1b73cb7b2cac2ad7c5ca3caa1c4efe25159","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":7,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":7,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:17:26.844499Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T18:10:00.725685Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2405.14191","last_updated":"2025-04-07T07:52:28Z","snapshot_observed_at":"2026-08-06T23:27:26.520354Z","submitted_at":"2024-05-23T05:34:31Z","title":"S-Eval: Towards Automated and Comprehensive Safety Evaluation for Large Language Models","version":4},"cited_work":{"arxiv_id":"2405.14191","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14191","snapshot_observed_at":"2026-08-04T01:57:26.797777Z","title":"S-eval: Towards automated and comprehensive safety evaluation for large language models","venue":null,"work_id":"6f1a6a75-1e42-4f95-aff9-2b1045ab9422","year":2025},"citing_paper":{"arxiv_id":"2404.16130","last_updated":"2025-02-19T10:49:41Z","snapshot_observed_at":"2026-07-06T18:05:11.700127Z","submitted_at":"2024-04-24T18:38:11Z","title":"From Local to Global: A Graph RAG Approach to Query-Focused Summarization","version":2},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-05-11T05:10:57.816312Z"},"links":{"cited_paper":"/paper/2405.14191","citing_paper":"/paper/2404.16130"},"observation_digest":"sha256:f78042c90e052e69a32a733dd6b9200d366e11d6c24459013d04a22bbf205efb","observation_id":"246381f3-539f-4c3e-a52a-21eafb6c6b56","resolution":{"observed_at":"2026-08-04T01:57:26.797777Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14191","last_updated":"2025-04-07T07:52:28Z","snapshot_observed_at":"2026-08-06T23:27:26.520354Z","submitted_at":"2024-05-23T05:34:31Z","title":"S-Eval: Towards Automated and Comprehensive Safety Evaluation for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14191","snapshot_observed_at":"2026-08-07T10:17:26.844499Z","title":"S-eval: Automatic and adaptive test generation for benchmarking safety evaluation of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11094","last_updated":"2025-10-30T06:22:33Z","snapshot_observed_at":"2026-08-07T10:11:06.747781Z","submitted_at":"2025-06-06T05:50:50Z","title":"The Scales of Justitia: A Comprehensive Survey on Safety Evaluation of LLMs","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:26.844499Z"},"links":{"cited_paper":"/paper/2405.14191","citing_paper":"/paper/2506.11094"},"observation_digest":"sha256:b9ccb644844f9b2effb8550ff2c8dac3809a8972eae7e3084b7c1b527eed8d03","observation_id":"d4ac6a66-df10-4627-9818-94933ba03a0e","resolution":{"observed_at":"2026-08-07T10:17:26.844499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14191","last_updated":"2025-04-07T07:52:28Z","snapshot_observed_at":"2026-08-06T23:27:26.520354Z","submitted_at":"2024-05-23T05:34:31Z","title":"S-Eval: Towards Automated and Comprehensive Safety Evaluation for Large Language Models","version":4},"cited_work":{"arxiv_id":"2405.14191","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14191","snapshot_observed_at":"2026-08-04T01:57:26.797777Z","title":"S-eval: Towards automated and comprehensive safety evaluation for large language models","venue":null,"work_id":"6f1a6a75-1e42-4f95-aff9-2b1045ab9422","year":2025},"citing_paper":{"arxiv_id":"2508.11222","last_updated":"2025-12-05T05:36:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-15T05:03:26Z","title":"ORFuzz: Fuzzing the \"Other Side\" of LLM Safety -- Testing Over-Refusal","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-18T23:27:52.438709Z"},"links":{"cited_paper":"/paper/2405.14191","citing_paper":"/paper/2508.11222"},"observation_digest":"sha256:ae5d2990d3789ea075479d513c428c3449bbc0da38938f58212ad0f8f677457e","observation_id":"303efba4-6986-4882-ab4a-783b4a3ba1d2","resolution":{"observed_at":"2026-08-04T01:57:26.797777Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14191","last_updated":"2025-04-07T07:52:28Z","snapshot_observed_at":"2026-08-06T23:27:26.520354Z","submitted_at":"2024-05-23T05:34:31Z","title":"S-Eval: Towards Automated and Comprehensive Safety Evaluation for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14191","snapshot_observed_at":"2026-08-04T12:45:26.905184Z","title":"S-eval: Towards automated and comprehensive safety evaluation for large language models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.02480","last_updated":"2026-05-27T22:55:59Z","snapshot_observed_at":"2026-08-04T12:45:19.590090Z","submitted_at":"2025-10-02T18:36:10Z","title":"Controlling the Risk of Corrupted Contexts for Language Models via Early-Exiting","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-04T12:45:26.905184Z"},"links":{"cited_paper":"/paper/2405.14191","citing_paper":"/paper/2510.02480"},"observation_digest":"sha256:6be26d8f8afd79e1d2441d4fd05d5cd606676413dc7e1f674de3bdcd7ca628df","observation_id":"d7650cbd-c31f-4368-ad84-0f9410e5f121","resolution":{"observed_at":"2026-08-04T12:45:26.905184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14191","last_updated":"2025-04-07T07:52:28Z","snapshot_observed_at":"2026-08-06T23:27:26.520354Z","submitted_at":"2024-05-23T05:34:31Z","title":"S-Eval: Towards Automated and Comprehensive Safety Evaluation for Large Language Models","version":4},"cited_work":{"arxiv_id":"2405.14191","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14191","snapshot_observed_at":"2026-08-04T01:57:26.797777Z","title":"S-eval: Towards automated and comprehensive safety evaluation for large language models","venue":null,"work_id":"6f1a6a75-1e42-4f95-aff9-2b1045ab9422","year":2025},"citing_paper":{"arxiv_id":"2606.07535","last_updated":"2026-04-24T09:29:14Z","snapshot_observed_at":"2026-08-03T04:03:26.597230Z","submitted_at":"2026-04-24T09:29:14Z","title":"Multilingual Refusal Alignment for Safer Large Language Models","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-07-04T18:09:17.531727Z"},"links":{"cited_paper":"/paper/2405.14191","citing_paper":"/paper/2606.07535"},"observation_digest":"sha256:be1d3662e05ebf3b48289b36ab3b9e7e90fcdb15056e8fffabc70ca220542451","observation_id":"1a5121e0-d0c8-4202-a219-9821cb75e50e","resolution":{"observed_at":"2026-08-04T01:57:26.797777Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14191","last_updated":"2025-04-07T07:52:28Z","snapshot_observed_at":"2026-08-06T23:27:26.520354Z","submitted_at":"2024-05-23T05:34:31Z","title":"S-Eval: Towards Automated and Comprehensive Safety Evaluation for Large Language Models","version":4},"cited_work":{"arxiv_id":"2405.14191","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14191","snapshot_observed_at":"2026-08-04T01:57:26.797777Z","title":"S-eval: Towards automated and comprehensive safety evaluation for large language models","venue":null,"work_id":"6f1a6a75-1e42-4f95-aff9-2b1045ab9422","year":2025},"citing_paper":{"arxiv_id":"2606.27632","last_updated":"2026-06-26T01:12:02Z","snapshot_observed_at":"2026-08-01T14:50:11.591955Z","submitted_at":"2026-06-26T01:12:02Z","title":"Yuvion LLM: An Adversarially-Aware Large Language Model for Content And AI Safety","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-29T00:46:03.210076Z"},"links":{"cited_paper":"/paper/2405.14191","citing_paper":"/paper/2606.27632"},"observation_digest":"sha256:b1687e11f402244c57d0b6729191a50185d9697b7396640a1049c1c1d947af1b","observation_id":"d42ba51f-292d-4d59-8f56-08e25b9b7ef9","resolution":{"observed_at":"2026-08-04T01:57:26.797777Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14191","last_updated":"2025-04-07T07:52:28Z","snapshot_observed_at":"2026-08-06T23:27:26.520354Z","submitted_at":"2024-05-23T05:34:31Z","title":"S-Eval: Towards Automated and Comprehensive Safety Evaluation for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14191","snapshot_observed_at":"2026-08-05T23:46:20.542247Z","title":"S-eval: Towards auto- mated and comprehensive safety evaluation for large lan- guage models.arXiv preprint arXiv:2405.14191, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03201","last_updated":"2026-08-04T06:43:04Z","snapshot_observed_at":"2026-08-07T22:11:05.204528Z","submitted_at":"2026-08-04T06:43:04Z","title":"When Refusal Looks Safe: The Refusal-Cue Shortcut in Safety Guard Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T23:46:20.542247Z"},"links":{"cited_paper":"/paper/2405.14191","citing_paper":"/paper/2608.03201"},"observation_digest":"sha256:2e92c985f97c8d445b8f375c2e3044bd1fe44eb552c44c46e213795f6d1cb955","observation_id":"077f18ff-e8be-4268-a724-7044051ea787","resolution":{"observed_at":"2026-08-05T23:46:20.542247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2405.14191/citation-record","integrity":"/paper/2405.14191/integrity","json":"/paper/2405.14191/citation-record.json","paper":"/paper/2405.14191"},"outbound":[],"paper":{"arxiv_id":"2405.14191","last_updated":"2025-04-07T07:52:28Z","latest_version":4,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-06T23:27:26.520354Z","submitted_at":"2024-05-23T05:34:31Z","title":"S-Eval: Towards Automated and Comprehensive Safety Evaluation for Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 7 inbound Pith citation observations for arXiv:2405.14191."}