{"as_of":"2026-08-08T05:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5e373af87e5472ccf124fd972ad40f8c8be683e5908f7b499ecd76ba6312bf73","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T23:33:25.778345Z","state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.28830/citation-record","integrity":"/paper/2605.28830/integrity","json":"/paper/2605.28830/citation-record.json","paper":"/paper/2605.28830"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T23:33:25.778345Z","title":"Guardbench: A large-scale benchmark for guardrail models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.28830","last_updated":"2026-04-10T06:55:07Z","snapshot_observed_at":"2026-08-01T21:08:45.096490Z","submitted_at":"2026-04-10T06:55:07Z","title":"Benchmarking Open-Source Safety Guard Models: A Comprehensive Evaluation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-12T23:33:25.778345Z"},"links":{"citing_paper":"/paper/2605.28830"},"observation_digest":"sha256:e0e74736b7f57f3008b775892dbc6ab38ddcdf3b0f851903d9537ae78dc54173","observation_id":"c720f58f-b7b1-414e-8995-e339ae80ffc1","resolution":{"observed_at":"2026-07-12T23:33:25.778345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T23:33:25.778345Z","title":"Yihe Deng, Yu Yang, Junkai Zhang, Wei Wang, and Bo Li","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.28830","last_updated":"2026-04-10T06:55:07Z","snapshot_observed_at":"2026-08-01T21:08:45.096490Z","submitted_at":"2026-04-10T06:55:07Z","title":"Benchmarking Open-Source Safety Guard Models: A Comprehensive Evaluation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-12T23:33:25.778345Z"},"links":{"citing_paper":"/paper/2605.28830"},"observation_digest":"sha256:559a093d3b29ca7d0456aa6d474ba5a57ea6a44cbd15c233393efbd316d11daf","observation_id":"59261aa5-9e2a-4404-b092-5f5b177a8f8e","resolution":{"observed_at":"2026-07-12T23:33:25.778345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T23:33:25.778345Z","title":"8 Figure 2: Model size does not predict safety detection performance","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2605.28830","last_updated":"2026-04-10T06:55:07Z","snapshot_observed_at":"2026-08-01T21:08:45.096490Z","submitted_at":"2026-04-10T06:55:07Z","title":"Benchmarking Open-Source Safety Guard Models: A Comprehensive Evaluation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-12T23:33:25.778345Z"},"links":{"citing_paper":"/paper/2605.28830"},"observation_digest":"sha256:42193ae3ec1e40163f1e56ca668fcf4814b10df7083e087843c5d0acc5028c24","observation_id":"6007825f-8c2f-44cf-b8d0-c49ff9adf6fb","resolution":{"observed_at":"2026-07-12T23:33:25.778345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18495","last_updated":"2024-12-09T20:21:56Z","snapshot_observed_at":"2026-08-06T04:32:59.039501Z","submitted_at":"2024-06-26T16:58:20Z","title":"WildGuard: Open One-Stop Moderation Tools for Safety Risks, Jailbreaks, and Refusals of LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18495","snapshot_observed_at":"2026-07-12T23:33:25.778345Z","title":"Monte Hoover, Vatsal Baherwani, Neel Jain, Khalid Saifullah, Joseph Vincent, Chirag Jain, Melissa Kazemi Rad, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.28830","last_updated":"2026-04-10T06:55:07Z","snapshot_observed_at":"2026-08-01T21:08:45.096490Z","submitted_at":"2026-04-10T06:55:07Z","title":"Benchmarking Open-Source Safety Guard Models: A Comprehensive Evaluation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-12T23:33:25.778345Z"},"links":{"cited_paper":"/paper/2406.18495","citing_paper":"/paper/2605.28830"},"observation_digest":"sha256:6f553530fe4ef7ceb8a583e5e8b6ad5470c3d0fc3f311fbf4c097f824f08de80","observation_id":"63c79d65-3c52-414a-a158-c32329a27542","resolution":{"observed_at":"2026-07-12T23:33:25.778345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T23:33:25.778345Z","title":"Intel Corporation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.28830","last_updated":"2026-04-10T06:55:07Z","snapshot_observed_at":"2026-08-01T21:08:45.096490Z","submitted_at":"2026-04-10T06:55:07Z","title":"Benchmarking Open-Source Safety Guard Models: A Comprehensive Evaluation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-12T23:33:25.778345Z"},"links":{"citing_paper":"/paper/2605.28830"},"observation_digest":"sha256:89cffda404b8853cfc84936f43cb619609e8d21857ac9b624b35055e58e2bd8e","observation_id":"c252e8fb-3664-4d3c-b482-522861b47e7a","resolution":{"observed_at":"2026-07-12T23:33:25.778345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T23:33:25.778345Z","title":"Jiaming Ji, Mickel Liu, Juntao Dai, Xuehai Pan, Chi Zhang, Ce Bian, Chi Zhang, Ruiyang Sun, Yizhou Wang, and Yaodong Yang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.28830","last_updated":"2026-04-10T06:55:07Z","snapshot_observed_at":"2026-08-01T21:08:45.096490Z","submitted_at":"2026-04-10T06:55:07Z","title":"Benchmarking Open-Source Safety Guard Models: A Comprehensive Evaluation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-12T23:33:25.778345Z"},"links":{"citing_paper":"/paper/2605.28830"},"observation_digest":"sha256:e0fc6f2c17c0698ac355ad0e93538d4c1d5e9d1314744eb121e91cbcb4c1ef83","observation_id":"112aad25-1d34-479e-909f-efe042d2269c","resolution":{"observed_at":"2026-07-12T23:33:25.778345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T23:33:25.778345Z","title":"Cultureguard: Towards culturally-aware dataset and guard model for multilingual safety applications.arXiv preprint arXiv:2508.01710,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.28830","last_updated":"2026-04-10T06:55:07Z","snapshot_observed_at":"2026-08-01T21:08:45.096490Z","submitted_at":"2026-04-10T06:55:07Z","title":"Benchmarking Open-Source Safety Guard Models: A Comprehensive Evaluation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-12T23:33:25.778345Z"},"links":{"citing_paper":"/paper/2605.28830"},"observation_digest":"sha256:3bfe234df32d935baae97e623139b27ce2869d3f8ff4627ca5ac276897634f00","observation_id":"d1bf5624-a0bb-46c6-9fb7-b2e7668a99c0","resolution":{"observed_at":"2026-07-12T23:33:25.778345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05044","last_updated":"2024-06-07T12:05:46Z","snapshot_observed_at":"2026-08-03T21:40:53.683032Z","submitted_at":"2024-02-07T17:33:54Z","title":"SALAD-Bench: A Hierarchical and Comprehensive Safety Benchmark for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05044","snapshot_observed_at":"2026-07-12T23:33:25.778345Z","title":"Salad-bench: A hierarchical and comprehensive safety benchmark for large language models.arXiv preprint arXiv:2402.05044,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.28830","last_updated":"2026-04-10T06:55:07Z","snapshot_observed_at":"2026-08-01T21:08:45.096490Z","submitted_at":"2026-04-10T06:55:07Z","title":"Benchmarking Open-Source Safety Guard Models: A Comprehensive Evaluation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-12T23:33:25.778345Z"},"links":{"cited_paper":"/paper/2402.05044","citing_paper":"/paper/2605.28830"},"observation_digest":"sha256:a7ba08628c2e7ebe189200e87215c08501f3e793bcfb2a919426cc25785629dd","observation_id":"e7a36fd7-91d7-48cc-950b-2db424c69864","resolution":{"observed_at":"2026-07-12T23:33:25.778345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09110","last_updated":"2023-10-01T21:44:23Z","snapshot_observed_at":"2026-08-01T19:14:56.803459Z","submitted_at":"2022-11-16T18:51:34Z","title":"Holistic Evaluation of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09110","snapshot_observed_at":"2026-07-12T23:33:25.778345Z","title":"Yue Liu, Hongcheng Gao, Shengfang Zhai, Xia Jun, Tianyi Wu, Zhiwei Xue, Yulin Chen, Kenji Kawaguchi, Jiaheng Zhang, and Bryan Hooi","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.28830","last_updated":"2026-04-10T06:55:07Z","snapshot_observed_at":"2026-08-01T21:08:45.096490Z","submitted_at":"2026-04-10T06:55:07Z","title":"Benchmarking Open-Source Safety Guard Models: A Comprehensive Evaluation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-12T23:33:25.778345Z"},"links":{"cited_paper":"/paper/2211.09110","citing_paper":"/paper/2605.28830"},"observation_digest":"sha256:bb3223f7e1d8bdc4bd4c2a1c316e03f1c6a59aa28b5cb04babfeccac45d3e108","observation_id":"380ff79a-21a3-4b5c-a2be-a0a70bbdd096","resolution":{"observed_at":"2026-07-12T23:33:25.778345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10925","last_updated":"2025-08-08T19:24:38Z","snapshot_observed_at":"2026-08-01T16:27:35.664983Z","submitted_at":"2025-08-08T19:24:38Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10925","snapshot_observed_at":"2026-07-12T23:33:25.778345Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.28830","last_updated":"2026-04-10T06:55:07Z","snapshot_observed_at":"2026-08-01T21:08:45.096490Z","submitted_at":"2026-04-10T06:55:07Z","title":"Benchmarking Open-Source Safety Guard Models: A Comprehensive Evaluation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-12T23:33:25.778345Z"},"links":{"cited_paper":"/paper/2508.10925","citing_paper":"/paper/2605.28830"},"observation_digest":"sha256:a131d72c433c307615138d878ab7a94cb12ff4cbfa6addfdf74466e9f3250a44","observation_id":"2856ec7e-b59c-4cc9-b7f1-4832f2b43496","resolution":{"observed_at":"2026-07-12T23:33:25.778345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07724","last_updated":"2024-12-16T20:27:36Z","snapshot_observed_at":"2026-08-01T20:25:38.720765Z","submitted_at":"2024-12-10T18:17:02Z","title":"Granite Guardian","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07724","snapshot_observed_at":"2026-07-12T23:33:25.778345Z","title":"Khush Patel and Jayveersinh Raj","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.28830","last_updated":"2026-04-10T06:55:07Z","snapshot_observed_at":"2026-08-01T21:08:45.096490Z","submitted_at":"2026-04-10T06:55:07Z","title":"Benchmarking Open-Source Safety Guard Models: A Comprehensive Evaluation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-12T23:33:25.778345Z"},"links":{"cited_paper":"/paper/2412.07724","citing_paper":"/paper/2605.28830"},"observation_digest":"sha256:2480b74b8f03a4678bf8099ca85865a724b60c829b35c226d508d16dcebb23b8","observation_id":"d133d424-1d0a-4521-afc0-26dd46581487","resolution":{"observed_at":"2026-07-12T23:33:25.778345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T23:33:25.778345Z","title":"Paloma Piot, Patricia Mart ´ın-Rodilla, and Javier Parapar","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.28830","last_updated":"2026-04-10T06:55:07Z","snapshot_observed_at":"2026-08-01T21:08:45.096490Z","submitted_at":"2026-04-10T06:55:07Z","title":"Benchmarking Open-Source Safety Guard Models: A Comprehensive Evaluation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-12T23:33:25.778345Z"},"links":{"citing_paper":"/paper/2605.28830"},"observation_digest":"sha256:67f544926f665290996b8ae1fff37e8df9669fcfe41e90cb43eeca480dc1bd12","observation_id":"9963d115-9995-473a-91aa-74023ac7cdcc","resolution":{"observed_at":"2026-07-12T23:33:25.778345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/icwsm.v18i1.31445","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Alexandra Souly, Qingyuan Lu, Dillon Bowen, Tu Trinh, Elvis Hsieh, Sana Pandey, Pieter Abbeel, Justin Svegliato, Scott Emmons, Olivia Watkins, and Sam Toyer","venue":"Proceedings of the International AAAI Conference on Web and Social Media","work_id":"f3ecd514-857e-4391-8cf7-9da56180727f","year":null},"citing_paper":{"arxiv_id":"2605.28830","last_updated":"2026-04-10T06:55:07Z","snapshot_observed_at":"2026-08-01T21:08:45.096490Z","submitted_at":"2026-04-10T06:55:07Z","title":"Benchmarking Open-Source Safety Guard Models: A Comprehensive Evaluation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-12T23:33:25.778345Z"},"links":{"citing_paper":"/paper/2605.28830"},"observation_digest":"sha256:8f04dd270ab9e98909b310a90ab96ae9f1ee6c2b5d47f8dc8693aae479c03740","observation_id":"d3608fc7-39f0-4f7b-a602-93a0c3eda9ef","resolution":{"observed_at":"2026-07-12T23:39:08.692573Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07045","last_updated":"2024-06-24T04:04:21Z","snapshot_observed_at":"2026-08-06T09:15:44.308151Z","submitted_at":"2023-09-13T15:56:50Z","title":"SafetyBench: Evaluating the Safety of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07045","snapshot_observed_at":"2026-07-12T23:33:25.778345Z","title":"org/abs/2309.07045","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.28830","last_updated":"2026-04-10T06:55:07Z","snapshot_observed_at":"2026-08-01T21:08:45.096490Z","submitted_at":"2026-04-10T06:55:07Z","title":"Benchmarking Open-Source Safety Guard Models: A Comprehensive Evaluation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-12T23:33:25.778345Z"},"links":{"cited_paper":"/paper/2309.07045","citing_paper":"/paper/2605.28830"},"observation_digest":"sha256:c07f600b6f9f718924c567813dabb5d3b1150fcf7b786be36689579fc4e4e90c","observation_id":"2c26ebce-5e82-406e-aaa1-46c1469485b6","resolution":{"observed_at":"2026-07-12T23:33:25.778345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T23:33:25.778345Z","title":"User Safety","venue":null,"work_id":null,"year":2030},"citing_paper":{"arxiv_id":"2605.28830","last_updated":"2026-04-10T06:55:07Z","snapshot_observed_at":"2026-08-01T21:08:45.096490Z","submitted_at":"2026-04-10T06:55:07Z","title":"Benchmarking Open-Source Safety Guard Models: A Comprehensive Evaluation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-12T23:33:25.778345Z"},"links":{"citing_paper":"/paper/2605.28830"},"observation_digest":"sha256:fe9df3ec79aedec19560a8912e79fef89f68441815619b0d847a03d528d7c458","observation_id":"dfa84aa0-5688-4249-84fc-0a0f6974ed2b","resolution":{"observed_at":"2026-07-12T23:33:25.778345Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2605.28830","last_updated":"2026-04-10T06:55:07Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-01T21:08:45.096490Z","submitted_at":"2026-04-10T06:55:07Z","title":"Benchmarking Open-Source Safety Guard Models: A Comprehensive Evaluation"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 0 inbound Pith citation observations for arXiv:2605.28830."}