{"as_of":"2026-08-09T21:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a9509c4ca215b173d0e6d9928ed7672dc7c0f69a160b36f44ae351c7639a5313","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T08:30:03.086317Z","state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.22671/citation-record","integrity":"/paper/2607.22671/integrity","json":"/paper/2607.22671/citation-record.json","paper":"/paper/2607.22671"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.17436","last_updated":"2024-08-05T18:12:27Z","snapshot_observed_at":"2026-08-08T01:17:55.124326Z","submitted_at":"2024-07-11T21:16:48Z","title":"AIR-Bench 2024: A Safety Benchmark Based on Risk Categories from Regulations and Policies","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17436","snapshot_observed_at":"2026-08-02T08:30:01.720511Z","title":"Air-bench 2024: A safety benchmark based on risk categories from regulations and policies.https://arxiv.org/abs/2407.17436, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22671","last_updated":"2026-07-06T17:26:46Z","snapshot_observed_at":"2026-08-06T17:18:06.876668Z","submitted_at":"2026-07-06T17:26:46Z","title":"AIR-BENCH Live: An Evolving Safety Benchmark for Foundation Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T08:30:01.720511Z"},"links":{"cited_paper":"/paper/2407.17436","citing_paper":"/paper/2607.22671"},"observation_digest":"sha256:9566d91e749488b2854c0667beb833bc716f828f56c1e6a17cbe693009b1f942","observation_id":"76cd7933-fe44-421e-b840-c1cef0f98e17","resolution":{"observed_at":"2026-08-02T08:30:01.720511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:30:01.862949Z","title":"The AI index 2025 annual report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22671","last_updated":"2026-07-06T17:26:46Z","snapshot_observed_at":"2026-08-06T17:18:06.876668Z","submitted_at":"2026-07-06T17:26:46Z","title":"AIR-BENCH Live: An Evolving Safety Benchmark for Foundation Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T08:30:01.862949Z"},"links":{"citing_paper":"/paper/2607.22671"},"observation_digest":"sha256:cb3f9042ea4ec477903b1455a7fe22bdabb8ace1cfc11c48bbf210e5f0b4b334","observation_id":"4cde1716-58f8-4989-b2bc-b6c2b11110e8","resolution":{"observed_at":"2026-08-02T08:30:01.862949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:30:02.004317Z","title":"Artificial intelligence 2025 legislation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22671","last_updated":"2026-07-06T17:26:46Z","snapshot_observed_at":"2026-08-06T17:18:06.876668Z","submitted_at":"2026-07-06T17:26:46Z","title":"AIR-BENCH Live: An Evolving Safety Benchmark for Foundation Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T08:30:02.004317Z"},"links":{"citing_paper":"/paper/2607.22671"},"observation_digest":"sha256:b2f612a1d68dad095fb9c9fc1507aa76ec0c8bd931ed0a9428da6635de608bbe","observation_id":"743b7641-adaf-4210-8597-eba899bb47c1","resolution":{"observed_at":"2026-08-02T08:30:02.004317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:30:02.169326Z","title":"OECD.AI policy observatory: Database of national AI policies and strategies.https://oecd.ai/en/dashboards/overview, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22671","last_updated":"2026-07-06T17:26:46Z","snapshot_observed_at":"2026-08-06T17:18:06.876668Z","submitted_at":"2026-07-06T17:26:46Z","title":"AIR-BENCH Live: An Evolving Safety Benchmark for Foundation Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T08:30:02.169326Z"},"links":{"citing_paper":"/paper/2607.22671"},"observation_digest":"sha256:faaa7eac7ffcf0f9c740af8e6741f7b9f10cf752a60304d80d3b345492d336b6","observation_id":"0f972a0d-d873-4440-8cfb-60c4bb9a6f0c","resolution":{"observed_at":"2026-08-02T08:30:02.169326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19472","last_updated":"2024-11-23T22:30:55Z","snapshot_observed_at":"2026-07-06T17:37:39.610989Z","submitted_at":"2024-02-29T18:58:26Z","title":"Efficient Lifelong Model Evaluation in an Era of Rapid Progress","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19472","snapshot_observed_at":"2026-08-02T08:30:02.296387Z","title":"Efficient lifelong model evaluation in an era of rapid progress","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22671","last_updated":"2026-07-06T17:26:46Z","snapshot_observed_at":"2026-08-06T17:18:06.876668Z","submitted_at":"2026-07-06T17:26:46Z","title":"AIR-BENCH Live: An Evolving Safety Benchmark for Foundation Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T08:30:02.296387Z"},"links":{"cited_paper":"/paper/2402.19472","citing_paper":"/paper/2607.22671"},"observation_digest":"sha256:9645b22d40e2900d8226271a12f663946bda632c70a18440cca7ca9fcece6d51","observation_id":"f3cfd0f3-8a9d-4f62-8dc1-c81f68a6f945","resolution":{"observed_at":"2026-08-02T08:30:02.296387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-08-08T01:20:38.655253Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-08-02T08:30:02.436170Z","title":"Jailbreakradar: Compre- hensive assessment of jailbreak attacks against llms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22671","last_updated":"2026-07-06T17:26:46Z","snapshot_observed_at":"2026-08-06T17:18:06.876668Z","submitted_at":"2026-07-06T17:26:46Z","title":"AIR-BENCH Live: An Evolving Safety Benchmark for Foundation Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T08:30:02.436170Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2607.22671"},"observation_digest":"sha256:dbad0365c7fe5deb47b2bbbe75b2ec94658daca5c0dd0699360903bf359c4fa0","observation_id":"30413506-c871-4d98-ae6d-1776f7b318c1","resolution":{"observed_at":"2026-08-02T08:30:02.436170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10260","last_updated":"2024-08-27T03:32:47Z","snapshot_observed_at":"2026-08-04T21:32:35.483431Z","submitted_at":"2024-02-15T18:58:09Z","title":"A StrongREJECT for Empty Jailbreaks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10260","snapshot_observed_at":"2026-08-02T08:30:02.544455Z","title":"A strongreject for empty jailbreaks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22671","last_updated":"2026-07-06T17:26:46Z","snapshot_observed_at":"2026-08-06T17:18:06.876668Z","submitted_at":"2026-07-06T17:26:46Z","title":"AIR-BENCH Live: An Evolving Safety Benchmark for Foundation Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T08:30:02.544455Z"},"links":{"cited_paper":"/paper/2402.10260","citing_paper":"/paper/2607.22671"},"observation_digest":"sha256:b55b0ee253bd4c6c0ae7d3f39d9cba78290dc11d9fb75d655b48be4a783adad4","observation_id":"f2e3467d-7751-4f28-bad3-7c6228ef7cdd","resolution":{"observed_at":"2026-08-02T08:30:02.544455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-07-06T17:26:23.067923Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-02T08:30:02.650997Z","title":"Harmbench: A standardized evaluation framework for automated red teaming and robust refusal.https://arxiv.org/abs/2402.04249, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22671","last_updated":"2026-07-06T17:26:46Z","snapshot_observed_at":"2026-08-06T17:18:06.876668Z","submitted_at":"2026-07-06T17:26:46Z","title":"AIR-BENCH Live: An Evolving Safety Benchmark for Foundation Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T08:30:02.650997Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2607.22671"},"observation_digest":"sha256:b9a4308b1047974e31296d70d8aa9e0041e82bcdb20f416aa820c27710580e03","observation_id":"1454c5be-6874-433b-8997-3ecedb3c92fc","resolution":{"observed_at":"2026-08-02T08:30:02.650997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18495","last_updated":"2024-12-09T20:21:56Z","snapshot_observed_at":"2026-08-06T04:32:59.039501Z","submitted_at":"2024-06-26T16:58:20Z","title":"WildGuard: Open One-Stop Moderation Tools for Safety Risks, Jailbreaks, and Refusals of LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18495","snapshot_observed_at":"2026-08-02T08:30:02.738917Z","title":"Wildguard: Open one-stop moderation tools for safety risks, jailbreaks, and refusals of llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22671","last_updated":"2026-07-06T17:26:46Z","snapshot_observed_at":"2026-08-06T17:18:06.876668Z","submitted_at":"2026-07-06T17:26:46Z","title":"AIR-BENCH Live: An Evolving Safety Benchmark for Foundation Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T08:30:02.738917Z"},"links":{"cited_paper":"/paper/2406.18495","citing_paper":"/paper/2607.22671"},"observation_digest":"sha256:0156a0082a0febdbd8adcf06063697b1fc56b8d9866d1d6e8466ae56a520ae0a","observation_id":"eeef61b5-ac50-49ac-af96-5da9471ba9a9","resolution":{"observed_at":"2026-08-02T08:30:02.738917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07045","last_updated":"2024-06-24T04:04:21Z","snapshot_observed_at":"2026-08-09T10:42:31.794884Z","submitted_at":"2023-09-13T15:56:50Z","title":"SafetyBench: Evaluating the Safety of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07045","snapshot_observed_at":"2026-08-02T08:30:02.855362Z","title":"Safetybench: Evaluating the safety of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22671","last_updated":"2026-07-06T17:26:46Z","snapshot_observed_at":"2026-08-06T17:18:06.876668Z","submitted_at":"2026-07-06T17:26:46Z","title":"AIR-BENCH Live: An Evolving Safety Benchmark for Foundation Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T08:30:02.855362Z"},"links":{"cited_paper":"/paper/2309.07045","citing_paper":"/paper/2607.22671"},"observation_digest":"sha256:945d7531a0146619b9b67b5765c2b279ece4ac446dd31558e84f0c497ba00c6a","observation_id":"e6acd021-14d3-4938-a9b6-830ddaa8c29f","resolution":{"observed_at":"2026-08-02T08:30:02.855362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06322","last_updated":"2025-01-10T19:56:50Z","snapshot_observed_at":"2026-07-30T22:07:13.869232Z","submitted_at":"2025-01-10T19:56:50Z","title":"Multi-Agent Collaboration Mechanisms: A Survey of LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.06322","snapshot_observed_at":"2026-08-02T08:30:02.978357Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22671","last_updated":"2026-07-06T17:26:46Z","snapshot_observed_at":"2026-08-06T17:18:06.876668Z","submitted_at":"2026-07-06T17:26:46Z","title":"AIR-BENCH Live: An Evolving Safety Benchmark for Foundation Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T08:30:02.978357Z"},"links":{"cited_paper":"/paper/2501.06322","citing_paper":"/paper/2607.22671"},"observation_digest":"sha256:2cd2c33440c9304612ecfa8eeb18305058ece29c2979d5b43bb6a58d9d0e0f5f","observation_id":"1bbe50c0-8d4e-471e-9649-685069e9585f","resolution":{"observed_at":"2026-08-02T08:30:02.978357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.20094","last_updated":"2025-05-08T00:24:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-28T17:59:01Z","title":"Scaling Synthetic Data Creation with 1,000,000,000 Personas","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.20094","snapshot_observed_at":"2026-08-02T08:30:03.086317Z","title":"Scaling synthetic data creation with 1,000,000,000 personas.https://arxiv.org/abs/2406.20094, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22671","last_updated":"2026-07-06T17:26:46Z","snapshot_observed_at":"2026-08-06T17:18:06.876668Z","submitted_at":"2026-07-06T17:26:46Z","title":"AIR-BENCH Live: An Evolving Safety Benchmark for Foundation Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T08:30:03.086317Z"},"links":{"cited_paper":"/paper/2406.20094","citing_paper":"/paper/2607.22671"},"observation_digest":"sha256:90a76825fa5315dac20d5bd36d589bec9a83e0f283fa4e3e5dcc111a79e489b4","observation_id":"e6f1fdf6-ac2d-4467-938a-a90226758841","resolution":{"observed_at":"2026-08-02T08:30:03.086317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.22671","last_updated":"2026-07-06T17:26:46Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-06T17:18:06.876668Z","submitted_at":"2026-07-06T17:26:46Z","title":"AIR-BENCH Live: An Evolving Safety Benchmark for Foundation Models"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 0 inbound Pith citation observations for arXiv:2607.22671."}