{"as_of":"2026-08-01T09:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:909f943db2fabcb63107d58dc6433fd58e3e1d38c628529baad7949241030692","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-01T06:32:01.292127+00:00","state":"measured"},{"denominator":35,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T23:24:19.561447Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-10T06:15:00.866473Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2305.09620","last_updated":"2026-05-19T19:24:46Z","snapshot_observed_at":"2026-07-06T15:28:16.998343Z","submitted_at":"2023-05-16T17:13:07Z","title":"AI-Augmented Surveys: Leveraging Large Language Models and Surveys for Opinion Prediction","version":4},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-05-24T08:47:23.231930Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2305.09620"},"observation_digest":"sha256:7616ed0ec075bd30a14414e7265749196643f40a3ad12689cf010833f07bda2b","observation_id":"604417e3-3264-4da5-b336-4c161674a669","resolution":{"observed_at":"2026-05-24T08:49:13.910243Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-05-24T05:00:28.453838Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2312.11805"},"observation_digest":"sha256:09c5139ae7f75a6538b0c73f91d156a04dd8ad2675d97e52ae5f3bebc4ee0ebf","observation_id":"322984e0-ed5c-4f59-bc4a-fdd194faa95f","resolution":{"observed_at":"2026-05-24T05:03:55.499819Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2401.05561","last_updated":"2024-09-30T10:17:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-10T22:07:21Z","title":"TrustLLM: Trustworthiness in Large Language Models","version":6},"reference_index":178,"source":"pdf_text","source_observed_at":"2026-05-18T11:17:08.108565Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2401.05561"},"observation_digest":"sha256:d7722401cfcab1c715c673fbcb5c907b163ebff0e882b7c3e85240d471276df9","observation_id":"e567a0de-1275-4d07-9569-096c39ef0453","resolution":{"observed_at":"2026-05-18T11:17:08.559994Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-10T12:11:16.326752Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2408.00118"},"observation_digest":"sha256:6f935d5fe783f31817ef2ff1b9dda7cdbb934a421175e6645ab6fb781c2386b3","observation_id":"5c16d358-cca0-46ce-8ba2-7bc8d01dac6a","resolution":{"observed_at":"2026-05-10T12:11:16.458916Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2502.18864","last_updated":"2025-02-26T06:17:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-26T06:17:13Z","title":"Towards an AI co-scientist","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-11T13:02:43.571234Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2502.18864"},"observation_digest":"sha256:2b53ce7caed51a61be0e6f9d221098fa86afeadba5b40f1c63d51ca5e3ec40e0","observation_id":"203605c6-35df-4a78-a504-9babfc3fd8af","resolution":{"observed_at":"2026-05-11T13:02:44.555404Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2506.06414","last_updated":"2026-04-20T20:58:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-06T17:33:33Z","title":"Benchmarking Misuse Mitigation Against Covert Adversaries","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-19T10:29:05.104520Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2506.06414"},"observation_digest":"sha256:1fb72f4a322cf4a452f3170ae63c6e47de5b2a399da7c2c2b4ba7069d919735c","observation_id":"a5823278-1eef-4d29-9d9f-d89cf8709360","resolution":{"observed_at":"2026-05-19T10:32:14.669979Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2506.07586","last_updated":"2026-04-30T11:06:08Z","snapshot_observed_at":"2026-07-06T21:38:59.043196Z","submitted_at":"2025-06-09T09:32:03Z","title":"MalGEN: A Testbed for Modeling and Evaluating Malware Behaviors","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-19T11:04:23.938028Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2506.07586"},"observation_digest":"sha256:01d2128e3234d060ba7deb35fc3e9f677c2c827f3a4d157149e6ccd514e89399","observation_id":"ae0ef045-e116-48ed-84e6-14f9f36aac9a","resolution":{"observed_at":"2026-05-19T11:07:15.347544Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2511.05914","last_updated":"2026-04-14T09:51:54Z","snapshot_observed_at":"2026-07-06T22:35:13.699594Z","submitted_at":"2025-11-08T08:22:16Z","title":"Designing Incident Reporting Systems for Harms from General-Purpose AI","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-18T00:16:17.173186Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2511.05914"},"observation_digest":"sha256:9845d789f4d99d709288e338398d580efc12cc9fe3e4144ec0b796b9010a0324","observation_id":"3c1b739c-c238-469b-a268-36ebc6ea9d53","resolution":{"observed_at":"2026-05-18T00:20:32.268321Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2512.05742","last_updated":"2026-05-20T12:16:41Z","snapshot_observed_at":"2026-07-06T22:37:54.987339Z","submitted_at":"2025-12-05T14:21:02Z","title":"Internal Deployment in the AI Act","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-21T17:51:47.841707Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2512.05742"},"observation_digest":"sha256:40f7307385ccf1f9d6b658831de615caec4b6e50d55569dfefead8e7dc9966a5","observation_id":"e229ee5b-ed62-464e-b88a-83c79af78af3","resolution":{"observed_at":"2026-05-21T17:54:18.544842Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2604.12601","last_updated":"2026-04-14T11:27:32Z","snapshot_observed_at":"2026-07-06T23:00:46.620106Z","submitted_at":"2026-04-14T11:27:32Z","title":"LLM-Guided Prompt Evolution for Password Guessing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T14:50:46.308625Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2604.12601"},"observation_digest":"sha256:0e220e0e102db4acffecaaa42520e46851e6437f57d247d5ab4d53f217859a0c","observation_id":"ae434422-e6ff-4489-91f0-5e33c4893222","resolution":{"observed_at":"2026-05-11T11:31:01.210679Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2604.17396","last_updated":"2026-04-19T11:59:58Z","snapshot_observed_at":"2026-07-06T23:04:32.734175Z","submitted_at":"2026-04-19T11:59:58Z","title":"Representation-Guided Parameter-Efficient LLM Unlearning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-10T06:01:46.885030Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2604.17396"},"observation_digest":"sha256:46f080283f630325eacbef3eed4dff13f287b861adfdbecc7afed505ba22f794","observation_id":"1f6a3b20-f614-4c80-a058-4dff33e7f0d8","resolution":{"observed_at":"2026-05-10T06:06:19.409992Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2604.21769","last_updated":"2026-04-23T15:28:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-23T15:28:32Z","title":"Who Defines \"Best\"? Towards Interactive, User-Defined Evaluation of LLM Leaderboards","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-09T21:58:05.584559Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2604.21769"},"observation_digest":"sha256:c25aa4b724e3e67438d82db4bb25e1ef15be035d1e2ecbefb80e9083fa39c432","observation_id":"ef47b39b-b3c0-486c-99b4-91d58f4a3192","resolution":{"observed_at":"2026-05-11T14:21:07.365784Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2604.24966","last_updated":"2026-04-27T20:07:09Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T20:07:09Z","title":"Risk Reporting for Developers' Internal AI Model Use","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-07T17:47:21.321820Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2604.24966"},"observation_digest":"sha256:18acfa9dd2703d7db5bd10c1cc2f8ffa8d15e18dadf92641dedc80af344f3ef6","observation_id":"e57dc426-ca56-4c82-b65b-78808d36c75f","resolution":{"observed_at":"2026-05-11T23:16:16.432362Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2604.25119","last_updated":"2026-04-28T01:54:25Z","snapshot_observed_at":"2026-07-06T23:11:02.043135Z","submitted_at":"2026-04-28T01:54:25Z","title":"Evaluation without Generation: Non-Generative Assessment of Harmful Model Specialization with Applications to CSAM","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-07T16:55:19.775120Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2604.25119"},"observation_digest":"sha256:650ae752ca93574100df695ab03191c2cab88b7d1d58a277baa1a89cd9087b95","observation_id":"fa8dc43b-6271-499b-9812-a4d0c020d8c0","resolution":{"observed_at":"2026-05-11T23:31:14.196298Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2605.01420","last_updated":"2026-05-02T12:37:28Z","snapshot_observed_at":"2026-07-06T23:14:38.379875Z","submitted_at":"2026-05-02T12:37:28Z","title":"Artificial Jagged Intelligence as Uneven Optimization Energy Allocation Capability Concentration, Redistribution, and Optimization Governance","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-09T14:13:59.908810Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2605.01420"},"observation_digest":"sha256:7d036233fdde1f7b661ffa7832f84b7c03a2b6f92cfd51a3498d09f94f74a91f","observation_id":"70fa7b83-c04f-41ad-b983-ff44680cfb62","resolution":{"observed_at":"2026-05-11T17:01:09.016460Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2605.03179","last_updated":"2026-05-04T21:42:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-04T21:42:10Z","title":"A Validated Prompt Bank for Malicious Code Generation: Separating Executable Weapons from Security Knowledge in 1,554 Consensus-Labeled Prompts","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-08T18:11:29.066362Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2605.03179"},"observation_digest":"sha256:883280b1e72d19fe5a01d428ae04996c1ef736604c9e95c186687b5db8119d36","observation_id":"bcc58897-32c0-4dcf-93e3-8d1564eb52cd","resolution":{"observed_at":"2026-05-09T06:40:43.534363Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2605.06652","last_updated":"2026-05-07T17:56:41Z","snapshot_observed_at":"2026-07-06T23:19:05.764765Z","submitted_at":"2026-05-07T17:56:41Z","title":"When No Benchmark Exists: Validating Comparative LLM Safety Scoring Without Ground-Truth Labels","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-08T12:07:02.778631Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2605.06652"},"observation_digest":"sha256:d4495ff8e891d1f92a6a86a995030218f1e90ffa4ce2b8d8fcfb70e9f9a20266","observation_id":"612496ef-2aad-468a-b2f1-e8b1fdc66928","resolution":{"observed_at":"2026-05-08T21:39:24.651511Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2605.12199","last_updated":"2026-05-12T14:37:55Z","snapshot_observed_at":"2026-07-06T23:23:54.142937Z","submitted_at":"2026-05-12T14:37:55Z","title":"Overtrained, Not Misaligned","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-13T06:45:52.544674Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2605.12199"},"observation_digest":"sha256:ee3aaed33d88cef03027b2288f67fb0b9ef58204ccc79603c1765fb2609e0506","observation_id":"4abdc819-bec3-4252-9092-d4bf6a8d8648","resolution":{"observed_at":"2026-05-13T06:47:26.248329Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2605.12288","last_updated":"2026-06-10T07:32:21Z","snapshot_observed_at":"2026-07-06T23:23:59.123377Z","submitted_at":"2026-05-12T15:44:33Z","title":"TokenRatio: Principled Token-Level Preference Optimization via Ratio Matching","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-05-13T04:55:55.013900Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2605.12288"},"observation_digest":"sha256:132a8af3565621a9ffe947730f79701fc87d01f627db8e02e40667e3eb345a11","observation_id":"2a4f006a-c173-44c6-8881-bf25d2053da4","resolution":{"observed_at":"2026-05-13T04:57:17.277926Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2605.12288","last_updated":"2026-06-10T07:32:21Z","snapshot_observed_at":"2026-07-06T23:23:59.123377Z","submitted_at":"2026-05-12T15:44:33Z","title":"TokenRatio: Principled Token-Level Preference Optimization via Ratio Matching","version":2},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-05-15T05:41:10.714594Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2605.12288"},"observation_digest":"sha256:a15a032bfa541d7a20abc58dc7504fdc1f1d5259c385f127c6d4e43b2ecef324","observation_id":"0edff6ea-befb-4647-851b-bc7182eea175","resolution":{"observed_at":"2026-05-15T05:45:06.474151Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2605.15164","last_updated":"2026-05-14T17:54:28Z","snapshot_observed_at":"2026-07-06T23:26:28.006734Z","submitted_at":"2026-05-14T17:54:28Z","title":"Position: Behavioural Assurance Cannot Verify the Safety Claims Governance Now Demands","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T20:53:04.274840Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2605.15164"},"observation_digest":"sha256:e0fc8fb994d469c0b3c38d03d8d2d35ed8dd910b6623f88cd2c21220b4d95ffa","observation_id":"6aec64f0-8e08-4930-af60-720b9a55ea30","resolution":{"observed_at":"2026-06-30T20:55:03.991229Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2605.19722","last_updated":"2026-05-19T11:55:54Z","snapshot_observed_at":"2026-07-06T23:30:25.609722Z","submitted_at":"2026-05-19T11:55:54Z","title":"Measuring Safety Alignment Effects in Autonomous Security Agents","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-20T04:24:46.357505Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2605.19722"},"observation_digest":"sha256:c1d9601632eb7e577ede52810b6353d2e574825052caaaef03818acaf16d5ece","observation_id":"ce90f471-643a-4f7f-a4ff-9105b12525d2","resolution":{"observed_at":"2026-05-20T04:28:05.922999Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2605.21095","last_updated":"2026-05-20T12:27:21Z","snapshot_observed_at":"2026-07-06T23:31:37.061253Z","submitted_at":"2026-05-20T12:27:21Z","title":"Backchaining Loss of Control Mitigations from Mission-Specific Benchmarks in National Security","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-21T02:01:42.033718Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2605.21095"},"observation_digest":"sha256:25bb23c875f8a2ca0f4b3208c2210b94f1aec8accc9ca3d1b7f2121873dc2522","observation_id":"d0953d61-28a0-4d0a-bf04-78c563c4c583","resolution":{"observed_at":"2026-05-21T02:03:54.371283Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2605.21095","last_updated":"2026-05-20T12:27:21Z","snapshot_observed_at":"2026-07-06T23:31:37.061253Z","submitted_at":"2026-05-20T12:27:21Z","title":"Backchaining Loss of Control Mitigations from Mission-Specific Benchmarks in National Security","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-21T02:01:42.033718Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2605.21095"},"observation_digest":"sha256:289454d0597881470f79a49a49e4a96693b46cd12e59ab22c365c6bd6b4ad23a","observation_id":"501e47f3-025b-45c7-a4e5-82ee61a3cc84","resolution":{"observed_at":"2026-05-21T02:03:54.276808Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2606.02211","last_updated":"2026-06-01T13:10:49Z","snapshot_observed_at":"2026-07-06T23:42:39.606419Z","submitted_at":"2026-06-01T13:10:49Z","title":"Consistency Training while Mitigating Obfuscation via Rate Matching","version":1},"reference_index":138,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:43.147442Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2606.02211"},"observation_digest":"sha256:2673d7186dbfe4a8c3b98dde7e76b9f30c2f798bf2175ed4727a6d5f59eb52db","observation_id":"1463a8d7-e34d-4643-adf6-ffc0360b188b","resolution":{"observed_at":"2026-06-28T14:32:18.172629Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2606.05330","last_updated":"2026-06-03T18:17:20Z","snapshot_observed_at":"2026-07-30T14:44:31.303885Z","submitted_at":"2026-06-03T18:17:20Z","title":"A Model of Multi-turn Human Persuadability Using Probabilistic Belief Tracing","version":1},"reference_index":114,"source":"pdf_text","source_observed_at":"2026-06-28T06:17:01.173495Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2606.05330"},"observation_digest":"sha256:cb9e4cc2fe26b4edf4fd64ea7a72d513007c0ee46430c9800aa9d3d2c72bd5bf","observation_id":"89d9bf51-6c35-487a-ac47-5266fa246336","resolution":{"observed_at":"2026-07-02T08:16:47.473340Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2606.06286","last_updated":"2026-06-04T15:25:24Z","snapshot_observed_at":"2026-08-01T08:56:54.370615Z","submitted_at":"2026-06-04T15:25:24Z","title":"LLMs Can Leak Training Data But Do They Want To? A Propensity-Aware Evaluation of Memorization in LLMs","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-28T01:40:53.284131Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2606.06286"},"observation_digest":"sha256:21d4465ffe29ba47ac22cdb89d7f7b656a862645f695e48b24c7ae7c5e4374b2","observation_id":"bce19943-8a43-49cf-9f23-fb169f0bc0cb","resolution":{"observed_at":"2026-06-28T01:41:29.305785Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2606.09809","last_updated":"2026-06-08T17:55:02Z","snapshot_observed_at":"2026-07-06T23:49:08.412079Z","submitted_at":"2026-06-08T17:55:02Z","title":"Evaluation Cards: An Interpretive Layer for AI Evaluation Reporting","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-06-27T16:11:36.483820Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2606.09809"},"observation_digest":"sha256:0099bf4d99c89d7fb5b8ea34d0d18147bcd1b1355e61c9f9774e1d559e52d1b7","observation_id":"2aad5fe4-fc00-42c9-9231-205c1d2855b6","resolution":{"observed_at":"2026-07-03T02:07:33.287703Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2606.18532","last_updated":"2026-06-16T22:57:24Z","snapshot_observed_at":"2026-07-06T23:53:59.519305Z","submitted_at":"2026-06-16T22:57:24Z","title":"AI Sandboxes: A Threat Model, Taxonomy, and Measurement Framework","version":1},"reference_index":142,"source":"pdf_text","source_observed_at":"2026-06-26T23:42:20.304205Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2606.18532"},"observation_digest":"sha256:1e9beba7e73944bc22a5f1cb426c330a7c12b5febead6a69ddb69da825393b34","observation_id":"fae8241c-6b94-4ea4-895c-e5540ed2c83c","resolution":{"observed_at":"2026-07-03T22:08:59.936017Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":"2305.15324","doi":"10.48550/arxiv.2305.15324","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Model evaluation for extreme risks","venue":null,"work_id":"12dff4e7-a81d-4b95-aba7-885a457042c6","year":2023},"citing_paper":{"arxiv_id":"2607.01854","last_updated":"2026-07-02T08:15:25Z","snapshot_observed_at":"2026-07-07T00:07:23.664493Z","submitted_at":"2026-07-02T08:15:25Z","title":"Has This Checkpoint Been Abliterated? A Two-Signal Audit and Its Failure Map","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-03T10:54:37.039277Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2607.01854"},"observation_digest":"sha256:1497108d32cfa30bbda6f3c821c4c69f69bf9e1476c6ba73f2813693da45b32b","observation_id":"c2a1ea71-96f9-4b62-9533-dff80c7ec0c2","resolution":{"observed_at":"2026-07-03T10:58:02.494876Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:52:16.870575+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-12T02:36:01.385664Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03423","last_updated":"2026-07-03T15:36:44Z","snapshot_observed_at":"2026-07-12T02:36:00.911087Z","submitted_at":"2026-07-03T15:36:44Z","title":"Securing Multi-Tool AI Agent Chains With Dynamic, Real-Time Compositional Policies","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-12T02:36:01.385664Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2607.03423"},"observation_digest":"sha256:b41ae45cd8ec9d5aba827938c2426b3dc05d91f0c5bbcb429fae96a0a0b2a022","observation_id":"8c1c4471-e678-41dd-81b0-679306396f64","resolution":{"observed_at":"2026-07-12T02:36:01.385664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-12T01:45:06.581823Z","title":"Model evaluation for extreme risks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03542","last_updated":"2026-07-03T18:01:41Z","snapshot_observed_at":"2026-07-12T01:45:03.951929Z","submitted_at":"2026-07-03T18:01:41Z","title":"Macro-Prudential AI Governance: A Two-Layer Early Warning and Response System for Frontier AI","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-07-12T01:45:06.581823Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2607.03542"},"observation_digest":"sha256:02844f956114c29945fd59d537b23b264c26f26b94cb132df1a295f21d909dc2","observation_id":"bcf9b8d3-76a9-4a20-8afa-d14f60399198","resolution":{"observed_at":"2026-07-12T01:45:06.581823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-11T07:50:18.332768Z","title":"arXiv preprint arXiv:2305.15324 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05163","last_updated":"2026-07-06T14:46:49Z","snapshot_observed_at":"2026-07-11T07:50:15.294192Z","submitted_at":"2026-07-06T14:46:49Z","title":"Open Problems in AI Incident Governance","version":1},"reference_index":107,"source":"arxiv_source","source_observed_at":"2026-07-11T07:50:18.332768Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2607.05163"},"observation_digest":"sha256:8f042ac08151557876ac98529b5f418b15393fe14155a7cf381a567580bbbe33","observation_id":"215fec64-896f-44cb-9cd7-3387bec92bf5","resolution":{"observed_at":"2026-07-11T07:50:18.332768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-14T11:20:52.129640Z","title":"arXiv preprint arXiv:2305.15324 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10490","last_updated":"2026-07-11T21:54:20Z","snapshot_observed_at":"2026-07-16T23:18:24.147822Z","submitted_at":"2026-07-11T21:54:20Z","title":"NetInjectBench: Benchmarking Indirect Prompt Injection in Tool-Using Large Language Model Agents for Network Operations","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-07-14T11:20:52.129640Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2607.10490"},"observation_digest":"sha256:bbc65e36ae1a862b3eab0711aca34bd958cf8f4168668db69c5858b18cacd291","observation_id":"49d6e1a2-c8ae-4098-810d-ef6e0cd631dc","resolution":{"observed_at":"2026-07-14T11:20:52.129640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15324","snapshot_observed_at":"2026-07-31T23:24:19.561447Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23999","last_updated":"2026-07-28T07:27:46Z","snapshot_observed_at":"2026-08-01T00:02:12.182714Z","submitted_at":"2026-07-27T04:51:20Z","title":"ContainmentBench: Trace-Based Evaluation of Post-Injection Containment in Tool-Using LLM Agents","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-31T23:24:19.561447Z"},"links":{"cited_paper":"/paper/2305.15324","citing_paper":"/paper/2607.23999"},"observation_digest":"sha256:c45c69181c460b528272363f27cda6f5cb4cd6a48f246b540098faf84cc8b53d","observation_id":"91461674-e372-43c8-b8fd-57db70a1d14f","resolution":{"observed_at":"2026-07-31T23:24:19.561447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2305.15324/citation-record","integrity":"/paper/2305.15324/integrity","json":"/paper/2305.15324/citation-record.json","paper":"/paper/2305.15324"},"outbound":[],"paper":{"arxiv_id":"2305.15324","last_updated":"2023-09-22T18:48:42Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T16:38:43Z","title":"Model evaluation for extreme risks"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"thesis":"As of 1 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 35 inbound Pith citation observations for arXiv:2305.15324."}