{"as_of":"2026-08-07T05:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9d09e18296546c9a9606cea4729aa48e9ee0d41cdbdbd89484b508dee24157e8","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:14:23.018672Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T09:18:59.008107Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"cited_work":{"arxiv_id":"2507.16534","doi":"10.48550/arxiv.2507.16534","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.16534","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Frontier ai risk management framework in practice: A risk analysis technical report","venue":"ArXiv.org","work_id":"ce6125ac-5326-45b4-86bb-f2c4737f0548","year":2025},"citing_paper":{"arxiv_id":"2606.03811","last_updated":"2026-06-02T15:54:39Z","snapshot_observed_at":"2026-08-06T23:02:10.999457Z","submitted_at":"2026-06-02T15:54:39Z","title":"AI Agents Enable Adaptive Computer Worms","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-28T09:18:59.008107Z"},"links":{"cited_paper":"/paper/2507.16534","citing_paper":"/paper/2606.03811"},"observation_digest":"sha256:2ac8f5340649e99bb2be49a83abbea23c2be8cb20188526d01654216b570e7b1","observation_id":"f781125e-9a5a-4396-87c3-56b24ecd8e26","resolution":{"observed_at":"2026-06-28T09:21:49.378804Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.16534/citation-record","integrity":"/paper/2507.16534/integrity","json":"/paper/2507.16534/citation-record.json","paper":"/paper/2507.16534"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.03789","last_updated":"2024-08-31T19:15:38Z","snapshot_observed_at":"2026-08-06T13:32:54.258151Z","submitted_at":"2024-08-31T19:15:38Z","title":"BreachSeek: A Multi-Agent Automated Penetration Tester","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03789","snapshot_observed_at":"2026-08-06T15:14:21.557548Z","title":"Anthropic","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:21.557548Z"},"links":{"cited_paper":"/paper/2409.03789","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:9c6c9ded0ab837633c3f986c5200cb50f17141a7740a1cd261cb95cc165699c2","observation_id":"87e7b001-350c-4616-af54-89f5e6b64167","resolution":{"observed_at":"2026-08-06T15:14:21.557548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18565","last_updated":"2025-05-05T20:52:36Z","snapshot_observed_at":"2026-08-06T04:13:55.623494Z","submitted_at":"2025-04-21T11:39:22Z","title":"RepliBench: Evaluating the Autonomous Replication Capabilities of Language Model Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.18565","snapshot_observed_at":"2026-08-06T15:14:21.791055Z","title":"Replibench: Evaluating the autonomous replication capabilities of language model agents.arXiv preprint arXiv:2504.18565,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:21.791055Z"},"links":{"cited_paper":"/paper/2504.18565","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:f8b22c33b50746589daf2b2d89e5f87a146587b9c9aaf503cb01977613b58ea6","observation_id":"1caa89ce-d703-4800-bc51-1c1fc2ae7ed8","resolution":{"observed_at":"2026-08-06T15:14:21.791055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:14:24.021999Z","title":"Accessed: 2025-06-19","venue":null,"work_id":"5eb05500-2da5-4772-b1b7-932423b743cb","year":2025},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:21.939704Z"},"links":{"citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:a1bffb037b442169f631f3ae67bcbecb7f630785c10bbbe12cdc0ca48bed4563","observation_id":"96732b36-dfbd-4014-a33f-523f5a0f6fc3","resolution":{"observed_at":"2026-08-06T15:14:24.027670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-06T15:14:22.020933Z","title":"DeepSeek-AI","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.020933Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:537855404b753f7f01510b8caab6910910c0e49843e499fee9c1c4a7f601e6a3","observation_id":"d3c26d2a-fd3f-4ecd-94c6-92a3d98e3565","resolution":{"observed_at":"2026-08-06T15:14:22.020933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T15:14:22.121008Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.121008Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:2a36bdd8be7e38f31865386c71d58322d10e8efcae0a6c3d5b2ee02dbf5cca5d","observation_id":"d0e9f8ec-2569-4156-86f9-5e008b821167","resolution":{"observed_at":"2026-08-06T15:14:22.121008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:14:22.185824Z","title":"Sciknoweval: Evaluating multi-level scientific knowledge of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.185824Z"},"links":{"citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:033cd45169befa5e7f404804c17df16d8b3324e076019d098d1bb010a0bd396f","observation_id":"278e80e6-66d3-409e-b85d-a4c1c121a7ef","resolution":{"observed_at":"2026-08-06T15:14:22.185824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16137","last_updated":"2025-04-29T15:14:35Z","snapshot_observed_at":"2026-07-06T21:13:13.686703Z","submitted_at":"2025-04-21T21:04:01Z","title":"Virology Capabilities Test (VCT): A Multimodal Virology Q&A Benchmark","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16137","snapshot_observed_at":"2026-08-06T15:14:22.300029Z","title":"Accessed: 2025-07-13","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.300029Z"},"links":{"cited_paper":"/paper/2504.16137","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:1b332f91474b9f42c45e0a1b3241abea00bcb705878ef11643ab38f83dec1d01","observation_id":"25ee9542-ef06-462f-a86a-b32797ca7a00","resolution":{"observed_at":"2026-08-06T15:14:22.300029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T15:14:22.418574Z","title":"Gemini 2.5 flash preview model card, 2025a","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.418574Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:3115ea6a330eb418df59d5791c08c94d86790f9b4f36e35cd8c1971d6e04da19","observation_id":"1f1df01c-3831-4f67-be33-83ff168ce5f8","resolution":{"observed_at":"2026-08-06T15:14:22.418574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14093","last_updated":"2024-12-20T02:22:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T17:41:24Z","title":"Alignment faking in large language models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14093","snapshot_observed_at":"2026-08-06T15:14:22.519969Z","title":"Alignment faking in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.519969Z"},"links":{"cited_paper":"/paper/2412.14093","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:88f1cd3f91b1f1f066db4ebc9073ee94a0546bb30eafdab6df5900fc407ab20c","observation_id":"e4758feb-304a-485c-934f-522f1505f8f2","resolution":{"observed_at":"2026-08-06T15:14:22.519969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14143","last_updated":"2025-02-19T23:03:21Z","snapshot_observed_at":"2026-07-06T20:39:28.583884Z","submitted_at":"2025-02-19T23:03:21Z","title":"Multi-Agent Risks from Advanced AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14143","snapshot_observed_at":"2026-08-06T15:14:22.652580Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.652580Z"},"links":{"cited_paper":"/paper/2502.14143","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:c9ae310f7748b669c956da92af0f8fc4529298a928eda1e8d88f06c5900f7c43","observation_id":"c9f31935-def7-4d11-ab8f-44771815d2c5","resolution":{"observed_at":"2026-08-06T15:14:22.652580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-06T15:14:22.743190Z","title":"Measuring massive multitask language understanding.arXiv preprint arXiv:2009.03300,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.743190Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:b5fb49bd587a7c71114bda578861059f298eefa9fa8df6b7b6db2d9912e29259","observation_id":"52f89928-a294-41b3-b949-9b5b8faae16c","resolution":{"observed_at":"2026-08-06T15:14:22.743190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T15:14:22.834304Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations.arXiv preprint arXiv:2312.06674,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.834304Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:d8924333d7312539b4a6dd368ab8338ab148b938fe246399591496b2d54fe433","observation_id":"a6528721-9175-4293-aa54-96cae918c15e","resolution":{"observed_at":"2026-08-06T15:14:22.834304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-06T15:14:22.844018Z","title":"Livecodebench: Holistic and contamination free evaluation of large language models for code.arXiv preprint arXiv:2403.07974,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.844018Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:bb537af39afa32b2cc233f5f6509fb91157668e85d144c305775f4b3c28f92d7","observation_id":"c6c98204-f467-4bbd-be04-871d7c2dbfe1","resolution":{"observed_at":"2026-08-06T15:14:22.844018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15513","last_updated":"2025-06-14T16:04:31Z","snapshot_observed_at":"2026-08-03T06:34:42.243765Z","submitted_at":"2024-06-20T18:37:36Z","title":"PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15513","snapshot_observed_at":"2026-08-06T15:14:22.849329Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.849329Z"},"links":{"cited_paper":"/paper/2406.15513","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:6eaec4771275622f634d7d0feaf89b3db2959edac9a71588b22f3e2a0a63453a","observation_id":"7cee2df6-4214-4911-bf5f-530698648edc","resolution":{"observed_at":"2026-08-06T15:14:22.849329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18807","last_updated":"2025-05-24T17:41:47Z","snapshot_observed_at":"2026-07-06T21:29:55.740715Z","submitted_at":"2025-05-24T17:41:47Z","title":"Mitigating Deceptive Alignment via Self-Monitoring","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18807","snapshot_observed_at":"2026-08-06T15:14:22.854339Z","title":"Mitigating deceptive alignment via self-monitoring.arXiv preprint arXiv:2505.18807,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.854339Z"},"links":{"cited_paper":"/paper/2505.18807","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:58a0e29f4797c07a1e963988e030551841ed4b71a9520b3c7210e0bfc8064286","observation_id":"50541677-0d41-417a-94bd-ff30d9a909d5","resolution":{"observed_at":"2026-08-06T15:14:22.854339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21605","last_updated":"2026-04-05T01:29:06Z","snapshot_observed_at":"2026-07-06T21:31:40.171357Z","submitted_at":"2025-05-27T17:47:08Z","title":"SoSBench: Benchmarking Safety Alignment on Six Scientific Domains","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21605","snapshot_observed_at":"2026-08-06T15:14:22.859306Z","title":"Sosbench: Benchmarking safety alignment on scientific knowledge","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.859306Z"},"links":{"cited_paper":"/paper/2505.21605","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:3d9ae8c74fa395206f94b5523f97ff5c20fe32b8512d9d6610247ca75b771a9c","observation_id":"c1dfdbb7-93ca-471b-a80f-efbeddb31a2d","resolution":{"observed_at":"2026-08-06T15:14:22.859306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20787","last_updated":"2025-01-06T07:22:50Z","snapshot_observed_at":"2026-08-05T03:53:59.997985Z","submitted_at":"2024-12-30T08:11:54Z","title":"SecBench: A Comprehensive Multi-Dimensional Benchmarking Dataset for LLMs in Cybersecurity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20787","snapshot_observed_at":"2026-08-06T15:14:22.863925Z","title":"Secbench: A comprehensive multi-dimensional benchmarking dataset for llms in cybersecurity.arXiv preprint arXiv:2412.20787,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.863925Z"},"links":{"cited_paper":"/paper/2412.20787","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:fea5a3a409fe1590da3aa4150bb8e1ca3137cab51c3d53a5a1c612637bd12fa5","observation_id":"63ae91d0-92bf-4670-bb24-cbd6f4184d1b","resolution":{"observed_at":"2026-08-06T15:14:22.863925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10362","last_updated":"2024-07-17T17:28:36Z","snapshot_observed_at":"2026-08-06T06:16:43.714786Z","submitted_at":"2024-07-14T23:52:25Z","title":"LAB-Bench: Measuring Capabilities of Language Models for Biology Research","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10362","snapshot_observed_at":"2026-08-06T15:14:22.869124Z","title":"Lab-bench: Measuring capabilities of language models for biology research.arXiv preprint arXiv:2407.10362,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.869124Z"},"links":{"cited_paper":"/paper/2407.10362","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:e09f26da38f193e40f5926067083d4cd677a2a8ec77e040595c4dacdf9641145","observation_id":"b3adbd70-7617-4799-bb22-0bfc8b9628b4","resolution":{"observed_at":"2026-08-06T15:14:22.869124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05044","last_updated":"2024-06-07T12:05:46Z","snapshot_observed_at":"2026-08-03T21:40:53.683032Z","submitted_at":"2024-02-07T17:33:54Z","title":"SALAD-Bench: A Hierarchical and Comprehensive Safety Benchmark for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05044","snapshot_observed_at":"2026-08-06T15:14:22.874665Z","title":"Salad-bench: A hierarchical and comprehensive safety benchmark for large language models.arXiv preprint arXiv:2402.05044, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.874665Z"},"links":{"cited_paper":"/paper/2402.05044","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:b86722bc3748fc0ba151c066472139ec52bf0054206b574a21ebdff19044c85c","observation_id":"f19f1ff8-ae1f-48e5-9ba7-d3826bd5e83a","resolution":{"observed_at":"2026-08-06T15:14:22.874665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:14:22.879999Z","title":"American invitational mathematics examination 2024,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.879999Z"},"links":{"citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:ca6f7211d523a576650f900c5beb297d3b0af89136b0a0671dff2bf8fa1d4b97","observation_id":"06b97683-5d85-4068-aa1c-34b691cebdb7","resolution":{"observed_at":"2026-08-06T15:14:22.879999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:14:23.973715Z","title":"Contest problems from the 2024 AIME competition","venue":null,"work_id":"13abe770-10c4-429f-a5d6-accff294a1ee","year":2024},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.884756Z"},"links":{"citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:60cc045861c102686ce4edb01dc732fc81d5338d5eaa8d86061b96d89ebc347d","observation_id":"6fe81f37-ab14-4d38-9829-7575cc8dc8ca","resolution":{"observed_at":"2026-08-06T15:14:23.978516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.06017","last_updated":"2025-04-09T13:54:18Z","snapshot_observed_at":"2026-07-06T21:06:08.430339Z","submitted_at":"2025-04-08T13:22:09Z","title":"CAI: An Open, Bug Bounty-Ready Cybersecurity AI","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.06017","snapshot_observed_at":"2026-08-06T15:14:22.889495Z","title":"Anay Mehrotra, Manolis Zampetakis, Paul Kassianik, Blaine Nelson, Hyrum Anderson, Yaron Singer, and Amin Karbasi","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.889495Z"},"links":{"cited_paper":"/paper/2504.06017","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:727328ebc1f5f71273fb052f5f710ed270865560cc1e3a8287afaf901fffcf67","observation_id":"cb2efb7f-7418-4292-8608-0d639b571c51","resolution":{"observed_at":"2026-08-06T15:14:22.889495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04984","last_updated":"2025-01-14T20:16:01Z","snapshot_observed_at":"2026-07-29T23:20:20.918596Z","submitted_at":"2024-12-06T12:09:50Z","title":"Frontier Models are Capable of In-context Scheming","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04984","snapshot_observed_at":"2026-08-06T15:14:22.894587Z","title":"Frontier models are capable of in-context scheming.arXiv preprint arXiv:2412.04984,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.894587Z"},"links":{"cited_paper":"/paper/2412.04984","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:a7a3227e2c1505819757f56a152ebaa3fce75cfa1facd0ff499a2eacc010611e","observation_id":"fdf74127-cb50-416c-9d5e-bcff8fc39895","resolution":{"observed_at":"2026-08-06T15:14:22.894587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:14:23.957277Z","title":"Responsible scaling policies (rsps).https://metr.org/blog/2023-09-26-rsp/, 09","venue":null,"work_id":"ba430a02-3e61-40a5-b72f-93d85d9cc961","year":2023},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.899057Z"},"links":{"citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:e12ebcd1d89e7b87201f260240a1a548491e4a48f5e6765ff67e9302795e75f3","observation_id":"ba52e359-94d8-4d62-8dd2-626fc61de117","resolution":{"observed_at":"2026-08-06T15:14:23.963015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12983","last_updated":"2023-11-21T20:34:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-21T20:34:47Z","title":"GAIA: a benchmark for General AI Assistants","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12983","snapshot_observed_at":"2026-08-06T15:14:22.907474Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.907474Z"},"links":{"cited_paper":"/paper/2311.12983","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:5a852103986a827a14b4b67d6d9f586f453cc7d3d7163d46d3a5c9b5558758c8","observation_id":"93fac917-a50b-44f4-876f-5feedcef89f4","resolution":{"observed_at":"2026-08-06T15:14:22.907474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:14:23.942526Z","title":null,"venue":null,"work_id":"2590a158-061b-4669-84dc-9fc6e5e175c6","year":2025},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.912298Z"},"links":{"citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:dcaf54b001769cad016a596a357cce2cc180f0b81b379b9f1b40259e90c726ba","observation_id":"be4d7f1d-a0a9-4166-83dd-5f37f87b8450","resolution":{"observed_at":"2026-08-06T15:14:23.946869Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:14:23.927850Z","title":"Accessed: 2025-07-13","venue":null,"work_id":"322ce285-e64c-4199-a55b-2093464bd205","year":2025},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.917782Z"},"links":{"citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:7b6335a566ed553579b28873727b223852623481850efe0c9744ae04dd085ffa","observation_id":"6acdd052-728a-470b-a7f7-8b50efb7cddb","resolution":{"observed_at":"2026-08-06T15:14:23.932093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17378","last_updated":"2025-03-25T13:38:18Z","snapshot_observed_at":"2026-07-06T20:56:53.615535Z","submitted_at":"2025-03-14T14:44:27Z","title":"Large language model-powered AI systems achieve self-replication with no human intervention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.17378","snapshot_observed_at":"2026-08-06T15:14:22.922224Z","title":"Accessed: 2025-06-19","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.922224Z"},"links":{"cited_paper":"/paper/2503.17378","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:cb63b71583e6bd32b3280db956d3e8f86f00608c89834994728ec236eb10fc29","observation_id":"83e52089-9a2b-4838-b162-475dc803f59e","resolution":{"observed_at":"2026-08-06T15:14:22.922224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13793","last_updated":"2024-04-05T12:26:11Z","snapshot_observed_at":"2026-08-03T18:07:25.978533Z","submitted_at":"2024-03-20T17:54:26Z","title":"Evaluating Frontier Models for Dangerous Capabilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13793","snapshot_observed_at":"2026-08-06T15:14:22.926909Z","title":"OpenAI Re- search Publication","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.926909Z"},"links":{"cited_paper":"/paper/2403.13793","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:2ac913423322a1fa05ae0ff84fb09f401562a541b142aa212d20061ecafb014d","observation_id":"ded1746d-a757-43f2-ae1c-421e4d68f658","resolution":{"observed_at":"2026-08-06T15:14:22.926909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.00207","last_updated":"2019-08-28T21:35:38Z","snapshot_observed_at":"2026-07-31T15:34:21.257195Z","submitted_at":"2018-11-01T03:43:10Z","title":"Towards Empathetic Open-domain Conversation Models: a New Benchmark and Dataset","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.00207","snapshot_observed_at":"2026-08-06T15:14:22.932039Z","title":"Towards empathetic open-domain conversation models: A new benchmark and dataset.arXiv preprint arXiv:1811.00207,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.932039Z"},"links":{"cited_paper":"/paper/1811.00207","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:88e6d4efd5a04cd58ef5c1c90a423a8636207f742e2b6f218d71d6fcb13dd3ac","observation_id":"eb9e64a6-a0eb-46a9-9d7e-d14847fea8cc","resolution":{"observed_at":"2026-08-06T15:14:22.932039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-04T22:55:15.345443Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-06T15:14:22.942276Z","title":"Qibing Ren, Hao Li, Dongrui Liu, Zhanxu Xie, Xiaoya Lu, Yu Qiao, Lei Sha, Junchi Yan, Lizhuang Ma, and Jing Shao","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.942276Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:48093898cb1bd83ed60aef460e2a5a62d34ea895a0fa0bf736cd7390df99c86d","observation_id":"8cb89a31-cc0e-4952-adca-938f89183e31","resolution":{"observed_at":"2026-08-06T15:14:22.942276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.14660","last_updated":"2025-07-24T06:00:02Z","snapshot_observed_at":"2026-08-07T03:49:49.965211Z","submitted_at":"2025-07-19T15:17:30Z","title":"When Autonomy Goes Rogue: Preparing for Risks of Multi-Agent Collusion in Social Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.14660","snapshot_observed_at":"2026-08-06T15:14:22.946739Z","title":"When autonomy goes rogue: Preparing for risks of multi-agent collusion in social systems, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.946739Z"},"links":{"cited_paper":"/paper/2507.14660","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:fb8a11c35c9075f150148df84e96b6e118f0605eefb5b92fec187f78a8339adc","observation_id":"0f26c0a8-a4e0-4f35-b9db-a6df662b0251","resolution":{"observed_at":"2026-08-06T15:14:22.946739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13548","last_updated":"2025-05-10T07:10:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-20T14:46:48Z","title":"Towards Understanding Sycophancy in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13548","snapshot_observed_at":"2026-08-06T15:14:22.951866Z","title":"Mrinank Sharma, Meg Tong, Tomasz Korbak, David Duvenaud, Amanda Askell, Samuel R Bowman, Newton Cheng, Esin Durmus, Zac Hatfield-Dodds, Scott R Johnston, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.951866Z"},"links":{"cited_paper":"/paper/2310.13548","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:ca5b09b9056182ac66e2b8f87d4a4f86f733bb58d1f38e0b09e65af87e870cdd","observation_id":"1a1a5579-dcf3-487f-b11b-651db1286378","resolution":{"observed_at":"2026-08-06T15:14:22.951866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10952","last_updated":"2024-04-16T23:27:38Z","snapshot_observed_at":"2026-08-06T17:58:39.743437Z","submitted_at":"2024-04-16T23:27:38Z","title":"Can Language Models Solve Olympiad Programming?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10952","snapshot_observed_at":"2026-08-06T15:14:22.961513Z","title":"Joey Skaf, Luis Ibanez-Lissen, Robert McCarthy, Connor Watts, Vasil Georgiv, Hannes Whittingham, Lorena Gonzalez-Manzano, David Lindner, Cameron Tice, Edward James Young, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.961513Z"},"links":{"cited_paper":"/paper/2404.10952","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:af1107a099fe82030a1a880f5a532aae675218f4493b71b36ab0bff82a1f27b7","observation_id":"31cf8291-b415-4b89-b249-67b52b43b67d","resolution":{"observed_at":"2026-08-06T15:14:22.961513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:14:23.909703Z","title":"github.io/blog/qwq-32b/","venue":null,"work_id":"833e9642-ce8d-497c-bcbd-afbaf320ace7","year":2024},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.976376Z"},"links":{"citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:b51acac8a58fe003a7228c78401acce63d9b1702f5e017d78bf26659d8197869","observation_id":"cf9f1a7b-47d0-49cd-b3f6-9e0ee04b9197","resolution":{"observed_at":"2026-08-06T15:14:23.915454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:14:22.981987Z","title":"Teun van der Weij, Felix Hofstätter, Ollie Jaffe, Samuel F Brown, and Francis Rhys Ward","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.981987Z"},"links":{"citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:6c8f73523f1d1df8612515ae4a3f8f9658dc2e5d85f53e692300551c1a3131d5","observation_id":"f49cb79f-7a76-4936-848c-20bd29528720","resolution":{"observed_at":"2026-08-06T15:14:22.981987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12786","last_updated":"2025-05-27T05:00:23Z","snapshot_observed_at":"2026-08-02T03:46:01.180109Z","submitted_at":"2025-05-19T07:19:06Z","title":"Forewarned is Forearmed: A Survey on Large Language Model-based Agents in Autonomous Cyberattacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.12786","snapshot_observed_at":"2026-08-06T15:14:22.991593Z","title":"An Yang, Baosong Yang, Beichen Zhang, Binyuan Hui, Bo Zheng, Bowen Yu, Chengyuan Li, Dayiheng Liu, Fei Huang, Haoran Wei, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.991593Z"},"links":{"cited_paper":"/paper/2505.12786","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:a654c4fabe2ccef838d1dd3831a8da055c12cd46dfb33aee745f651765b2a50f","observation_id":"979b8ec1-35af-4b39-9e3c-5a1b481ba118","resolution":{"observed_at":"2026-08-06T15:14:22.991593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16557","last_updated":"2025-06-13T11:41:42Z","snapshot_observed_at":"2026-07-06T21:28:29.307086Z","submitted_at":"2025-05-22T11:46:46Z","title":"Is Your LLM-Based Multi-Agent a Reliable Real-World Planner? Exploring Fraud Detection in Travel Planning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16557","snapshot_observed_at":"2026-08-06T15:14:22.996359Z","title":"Shunyu Yao, Jeffrey Zhao, Dian Yu, Nan Du, Izhak Shafran, Karthik Narasimhan, and Yuan Cao","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.996359Z"},"links":{"cited_paper":"/paper/2505.16557","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:293490817bbdd44b69f15c9dafb4aded15a5bf9d7014c13cd79c53d5b0f0eb9a","observation_id":"304d5447-6a79-48f7-af13-9fd530fe6518","resolution":{"observed_at":"2026-08-06T15:14:22.996359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10253","last_updated":"2024-06-27T16:01:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-19T02:19:48Z","title":"GPTFUZZER: Red Teaming Large Language Models with Auto-Generated Jailbreak Prompts","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10253","snapshot_observed_at":"2026-08-06T15:14:23.001640Z","title":"Gptfuzzer: Red teaming large language models with auto-generated jailbreak prompts.arXiv preprint arXiv:2309.10253,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:23.001640Z"},"links":{"cited_paper":"/paper/2309.10253","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:b365d21dfdd7cc7f107669b34ee53ccef47612efa92e476222884ba689be29bc","observation_id":"cbe1dbe2-9e4d-41a5-bc10-fff805cfe8bb","resolution":{"observed_at":"2026-08-06T15:14:23.001640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08926","last_updated":"2025-04-12T21:26:07Z","snapshot_observed_at":"2026-08-06T12:22:30.341073Z","submitted_at":"2024-08-15T17:23:10Z","title":"Cybench: A Framework for Evaluating Cybersecurity Capabilities and Risks of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08926","snapshot_observed_at":"2026-08-06T15:14:23.006196Z","title":"Cybench: A framework for evaluating cybersecurity capabilities and risks of language models.arXiv preprint arXiv:2408.08926,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:23.006196Z"},"links":{"cited_paper":"/paper/2408.08926","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:fefee020e80ba3067d3db9e595139355063610c35b28d24927fce4523408c61e","observation_id":"ca2ca46d-83e1-4bf8-b634-cbf1ce3a42f3","resolution":{"observed_at":"2026-08-06T15:14:23.006196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-06T15:14:23.014971Z","title":"Terry Yue Zhuo, Minh Chien Vu, Jenny Chim, Han Hu, Wenhao Yu, Ratnadira Widyasari, Imam Nur Bani Yusuf, Haolan Zhan, Junda He, Indraneil Paul, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:23.014971Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:3eda463709dd55fb281c144f5fe7b2e422b9abbe688412b7d9cfd6afa2fc6b06","observation_id":"5f8fbb08-a161-444e-9aa8-0823e81e849d","resolution":{"observed_at":"2026-08-06T15:14:23.014971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15877","last_updated":"2025-04-01T08:36:44Z","snapshot_observed_at":"2026-07-31T19:00:59.311189Z","submitted_at":"2024-06-22T15:52:04Z","title":"BigCodeBench: Benchmarking Code Generation with Diverse Function Calls and Complex Instructions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15877","snapshot_observed_at":"2026-08-06T15:14:23.018672Z","title":"Andy Zou, Zifan Wang, Nicholas Carlini, Milad Nasr, J Zico Kolter, and Matt Fredrikson","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:23.018672Z"},"links":{"cited_paper":"/paper/2406.15877","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:96e21685d502d68c0cc8d1ce724a3830aa0f4b2fdccdab58519ab43b3d5b3b9b","observation_id":"6c2b8b6a-ebd0-4314-91f3-d600ba8c1487","resolution":{"observed_at":"2026-08-06T15:14:23.018672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T15:14:22.804368Z","title":"Gpt-4o system card.arXiv preprint arXiv:2410.21276,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":1953,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.804368Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:79173ee66e5c65eca5d4df560fd1134e282306c83546ff59127869be2c8d5fc6","observation_id":"59418bc6-79b4-4a4d-b07a-1f5276087639","resolution":{"observed_at":"2026-08-06T15:14:22.804368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08379","last_updated":"2023-11-27T19:30:35Z","snapshot_observed_at":"2026-08-05T18:30:31.616984Z","submitted_at":"2023-11-14T18:42:40Z","title":"Scheming AIs: Will AIs fake alignment during training in order to get power?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08379","snapshot_observed_at":"2026-08-06T15:14:21.887761Z","title":"Scheming ais: Will ais fake alignment during training in order to get power?arXiv preprint arXiv:2311.08379,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":2002,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:21.887761Z"},"links":{"cited_paper":"/paper/2311.08379","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:fb47f380e155200090acb16f36631548dc84d0c246fec76ccf2acfe60a376568","observation_id":"59b84338-8ab4-482f-a89f-9306667dde6e","resolution":{"observed_at":"2026-08-06T15:14:21.887761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01574","last_updated":"2024-11-06T02:54:00Z","snapshot_observed_at":"2026-08-06T00:29:17.674418Z","submitted_at":"2024-06-03T17:53:00Z","title":"MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01574","snapshot_observed_at":"2026-08-06T15:14:22.986497Z","title":"Mmlu-pro: A more robust and challenging multi-task language understanding benchmark","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":2006,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.986497Z"},"links":{"cited_paper":"/paper/2406.01574","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:0be7243ad44c9d4b53d579f417d321670f58518135b07d7e83db7f5beba6cd6c","observation_id":"118bef26-7bfa-44a8-bc95-f54a0330bc81","resolution":{"observed_at":"2026-08-06T15:14:22.986497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:14:24.004334Z","title":"Biolp-bench: Measuring understanding of biological lab protocols by large language models","venue":null,"work_id":"e7dd7dc0-d18e-439d-998e-b04a9432f7fb","year":2024},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.839502Z"},"links":{"citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:a42f77ac180b06ac99e7581ccf29510d5aeb5e6a5cd65d261d76948d03c15f1e","observation_id":"edd18540-d5f1-4a2b-8964-d4ab795144cc","resolution":{"observed_at":"2026-08-06T15:14:24.009701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17805","last_updated":"2025-01-29T17:47:36Z","snapshot_observed_at":"2026-08-02T14:12:38.024671Z","submitted_at":"2025-01-29T17:47:36Z","title":"International AI Safety Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17805","snapshot_observed_at":"2026-08-06T15:14:21.709311Z","title":"International ai safety report.arXiv preprint arXiv:2501.17805,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:21.709311Z"},"links":{"cited_paper":"/paper/2501.17805","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:3973c65318643436fdb6ec00e3f98e210eda4b2e296eff914ae18362a7b832e0","observation_id":"b88639e1-0404-4a6a-9840-6186f29b8de5","resolution":{"observed_at":"2026-08-06T15:14:21.709311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-06T15:14:22.971435Z","title":"Qwen Team","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.971435Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:7210e5f7922007fa4b96d0dd346fc68cf988666483db028c8d1b6c0a1ab40208","observation_id":"c4be9b7e-cc32-4fee-8169-6250a3f5348c","resolution":{"observed_at":"2026-08-06T15:14:22.971435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05130","last_updated":"2024-12-16T02:20:31Z","snapshot_observed_at":"2026-08-03T21:21:39.149039Z","submitted_at":"2023-10-08T11:41:28Z","title":"Fast-DetectGPT: Efficient Zero-Shot Detection of Machine-Generated Text via Conditional Probability Curvature","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05130","snapshot_observed_at":"2026-08-06T15:14:21.642015Z","title":"com/production/files/responsible-scaling-policy-1.0.pdf","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:21.642015Z"},"links":{"cited_paper":"/paper/2310.05130","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:c02e60cd45ff9c47f8bac6d478db77392356907fb64b1d05065c8563af42009f","observation_id":"ce5731ec-f81b-4dee-a162-84c9f9a26377","resolution":{"observed_at":"2026-08-06T15:14:21.642015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:14:24.056358Z","title":"Mistral AI","venue":null,"work_id":"cad8ed88-980b-4440-b25b-52b872567660","year":2024},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:21.421720Z"},"links":{"citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:f2df568eb3a19914fa551e352ab33ea762a083fd102c25d37337aa785bed415f","observation_id":"52e159df-342b-41ac-b844-e667b42aae8f","resolution":{"observed_at":"2026-08-06T15:14:24.060858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:14:24.038771Z","title":"Accessed: 2025-06-19","venue":null,"work_id":"394d2fd8-8779-4218-8b73-d233683b41a7","year":2025},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:21.487379Z"},"links":{"citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:52c3c0566819c919a13e6948c0fee1e190f3e16b37682bc1badf2276503cc4bb","observation_id":"c143ecc8-b397-4d13-b15f-036849d2f37e","resolution":{"observed_at":"2026-08-06T15:14:24.044219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T01:33:09.667763Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":0,"verified_fuzzy":8},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 1 inbound Pith citation observation for arXiv:2507.16534."}