{"as_of":"2026-08-21T15:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e81b4a4959cf1f27522d90a3b220a18a00101e23bf4b585812307ee900c4111b","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T06:49:29.653094Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.09890/citation-record","integrity":"/paper/2606.09890/integrity","json":"/paper/2606.09890/citation-record.json","paper":"/paper/2606.09890"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2602.20021","last_updated":"2026-02-23T16:28:48Z","snapshot_observed_at":"2026-07-06T22:46:45.213871Z","submitted_at":"2026-02-23T16:28:48Z","title":"Agents of Chaos","version":1},"cited_work":{"arxiv_id":"2602.20021","doi":"10.48550/arxiv.2602.20021","metadata_source":"pith","pith_arxiv_id":"2602.20021","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agents of Chaos","venue":"cs.AI","work_id":"02176c31-e67c-46e2-835a-ac21f005e1be","year":2026},"citing_paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T06:49:29.653094Z"},"links":{"cited_paper":"/paper/2602.20021","citing_paper":"/paper/2606.09890"},"observation_digest":"sha256:d7d8268301992026b4f17ceaca040b0b6d43bf96379b83905c3d8d41d1b9e525","observation_id":"c33cd1ce-9144-47a6-98cb-c78825e79142","resolution":{"observed_at":"2026-07-02T07:36:45.284817Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-07-15T18:20:21.538265+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T18:20:21.538265+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T06:49:29.653094Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2606.09890"},"observation_digest":"sha256:dee9756b11147be1cd87c7d3be4b796579b394f8f2734a487e76698ac02e43f4","observation_id":"a995e2dd-40ed-40ff-857b-0b3725e54770","resolution":{"observed_at":"2026-07-02T07:36:45.287211Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21772","last_updated":"2024-08-04T22:13:39Z","snapshot_observed_at":"2026-08-19T02:59:43.798238Z","submitted_at":"2024-07-31T17:48:14Z","title":"ShieldGemma: Generative AI Content Moderation Based on Gemma","version":2},"cited_work":{"arxiv_id":"2407.21772","doi":"10.48550/arxiv.2407.21772","metadata_source":"pith","pith_arxiv_id":"2407.21772","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ShieldGemma: Generative AI Content Moderation Based on Gemma","venue":"cs.CL","work_id":"6d0d9d39-490d-48d5-b346-6bfe40b8b8fb","year":2024},"citing_paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T06:49:29.653094Z"},"links":{"cited_paper":"/paper/2407.21772","citing_paper":"/paper/2606.09890"},"observation_digest":"sha256:a5c2b02be3e0c1a0b90e8bcde40501a8893db49d8839a75a72ea238ae8e9283d","observation_id":"f33e7731-007b-4ddb-8f01-72d80def2a00","resolution":{"observed_at":"2026-07-02T07:36:45.289515Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.14276","last_updated":"2025-10-16T04:00:18Z","snapshot_observed_at":"2026-08-14T07:39:23.817965Z","submitted_at":"2025-10-16T04:00:18Z","title":"Qwen3Guard Technical Report","version":1},"cited_work":{"arxiv_id":"2510.14276","doi":"10.48550/arxiv.2510.14276","metadata_source":"pith","pith_arxiv_id":"2510.14276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3Guard Technical Report","venue":"cs.CL","work_id":"de1c5964-d29a-456c-97cc-30684b243a85","year":2025},"citing_paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T06:49:29.653094Z"},"links":{"cited_paper":"/paper/2510.14276","citing_paper":"/paper/2606.09890"},"observation_digest":"sha256:9cb11664aa1247e8120ee6dcc76c97340079cc896ea48118744f75a5c692f496","observation_id":"5677da66-5809-4ddd-96d1-8d009b22d61b","resolution":{"observed_at":"2026-07-02T07:36:45.291932Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:49:29.653094Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T06:49:29.653094Z"},"links":{"citing_paper":"/paper/2606.09890"},"observation_digest":"sha256:7dcadd6d87bf8dc22b3d9bbaa751c161b71a758a1b148019e0a3fb060ba9e48b","observation_id":"f3db7e3b-cb04-4817-955e-02aa85c2def5","resolution":{"observed_at":"2026-06-28T06:49:29.653094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:49:29.653094Z","title":"An LLM is instructed to match the ethical step’s neutral tone while preserving the unethical step’s factual content","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T06:49:29.653094Z"},"links":{"citing_paper":"/paper/2606.09890"},"observation_digest":"sha256:c3d24f6560ea35739b3db7f3b98f6a1141a55a9718fa9a6521f59b50bd6e6581","observation_id":"38240dd6-aa83-4edf-9a59-ea8dc8acbf95","resolution":{"observed_at":"2026-06-28T06:49:29.653094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:49:29.653094Z","title":"12 Academic Cybersecurity Daily Life Law & Contract Politics Figure A1: Word clouds of task descriptions across domains represented in the benchmark","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T06:49:29.653094Z"},"links":{"citing_paper":"/paper/2606.09890"},"observation_digest":"sha256:11ee82bf79a5dfa8c7d703ff0b91fa0541b8117a85004ed2cec31ab027b78be1","observation_id":"1ed31578-540c-4083-b87f-983d5b3de425","resolution":{"observed_at":"2026-06-28T06:49:29.653094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:49:29.653094Z","title":"Patterns are capped at 5 words to avoid removing too much text","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T06:49:29.653094Z"},"links":{"citing_paper":"/paper/2606.09890"},"observation_digest":"sha256:f371ead6b5515201a45a8279804068926310b35aba8bf216e973931c15ff0f1c","observation_id":"929adddd-cda5-4042-b522-1db910a6b037","resolution":{"observed_at":"2026-06-28T06:49:29.653094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:49:29.653094Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T06:49:29.653094Z"},"links":{"citing_paper":"/paper/2606.09890"},"observation_digest":"sha256:2db958555f3ba5edc6a37aceb43d6fe30a59420f3c0122f1d9a6b3960a821789","observation_id":"85c390f5-428c-4b46-bd3b-478e7917711a","resolution":{"observed_at":"2026-06-28T06:49:29.653094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:49:29.653094Z","title":"C.2 Stage 2: Reference-Based LLM Rewrite After the regex pass, each step is paired with the corresponding positional step from the ethical con- text","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T06:49:29.653094Z"},"links":{"citing_paper":"/paper/2606.09890"},"observation_digest":"sha256:b5d9fb8ffde25bbbf6e3ad904a82da21ccecb464dc837440546d1603cd066a64","observation_id":"b708b3d9-b7a5-4c2a-b39c-2ec102a4b8a6","resolution":{"observed_at":"2026-06-28T06:49:29.653094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:49:29.653094Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T06:49:29.653094Z"},"links":{"citing_paper":"/paper/2606.09890"},"observation_digest":"sha256:f2f4104cd163a42eb33d2f15d1512fc291082e6057a9021819354ba4607653f1","observation_id":"03d5fc05-e3ba-4673-a8de-e2d25c1b133b","resolution":{"observed_at":"2026-06-28T06:49:29.653094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:49:29.653094Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T06:49:29.653094Z"},"links":{"citing_paper":"/paper/2606.09890"},"observation_digest":"sha256:71f46ffadf28d0e559bd2fd339dbd031db4137cf25543a5a0ed8e35092f44746","observation_id":"e0ef34cf-d865-4bed-b5fc-525f0bdd7c56","resolution":{"observed_at":"2026-06-28T06:49:29.653094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:49:29.653094Z","title":"consensus standards","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T06:49:29.653094Z"},"links":{"citing_paper":"/paper/2606.09890"},"observation_digest":"sha256:2073ad832531992a24558146f614b5ca2d56c3423cc2aa164df2159a979a6f91","observation_id":"25044a12-d5c0-405f-88d5-3ed3c2092685","resolution":{"observed_at":"2026-06-28T06:49:29.653094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:49:29.653094Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T06:49:29.653094Z"},"links":{"citing_paper":"/paper/2606.09890"},"observation_digest":"sha256:81686fb6317999f98aabbadf8d71a33ddbc5fb69e66af7099fc78d560f81dd8e","observation_id":"bc612228-ad08-4d76-9b37-b6061d46f0d4","resolution":{"observed_at":"2026-06-28T06:49:29.653094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:49:29.653094Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T06:49:29.653094Z"},"links":{"citing_paper":"/paper/2606.09890"},"observation_digest":"sha256:dedf2c9b4b1cd51a66bace52bd5c3e747a9935342dbcca9a192f3dabfde1ae19","observation_id":"ed08921c-2b69-4d7d-9a61-905e13ae0e11","resolution":{"observed_at":"2026-06-28T06:49:29.653094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:49:29.653094Z","title":"not shown to evaluators","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T06:49:29.653094Z"},"links":{"citing_paper":"/paper/2606.09890"},"observation_digest":"sha256:7f59ff6ccf700f55be15679aeae9902f972dc902881c01f21dbbe1c0a73da9d6","observation_id":"2f785c54-41e1-4ea6-8ca7-a4d2a20e2ff8","resolution":{"observed_at":"2026-06-28T06:49:29.653094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:49:29.653094Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T06:49:29.653094Z"},"links":{"citing_paper":"/paper/2606.09890"},"observation_digest":"sha256:f543e689845ada487bb441edfe90243f607863f59b39e028edb0f7d8fe8e877b","observation_id":"f93acafc-9c3b-4324-95ce-2188663a414b","resolution":{"observed_at":"2026-06-28T06:49:29.653094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:49:29.653094Z","title":"Figure A4: A representative unethical trajectory from PreAct-Bench","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T06:49:29.653094Z"},"links":{"citing_paper":"/paper/2606.09890"},"observation_digest":"sha256:4a8b4901dff210455134e6cd19c060777d5cfcc1f3474a8baa77aa83ed7757ca","observation_id":"4fc752bf-acad-4b37-8bf7-1cbc371993c7","resolution":{"observed_at":"2026-06-28T06:49:29.653094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:49:29.653094Z","title":"Keep it concise: mention the role, the core tension, and the stakes without excessive specifics such as exact dollar amounts or named stakeholders","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T06:49:29.653094Z"},"links":{"citing_paper":"/paper/2606.09890"},"observation_digest":"sha256:27c339513b2ad64d2cef9da8f459355bd9cb03c2c4f7dacd6750c6a30bb10970","observation_id":"7453f59a-98c1-4100-9a05-de7b5c33f8fd","resolution":{"observed_at":"2026-06-28T06:49:29.653094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:49:29.653094Z","title":"A good-faith actor and a bad-faith actor would both pursue the same stated task but through very different means","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T06:49:29.653094Z"},"links":{"citing_paper":"/paper/2606.09890"},"observation_digest":"sha256:4a0d3e139618224d5168d271fd8e4702eb0fab65085f36bda8d1ab950c4b6d3f","observation_id":"a13c9cef-1724-4a78-a8b5-b45089e36eb7","resolution":{"observed_at":"2026-06-28T06:49:29.653094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:49:29.653094Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T06:49:29.653094Z"},"links":{"citing_paper":"/paper/2606.09890"},"observation_digest":"sha256:0a1d96e55094cab49db8e78c90db640a84c021ed73ddc06bc490506a392a7f56","observation_id":"de3fc9de-64e2-4cc8-b764-fbddd359962d","resolution":{"observed_at":"2026-06-28T06:49:29.653094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:49:29.653094Z","title":"USER PROMPT GenerateNscenarios for theDomainNamedomain","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T06:49:29.653094Z"},"links":{"citing_paper":"/paper/2606.09890"},"observation_digest":"sha256:d0b0893c0d6142bd83a30ec3ac93b39257e82917246d490de316a81c27735665","observation_id":"0fe743d7-630e-46ed-9383-1fb831f5cc53","resolution":{"observed_at":"2026-06-28T06:49:29.653094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:49:29.653094Z","title":"Critical Requirements","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T06:49:29.653094Z"},"links":{"citing_paper":"/paper/2606.09890"},"observation_digest":"sha256:719ab2cb414b450dc4b7fd237fbe313735c7ffe99213223ecf057ef2441183ad","observation_id":"d2f5ac6d-1059-47e3-9201-f9ce0bacff41","resolution":{"observed_at":"2026-06-28T06:49:29.653094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:49:29.653094Z","title":"Fabricate evidence to","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T06:49:29.653094Z"},"links":{"citing_paper":"/paper/2606.09890"},"observation_digest":"sha256:e117bcbaf7c6d89998fb21393c193bafc67a32832a5917a057406fb02d884a3b","observation_id":"5322a057-c8a4-4d46-a025-9d22c4818266","resolution":{"observed_at":"2026-06-28T06:49:29.653094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T06:49:29.653094Z","title":"All steps in trajectory A should be[ethical]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T06:49:29.653094Z"},"links":{"citing_paper":"/paper/2606.09890"},"observation_digest":"sha256:c07d3315a1d2cffdf3fea8501723a387dd5a220aa8bc66cf3c331c88e58e8e1d","observation_id":"ce635f14-ab3f-429c-ba05-c8304b28e610","resolution":{"observed_at":"2026-06-28T06:49:29.653094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.09890","last_updated":"2026-06-03T13:26:41Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-19T21:19:39.735993Z","submitted_at":"2026-06-03T13:26:41Z","title":"PreAct-Bench: Benchmarking Predictive Monitoring in LLMs"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":21,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2606.09890."}