{"as_of":"2026-08-14T22:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1cc7b73b00ccfa5f4b80c3f2ad3f685a1dc852081a4382c357e93c695e25d7d2","coverage":[{"denominator":95,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":95,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T04:33:13.432133Z","state":"measured"},{"denominator":95,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":95,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.06422/citation-record","integrity":"/paper/2608.06422/integrity","json":"/paper/2608.06422/citation-record.json","paper":"/paper/2608.06422"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.031180Z","title":"Learning to give checkable answers with prover-verifier games, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.031180Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:516e0498f1419a9bd252411d4882755f3a0eb4e3960af4baed911f8ec6f8c5b6","observation_id":"56f9b2bf-c6bc-4b9f-b0f7-a2979f1e7b2d","resolution":{"observed_at":"2026-08-10T04:33:13.031180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.037957Z","title":"Bowman, Jeeyoon Hyun, Ethan Perez, Edwin Chen, Craig Pettit, Scott Heiner, Kamil \\.e Luko s i \\=u t \\.e , Amanda Askell, Andy Jones, Anna Chen, et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.037957Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:d3567b0da809e430b6ac09bac2091be4a77d62d5fe75fbd554603367757f2de0","observation_id":"09258d73-6dc8-429a-9352-a53ab91102df","resolution":{"observed_at":"2026-08-10T04:33:13.037957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.042842Z","title":"Weak-to-strong generalization: Eliciting strong capabilities with weak supervision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.042842Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:ebe43f57f27ace6e4e9fc170d5ddabd71546bc1af08dca4f4e3a9535e56ae2c5","observation_id":"ab708731-c1cc-4dfb-8112-c739b35ee2ab","resolution":{"observed_at":"2026-08-10T04:33:13.042842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.048271Z","title":"Supervising strong learners by amplifying weak experts, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.048271Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:3edeb59727f2f2e8fcbf1a05a5679e3572853a6423ede772d39c1c968a0d5a77","observation_id":"7c92fb5a-4cd6-469b-896d-061307f91f19","resolution":{"observed_at":"2026-08-10T04:33:13.048271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.053453Z","title":"A coefficient of agreement for nominal scales","venue":null,"work_id":null,"year":1960},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.053453Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:5c0b0f9a001f627dc7703d7502acd2cdff93f94cb139b039cf7307be503d0be4","observation_id":"037c6f63-6c50-42ae-a296-21b0e1100229","resolution":{"observed_at":"2026-08-10T04:33:13.053453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.057891Z","title":"Zico Kolter","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.057891Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:7a7f9d3fa3dab618677de3357a37d775236604eafc7511ade3671c9cc9e9f46f","observation_id":"28dd74c3-9402-43db-bf0f-573eec951341","resolution":{"observed_at":"2026-08-10T04:33:13.057891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.063820Z","title":"Limits to scalable evaluation at the frontier: LLM as judge won't beat twice the data","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.063820Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:50180d29d588439b74f6f2da9ee672b258d0e359c55950d2c5fa80c9aba24ee2","observation_id":"848c0cb2-5b3b-47c0-824f-f0670bff9aea","resolution":{"observed_at":"2026-08-10T04:33:13.063820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.068343Z","title":"Baek, Subhash Kantamneni, and Max Tegmark","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.068343Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:641e8ce430309054fc515336175b99fc7af4734fca52bc8bb9e014992c9d4892","observation_id":"a56afad3-3df7-4ef1-a682-00dd90db5323","resolution":{"observed_at":"2026-08-10T04:33:13.068343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.072368Z","title":"Factored verification: Detecting and reducing hallucination in summaries of academic papers, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.072368Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:57a6250b25b4407a35944c5859219922089ae62abcb16bde83065ae351943ebd","observation_id":"672285ba-52f5-4254-9aca-ecd370522ce9","resolution":{"observed_at":"2026-08-10T04:33:13.072368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.076833Z","title":"Criteria-based LLM relevance judgments","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.076833Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:2b9a1e1cec3abb4539f4b52ac2e8d177314ca0e1940c94817499d10d57a6979c","observation_id":"a186b837-8fb6-406d-b9c3-b14e713063e1","resolution":{"observed_at":"2026-08-10T04:33:13.076833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.081534Z","title":"Scaling laws for reward model overoptimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.081534Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:46a4cb0410357966ab27bbda0063a10486d3cf6231467e459c5357b19b3c23e8","observation_id":"a3fb761c-7d30-4729-88d8-33a6da7a9dc7","resolution":{"observed_at":"2026-08-10T04:33:13.081534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.085654Z","title":"Chandra, Ponnurangam Kumaraguru, Douwe Kiela, Ameya Prabhu, Matthias Bethge, and Jonas Geiping","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.085654Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:0b720247b90a2dedcb81fc3ae2930392db8e5c529c3405194212046a8ba2af6d","observation_id":"208e9694-4289-4b89-a7ce-c57b03830eec","resolution":{"observed_at":"2026-08-10T04:33:13.085654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.090182Z","title":"Klassen, and Lucy Lu Wang","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.090182Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:738d2250cf630645a1a09c1bc8091b483fe03266775109ae17c9dfe06c971f71","observation_id":"66bb48b4-a73e-4458-ae51-8f46fb78991e","resolution":{"observed_at":"2026-08-10T04:33:13.090182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.094237Z","title":"AI safety via debate, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.094237Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:c28e7d89f546884345129106f65276e4ab37a93e14de9035a6ea32f0a934e576","observation_id":"7fdfaf78-7a4a-4aff-be28-36c0b5bdcfae","resolution":{"observed_at":"2026-08-10T04:33:13.094237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.098425Z","title":"Bowman, Tim Rockt \\\"a schel, and Ethan Perez","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.098425Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:7c0f8977ffef3608ac9bdde9bf4ee7182720350d20c70a992f09f69e56bbd1b0","observation_id":"352eeb0b-c09f-4764-abc5-213aae2b0773","resolution":{"observed_at":"2026-08-10T04:33:13.098425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.102380Z","title":"Prover-verifier games improve legibility of LLM outputs, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.102380Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:1bb3dc9a2d217f9a60cb2c4bf18d77008e203278675fe2082687699273bd308a","observation_id":"b4b89e28-fc27-4173-a4d6-313a936d9a55","resolution":{"observed_at":"2026-08-10T04:33:13.102380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.508182Z","title":"SHADE-Arena : Evaluating sabotage and monitoring in LLM agents, 2025","venue":null,"work_id":"3fe1872b-7485-43f9-bf30-28ef09f7229d","year":2025},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.106470Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:9993a29097da288e1dab79cf993cc12831f427990328985cb465b185e12d33e0","observation_id":"4caeb79f-2990-46b6-bb3a-e7dd32c9c7a3","resolution":{"observed_at":"2026-08-10T04:33:14.513185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.493943Z","title":"Selective weak-to-strong generalization","venue":null,"work_id":"4754254f-c8f9-4d38-8ef4-63617c20e505","year":2026},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.110461Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:286f7615e11619492ee8fc4d0880c4c94e3094e5341b6c26d46d9a0f2e5ae307","observation_id":"448f736f-b233-47c5-addc-044b2158beec","resolution":{"observed_at":"2026-08-10T04:33:14.499232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.478659Z","title":"Scalable agent alignment via reward modeling: A research direction, 2018","venue":null,"work_id":"e7f1ee41-931f-4e3f-a8c3-f7d65d801db5","year":2018},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.114377Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:8fc357c6dcc85a1965bf3528d2e18204c330c8ef6da127f148796ebe13b2ba76","observation_id":"62d811ab-ed0b-4ccc-b651-e25daaf69558","resolution":{"observed_at":"2026-08-10T04:33:14.483580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.464631Z","title":"LLMs cannot reliably judge (yet?): A comprehensive assessment on the robustness of LLM -as-a-judge, 2025","venue":null,"work_id":"d810759b-a0bb-44f7-a16c-c36f8ea42d87","year":2025},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.118508Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:fe824967938eb59398b6079a4916c2dab732e404eddfdc40d17f9c8dcefc48df","observation_id":"7fe82dc9-8bcc-4634-be72-e9df905e6c64","resolution":{"observed_at":"2026-08-10T04:33:14.469435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.123016Z","title":"Let's verify step by step, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.123016Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:2f73115694b5f0ac0c2e4f6de3c9660e4b088ec6daa7517c289ea36bd7e49787","observation_id":"31258da8-b515-49da-b165-f00d1bede33c","resolution":{"observed_at":"2026-08-10T04:33:13.123016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.441199Z","title":"Mitigating self-preference by authorship obfuscation","venue":null,"work_id":"4d21738e-b863-45f0-a3b8-03193eadb154","year":2026},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.127437Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:a8e6ef9e07145665168d0282040d54ff32c65328efc2755fc2205da8f2e68b3d","observation_id":"74742177-7c97-428f-a889-c5f00fc89452","resolution":{"observed_at":"2026-08-10T04:33:14.445466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.428718Z","title":"McKenzie et al","venue":null,"work_id":"1d568a8a-a004-4aba-a361-4c58d801ef95","year":2026},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.131419Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:4138ea06762c3dba3fd4085d3f9e0900e470c79b221bbe19dc8d7d9820e3cfcc","observation_id":"503a500f-d032-454c-8ce5-9450b65402ea","resolution":{"observed_at":"2026-08-10T04:33:14.432713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.415529Z","title":"ARVO : Atlas of reproducible vulnerabilities for open source software, 2024","venue":null,"work_id":"b0ce97f4-bc7d-46de-8e8a-69c9289129e0","year":2024},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.135462Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:906d7e38bba3ba1711c88eaa21fbf0d72f91db3d557f80fa4348fa4644834c25","observation_id":"319ad3da-2cbc-4eb7-bc92-0360a411e606","resolution":{"observed_at":"2026-08-10T04:33:14.420222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.400657Z","title":null,"venue":null,"work_id":"aa234312-8b0b-4901-bf9c-06b2b9f6dd49","year":2023},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.140153Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:67e7e2c49a319d819b6e4aa3fba7cfe338b796348af41bf2e21b4c95224c1f24","observation_id":"7bcee44a-63f5-4f52-ac91-cce5fd5d6e71","resolution":{"observed_at":"2026-08-10T04:33:14.405369Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.385843Z","title":"FActScore : Fine-grained atomic evaluation of factual precision in long form text generation","venue":null,"work_id":"991c608d-cfdd-453b-962b-3a1f59539c10","year":2023},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.144647Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:e3bbc0762ea710811e12041d80b4dd80e05c6b9580a4cc1f9b88d99c01e90e1d","observation_id":"861f692a-ddad-4af0-b037-d422426dd65b","resolution":{"observed_at":"2026-08-10T04:33:14.390636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.371502Z","title":"Rossi, Seunghyun Yoon, and Hinrich Schuetze","venue":null,"work_id":"1f79929d-3cfb-43be-b968-bc756777cc8c","year":2025},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.149095Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:9f0cf2e4fc50258b3c3bab34a4c43212a47a6edb2c07824c92278ea8e49189e0","observation_id":"94db4dc3-d215-4ce4-a89e-8acb7c0aff48","resolution":{"observed_at":"2026-08-10T04:33:14.376320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.357248Z","title":"Intrinsic barriers and practical pathways for human- AI alignment: An agreement-based complexity analysis","venue":null,"work_id":"58271222-151d-48e9-83cd-d67345de4421","year":2026},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.153001Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:6ffe781d81e63c98a40a1bdbdc89321e10cb0a0f894d8078c16f2750ee48e1a8","observation_id":"5f9df387-131a-4468-a23f-3beb621141f8","resolution":{"observed_at":"2026-08-10T04:33:14.362325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.343544Z","title":"LieCraft : A multi-agent framework for evaluating deceptive capabilities in language models","venue":null,"work_id":"910ff724-c0af-4dd2-876c-4bfe6f9509d9","year":2026},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.156770Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:c13f6ca1f55ab90a149515f26e1d8f20ccc4bf304bee26c19f69e32ba287274e","observation_id":"5700ffbd-ce8a-4c43-ac0e-7e3510ff4282","resolution":{"observed_at":"2026-08-10T04:33:14.348305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.328705Z","title":"The effects of reward misspecification: Mapping and mitigating misaligned models","venue":null,"work_id":"acae2e35-3002-4302-9380-6ee29ac2f829","year":2022},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.160963Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:cc67ba76eec9c9077329a41b5c578a0b6230394f150ecd0d57041be6d0d93719","observation_id":"e0b2457d-a245-4a14-a263-126f08eafe21","resolution":{"observed_at":"2026-08-10T04:33:14.334071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.164985Z","title":"Bowman, and Shi Feng","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.164985Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:d068ef207dbe5ad13cf6fa0a1920fd9486afe271f0e5ed78903b80513ac769be","observation_id":"35c49ab5-7c64-43e9-a4cd-846c403e5078","resolution":{"observed_at":"2026-08-10T04:33:13.164985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.306646Z","title":"Confirmation bias: A challenge for scalable oversight","venue":null,"work_id":"bf512d64-71de-4147-90e1-c265981bfcf9","year":2026},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.168661Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:20a23a854f0480ef57503c04434ce4e24e3b3cc7f56eb3d7d3da594288999c51","observation_id":"cda2a22f-640c-4b44-8e58-cd7ad3fd8fc1","resolution":{"observed_at":"2026-08-10T04:33:14.310788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.293553Z","title":"FindTheFlaws : Annotated errors for detecting flawed reasoning and scalable oversight research","venue":null,"work_id":"a55dd193-2150-4c9d-9278-b8eb6d7be24e","year":2026},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.172486Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:8574e48b8a2ed9ebc05da0fbb7ebdd6a561032b337ddd0be8bf3341b3511bb4b","observation_id":"a95109af-29f7-48b9-b85f-623022c6e314","resolution":{"observed_at":"2026-08-10T04:33:14.297860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.279853Z","title":"Verbosity bias in preference labeling by large language models, 2023","venue":null,"work_id":"dc6e1b17-849b-4925-8b4f-d45fe552c765","year":2023},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.176646Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:0204b7989d181809f85cab2b12f371f9c4674b4911f38760964e8bb3f9048bd7","observation_id":"82fc859c-94d1-4a10-a2d6-1b1c86952210","resolution":{"observed_at":"2026-08-10T04:33:14.284027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.266874Z","title":"Self-critiquing models for assisting human evaluators, 2022","venue":null,"work_id":"6a710f85-cac5-4737-917d-57bfc3f49135","year":2022},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.180661Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:ddd27cf8a1d577016b4b7cb8dfa425b4a6aadba35a55815ee8006d80c91ecd5c","observation_id":"a957bfdd-0b91-4bb7-9663-fd8dd4a12f04","resolution":{"observed_at":"2026-08-10T04:33:14.271004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.253277Z","title":"SWE-Bench Pro : Can AI agents solve long-horizon software engineering tasks?, 2025","venue":null,"work_id":"0f8f350b-ed1c-4ef5-803b-e9b4eee45b21","year":2025},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.184588Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:70ab8a4eba837a846e2ce6beec8adb6e301fee0af7ef0ad471dbdb7fe8fcfd1b","observation_id":"0d2552fb-432a-4a22-a245-1311197cd570","resolution":{"observed_at":"2026-08-10T04:33:14.257928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.238425Z","title":"PaperBench : Evaluating AI 's ability to replicate AI research, 2025","venue":null,"work_id":"2465c3ef-d337-4c11-b6ae-1bd84f7471b3","year":2025},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.188598Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:583f3934ce551b74ffdd7a356cd9a59e138006bf8151bd80d004fb2fefe059f9","observation_id":"fe82a08a-8cb8-4a8a-accd-4b08d640e670","resolution":{"observed_at":"2026-08-10T04:33:14.243494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.224395Z","title":null,"venue":null,"work_id":"29086720-2217-4bba-8061-b83ce5a80bdb","year":2019},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.192625Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:848a3ccad47a929428d7da882eb9a7e3e18da35e01334654eb5f3147fb5548e3","observation_id":"b4d66de3-dfd9-489e-85cb-75fff3ee2c95","resolution":{"observed_at":"2026-08-10T04:33:14.229237Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.209232Z","title":"Christiano","venue":null,"work_id":"c4404e8e-d13d-4a96-9046-37245b908fca","year":2020},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.196958Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:f7a058c5ab1c0fbff51e53d87d0b66d4a34e8e9ec2af410b667dd79864bc78fa","observation_id":"816b2c5b-17f1-4c3a-94d3-72f75957a349","resolution":{"observed_at":"2026-08-10T04:33:14.215080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.194553Z","title":"JudgeBench : A benchmark for evaluating LLM -based judges","venue":null,"work_id":"60cdbc56-d11f-4d37-9d22-b4decf2ef012","year":2025},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.201200Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:ac2d2dd446b4b7be36c22b4bedfef23e9a34b740df84008e6fb248487c93dc43","observation_id":"13e5410c-c9d0-4a8e-b6af-9e5879dce8f5","resolution":{"observed_at":"2026-08-10T04:33:14.198798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.181153Z","title":"Large language models are not fair evaluators, 2023","venue":null,"work_id":"efdfabf2-3413-4218-9efc-0706d28e0c56","year":2023},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.205320Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:daa614ebba54857cc15c67ec6589f96a11ae7e70342c51fcdddbfbaef19e61e5","observation_id":"850b06a9-4472-4a75-ac1b-4872d1e060aa","resolution":{"observed_at":"2026-08-10T04:33:14.185388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.168160Z","title":"Ziegler, Nisan Stiennon, Ryan Lowe, Jan Leike, and Paul Christiano","venue":null,"work_id":"69d46561-8250-4e57-9dac-11a51954e350","year":2021},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.209536Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:1c2501ab2d9828125958b7292b2b9bb23629d501b048597f1e8436aadb38ad57","observation_id":"6cbfc4da-dba0-47ee-9e8f-d5519ed715c5","resolution":{"observed_at":"2026-08-10T04:33:14.172381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.213344Z","title":"Does context matter? ContextualJudgeBench for evaluating LLM -based judges in contextual settings","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.213344Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:96f8f8dc64abb815b633a4c61634e666180af78110d1f3c920db7cdb0f70a08c","observation_id":"cdf6a17c-5367-4afe-8ca2-db449f293f2d","resolution":{"observed_at":"2026-08-10T04:33:13.213344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.25240","last_updated":"2026-06-04T00:43:30Z","snapshot_observed_at":"2026-08-13T20:40:49.205215Z","submitted_at":"2026-05-24T19:52:39Z","title":"JudgmentBench: Comparing Rubric and Preference Evaluation for Quality Assessment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.25240","snapshot_observed_at":"2026-08-10T04:33:13.217326Z","title":"JudgmentBench : Comparing rubric and preference evaluation for quality assessment","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.217326Z"},"links":{"cited_paper":"/paper/2605.25240","citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:ef6f3cc5e92db816ef8d4c3fd87a93f7c21f86db6c1283c151e12fb36bc8e245","observation_id":"9dc897fe-2d09-45a1-a391-adb08f16c045","resolution":{"observed_at":"2026-08-10T04:33:13.217326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.154486Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":"04afb197-11d9-4988-93d4-625090e05a46","year":2023},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.221815Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:3f89c66b99dc060d2075f04c2bebbf2aafd290586f441472f9dbf07153c442e7","observation_id":"7b6e56be-2d71-4271-8cd2-3901d87dcc88","resolution":{"observed_at":"2026-08-10T04:33:14.158822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.141131Z","title":"Evaluating judges as evaluators: The JETTS benchmark of LLM -as-judges as test-time scaling evaluators, 2025","venue":null,"work_id":"71a1086d-a3c4-4085-bd5e-240d90fa7e48","year":2025},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.225905Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:fc3475f410fe1c4fe538bc6947e88b797e86630b38bfa014382f97bd06770576","observation_id":"e2ba11d2-3f9d-49ce-b8f0-1c612aadb1e9","resolution":{"observed_at":"2026-08-10T04:33:14.145443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.229843Z","title":"Zico Kolter, and Matt Fredrikson","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.229843Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:468bdd6460d7839a1fb2e30e8b3abaa75401cab6afd91359058591b278121aff","observation_id":"7284243f-8fbd-46de-9aec-94fd60a9803b","resolution":{"observed_at":"2026-08-10T04:33:13.229843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.119615Z","title":"2025 , eprint =","venue":null,"work_id":"fb31a8ab-6a6e-43ba-98fe-056a523dddca","year":2025},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.234090Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:43ea9dd903c2fc48a364abb19f37a12f6177d879306f9baacccfbca196945f6f","observation_id":"c2d6a94f-3cf2-4249-a115-8e54ef0443c5","resolution":{"observed_at":"2026-08-10T04:33:14.123977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.106908Z","title":null,"venue":null,"work_id":"4322c8e6-3955-4e1a-8b25-d251f9eb07fd","year":null},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.237878Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:ca97f11f19a69de092bd4b95e220b2b55a5e85efb49b0c0dabcca5dec35e08ae","observation_id":"dd698f18-1152-4f04-80f4-7840941b03a7","resolution":{"observed_at":"2026-08-10T04:33:14.111399Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.093945Z","title":"and Wang, Lucy Lu , booktitle =","venue":null,"work_id":"3677e9c9-4f05-4f96-b507-3aa4440ab7aa","year":null},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.242495Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:b9f92cdf2df629aeb366edee9a5ac4072bf408a4fc7b5eface6405d6587e2c47","observation_id":"498df39f-b9b8-4bbb-bf82-6ac9c6b9d543","resolution":{"observed_at":"2026-08-10T04:33:14.098458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.079462Z","title":null,"venue":null,"work_id":"c388b0df-b040-4270-80ac-266820f6b7bb","year":null},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.247450Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:f03f34c68f4ab05dea162ec027e7225559c4c7945043e44ec516a9622d5c9f3a","observation_id":"8d9666f5-9d61-4f25-a9fe-9b63156b9939","resolution":{"observed_at":"2026-08-10T04:33:14.084248Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.064890Z","title":"2024 , eprint =","venue":null,"work_id":"ae8b376a-a398-4336-9845-2ae1f855ce61","year":2024},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.251798Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:cbc39ed4204f2ba198e5a10180a134defa20bad9609293a8bfe3507292bf5d98","observation_id":"4c7a8a52-c261-4462-aae3-a65ced41143b","resolution":{"observed_at":"2026-08-10T04:33:14.070241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.052174Z","title":"2024 , eprint =","venue":null,"work_id":"9ce602cd-267e-475d-a2a0-c63f4131ee2e","year":2024},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.255764Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:841d3ab226b2ff62353973f45910300b7dda36bcf2e63af54b7c02d0dc52361c","observation_id":"ea617cd5-b148-4311-bfbf-ac7d31b3af31","resolution":{"observed_at":"2026-08-10T04:33:14.056339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.039561Z","title":"Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing , pages =","venue":null,"work_id":"485767f7-1ef8-4a52-b7ba-b3681ef84526","year":2023},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.259805Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:f923fc647bde653f3940ef8fd4ae6f0fbe3638baa6aae8a057b81b0cf52a14b7","observation_id":"735002df-2213-4751-9327-cca6884e3ffd","resolution":{"observed_at":"2026-08-10T04:33:14.043713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.027206Z","title":null,"venue":null,"work_id":"76e8f841-cbbb-4cb5-9680-af84701deaa2","year":2025},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.263868Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:9c8d6c86421726562ea7147c363dbb395ef078f8256eb7b503879adda86042cb","observation_id":"7363d855-e941-42d6-b0f9-2fa419247bf0","resolution":{"observed_at":"2026-08-10T04:33:14.031355Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.013947Z","title":"2018 , eprint =","venue":null,"work_id":"7458a8ab-813d-4af8-a93c-950f47dac00d","year":2018},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.268481Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:7030d19ec7a5c8c18b4305936a167c78903fb990f5c4b9996a480683a1803c2f","observation_id":"68da86e0-d22a-4899-81da-3e2b59a778a4","resolution":{"observed_at":"2026-08-10T04:33:14.018931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:14.001398Z","title":"2018 , eprint =","venue":null,"work_id":"59ae3f18-0755-49c0-8118-98344f5b4261","year":2018},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.272588Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:d3d0de7e5ec6d93d55013df68ac24b1d57b345c73be96adf8fb0f445ccd44d48","observation_id":"5b1c37c4-3276-4fe7-b382-6520ac3e2b23","resolution":{"observed_at":"2026-08-10T04:33:14.005627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.987539Z","title":"2018 , eprint =","venue":null,"work_id":"35b10a2c-3d05-41a4-be1c-f42fc4485b7a","year":2018},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.276724Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:bab857e09794d511afab5be448ed361683d12136f1de1ed23c90e3876d808938","observation_id":"f0a3c3d4-bb1b-4e79-9ce5-2bbc901d0f4c","resolution":{"observed_at":"2026-08-10T04:33:13.992047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.973140Z","title":"2024 , eprint =","venue":null,"work_id":"f4c6876d-4754-4bb3-813f-46fae7431609","year":2024},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.281356Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:c003296942c483f301a37b13bc118c7e448955d38bb94c90a7a12240ab81365f","observation_id":"3c2edb8a-0502-4418-b9d0-d00d2cbea0e1","resolution":{"observed_at":"2026-08-10T04:33:13.978360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.959405Z","title":"2021 , eprint =","venue":null,"work_id":"3a9e5667-ea7b-4b18-af30-f9b3083f8841","year":2021},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.285539Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:8d873ff59aa0e52991b8987ce6d8029696e543d534760c27256a25e7ea1b1c46","observation_id":"9f0b97b7-4f9e-4d9f-92d9-5e78e706eb91","resolution":{"observed_at":"2026-08-10T04:33:13.963575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.946702Z","title":"and Stoica, Ion , title =","venue":null,"work_id":"4ada6278-fc08-4a6f-992d-3d0130cc6ffd","year":null},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.289422Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:58ac46561761f769ab7e89776a61f3e43fdbae45157fe06b1c5dd4bce3e30e62","observation_id":"d2030da3-b8e3-4906-8ac4-c609809b3de1","resolution":{"observed_at":"2026-08-10T04:33:13.950848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.933080Z","title":"2023 , eprint =","venue":null,"work_id":"84cdc785-8b83-4a78-be80-3379c690a121","year":2023},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.293632Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:a6e8a7871848d997c0093ea19ebdccc647815da350a69ee3c16244d44c070c0b","observation_id":"63c91790-6113-4b97-af4e-ea8e8fec5008","resolution":{"observed_at":"2026-08-10T04:33:13.937382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.919278Z","title":"and Feng, Shi , title =","venue":null,"work_id":"bf2495fd-8eea-48df-bc58-159edca3f9f3","year":2024},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.297585Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:0912ebd086b9ffa2a7478560b85baae92ae5fa7f33b309747d53f9e76c4b0736","observation_id":"bbd8d89b-3d12-4a9d-8745-c39855774cb9","resolution":{"observed_at":"2026-08-10T04:33:13.923427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.904862Z","title":"2023 , eprint =","venue":null,"work_id":"0202d4a7-e46f-4e5f-a70f-d2336eecbb7d","year":2023},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.301467Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:75851aca34f042c23c5e45c3a5d82b7b1ef283b7a7fe1dec4ce262b8520e5219","observation_id":"4729b14a-19ef-431a-8432-a3c42d0c5e0f","resolution":{"observed_at":"2026-08-10T04:33:13.910023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.890804Z","title":"Proceedings of the 40th International Conference on Machine Learning , pages =","venue":null,"work_id":"b515c558-9b8e-4875-ae9c-7ed0e9f2b643","year":null},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.305464Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:38a42d5cfba48216c194bb45f311742919a7a423b99a3fc946f7776296379254","observation_id":"cf017ed3-a802-4bbe-9b1f-e1b1f5c9c607","resolution":{"observed_at":"2026-08-10T04:33:13.895982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.03540","last_updated":"2022-11-11T20:17:18Z","snapshot_observed_at":"2026-07-06T14:15:17.474527Z","submitted_at":"2022-11-04T17:03:49Z","title":"Measuring Progress on Scalable Oversight for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.03540","snapshot_observed_at":"2026-08-10T04:33:13.310081Z","title":"and Hyun, Jeeyoon and Perez, Ethan and Chen, Edwin and Pettit, Craig and Heiner, Scott and Luko","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.310081Z"},"links":{"cited_paper":"/paper/2211.03540","citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:f22ab9b13207b9688661ac748ea65ff5cd63f9bbef9d2beafbbf99cee0339668","observation_id":"02a26895-fad4-47a8-8063-427b7b116ce1","resolution":{"observed_at":"2026-08-10T04:33:13.310081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.876773Z","title":"and Rockt","venue":null,"work_id":"7606b310-916a-4e48-8e67-952ea8110e8e","year":null},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.315561Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:c19d107baacd259e0d88fd38352ff5a0f59e0bbc30220cdc6e235facf7ef1ed3","observation_id":"c91e2b72-be6f-4181-a27b-bfe0edaa29c4","resolution":{"observed_at":"2026-08-10T04:33:13.881294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.862020Z","title":", title =","venue":null,"work_id":"c36c11fe-8b8e-47e9-9265-68999ed722b2","year":2023},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.319865Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:3b206b90b633a26625cdfbbcec3512f6d8dbcacf1e0b245c247990c33d4127f2","observation_id":"1c6e8548-029b-4314-935a-ab043597b6a9","resolution":{"observed_at":"2026-08-10T04:33:13.866808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10627","last_updated":"2023-10-16T17:51:17Z","snapshot_observed_at":"2026-08-14T17:25:31.217802Z","submitted_at":"2023-10-16T17:51:17Z","title":"Factored Verification: Detecting and Reducing Hallucination in Summaries of Academic Papers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10627","snapshot_observed_at":"2026-08-10T04:33:13.323768Z","title":"Factored Verification: Detecting and Reducing Hallucination in Summaries of Academic Papers , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.323768Z"},"links":{"cited_paper":"/paper/2310.10627","citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:c3a97c05ba5059a8cac8cd8562e9daa9fb9b451c21e2e8958b37017d5b54cb7f","observation_id":"d7728caf-7e77-4310-9f8a-536fe49e5965","resolution":{"observed_at":"2026-08-10T04:33:13.323768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.328294Z","title":"2023 , eprint =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.328294Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:8502a9e8bacee4ea19d4294f11b5eaeca3b01d8a3cc36b9e4bee0b38ee868bea","observation_id":"bffde302-3b39-4fea-800b-1a351908a363","resolution":{"observed_at":"2026-08-10T04:33:13.328294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.838777Z","title":"2022 , eprint =","venue":null,"work_id":"599ccfa7-1536-44e1-8b07-ef627c58b4fc","year":2022},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.332451Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:d35c2c89ca90ce4f69ad447e7bc0742ca32d2ddb65e201371fc41520354a5162","observation_id":"f5342b3a-5d34-4fe4-86f1-05020b3140a3","resolution":{"observed_at":"2026-08-10T04:33:13.843487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.824696Z","title":"and Stiennon, Nisan and Lowe, Ryan and Leike, Jan and Christiano, Paul , title =","venue":null,"work_id":"0349784b-0a67-4429-b05c-b1b8a31202ca","year":2021},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.336540Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:ed867a2c24aff545ce45c4548f8df50b9d27a02d7bc3386076b3ad799080c0f8","observation_id":"40281b96-0c2c-4d9f-baba-c8287404df22","resolution":{"observed_at":"2026-08-10T04:33:13.829044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.340587Z","title":"Educational and Psychological Measurement , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.340587Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:e256fa815d24cb2e7e2c8a7995309e9bcd00fc09a4a0623709abe5ca1601a4be","observation_id":"bb7349c2-5213-4396-b892-3bab2a17d641","resolution":{"observed_at":"2026-08-10T04:33:13.340587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.344693Z","title":"International Conference on Learning Representations , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.344693Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:60d49524c8d192732a62e98dec49655dfc0882f6ef4ea10b51e76d5b1aff4a1f","observation_id":"d506223e-d7e8-44c5-b73e-a92c0abc8295","resolution":{"observed_at":"2026-08-10T04:33:13.344693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.793726Z","title":"Proceedings of the 2024 Conference of the North American Chapter of the Association for Computational Linguistics , year =","venue":null,"work_id":"91e8a75f-f48f-4f19-9cd4-ec64a37a89e4","year":2024},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.348896Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:7e71d9afae72b60a3509deaa875ebb833f8ed345f45005883be0d73986a1979f","observation_id":"d42228c6-5373-4158-ac17-fb1c33b7d092","resolution":{"observed_at":"2026-08-10T04:33:13.798231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.780312Z","title":", title =","venue":null,"work_id":"29eb4dc0-5391-4d50-b2a2-bb64b848ba4e","year":null},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.352907Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:b2b9266c487c583fc8ba211b4781ae84e64f2fecf15bd72b5c9dd4e2a060ef16","observation_id":"09ae2244-952d-4429-b310-4f3432c9562c","resolution":{"observed_at":"2026-08-10T04:33:13.784516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.767159Z","title":"Zico and Fredrikson, Matt , title =","venue":null,"work_id":"8ad65724-9528-4d95-bba5-fa73419b28a9","year":2023},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.356945Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:724b3b2fa980e5f255eb72743ba40d253c5bf1b44edabe9d6c2e953605f8a1eb","observation_id":"c24a6314-abcd-457e-8d6a-4dd23333efc2","resolution":{"observed_at":"2026-08-10T04:33:13.771592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.753696Z","title":"Zico , title =","venue":null,"work_id":"832b9bab-82fb-4b1e-8410-67752a497b05","year":null},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.361099Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:b2b67fc8739f8d9e65a2b27d11090a0d5bf56e362641d5cb13d95c7971aa275e","observation_id":"280aee6d-a268-412a-896d-62ca01619aeb","resolution":{"observed_at":"2026-08-10T04:33:13.758396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.740612Z","title":"Proceedings of the 41st International Conference on Machine Learning , year =","venue":null,"work_id":"a57c9052-c9a3-4a0d-9008-4bc67734c901","year":null},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.365569Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:f311598be15c061f4a11aaf876949cad684bcc0cd3ca50fb3853e4f437cbec5c","observation_id":"b81703fb-cc68-49ff-9bf9-d2fa8d94a975","resolution":{"observed_at":"2026-08-10T04:33:13.744861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.727418Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume =","venue":null,"work_id":"877d74e3-84af-4a59-8b0d-f2b74d5d8b3f","year":null},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.369679Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:e50c566a75674b4320a53819062300628b6b0f04d413eece91ae57b8ef643e05","observation_id":"658f4625-eef6-4eee-a14f-2150816de3cb","resolution":{"observed_at":"2026-08-10T04:33:13.731579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.714555Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume =","venue":null,"work_id":"37696ad3-ff66-425f-817b-6cac0bbb6067","year":null},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.373521Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:23c3e19fa630b9233e9abc3e40db1adb799e983e5ac84b51d1744424eae2ea2d","observation_id":"8a83c2e7-56fe-4195-ab40-daef100d305b","resolution":{"observed_at":"2026-08-10T04:33:13.718757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.700786Z","title":"and others , title =","venue":null,"work_id":"76b29267-d9a7-409a-843e-654112b00fe0","year":null},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.378219Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:35550b3519f70eb7373d72cf5cc0753a3323ac02fdb96cf331bd51308f9191c7","observation_id":"6862f3ea-dfb1-4170-bb25-f4f096c40ea2","resolution":{"observed_at":"2026-08-10T04:33:13.705940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.687700Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume =","venue":null,"work_id":"a16b7963-797b-4c76-8bcf-a2b8e32e9c57","year":null},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.382012Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:ca346283b944516e6e05b39fcc107789fd3d53b6a473ac6d49d4a90705583373","observation_id":"477e9c32-3857-442b-a066-7d35cf2e3493","resolution":{"observed_at":"2026-08-10T04:33:13.691909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.674747Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume =","venue":null,"work_id":"caca87d7-a821-41a5-ba57-cc1833d5b03f","year":null},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.386260Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:b357ea1265711a7cf199f8571ba0eb9299061bc993fb36465aa676523462e698","observation_id":"8c66c1d6-f551-4191-a368-18c65f675f01","resolution":{"observed_at":"2026-08-10T04:33:13.679057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.660593Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume =","venue":null,"work_id":"6da93134-9103-4d32-b09d-2b19993e67f5","year":null},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.390535Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:463442647d62b657f88122b936bbdbc7ee404b372abfcf6a5b377ceae979f701","observation_id":"9e99998e-71e0-4836-92df-5add91e64252","resolution":{"observed_at":"2026-08-10T04:33:13.665184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.646099Z","title":"International Conference on Learning Representations , year =","venue":null,"work_id":"b67b82a5-ed82-4fd4-b37e-5d4ef3f862e0","year":null},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.394355Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:cb04c229f401611c07ab8ae6629569dd1ed7c77f9ccbfd63a39077a2a2cd2aa9","observation_id":"809c4fda-bb90-4d99-b084-cbc756cd6192","resolution":{"observed_at":"2026-08-10T04:33:13.651106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.633013Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics , pages =","venue":null,"work_id":"51cb6074-0790-4ace-a443-84f5a8e0c9ab","year":2025},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.398519Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:f9b7be4b81282b9086cf1b2eeb6ae26b155d3b93b63fa7ab635bc6e2eea9f6ce","observation_id":"ddeee0bf-7ff2-46a1-9400-7e58168cb118","resolution":{"observed_at":"2026-08-10T04:33:13.637480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.618877Z","title":"2025 , eprint =","venue":null,"work_id":"1f81aa02-08e6-4ea2-9132-8a8e09da7a22","year":2025},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.402492Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:6d2898e9fd9f4003d26248ce32c2d6b8dc66429b2ce88f7c972116e28fee6305","observation_id":"1d3d6c66-874c-4f3a-82aa-e6b5cf04431b","resolution":{"observed_at":"2026-08-10T04:33:13.623311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.604767Z","title":"2025 , eprint =","venue":null,"work_id":"1077c2f2-9253-470e-a90c-3f6061829568","year":2025},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.406998Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:30b7eeaafc1a33197c0aa2fe7af2f216bdeea0bc02f3012eeab4501cca5056be","observation_id":"154536d3-cf86-4d12-a7f3-d6fe5de0644b","resolution":{"observed_at":"2026-08-10T04:33:13.609329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.588716Z","title":"Great Models Think Alike and This Undermines","venue":null,"work_id":"1b7f8a55-f5d7-49af-bd27-2dc8e1695d20","year":2025},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.411864Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:eb9d967c0017c90f793155e83dd265ec9bab0ca006dafa707312e97104e9dce6","observation_id":"f8393bb2-62b1-4349-ba4e-13c541662da4","resolution":{"observed_at":"2026-08-10T04:33:13.593665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.573556Z","title":"and Kantamneni, Subhash and Tegmark, Max , title =","venue":null,"work_id":"73303396-0256-40d0-8314-ab592c8f3d59","year":2025},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.416157Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:f4304b7649e00cfeca968aceb1dfa23b119d91a559617552ceadc7c23dd92515","observation_id":"129c753b-f7f7-45ba-b379-9da58f20d6bd","resolution":{"observed_at":"2026-08-10T04:33:13.577847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.560444Z","title":"International Conference on Learning Representations , year =","venue":null,"work_id":"53cd7921-a1d2-43f4-9a83-d729f36b96dc","year":null},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.420192Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:7aa3670fadc34fc5226f5552e762325f3dabe80855fd492306429f424580d6e1","observation_id":"49766778-4f3a-4b02-8801-cad6e9f0dedf","resolution":{"observed_at":"2026-08-10T04:33:13.564629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.546786Z","title":"2025 , eprint =","venue":null,"work_id":"c49ad7d3-527e-4707-adf2-9dbf781bfdac","year":2025},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.424105Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:294f0dc8436e049985bc138955a8025691432dfb4173c469dee17007e39e6c84","observation_id":"68e2f004-9e3d-4a4b-9455-14385f22c547","resolution":{"observed_at":"2026-08-10T04:33:13.551233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.533587Z","title":"and Yoon, Seunghyun and Schuetze, Hinrich , title =","venue":null,"work_id":"c9d6b363-0780-44f9-8156-8e9c7b27d0a8","year":2025},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.428253Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:6d0cabfc7593ec86f55cd5f12e185b9aa3818e64182d926d6c7707d21ada58b9","observation_id":"ec5c16c4-0aaa-451e-a5cf-b740872269d4","resolution":{"observed_at":"2026-08-10T04:33:13.537947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:33:13.515368Z","title":"Proceedings of the 2025 ACM SIGIR International Conference on the Theory of Information Retrieval , year =","venue":null,"work_id":"93231e53-3ac1-4c30-98b2-9f6a78673afc","year":2025},"citing_paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-10T04:33:13.432133Z"},"links":{"citing_paper":"/paper/2608.06422"},"observation_digest":"sha256:ab089a4a4a92785d6210aa8277e064c1e37d50c9b401223adf6c2eae0c2981e7","observation_id":"eefed925-87cd-486f-91ce-a3955b4a4680","resolution":{"observed_at":"2026-08-10T04:33:13.522837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.06422","last_updated":"2026-08-05T18:21:21Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T17:24:49.364907Z","submitted_at":"2026-08-05T18:21:21Z","title":"Sharding Prevents LLM Oversight Failures and Adversarial Exploitation"},"reference_resolution":{"displayed":95,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":0,"verified_fuzzy":64},"total_outbound_references":95},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 95 of 95 outbound references and 0 inbound Pith citation observations for arXiv:2608.06422."}