{"as_of":"2026-08-10T05:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3bb37b5113c5b88f29ea8cf08355c22d9a756258d65d683f4b3b9d54f2c0877e","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T17:54:49.531461Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.04528/citation-record","integrity":"/paper/2607.04528/integrity","json":"/paper/2607.04528/citation-record.json","paper":"/paper/2607.04528"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:ce74278878995161fb000e6852402f13c9d946c0fc26bac8a457b19bdbc328c5","observation_id":"7061a168-5ccc-47d4-ba03-ecec2a7c5788","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:67352de2a33fb34d7ce6086e78d679ad9d3b9617f079008225db0e586abe4cac","observation_id":"209cfd80-a101-4e0a-a61d-9da4f1d67afd","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:5d5a226931749624b4ac067b6fb9390bb29ee91432aa78dbe3bfe01606d5f1c4","observation_id":"6da13153-85ec-440e-a6d3-29b3a26c318b","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:9ae30ac8764a834bd3bef5a7b839c7e80b10f2655c36eb13bc837c8df249f022","observation_id":"51599f35-7f1b-4b1a-a3a2-f4185f45a857","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"and Yang, John and Wettig, Alexander and Yao, Shunyu and Pei, Kexin and Press, Ofir and Narasimhan, Karthik , booktitle =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:750efe6eab14a99eec15a877ab92ec4341258ba2a46dfdadf2976097a11441be","observation_id":"2eda1434-897b-47f3-b4b4-6e640b1d21a6","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"2024 , month = aug, howpublished =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:f295169bfa9bf914cd43ea2ebd6ee1a52ed01b40f43758fab50bb26f0999b147","observation_id":"b46df4a4-2bf1-483e-98a0-5d429b7ebf77","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"International Conference on Learning Representations , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:cb34f69ec0e3fa9d94a52d29e2de3fc522a3a41da5705d243d3d8f4d6d81f4cd","observation_id":"ff4b8182-fd69-4b91-a747-f39bc94d5c2e","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:2b8125fd11e7284acff9a9c52e8c81560b0f2ad5822a90b831844c8f2d06b40d","observation_id":"6fd8adf0-e409-4ec9-8831-fc906ecc22ca","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15793","last_updated":"2024-11-11T20:01:15Z","snapshot_observed_at":"2026-07-06T18:19:29.996982Z","submitted_at":"2024-05-06T17:41:33Z","title":"SWE-agent: Agent-Computer Interfaces Enable Automated Software Engineering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15793","snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"arXiv preprint arXiv:2405.15793 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"cited_paper":"/paper/2405.15793","citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:0f17c893543d428b45f5c953c2ecb7b1a2eb54b1f67226eee9af8799fe2f3245","observation_id":"8c1e27a4-2929-46ee-a9fc-0cabad383856","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:b450994abee3fd9da9973bd0eb62ebdf1ebcc3289a975137f7e284caa9798167","observation_id":"e25272fb-7159-47dd-b1de-153817ade270","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.22166","last_updated":"2026-05-27T04:34:36Z","snapshot_observed_at":"2026-07-06T23:32:30.578213Z","submitted_at":"2026-05-21T08:36:49Z","title":"Adapting the Interface, Not the Model: Runtime Harness Adaptation for Deterministic LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.22166","snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"arXiv preprint arXiv:2605.22166 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"cited_paper":"/paper/2605.22166","citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:230ae7bb5bce25f3e13012f54bbab8143861e79ac415fda7cbcbc35b8a9d9e29","observation_id":"25578378-4ed4-4a83-94b9-78f5542138ed","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing , year=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:e0e56eb497ff36f3090da9e264502c09da5809b383fb3e2d76f6c2961cc2b20a","observation_id":"115bd7c7-fefc-4afd-9de8-df05951aba4c","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"International Conference on Machine Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:7f8292b730ffa6d11d7c4560258bf64395e849a63004377dce543409083643dd","observation_id":"705862df-e9c4-4ef5-8bfd-b8ce07ac6ec0","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:4db357638c210deb54bf38bfa55cade8c2110789fe336c681dd5104ad66f6e6c","observation_id":"57aeebe4-77a7-4e05-923b-14d4c95f98fd","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:0c909170e3bb9f1ee55f0ddbc6aaba772f7bd744ac21aff0ecd327e658da03e2","observation_id":"3df9222f-0a07-4db8-8e8c-3656971e90ba","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:9d3b39cbd69a0f99439a81d78064ec524caf8bbb621b01382d5088b761f03fd8","observation_id":"afdc7cd7-97ce-4616-8c31-809cdb382215","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:7a3f698eb98e1e9642568dd880d34dc45a0010c42dc9b1f9bdbfd3a42c44f93b","observation_id":"701681f0-d248-4513-ae4a-c6b20ce130d0","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:a0ca0583c5b88339b847076be8d69acffb38d7ab490f6624760d68e142277fd9","observation_id":"0b6cd11d-8ac5-460b-8849-1c2958337052","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"What Twelve","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:1c9bd84f91f48df2a320e46cbf51fd82ab0639bb53d687702db3e542bff674d7","observation_id":"9eae076f-47cc-45f2-96c0-f94007673215","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"Proceedings of the 31st ACM SIGKDD Conference on Knowledge Discovery and Data Mining , doi=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:2d2bcfecf07bb225d5fa55af2cef307420b78332e11096af8d43ed501ffb5010","observation_id":"0865f8f4-1009-4b99-a28b-7772b64f0215","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.16492","last_updated":"2026-06-26T11:50:13Z","snapshot_observed_at":"2026-08-08T13:13:47.504376Z","submitted_at":"2025-10-18T13:22:19Z","title":"Check Yourself Before You Wreck Yourself: Selectively Quitting Improves LLM Agent Safety","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.16492","snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"arXiv preprint arXiv:2510.16492 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"cited_paper":"/paper/2510.16492","citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:12de26c3f3cd64469519b3fac49991e97f2af32ddb507dd13db6061e66ff88a1","observation_id":"fa8156d4-3773-4d61-8d0a-53fb1295e6c7","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"ToolSafe: Enhancing Tool Invocation Safety of","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:85753ffeaf1a755d1600ef78151ad0ca01c54d758eccd9bbcf19d87100a4a6fe","observation_id":"c7f95e37-2bf1-403c-8784-d5a0dd7a580d","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.04785","last_updated":"2026-05-06T11:38:16Z","snapshot_observed_at":"2026-08-08T11:58:06.792645Z","submitted_at":"2026-05-06T11:38:16Z","title":"AgentTrust: Runtime Safety Evaluation and Interception for AI Agent Tool Use","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.04785","snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"arXiv preprint arXiv:2605.04785 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"cited_paper":"/paper/2605.04785","citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:1c982f460a31df3c9f94d928555ebcff2e4c8e844fb7a39786e644045fb7035e","observation_id":"c41604fe-2992-428e-affc-2e98ea476c96","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"A survey on","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:1d5900a2d98bcc3d27b4dd650e92aa23a7e20e4d34dde2fe0f0831a10de60786","observation_id":"cf2eb314-848a-46fa-bb5a-7a65aff92bd1","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"Understanding the planning of","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:d2d74ac8ea3e7e7087a2983a126feeba6413394077da60d6f73c93e12efc27e5","observation_id":"a3a51159-e628-489a-a8cd-f40b23b1fd27","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21460","last_updated":"2025-03-27T12:50:17Z","snapshot_observed_at":"2026-07-06T20:59:35.694800Z","submitted_at":"2025-03-27T12:50:17Z","title":"Large Language Model Agent: A Survey on Methodology, Applications and Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21460","snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"arXiv preprint arXiv:2503.21460 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"cited_paper":"/paper/2503.21460","citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:967fe1d96a8c37eaa3f77ffc380bda8229639cd968975d8fb8a08959ac75c9da","observation_id":"87322373-e774-45f1-b21d-c5d5e11ad5b6","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"and others , booktitle=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:65f6bbf9b7670524438b80656d1392a3a505700905293bf57a9b99a6d4100ca1","observation_id":"aa5355cf-334b-4c20-9355-912e64a16f8c","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:4a51e99ab32d544eadd475efe1de9cc643bf1cc72099a6eb799540b732e0752a","observation_id":"a391e31b-cf43-4e24-ba30-09724db7f417","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:fb88441316e455b2f2355eb142339dc0fc55be351150dbd275d68c273b76e404","observation_id":"341c9502-9802-414c-a12f-b2801821070a","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"2025 , url=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:13f65a7ec13bbee9a557c09f67911a3a5b95a95cb50f02861613a227df133e68","observation_id":"76318b37-209c-4258-848b-e814821bceac","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:986761abcc13f9f76b92fc1cdebe444956736e8704542d5e6d844a9b7960ca5e","observation_id":"2c5862c3-30e1-408a-b692-2ce90737d4a7","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:37e600c29905b18c27572e2a4c28e3f781be90cde5f334c4ad76bf747118b606","observation_id":"477c94cd-886f-416e-9fee-d72bede3f641","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"arXiv preprint arXiv:2301.04104 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:a3286e257f8b75f1a9391fe29c7df999eafe10b41b7c0d86d9a077adc146771b","observation_id":"500797a1-c5d7-45a4-9142-499c003402be","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23773","last_updated":"2026-05-21T08:18:41Z","snapshot_observed_at":"2026-07-06T22:05:57.485783Z","submitted_at":"2025-07-31T17:57:20Z","title":"General Agentic Planning Through Simulative Reasoning with World Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23773","snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"arXiv preprint arXiv:2507.23773 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"cited_paper":"/paper/2507.23773","citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:09c1cfaa1208c992e27fd11b9857872acac0da52198a00e7f390aac5c58f79db","observation_id":"8a079037-84ff-4569-a5a8-6f195b74c36d","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"The Verifier Tax: Horizon Dependent Safety Success Tradeoffs in Tool Using","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:93089c502cea2c0e7d23b39b407605881c57aa17a9b51757249b431a69527cd8","observation_id":"1570c7d3-a33b-437b-a863-6c47e2c13b16","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"When Refusals Fail: Unstable Safety Mechanisms in Long-Context","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:efb2ecbc7acbe8b9fac5910b5d4ba309abf2e3bab61be6756edc58b074977197","observation_id":"cbf15fc6-0fa6-4a2d-9a69-12cec3dcb874","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"From Reward-Hack Activations to Agentic Risk States: Context-Calibrated Mechanistic Monitoring in","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:14aa71369245c8d96e2b5cdee16e92b85913fe7b354e4dd0967a94b7373b5c68","observation_id":"5706530f-dd37-4ef6-a7d9-b1d3c73da37a","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:de48b66c5495b0ad6baff71792f5f3890294274de4ffe923a2fa47c5415428bc","observation_id":"216d2d1f-bba0-4281-bb84-27635bee6cc8","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:b6664f1a3729bedcec7b012673c7cb7c5fe162a304bc7a23175af780d54ebe8b","observation_id":"465881e4-6168-45ba-8a4e-eb52dfcb32ca","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.11211","last_updated":"2026-04-24T04:46:16Z","snapshot_observed_at":"2026-08-06T06:29:18.404870Z","submitted_at":"2026-04-24T04:46:16Z","title":"Calibration Drift Under Reasoning: How Chain-of-Thought Budgets Induce Overconfidence in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.11211","snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"arXiv preprint arXiv:2606.11211 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"cited_paper":"/paper/2606.11211","citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:e957fcabda5a5e1bd78f5ac521002ebd4ccff7abef177e07318d5f118ab6d55b","observation_id":"d8879794-a8c6-45f1-8b95-c0b2815085c5","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"Proceedings of the 34th International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:37c7b753649424d0a2a0f9aac71e27b19d98c01ac637853f1e63698db158cfe7","observation_id":"96c71489-75e4-445a-8e2f-9e249c96ce48","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-06T08:34:11.887259Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"arXiv preprint arXiv:2207.05221 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:1b946ba618cf9230a0e9dea9e7a0d7946f800af48ed180637d56f084bdfa8533","observation_id":"672f45ab-f9e4-4aa7-a776-89f243140940","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"Advances in Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:19ed1cc9b6f397a07625b0a1172d668cfe2dc531eb708c68b0530417e7b786b4","observation_id":"3f6f592b-1568-4a50-a63d-2e9d23b2342f","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"and Hashimoto, Tatsunori , journal=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:5d4e638041d36763ac3a4bb9eb5ee7c0b974b8a3cda1d2b2d927c194d6d60607","observation_id":"6779b6cb-a611-4d2f-9d1d-3e562ba96152","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:fa56f8f893f61994ee260d0ae8761894cfb0e338648538bd5cd703a55aacba4e","observation_id":"8fc14ea2-a577-4987-b10f-f41b5b29c82d","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"Advances in Neural Information Processing Systems Datasets and Benchmarks Track , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:daddfe59c296d61172d04db386aa551c41fb82212bce6668b3fdef6b015480c1","observation_id":"3bfcde63-3c9f-43ba-81f5-89f376723791","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"2023 , doi=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:51c4a391557137c32ee692b318b3d2e7768e86073c5e5f437c7fd570c5d97850","observation_id":"a0032871-8796-4afe-abf1-3729862a7b0c","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:da3b3def9d476d8932f3f2f88c6e63d8e7e0cadb092038c4d1571e8b2bd0559b","observation_id":"16f624d1-5917-492b-a733-c61075a7f37e","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"and Zhang, Tianjun and Wang, Xin and Gonzalez, Joseph E","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:60557af0b618d464992a960fe0c0af27a9223928d3a94bfdee2ce0694509a6a9","observation_id":"db9e92c0-31c1-4029-8d8e-32cc97656d1f","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:54:49.531461Z","title":"and Mao, Huanzhi and Ji, Charlie Cheng-Jie and Yan, Fanjia and Suresh, Vishnu and Stoica, Ion and Gonzalez, Joseph E","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-07-11T17:54:49.531461Z"},"links":{"citing_paper":"/paper/2607.04528"},"observation_digest":"sha256:2c880e32cb5946377a95eebfe975a101de86f6d36673ee98542beb72a44ad35a","observation_id":"a05fbeee-3311-4710-9057-5eda6a5ac019","resolution":{"observed_at":"2026-07-11T17:54:49.531461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.04528","last_updated":"2026-07-05T22:22:39Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-06T09:31:33.885518Z","submitted_at":"2026-07-05T22:22:39Z","title":"Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":50,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2607.04528."}