{"as_of":"2026-08-08T09:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4c9e82bf818c31bc55ce5ef49f149f2862ddf22930a5e91dcd7dcf8b4d5137d0","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T23:49:13.596563Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2602.12963/citation-record","integrity":"/paper/2602.12963/integrity","json":"/paper/2602.12963/citation-record.json","paper":"/paper/2602.12963"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:49:11.095103Z","title":"Un- derstanding world or predicting future? a comprehensive survey of world models.ACM Computing Surveys, 58(3):1–38, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.12963","last_updated":"2026-07-14T15:00:49Z","snapshot_observed_at":"2026-08-07T16:35:02.756611Z","submitted_at":"2026-02-13T14:29:17Z","title":"Calculating Mutual Information between a Reward Maximizer and its Environment","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T23:49:11.095103Z"},"links":{"citing_paper":"/paper/2602.12963"},"observation_digest":"sha256:17bb598c7518ba1c006d167d778698cb0b766e87b3fc6b206b10332ba3ec8c5f","observation_id":"5e3fe48a-588d-47b7-ab43-4d14e62e5a2d","resolution":{"observed_at":"2026-08-02T23:49:11.095103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:49:11.258549Z","title":"Towards a formalization of the agent structure problem","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.12963","last_updated":"2026-07-14T15:00:49Z","snapshot_observed_at":"2026-08-07T16:35:02.756611Z","submitted_at":"2026-02-13T14:29:17Z","title":"Calculating Mutual Information between a Reward Maximizer and its Environment","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T23:49:11.258549Z"},"links":{"citing_paper":"/paper/2602.12963"},"observation_digest":"sha256:e3766a78e718df51c3fa9feb275f2a185309f8661b4838d54e638237ffaf68a4","observation_id":"8a3652af-c5ab-4b61-a99b-fa0245389e3c","resolution":{"observed_at":"2026-08-02T23:49:11.258549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:49:11.439453Z","title":"General agents need world models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.12963","last_updated":"2026-07-14T15:00:49Z","snapshot_observed_at":"2026-08-07T16:35:02.756611Z","submitted_at":"2026-02-13T14:29:17Z","title":"Calculating Mutual Information between a Reward Maximizer and its Environment","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T23:49:11.439453Z"},"links":{"citing_paper":"/paper/2602.12963"},"observation_digest":"sha256:c7de8cf13c55b9ba4b1a3d36cd8f958129efabe950f1f723ef1e3ebf83caa0d9","observation_id":"e41e4456-b722-4f07-98c0-328c269f6bc3","resolution":{"observed_at":"2026-08-02T23:49:11.439453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:49:11.562592Z","title":"Settling the reward hypothesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.12963","last_updated":"2026-07-14T15:00:49Z","snapshot_observed_at":"2026-08-07T16:35:02.756611Z","submitted_at":"2026-02-13T14:29:17Z","title":"Calculating Mutual Information between a Reward Maximizer and its Environment","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T23:49:11.562592Z"},"links":{"citing_paper":"/paper/2602.12963"},"observation_digest":"sha256:77418d613cbe24331b85dab1235f84956e7acc44c599eb895765e7d3c8222a94","observation_id":"07ab1773-502a-49db-82df-e7abcdd5fdc6","resolution":{"observed_at":"2026-08-02T23:49:11.562592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:49:11.739683Z","title":"Theory of games and economic behavior: 60th anniversary commemorative edition","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2602.12963","last_updated":"2026-07-14T15:00:49Z","snapshot_observed_at":"2026-08-07T16:35:02.756611Z","submitted_at":"2026-02-13T14:29:17Z","title":"Calculating Mutual Information between a Reward Maximizer and its Environment","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T23:49:11.739683Z"},"links":{"citing_paper":"/paper/2602.12963"},"observation_digest":"sha256:71748c3aff715a14b29034fe8520258a36ba692aed8f7424d9b45a06f3366d27","observation_id":"a8ca5bdb-a5f8-4b1d-b733-3e072f9b219f","resolution":{"observed_at":"2026-08-02T23:49:11.739683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:49:11.863297Z","title":"Sutton and Andrew G","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.12963","last_updated":"2026-07-14T15:00:49Z","snapshot_observed_at":"2026-08-07T16:35:02.756611Z","submitted_at":"2026-02-13T14:29:17Z","title":"Calculating Mutual Information between a Reward Maximizer and its Environment","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T23:49:11.863297Z"},"links":{"citing_paper":"/paper/2602.12963"},"observation_digest":"sha256:b5aeb94a78dc1aac198eb323108478124aa6f0cc2d786abea7a203a56a3c9e4d","observation_id":"d393cda6-21de-41cd-b691-663d49d15f39","resolution":{"observed_at":"2026-08-02T23:49:11.863297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:49:12.049213Z","title":"Intelligence without representation.Artificial intelli- gence, 47(1-3):139–159, 1991","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2602.12963","last_updated":"2026-07-14T15:00:49Z","snapshot_observed_at":"2026-08-07T16:35:02.756611Z","submitted_at":"2026-02-13T14:29:17Z","title":"Calculating Mutual Information between a Reward Maximizer and its Environment","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T23:49:12.049213Z"},"links":{"citing_paper":"/paper/2602.12963"},"observation_digest":"sha256:6da67375066117d57a40627fbaa0b8ea1c20bd96d13555e891c196e39927e643","observation_id":"3c86aaf1-d795-4000-8da6-0eef4a566a38","resolution":{"observed_at":"2026-08-02T23:49:12.049213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:49:12.201047Z","title":"The bitter lesson.Incomplete Ideas (blog), 13(1):38, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.12963","last_updated":"2026-07-14T15:00:49Z","snapshot_observed_at":"2026-08-07T16:35:02.756611Z","submitted_at":"2026-02-13T14:29:17Z","title":"Calculating Mutual Information between a Reward Maximizer and its Environment","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T23:49:12.201047Z"},"links":{"citing_paper":"/paper/2602.12963"},"observation_digest":"sha256:890b9c38bb3ffc0f69c3d7137ba17c25be48214df6f35148b24521a3eebaa093","observation_id":"4dd0cab2-65ce-451b-8acd-d9d533e87d7e","resolution":{"observed_at":"2026-08-02T23:49:12.201047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-07-31T21:36:45.596575Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-02T23:49:12.322309Z","title":"World models.arXiv preprint arXiv:1803.10122, 2(3), 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.12963","last_updated":"2026-07-14T15:00:49Z","snapshot_observed_at":"2026-08-07T16:35:02.756611Z","submitted_at":"2026-02-13T14:29:17Z","title":"Calculating Mutual Information between a Reward Maximizer and its Environment","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T23:49:12.322309Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2602.12963"},"observation_digest":"sha256:486bfc3b721c33c06ee38a22bd675efd8a9f753e9f0c2c1a4b65472c989ff4f9","observation_id":"4398e965-cbfc-46bc-bf11-d5167ddae59a","resolution":{"observed_at":"2026-08-02T23:49:12.322309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:49:12.449584Z","title":"Information-theoretic approach to the study of control systems.Physica A: Statistical Mechanics and its Appli- cations, 331(1-2):140–172, 2004","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2602.12963","last_updated":"2026-07-14T15:00:49Z","snapshot_observed_at":"2026-08-07T16:35:02.756611Z","submitted_at":"2026-02-13T14:29:17Z","title":"Calculating Mutual Information between a Reward Maximizer and its Environment","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T23:49:12.449584Z"},"links":{"citing_paper":"/paper/2602.12963"},"observation_digest":"sha256:c44fc9a49e0c79bf6fecff7637aa18d7a1f43fb293205a257082fd153cd95efa","observation_id":"fe8f54fc-3bc4-4a36-83e0-4a9f88966cb7","resolution":{"observed_at":"2026-08-02T23:49:12.449584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10877","last_updated":"2024-07-19T11:12:08Z","snapshot_observed_at":"2026-07-06T17:31:17.058043Z","submitted_at":"2024-02-16T18:29:19Z","title":"Robust agents learn causal world models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10877","snapshot_observed_at":"2026-08-02T23:49:12.592843Z","title":"Robust agents learn causal world models.arXiv preprint arXiv:2402.10877, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.12963","last_updated":"2026-07-14T15:00:49Z","snapshot_observed_at":"2026-08-07T16:35:02.756611Z","submitted_at":"2026-02-13T14:29:17Z","title":"Calculating Mutual Information between a Reward Maximizer and its Environment","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T23:49:12.592843Z"},"links":{"cited_paper":"/paper/2402.10877","citing_paper":"/paper/2602.12963"},"observation_digest":"sha256:8e813e0c56063f6925716b6b57fcdcbc49916266b0084c87282d966ca5021218","observation_id":"584c8a66-b773-4203-a89d-1a8991ffc0be","resolution":{"observed_at":"2026-08-02T23:49:12.592843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:49:12.717620Z","title":"General agents contain world models, even under par- tial observability and stochasticity.arXiv preprint arXiv:2602.03146, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2602.12963","last_updated":"2026-07-14T15:00:49Z","snapshot_observed_at":"2026-08-07T16:35:02.756611Z","submitted_at":"2026-02-13T14:29:17Z","title":"Calculating Mutual Information between a Reward Maximizer and its Environment","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T23:49:12.717620Z"},"links":{"citing_paper":"/paper/2602.12963"},"observation_digest":"sha256:e8f46579871bb7bcf108f39c76331190a8ac54ea819caa1f42514f7115fbdecf","observation_id":"b7128e84-2c7e-4286-8d94-c69f5b10ea6a","resolution":{"observed_at":"2026-08-02T23:49:12.717620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:49:12.832985Z","title":"John Wiley & Sons, 1999","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2602.12963","last_updated":"2026-07-14T15:00:49Z","snapshot_observed_at":"2026-08-07T16:35:02.756611Z","submitted_at":"2026-02-13T14:29:17Z","title":"Calculating Mutual Information between a Reward Maximizer and its Environment","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T23:49:12.832985Z"},"links":{"citing_paper":"/paper/2602.12963"},"observation_digest":"sha256:51b9a36e02a1b86cbf1f1b8d4a0ad542f0ab6f071ac8cb10af58de5d1cff1ce1","observation_id":"bc28576c-5617-451c-a329-2048f28c2a6a","resolution":{"observed_at":"2026-08-02T23:49:12.832985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1512.07276","last_updated":"2015-12-22T22:01:22Z","snapshot_observed_at":"2026-07-06T04:40:50.003234Z","submitted_at":"2015-12-22T22:01:22Z","title":"The Zero Set of a Real Analytic Function","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1512.07276","snapshot_observed_at":"2026-08-02T23:49:12.985514Z","title":"The zero set of a real analytic function.arXiv preprint arXiv:1512.07276, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2602.12963","last_updated":"2026-07-14T15:00:49Z","snapshot_observed_at":"2026-08-07T16:35:02.756611Z","submitted_at":"2026-02-13T14:29:17Z","title":"Calculating Mutual Information between a Reward Maximizer and its Environment","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T23:49:12.985514Z"},"links":{"cited_paper":"/paper/1512.07276","citing_paper":"/paper/2602.12963"},"observation_digest":"sha256:634ffb10480fe7b04ef1cc7db5180a032cd10376137f3e22003ec7ffd7f8ab12","observation_id":"519a8eae-4d91-4e25-be99-7a18e303b21a","resolution":{"observed_at":"2026-08-02T23:49:12.985514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:49:13.125841Z","title":"Spivak.Calculus On Manifolds: A Modern Approach To Classical The- orems Of Advanced Calculus (1st ed.)","venue":null,"work_id":null,"year":1965},"citing_paper":{"arxiv_id":"2602.12963","last_updated":"2026-07-14T15:00:49Z","snapshot_observed_at":"2026-08-07T16:35:02.756611Z","submitted_at":"2026-02-13T14:29:17Z","title":"Calculating Mutual Information between a Reward Maximizer and its Environment","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T23:49:13.125841Z"},"links":{"citing_paper":"/paper/2602.12963"},"observation_digest":"sha256:239559c829e708aabb14bc2fc935a69867b219550bd8cf15308208c09c41c07b","observation_id":"281b0e34-4bc1-43ab-880d-ae7425e459c3","resolution":{"observed_at":"2026-08-02T23:49:13.125841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:49:13.273065Z","title":"Number 2","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2602.12963","last_updated":"2026-07-14T15:00:49Z","snapshot_observed_at":"2026-08-07T16:35:02.756611Z","submitted_at":"2026-02-13T14:29:17Z","title":"Calculating Mutual Information between a Reward Maximizer and its Environment","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T23:49:13.273065Z"},"links":{"citing_paper":"/paper/2602.12963"},"observation_digest":"sha256:14fe09240eec280dae77a0e2cf94e6f5f3049c6c69362f9144482855577b6d13","observation_id":"f9bd66fc-3985-40c4-ac07-357cd25ef09f","resolution":{"observed_at":"2026-08-02T23:49:13.273065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:49:13.412807Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.12963","last_updated":"2026-07-14T15:00:49Z","snapshot_observed_at":"2026-08-07T16:35:02.756611Z","submitted_at":"2026-02-13T14:29:17Z","title":"Calculating Mutual Information between a Reward Maximizer and its Environment","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T23:49:13.412807Z"},"links":{"citing_paper":"/paper/2602.12963"},"observation_digest":"sha256:a89cc7d97096a16400823d7d2b94da7d290f06690b40a69c6b4b9e6b8e749063","observation_id":"52126812-be58-4599-a0d5-aa32a1f89244","resolution":{"observed_at":"2026-08-02T23:49:13.412807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:49:13.596563Z","title":"Courier Corporation, 2012","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2602.12963","last_updated":"2026-07-14T15:00:49Z","snapshot_observed_at":"2026-08-07T16:35:02.756611Z","submitted_at":"2026-02-13T14:29:17Z","title":"Calculating Mutual Information between a Reward Maximizer and its Environment","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T23:49:13.596563Z"},"links":{"citing_paper":"/paper/2602.12963"},"observation_digest":"sha256:134ed1310ffb3a594383fac8b6aaf2b57943158f5cd95febec01f92940ea58a1","observation_id":"9ac7b669-87d7-41bc-b065-246ed2f1bb7e","resolution":{"observed_at":"2026-08-02T23:49:13.596563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T23:49:13.495204Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.12963","last_updated":"2026-07-14T15:00:49Z","snapshot_observed_at":"2026-08-07T16:35:02.756611Z","submitted_at":"2026-02-13T14:29:17Z","title":"Calculating Mutual Information between a Reward Maximizer and its Environment","version":2},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-08-02T23:49:13.495204Z"},"links":{"citing_paper":"/paper/2602.12963"},"observation_digest":"sha256:868b2be9fc865efb625a99680b1a51cb2e6f924eecca4fd0f71f771eb8599a49","observation_id":"22eef67d-ca49-464c-9f1a-440385ca21ef","resolution":{"observed_at":"2026-08-02T23:49:13.495204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.12963","last_updated":"2026-07-14T15:00:49Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T16:35:02.756611Z","submitted_at":"2026-02-13T14:29:17Z","title":"Calculating Mutual Information between a Reward Maximizer and its Environment"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:2602.12963."}