{"as_of":"2026-08-07T17:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ae70f472583641c27f93efded9b7eac983e7fba54f53cc084fae38bb2d2f09a4","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T11:58:03.858544Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T01:01:50.627177Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.22255","last_updated":"2025-07-29T22:09:35Z","snapshot_observed_at":"2026-08-06T11:58:02.920060Z","submitted_at":"2025-07-29T22:09:35Z","title":"Agent-centric learning: from external reward maximization to internal knowledge curation","version":1},"cited_work":{"arxiv_id":"2507.22255","doi":"10.48550/arxiv.2507.22255","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.22255","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agent-centric learning: from external reward maximization to internal knowledge curation , year =","venue":"MPG.PuRe (Max Planck Society)","work_id":"c98e7c52-9575-48f6-b755-96d0a16b0c26","year":null},"citing_paper":{"arxiv_id":"2605.08406","last_updated":"2026-05-08T19:12:14Z","snapshot_observed_at":"2026-07-06T23:20:38.385189Z","submitted_at":"2026-05-08T19:12:14Z","title":"Effective Explanations Support Planning Under Uncertainty","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-12T01:01:50.627177Z"},"links":{"cited_paper":"/paper/2507.22255","citing_paper":"/paper/2605.08406"},"observation_digest":"sha256:8e36b6e85e326bf52d8e87c5183d6915f1d2b8373cab6df299991e5531aaa4af","observation_id":"227be599-4166-4e83-8f0a-53d537622d1b","resolution":{"observed_at":"2026-05-12T01:06:13.931945Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.22255/citation-record","integrity":"/paper/2507.22255/integrity","json":"/paper/2507.22255/citation-record.json","paper":"/paper/2507.22255"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:58:04.458197Z","title":"Vime: Variational information maximizing exploration","venue":null,"work_id":"41a244cd-e3cf-4a30-8c90-c17281a64cdb","year":2025},"citing_paper":{"arxiv_id":"2507.22255","last_updated":"2025-07-29T22:09:35Z","snapshot_observed_at":"2026-08-06T11:58:02.920060Z","submitted_at":"2025-07-29T22:09:35Z","title":"Agent-centric learning: from external reward maximization to internal knowledge curation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T11:58:03.791506Z"},"links":{"citing_paper":"/paper/2507.22255"},"observation_digest":"sha256:9cf4ec3c12aef089cf0eb6d9e2b1bfa51808eb625fcd65fbf5b64afb47927fc2","observation_id":"5b0ca714-b3a4-435c-8d90-3f31dec0325a","resolution":{"observed_at":"2026-08-06T11:58:04.465815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10851","last_updated":"2023-11-14T23:23:16Z","snapshot_observed_at":"2026-07-06T14:20:42.913149Z","submitted_at":"2022-11-20T02:48:01Z","title":"Reward is not Necessary: How to Create a Modular & Compositional Self-Preserving Agent for Life-Long Learning","version":4},"cited_work":{"arxiv_id":"2211.10851","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.10851","snapshot_observed_at":"2026-08-06T11:58:04.071846Z","title":"Reward is not Necessary: How to Create a Modular & Compositional Self-Preserving Agent for Life-Long Learning","venue":"cs.AI","work_id":"a49516cf-6356-4657-a777-365e63f56d03","year":2022},"citing_paper":{"arxiv_id":"2507.22255","last_updated":"2025-07-29T22:09:35Z","snapshot_observed_at":"2026-08-06T11:58:02.920060Z","submitted_at":"2025-07-29T22:09:35Z","title":"Agent-centric learning: from external reward maximization to internal knowledge curation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T11:58:03.826691Z"},"links":{"cited_paper":"/paper/2211.10851","citing_paper":"/paper/2507.22255"},"observation_digest":"sha256:bccc1ddde46a2c4626eeecb32c3798dada7d5c45d357c3b8d6719cc720f7a828","observation_id":"5b989bf6-02ee-4f85-a0c9-88c4756acd0b","resolution":{"observed_at":"2026-08-06T11:58:04.084475Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:58:03.847501Z","title":"2404928121","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22255","last_updated":"2025-07-29T22:09:35Z","snapshot_observed_at":"2026-08-06T11:58:02.920060Z","submitted_at":"2025-07-29T22:09:35Z","title":"Agent-centric learning: from external reward maximization to internal knowledge curation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T11:58:03.847501Z"},"links":{"citing_paper":"/paper/2507.22255"},"observation_digest":"sha256:6f150ce1832cc7014b5c60e2616d326bbd8e0a4529925b0c366035430dbbcef6","observation_id":"8d887da1-45a7-49f7-8fba-14ee57546a7d","resolution":{"observed_at":"2026-08-06T11:58:03.847501Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05294","last_updated":"2024-05-08T10:03:50Z","snapshot_observed_at":"2026-08-07T10:59:44.065141Z","submitted_at":"2024-05-08T10:03:50Z","title":"Harmonizing Program Induction with Rate-Distortion Theory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05294","snapshot_observed_at":"2026-08-06T11:58:03.858544Z","title":"Hanqi Zhou, David G Nagy, and Charley M Wu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22255","last_updated":"2025-07-29T22:09:35Z","snapshot_observed_at":"2026-08-06T11:58:02.920060Z","submitted_at":"2025-07-29T22:09:35Z","title":"Agent-centric learning: from external reward maximization to internal knowledge curation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T11:58:03.858544Z"},"links":{"cited_paper":"/paper/2405.05294","citing_paper":"/paper/2507.22255"},"observation_digest":"sha256:e62e9b35ec4f8988ff086c748905ab89c63363b8a6cfa5c9d2b7b711f65bd9e2","observation_id":"011ca0c2-068e-4a00-9553-374bde89f386","resolution":{"observed_at":"2026-08-06T11:58:03.858544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"physics/0004057","last_updated":"2000-04-24T15:22:30Z","snapshot_observed_at":"2026-08-07T10:46:08.274157Z","submitted_at":"2000-04-24T15:22:30Z","title":"The information bottleneck method","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"physics/0004057","snapshot_observed_at":"2026-08-06T11:58:03.838978Z","title":"The information bottleneck method","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22255","last_updated":"2025-07-29T22:09:35Z","snapshot_observed_at":"2026-08-06T11:58:02.920060Z","submitted_at":"2025-07-29T22:09:35Z","title":"Agent-centric learning: from external reward maximization to internal knowledge curation","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-06T11:58:03.838978Z"},"links":{"cited_paper":"/paper/physics/0004057","citing_paper":"/paper/2507.22255"},"observation_digest":"sha256:9bd263ee53bee4ecb9a164e521c83e5b58df8dbc1325f3ee69dad495e0b2c0e3","observation_id":"8cc95a0c-d057-47ce-a2eb-35e1671b92af","resolution":{"observed_at":"2026-08-06T11:58:03.838978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23631","last_updated":"2025-05-27T22:09:36Z","snapshot_observed_at":"2026-08-07T16:26:52.034034Z","submitted_at":"2025-03-31T00:09:00Z","title":"Intrinsically-Motivated Humans and Agents in Open-World Exploration","version":2},"cited_work":{"arxiv_id":"2503.23631","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.23631","snapshot_observed_at":"2026-08-06T11:58:04.136120Z","title":"Intrinsically-Motivated Humans and Agents in Open-World Exploration","venue":"cs.AI","work_id":"db063da2-0643-415b-aa13-b298a4cc670f","year":2025},"citing_paper":{"arxiv_id":"2507.22255","last_updated":"2025-07-29T22:09:35Z","snapshot_observed_at":"2026-08-06T11:58:02.920060Z","submitted_at":"2025-07-29T22:09:35Z","title":"Agent-centric learning: from external reward maximization to internal knowledge curation","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-06T11:58:03.810178Z"},"links":{"cited_paper":"/paper/2503.23631","citing_paper":"/paper/2507.22255"},"observation_digest":"sha256:d263330feff7fb679cbbaa7ec2b7fb07be6df11b6cfdf094d056a06ce587040f","observation_id":"1ded20d0-b198-4d26-b4e6-8149e6bf8e3a","resolution":{"observed_at":"2026-08-06T11:58:04.153194Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.01820","last_updated":"2021-12-01T11:22:52Z","snapshot_observed_at":"2026-08-01T23:32:03.638122Z","submitted_at":"2019-06-05T04:43:25Z","title":"Risks from Learned Optimization in Advanced Machine Learning Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.01820","snapshot_observed_at":"2026-08-06T11:58:03.796973Z","title":"Risks from learned optimization in advanced machine learning systems","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2507.22255","last_updated":"2025-07-29T22:09:35Z","snapshot_observed_at":"2026-08-06T11:58:02.920060Z","submitted_at":"2025-07-29T22:09:35Z","title":"Agent-centric learning: from external reward maximization to internal knowledge curation","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-06T11:58:03.796973Z"},"links":{"cited_paper":"/paper/1906.01820","citing_paper":"/paper/2507.22255"},"observation_digest":"sha256:24b63d6e5a2890412daae76321a5891c3a0ee31069bbbfc349c1523207f0054a","observation_id":"15ef19a5-5124-472e-96d2-d4dc9c016684","resolution":{"observed_at":"2026-08-06T11:58:03.796973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.05325","last_updated":"2020-03-11T14:25:43Z","snapshot_observed_at":"2026-07-06T09:03:58.764166Z","submitted_at":"2020-03-11T14:25:43Z","title":"Meta-learning curiosity algorithms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.05325","snapshot_observed_at":"2026-08-06T11:58:03.744415Z","title":"Meta-learning curiosity algorithms","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2507.22255","last_updated":"2025-07-29T22:09:35Z","snapshot_observed_at":"2026-08-06T11:58:02.920060Z","submitted_at":"2025-07-29T22:09:35Z","title":"Agent-centric learning: from external reward maximization to internal knowledge curation","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T11:58:03.744415Z"},"links":{"cited_paper":"/paper/2003.05325","citing_paper":"/paper/2507.22255"},"observation_digest":"sha256:abc83151bcc9125ad12a046de62bfe810ce507ac8993fab89e78bf6a583ea5b6","observation_id":"f4640899-baca-44ce-9efe-7dfc1f4c885c","resolution":{"observed_at":"2026-08-06T11:58:03.744415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10583","last_updated":"2024-07-15T10:03:24Z","snapshot_observed_at":"2026-07-06T18:46:22.753758Z","submitted_at":"2024-07-15T10:03:24Z","title":"Three Dogmas of Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10583","snapshot_observed_at":"2026-08-06T11:58:03.715479Z","title":"Three dogmas of reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22255","last_updated":"2025-07-29T22:09:35Z","snapshot_observed_at":"2026-08-06T11:58:02.920060Z","submitted_at":"2025-07-29T22:09:35Z","title":"Agent-centric learning: from external reward maximization to internal knowledge curation","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T11:58:03.715479Z"},"links":{"cited_paper":"/paper/2407.10583","citing_paper":"/paper/2507.22255"},"observation_digest":"sha256:6ebcb8ceff3bb768103c0ee32d72000280f6067f2d0d2fa9e5f590d36384dc5d","observation_id":"aac8032d-eac0-490e-b598-7de5da93ff14","resolution":{"observed_at":"2026-08-06T11:58:03.715479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.06780","last_updated":"2022-02-12T20:02:13Z","snapshot_observed_at":"2026-07-06T11:47:40.777131Z","submitted_at":"2021-09-14T15:49:31Z","title":"Benchmarking the Spectrum of Agent Capabilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.06780","snapshot_observed_at":"2026-08-06T11:58:03.781339Z","title":"Benchmarking the spectrum of agent capabilities.arXiv preprint arXiv:2109.06780,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22255","last_updated":"2025-07-29T22:09:35Z","snapshot_observed_at":"2026-08-06T11:58:02.920060Z","submitted_at":"2025-07-29T22:09:35Z","title":"Agent-centric learning: from external reward maximization to internal knowledge curation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T11:58:03.781339Z"},"links":{"cited_paper":"/paper/2109.06780","citing_paper":"/paper/2507.22255"},"observation_digest":"sha256:3f3804bd36fb2e94d8a9f8c5782036df4e41d1d32018e6311bf9f356f0464762","observation_id":"434a26f0-1083-433d-bfd8-94779226a9e4","resolution":{"observed_at":"2026-08-06T11:58:03.781339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08161","last_updated":"2025-07-15T03:27:33Z","snapshot_observed_at":"2026-08-07T16:06:41.572743Z","submitted_at":"2025-04-10T23:05:56Z","title":"Rethinking the Foundations for Continual Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08161","snapshot_observed_at":"2026-08-06T11:58:03.757284Z","title":"Rethinking the foundations for continual reinforcement learn- ing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22255","last_updated":"2025-07-29T22:09:35Z","snapshot_observed_at":"2026-08-06T11:58:02.920060Z","submitted_at":"2025-07-29T22:09:35Z","title":"Agent-centric learning: from external reward maximization to internal knowledge curation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T11:58:03.757284Z"},"links":{"cited_paper":"/paper/2504.08161","citing_paper":"/paper/2507.22255"},"observation_digest":"sha256:57d61855fb07dc757f650dcc083dbb9b155e153f89042f20c3022c5d8397eaee","observation_id":"5ccfd4e5-7aed-4a7b-af9d-b6632ea15f44","resolution":{"observed_at":"2026-08-06T11:58:03.757284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.01732","last_updated":"2017-03-06T05:51:42Z","snapshot_observed_at":"2026-07-06T05:32:27.193419Z","submitted_at":"2017-03-06T05:51:42Z","title":"Surprise-Based Intrinsic Motivation for Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.01732","snapshot_observed_at":"2026-08-06T11:58:03.731987Z","title":"Surprise-based intrinsic motivation for deep reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22255","last_updated":"2025-07-29T22:09:35Z","snapshot_observed_at":"2026-08-06T11:58:02.920060Z","submitted_at":"2025-07-29T22:09:35Z","title":"Agent-centric learning: from external reward maximization to internal knowledge curation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T11:58:03.731987Z"},"links":{"cited_paper":"/paper/1703.01732","citing_paper":"/paper/2507.22255"},"observation_digest":"sha256:bf764c0b83f16793799e813d4c2d6dc8b604844759e5995cf7a5981bb079a9bd","observation_id":"bece8ab2-2b51-4d1f-9eab-3e12940b7cfd","resolution":{"observed_at":"2026-08-06T11:58:03.731987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:58:04.488833Z","title":"What can ai learn from human exploration? intrinsically-motivated humans and agents in open-world exploration","venue":null,"work_id":"d6fb40ef-c18f-45d2-b298-0f78ec3d7fd0","year":2023},"citing_paper":{"arxiv_id":"2507.22255","last_updated":"2025-07-29T22:09:35Z","snapshot_observed_at":"2026-08-06T11:58:02.920060Z","submitted_at":"2025-07-29T22:09:35Z","title":"Agent-centric learning: from external reward maximization to internal knowledge curation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T11:58:03.771127Z"},"links":{"citing_paper":"/paper/2507.22255"},"observation_digest":"sha256:f7f4003ca273d1a3ebb7ff67221677dc4c1baf01b959499cd6dda7c318dd5ffe","observation_id":"1a860ca6-3523-4976-a136-75088502a16c","resolution":{"observed_at":"2026-08-06T11:58:04.495760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.22255","last_updated":"2025-07-29T22:09:35Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T11:58:02.920060Z","submitted_at":"2025-07-29T22:09:35Z","title":"Agent-centric learning: from external reward maximization to internal knowledge curation"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":2,"verified_fuzzy":2},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 1 inbound Pith citation observation for arXiv:2507.22255."}