{"as_of":"2026-08-19T10:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:757fa1b32891ccf427f8699dd6a702bccb0b2f5e1c07205fa2c4c820ae81430b","coverage":[{"denominator":95,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":95,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:28:24.695242Z","state":"measured"},{"denominator":98,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":98,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T01:01:38.475397Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":2,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05109","snapshot_observed_at":"2026-08-06T01:01:38.475397Z","title":"arXiv:2506.05109","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.03991","last_updated":"2025-08-06T00:46:38Z","snapshot_observed_at":"2026-08-16T16:59:22.548614Z","submitted_at":"2025-08-06T00:46:38Z","title":"Galaxy: A Cognition-Centered Framework for Proactive, Privacy-Preserving, and Self-Evolving LLM Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T01:01:38.475397Z"},"links":{"cited_paper":"/paper/2506.05109","citing_paper":"/paper/2508.03991"},"observation_digest":"sha256:01b58928900045550fa4b047e06b54177541aaa382a068d4035e4591b2ea181c","observation_id":"62023054-4f59-4d22-a34e-161cd3d1902c","resolution":{"observed_at":"2026-08-06T01:01:38.475397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"cited_work":{"arxiv_id":"2506.05109","doi":"10.48550/arxiv.2506.05109","metadata_source":"pith","pith_arxiv_id":"2506.05109","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","venue":"cs.AI","work_id":"ee163b6e-ffc2-4fe7-a87c-e0eabc5ff1e4","year":2025},"citing_paper":{"arxiv_id":"2606.23127","last_updated":"2026-06-22T10:14:11Z","snapshot_observed_at":"2026-08-19T08:20:19.259881Z","submitted_at":"2026-06-22T10:14:11Z","title":"Managing Procedural Memory in LLM Agents: Control, Adaptation, and Evaluation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-26T08:39:41.575494Z"},"links":{"cited_paper":"/paper/2506.05109","citing_paper":"/paper/2606.23127"},"observation_digest":"sha256:bb9a21d7671d6cd40b47fb55e80704a26822f636821d1428b98dbf421fbb1e72","observation_id":"c14027cb-b536-4031-babb-0b38c0958ac8","resolution":{"observed_at":"2026-06-26T08:49:15.256236Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"cited_work":{"arxiv_id":"2506.05109","doi":"10.48550/arxiv.2506.05109","metadata_source":"pith","pith_arxiv_id":"2506.05109","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","venue":"cs.AI","work_id":"ee163b6e-ffc2-4fe7-a87c-e0eabc5ff1e4","year":2025},"citing_paper":{"arxiv_id":"2607.07663","last_updated":"2026-07-08T17:19:50Z","snapshot_observed_at":"2026-08-12T14:05:29.940431Z","submitted_at":"2026-07-08T17:19:50Z","title":"Recursive Self-Improvement in AI: From Bounded Self-Refinement to Autonomous Research Loops","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-09T03:36:57.168246Z"},"links":{"cited_paper":"/paper/2506.05109","citing_paper":"/paper/2607.07663"},"observation_digest":"sha256:3828292566a697137d5355c71d4d87bd82cc744864e8e80dc8d509ba9958ada1","observation_id":"1e3ff57d-18da-485b-b977-6daeef297033","resolution":{"observed_at":"2026-07-09T03:45:55.365517Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.05109/citation-record","integrity":"/paper/2506.05109/integrity","json":"/paper/2506.05109/citation-record.json","paper":"/paper/2506.05109"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:16.760749Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:16.760749Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:7f926c4a33def0908d4d6338db5fded6dbaec74adc23160237475921f3501ef2","observation_id":"d5a42c6a-9ccf-4747-9c48-3453a2caed51","resolution":{"observed_at":"2026-08-07T10:28:16.760749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","snapshot_observed_at":"2026-08-19T00:16:57.115468Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10003","snapshot_observed_at":"2026-08-07T10:28:16.864213Z","title":"Rest meets react: Self-improvement for multi-step reasoning llm agent","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:16.864213Z"},"links":{"cited_paper":"/paper/2312.10003","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:66e4bc33fba7530fccf0bde2f6661b6ff425e12349fc8551b513fc51ddfb66fd","observation_id":"e146ce08-8442-47ea-baba-77c1d7e78c41","resolution":{"observed_at":"2026-08-07T10:28:16.864213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11896","last_updated":"2024-06-14T17:49:55Z","snapshot_observed_at":"2026-08-16T13:42:51.892765Z","submitted_at":"2024-06-14T17:49:55Z","title":"DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11896","snapshot_observed_at":"2026-08-07T10:28:16.963397Z","title":"Digirl: Training in-the-wild device-control agents with autonomous reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:16.963397Z"},"links":{"cited_paper":"/paper/2406.11896","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:fbe465b023afbb6e07698072cc51d1c8e5983ea7de701900d0f4d8316d949ebd","observation_id":"e94ea10d-0614-4f9b-860c-ae435ececd19","resolution":{"observed_at":"2026-08-07T10:28:16.963397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-16T03:49:00.703994Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-07T10:28:17.065407Z","title":"Constitutional ai: Harmlessness from ai feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:17.065407Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:c0026656c65dba19e0371390c4428da99b08eeac4dd5bcaa8188d8845490bf24","observation_id":"42676b98-b535-4b3e-806e-cb062700f94d","resolution":{"observed_at":"2026-08-07T10:28:17.065407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:17.166714Z","title":"Human-timescale adaptation in an open-ended task space","venue":null,"work_id":null,"year":1935},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:17.166714Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:b8a6c19c54aaabd648b6f2164bdf3fdb85635a8d0bdce07a5bab1437f991d9b2","observation_id":"9fc23d32-3abb-4533-b8b7-d752cbf6cdfd","resolution":{"observed_at":"2026-08-07T10:28:17.166714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:17.243242Z","title":"M., Gebru, T., McMillan-Major, A., and Shmitchell, S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:17.243242Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:be6f2d69e4226af3a827ef1b28f2dc097d89cbc700fbd93e9f5163e7a3d902aa","observation_id":"f9027692-9226-49ec-a94c-162ff8aa8467","resolution":{"observed_at":"2026-08-07T10:28:17.243242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:17.306726Z","title":"Curriculum learning","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:17.306726Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:4654329c61d55920344fccb1451617349caa5cb559520718c771a6ddb08262b0","observation_id":"a4a7c8a1-d526-498d-ada7-ef02fb380f90","resolution":{"observed_at":"2026-08-07T10:28:17.306726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:17.380705Z","title":"B., Zhang, J., Oostermeijer, K., Bellagente, M., Clune, J., Stanley, K., Schott, G., and Lehman, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:17.380705Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:91276626c21c30110f9134d581f65b5114f5c599e5720652470d6f06d2b47301","observation_id":"5d6eabb9-39cb-45ba-8af2-c442f20bd220","resolution":{"observed_at":"2026-08-07T10:28:17.380705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:17.459026Z","title":"Metacognition, executive control, self-regulation, and other more mysterious mechanisms","venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:17.459026Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:d14a0e8eb18043ad2f2cecaf2601b2d53e2f6b6c1bd2826d5dc3d2d511345f3a","observation_id":"09013d81-5b43-452a-a558-fc3123a7320c","resolution":{"observed_at":"2026-08-07T10:28:17.459026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:17.544773Z","title":"D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:17.544773Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:cbd7184a4a78a237b19a6404712f88786a28a03a67978e942c82d5be0f9d823a","observation_id":"5ee11e9a-3e13-4e8e-8618-5c454426f0f7","resolution":{"observed_at":"2026-08-07T10:28:17.544773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:17.620825Z","title":"D., Edwards, A., Parker-Holder, J., Shi, Y., Hughes, E., Lai, M., Mavalankar, A., Steigerwald, R., Apps, C., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:17.620825Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:eeaefd8cfd5fab613e18c6052f8ed9c0121bc600018bfd49b75148749f77355c","observation_id":"4e865748-7cec-4e32-bf0a-dbb511d75b72","resolution":{"observed_at":"2026-08-07T10:28:17.620825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:17.712364Z","title":"Alphamath almost zero: Process supervision without process","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:17.712364Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:15ffa71bbe14836cb96ae202a5ce030ed29beec970ae83f52372c540ac63792f","observation_id":"b8f435bf-9fb7-4b6c-b76f-897d41a99e53","resolution":{"observed_at":"2026-08-07T10:28:17.712364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:17.793828Z","title":"Teaching large language models to self-debug","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:17.793828Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:d6d57abfe0a04c1b487e69d81530c245fea826bc4efcc85a6e3657c5dbbf011a","observation_id":"eb335fc1-f301-4df1-95e0-d15d1313ee77","resolution":{"observed_at":"2026-08-07T10:28:17.793828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:17.871805Z","title":"N., Li, T., Li, D., Zhu, B., Zhang, H., Jordan, M., Gonzalez, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:17.871805Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:3886df4aeec244679c6094c038d3964fb54cc4fdc76dea9d0168e6d03f256653","observation_id":"1a47be92-21f4-4c31-be34-4591795da1d1","resolution":{"observed_at":"2026-08-07T10:28:17.871805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.01547","last_updated":"2019-11-25T13:02:04Z","snapshot_observed_at":"2026-08-17T05:38:14.090895Z","submitted_at":"2019-11-05T00:31:38Z","title":"On the Measure of Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.01547","snapshot_observed_at":"2026-08-07T10:28:17.940922Z","title":"On the measure of intelligence","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:17.940922Z"},"links":{"cited_paper":"/paper/1911.01547","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:2c5f0b32eb55028a6dcf83025d25eaf2764fb8ca78bd21997861cd87e630d584","observation_id":"dffe7a3b-37f3-47b6-b933-da2c3552a718","resolution":{"observed_at":"2026-08-07T10:28:17.940922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:18.043043Z","title":"W., Sutton, C., Gehrmann, S., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:18.043043Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:b151a437cc4ffb545bfadf109d89932a8d147e03ecd26f5ae310afa4ea684d1c","observation_id":"631581fb-b26f-4552-9927-82f102ecc763","resolution":{"observed_at":"2026-08-07T10:28:18.043043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:18.112668Z","title":"W., Hou, L., Longpre, S., Zoph, B., Tay, Y., Fedus, W., Li, Y., Wang, X., Dehghani, M., Brahma, S., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:18.112668Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:086fd634c914a1ca3d07ac8a264ef1f0e916812f75d8c608579503109add0d0d","observation_id":"27828ccd-c7bd-4550-9724-6e956804c27b","resolution":{"observed_at":"2026-08-07T10:28:18.112668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T10:28:18.211427Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:18.211427Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:43a0ea2b257d7406c131cd5803f64b497452c9de17ade1013508df92df8bfea6","observation_id":"62529be3-2c24-43ca-b538-79c462921deb","resolution":{"observed_at":"2026-08-07T10:28:18.211427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:18.283310Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:18.283310Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:96a04c2b72ac2c7d2d2f372c639e2465bc0831bf83e64c115feb9761f6969b23","observation_id":"2a08b2ae-80c5-4ce0-971d-567f9e5dbde8","resolution":{"observed_at":"2026-08-07T10:28:18.283310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:18.356818Z","title":"Meta-rules: Reasoning about control","venue":null,"work_id":null,"year":1980},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:18.356818Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:e0edb75a7a9badcab52e0d6cabbc8e4d6abcbdfbc4d0d771cd5e38f9489e3ca6","observation_id":"66b7c29f-e2fe-409e-9379-724d0af430c3","resolution":{"observed_at":"2026-08-07T10:28:18.356818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:33.967561Z","title":"Emergent complexity and zero-shot transfer via unsupervised environment design","venue":null,"work_id":"976d976a-7551-4e5c-bc86-6e1227765138","year":2020},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:18.428745Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:2267cde63f49033e2f1fc6908dab9a5eabc6c09c004b7118d3acd344efdad062","observation_id":"1bf443c0-3679-4e42-87b2-eea0fb618d92","resolution":{"observed_at":"2026-08-07T10:28:34.064823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12205","last_updated":"2024-05-20T17:45:26Z","snapshot_observed_at":"2026-08-16T13:51:14.060214Z","submitted_at":"2024-05-20T17:45:26Z","title":"Metacognitive Capabilities of LLMs: An Exploration in Mathematical Problem Solving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12205","snapshot_observed_at":"2026-08-07T10:28:18.501424Z","title":"R., Guo, S., Valko, M., Lillicrap, T., Rezende, D., Bengio, Y., Mozer, M., and Arora, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:18.501424Z"},"links":{"cited_paper":"/paper/2405.12205","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:4a025a853c911b772a2bd154b969a95b1f8562da4a148ba7376b7931f6b23397","observation_id":"21ae20e8-1966-4d87-a94f-1e426f679340","resolution":{"observed_at":"2026-08-07T10:28:18.501424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:18.582485Z","title":"F., Lan, Q., Rahman, P., Mahmood, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:18.582485Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:ef2b7ad8a0202161dd53314ceffce7d1a6ca68ecba48771b7546285b519f960d","observation_id":"0d56e7b4-087a-4ddc-a7e9-86f30a67f08c","resolution":{"observed_at":"2026-08-07T10:28:18.582485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:18.670347Z","title":"RAFT : Reward ranked finetuning for generative foundation model alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:18.670347Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:ce75fa12dbf6aff51a3d74fafe2d859adf70e3728af0828d661ed999043f2379","observation_id":"d2f7922e-b28a-4a07-af18-4cceb61e88e6","resolution":{"observed_at":"2026-08-07T10:28:18.670347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15568","last_updated":"2025-02-14T14:24:59Z","snapshot_observed_at":"2026-08-17T17:09:26.087615Z","submitted_at":"2024-05-24T13:57:32Z","title":"OMNI-EPIC: Open-endedness via Models of human Notions of Interestingness with Environments Programmed in Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15568","snapshot_observed_at":"2026-08-07T10:28:18.762189Z","title":"Omni-epic: Open-endedness via models of human notions of interestingness with environments programmed in code","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:18.762189Z"},"links":{"cited_paper":"/paper/2405.15568","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:86d8fee395f289843e19d1062914eb6f1d9a28fb3fa27450f67a624b1f1c5860","observation_id":"b6225795-fd3d-4425-aa41-bb93d186e8cc","resolution":{"observed_at":"2026-08-07T10:28:18.762189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:33.718746Z","title":null,"venue":null,"work_id":"b376648f-9dcc-4c69-98d9-9f4e2ac17666","year":1979},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:18.842019Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:92fcd778397c9462124afcdf901a9c6a42e429e120ac77a7b19820b31c1fd4ff","observation_id":"3fe51d09-b95f-4a68-91b9-485fa1565199","resolution":{"observed_at":"2026-08-07T10:28:33.821225Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:33.443120Z","title":"S., Bredeweg, B., and van den Bos, W","venue":null,"work_id":"6cc06b7e-0e83-455e-8fd6-d171be4c32c4","year":2021},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:18.933139Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:1f47501ce612d0321dc2e7e04ef4394320fbf44f76103ecacf01e75d6b099a53","observation_id":"40115d67-a1fa-496d-b6ad-69fd02f1ae4c","resolution":{"observed_at":"2026-08-07T10:28:33.573085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:33.200723Z","title":null,"venue":null,"work_id":"b8eb7cf9-04b4-4691-bee7-ffc3b2257e83","year":1983},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.046245Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:fb661f6c7838929b92b7a318f281dba8045bbc977623475d3ec3e247bb5e7302","observation_id":"8ca6eb6f-9fff-4bca-91d4-20e5637d4d50","resolution":{"observed_at":"2026-08-07T10:28:33.299726Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:32.993642Z","title":"Auto-gpt: An autonomous gpt-4 experiment, 2023","venue":null,"work_id":"a7e456d2-cd1d-42a7-8a0d-96cf49a1e03a","year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.130458Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:366a7e0fb829e0bf8dde27de7013b53482c770ef5cf8730660e101a90b1a3f31","observation_id":"5516b231-b978-414d-84aa-af0238a9044d","resolution":{"observed_at":"2026-08-07T10:28:33.062588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:19.218992Z","title":"Connecting large language models with evolutionary algorithms yields powerful prompt optimizers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.218992Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:375f2316b8c5554b33f29c2885c724098a22c9333909b3dc15719180448cb059","observation_id":"1b64439d-31d9-4c67-8bb2-151b1333ffdf","resolution":{"observed_at":"2026-08-07T10:28:19.218992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:32.767917Z","title":"V., Safdari, M., Matsuo, Y., Eck, D., and Faust, A","venue":null,"work_id":"dad64007-d1b3-4270-8625-d196feaf6837","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.296099Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:d01a075e35018ae5dbfd4d57f71e49d0e9ac0b794169cacb7fbb8f9b4e70af9b","observation_id":"e4dfa4d5-baa4-4f18-b9dd-9f474cf778d3","resolution":{"observed_at":"2026-08-07T10:28:32.899862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:32.528128Z","title":"J., Wang, Z., Wang, D","venue":null,"work_id":"11fc6a0e-10f1-49bf-a04f-1280883fe10b","year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.361090Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:d53656c3e0cf1c87308afb6b483a481f4bf0081c328a402c828c0e27ac883599","observation_id":"e7d02b9a-2cd2-4860-a31b-43f333446651","resolution":{"observed_at":"2026-08-07T10:28:32.617602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04642","last_updated":"2024-03-07T16:36:29Z","snapshot_observed_at":"2026-08-16T14:11:54.240619Z","submitted_at":"2024-03-07T16:36:29Z","title":"Teaching Large Language Models to Reason with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04642","snapshot_observed_at":"2026-08-07T10:28:19.442762Z","title":"C., Nalmpantis, C., Dwivedi-Yu, J., Zhuravinskyi, M., Hambro, E., Sukhbaatar, S., and Raileanu, R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.442762Z"},"links":{"cited_paper":"/paper/2403.04642","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:1d4e6060b72ca5cf07c1f6e7df9773f23d13615a3ff0a20fa3c79a976cfbd089","observation_id":"a53a291c-66f3-4219-8f0f-dc8fd58cf89f","resolution":{"observed_at":"2026-08-07T10:28:19.442762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:19.521152Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.521152Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:871f6350019ea293ca8446c9359d76fb7a8586d1e709125c658c2be2f2f65a2c","observation_id":"e0204f75-9542-43a9-b767-fc3e4bfcc5e0","resolution":{"observed_at":"2026-08-07T10:28:19.521152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:32.280237Z","title":null,"venue":null,"work_id":"c2dfeadb-198e-49f5-98ec-537ab6f5c0d4","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.617890Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:c73f1436a1e168e24158aa00e7d39360e8b74f6366fed0b05bb6f336726054a4","observation_id":"ae3e674f-e94f-4f6b-8863-07c8d8f3b981","resolution":{"observed_at":"2026-08-07T10:28:32.390166Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:32.028163Z","title":"D., Parker-Holder, J., Behbahani, F., Mavalankar, A., Shi, Y., Schaul, T., and Rockt\\\" a schel, T","venue":null,"work_id":"cfdb7949-eca2-4f1a-8ddb-55f4416dd4f8","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.660963Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:d07f6db2551d505bfe288208c1b91fa86d8601c902e9e39126dec5b269f71dc3","observation_id":"cf752242-d7b8-446a-af39-b098f6a75ce8","resolution":{"observed_at":"2026-08-07T10:28:32.170040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:19.727240Z","title":"Prioritized level replay","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.727240Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:30124cca2ff1c3ecd3593735bc5f2ac75f44a489a322588e579ca40a5eef285b","observation_id":"fd7f6e70-1b1b-4e15-9bdc-ada83a9c63d2","resolution":{"observed_at":"2026-08-07T10:28:19.727240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02907","last_updated":"2023-06-05T14:12:46Z","snapshot_observed_at":"2026-08-18T05:17:30.297940Z","submitted_at":"2023-06-05T14:12:46Z","title":"SelfEvolve: A Code Evolution Framework via Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02907","snapshot_observed_at":"2026-08-07T10:28:19.784378Z","title":"Selfevolve: A code evolution framework via large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.784378Z"},"links":{"cited_paper":"/paper/2306.02907","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:75deaecfebb30fc9584ac7c439993c3826f6bf6ed28a434e9397fea3881c07de","observation_id":"3b4168f6-d3d7-4e17-b2da-398db35c9093","resolution":{"observed_at":"2026-08-07T10:28:19.784378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:19.854733Z","title":"G., Karimi, A.-H., Bengio, Y., Chater, N., Gerstenberg, T., Larson, K., Levine, S., Mitchell, M., Rahwan, I., Sch \\\"o lkopf, B., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.854733Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:4acf80fafa1c9e46488be10c0fa1411e54d862748cdc831968edf358da3dc852","observation_id":"483af8bf-ca6b-47c4-985c-d011d718f506","resolution":{"observed_at":"2026-08-07T10:28:19.854733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-14T05:42:29.067319Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-08-07T10:28:19.943318Z","title":"Language models (mostly) know what they know","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:19.943318Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:08c6453abdc3313d41b7b9bdcde27998e21015c60b2e27c68bc877f109de0dbf","observation_id":"66444608-831f-4293-83e9-155342fc7419","resolution":{"observed_at":"2026-08-07T10:28:19.943318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:31.807078Z","title":"V., Haq, S., Sharma, A., Joshi, T","venue":null,"work_id":"4658f9dd-798b-44c5-85e3-144f6066280d","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:20.034475Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:c7db525fe5b30a5e75f3bf57e9dc6c08d0b961a1fdfab75171aea493c7ed01be","observation_id":"ba02476b-bd30-4c52-b294-8734a5c49572","resolution":{"observed_at":"2026-08-07T10:28:31.893092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:31.624644Z","title":null,"venue":null,"work_id":"65038bbc-20c5-4b6d-93ba-684447a28c2b","year":2009},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:20.133380Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:346248546cac3a2a00c8b13737888ea1b76f17e46f84fc86b2d4952fad33e6fb","observation_id":"51757441-9150-431e-aa24-fd0d10aebad6","resolution":{"observed_at":"2026-08-07T10:28:31.716688Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:31.356673Z","title":"and Bjork, R","venue":null,"work_id":"1c703e10-1d9e-49a0-a1cc-142f525c27b8","year":2005},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:20.232344Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:7ab2bae5700c7bd342d9267d65fd113f64bc5785062c51abc695269a5e302a46","observation_id":"2bb84647-02cd-47b7-9ed1-5021916bf16c","resolution":{"observed_at":"2026-08-07T10:28:31.456959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:31.148503Z","title":"Specification gaming: the flip side of ai ingenuity","venue":null,"work_id":"b1f202a7-0c31-4489-be53-ee32f945d890","year":2020},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:20.329656Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:0a0ff35077e12cda9968800921effbde599b4a376dfbfac49334eeb375d41f9c","observation_id":"51fc9f4b-bfae-4297-b83d-c53da0e89c7a","resolution":{"observed_at":"2026-08-07T10:28:31.222136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:20.404733Z","title":"M., Ullman, T","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:20.404733Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:1e9fb8ae69e46b8691f1f2704a786e219f068316f1f3e968eaf914ea4a2e74fb","observation_id":"ac17182f-6518-44fd-a519-b0d881fcda3d","resolution":{"observed_at":"2026-08-07T10:28:20.404733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:20.489962Z","title":"u ttler, H., Lewis, M., Yih, W.-t., Rockt \\","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:20.489962Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:96b88ba86cb0fb769ef1947e75e6ecb494ac296ee2a0b63f8adc6e70cfbf0144","observation_id":"60791e4c-a5a6-4082-aaa2-f021a86eb949","resolution":{"observed_at":"2026-08-07T10:28:20.489962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:30.960792Z","title":"From quantity to quality: Boosting llm performance with self-guided data selection for instruction tuning","venue":null,"work_id":"4e648e51-5f84-4ecd-8384-adbe113b6976","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:20.560985Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:4eb26020408a08a34a4584def554f62ba7c35fd0f7e522ef46b379025c330f4b","observation_id":"73c32ec4-069d-401c-8c87-252cb280e432","resolution":{"observed_at":"2026-08-07T10:28:31.039020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.17882","last_updated":"2024-02-16T09:47:38Z","snapshot_observed_at":"2026-08-16T14:22:51.011988Z","submitted_at":"2024-01-31T14:41:23Z","title":"I Think, Therefore I am: Benchmarking Awareness of Large Language Models Using AwareBench","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.17882","snapshot_observed_at":"2026-08-07T10:28:20.658807Z","title":"I think, therefore i am: Awareness in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:20.658807Z"},"links":{"cited_paper":"/paper/2401.17882","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:19fb6c6c13be2d704258a5f92d33b1547c70e1046b145dc28c874d6f06313799","observation_id":"ba3a48cd-c8d5-4c2c-a5b6-45fde16add6b","resolution":{"observed_at":"2026-08-07T10:28:20.658807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06292","last_updated":"2024-09-01T00:41:18Z","snapshot_observed_at":"2026-07-06T18:59:43.564435Z","submitted_at":"2024-08-12T16:58:11Z","title":"The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06292","snapshot_observed_at":"2026-08-07T10:28:20.727797Z","title":"T., Foerster, J., Clune, J., and Ha, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:20.727797Z"},"links":{"cited_paper":"/paper/2408.06292","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:edfbc1ae072d14e5495e95d7490e3ab1c8848a8df5531a302593b047f80b6449","observation_id":"b43ef41f-fa84-4658-9ea7-de02a61f1389","resolution":{"observed_at":"2026-08-07T10:28:20.727797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:30.764140Z","title":"J., Liang, W., Wang, G., Huang, D.-A., Bastani, O., Jayaraman, D., Zhu, Y., Fan, L., and Anandkumar, A","venue":null,"work_id":"e82afd4a-7c88-4e15-bfc9-09d697e848db","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:20.791681Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:492f35b4b87f57eee616d5c464a8fc06a4393abec6c0289166e8e72721da744c","observation_id":"40d65aee-ce1b-4bc5-b4b8-ea89df7cf338","resolution":{"observed_at":"2026-08-07T10:28:30.860012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:30.606867Z","title":"Self-refine: Iterative refinement with self-feedback","venue":null,"work_id":"e03375ae-52b1-4956-a816-a498217d7451","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:20.899514Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:73d266c7aa7f597817040dca056a3d8b93887a6215227c0e73c015169b007ad0","observation_id":"c615e20f-bd51-4cea-aff0-54e1317ede47","resolution":{"observed_at":"2026-08-07T10:28:30.684549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.09332","last_updated":"2022-06-01T19:08:11Z","snapshot_observed_at":"2026-08-19T02:54:55.334346Z","submitted_at":"2021-12-17T05:43:43Z","title":"WebGPT: Browser-assisted question-answering with human feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.09332","snapshot_observed_at":"2026-08-07T10:28:20.990171Z","title":"Webgpt: Browser-assisted question-answering with human feedback","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:20.990171Z"},"links":{"cited_paper":"/paper/2112.09332","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:45ea786a5647af74553c987256f0aa65b1345d9c4789c3e3f21924a5473b6041","observation_id":"ad6c4fc7-72ad-4f03-a28a-250c701d527a","resolution":{"observed_at":"2026-08-07T10:28:20.990171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:30.436014Z","title":"Superintelligence: Paths, dangers, strategies","venue":null,"work_id":"9c7542f3-9ce4-49b9-bafc-cac0f3883a53","year":2014},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:21.054167Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:d8a9e02e1606fe222c8a7223d457e3a0b3f8527bd8618f66f50d1d3a2e4943c4","observation_id":"a2a9e057-9368-4e74-8220-df685b85f6c8","resolution":{"observed_at":"2026-08-07T10:28:30.509798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:21.105201Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:21.105201Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:6e68f22f323716528d8ceb1c7c2283f42e3344093bf5c4c7bcfe29a6cdd9bc69","observation_id":"09207605-cc07-4509-aea2-c76672548ac3","resolution":{"observed_at":"2026-08-07T10:28:21.105201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:21.216381Z","title":"S., O'Brien, J., Cai, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:21.216381Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:5797f6e492dd9ea1a4815e716a63eb84f00a57be02124b5ada095bae4c5167dc","observation_id":"df850d23-ee5a-4659-8ce3-27779a4d418c","resolution":{"observed_at":"2026-08-07T10:28:21.216381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:30.201646Z","title":null,"venue":null,"work_id":"c4c899a6-6e15-4320-80e5-90c71b5e2806","year":2002},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:21.441438Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:3594f5a2841cd74505a247a8e6ca8de654a8b0424f22f0446a08cb8da5e19a9b","observation_id":"2df7fb13-680e-46e2-8e24-f348bcf72c1b","resolution":{"observed_at":"2026-08-07T10:28:30.313778Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02337","last_updated":"2025-01-27T11:56:15Z","snapshot_observed_at":"2026-08-18T10:06:51.290180Z","submitted_at":"2024-11-04T17:59:58Z","title":"WebRL: Training LLM Web Agents via Self-Evolving Online Curriculum Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02337","snapshot_observed_at":"2026-08-07T10:28:21.810260Z","title":"L., Lai, H., Sun, X., Yang, X., Sun, J., Yang, Y., Yao, S., Zhang, T., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:21.810260Z"},"links":{"cited_paper":"/paper/2411.02337","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:f65ced1447e5663122bc50f3ab078f092eec0dce0c410b0cf0e71f6bcd644f3f","observation_id":"7498d1e4-28c7-4c4e-bd30-e41f5108b9a1","resolution":{"observed_at":"2026-08-07T10:28:21.810260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:29.995840Z","title":"Vision-language models are zero-shot reward models for reinforcement learning","venue":null,"work_id":"a2632166-0989-41e7-9549-b8d825cbf403","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:21.907724Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:03f2fa1152052f1e4c240eaeb26cb41f8277928ec2d6134a833346d66a843771","observation_id":"30502117-d889-4cb3-a595-72b0f13334f8","resolution":{"observed_at":"2026-08-07T10:28:30.103119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:29.799337Z","title":"Human-compatible artificial intelligence., 2022","venue":null,"work_id":"69b78dbe-3eec-4e5a-ba7d-ca7344f2c652","year":2022},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:22.034929Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:51b0b9c5baf6431c365b77c2455aefbab85b23d16915fea6fdc4ad297751386c","observation_id":"11fd6b50-2753-46a7-9216-7e01d06c192d","resolution":{"observed_at":"2026-08-07T10:28:29.909495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:29.505472Z","title":"and Wefald, E","venue":null,"work_id":"90a24423-9707-4a62-840f-5f97c413d1d8","year":1991},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:22.106404Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:7f26a4a75f19388b977584684139464746107bd3a3df903c46ca0124216ed9ea","observation_id":"cdb1ccfa-6327-4cb3-b2c3-92f5a888b56b","resolution":{"observed_at":"2026-08-07T10:28:29.623871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09668","last_updated":"2024-02-15T02:27:57Z","snapshot_observed_at":"2026-08-16T14:18:27.107802Z","submitted_at":"2024-02-15T02:27:57Z","title":"How to Train Data-Efficient LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09668","snapshot_observed_at":"2026-08-07T10:28:22.198008Z","title":"H., Caverlee, J., McAuley, J., and Cheng, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:22.198008Z"},"links":{"cited_paper":"/paper/2402.09668","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:39d0b8e7ee675e85b3766b88a5e4bcc38975714b55b2b099f718ded871bfc0be","observation_id":"baf9518d-8283-4d8e-9693-627a73a6bf4c","resolution":{"observed_at":"2026-08-07T10:28:22.198008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:22.274561Z","title":"Toolformer: Language models can teach themselves to use tools","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:22.274561Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:349bd33cb5b85241c90f26d0d78705a6b37701e374407037cc0f8396ec8dd725","observation_id":"ab7052d9-503e-499e-87d6-7bd2c7654320","resolution":{"observed_at":"2026-08-07T10:28:22.274561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:29.380719Z","title":null,"venue":null,"work_id":"c8c6d795-037e-402d-9007-aeded31c2694","year":2009},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:22.378748Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:9709d4b9318ad14527239bd6f8cf081a6bdd76238a170fb818257a0ccb2b53ac","observation_id":"443bb5cb-4018-490b-b9b9-18ac5afe28b8","resolution":{"observed_at":"2026-08-07T10:28:29.420717Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:29.196130Z","title":"Reflexion: Language agents with verbal reinforcement learning","venue":null,"work_id":"3450acfa-bcfe-4c9c-855f-819dc67f3f64","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:22.494287Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:4dadb489b1598efe9d5e86abb0b97eba9fdd5fc4260d70b4cc3a26142df54ba9","observation_id":"93f1d9a9-a8ef-4323-bd4a-7a621876368d","resolution":{"observed_at":"2026-08-07T10:28:29.283609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:22.627881Z","title":"J., Guez, A., Sifre, L., Van Den Driessche, G., Schrittwieser, J., Antonoglou, I., Panneershelvam, V., Lanctot, M., et al","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:22.627881Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:79a9fc32c141c4ffe021c52f0f6649522add658f9c92c0b0737c357923bb72c2","observation_id":"40856bd1-7d7e-4c60-a168-2e8075a191a3","resolution":{"observed_at":"2026-08-07T10:28:22.627881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:28.994017Z","title":"D., Agarwal, R., Anand, A., Patil, P., Garcia, X., Liu, P","venue":null,"work_id":"ebfa9623-e051-4f4e-b833-d0764fb7810e","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:22.727873Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:29c63cfb3562eba338bd0246c48a5d702a10f4c455672a7c3c7d7acd23c480cb","observation_id":"bdcfe909-8341-4704-a609-08fa553736ad","resolution":{"observed_at":"2026-08-07T10:28:29.098415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02674","last_updated":"2025-02-25T16:59:11Z","snapshot_observed_at":"2026-08-14T20:58:55.959220Z","submitted_at":"2024-12-03T18:47:26Z","title":"Mind the Gap: Examining the Self-Improvement Capabilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02674","snapshot_observed_at":"2026-08-07T10:28:22.812009Z","title":"Mind the gap: Examining the self-improvement capabilities of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:22.812009Z"},"links":{"cited_paper":"/paper/2412.02674","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:b4c161e8105b15d6971b2a38a2d9acab9cf51735ec6561614874903cf596d0f9","observation_id":"e61b5bbf-b799-4ccf-ab58-29688b857d9b","resolution":{"observed_at":"2026-08-07T10:28:22.812009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:28.849065Z","title":null,"venue":null,"work_id":"534b9411-1268-452c-b6aa-3e571f15daca","year":2003},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:22.840098Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:c22f4989b40b326cf264eb253256acd6642e7330d6a216fc30d8003fa4233060","observation_id":"820c7bdb-02f5-48c3-96ed-324ac61af2ef","resolution":{"observed_at":"2026-08-07T10:28:28.915071Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:28.666412Z","title":"Cognitive architectures for language agents","venue":null,"work_id":"b98e2bde-eb4b-4237-87a7-b2faaa0132b1","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:22.925737Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:e57973204ce7f8a64fdc0b249b0ee95a107597abf0e13407447d754b843e92dd","observation_id":"323dc2fc-943f-4f59-ad20-d2d20ad8219d","resolution":{"observed_at":"2026-08-07T10:28:28.732086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:28.495465Z","title":null,"venue":null,"work_id":"49e91687-324f-4218-b593-284d40d69e9f","year":1988},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:22.977812Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:2d9086760d7aaf6366efd9da2ffcf0131d42587b8631acdc2d4980530dcdbecf","observation_id":"b2dffad8-29b1-4541-a89c-38c105103b2b","resolution":{"observed_at":"2026-08-07T10:28:28.586189Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:28.295492Z","title":"E., Sarkar, A., Sellen, A., and Rintel, S","venue":null,"work_id":"d4edda7d-c5ba-4b17-bca8-d2f5401cc613","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.020525Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:840b9c50e1101f219c1fb33cf60be00a130bc0f536ca0db82ac635fee1c6864f","observation_id":"a67b8b24-e232-4bcd-b90b-120a90925c11","resolution":{"observed_at":"2026-08-07T10:28:28.383657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14387","last_updated":"2024-06-03T17:47:30Z","snapshot_observed_at":"2026-08-18T08:11:04.376031Z","submitted_at":"2024-04-22T17:43:23Z","title":"A Survey on Self-Evolution of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14387","snapshot_observed_at":"2026-08-07T10:28:23.089533Z","title":"A survey on self-evolution of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.089533Z"},"links":{"cited_paper":"/paper/2404.14387","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:f6135984a388f1cf5014944bff5cf9a38293cac75c21fe5486205a794073a025","observation_id":"70fdfd3d-505d-474c-a5e4-c203e2f899ba","resolution":{"observed_at":"2026-08-07T10:28:23.089533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-08-13T16:55:46.498156Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-07T10:28:23.137247Z","title":"Voyager: An open-ended embodied agent with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.137247Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:6327a33db8716b2ce587422953f5acfb6d932d75efbe44f8ddf83480e313d789","observation_id":"9d6ff0b8-97c5-4fc3-bfc1-4512b44c9322","resolution":{"observed_at":"2026-08-07T10:28:23.137247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:23.177586Z","title":"A survey on large language model based autonomous agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.177586Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:bdbe0f525cb28e1337cea606bcef6a22be84835b4c3c8af7cdce6508986ee1e9","observation_id":"629e8220-685f-4277-a032-089cd9067781","resolution":{"observed_at":"2026-08-07T10:28:23.177586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:28.136952Z","title":"Emotional intelligence of large language models","venue":null,"work_id":"7aaa7e19-b3e6-4945-9f78-4df03cd3e4ef","year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.247881Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:61efa274843b5506c3381caca24d9dbecf0f5b0d983b81abe7db756d51145381","observation_id":"4016d8fb-0416-4ee8-b916-2a432988204a","resolution":{"observed_at":"2026-08-07T10:28:28.205033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:27.989503Z","title":"A., Khashabi, D., and Hajishirzi, H","venue":null,"work_id":"455ac4ab-2e4b-48e0-b450-d5d967556375","year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.314426Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:d620deb12fb858e461ea5beead1fcf389cfa894ac0cc5f569a667fab4ac9bb5d","observation_id":"1479d99f-2c4b-44c6-99bf-8dc5754350bf","resolution":{"observed_at":"2026-08-07T10:28:28.047808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:27.809984Z","title":"Metacognitive ai: Framework and the case for a neurosymbolic approach","venue":null,"work_id":"97d14273-f0ee-4c84-bb17-54bf1f49a564","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.399854Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:0f1d9b55a24403d03e764e5ac547123e8ca8c59f68b271a1eeff3ea2164285aa","observation_id":"afc6906f-b03c-4154-afbe-f1a097ba562b","resolution":{"observed_at":"2026-08-07T10:28:27.910261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:27.522865Z","title":null,"venue":null,"work_id":"3fdf48b5-0115-4336-a348-8e3be297d470","year":2014},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.447332Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:4f974fe73dc35811993e65c16418879df13ecb4e26138c29e06193b6bfbf345a","observation_id":"81814fb6-e247-44eb-a405-d2462cf588e7","resolution":{"observed_at":"2026-08-07T10:28:27.667495Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07456","last_updated":"2024-02-15T09:30:48Z","snapshot_observed_at":"2026-08-16T14:19:26.200721Z","submitted_at":"2024-02-12T07:29:22Z","title":"OS-Copilot: Towards Generalist Computer Agents with Self-Improvement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07456","snapshot_observed_at":"2026-08-07T10:28:23.486683Z","title":"Os-copilot: Towards generalist computer agents with self-improvement","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.486683Z"},"links":{"cited_paper":"/paper/2402.07456","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:25d8a94edac2a8b9391bd4c28e1a58c4cbd8c58d4746564ce6d2304340a56835","observation_id":"8c3c78bd-e0b5-4bf6-b3c9-d6638188751c","resolution":{"observed_at":"2026-08-07T10:28:23.486683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07864","last_updated":"2023-09-19T08:29:18Z","snapshot_observed_at":"2026-08-17T06:15:32.510873Z","submitted_at":"2023-09-14T17:12:03Z","title":"The Rise and Potential of Large Language Model Based Agents: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07864","snapshot_observed_at":"2026-08-07T10:28:23.548433Z","title":"The rise and potential of large language model based agents: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.548433Z"},"links":{"cited_paper":"/paper/2309.07864","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:6b16918b99ce922c0800c5e013c82563a87e8ec43bed9dbcf9204b1a707541db","observation_id":"2643ba2a-11b2-4363-93a8-c3af68948a40","resolution":{"observed_at":"2026-08-07T10:28:23.548433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:27.273184Z","title":"J., Cheng, Z., Shin, D., Lei, F., Liu, Y., Xu, Y., Zhou, S., Savarese, S., Xiong, C., Zhong, V., and Yu, T","venue":null,"work_id":"329354a7-fc55-4602-9930-426cd9cf7e04","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.620932Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:6ecd1028f743671692b6b80167d83a5ecf63f86915336c677186ed7b933b954a","observation_id":"44e9f224-5fcb-4450-aa4d-9914b7b83ca8","resolution":{"observed_at":"2026-08-07T10:28:27.400891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:27.014282Z","title":"V., Zhou, D., and Chen, X","venue":null,"work_id":"14fa8182-3c7c-4402-a8e5-65de91fa0d02","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.705839Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:5d612639f1fff633dfce120f9f646e7939d6a2f5500b9b607631f67aa953dde6","observation_id":"b0f540aa-993d-4aa0-9589-bd3ba0804f5c","resolution":{"observed_at":"2026-08-07T10:28:27.170574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:26.819546Z","title":null,"venue":null,"work_id":"9c7d04a8-ea32-45fc-99d8-d262adbbf441","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.759255Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:77cbc6ed18020393cc8936f22413d4b54239a1ea69aaaae6636ad7b7a463c2af","observation_id":"7e3049ec-fa99-4f67-91a4-5748dc1390b0","resolution":{"observed_at":"2026-08-07T10:28:26.951792Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:26.617981Z","title":"Failures pave the way: Enhancing large language models through tuning-free rule accumulation","venue":null,"work_id":"cd175394-8107-401e-abe9-5afc2f7e680c","year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.816080Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:3e225a055037eded19b206f026b19e845148c89d334830fe0df251d165e364c5","observation_id":"bc5afa07-cc54-4c53-ab1e-7bd5f0de81bc","resolution":{"observed_at":"2026-08-07T10:28:26.707251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:26.444749Z","title":"R., and Cao, Y","venue":null,"work_id":"36ee86da-0718-48ad-b56c-0952f633e149","year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.865099Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:859c807d8c422947f4f50efae787266828667a42d0caccdf9ebdf173b0e34aee","observation_id":"57f0e311-d0bc-43f9-9515-511447d82332","resolution":{"observed_at":"2026-08-07T10:28:26.549263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:26.295151Z","title":"Star: Bootstrapping reasoning with reasoning","venue":null,"work_id":"d784c30c-9082-4078-8979-407dda959269","year":2022},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:23.932489Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:a56f3bc5f3b005789440e4081497a10e790a175933afa0eb0f510c94e96966ca","observation_id":"45ab5fba-cc3c-4747-850f-0e62de2600f7","resolution":{"observed_at":"2026-08-07T10:28:26.379100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:26.113733Z","title":"Large language models are semi-parametric reinforcement learning agents","venue":null,"work_id":"a9504bc7-a4f9-4c05-975e-0c499942da00","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:24.011471Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:aaa173acd993089b9137032ab16f680b294cafb8a0fd05d21351bd396875fd02","observation_id":"e0761761-8e2d-4193-a640-865a86194ce8","resolution":{"observed_at":"2026-08-07T10:28:26.190985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15506","last_updated":"2024-11-09T00:28:26Z","snapshot_observed_at":"2026-08-16T14:15:48.898355Z","submitted_at":"2024-02-23T18:56:26Z","title":"AgentOhana: Design Unified Data and Training Pipeline for Effective Agent Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15506","snapshot_observed_at":"2026-08-07T10:28:24.108717Z","title":"Agentohana: Design unified data and training pipeline for effective agent learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:24.108717Z"},"links":{"cited_paper":"/paper/2402.15506","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:a538ff0c350d01f287a177f3239bb53926aeac5eec3fd8484940933cc1aef91d","observation_id":"a6e1580c-d7a3-4dea-9374-2b80f795498a","resolution":{"observed_at":"2026-08-07T10:28:24.108717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:25.956776Z","title":"OMNI : Open-endedness via models of human notions of interestingness","venue":null,"work_id":"9f754878-f2f4-4ad6-b86a-22a72821b193","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:24.173811Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:4d92e5d1b8e69297995611527dafa01492cce16465e710fa84ab86346ad9c277","observation_id":"748cf989-85bc-4426-8237-273a1c18150f","resolution":{"observed_at":"2026-08-07T10:28:26.008245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:24.270265Z","title":"Expel: Llm agents are experiential learners","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:24.270265Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:dc75b982938561ff669678fd467503e7ba46d312ad0b2461537ec66c8a347523","observation_id":"333dd0ed-4f18-4a42-bf3f-c123bf8e197a","resolution":{"observed_at":"2026-08-07T10:28:24.270265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15809","last_updated":"2024-08-08T07:05:46Z","snapshot_observed_at":"2026-08-18T07:49:15.652922Z","submitted_at":"2024-02-24T13:13:04Z","title":"Empowering Large Language Model Agents through Action Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15809","snapshot_observed_at":"2026-08-07T10:28:24.359078Z","title":"Empowering large language model agents through action learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:24.359078Z"},"links":{"cited_paper":"/paper/2402.15809","citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:2fbe1ff77603ecf8902ccdc15a01be3a4bf5991067a74d829b53a1ced981973c","observation_id":"53795e59-98ae-4552-9f91-01f1dcf8c4ae","resolution":{"observed_at":"2026-08-07T10:28:24.359078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:25.728273Z","title":"E., and Stoica, I","venue":null,"work_id":"7ad80c92-93fa-4725-98d6-c49c0ffeaf9f","year":2023},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:24.367110Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:81f0d4f504ddba3d696db36ee0cecb9aff58e4968e118c7a12f4cc11649bbf3f","observation_id":"4a8b815d-0033-4f99-bf35-198c76937523","resolution":{"observed_at":"2026-08-07T10:28:25.826078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:25.485138Z","title":"and Hadfield-Menell, D","venue":null,"work_id":"548fee63-b404-44bd-8478-44f483397db2","year":2020},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:24.481803Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:b57e64d4589de21e230f28fd88dfe3338f8c6fae568316e6bd18f9783b7b5dee","observation_id":"c915e8ba-3de0-4194-add4-072dee8df19d","resolution":{"observed_at":"2026-08-07T10:28:25.618435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:25.272615Z","title":"GPTS warm: Language agents as optimizable graphs","venue":null,"work_id":"7a13b80f-74d6-45e9-91f9-3b2ddc2a684d","year":2024},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:24.601914Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:b32af027fc873f558e53351b6a637fb8f19b30b4640d99201c7f13a4cebafcff","observation_id":"dad5cf41-3360-4ff9-a46e-8e52d69b4ef8","resolution":{"observed_at":"2026-08-07T10:28:25.415949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:25.157639Z","title":null,"venue":null,"work_id":"34d1ca89-87b0-43fe-82f5-7e97532e6809","year":2013},"citing_paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-07T10:28:24.695242Z"},"links":{"citing_paper":"/paper/2506.05109"},"observation_digest":"sha256:e6f248f355491fb3e1d7c8f0c2f14b12cd12e0e42eab19a3e7cb05b27a400179","observation_id":"29c2ecbb-7d46-4643-a6eb-7b204d76a3f5","resolution":{"observed_at":"2026-08-07T10:28:25.213666Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.05109","last_updated":"2025-06-05T14:53:35Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-13T01:01:54.935509Z","submitted_at":"2025-06-05T14:53:35Z","title":"Truly Self-Improving Agents Require Intrinsic Metacognitive Learning"},"reference_resolution":{"displayed":95,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":62,"verified_exact":0,"verified_fuzzy":33},"total_outbound_references":95},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 95 of 95 outbound references and 3 inbound Pith citation observations for arXiv:2506.05109."}