{"as_of":"2026-08-21T07:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a09abd8de0b293989f36e0a36566da7f183b0970468e29c9173dd13e30121aea","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T07:05:18.137509Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T07:34:39.212287Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.04815","last_updated":"2026-06-19T10:36:09Z","snapshot_observed_at":"2026-08-08T02:26:12.261506Z","submitted_at":"2026-06-03T12:38:57Z","title":"Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifelong Learning Agents","version":2},"cited_work":{"arxiv_id":"2606.04815","doi":"10.48550/arxiv.2606.04815","metadata_source":"pith","pith_arxiv_id":"2606.04815","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifelong Learning Agents","venue":"cs.LG","work_id":"49c1f9c1-ba4c-4705-9f06-738152cdbe16","year":2026},"citing_paper":{"arxiv_id":"2607.21419","last_updated":"2026-07-30T03:55:54Z","snapshot_observed_at":"2026-08-16T22:33:35.878316Z","submitted_at":"2026-07-23T15:24:35Z","title":"PATS: Policy-Aware Training Scaffolding for Agentic Reinforcement Learning","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-01T07:34:39.212287Z"},"links":{"cited_paper":"/paper/2606.04815","citing_paper":"/paper/2607.21419"},"observation_digest":"sha256:b3a40beaa89108f297396991a8b2636d044d630a7619df40d94103519b53fff0","observation_id":"8f7aa493-0411-4fa4-aa20-6756ffd5fbf7","resolution":{"observed_at":"2026-08-01T07:39:17.457236Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-01T10:08:10.708448+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T10:08:10.708448+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2606.04815/citation-record","integrity":"/paper/2606.04815/integrity","json":"/paper/2606.04815/citation-record.json","paper":"/paper/2606.04815"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.19005","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T23:54:18.662831Z","title":"Building self-evolving agents via experience-driven lifelong learning: A framework and benchmark","venue":null,"work_id":"6f99904a-f32e-485e-b821-d4489e4898b1","year":2025},"citing_paper":{"arxiv_id":"2606.04815","last_updated":"2026-06-19T10:36:09Z","snapshot_observed_at":"2026-08-08T02:26:12.261506Z","submitted_at":"2026-06-03T12:38:57Z","title":"Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifelong Learning Agents","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T07:05:18.137509Z"},"links":{"citing_paper":"/paper/2606.04815"},"observation_digest":"sha256:7da47c8f54586ef930da3ed1049edb309dcfbdca9b828f4341ca3b3d471a4096","observation_id":"41920523-f333-49f8-a2ec-44f45daac396","resolution":{"observed_at":"2026-07-02T07:06:44.861115Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2606.04815","last_updated":"2026-06-19T10:36:09Z","snapshot_observed_at":"2026-08-08T02:26:12.261506Z","submitted_at":"2026-06-03T12:38:57Z","title":"Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifelong Learning Agents","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T07:05:18.137509Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2606.04815"},"observation_digest":"sha256:0d45c4129025c4577ee4619a8f9854d64356a263912d2dfe53780212fcc49cdb","observation_id":"8c24feba-2ef7-4ffb-bed7-177fef257741","resolution":{"observed_at":"2026-07-02T07:06:44.856509Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21046","last_updated":"2026-01-16T20:59:08Z","snapshot_observed_at":"2026-08-01T06:32:44.461162Z","submitted_at":"2025-07-28T17:59:05Z","title":"A Survey of Self-Evolving Agents: What, When, How, and Where to Evolve on the Path to Artificial Super Intelligence","version":4},"cited_work":{"arxiv_id":"2507.21046","doi":"10.48550/arxiv.2507.21046","metadata_source":"pith","pith_arxiv_id":"2507.21046","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey of Self-Evolving Agents: What, When, How, and Where to Evolve on the Path to Artificial Super Intelligence","venue":"cs.AI","work_id":"f5de9511-98bf-411c-9eba-e8b7a914ec18","year":2025},"citing_paper":{"arxiv_id":"2606.04815","last_updated":"2026-06-19T10:36:09Z","snapshot_observed_at":"2026-08-08T02:26:12.261506Z","submitted_at":"2026-06-03T12:38:57Z","title":"Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifelong Learning Agents","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T07:05:18.137509Z"},"links":{"cited_paper":"/paper/2507.21046","citing_paper":"/paper/2606.04815"},"observation_digest":"sha256:4a9e311c32c9988f7ce0723eec790912b980ea9aff0ccf36de4d4fd371ef697f","observation_id":"1adc9c63-776c-4adf-b38e-71cab9371c83","resolution":{"observed_at":"2026-07-02T07:06:44.870646Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-01T10:08:10.122082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T10:08:10.122082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13649","last_updated":"2024-06-06T02:01:09Z","snapshot_observed_at":"2026-08-15T00:56:43.641640Z","submitted_at":"2024-01-24T18:35:21Z","title":"VisualWebArena: Evaluating Multimodal Agents on Realistic Visual Web Tasks","version":2},"cited_work":{"arxiv_id":"2401.13649","doi":"10.48550/arxiv.2401.13649","metadata_source":"pith","pith_arxiv_id":"2401.13649","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VisualWebArena: Evaluating Multimodal Agents on Realistic Visual Web Tasks","venue":"cs.LG","work_id":"37f08c56-1b7d-4d9e-baf9-7c2ebb7e6acd","year":2024},"citing_paper":{"arxiv_id":"2606.04815","last_updated":"2026-06-19T10:36:09Z","snapshot_observed_at":"2026-08-08T02:26:12.261506Z","submitted_at":"2026-06-03T12:38:57Z","title":"Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifelong Learning Agents","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T07:05:18.137509Z"},"links":{"cited_paper":"/paper/2401.13649","citing_paper":"/paper/2606.04815"},"observation_digest":"sha256:61e6e932b165c2e39bd11443ad8deb05b6b1b3c1a376fbe748525d24359ea39a","observation_id":"a998b8c0-8123-460e-b620-d76e94c55c01","resolution":{"observed_at":"2026-07-02T07:06:44.863802Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-15T07:08:14.13759+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-15T07:08:14.13759+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22101","last_updated":"2025-05-28T08:27:12Z","snapshot_observed_at":"2026-08-19T01:38:39.201686Z","submitted_at":"2025-05-28T08:27:12Z","title":"MemOS: An Operating System for Memory-Augmented Generation (MAG) in Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.22101","doi":"10.48550/arxiv.2505.22101","metadata_source":"pith","pith_arxiv_id":"2505.22101","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MemOS: An operating system for memory-augmented generation","venue":"cs.CL","work_id":"62f802d2-2c22-4140-9b3d-b8b7220f772e","year":2025},"citing_paper":{"arxiv_id":"2606.04815","last_updated":"2026-06-19T10:36:09Z","snapshot_observed_at":"2026-08-08T02:26:12.261506Z","submitted_at":"2026-06-03T12:38:57Z","title":"Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifelong Learning Agents","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T07:05:18.137509Z"},"links":{"cited_paper":"/paper/2505.22101","citing_paper":"/paper/2606.04815"},"observation_digest":"sha256:ab5ae8d8692e245521620a27f4d0ca676f7bb97ccd11a0e98afe627a489ffc51","observation_id":"47ffbfdb-6155-46f9-8455-e3bae5031e17","resolution":{"observed_at":"2026-07-02T07:06:44.867161Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:05:18.137509Z","title":"Narasimhan, and Shunyu Yao","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04815","last_updated":"2026-06-19T10:36:09Z","snapshot_observed_at":"2026-08-08T02:26:12.261506Z","submitted_at":"2026-06-03T12:38:57Z","title":"Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifelong Learning Agents","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T07:05:18.137509Z"},"links":{"citing_paper":"/paper/2606.04815"},"observation_digest":"sha256:2126bfa7c0084718212d7c28e7b020c38e968b110e15397274600626ea549edf","observation_id":"4d34ac03-4247-45b3-b61a-c08b550570d1","resolution":{"observed_at":"2026-06-28T07:05:18.137509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:05:18.137509Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04815","last_updated":"2026-06-19T10:36:09Z","snapshot_observed_at":"2026-08-08T02:26:12.261506Z","submitted_at":"2026-06-03T12:38:57Z","title":"Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifelong Learning Agents","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T07:05:18.137509Z"},"links":{"citing_paper":"/paper/2606.04815"},"observation_digest":"sha256:489189a7280e14af8e3ceab62e5d9d3fbdad185acd3de30a815fb4d6a6bfb7a4","observation_id":"0e266dcc-57e7-4ac6-ba51-27af320e1ac0","resolution":{"observed_at":"2026-06-28T07:05:18.137509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:05:18.137509Z","title":"Long Ouyang, Jeff Wu, Xu Jiang, Diogo Almeida, Carroll L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.04815","last_updated":"2026-06-19T10:36:09Z","snapshot_observed_at":"2026-08-08T02:26:12.261506Z","submitted_at":"2026-06-03T12:38:57Z","title":"Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifelong Learning Agents","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T07:05:18.137509Z"},"links":{"citing_paper":"/paper/2606.04815"},"observation_digest":"sha256:b04e5e9d696986acdcee35003ab341fe0a44c8bba6859691af08f82d6308c82b","observation_id":"c81133be-657e-44da-8f5d-969e51055bfe","resolution":{"observed_at":"2026-06-28T07:05:18.137509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.25140","last_updated":"2026-03-16T20:49:28Z","snapshot_observed_at":"2026-08-20T07:49:07.866542Z","submitted_at":"2025-09-29T17:51:03Z","title":"ReasoningBank: Scaling Agent Self-Evolving with Reasoning Memory","version":2},"cited_work":{"arxiv_id":"2509.25140","doi":"10.48550/arxiv.2509.25140","metadata_source":"pith","pith_arxiv_id":"2509.25140","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ReasoningBank: Scaling Agent Self-Evolving with Reasoning Memory","venue":"cs.AI","work_id":"551218b8-a306-4c1e-8795-6232cc30192b","year":2025},"citing_paper":{"arxiv_id":"2606.04815","last_updated":"2026-06-19T10:36:09Z","snapshot_observed_at":"2026-08-08T02:26:12.261506Z","submitted_at":"2026-06-03T12:38:57Z","title":"Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifelong Learning Agents","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T07:05:18.137509Z"},"links":{"cited_paper":"/paper/2509.25140","citing_paper":"/paper/2606.04815"},"observation_digest":"sha256:5a0997b8b51b76583e22e712c7a4d14b6dc8e087130c6af245aedfd786b41dc8","observation_id":"962268a2-a2a0-40a3-9e90-89c79fc6a334","resolution":{"observed_at":"2026-07-02T07:06:44.874024Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:34.995342+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:34.995342+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2606.04815","last_updated":"2026-06-19T10:36:09Z","snapshot_observed_at":"2026-08-08T02:26:12.261506Z","submitted_at":"2026-06-03T12:38:57Z","title":"Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifelong Learning Agents","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T07:05:18.137509Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2606.04815"},"observation_digest":"sha256:75b33a337b6e127e2f57d0ad8bd4c5f41bfeaa24a89fb3c3f2746f99631fa547","observation_id":"177b6b38-0bbb-4d7f-8091-982a72036112","resolution":{"observed_at":"2026-07-02T07:06:44.885182Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:05:18.137509Z","title":"Reflexion: language agents with verbal reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.04815","last_updated":"2026-06-19T10:36:09Z","snapshot_observed_at":"2026-08-08T02:26:12.261506Z","submitted_at":"2026-06-03T12:38:57Z","title":"Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifelong Learning Agents","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T07:05:18.137509Z"},"links":{"citing_paper":"/paper/2606.04815"},"observation_digest":"sha256:b4f42df601718e0b6d71b8dccf14e1dae827dbedcb1cda542d3fa341268de151","observation_id":"6c1f0806-8730-457e-b042-e33f22f23b59","resolution":{"observed_at":"2026-06-28T07:05:18.137509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:05:18.137509Z","title":"12 ICALK Yu Sun, Xiaolong Wang, Zhuang Liu, John Miller, Alexei A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.04815","last_updated":"2026-06-19T10:36:09Z","snapshot_observed_at":"2026-08-08T02:26:12.261506Z","submitted_at":"2026-06-03T12:38:57Z","title":"Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifelong Learning Agents","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T07:05:18.137509Z"},"links":{"citing_paper":"/paper/2606.04815"},"observation_digest":"sha256:9e1b290d82586807683c9e2dad2f5fe000ce61c98c61f40ceff69f11f9cd2305","observation_id":"60076275-16b2-4e97-8d1d-8768c07f99a7","resolution":{"observed_at":"2026-06-28T07:05:18.137509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07952","last_updated":"2025-04-10T17:57:33Z","snapshot_observed_at":"2026-08-16T12:42:16.328965Z","submitted_at":"2025-04-10T17:57:33Z","title":"Dynamic Cheatsheet: Test-Time Learning with Adaptive Memory","version":1},"cited_work":{"arxiv_id":"2504.07952","doi":"10.48550/arxiv.2504.07952","metadata_source":"pith","pith_arxiv_id":"2504.07952","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Dy- namic cheatsheet: Test-time learning with adaptive memory, 2025.URL https://arxiv","venue":"cs.LG","work_id":"c456160c-605b-4bcb-b322-6d1c3572bac4","year":2025},"citing_paper":{"arxiv_id":"2606.04815","last_updated":"2026-06-19T10:36:09Z","snapshot_observed_at":"2026-08-08T02:26:12.261506Z","submitted_at":"2026-06-03T12:38:57Z","title":"Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifelong Learning Agents","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T07:05:18.137509Z"},"links":{"cited_paper":"/paper/2504.07952","citing_paper":"/paper/2606.04815"},"observation_digest":"sha256:5e9a9b2a3e2ebcb2bbdd49b5d257ccc5c7959f0499a775d4cc20a4fa8349c6fe","observation_id":"164cbb6c-1fb6-49fa-93af-d96f751fac7b","resolution":{"observed_at":"2026-07-02T07:06:44.891917Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.06229","doi":"10.48550/arxiv.2507.06229","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agent kb: Leveraging cross-domain experience for agentic problem solving","venue":"ArXiv.org","work_id":"11232777-9790-41f1-ae97-5d0c1577d5a0","year":2025},"citing_paper":{"arxiv_id":"2606.04815","last_updated":"2026-06-19T10:36:09Z","snapshot_observed_at":"2026-08-08T02:26:12.261506Z","submitted_at":"2026-06-03T12:38:57Z","title":"Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifelong Learning Agents","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T07:05:18.137509Z"},"links":{"citing_paper":"/paper/2606.04815"},"observation_digest":"sha256:666b521a89e10800126d96e74613730f07f6a41472598e44eb4effb08165bd17","observation_id":"72f758a7-06b8-4620-b42f-21e39adf2d7d","resolution":{"observed_at":"2026-07-02T07:06:44.894867Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-08-13T16:55:46.498156Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":"2305.16291","doi":"10.18653/v1/2023.emnlp-main.118","metadata_source":"pith","pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","venue":"cs.AI","work_id":"ffe0d207-86cf-4742-a100-e988ac8b9676","year":2023},"citing_paper":{"arxiv_id":"2606.04815","last_updated":"2026-06-19T10:36:09Z","snapshot_observed_at":"2026-08-08T02:26:12.261506Z","submitted_at":"2026-06-03T12:38:57Z","title":"Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifelong Learning Agents","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T07:05:18.137509Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2606.04815"},"observation_digest":"sha256:30d9810f99c4cabb8acdb1f47ea62ba46f8a41d912adb93c6756574a253417c1","observation_id":"af6f7b5e-44ed-465c-b3f5-206165db217c","resolution":{"observed_at":"2026-07-02T07:06:44.900614Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:05:18.137509Z","title":"Self- consistency improves chain of thought reasoning in language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04815","last_updated":"2026-06-19T10:36:09Z","snapshot_observed_at":"2026-08-08T02:26:12.261506Z","submitted_at":"2026-06-03T12:38:57Z","title":"Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifelong Learning Agents","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T07:05:18.137509Z"},"links":{"citing_paper":"/paper/2606.04815"},"observation_digest":"sha256:7072033a5d5df85fe4d80bf5e443fcbb8a94f295b5ba398d712451e257dc45a3","observation_id":"1c491063-bbf8-429f-95c4-3d3a84d5a927","resolution":{"observed_at":"2026-06-28T07:05:18.137509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.08234","last_updated":"2026-02-09T03:17:17Z","snapshot_observed_at":"2026-08-16T15:35:02.889986Z","submitted_at":"2026-02-09T03:17:17Z","title":"SkillRL: Evolving Agents via Recursive Skill-Augmented Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2602.08234","doi":"10.48550/arxiv.2602.08234","metadata_source":"pith","pith_arxiv_id":"2602.08234","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SkillRL: Evolving Agents via Recursive Skill-Augmented Reinforcement Learning","venue":"cs.LG","work_id":"536a9d0a-baed-4eb9-9a51-f2b585c3388b","year":2026},"citing_paper":{"arxiv_id":"2606.04815","last_updated":"2026-06-19T10:36:09Z","snapshot_observed_at":"2026-08-08T02:26:12.261506Z","submitted_at":"2026-06-03T12:38:57Z","title":"Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifelong Learning Agents","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T07:05:18.137509Z"},"links":{"cited_paper":"/paper/2602.08234","citing_paper":"/paper/2606.04815"},"observation_digest":"sha256:41be94e9cfd3d887eb3babba88d49f3b03b9f668e893eb201514ba6d948e30d8","observation_id":"8cc6d142-6dd5-4480-b5de-da321ba53b2d","resolution":{"observed_at":"2026-07-02T07:06:44.882126Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10601","last_updated":"2023-12-03T22:50:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T23:16:17Z","title":"Tree of Thoughts: Deliberate Problem Solving with Large Language Models","version":2},"cited_work":{"arxiv_id":"2305.10601","doi":"10.48550/arxiv.2305.10601","metadata_source":"pith","pith_arxiv_id":"2305.10601","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tree of Thoughts: Deliberate Problem Solving with Large Language Models","venue":"cs.CL","work_id":"07adb06e-4ed5-4ec5-a7ae-ff288fd214fb","year":2023},"citing_paper":{"arxiv_id":"2606.04815","last_updated":"2026-06-19T10:36:09Z","snapshot_observed_at":"2026-08-08T02:26:12.261506Z","submitted_at":"2026-06-03T12:38:57Z","title":"Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifelong Learning Agents","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T07:05:18.137509Z"},"links":{"cited_paper":"/paper/2305.10601","citing_paper":"/paper/2606.04815"},"observation_digest":"sha256:3de8fc661e4cf333f6bf9023746159869cb3a8ae0ee002a6e62baf2ea331f4ed","observation_id":"1ed490d7-7983-4769-addd-91c73637ed0a","resolution":{"observed_at":"2026-07-02T07:06:44.897765Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:14.037057+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:14.037057+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01825","last_updated":"2023-09-13T03:57:29Z","snapshot_observed_at":"2026-08-16T18:17:11.146813Z","submitted_at":"2023-08-03T15:34:01Z","title":"Scaling Relationship on Learning Mathematical Reasoning with Large Language Models","version":2},"cited_work":{"arxiv_id":"2308.01825","doi":"10.48550/arxiv.2308.01825","metadata_source":"pith","pith_arxiv_id":"2308.01825","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Relationship on Learning Mathematical Reasoning with Large Language Models","venue":"cs.CL","work_id":"15eea2e2-dff3-42a7-842a-b663d50f64cb","year":2023},"citing_paper":{"arxiv_id":"2606.04815","last_updated":"2026-06-19T10:36:09Z","snapshot_observed_at":"2026-08-08T02:26:12.261506Z","submitted_at":"2026-06-03T12:38:57Z","title":"Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifelong Learning Agents","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T07:05:18.137509Z"},"links":{"cited_paper":"/paper/2308.01825","citing_paper":"/paper/2606.04815"},"observation_digest":"sha256:b1347fd4b7693270b59ae08d60e73d57bba628d4674211bb179ffebffd97c3e0","observation_id":"d7098c18-415c-4b1c-a40a-1ee693835529","resolution":{"observed_at":"2026-06-28T07:11:44.783941Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-05-22T08:24:16.697802+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T08:24:16.697802+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11942","last_updated":"2025-05-30T02:28:21Z","snapshot_observed_at":"2026-08-19T20:11:09.656463Z","submitted_at":"2025-05-17T10:09:11Z","title":"LifelongAgentBench: Evaluating LLM Agents as Lifelong Learners","version":3},"cited_work":{"arxiv_id":"2505.11942","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.11942","snapshot_observed_at":"2026-07-04T17:09:59.374964Z","title":"Lifelonga- gentbench: Evaluating llm agents as lifelong learners.arXiv preprint arXiv:2505.11942","venue":null,"work_id":"c834b014-6484-4f50-bc9d-15e598a8890a","year":2025},"citing_paper":{"arxiv_id":"2606.04815","last_updated":"2026-06-19T10:36:09Z","snapshot_observed_at":"2026-08-08T02:26:12.261506Z","submitted_at":"2026-06-03T12:38:57Z","title":"Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifelong Learning Agents","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T07:05:18.137509Z"},"links":{"cited_paper":"/paper/2505.11942","citing_paper":"/paper/2606.04815"},"observation_digest":"sha256:14835070a0ae4c120663a2e50c1909ccd72b325aef1cde796ce480f419737671","observation_id":"68135c1e-bb52-4b5d-a59d-e275a884ae8f","resolution":{"observed_at":"2026-07-02T07:06:44.878043Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:05:18.137509Z","title":"Longtao Zheng, Rundong Wang, Xinrun Wang, and Bo An","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.04815","last_updated":"2026-06-19T10:36:09Z","snapshot_observed_at":"2026-08-08T02:26:12.261506Z","submitted_at":"2026-06-03T12:38:57Z","title":"Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifelong Learning Agents","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T07:05:18.137509Z"},"links":{"citing_paper":"/paper/2606.04815"},"observation_digest":"sha256:c8ba7c09c6edffb358788993badbcee2acb30da0e4ded7e6446b4202b6822ddc","observation_id":"f6946181-72b0-49d7-86e2-2964cfb6dafc","resolution":{"observed_at":"2026-06-28T07:05:18.137509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-08-14T11:14:55.351653Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":"2307.13854","doi":"10.48550/arxiv.2307.13854","metadata_source":"pith","pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","venue":"cs.AI","work_id":"7058ffd2-a339-4102-89eb-248eeb074652","year":2023},"citing_paper":{"arxiv_id":"2606.04815","last_updated":"2026-06-19T10:36:09Z","snapshot_observed_at":"2026-08-08T02:26:12.261506Z","submitted_at":"2026-06-03T12:38:57Z","title":"Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifelong Learning Agents","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T07:05:18.137509Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2606.04815"},"observation_digest":"sha256:9595014e4a1384201fd57a7f03465387cb394e48096559422659f9d38cac25d7","observation_id":"f6023b4d-74d7-4b0e-ac19-de7a7c377f6d","resolution":{"observed_at":"2026-07-02T07:06:44.889022Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-15T07:08:14.424698+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-15T07:08:14.424698+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.04815","last_updated":"2026-06-19T10:36:09Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T02:26:12.261506Z","submitted_at":"2026-06-03T12:38:57Z","title":"Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifelong Learning Agents"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":1,"metadata_mismatch":5,"parse_uncertain":0,"unresolved":7,"verified_exact":9,"verified_fuzzy":0},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 1 inbound Pith citation observation for arXiv:2606.04815."}