{"as_of":"2026-08-18T17:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cc19f95557fb32b9380a61c9bf5130d7a88bde7a33295ddc2da3945558202985","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":27,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T10:08:58.313670Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T17:20:00.052495Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-08-12T19:10:14.548500Z","title":"Agent-pro: Learning to evolve via policy-level reflection and optimization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10943","last_updated":"2024-11-17T02:44:56Z","snapshot_observed_at":"2026-08-16T10:37:51.980574Z","submitted_at":"2024-11-17T02:44:56Z","title":"Generalist Virtual Agents: A Survey on Autonomous Agents Across Digital Platforms","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-12T19:10:14.548500Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2411.10943"},"observation_digest":"sha256:7a304ec41cf960b13e08ecbd0424f9a2a60e23e3952aa13992e766868474f8da","observation_id":"9f5f84bd-24de-4a88-9145-f96f8fbda7d2","resolution":{"observed_at":"2026-08-12T19:10:14.548500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-08-12T10:08:13.259699Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19547","last_updated":"2024-11-29T08:47:04Z","snapshot_observed_at":"2026-08-18T10:05:26.260953Z","submitted_at":"2024-11-29T08:47:04Z","title":"Training Agents with Weakly Supervised Feedback from Large Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-12T10:08:13.259699Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2411.19547"},"observation_digest":"sha256:08868d9c925cd450bdfcbd15d1a15888571787d272f2cf08f243715bc62c0cce","observation_id":"af16f172-6a01-4b14-89ea-2613ee381586","resolution":{"observed_at":"2026-08-12T10:08:13.259699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-08-11T22:52:15.192227Z","title":"Zhang, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03092","last_updated":"2025-06-18T04:06:03Z","snapshot_observed_at":"2026-08-17T07:11:23.935721Z","submitted_at":"2024-12-04T07:44:35Z","title":"REVOLVE: Optimizing AI Systems by Tracking Response Evolution in Textual Optimization","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:15.192227Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2412.03092"},"observation_digest":"sha256:4359e7574fc17396f29bb510905661897fdefa97e4df59afbc2d9899245b8143","observation_id":"ee55fb2e-2672-42cd-867c-e86ed65458d8","resolution":{"observed_at":"2026-08-11T22:52:15.192227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-08-11T21:58:46.979827Z","title":"Agent-pro: Learning to evolve via policy-level reflection and optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03920","last_updated":"2025-07-20T01:35:50Z","snapshot_observed_at":"2026-08-17T14:59:50.479461Z","submitted_at":"2024-12-05T06:46:46Z","title":"A Survey on Large Language Model-Based Social Agents in Game-Theoretic Scenarios","version":2},"reference_index":141,"source":"arxiv_source","source_observed_at":"2026-08-11T21:58:46.979827Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2412.03920"},"observation_digest":"sha256:d6c741ede064c45b19b5093ab8036132314e8455b9e0d77a245d3bd52de1cb3e","observation_id":"958420c8-eaf0-4178-b1c4-216ed9ea6eac","resolution":{"observed_at":"2026-08-11T21:58:46.979827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-08-11T14:03:01.161778Z","title":"Advances in Neural Information Processing Systems, 36","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15266","last_updated":"2024-12-17T04:30:00Z","snapshot_observed_at":"2026-08-18T10:04:09.771450Z","submitted_at":"2024-12-17T04:30:00Z","title":"On the Structural Memory of LLM Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T14:03:01.161778Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2412.15266"},"observation_digest":"sha256:5bb26c456df0e6ad56cb892ad7f59cd4b5b9abf627aabff8ed2a946fc02af2a8","observation_id":"02515358-adfb-4cac-bd7d-727bbcf74640","resolution":{"observed_at":"2026-08-11T14:03:01.161778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-08-11T00:08:16.295396Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19684","last_updated":"2025-02-17T15:32:50Z","snapshot_observed_at":"2026-08-18T09:40:01.388208Z","submitted_at":"2024-12-27T15:21:17Z","title":"Boosting Private Domain Understanding of Efficient MLLMs: A Tuning-free, Adaptive, Universal Prompt Optimization Framework","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T00:08:16.295396Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2412.19684"},"observation_digest":"sha256:6bce21c104933ec4d25197f770013808562e203ae63bdbb220e62fdb27e448c5","observation_id":"f0e7372d-3567-431b-b450-16628c4db821","resolution":{"observed_at":"2026-08-11T00:08:16.295396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-08-10T20:41:30.399995Z","title":"Agent-pro: Learning to evolve via policy-level reflection and optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.07572","last_updated":"2025-08-10T05:59:20Z","snapshot_observed_at":"2026-08-14T06:23:46.085198Z","submitted_at":"2025-01-13T18:58:07Z","title":"WebWalker: Benchmarking LLMs in Web Traversal","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-10T20:41:30.399995Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2501.07572"},"observation_digest":"sha256:a5988e9ff6a4ffb9dd8de62ae6d831291fb34281f3e62392fbe9a2beab6848f8","observation_id":"5656fe9e-a0d2-46c9-a02b-a2042eca476d","resolution":{"observed_at":"2026-08-10T20:41:30.399995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":"2402.17574","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-07-04T17:20:00.052495Z","title":"Agent-pro: Learning to evolve via policy-level reflection and optimization","venue":null,"work_id":"948b97fe-757f-44c8-89ef-9fd25c62be0d","year":2024},"citing_paper":{"arxiv_id":"2501.09686","last_updated":"2025-01-23T08:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T17:37:58Z","title":"Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models","version":3},"reference_index":190,"source":"pdf_text","source_observed_at":"2026-05-15T21:20:59.128986Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2501.09686"},"observation_digest":"sha256:1214a35bfed718120dc6c3ae0f349d2cdc5c74bcb26c0bd128bf5cd5a5f4539a","observation_id":"d2afa31b-fd8f-4fb2-bccf-c07d480cb1e6","resolution":{"observed_at":"2026-05-15T21:20:59.435553Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-08-09T14:34:58.948949Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05210","last_updated":"2025-05-28T19:42:17Z","snapshot_observed_at":"2026-08-17T07:58:29.556919Z","submitted_at":"2025-02-03T19:26:44Z","title":"Regression and Forecasting of U.S. Stock Returns Based on LSTM","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T14:34:58.948949Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2502.05210"},"observation_digest":"sha256:84ae5dcc35e64236b01da3f69f98af016894d74e9e4d296cfd387458762068c0","observation_id":"0ee24071-c004-481e-9291-358b5be18f86","resolution":{"observed_at":"2026-08-09T14:34:58.948949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":"2402.17574","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-07-04T17:20:00.052495Z","title":"Agent-pro: Learning to evolve via policy-level reflection and optimization","venue":null,"work_id":"948b97fe-757f-44c8-89ef-9fd25c62be0d","year":2024},"citing_paper":{"arxiv_id":"2502.13388","last_updated":"2026-04-10T14:53:27Z","snapshot_observed_at":"2026-08-12T15:38:39.325743Z","submitted_at":"2025-02-19T02:53:43Z","title":"Reflection of Episodes: Learning to Play Game from Expert and Self Experiences","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-23T03:09:43.596964Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2502.13388"},"observation_digest":"sha256:e4be9514e17591118f80da03e33ba7ebba1e066802420e1be88b80f95b70f15c","observation_id":"a004e354-8cac-4039-bc1a-1aab93c0a57e","resolution":{"observed_at":"2026-05-23T03:12:28.469302Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-08-16T10:08:58.313670Z","title":"Agent-pro: Learning to evolve via policy-level reflection and optimization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18945","last_updated":"2025-04-26T15:07:38Z","snapshot_observed_at":"2026-08-18T10:11:38.298160Z","submitted_at":"2025-04-26T15:07:38Z","title":"Generative AI in Embodied Systems: System-Level Analysis of Performance, Efficiency and Scalability","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T10:08:58.313670Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2504.18945"},"observation_digest":"sha256:da4945349c24fb6953f389f7bbb2dbde01769b6bbd11440aae0381777e105378","observation_id":"5b692b4a-1c69-4a2f-a7d9-4ce1ebfd1d7f","resolution":{"observed_at":"2026-08-16T10:08:58.313670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-08-15T21:59:53.906880Z","title":"Agent-pro: Learning to evolve via policy-level reflection and optimization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08459","last_updated":"2025-06-01T11:53:16Z","snapshot_observed_at":"2026-08-16T19:44:04.300137Z","submitted_at":"2025-05-13T11:41:10Z","title":"Strategy-Augmented Planning for Large Language Models via Opponent Exploitation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T21:59:53.906880Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2505.08459"},"observation_digest":"sha256:33c7235ee2d778ec045fe61f8084175b4bf33ef3e64128bae1064dce7770ab4a","observation_id":"5d72ca18-692f-4d09-bf5a-7c5ddb887e1c","resolution":{"observed_at":"2026-08-15T21:59:53.906880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-08-15T21:12:01.515887Z","title":"Agent-pro: Learning to evolve via policy-level reflection and optimization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","snapshot_observed_at":"2026-08-18T15:16:05.553658Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T21:12:01.515887Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2505.10543"},"observation_digest":"sha256:6a5970ede2be3a1b5a45d007b1006705c73bceeeb4ffc59c1b082b79a17233dd","observation_id":"0259a033-897e-4c0e-8a1c-2a357cedce90","resolution":{"observed_at":"2026-08-15T21:12:01.515887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-08-07T11:52:05.260604Z","title":"Agent-pro: Learning to evolve via policy-level reflection and optimization.arXiv preprint arXiv:2402.17574, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-15T05:47:34.730195Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T11:52:05.260604Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2506.01300"},"observation_digest":"sha256:ce8d760f2db71819261a452f9e9032183975848b110a824e55be4d313564cfc2","observation_id":"1037613c-34e7-4cf4-993a-c89ec1469acc","resolution":{"observed_at":"2026-08-07T11:52:05.260604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-08-07T05:00:54.047516Z","title":"Agent-pro: Learning to evolve via policy-level reflection and optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09107","last_updated":"2025-06-10T17:02:43Z","snapshot_observed_at":"2026-08-15T14:17:06.844918Z","submitted_at":"2025-06-10T17:02:43Z","title":"FAIRTOPIA: Envisioning Multi-Agent Guardianship for Disrupting Unfair AI Pipelines","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T05:00:54.047516Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2506.09107"},"observation_digest":"sha256:05245805b2fac1f92dafd6232694d1522fe9a3fed66448fe28740a22d26d70ec","observation_id":"fa4919cb-4133-466b-8fa6-ad50041b38f7","resolution":{"observed_at":"2026-08-07T05:00:54.047516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-08-07T04:46:04.611203Z","title":"Agent-pro: Learning to evolve via policy-level reflection and optimization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09656","last_updated":"2025-08-07T08:42:17Z","snapshot_observed_at":"2026-08-15T16:31:58.100230Z","submitted_at":"2025-06-11T12:25:38Z","title":"Multi-level Value Alignment in Agentic AI Systems: Survey and Perspectives","version":2},"reference_index":160,"source":"pdf_text","source_observed_at":"2026-08-07T04:46:04.611203Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2506.09656"},"observation_digest":"sha256:eeeffeb2e3210121998d5c9e36d2ab0d21901b73618edb31a84406fb2daf0a2b","observation_id":"c480e29b-1511-4bab-80e1-30443739c009","resolution":{"observed_at":"2026-08-07T04:46:04.611203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-08-06T21:34:42.695008Z","title":"Agent-pro: Learning IEEE TRANSACTIONS ON PATTERN ANAL YSIS AND MACHINE INTELLIGENCE 18 to evolve via policy-level reflection and optimization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23844","last_updated":"2025-06-30T13:34:34Z","snapshot_observed_at":"2026-08-14T01:01:55.822518Z","submitted_at":"2025-06-30T13:34:34Z","title":"A Survey on Autonomy-Induced Security Risks in Large Model-Based Agents","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T21:34:42.695008Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2506.23844"},"observation_digest":"sha256:cb0b897706299a1d20465164434e2e35b1bc848fb94d574ae7a727293abb4ff3","observation_id":"69e25ffc-54ad-4ef8-b964-6658e1d7f3e8","resolution":{"observed_at":"2026-08-06T21:34:42.695008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-08-06T16:33:48.946358Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.13152","last_updated":"2025-08-26T08:52:15Z","snapshot_observed_at":"2026-08-18T17:00:21.419870Z","submitted_at":"2025-07-17T14:13:50Z","title":"SE-VLN: A Self-Evolving Vision-Language Navigation Framework Based on Multimodal Large Language Models","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T16:33:48.946358Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2507.13152"},"observation_digest":"sha256:41f6ac7c1bbc3f963595d241f70638be12b6a0e3a9c364a20d55fa231f3a9961","observation_id":"0b0d1496-ebbc-45ad-9857-a97331296eca","resolution":{"observed_at":"2026-08-06T16:33:48.946358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-08-05T20:31:56.343748Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10399","last_updated":"2025-08-14T06:56:16Z","snapshot_observed_at":"2026-08-17T18:39:16.964832Z","submitted_at":"2025-08-14T06:56:16Z","title":"Large Model Empowered Embodied AI: A Survey on Decision-Making and Embodied Learning","version":1},"reference_index":221,"source":"pdf_text","source_observed_at":"2026-08-05T20:31:56.343748Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2508.10399"},"observation_digest":"sha256:811f4465c1aae98d78833c47d999ca8c673efde0a1bc4ad62dea99d315b96a67","observation_id":"798c817d-f13b-4592-aeba-3f94cb13d2c6","resolution":{"observed_at":"2026-08-05T20:31:56.343748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-08-15T16:37:52.799830Z","title":"Agent-pro: Learning to evolve via policy-level reflection and optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03059","last_updated":"2026-07-26T23:59:38Z","snapshot_observed_at":"2026-08-15T17:21:39.654535Z","submitted_at":"2025-09-03T06:42:40Z","title":"Loong: Synthesize Long Chain-of-Thoughts at Scale through Verifiers","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T16:37:52.799830Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2509.03059"},"observation_digest":"sha256:7d20ccb75089a6931b12d32c05ecfb4a79151b9f611e29d0e42b3b4829745f2c","observation_id":"75198911-985f-42d3-a3e2-5020a92af878","resolution":{"observed_at":"2026-08-15T16:37:52.799830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":"2402.17574","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-07-04T17:20:00.052495Z","title":"Agent-pro: Learning to evolve via policy-level reflection and optimization","venue":null,"work_id":"948b97fe-757f-44c8-89ef-9fd25c62be0d","year":2024},"citing_paper":{"arxiv_id":"2603.29908","last_updated":"2026-03-31T15:53:29Z","snapshot_observed_at":"2026-08-13T20:15:50.035768Z","submitted_at":"2026-03-31T15:53:29Z","title":"C-TRAIL: A Commonsense World Framework for Trajectory Planning in Autonomous Driving","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-13T23:27:31.054348Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2603.29908"},"observation_digest":"sha256:d1eff1ebd453411400eb43dd4af40676a13dde8e018c886b3c776f42a6242282","observation_id":"36a7ab9f-b5b7-450a-af13-c5a3a5958309","resolution":{"observed_at":"2026-05-13T23:28:26.110501Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":"2402.17574","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-07-04T17:20:00.052495Z","title":"Agent-pro: Learning to evolve via policy-level reflection and optimization","venue":null,"work_id":"948b97fe-757f-44c8-89ef-9fd25c62be0d","year":2024},"citing_paper":{"arxiv_id":"2604.09285","last_updated":"2026-04-10T12:55:23Z","snapshot_observed_at":"2026-08-14T21:54:16.313879Z","submitted_at":"2026-04-10T12:55:23Z","title":"SAGE: A Service Agent Graph-guided Evaluation Benchmark","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-10T16:41:23.956104Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2604.09285"},"observation_digest":"sha256:cb8f67a10be7ac7dd117098a68a73e0c8b4fc9f4a607f8d2ad39153d0b2994e5","observation_id":"703355d8-a7fb-41a5-9489-2d637eff7ba7","resolution":{"observed_at":"2026-05-11T08:21:00.927739Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":"2402.17574","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-07-04T17:20:00.052495Z","title":"Agent-pro: Learning to evolve via policy-level reflection and optimization","venue":null,"work_id":"948b97fe-757f-44c8-89ef-9fd25c62be0d","year":2024},"citing_paper":{"arxiv_id":"2605.05974","last_updated":"2026-05-19T06:13:53Z","snapshot_observed_at":"2026-07-06T23:18:31.432422Z","submitted_at":"2026-05-07T10:19:06Z","title":"PragLocker: Protecting Agent Intellectual Property in Untrusted Deployments via Non-Portable Prompts","version":1},"reference_index":133,"source":"arxiv_source","source_observed_at":"2026-05-08T09:24:27.977204Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2605.05974"},"observation_digest":"sha256:e721c27e499aadd6700b1c3b6aab615e5e03c497482329538d72588bd247912a","observation_id":"aa262c24-ccc9-4d99-957a-a4b013562bcb","resolution":{"observed_at":"2026-05-11T20:21:11.091887Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":"2402.17574","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-07-04T17:20:00.052495Z","title":"Agent-pro: Learning to evolve via policy-level reflection and optimization","venue":null,"work_id":"948b97fe-757f-44c8-89ef-9fd25c62be0d","year":2024},"citing_paper":{"arxiv_id":"2605.05974","last_updated":"2026-05-19T06:13:53Z","snapshot_observed_at":"2026-07-06T23:18:31.432422Z","submitted_at":"2026-05-07T10:19:06Z","title":"PragLocker: Protecting Agent Intellectual Property in Untrusted Deployments via Non-Portable Prompts","version":2},"reference_index":133,"source":"arxiv_source","source_observed_at":"2026-05-20T23:32:48.878074Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2605.05974"},"observation_digest":"sha256:3d8ffd5749c123e8f8334142f174bf1e2bb6181dd0ccaafd1567903c168538af","observation_id":"1bd5d1e7-1590-46d7-a587-802b9acbf478","resolution":{"observed_at":"2026-05-20T23:33:50.618069Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":"2402.17574","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-07-04T17:20:00.052495Z","title":"Agent-pro: Learning to evolve via policy-level reflection and optimization","venue":null,"work_id":"948b97fe-757f-44c8-89ef-9fd25c62be0d","year":2024},"citing_paper":{"arxiv_id":"2606.01581","last_updated":"2026-06-01T02:26:39Z","snapshot_observed_at":"2026-07-06T23:42:07.508474Z","submitted_at":"2026-06-01T02:26:39Z","title":"Agent System Operations: Categorization, Challenges, and Future Directions","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T12:14:21.322860Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2606.01581"},"observation_digest":"sha256:22ba4d70392741d1547da118d3be219de2615dd97d0cd25f2907e4dfade8590a","observation_id":"8d904238-7149-45db-aaa3-adb0f33c42e7","resolution":{"observed_at":"2026-07-02T01:16:24.986196Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":"2402.17574","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-07-04T17:20:00.052495Z","title":"Agent-pro: Learning to evolve via policy-level reflection and optimization","venue":null,"work_id":"948b97fe-757f-44c8-89ef-9fd25c62be0d","year":2024},"citing_paper":{"arxiv_id":"2606.24428","last_updated":"2026-06-23T11:05:05Z","snapshot_observed_at":"2026-08-16T06:23:09.063637Z","submitted_at":"2026-06-23T11:05:05Z","title":"Escaping the Self-Confirmation Trap: An Execute-Distill-Verify Paradigm for Agentic Experience Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-25T23:49:38.932474Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2606.24428"},"observation_digest":"sha256:4c7de1cc512d4f1c66fd5f914ecac51dbf584cfdd729f5dac72cbed923b540e5","observation_id":"8bd71679-c7ed-4447-84a7-ee36f63cefc4","resolution":{"observed_at":"2026-07-04T17:20:00.053906Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-08-05T19:47:58.926605Z","title":"2402.17574 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03392","last_updated":"2026-08-04T09:43:46Z","snapshot_observed_at":"2026-08-16T17:48:28.468868Z","submitted_at":"2026-08-04T09:43:46Z","title":"Self-Evolving Coding Agents","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T19:47:58.926605Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2608.03392"},"observation_digest":"sha256:8ecfaae027d96e6c942589e445f2127f79699d39ea683bd955fda1c966ab67c8","observation_id":"61fcf741-39ad-4f0a-a781-88dcae1d4211","resolution":{"observed_at":"2026-08-05T19:47:58.926605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.17574/citation-record","integrity":"/paper/2402.17574/integrity","json":"/paper/2402.17574/citation-record.json","paper":"/paper/2402.17574"},"outbound":[],"paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-18T10:03:20.539248Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 27 inbound Pith citation observations for arXiv:2402.17574."}