{"as_of":"2026-08-04T19:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:37698906de7ee7c50d2f60b49ca8763aa54d78dc504bbfcb888ef947d3c18e9f","coverage":[{"denominator":6,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T05:35:32.207725Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":34,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T02:07:42.304450Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T12:15:01.137692Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2604.15097","last_updated":"2026-06-02T07:26:24Z","snapshot_observed_at":"2026-07-12T19:51:47.153234Z","submitted_at":"2026-04-16T14:55:49Z","title":"From Procedural Skills to Strategy Genes: Towards Experience-Driven Test-Time Evolution","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T10:52:47.760627Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2604.15097"},"observation_digest":"sha256:0cd63fe0886a36d5faa5f6c077dd6c207c27cf547ec342ec1b420b7118be47b8","observation_id":"19fef1f3-3552-44a1-b349-6ab868e31d92","resolution":{"observed_at":"2026-05-10T10:55:04.021820Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-12T19:51:48.531280Z","title":"Procmem: Learning reusable procedural memory from experience via non-parametric PPO for LLM agents.CoRR, abs/2602.01869, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2604.15097","last_updated":"2026-06-02T07:26:24Z","snapshot_observed_at":"2026-07-12T19:51:47.153234Z","submitted_at":"2026-04-16T14:55:49Z","title":"From Procedural Skills to Strategy Genes: Towards Experience-Driven Test-Time Evolution","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-12T19:51:48.531280Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2604.15097"},"observation_digest":"sha256:4e4b125d32450b7e0d96e5e9e4ee1168bdf521418ef37062f96f71bc663fdcf5","observation_id":"4258eae8-cfff-46a6-8abf-66f15ef23617","resolution":{"observed_at":"2026-07-12T19:51:48.531280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2604.20987","last_updated":"2026-04-22T18:17:17Z","snapshot_observed_at":"2026-07-06T23:07:36.996629Z","submitted_at":"2026-04-22T18:17:17Z","title":"Co-Evolving LLM Decision and Skill Bank Agents for Long-Horizon Tasks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T00:14:07.017420Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2604.20987"},"observation_digest":"sha256:a9778391c836cb90f4f6ea67a359a3e81376654f8ff1bce2590c38dd72862ac3","observation_id":"7a4fd127-8aab-40e2-85b0-50d5d8be1649","resolution":{"observed_at":"2026-05-10T00:14:46.447134Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2605.07242","last_updated":"2026-05-08T04:57:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-08T04:57:29Z","title":"MEMOREPAIR: Barrier-First Cascade Repair in Agentic Memory","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-11T01:39:26.332430Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2605.07242"},"observation_digest":"sha256:c26c85a9dd80628dc995e331a3fb4941408a4dc17da6301b32be1132478ffef2","observation_id":"48b38cff-4fca-4191-bdd4-b632234a76d1","resolution":{"observed_at":"2026-05-11T01:40:51.717079Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2605.07358","last_updated":"2026-05-26T05:21:04Z","snapshot_observed_at":"2026-07-06T23:19:46.018236Z","submitted_at":"2026-05-08T07:10:26Z","title":"A Comprehensive Survey on Agent Skills: Taxonomy, Techniques, and Applications","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-11T01:47:39.926540Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2605.07358"},"observation_digest":"sha256:0e4e0f0b03ffa5b550078b8c917d48db7bf24455de4f963c69cefe08ea6d47ee","observation_id":"7bb7ce15-62da-4507-abf7-0074f2037d77","resolution":{"observed_at":"2026-05-11T04:20:56.979632Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2605.07358","last_updated":"2026-05-26T05:21:04Z","snapshot_observed_at":"2026-07-06T23:19:46.018236Z","submitted_at":"2026-05-08T07:10:26Z","title":"A Comprehensive Survey on Agent Skills: Taxonomy, Techniques, and Applications","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-20T23:15:44.550045Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2605.07358"},"observation_digest":"sha256:2daadc21eb0c7ebaa2989f67d934b028d2a66efe9aef018f4c321815e9cffd5b","observation_id":"de8d5e83-a42e-488f-b143-4c0fc774e373","resolution":{"observed_at":"2026-05-20T23:19:14.848201Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2605.07358","last_updated":"2026-05-26T05:21:04Z","snapshot_observed_at":"2026-07-06T23:19:46.018236Z","submitted_at":"2026-05-08T07:10:26Z","title":"A Comprehensive Survey on Agent Skills: Taxonomy, Techniques, and Applications","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-30T23:23:42.883286Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2605.07358"},"observation_digest":"sha256:ad32129b191f91143a0745e043afa7644e52726dfbca261c9652ea8b8e13dc65","observation_id":"da1bfba5-e302-4e74-87a2-1b7794019553","resolution":{"observed_at":"2026-06-30T23:25:07.275896Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2605.08386","last_updated":"2026-05-08T18:48:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-08T18:48:04Z","title":"SkillLens: Adaptive Multi-Granularity Skill Reuse for Cost-Efficient LLM Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-12T01:12:52.837729Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2605.08386"},"observation_digest":"sha256:1de01d586a0ab87797b693ff1b89fa367ba09d24176734831984814a9e5ba751","observation_id":"9d0f598c-3ef0-4dbc-8918-e656370e005e","resolution":{"observed_at":"2026-05-12T08:21:25.556207Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2605.08526","last_updated":"2026-05-08T22:17:54Z","snapshot_observed_at":"2026-08-02T11:50:00.146281Z","submitted_at":"2026-05-08T22:17:54Z","title":"Skill-CMIB: Multimodal Agent Skill for Consistent Action via Conditional Multimodal Information Bottleneck","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:59.721212Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2605.08526"},"observation_digest":"sha256:2aa93c62fe8144923c163813b8bb7ec02c4a8ed17dd53b626b57e06bf921667b","observation_id":"6ed8dd37-c8ad-47a9-a70b-834b2a006c71","resolution":{"observed_at":"2026-05-12T08:01:28.230686Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2605.10923","last_updated":"2026-05-17T05:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T17:55:13Z","title":"Dynamic Skill Lifecycle Management for Agentic Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-12T03:45:06.199636Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2605.10923"},"observation_digest":"sha256:e06c57732337a3eee0ed81962cbb1ff5a97bffdb7446426cfcc05c2f7739965b","observation_id":"37c53803-2599-4fae-b568-9d9db4e94bc6","resolution":{"observed_at":"2026-05-12T07:06:33.576653Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2605.10923","last_updated":"2026-05-17T05:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T17:55:13Z","title":"Dynamic Skill Lifecycle Management for Agentic Reinforcement Learning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-20T22:19:49.016156Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2605.10923"},"observation_digest":"sha256:3e53ead1242762d29d955de2f66d48bd214b3ad6341fea69be669a9e86fb9d21","observation_id":"6d69f720-e582-485e-bf97-63ff4c98a1da","resolution":{"observed_at":"2026-05-20T22:23:48.304691Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2605.13037","last_updated":"2026-05-13T05:46:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-13T05:46:29Z","title":"MAP: A Map-then-Act Paradigm for Long-Horizon Interactive Agent Reasoning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-14T19:48:53.213389Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2605.13037"},"observation_digest":"sha256:bfce110049a071cea18ccd496afa4612cd29d1589dd057ae3acf27d40a143e51","observation_id":"64d11719-9425-486c-8327-5327cd8f025f","resolution":{"observed_at":"2026-05-14T19:49:25.815783Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2605.18401","last_updated":"2026-05-18T13:44:19Z","snapshot_observed_at":"2026-07-06T23:29:20.279470Z","submitted_at":"2026-05-18T13:44:19Z","title":"SkillsVote: Lifecycle Governance of Agent Skills from Collection, Recommendation to Evolution","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-20T11:40:45.397038Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2605.18401"},"observation_digest":"sha256:084e867027a95a68ab2e8d50d4827924b5d7063b33147badebde4467f544e029","observation_id":"b6806335-5862-4164-98fa-da08dac27af2","resolution":{"observed_at":"2026-05-20T11:43:15.029937Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2605.22208","last_updated":"2026-06-06T02:15:03Z","snapshot_observed_at":"2026-08-04T00:38:51.798028Z","submitted_at":"2026-05-21T09:14:25Z","title":"EvoIR-Agent: Self-Evolving Image Restoration Agentic System via Experience-Driven Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-22T07:49:15.291339Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2605.22208"},"observation_digest":"sha256:0a2484237f4d0b0bb6457dc46402a8d8859a94b3b4821a2ddbed57607c70e96f","observation_id":"33adaaef-4515-41ba-9c55-4e9d1c1439a6","resolution":{"observed_at":"2026-05-22T07:51:16.155833Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2605.22208","last_updated":"2026-06-06T02:15:03Z","snapshot_observed_at":"2026-08-04T00:38:51.798028Z","submitted_at":"2026-05-21T09:14:25Z","title":"EvoIR-Agent: Self-Evolving Image Restoration Agentic System via Experience-Driven Learning","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-30T17:22:36.435074Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2605.22208"},"observation_digest":"sha256:38b661c7cb7b9055d69094cbf76aac20142c2873ba141680172750a113ab53de","observation_id":"238e552a-644a-4969-bb10-d809da6210a9","resolution":{"observed_at":"2026-06-30T17:24:57.057323Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2605.23899","last_updated":"2026-05-22T17:59:12Z","snapshot_observed_at":"2026-07-06T23:34:03.934151Z","submitted_at":"2026-05-22T17:59:12Z","title":"From Raw Experience to Skill Consumption: A Systematic Study of Model-Generated Agent Skills","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-25T03:53:56.643075Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2605.23899"},"observation_digest":"sha256:cd87f7ee40338a2084423488b85e69460ff2ed680de9ceeb9dcb69f4585c971f","observation_id":"afc5280c-78d0-4387-b533-aba5625b5b10","resolution":{"observed_at":"2026-05-25T03:55:20.457433Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2605.23904","last_updated":"2026-05-25T17:58:16Z","snapshot_observed_at":"2026-07-06T23:34:03.934151Z","submitted_at":"2026-05-22T17:59:50Z","title":"SkillOpt: Executive Strategy for Self-Evolving Agent Skills","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-25T03:51:49.812710Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2605.23904"},"observation_digest":"sha256:637540116482ae3c3117f4b3815688bd8380fea51cb843ec120360c2e18009a8","observation_id":"3cfbaf3c-e1ea-4c7c-a77f-4558e7349d39","resolution":{"observed_at":"2026-05-25T03:56:36.893749Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2605.23904","last_updated":"2026-05-25T17:58:16Z","snapshot_observed_at":"2026-07-06T23:34:03.934151Z","submitted_at":"2026-05-22T17:59:50Z","title":"SkillOpt: Executive Strategy for Self-Evolving Agent Skills","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-30T16:26:23.130418Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2605.23904"},"observation_digest":"sha256:028789114821bf4657db64dd4003d1b959f66b81ee382a30fedf0d734c578962","observation_id":"51c09df6-9169-4d7b-b5f0-0343cd0febb0","resolution":{"observed_at":"2026-06-30T16:35:12.842968Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2605.30690","last_updated":"2026-05-29T00:34:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-29T00:34:40Z","title":"ElasticMem: Latent Memory as a Learnable Resource for LLM Agents","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T23:06:57.377183Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2605.30690"},"observation_digest":"sha256:ba1d85f0162db79bfbe050648d1f43a00356510c54a8d62561edcc170df1c1c7","observation_id":"20bd4c45-8216-4088-8122-e0f4cf1d07ac","resolution":{"observed_at":"2026-06-29T00:22:51.816491Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2606.01139","last_updated":"2026-06-17T05:10:07Z","snapshot_observed_at":"2026-07-06T23:41:43.820102Z","submitted_at":"2026-05-31T10:19:13Z","title":"SkillRevise: Improving LLM-Authored Agent Skills via Trace-Conditioned Skill Revision","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-28T17:37:31.081762Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2606.01139"},"observation_digest":"sha256:39994a58b4b7f34c95f8b5cce624204330a7d76212b868cfdfe6eee1ab32f5bb","observation_id":"b5c8730b-9e81-4701-b55a-045d1a32d7dd","resolution":{"observed_at":"2026-06-28T17:42:24.840642Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2606.03692","last_updated":"2026-06-02T14:14:27Z","snapshot_observed_at":"2026-07-06T23:43:55.632508Z","submitted_at":"2026-06-02T14:14:27Z","title":"SkillPyramid: A Hierarchical Skill Consolidation Framework for Self-Evolving Agents","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-28T10:15:03.274182Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2606.03692"},"observation_digest":"sha256:3999545c9b00618b99f4c97744be59c125a7d4a09ecbfbeec41c9b90ec3aa830","observation_id":"d50b2e55-fb36-4925-88bc-92a7534abfd5","resolution":{"observed_at":"2026-07-02T03:16:33.461204Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2606.11543","last_updated":"2026-06-10T01:11:50Z","snapshot_observed_at":"2026-07-06T23:50:35.052764Z","submitted_at":"2026-06-10T01:11:50Z","title":"SkillJuror: Measuring How Agent Skill Organization Changes Runtime Behavior","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T10:12:03.985549Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2606.11543"},"observation_digest":"sha256:d4ab6e0820842c45902306cdc41ed4a07aa924e2abcf24066b65092b8b955e74","observation_id":"4b598877-4146-4006-a466-6af2f89edeb5","resolution":{"observed_at":"2026-07-03T10:17:57.313157Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2606.11680","last_updated":"2026-06-10T05:49:14Z","snapshot_observed_at":"2026-08-02T11:10:24.123513Z","submitted_at":"2026-06-10T05:49:14Z","title":"Organize then Retrieve: Hierarchical Memory Navigation for Efficient Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T10:06:59.839645Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2606.11680"},"observation_digest":"sha256:3582ab5b4016238af6880f137e79954be5dca8abb0afafffc5c364276f4b3033","observation_id":"d6c60a18-c9a4-421a-a523-91721422df55","resolution":{"observed_at":"2026-07-03T10:17:57.783648Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2606.17929","last_updated":"2026-06-16T13:40:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-16T13:40:21Z","title":"PreAct: Computer-Using Agents that Get Faster on Repeated Tasks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-27T01:06:26.643487Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2606.17929"},"observation_digest":"sha256:2ad719e34efcb446a9d6130df174b8f70da2df7214ca993720ebfc9b4b302471","observation_id":"c3e04f58-2b8a-40f6-ae1f-f639b524ab25","resolution":{"observed_at":"2026-07-03T20:58:57.438121Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2606.24151","last_updated":"2026-06-23T05:17:22Z","snapshot_observed_at":"2026-08-04T04:36:24.557913Z","submitted_at":"2026-06-23T05:17:22Z","title":"Metis: Bridging Text and Code Memory for Self-Evolving Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T00:42:55.758578Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2606.24151"},"observation_digest":"sha256:5326faa813055fbe4f87d17891a1d742a6c75ca822d6d15e5ad531e8d8c10600","observation_id":"2a6cccdd-3991-4a64-903e-1dc4ee7015f3","resolution":{"observed_at":"2026-07-04T16:29:56.683203Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2606.29502","last_updated":"2026-07-17T09:23:58Z","snapshot_observed_at":"2026-08-03T00:43:32.504636Z","submitted_at":"2026-06-28T17:02:18Z","title":"UCOB: Learning to Utilize and Evolve Agentic Skills via Credit-Aware On-Policy Bidirectional Self-Distillation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-30T07:15:44.387347Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2606.29502"},"observation_digest":"sha256:99ec4b14d9916b617c53609e16ed6d7a7d80bd0cca7425edd1a0b77281f5c485","observation_id":"af1bef39-b102-45a6-9224-45e2b514305e","resolution":{"observed_at":"2026-06-30T07:24:22.348730Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-12T10:46:46.380037Z","title":"Skill-pro: Learning reusable skills from experience via non-parametric ppo for llm agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.30005","last_updated":"2026-07-31T09:32:57Z","snapshot_observed_at":"2026-08-04T19:11:08.634889Z","submitted_at":"2026-06-29T09:13:38Z","title":"LLM Agents Are Latent Context Managers: Eliciting Self-Managed Context via State Proprioception","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-12T10:46:46.380037Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2606.30005"},"observation_digest":"sha256:d7f167c37fd402cb8236c7cb96e19a86767a5e7c1e0df80e8ea011f9b267dfb4","observation_id":"0f0a5d9f-79fd-4c3e-86d4-2601cfd7ee42","resolution":{"observed_at":"2026-07-12T10:46:46.380037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-08-02T09:38:42.966270Z","title":"Skill-pro: Learning reusable skills from experience via non-parametric ppo for llm agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.30005","last_updated":"2026-07-31T09:32:57Z","snapshot_observed_at":"2026-08-04T19:11:08.634889Z","submitted_at":"2026-06-29T09:13:38Z","title":"LLM Agents Are Latent Context Managers: Eliciting Self-Managed Context via State Proprioception","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T09:38:42.966270Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2606.30005"},"observation_digest":"sha256:4b5804d7465cb1e5373152b5e146128623f6a7d8867045da310ef08e7f352715","observation_id":"eb408c66-2785-45b2-ac2d-50964b7b290c","resolution":{"observed_at":"2026-08-02T09:38:42.966270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-08-03T02:07:42.304450Z","title":"Skill-pro: Learning reusable skills from experience via non-parametric ppo for llm agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.30005","last_updated":"2026-07-31T09:32:57Z","snapshot_observed_at":"2026-08-04T19:11:08.634889Z","submitted_at":"2026-06-29T09:13:38Z","title":"LLM Agents Are Latent Context Managers: Eliciting Self-Managed Context via State Proprioception","version":5},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T02:07:42.304450Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2606.30005"},"observation_digest":"sha256:e70ebe36679564c4cc80f8665b93d404ac0b55e8424204181f7deda8c4a7d163","observation_id":"59ada0ac-c954-4da0-8c1d-783aa83c2fed","resolution":{"observed_at":"2026-08-03T02:07:42.304450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":"2602.01869","doi":"10.48550/arxiv.2602.01869","metadata_source":"pith","pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","venue":"cs.AI","work_id":"8b577494-0367-43d0-82ca-804c3a431082","year":2026},"citing_paper":{"arxiv_id":"2607.05202","last_updated":"2026-07-06T15:17:09Z","snapshot_observed_at":"2026-08-01T16:59:54.701989Z","submitted_at":"2026-07-06T15:17:09Z","title":"EvoAgentBench: Benchmarking Agent Self-Evolution via Ability Transfer","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-07T23:48:16.309103Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2607.05202"},"observation_digest":"sha256:709c1a003c5cd25f56cd66e368503be79a48b8ffd995df34c0e0267bb63ee654","observation_id":"66b0aea3-0daa-4bc5-8200-ee51091e9c3c","resolution":{"observed_at":"2026-07-07T23:54:18.645734Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-08-02T04:50:36.427905Z","title":"Procmem: Learning reusable procedural memory from experience via non-parametric ppo for llm agents.arXiv preprint arXiv:2602.01869, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13591","last_updated":"2026-07-15T08:32:40Z","snapshot_observed_at":"2026-08-02T04:50:27.651928Z","submitted_at":"2026-07-15T08:32:40Z","title":"Memory as a Controlled Process: Learned Adaptive Memory Management for LLM Agents","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-02T04:50:36.427905Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2607.13591"},"observation_digest":"sha256:6d30c41c8a5da0aeb68f45433f8427dffcb1bc8a51aaee4f5aeb649ebbe19346","observation_id":"df9cfc06-f91c-4eb0-b324-8f7ea915dd0c","resolution":{"observed_at":"2026-08-02T04:50:36.427905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-08-02T03:29:10.739890Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13884","last_updated":"2026-07-15T14:33:15Z","snapshot_observed_at":"2026-08-02T03:29:09.069499Z","submitted_at":"2026-07-15T14:33:15Z","title":"Experience Memory Graph: One-Shot Error Correction for Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T03:29:10.739890Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2607.13884"},"observation_digest":"sha256:37dcc6a80e3695ece81c056ea7fd8928ea8a541553e6a95048004b496dd369b2","observation_id":"d3f9d975-5668-41f8-88d9-e14b2bc7d137","resolution":{"observed_at":"2026-08-02T03:29:10.739890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-08-01T20:27:33.860778Z","title":"Procmem: Learning reusable procedural memory from experience via non-parametric ppo for llm agents","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16621","last_updated":"2026-07-18T03:46:22Z","snapshot_observed_at":"2026-08-02T00:21:41.822683Z","submitted_at":"2026-07-18T03:46:22Z","title":"From Memory to Skills: Evidence-Grounded Co-Evolution Governance for Long-Horizon LLM Agents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T20:27:33.860778Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2607.16621"},"observation_digest":"sha256:33166463b3a56dafd99aec2e1ae1d8ac12bc84578e945bb63c8161805dcc8f6e","observation_id":"c4bc95f6-2965-4b6a-829b-8c0d1c04ab9f","resolution":{"observed_at":"2026-08-01T20:27:33.860778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.01869","snapshot_observed_at":"2026-08-01T04:28:47.064528Z","title":"Procmem: Learning reusable procedural memory from experience via non-parametric ppo for llm agents.arXiv preprint arXiv:2602.01869,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22529","last_updated":"2026-07-24T17:59:22Z","snapshot_observed_at":"2026-08-01T04:28:42.700487Z","submitted_at":"2026-07-24T17:59:22Z","title":"Skill Self-Play: Pushing the Frontier of LLM Capability with Co-Evolving Skills","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T04:28:47.064528Z"},"links":{"cited_paper":"/paper/2602.01869","citing_paper":"/paper/2607.22529"},"observation_digest":"sha256:006cd19811cb8569e0a88bcb8a97e8fc915fa621feb864d7e82a53d7ad267f25","observation_id":"4d74f686-e46e-4e04-80d0-371b74be435c","resolution":{"observed_at":"2026-08-01T04:28:47.064528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2602.01869/citation-record","integrity":"/paper/2602.01869/integrity","json":"/paper/2602.01869/citation-record.json","paper":"/paper/2602.01869"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:35:31.392350Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T05:35:31.392350Z"},"links":{"citing_paper":"/paper/2602.01869"},"observation_digest":"sha256:9e650d9df1b40efb98a81ce37f7cdba18c395bf1aa6a3b5cc35c734e55cb93dc","observation_id":"193de6b0-389e-4fe7-99f5-6aeee1d02f7c","resolution":{"observed_at":"2026-08-03T05:35:31.392350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:35:31.506716Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T05:35:31.506716Z"},"links":{"citing_paper":"/paper/2602.01869"},"observation_digest":"sha256:d9b60add52b2ae42e368641f638bc3034110b44da6324bc310679c37fe81bccd","observation_id":"d94490ce-34cb-42aa-a303-e4657e4a0cce","resolution":{"observed_at":"2026-08-03T05:35:31.506716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:35:31.672300Z","title":"•Termination: The first valid move is submitted and initial feedback is received","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T05:35:31.672300Z"},"links":{"citing_paper":"/paper/2602.01869"},"observation_digest":"sha256:30434968298b9dc8d9a35d9de4438e27dea55063d82bedebaa0e8cdf7bdf2ebe","observation_id":"4202d4c7-abb9-4f07-9966-3bf8adc03256","resolution":{"observed_at":"2026-08-03T05:35:31.672300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:35:31.880467Z","title":"Add a check for X","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T05:35:31.880467Z"},"links":{"citing_paper":"/paper/2602.01869"},"observation_digest":"sha256:ead61fea4481034d72520f2e7755e891377c35c4e797eaf01e35ef7a525ab674","observation_id":"aa9f745b-9eb9-489c-8478-4daeece56650","resolution":{"observed_at":"2026-08-03T05:35:31.880467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:35:32.107876Z","title":"IF” condition to ensure the skill only starts in valid states. •Policy (π): Update the 3–5 reasoning steps to bypass identified failure modes. •Termination (β): Update the “Stop IF","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T05:35:32.107876Z"},"links":{"citing_paper":"/paper/2602.01869"},"observation_digest":"sha256:1b4db46eb7a7bdaa9fd71a35f59694d85991bd58fe42d34cce900b23e2c5f40e","observation_id":"e6847a32-8e09-4815-bd39-6752bce422c9","resolution":{"observed_at":"2026-08-03T05:35:32.107876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:35:32.207725Z","title":"skill_name","venue":null,"work_id":null,"year":1980},"citing_paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T05:35:32.207725Z"},"links":{"citing_paper":"/paper/2602.01869"},"observation_digest":"sha256:fb7bb47bc2345f067504b38b661dca821dd9bb7fe679ee8fb854dc8f82a12253","observation_id":"27037b2a-8fe7-4864-90df-8af1f6b440c0","resolution":{"observed_at":"2026-08-03T05:35:32.207725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.01869","last_updated":"2026-05-28T12:51:20Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-03T05:35:29.225447Z","submitted_at":"2026-02-02T09:43:12Z","title":"Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents"},"reference_resolution":{"displayed":6,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":6},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 6 of 6 outbound references and 34 inbound Pith citation observations for arXiv:2602.01869."}