{"as_of":"2026-08-07T03:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4f50b11efe358bf2ae44798b9349ab80f1051401345fad57b1f516dde86722ca","coverage":[{"denominator":96,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":96,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T18:37:00.015083Z","state":"measured"},{"denominator":97,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":97,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T07:15:44.387347Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-06-30T07:24:21.952673Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"cited_work":{"arxiv_id":"2606.08755","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.08755","snapshot_observed_at":"2026-06-30T07:24:21.952673Z","title":"Co-Evolving Skill Generation and Policy Optimization","venue":"cs.CL","work_id":"619f108c-30e3-419a-9027-1e30112cc546","year":2026},"citing_paper":{"arxiv_id":"2606.29502","last_updated":"2026-07-17T09:23:58Z","snapshot_observed_at":"2026-08-03T00:43:32.504636Z","submitted_at":"2026-06-28T17:02:18Z","title":"UCOB: Learning to Utilize and Evolve Agentic Skills via Credit-Aware On-Policy Bidirectional Self-Distillation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-06-30T07:15:44.387347Z"},"links":{"cited_paper":"/paper/2606.08755","citing_paper":"/paper/2606.29502"},"observation_digest":"sha256:e568bcc914d503b6ca86f6d14d21fbf8d1f44eca874a9c7294ecc07f49f91353","observation_id":"22bfe044-6bb1-4c4c-9bbd-3c7adba51a78","resolution":{"observed_at":"2026-06-30T07:24:21.953954Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2606.08755/citation-record","integrity":"/paper/2606.08755/integrity","json":"/paper/2606.08755/citation-record.json","paper":"/paper/2606.08755"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.08224","last_updated":"2026-04-09T13:19:41Z","snapshot_observed_at":"2026-08-02T22:56:00.067549Z","submitted_at":"2026-04-09T13:19:41Z","title":"Externalization in LLM Agents: A Unified Review of Memory, Skills, Protocols and Harness Engineering","version":1},"cited_work":{"arxiv_id":"2604.08224","doi":"10.48550/arxiv.2604.08224","metadata_source":"pith","pith_arxiv_id":"2604.08224","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Externalization in LLM Agents: A Unified Review of Memory, Skills, Protocols and Harness Engineering","venue":"cs.SE","work_id":"766ea250-68f3-4ef9-b7fa-b92fd9eba501","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2604.08224","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:bfec086f43e30aed146a48c6ea314da487a6040383032a6829f23f1711f6147b","observation_id":"87283b5b-078c-4e8d-be7b-1daf5bfc13ce","resolution":{"observed_at":"2026-07-02T22:57:25.897250Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.18743","doi":"10.48550/arxiv.2603.18743","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Memento-skills: Let agents design agents","venue":"arXiv (Cornell University)","work_id":"53800d8e-8b59-418c-b6cb-3cd56186c42e","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:87d39abf8b12f559e6051209ad20211b3ce789450a16ce41acb033d5fa33bd68","observation_id":"638b214c-087f-4744-b9ce-c933abdeb97f","resolution":{"observed_at":"2026-07-02T22:47:26.451969Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.01885","last_updated":"2026-07-23T06:23:36Z","snapshot_observed_at":"2026-08-03T14:57:06.604444Z","submitted_at":"2026-01-05T08:24:16Z","title":"Agentic Memory: Learning Unified Long-Term and Short-Term Memory Management for Large Language Model Agents","version":3},"cited_work":{"arxiv_id":"2601.01885","doi":"10.48550/arxiv.2601.01885","metadata_source":"pith","pith_arxiv_id":"2601.01885","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Agentic Memory: Learning Unified Long-Term and Short-Term Memory Management for Large Language Model Agents","venue":"cs.CL","work_id":"4519e90e-26c9-43ef-a89b-c8e8a8378280","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2601.01885","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:a8f9c9e26bded912a88293d40dc0c4b707904a5d95fbe4d74a0948f09942c865","observation_id":"a7182a07-895d-418b-8882-1874d3f53b4c","resolution":{"observed_at":"2026-07-02T22:57:25.841643Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.21725","last_updated":"2026-04-23T14:29:25Z","snapshot_observed_at":"2026-07-06T23:08:14.631453Z","submitted_at":"2026-04-23T14:29:25Z","title":"AEL: Agent Evolving Learning for Open-Ended Environments","version":1},"cited_work":{"arxiv_id":"2604.21725","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.21725","snapshot_observed_at":"2026-07-02T22:57:25.882212Z","title":"AEL: Agent Evolving Learning for Open-Ended Environments","venue":"cs.CL","work_id":"840da641-8a4f-453d-9a7b-1c7d93a8e413","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2604.21725","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:6c348989e603600f076ef756fc378c81747ef494ceb6efa9e646a8e05c4c518a","observation_id":"0d0cbeb4-d1ea-4e5f-869e-d0ab8c28e771","resolution":{"observed_at":"2026-07-02T22:57:25.884218Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.12560","doi":"10.48550/arxiv.2601.12560","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Arunkumar, G","venue":"arXiv (Cornell University)","work_id":"01d3e26d-27ff-4996-bc70-b3a3b3db6e1c","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:e5b6910a0254208181f0cdadf3cba81dd687fd8ff390031322fffc8af72868c2","observation_id":"76d76fec-c167-4b3f-9fb7-5296f2031039","resolution":{"observed_at":"2026-07-02T22:47:26.424854Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02547","last_updated":"2026-04-17T18:09:08Z","snapshot_observed_at":"2026-08-03T09:07:42.489237Z","submitted_at":"2025-09-02T17:46:26Z","title":"The Landscape of Agentic Reinforcement Learning for LLMs: A Survey","version":5},"cited_work":{"arxiv_id":"2509.02547","doi":"10.48550/arxiv.2509.02547","metadata_source":"pith","pith_arxiv_id":"2509.02547","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"The Landscape of Agentic Reinforcement Learning for LLMs: A Survey","venue":"cs.AI","work_id":"87909127-da20-4ccc-8ae3-4a4a20ef81b7","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2509.02547","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:b6bf86f884a993516432e7d0d8fe6f73a1242fd2232af4b85f6a7f45ba2f225c","observation_id":"f5b1c40d-9b05-4f54-b95d-ebeb54d0a35e","resolution":{"observed_at":"2026-07-02T22:47:26.427426Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:37:00.015083Z","title":"Agentic large language models, a survey.Journal of Artificial Intelligence Research, 84, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:19a3d39c6e2d69a3065138dda0773a406a042465516a2a311bd0ff6bf3051b30","observation_id":"0497ade2-9dfe-4459-8852-8bb12cc15391","resolution":{"observed_at":"2026-06-27T18:37:00.015083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.12538","last_updated":"2026-01-18T18:58:23Z","snapshot_observed_at":"2026-08-04T22:42:23.171653Z","submitted_at":"2026-01-18T18:58:23Z","title":"Agentic Reasoning for Large Language Models","version":1},"cited_work":{"arxiv_id":"2601.12538","doi":"10.48550/arxiv.2601.12538","metadata_source":"pith","pith_arxiv_id":"2601.12538","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agentic Reasoning for Large Language Models","venue":"cs.AI","work_id":"062546cd-e1a7-46e4-b617-c6b8e19b6fa3","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2601.12538","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:2bb25e2fd6c253333ede69dad83d85d5b703b846793a3b953697a2792fab6aa5","observation_id":"8be65db4-28ea-48bf-982b-fca614b9bafc","resolution":{"observed_at":"2026-07-02T22:47:26.432494Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-01T10:08:10.217033+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T10:08:10.217033+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.13517","last_updated":"2026-07-06T04:28:14Z","snapshot_observed_at":"2026-08-02T23:35:20.935757Z","submitted_at":"2026-02-13T23:07:37Z","title":"Think Deep, Not Just Long: Measuring LLM Reasoning Effort via Deep-Thinking Tokens","version":2},"cited_work":{"arxiv_id":"2602.13517","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.13517","snapshot_observed_at":"2026-07-07T03:18:12.196403Z","title":"arXiv preprint arXiv:2602.13517 , year=","venue":null,"work_id":"3ee1934b-7153-4a9d-ac2b-94584044e271","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2602.13517","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:ff526e3138e2be3e5e8898133c7f12481679f91fdee5cf884272f23092a1e1db","observation_id":"d1a10e44-d33a-427c-8c03-0bbaf2d76db8","resolution":{"observed_at":"2026-07-07T03:18:12.196403Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.15371","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T16:58:43.708557Z","title":"Brain-inspired graph multi- agent systems for llm reasoning,","venue":null,"work_id":"459abbce-78d9-4824-b420-94d7cd30203f","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:497411714dd1c568ad97b1d2f1405c79fea9662fb40a35c9ee819be117503ce0","observation_id":"b1c34d4c-78c4-43c6-878a-8fce6eec9efa","resolution":{"observed_at":"2026-07-02T22:47:26.421959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.06676","last_updated":"2026-06-20T08:29:36Z","snapshot_observed_at":"2026-08-03T11:24:44.839715Z","submitted_at":"2026-01-10T20:29:12Z","title":"One Interaction Is Worth a Thousand Guesses: Benchmarking the Interactive Capabilities of Deep Research Agents","version":2},"cited_work":{"arxiv_id":"2601.06676","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.06676","snapshot_observed_at":"2026-07-02T22:47:26.433710Z","title":"One Interaction Is Worth a Thousand Guesses: Benchmarking the Interactive Capabilities of Deep Research Agents","venue":"cs.CL","work_id":"8de81437-31f5-481a-82ee-fe5fab3488b1","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2601.06676","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:bec3ba637c88130237b5fdb93ae4493244568de654c58302f6ea992e0749ab6b","observation_id":"90411c73-9e43-4b14-b4dd-32e7726d1c9a","resolution":{"observed_at":"2026-07-02T22:47:26.435251Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.18998","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T22:57:25.891182Z","title":"arXiv:2602.18998 (2026)","venue":null,"work_id":"d43ea20c-d84e-4930-80ef-8683a1badbe0","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:9404f02255ac09350fa01b20a2831f8d42cc1d39aec62a47609147a873c5f9cf","observation_id":"89b83765-680a-46f7-99a9-d882e543677b","resolution":{"observed_at":"2026-07-02T22:57:25.892666Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:37:00.015083Z","title":"Agentic reasoning: A streamlined framework for enhancing llm reasoning with agentic tools","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:784742e592a2dd4f70b26244bb2f6aa858acb7dfd414ee710c3e254cd62dffcb","observation_id":"68da68c9-854a-459a-ba3e-270e619acb1b","resolution":{"observed_at":"2026-06-27T18:37:00.015083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.17692","last_updated":"2025-08-25T06:01:16Z","snapshot_observed_at":"2026-08-05T16:42:45.846627Z","submitted_at":"2025-08-25T06:01:16Z","title":"LLM-based Agentic Reasoning Frameworks: A Survey from Methods to Scenarios","version":1},"cited_work":{"arxiv_id":"2508.17692","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.17692","snapshot_observed_at":"2026-07-02T22:57:25.897612Z","title":"LLM-based agentic rea- soning frameworks: A survey from methods to scenarios","venue":null,"work_id":"72e6ad05-70c7-43be-a64c-81e3d8c8b9dd","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2508.17692","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:25967b4486893de43160b8b73d84d8a3b01f2ce9844911eba670aaeea8494bc0","observation_id":"16ee237f-0240-42ad-9f34-91489e651eb3","resolution":{"observed_at":"2026-07-02T22:57:25.899087Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12430","last_updated":"2026-06-02T16:14:54Z","snapshot_observed_at":"2026-08-06T11:11:16.632352Z","submitted_at":"2026-02-12T21:33:25Z","title":"Agent Skills for Large Language Models: Architecture, Acquisition, Security, and the Path Forward","version":4},"cited_work":{"arxiv_id":"2602.12430","doi":"10.48550/arxiv.2602.12430","metadata_source":"pith","pith_arxiv_id":"2602.12430","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agent Skills for Large Language Models: Architecture, Acquisition, Security, and the Path Forward","venue":"cs.MA","work_id":"a64d3985-6826-492c-8a2e-f0965d805bfd","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2602.12430","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:d74803b7728b102fcfc9bbc8f0e73a17c0573fdf487f145c31ef9f65c97c221a","observation_id":"57afa478-200c-4c24-a405-40d2ad93c06e","resolution":{"observed_at":"2026-07-02T22:57:25.876462Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.20867","last_updated":"2026-02-24T13:11:38Z","snapshot_observed_at":"2026-07-29T17:42:23.433838Z","submitted_at":"2026-02-24T13:11:38Z","title":"SoK: Agentic Skills -- Beyond Tool Use in LLM Agents","version":1},"cited_work":{"arxiv_id":"2602.20867","doi":"10.48550/arxiv.2602.20867","metadata_source":"pith","pith_arxiv_id":"2602.20867","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SoK: Agentic Skills -- Beyond Tool Use in LLM Agents","venue":"cs.CR","work_id":"db16e56a-bf5c-4b9b-ab0e-2c76449f4dcb","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2602.20867","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:82e57d43b16dfab9c31de1ed5f4e052ebedc0ceb1b995dd4bda1eb652fa7f719","observation_id":"85cba283-49fb-438a-a9d3-bc994d2c039e","resolution":{"observed_at":"2026-07-02T22:57:25.836483Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.04804","last_updated":"2026-04-19T16:14:01Z","snapshot_observed_at":"2026-07-06T22:53:41.734429Z","submitted_at":"2026-04-06T16:09:33Z","title":"SkillX: Automatically Constructing Skill Knowledge Bases for Agents","version":2},"cited_work":{"arxiv_id":"2604.04804","doi":"10.48550/arxiv.2604.04804","metadata_source":"pith","pith_arxiv_id":"2604.04804","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"SkillX: Automatically Constructing Skill Knowledge Bases for Agents","venue":"cs.CL","work_id":"d639485a-3100-47ce-a377-7b661443784e","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2604.04804","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:dcbd40bf9bb8def7967f2d543224bc239488b24e321a7b2b208bbbcd2faa642a","observation_id":"14eee291-7dab-4fbf-9a2e-cdfdb0209697","resolution":{"observed_at":"2026-07-02T22:57:25.853843Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.08234","last_updated":"2026-02-09T03:17:17Z","snapshot_observed_at":"2026-07-06T22:45:05.823859Z","submitted_at":"2026-02-09T03:17:17Z","title":"SkillRL: Evolving Agents via Recursive Skill-Augmented Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2602.08234","doi":"10.48550/arxiv.2602.08234","metadata_source":"pith","pith_arxiv_id":"2602.08234","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SkillRL: Evolving Agents via Recursive Skill-Augmented Reinforcement Learning","venue":"cs.LG","work_id":"536a9d0a-baed-4eb9-9a51-f2b585c3388b","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2602.08234","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:e90e4e25cf75f6d9491df2d621a38151f4fc0e4b04ce267d45c36d546587a8c1","observation_id":"e647e662-9de1-42a9-9dfe-d168bdaa51d2","resolution":{"observed_at":"2026-07-02T22:57:25.850746Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.12740","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T22:57:25.838888Z","title":"Tooltree: Efficient llm agent tool planning via dual-feedback monte carlo tree search and bidirectional pruning","venue":null,"work_id":"dc73ad59-3fcd-4926-9731-2081a4f47b30","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:6d099066a94a4910012e3ff893001d79e2c7ed9e1183402d7edfda298726403d","observation_id":"05dcb7c0-96c8-4bcb-888d-f4afca18a68c","resolution":{"observed_at":"2026-07-02T22:57:25.840525Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.00835","last_updated":"2026-06-29T05:50:41Z","snapshot_observed_at":"2026-07-13T14:49:11.842114Z","submitted_at":"2026-04-01T12:46:51Z","title":"Agentic Tool Use in Large Language Models","version":2},"cited_work":{"arxiv_id":"2604.00835","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.00835","snapshot_observed_at":"2026-07-03T17:48:46.034208Z","title":"Agentic Tool Use in Large Language Models","venue":"cs.CL","work_id":"821023e0-5ed3-4616-bac2-0b528724afc3","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2604.00835","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:a21332a4e742f1b1d2db2f8af7f9a433e6afae329ca4575b04e1100678a4b112","observation_id":"b5c9c2ff-84b8-48a9-bb4f-ba78743248be","resolution":{"observed_at":"2026-07-02T22:57:25.824054Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.07359","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T19:50:11.234780Z","title":"arXiv preprint , year =","venue":null,"work_id":"8b22b672-2208-4f47-be5e-d8fc44495d06","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:60b831816b4c1726c325f7accd7a6e7246ae5a32c9893ed2010456cced42c94d","observation_id":"ed9f1dee-1e6e-4a63-8d81-9c960b78a778","resolution":{"observed_at":"2026-07-02T22:57:25.890044Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:37:00.015083Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:46c6a12f9de118800ccbf0cc3f4723d4dfb55c96e19ea91390aec2026ff04053","observation_id":"54e3a7a8-b2d5-46fa-b0f2-dff021b7812b","resolution":{"observed_at":"2026-06-27T18:37:00.015083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.23880","doi":"10.48550/arxiv.2512.23880","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CAS- CADE: Cumulative agentic skill creation through autonomous development and evolution","venue":"Open MIND","work_id":"bcad44f5-06ea-4b5b-8b14-4c943d2cf1ca","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:e15366705425477e28ef528479b99eabc4e6f9025c59698f4355b68aff886180","observation_id":"dc31ce23-ccac-4721-b49b-127489c56fe4","resolution":{"observed_at":"2026-07-02T22:57:25.834911Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07079","last_updated":"2025-04-09T17:51:50Z","snapshot_observed_at":"2026-07-06T21:06:50.056353Z","submitted_at":"2025-04-09T17:51:50Z","title":"SkillWeaver: Web Agents can Self-Improve by Discovering and Honing Skills","version":1},"cited_work":{"arxiv_id":"2504.07079","doi":"10.48550/arxiv.2504.07079","metadata_source":"pith","pith_arxiv_id":"2504.07079","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SkillWeaver: Web Agents can Self-Improve by Discovering and Honing Skills","venue":"cs.AI","work_id":"72b1aff0-91c3-4500-abc9-22129ca67748","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2504.07079","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:2dd310c62b7f22a8ee4ec36f5133c9f2c30f0fc139e3aafcef20f7070d0ae012","observation_id":"325bec0c-3a15-4f56-91aa-7b14ab9159da","resolution":{"observed_at":"2026-07-02T22:57:25.851525Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-07-06T21:36:45.605379Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"cited_work":{"arxiv_id":"2506.04287","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04287","snapshot_observed_at":"2026-07-04T13:39:50.584868Z","title":"Automated skill discovery for language agents through exploration and iterative feedback","venue":null,"work_id":"7ad69216-d142-4976-a0dd-7b2c057eb593","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2506.04287","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:c5716123a4edd0ac199e80eaa0a994ae7fe4bbb521138f11b80901ebd9fd01bb","observation_id":"f519e037-47cb-4232-93ec-7bcf3a0b64f0","resolution":{"observed_at":"2026-07-02T22:57:25.856666Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:37:00.015083Z","title":"Proposer-agent-evaluator (pae): Autonomous skill discovery for foundation model internet agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:265e340228e1545ab2c1c89a11b8cdb2151e05c849b7cdab08418d9f8376e287","observation_id":"37f93bd7-0806-4ebd-b779-d35f1b75ac20","resolution":{"observed_at":"2026-06-27T18:37:00.015083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.06433","last_updated":"2026-04-15T17:21:59Z","snapshot_observed_at":"2026-07-06T22:10:07.250122Z","submitted_at":"2025-08-08T16:20:56Z","title":"Memp: Exploring Agent Procedural Memory","version":4},"cited_work":{"arxiv_id":"2508.06433","doi":"10.48550/arxiv.2508.06433","metadata_source":"pith","pith_arxiv_id":"2508.06433","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Memp: Exploring Agent Procedural Memory","venue":"cs.CL","work_id":"7a9faca4-10b1-472d-8fc5-89b683d01851","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2508.06433","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:8ec19adf380812d62b357fdf01df499bed0b7a37063acb94f296d54d0d3340ef","observation_id":"eeeba68a-3cfd-4114-aa41-032163ffaf83","resolution":{"observed_at":"2026-07-02T22:47:26.438012Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.10696","last_updated":"2026-04-15T07:24:43Z","snapshot_observed_at":"2026-07-06T22:38:45.907386Z","submitted_at":"2025-12-11T14:40:01Z","title":"Remember Me, Refine Me: A Dynamic Procedural Memory Framework for Experience-Driven Agent Evolution","version":2},"cited_work":{"arxiv_id":"2512.10696","doi":"10.48550/arxiv.2512.10696","metadata_source":"pith","pith_arxiv_id":"2512.10696","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Remember Me, Refine Me: A Dynamic Procedural Memory Framework for Experience-Driven Agent Evolution","venue":"cs.AI","work_id":"e1808e0d-921b-46dd-b221-96110080aa71","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2512.10696","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:42c5a310cb17a67edabf99f08621dec11d91c75e7c1a538e1f9ea8f885505f6f","observation_id":"0d90c69c-de88-4c3e-b763-96f3c8733781","resolution":{"observed_at":"2026-07-02T22:57:25.817912Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.21557","doi":"10.48550/arxiv.2601.21557","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Meta Context Engineer- ing via Agentic Skill Evolution, February 2026.https://arxiv.org/abs/2601.21557","venue":"Open MIND","work_id":"7dac2c20-2585-4430-b2e0-ba9488cfafa5","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:f4adb5ae9f1b1126712072619c424d28080014c3ad46eefd41657281c7457468","observation_id":"2ca10401-ff03-4fdf-9869-f16180eb46d0","resolution":{"observed_at":"2026-07-02T22:57:25.906423Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.02268","last_updated":"2026-05-15T09:15:24Z","snapshot_observed_at":"2026-07-06T22:51:44.663367Z","submitted_at":"2026-04-02T17:03:05Z","title":"SKILL0: In-Context Agentic Reinforcement Learning for Skill Internalization","version":2},"cited_work":{"arxiv_id":"2604.02268","doi":"10.48550/arxiv.2604.02268","metadata_source":"pith","pith_arxiv_id":"2604.02268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SKILL0: In-Context Agentic Reinforcement Learning for Skill Internalization","venue":"cs.LG","work_id":"e473fd3a-07f1-4cc2-b982-8e0582795882","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2604.02268","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:70df4b31e7556cde7a96cca4c8ef2ed0da3f230016baa2180621a8b8a8dfc37e","observation_id":"744d9e5e-7c9f-4e9e-9484-f09d527eebc6","resolution":{"observed_at":"2026-07-02T22:57:25.880988Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.28716","last_updated":"2026-05-25T12:19:13Z","snapshot_observed_at":"2026-08-07T00:16:37.054765Z","submitted_at":"2026-03-30T17:32:11Z","title":"Dynamic Dual-Granularity Skill Bank for Agentic RL","version":2},"cited_work":{"arxiv_id":"2603.28716","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.28716","snapshot_observed_at":"2026-07-03T18:18:49.838141Z","title":"arXiv preprint arXiv:2603.28716 , year =","venue":"cs.AI","work_id":"6ce82f8a-a849-4330-a0b8-f4c29225e5ce","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2603.28716","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:1c8bddd8534b40da177c924fc5ec332a95ef1037fae8dce4850d1a29eba9e2fb","observation_id":"7deaae6e-99eb-4aad-b5ef-4e2392a88cf6","resolution":{"observed_at":"2026-07-02T22:57:25.894872Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":"2305.16291","doi":"10.18653/v1/2023.emnlp-main.118","metadata_source":"pith","pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","venue":"cs.AI","work_id":"ffe0d207-86cf-4742-a100-e988ac8b9676","year":2023},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:af70d529a1557ed047d1299cde405b7cbbbc711623373ad04e00ce2de43fe461","observation_id":"8a421fcc-bf46-49f7-ae95-a1b50906259f","resolution":{"observed_at":"2026-07-02T22:57:25.826927Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:37:00.015083Z","title":"Skillact: Using skill abstractions improves llm agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:d9065dd31d385cd88fcced7e11cccf32fcad37fcb564b4206df2fd61abfb9ea8","observation_id":"b719c3d5-d8ab-40ae-ac4a-d5cda4723c48","resolution":{"observed_at":"2026-06-27T18:37:00.015083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.06821","last_updated":"2025-08-29T15:46:04Z","snapshot_observed_at":"2026-08-02T17:51:58.590668Z","submitted_at":"2025-04-09T12:25:37Z","title":"Inducing Programmatic Skills for Agentic Tasks","version":2},"cited_work":{"arxiv_id":"2504.06821","doi":"10.48550/arxiv.2504.06821","metadata_source":"pith","pith_arxiv_id":"2504.06821","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Inducing programmatic skills for agentic tasks","venue":"cs.CL","work_id":"e4333b5a-8a41-4819-b273-abda1e8e22a4","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2504.06821","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:d727fe69e8b550456fafe95bd5490b42592823ee58ed00e0c1e12b46ec3935ba","observation_id":"6c42ef35-cb9c-409d-9caa-89719d3b8d7e","resolution":{"observed_at":"2026-07-02T22:47:26.441022Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:37:00.015083Z","title":"Agent skills from the perspective of procedural memory: A survey.Authorea Preprints, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:b1b80c8c0cb36d10c56324bc653e695dded64c53d80725485645d696461e80f2","observation_id":"1ba98e6f-a887-4a81-933d-b8eee3dc8955","resolution":{"observed_at":"2026-06-27T18:37:00.015083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.15877","last_updated":"2026-06-25T10:23:51Z","snapshot_observed_at":"2026-08-05T07:19:45.659136Z","submitted_at":"2026-04-17T09:26:25Z","title":"Experience Compression Spectrum: Unifying Memory, Skills, and Rules in LLM Agents","version":2},"cited_work":{"arxiv_id":"2604.15877","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.15877","snapshot_observed_at":"2026-07-03T05:27:39.671982Z","title":"Experience Compression Spectrum: Unifying Memory, Skills, and Rules in LLM Agents","venue":"cs.AI","work_id":"cbebdce0-6654-458f-af33-dedd1c440040","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2604.15877","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:6e16e779e0607d7b51a8badd25bcabcdc3affb95ca438d38309bcbdc8c084a4b","observation_id":"e68be63c-88a4-4e21-b367-9d7217c0f6b9","resolution":{"observed_at":"2026-07-02T22:57:25.839040Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.11808","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T05:27:39.672510Z","title":"Automating skill acquisition through large-scale mining of open-source agentic repositories: A framework for multi-agent procedural knowledge extraction","venue":null,"work_id":"5a53321b-98f5-45bc-aebc-60e6bb82d68a","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:6c2b5e6209bd1851c0c9e943e623a2c39c9ec199012928ef085ae062834517bb","observation_id":"d062d8a4-04bc-4c49-85a0-2825b2cb9cad","resolution":{"observed_at":"2026-07-02T22:57:25.873879Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.03964","last_updated":"2026-04-05T05:02:18Z","snapshot_observed_at":"2026-07-06T22:53:01.835843Z","submitted_at":"2026-04-05T05:02:18Z","title":"SKILLFOUNDRY: Building Self-Evolving Agent Skill Libraries from Heterogeneous Scientific Resources","version":1},"cited_work":{"arxiv_id":"2604.03964","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.03964","snapshot_observed_at":"2026-07-03T14:18:22.412156Z","title":"SKILLFOUNDRY: Building Self-Evolving Agent Skill Libraries from Heterogeneous Scientific Resources","venue":"cs.AI","work_id":"d8e5425e-1676-4900-9e8a-90c450157557","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2604.03964","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:f34ce9b8f90769fb5855d3b4a5bb0e8e9f227fa860043d6b7139fbcee8a64db6","observation_id":"dcf9c615-0ad7-4c20-8730-d3d04af93226","resolution":{"observed_at":"2026-07-02T22:57:25.903852Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.01145","doi":"10.48550/arxiv.2603.01145","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Autoskill: Experience-driven lifelong learning via skill self-evolution","venue":"Open MIND","work_id":"f5786621-deeb-44fb-9f12-c1d70df052ea","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:5ed0867d859529a9dc7ea3834a3a35373fa783734d4f98e6fa0e4947f99ccf61","observation_id":"3cc258b4-1d36-4cfc-a613-e57d83e97bb6","resolution":{"observed_at":"2026-07-02T22:57:25.859355Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.25158","last_updated":"2026-06-04T12:51:52Z","snapshot_observed_at":"2026-08-06T10:33:38.415457Z","submitted_at":"2026-03-26T08:26:38Z","title":"Trace2Skill: Distill Trajectory-Local Lessons into Transferable Agent Skills","version":5},"cited_work":{"arxiv_id":"2603.25158","doi":"10.48550/arxiv.2603.25158","metadata_source":"pith","pith_arxiv_id":"2603.25158","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Trace2Skill: Distill Trajectory-Local Lessons into Transferable Agent Skills","venue":"cs.AI","work_id":"c6f8f524-e13a-48b6-99b8-7dd3357d9665","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2603.25158","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:49c264d751d5d0101afe48961c18106e5adaf5c1b13ab65d1d66c1ff24482736","observation_id":"dc25d14d-789c-43ba-8341-3bc55a6f7c60","resolution":{"observed_at":"2026-07-02T22:57:25.894014Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:50:58.511509+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:50:58.511509+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.17102","last_updated":"2026-03-10T05:40:56Z","snapshot_observed_at":"2026-08-02T15:17:10.009854Z","submitted_at":"2025-12-18T21:58:19Z","title":"Reinforcement Learning for Self-Improving Agent with Skill Library","version":2},"cited_work":{"arxiv_id":"2512.17102","doi":"10.48550/arxiv.2512.17102","metadata_source":"pith","pith_arxiv_id":"2512.17102","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reinforcement Learning for Self-Improving Agent with Skill Library","venue":"cs.AI","work_id":"48e4c885-a8df-43e2-8b95-4a17ec085323","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2512.17102","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:bc8bd86d4b6b57cc10cbe9b77a32386437362ec222d1be3f04748c6cfbf7bc29","observation_id":"7984dccf-c9dd-4962-8f93-a7bf6651068e","resolution":{"observed_at":"2026-07-02T22:47:26.443531Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.16060","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T02:59:25.150542Z","title":"Arise: Agent reasoning with intrinsic skill evolution in hierarchical reinforcement learning","venue":null,"work_id":"52383da6-019e-47d5-8f82-f096957956f3","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:f5c4162cbc7dacd4b143bad40ff2270cef6aba14faa434b2104b3aa27ab067f5","observation_id":"3a2fc74d-8077-4fb6-8813-a65f968861c7","resolution":{"observed_at":"2026-07-02T22:57:25.862516Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.01687","last_updated":"2026-04-12T23:04:42Z","snapshot_observed_at":"2026-07-06T22:51:35.522923Z","submitted_at":"2026-04-02T06:43:20Z","title":"CoEvoSkills: Self-Evolving Agent Skills via Co-Evolutionary Verification","version":2},"cited_work":{"arxiv_id":"2604.01687","doi":"10.48550/arxiv.2604.01687","metadata_source":"pith","pith_arxiv_id":"2604.01687","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"CoEvoSkills: Self-Evolving Agent Skills via Co-Evolutionary Verification","venue":"cs.AI","work_id":"509f2c7c-7ee4-4b35-aa68-a3db839ad987","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2604.01687","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:c1f80348ca544bafa4401051cf21521e4ca6b240894c501297a74f6bfc1a1454","observation_id":"1f58cbe1-ae32-40d0-8ecf-ab1507d6ccd1","resolution":{"observed_at":"2026-07-02T22:57:25.901517Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.08377","last_updated":"2026-04-09T15:38:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-09T15:38:27Z","title":"SkillClaw: Let Skills Evolve Collectively with Agentic Evolver","version":1},"cited_work":{"arxiv_id":"2604.08377","doi":"10.48550/arxiv.2604.08377","metadata_source":"pith","pith_arxiv_id":"2604.08377","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"SkillClaw: Let Skills Evolve Collectively with Agentic Evolver","venue":"cs.AI","work_id":"31a44ebb-9aae-4719-8d62-50f8c82ece16","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2604.08377","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:f80d677616bc470294047aad12a06cac44f35a918ca9e03a85041eefe4e58cd4","observation_id":"63b4c900-7527-4b2f-8f13-65129af8004e","resolution":{"observed_at":"2026-07-02T22:57:25.830923Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12670","last_updated":"2026-03-13T07:33:01Z","snapshot_observed_at":"2026-07-06T22:45:44.135338Z","submitted_at":"2026-02-13T07:06:06Z","title":"SkillsBench: Benchmarking How Well Agent Skills Work Across Diverse Tasks","version":3},"cited_work":{"arxiv_id":"2602.12670","doi":"10.48550/arxiv.2602.12670","metadata_source":"pith","pith_arxiv_id":"2602.12670","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SkillsBench: Benchmarking How Well Agent Skills Work Across Diverse Tasks","venue":"cs.AI","work_id":"b477d12a-2ca6-4894-9f90-3fb479635e98","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2602.12670","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:27f9304c6c0aaed82804958f8890d8fd6c7fd680e407f674ad0e62aa0a762056","observation_id":"600aaf1c-be28-41ff-8ac2-792c42c3f4b2","resolution":{"observed_at":"2026-07-02T22:57:25.878550Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.20087","last_updated":"2026-04-22T01:07:37Z","snapshot_observed_at":"2026-07-06T23:06:35.507008Z","submitted_at":"2026-04-22T01:07:37Z","title":"SkillLearnBench: Benchmarking Continual Learning Methods for Agent Skill Generation on Real-World Tasks","version":1},"cited_work":{"arxiv_id":"2604.20087","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.20087","snapshot_observed_at":"2026-07-09T09:06:06.149512Z","title":"SkillLearnBench: Benchmarking Continual Learning Methods for Agent Skill Generation on Real-World Tasks","venue":"cs.CL","work_id":"bbd534c8-6aa4-49d2-b016-fd34cdb62c2e","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2604.20087","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:38ecda0ac626fbbfdae5c9bcee223ea36c9c2b4cabec79b39861383d3d0cc4d4","observation_id":"004a7c61-0a79-441a-9ffb-62bc2fd2846c","resolution":{"observed_at":"2026-07-02T22:47:26.440552Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.04323","last_updated":"2026-04-06T00:10:30Z","snapshot_observed_at":"2026-07-06T22:53:20.122451Z","submitted_at":"2026-04-06T00:10:30Z","title":"How Well Do Agentic Skills Work in the Wild: Benchmarking LLM Skill Usage in Realistic Settings","version":1},"cited_work":{"arxiv_id":"2604.04323","doi":"10.48550/arxiv.2604.04323","metadata_source":"pith","pith_arxiv_id":"2604.04323","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"How Well Do Agentic Skills Work in the Wild: Benchmarking LLM Skill Usage in Realistic Settings","venue":"cs.CL","work_id":"1298ec8c-0f55-41e8-b684-19c3f512378d","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2604.04323","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:726436d6be2ccc8482fac5f22494ec5807890f431cabfb031eb12250f24555eb","observation_id":"48386583-dbbb-4203-814d-6928691314a9","resolution":{"observed_at":"2026-07-02T22:57:25.849136Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.28815","doi":"10.48550/arxiv.2603.28815","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Skilltester: Benchmarking utility and security of agent skills","venue":"arXiv (Cornell University)","work_id":"1fa8d00f-0428-4328-8243-fff8888e7d98","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:46f4bf02f40235df97ede7c200e8e0a26ce14dd6a5a934fcb6b2420a7c7a5791","observation_id":"a1255679-a3c9-425d-99e2-91210c1e4572","resolution":{"observed_at":"2026-07-02T22:47:26.457806Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.17308","last_updated":"2026-04-19T07:51:46Z","snapshot_observed_at":"2026-07-06T23:04:28.260463Z","submitted_at":"2026-04-19T07:51:46Z","title":"SkillFlow:Benchmarking Lifelong Skill Discovery and Evolution for Autonomous Agents","version":1},"cited_work":{"arxiv_id":"2604.17308","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.17308","snapshot_observed_at":"2026-07-03T14:18:22.420135Z","title":"SkillFlow:Benchmarking Lifelong Skill Discovery and Evolution for Autonomous Agents","venue":"cs.AI","work_id":"748b02c2-6915-400b-a0dc-5e5dba4a3b99","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2604.17308","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:230f91378ab68cdc5b57527c64a72d8e1bb89af676f50ee517d120279d79560f","observation_id":"59a2cabd-dc1b-4498-b3ae-41a918821918","resolution":{"observed_at":"2026-07-02T22:47:26.460447Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:37:00.015083Z","title":"Welcome to the era of experience.Google AI, 1:11, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:054106a527da47d83aa57fdb8856757d7962fb47a10c0e33c4c7cdda3c79bf5a","observation_id":"d08258a8-df2e-4639-ac6a-e3f2b12b5e61","resolution":{"observed_at":"2026-06-27T18:37:00.015083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.07670","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:47:48.310753Z","title":"Memory for autonomous llm agents: Mechanisms, evaluation, and emerging frontiers","venue":null,"work_id":"9aecac84-4c67-4c0c-80b2-942f93760de7","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:3a48854c290a303cbcdc5541af9e7ee48f44a98300231e64efdb52459ccb2724","observation_id":"bd293901-17f6-4896-b9cc-d6087f836954","resolution":{"observed_at":"2026-07-02T22:47:26.449273Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.16153","last_updated":"2025-08-25T13:32:12Z","snapshot_observed_at":"2026-08-06T23:53:22.457977Z","submitted_at":"2025-08-22T07:25:30Z","title":"Memento: Fine-tuning LLM Agents without Fine-tuning LLMs","version":2},"cited_work":{"arxiv_id":"2508.16153","doi":"10.48550/arxiv.2508.16153","metadata_source":"pith","pith_arxiv_id":"2508.16153","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Memento: Fine-tuning LLM Agents without Fine-tuning LLMs","venue":"cs.LG","work_id":"ed7d69aa-0e41-4f9f-99e1-2dfcbdd515a0","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2508.16153","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:39fadb5cfc2dc1d03ed0271de43c3d3a5661bd5fcb050cc94627ce54d8e70062","observation_id":"cc670e79-6e3e-4094-a0c4-a1ebd6290b17","resolution":{"observed_at":"2026-07-02T22:57:25.867397Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:34.518715+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:34.518715+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.03773","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T20:05:34.030607Z","title":"Scaling agent learning via experience synthesis","venue":null,"work_id":"07901808-801a-418a-aa0f-4fbaebfab139","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:476adc2fb81f2111e09ab096b0640ccce47fdb813dc4a34adf60e3278955c9f9","observation_id":"b44203e5-9781-40bf-b35f-be9e65c24968","resolution":{"observed_at":"2026-07-02T22:57:25.904457Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.08558","last_updated":"2026-05-24T21:56:11Z","snapshot_observed_at":"2026-08-04T10:47:54.049813Z","submitted_at":"2025-10-09T17:59:17Z","title":"Agent Learning via Early Experience","version":3},"cited_work":{"arxiv_id":"2510.08558","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.08558","snapshot_observed_at":"2026-07-04T20:00:07.735443Z","title":"arXiv preprint arXiv:2510.08558 , year=","venue":"cs.AI","work_id":"f0d69349-a2c2-4250-8431-82719c22096f","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2510.08558","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:f155d7bb64a9cea9a890a940645b3722512807e3b95e1730a13e4272cc8d5bcb","observation_id":"3a71f265-0b05-4144-be95-d1611ff72898","resolution":{"observed_at":"2026-07-02T22:57:25.878799Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03192","last_updated":"2026-02-12T05:43:57Z","snapshot_observed_at":"2026-08-02T21:01:18.325722Z","submitted_at":"2026-01-06T17:14:50Z","title":"MemRL: Self-Evolving Agents via Runtime Reinforcement Learning on Episodic Memory","version":2},"cited_work":{"arxiv_id":"2601.03192","doi":"10.48550/arxiv.2601.03192","metadata_source":"pith","pith_arxiv_id":"2601.03192","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MemRL: Self-Evolving Agents via Runtime Reinforcement Learning on Episodic Memory","venue":"cs.CL","work_id":"0ab11b49-e934-49e1-9eaf-a25fb7343010","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2601.03192","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:8f27e025bb3557459adfbdc473164266c75fa7705615158e6e18fdd215d27ade","observation_id":"a5e360c6-d55c-426a-85c8-ea046b3da241","resolution":{"observed_at":"2026-07-02T22:57:25.899564Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.10600","doi":"10.48550/arxiv.2603.10600","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trajectory-informed memory generation for self-improving agent systems","venue":"arXiv (Cornell University)","work_id":"797458d0-d24f-4c70-8bac-e1ef83fd0f70","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:3ab362ececb0b36b4e8d947339677685ef1b52b0d81759ac24cc98122d20d06c","observation_id":"4c6afe53-99af-4150-b9d3-2959a043f709","resolution":{"observed_at":"2026-07-02T22:57:25.887645Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:50:58.923039+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:50:58.923039+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.25140","last_updated":"2026-03-16T20:49:28Z","snapshot_observed_at":"2026-08-02T12:08:17.149184Z","submitted_at":"2025-09-29T17:51:03Z","title":"ReasoningBank: Scaling Agent Self-Evolving with Reasoning Memory","version":2},"cited_work":{"arxiv_id":"2509.25140","doi":"10.48550/arxiv.2509.25140","metadata_source":"pith","pith_arxiv_id":"2509.25140","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ReasoningBank: Scaling Agent Self-Evolving with Reasoning Memory","venue":"cs.AI","work_id":"551218b8-a306-4c1e-8795-6232cc30192b","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2509.25140","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:ea330077915604761433c64b42d323bb464a484ff206f33994a98954e751ca01","observation_id":"a5db41fc-e95d-4093-b10e-50799bead76e","resolution":{"observed_at":"2026-07-02T22:57:25.910403Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:34.995342+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:34.995342+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:37:00.015083Z","title":"R2d2: Remembering, replaying and dynamic decision making with a reflective agentic memory","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:8c308ae9afd9bfb7d1df4a85345bbf41131a0dcac5560653755fa596b5c53ab5","observation_id":"05e77c32-6688-4ac0-aeff-e9378f78f76f","resolution":{"observed_at":"2026-06-27T18:37:00.015083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:37:00.015083Z","title":"Dynamic cheatsheet: Test-time learning with adaptive memory","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:649409343026f887065c7d9f24607795097966ade6a864158ad390ca62d9f555","observation_id":"24ce572e-c007-471f-8b30-94f42ad805d2","resolution":{"observed_at":"2026-06-27T18:37:00.015083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.06449","doi":"10.48550/arxiv.2511.06449","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flex: Continuous agent evolution via forward learning from experience","venue":"ArXiv.org","work_id":"20c70353-cdc5-4bb5-806a-59181ff4fbdf","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:bbddf957a308875c2cf52d9388cb565dc697c03c17bcf57c4005e94ccdce2d19","observation_id":"ed5a25d2-4d6f-49a6-89ec-81ce22cd7023","resolution":{"observed_at":"2026-07-02T22:57:25.776640Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22954","last_updated":"2026-03-12T23:47:40Z","snapshot_observed_at":"2026-07-06T21:32:33.515702Z","submitted_at":"2025-05-29T00:26:15Z","title":"Darwin Godel Machine: Open-Ended Evolution of Self-Improving Agents","version":3},"cited_work":{"arxiv_id":"2505.22954","doi":"10.48550/arxiv.2505.22954","metadata_source":"pith","pith_arxiv_id":"2505.22954","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Darwin Godel Machine: Open-Ended Evolution of Self-Improving Agents","venue":"cs.AI","work_id":"c0d964a0-02a1-4ee2-a596-028489ba753f","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2505.22954","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:15e7e5b0172e50ed4fa9499edc60a299b6bf2156cf3657bb517e1caf73d06492","observation_id":"d4072ae0-91a9-4c30-b42b-3f320d3ec772","resolution":{"observed_at":"2026-07-02T22:57:25.828262Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:19.626419+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:19.626419+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.04851","doi":"10.48550/arxiv.2510.04851","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Legomem: Modular procedural memory for multi-agent llm systems for workflow automation","venue":null,"work_id":"81b5a1e3-7f36-4854-a305-10e386c1b07f","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:a42f2df3cac318edd2584e9491b33ad8644e223c7b59ba97ca180e2d37e37d09","observation_id":"9c57175e-7d8f-47db-9a70-d85c37009f51","resolution":{"observed_at":"2026-07-02T22:57:25.837741Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.06229","doi":"10.48550/arxiv.2507.06229","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agent kb: Leveraging cross-domain experience for agentic problem solving","venue":"ArXiv.org","work_id":"11232777-9790-41f1-ae97-5d0c1577d5a0","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:ea976eeae504bbabcf6713fdf93489d14affb5555bb13c308fbd1e5bdc8555cf","observation_id":"5b8faa6b-4820-41d3-bea7-a7fa4983d446","resolution":{"observed_at":"2026-07-02T22:57:25.907637Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07398","last_updated":"2025-06-16T08:45:10Z","snapshot_observed_at":"2026-07-06T21:38:49.668502Z","submitted_at":"2025-06-09T03:43:46Z","title":"G-Memory: Tracing Hierarchical Memory for Multi-Agent Systems","version":2},"cited_work":{"arxiv_id":"2506.07398","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.07398","snapshot_observed_at":"2026-07-10T01:36:44.001440Z","title":"G- memory: Tracing hierarchical memory for multi-agent systems","venue":"cs.MA","work_id":"e5c4ec9c-3e43-42d1-a3d7-0deef9c44093","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2506.07398","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:b5f5106a33b7e4a318163307c80ee032654b694c6f24dd0069ace8947117578a","observation_id":"f0fe70a6-bcd7-432b-95d9-ee64fd3b2e0e","resolution":{"observed_at":"2026-07-02T22:47:26.421753Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.16079","last_updated":"2026-05-16T02:57:47Z","snapshot_observed_at":"2026-08-05T00:54:36.690304Z","submitted_at":"2025-10-17T12:03:16Z","title":"EvolveR: Self-Evolving LLM Agents through an Experience-Driven Lifecycle","version":3},"cited_work":{"arxiv_id":"2510.16079","doi":"10.48550/arxiv.2510.16079","metadata_source":"pith","pith_arxiv_id":"2510.16079","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"EvolveR: Self-Evolving LLM Agents through an Experience-Driven Lifecycle","venue":"cs.CL","work_id":"350af93c-7749-4477-8163-e35d2cac8d96","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2510.16079","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:90230202545aeb728591bd43d24fa8e5a5c6495deab8cb993bcf376b2ae4c54f","observation_id":"81f77580-c744-4f1a-95c8-82f1823fb822","resolution":{"observed_at":"2026-07-02T22:47:26.424338Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.05665","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T17:09:59.346546Z","title":"Graph-based agent memory: Taxonomy, techniques, and applications","venue":null,"work_id":"02aaf46d-085a-417b-97df-ff3cf1a8a3a0","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:0c942ce36b900f24d9c827fb7e6dcf41909d9cc455026e6ce764b4aa0ac56273","observation_id":"838d8488-37bb-4416-af6b-c11213ffba73","resolution":{"observed_at":"2026-07-02T22:57:25.845493Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.18746","last_updated":"2025-12-21T14:26:14Z","snapshot_observed_at":"2026-07-06T22:39:43.359149Z","submitted_at":"2025-12-21T14:26:14Z","title":"MemEvolve: Meta-Evolution of Agent Memory Systems","version":1},"cited_work":{"arxiv_id":"2512.18746","doi":"10.48550/arxiv.2512.18746","metadata_source":"pith","pith_arxiv_id":"2512.18746","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MemEvolve: Meta-Evolution of Agent Memory Systems","venue":"cs.CL","work_id":"69fd3342-cd0c-43d2-b12c-2d266dc000b2","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2512.18746","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:7252e42510be690aa6ef8011838b8f8387949eead6fbe6e91687c8917998d173","observation_id":"1934cf68-119b-4c96-95c2-1cd1d79aea29","resolution":{"observed_at":"2026-07-02T22:57:25.890807Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.10395","doi":"10.48550/arxiv.2511.10395","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agentevolver: Towards efficient self-evolving agent system","venue":"ArXiv.org","work_id":"e9710c06-579f-415b-88ba-965ce465b757","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:e837fd01a707e9c3222e2eff30f7ec14e4c5733cd5aa7218ed243e6e0e044262","observation_id":"8d55a5ce-5ba9-4013-9431-9584deaa2662","resolution":{"observed_at":"2026-07-02T22:47:26.454755Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.19005","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T23:54:18.662831Z","title":"Building self-evolving agents via experience-driven lifelong learning: A framework and benchmark","venue":null,"work_id":"6f99904a-f32e-485e-b821-d4489e4898b1","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:30c728437f35f173efd9b0488daa466082fe57eed4b0607d8bccf28fdfada062","observation_id":"8b5c4b91-481f-4016-804d-6b844681a852","resolution":{"observed_at":"2026-07-02T22:47:26.449485Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19828","last_updated":"2026-01-14T14:21:21Z","snapshot_observed_at":"2026-07-06T22:19:28.487854Z","submitted_at":"2025-08-27T12:26:55Z","title":"Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2508.19828","doi":"10.48550/arxiv.2508.19828","metadata_source":"pith","pith_arxiv_id":"2508.19828","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning","venue":"cs.CL","work_id":"2a070440-2167-4398-be97-c2d4c3ee3541","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2508.19828","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:67c21dbbd2f79ba96c6f17ea53eefdde9e9122e41cf5b9f3d9edac804cfeffa6","observation_id":"987f4751-8af1-4d9d-9111-2a728b5bbf26","resolution":{"observed_at":"2026-07-02T22:57:25.901885Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:49:35.802766+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:49:35.802766+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.13085","last_updated":"2026-04-02T22:53:34Z","snapshot_observed_at":"2026-07-06T23:01:10.333101Z","submitted_at":"2026-04-02T22:53:34Z","title":"Adaptive Memory Crystallization for Autonomous AI Agent Learning in Dynamic Environments","version":1},"cited_work":{"arxiv_id":"2604.13085","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.13085","snapshot_observed_at":"2026-07-02T22:47:26.412213Z","title":"Adaptive Memory Crystallization for Autonomous AI Agent Learning in Dynamic Environments","venue":"cs.LG","work_id":"f382d493-9cc2-4dc6-848e-f19cea89212c","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2604.13085","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:c5f1fd5dbbaa5ae02d12f089c026e3426a56d10a80c7b54db7b854cea2d8168b","observation_id":"c858693e-e2d5-4671-b494-3ad29d1ddd0c","resolution":{"observed_at":"2026-07-02T22:47:26.413524Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03768","last_updated":"2021-03-14T22:44:38Z","snapshot_observed_at":"2026-07-06T10:02:33.297722Z","submitted_at":"2020-10-08T05:13:36Z","title":"ALFWorld: Aligning Text and Embodied Environments for Interactive Learning","version":2},"cited_work":{"arxiv_id":"2010.03768","doi":"10.1109/cvpr.2001.990517","metadata_source":"pith","pith_arxiv_id":"2010.03768","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ALFWorld: Aligning Text and Embodied Environments for Interactive Learning","venue":"cs.CL","work_id":"fa436f46-ec0a-4d2e-a0ff-e697def4a7be","year":2020},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2010.03768","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:bcef0297958c9c0ca707ced6ecf2406e8eb40f5ced46e818b3d8f9a0e6172f79","observation_id":"8560c48b-187d-43bd-a22a-43e1a5f0de09","resolution":{"observed_at":"2026-07-02T22:47:26.416212Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-20T11:23:33.289391+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T11:23:33.289391+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:37:00.015083Z","title":"Webshop: Towards scalable real-world web interaction with grounded language agents.Advances in Neural Information Processing Systems, 35:20744–20757, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:f494875ff7337c1c0940b5356e0356a6d8fb3087566814f8bd38c54d855641dd","observation_id":"3cec899c-61a7-4953-a26d-fb19336f1751","resolution":{"observed_at":"2026-06-27T18:37:00.015083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:07e13558fc528949813d948180f57ef27c6a025027814ee3d40f778be2aaa456","observation_id":"194a0efe-d2d0-4622-8392-25a94e9e0617","resolution":{"observed_at":"2026-07-02T22:47:26.429860Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:23cd99e561345db1252f9fe7874fecaa775b76f895f93ddd7b9537dd4e726279","observation_id":"07bcbd80-c110-4399-90e7-0132421a4958","resolution":{"observed_at":"2026-07-02T22:47:26.443218Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.01347","doi":"10.48550/arxiv.2506.01347","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The surprising effectiveness of negative reinforcement in llm reasoning.arXiv preprint arXiv:2506.01347","venue":"ArXiv.org","work_id":"90fa4c77-dcfb-4253-827e-9bde0d342fcb","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:003c11031a28fbd9dd26d1dd18e92e7e426ce66fa23b145fc73f4dc58a43ce37","observation_id":"42349223-83ac-4946-a1e6-3342dd2fcbd8","resolution":{"observed_at":"2026-07-02T22:47:26.426988Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:37:00.015083Z","title":"Natural questions: a benchmark for question answering research.Transactions of the Association for Computational Linguistics, 7:453–466, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:233a8a28b60f1e75b926debd9ef0e41a142a03b32969cf402433e44921293ee3","observation_id":"4ab0146b-dcbc-4e50-9d96-a814996eb7d1","resolution":{"observed_at":"2026-06-27T18:37:00.015083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:37:00.015083Z","title":"Triviaqa: A large scale distantly supervised challenge dataset for reading comprehension","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:f89e0b982bf53dc3ea9a86d8d6629c36bdd9a854944f5bc137f771e707c66001","observation_id":"cd5e89d8-8b27-44f1-bc96-f2302069de34","resolution":{"observed_at":"2026-06-27T18:37:00.015083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:37:00.015083Z","title":"When not to trust language models: Investigating effectiveness of parametric and non-parametric memories","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:e672e7254244962ada7df8cbef6b689a808ec1d9a56a1a8b843351d960a1c5d0","observation_id":"ae7693b3-c8b7-4137-930a-2a8a59b385fe","resolution":{"observed_at":"2026-06-27T18:37:00.015083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:37:00.015083Z","title":"Hotpotqa: A dataset for diverse, explainable multi-hop question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:61782d8354eb19d2f6f44436ea015a820801858fc952484d3326283154e187f1","observation_id":"801c0f63-9afa-4f4b-ad94-e8d52133ed60","resolution":{"observed_at":"2026-06-27T18:37:00.015083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:37:00.015083Z","title":"Constructing a multi-hop qa dataset for comprehensive evaluation of reasoning steps","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:ff4ee42649029912989df3a7b8ef06686c9fc5d494dc38b0a4f5d9186dc25cb3","observation_id":"1bc986e8-6f15-47fd-8abc-00cd3cb2434e","resolution":{"observed_at":"2026-06-27T18:37:00.015083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:37:00.015083Z","title":"Musique: Multi-hop questions via single-hop question composition.Transactions of the Association for Computational Linguistics, 10:539–554, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:9cc92bd17315c22030119a4d5d848a489f71ae6f7e2499185fe331cf840b0d1d","observation_id":"d04772b8-43f2-4702-b346-6f8d16b35b3d","resolution":{"observed_at":"2026-06-27T18:37:00.015083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:37:00.015083Z","title":"Measuring and narrowing the compositionality gap in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:bcee987d6e075a518ca06ac4429dcf102e8f967563810630aaead67f2d806a2d","observation_id":"ce80d306-3640-4842-81c4-ca6fef390c23","resolution":{"observed_at":"2026-06-27T18:37:00.015083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":"2507.06261","doi":"10.48550/arxiv.2503.19","metadata_source":"pith","pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-07-11T03:17:51.364436Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","venue":"cs.CL","work_id":"008df105-2fdd-45d8-857a-8e35868aecb6","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:326c0a7bd26cc4adc8036f4cf74f1721de9ef7ecf23a35b25d23999fc6f514bc","observation_id":"8af126c3-526c-4b8e-817a-37f560c4602d","resolution":{"observed_at":"2026-07-02T22:47:26.429486Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03629","last_updated":"2023-03-10T01:00:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-06T01:00:32Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","version":3},"cited_work":{"arxiv_id":"2210.03629","doi":"10.48550/arxiv.2210.03629","metadata_source":"pith","pith_arxiv_id":"2210.03629","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","venue":"cs.CL","work_id":"407a2351-25f1-497d-b611-f77d0292a8e6","year":2022},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2210.03629","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:b88791339ecda02a8947394a04b137a8d9df83d6351a65bae96b5626e20c2391","observation_id":"6009b2cf-53a8-4e43-a23f-e0faac7ac119","resolution":{"observed_at":"2026-07-02T22:47:26.432235Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-12T03:19:36.897515+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T03:19:36.897515+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:37:00.015083Z","title":"Reflexion: Language agents with verbal reinforcement learning.Advances in neural information processing systems, 36:8634–8652, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:7dbcc7b02b31577a27a41d2c90f81701db37d84efa4918fc76b99451b797498a","observation_id":"ae2ea331-8cbb-4e54-a599-8aa4334fc6c1","resolution":{"observed_at":"2026-06-27T18:37:00.015083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19413","last_updated":"2025-04-28T01:46:35Z","snapshot_observed_at":"2026-08-02T07:32:11.339534Z","submitted_at":"2025-04-28T01:46:35Z","title":"Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory","version":1},"cited_work":{"arxiv_id":"2504.19413","doi":"10.48550/arxiv.2504.19413","metadata_source":"pith","pith_arxiv_id":"2504.19413","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory","venue":"cs.CL","work_id":"a5aed26c-a248-48b6-a59e-f7693fcb180a","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2504.19413","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:6715617a220e0810fa1ed5200b4d4f968a951300edcdcaed87a4107202e7600f","observation_id":"f0a149d7-9968-4fa6-8131-d788eec6be4d","resolution":{"observed_at":"2026-07-02T22:47:26.446146Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:37:00.015083Z","title":"Expel: Llm agents are experiential learners","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:62112ff57610c1162b920d11d72b44ff699022e84999d0d37fd26c7b16b6f3f2","observation_id":"f940e363-7245-4592-b44f-e2ee9638a819","resolution":{"observed_at":"2026-06-27T18:37:00.015083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:37:00.015083Z","title":"Back to basics: Revisiting reinforce-style optimization for learning from human feedback in llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:8659f2c81ec5f1d8d242221eaa9d453aed7cb7276f4bf637a5e873c853a3f8f2","observation_id":"6cbc82e2-1e9c-4321-b6ca-3c2c303f78aa","resolution":{"observed_at":"2026-06-27T18:37:00.015083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.02553","last_updated":"2026-01-29T15:45:24Z","snapshot_observed_at":"2026-07-06T22:40:46.465095Z","submitted_at":"2026-01-05T21:02:49Z","title":"SimpleMem: Efficient Lifelong Memory for LLM Agents","version":3},"cited_work":{"arxiv_id":"2601.02553","doi":"10.48550/arxiv.2601.02553","metadata_source":"pith","pith_arxiv_id":"2601.02553","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SimpleMem: Efficient Lifelong Memory for LLM Agents","venue":"cs.AI","work_id":"9b5b2649-8727-425e-a2c5-60f49518a5c4","year":2026},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2601.02553","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:6bd329f71ecb2fa9a058a9f9ce8863bcb0b6344a65fee7a417eaa7ad2296264b","observation_id":"0901fb9c-d856-4d7b-9198-fb19603db4d6","resolution":{"observed_at":"2026-07-02T22:47:26.435624Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T18:37:00.015083Z","title":"Search-o1: Agentic search-enhanced large reasoning models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:05679d995e9929c88821f875a2e98d106b3721ac1b0e55b202c7636203805887","observation_id":"8c140f9f-5923-49fb-992a-73b8cdbd086e","resolution":{"observed_at":"2026-06-27T18:37:00.015083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09516","last_updated":"2025-08-05T19:08:38Z","snapshot_observed_at":"2026-07-06T20:51:28.022519Z","submitted_at":"2025-03-12T16:26:39Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2503.09516","doi":"10.48550/arxiv.2503.09516","metadata_source":"pith","pith_arxiv_id":"2503.09516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","venue":"cs.CL","work_id":"0e0b7549-2bc4-4574-aa7f-588ffa16eaae","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2503.09516","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:51687d122dac17b14823c599146e507ea0c82b99e2048e630696db9b7522076c","observation_id":"b11de2d0-1b76-4da9-b8f7-3e8f9e911bbb","resolution":{"observed_at":"2026-07-02T22:57:25.842847Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04588","last_updated":"2026-05-19T11:51:42Z","snapshot_observed_at":"2026-08-04T18:36:41.979541Z","submitted_at":"2025-05-07T17:30:22Z","title":"ZeroSearch: Incentivize the Search Capability of LLMs without Searching","version":3},"cited_work":{"arxiv_id":"2505.04588","doi":"10.48550/arxiv.2505.04588","metadata_source":"pith","pith_arxiv_id":"2505.04588","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ZeroSearch: Incentivize the Search Capability of LLMs without Searching","venue":"cs.CL","work_id":"0ea11521-4603-4e7a-abe3-bbc2f3e3f71c","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2505.04588","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:54768737e554c2797ea41636cb7d936d1ff4ec57cde8f5973377c68fa932d321","observation_id":"9dc86ad0-4ac1-4ba5-9ff1-3600745d6288","resolution":{"observed_at":"2026-07-02T22:57:25.864373Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15107","last_updated":"2025-05-26T04:44:21Z","snapshot_observed_at":"2026-08-07T01:41:10.026662Z","submitted_at":"2025-05-21T05:01:31Z","title":"StepSearch: Igniting LLMs Search Ability via Step-Wise Proximal Policy Optimization","version":2},"cited_work":{"arxiv_id":"2505.15107","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.15107","snapshot_observed_at":"2026-07-08T13:04:56.727934Z","title":"Stepsearch: Igniting llms search ability via step-wise proximal policy optimization.arXiv preprint arXiv:2505.15107","venue":"cs.CL","work_id":"0c9eadf8-223b-4c81-a25c-3a46d830ba8b","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2505.15107","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:2d3fb35769af5be97410e572e80f02756a613c3a8cb100e926623ce383036915","observation_id":"ffaea00e-6581-4880-a5f1-68dd30ab359c","resolution":{"observed_at":"2026-07-02T22:57:25.881525Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10978","last_updated":"2025-10-28T15:11:36Z","snapshot_observed_at":"2026-07-29T19:20:21.974239Z","submitted_at":"2025-05-16T08:26:59Z","title":"Group-in-Group Policy Optimization for LLM Agent Training","version":3},"cited_work":{"arxiv_id":"2505.10978","doi":"10.48550/arxiv.2505.10978","metadata_source":"pith","pith_arxiv_id":"2505.10978","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Group-in-Group Policy Optimization for LLM Agent Training","venue":"cs.LG","work_id":"bc65d492-e6ba-4522-874c-43d2f4fc5191","year":2025},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2505.10978","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:ea85c097197c2da8d30224d117fd8aa94b5d576fc22958c6728d84ab1cf105c5","observation_id":"ac9f0a0b-3ab0-49aa-a391-3851bf17818b","resolution":{"observed_at":"2026-07-02T22:57:25.896537Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03533","last_updated":"2024-02-22T06:21:51Z","snapshot_observed_at":"2026-07-06T14:27:46.217000Z","submitted_at":"2022-12-07T09:25:54Z","title":"Text Embeddings by Weakly-Supervised Contrastive Pre-training","version":2},"cited_work":{"arxiv_id":"2212.03533","doi":"10.48550/arxiv.2212.03533","metadata_source":"pith","pith_arxiv_id":"2212.03533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Text Embeddings by Weakly-Supervised Contrastive Pre-training","venue":"cs.CL","work_id":"789cc674-467e-4f23-bb50-05c79fe8c4c2","year":2022},"citing_paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:00.015083Z"},"links":{"cited_paper":"/paper/2212.03533","citing_paper":"/paper/2606.08755"},"observation_digest":"sha256:3c0792fe1f0bff3a499f10588a659927ac9a9dfa6f5cea416e94e6d7174b27f3","observation_id":"889cc33b-1ce3-4984-829d-c17a53a6fbaf","resolution":{"observed_at":"2026-07-02T22:57:25.861682Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-01T10:08:09.486841+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T10:08:09.486841+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.08755","last_updated":"2026-06-07T17:55:55Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-01T04:11:26.349236Z","submitted_at":"2026-06-07T17:55:55Z","title":"Co-Evolving Skill Generation and Policy Optimization"},"reference_resolution":{"displayed":96,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":21,"verified_exact":73,"verified_fuzzy":0},"total_outbound_references":96},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 96 of 96 outbound references and 1 inbound Pith citation observation for arXiv:2606.08755."}