{"as_of":"2026-08-04T23:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ff70b1e896f8f244548561b2daac7204e38a5b19a5faf5876d9e53fcc55624c8","coverage":[{"denominator":81,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":81,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T04:36:27.381942Z","state":"measured"},{"denominator":82,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":82,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T04:40:30.985824Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-03T16:58:43.673293Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"cited_work":{"arxiv_id":"2604.18131","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.18131","snapshot_observed_at":"2026-07-03T16:58:43.673293Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","venue":"cs.AI","work_id":"7c261e21-a47c-4157-acc3-097cdb796021","year":2026},"citing_paper":{"arxiv_id":"2606.20683","last_updated":"2026-06-14T05:40:16Z","snapshot_observed_at":"2026-07-30T16:44:18.366904Z","submitted_at":"2026-06-14T05:40:16Z","title":"From Question Answering to Task Completion: A Survey on Agent System and Harness Design","version":1},"reference_index":163,"source":"pdf_text","source_observed_at":"2026-06-27T04:40:30.985824Z"},"links":{"cited_paper":"/paper/2604.18131","citing_paper":"/paper/2606.20683"},"observation_digest":"sha256:f1e8d4252bd82e8940e864dc963023f1c18b0c72eed0110c6ec68706d10c1c33","observation_id":"8de6d7fb-a4b1-429e-8b2b-ea0c51c37110","resolution":{"observed_at":"2026-07-03T16:58:43.674751Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2604.18131/citation-record","integrity":"/paper/2604.18131/integrity","json":"/paper/2604.18131/citation-record.json","paper":"/paper/2604.18131"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2401.13919","last_updated":"2024-06-06T18:37:34Z","snapshot_observed_at":"2026-07-06T17:20:11.913242Z","submitted_at":"2024-01-25T03:33:18Z","title":"WebVoyager: Building an End-to-End Web Agent with Large Multimodal Models","version":4},"cited_work":{"arxiv_id":"2401.13919","doi":"10.48550/arxiv.2401.13919","metadata_source":"pith","pith_arxiv_id":"2401.13919","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"WebVoyager: Building an End-to-End Web Agent with Large Multimodal Models","venue":"cs.CL","work_id":"12c1d840-af20-4a4e-8750-6b9c6266638f","year":2024},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2401.13919","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:c746dfd0412bb8160e1539f114c987291b42200095608a2f2529f0500f62ab8b","observation_id":"9987c547-3a84-4242-903d-9cf38d159151","resolution":{"observed_at":"2026-05-15T22:43:35.479641Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07572","last_updated":"2025-08-10T05:59:20Z","snapshot_observed_at":"2026-08-04T14:46:05.418102Z","submitted_at":"2025-01-13T18:58:07Z","title":"WebWalker: Benchmarking LLMs in Web Traversal","version":3},"cited_work":{"arxiv_id":"2501.07572","doi":"10.48550/arxiv.2501.07572","metadata_source":"pith","pith_arxiv_id":"2501.07572","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Jialong Wu, Baixuan Li, Runnan Fang, Wenbiao Yin, Liwen Zhang, Zhengwei Tao, Dingchu Zhang, Zekun Xi, Gang Fu, Yong Jiang, Pengjun Xie, Fei Huang, and Jingren Zhou","venue":"cs.CL","work_id":"8528e4cd-bcbc-4f57-9bd2-11ce86dd3493","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2501.07572","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:a4e298fc4c2267e7b3e31724f85b458ae33caae0cb862f768074e9744daa624d","observation_id":"c14ae87d-840d-4b97-af62-f824bc72ab98","resolution":{"observed_at":"2026-05-10T12:10:23.405556Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:5505c91fff8dfa7705224f156087415075aaf2b25e2f1863e623fd7c814a01e8","observation_id":"5927d826-f8ad-40fe-9b36-f282f87c7747","resolution":{"observed_at":"2026-05-10T12:10:23.513889Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Seed-oss open-source models.https://github.com/ByteDance-Seed/seed-oss","venue":null,"work_id":"2a7b30f3-c283-4262-8c63-425cc40f6814","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:555ff67fa9b5f03362e7fff878f85daf4b41ab65cceee0cc1bfc2062debfb3ce","observation_id":"4ffcccc2-aeab-4d5a-9454-91c30d52c195","resolution":{"observed_at":"2026-05-22T03:56:02.630014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:16:21.111301Z","title":"Qwen3 technical report","venue":null,"work_id":"d95873d5-9f2e-4813-aee5-72264f679d9c","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:19bbbd79f72b2006daa3689e6630a8bad4022c5bae0b600645967ebd81ac1bb1","observation_id":"dbd63f9e-d63d-4aa8-9140-287f1e5f4eff","resolution":{"observed_at":"2026-05-22T03:56:02.633823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":"2507.06261","doi":"10.48550/arxiv.2503.19","metadata_source":"pith","pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-07-11T03:17:51.364436Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","venue":"cs.CL","work_id":"008df105-2fdd-45d8-857a-8e35868aecb6","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:ceeab584c5310a5f7d1df15681447ea64a0df54c3c4a8323e215ae49c5aa9c1d","observation_id":"956be0d3-309d-422f-ae0c-a889821bf62c","resolution":{"observed_at":"2026-05-10T12:10:23.427351Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21046","last_updated":"2026-01-16T20:59:08Z","snapshot_observed_at":"2026-08-01T06:32:44.461162Z","submitted_at":"2025-07-28T17:59:05Z","title":"A Survey of Self-Evolving Agents: What, When, How, and Where to Evolve on the Path to Artificial Super Intelligence","version":4},"cited_work":{"arxiv_id":"2507.21046","doi":"10.48550/arxiv.2507.21046","metadata_source":"pith","pith_arxiv_id":"2507.21046","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"A Survey of Self-Evolving Agents: What, When, How, and Where to Evolve on the Path to Artificial Super Intelligence","venue":"cs.AI","work_id":"f5de9511-98bf-411c-9eba-e8b7a914ec18","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2507.21046","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:11c299e4ce7390f5a1ad1e894534c4062f539abce88ce68a31a01e6d5d2ee8da","observation_id":"f1a73f88-48e1-40b8-853f-cd1e445be621","resolution":{"observed_at":"2026-05-14T22:23:15.948876Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-01T10:08:10.122082+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T10:08:10.122082+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.04618","last_updated":"2026-03-29T09:18:02Z","snapshot_observed_at":"2026-07-06T22:31:49.574184Z","submitted_at":"2025-10-06T09:30:18Z","title":"Agentic Context Engineering: Evolving Contexts for Self-Improving Language Models","version":3},"cited_work":{"arxiv_id":"2510.04618","doi":"10.48550/arxiv.2510.04618","metadata_source":"pith","pith_arxiv_id":"2510.04618","snapshot_observed_at":"2026-07-10T16:57:24.542956Z","title":"Agentic Context Engineering: Evolving Contexts for Self-Improving Language Models","venue":"cs.LG","work_id":"c1d09cf9-9176-403d-8028-630bbc0cbc5d","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2510.04618","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:7c2a67725fe4adbc9bbe52229156511dad6c981c361a0a678a03d8c88b3cb24a","observation_id":"b639b585-52a5-489f-ad70-58b2abc530b3","resolution":{"observed_at":"2026-05-12T16:44:08.223014Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-24T00:53:03.57435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T00:53:03.57435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.25052","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cogito, ergo ludo: An agent that learns to play by reasoning and planning.arXiv preprint arXiv:2509.25052, 2025b","venue":null,"work_id":"ec4063ee-810e-4332-992a-f9ba88b4ac48","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:2d4a856ee86272d80702467e1fdcd3387a2648c4864cc8e1a1e7d90982a79a7a","observation_id":"e117de84-062a-4d2d-9564-f3c49056d95b","resolution":{"observed_at":"2026-05-10T12:10:23.488892Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06855","last_updated":"2025-08-21T08:09:13Z","snapshot_observed_at":"2026-07-06T20:34:15.946558Z","submitted_at":"2025-02-07T17:45:16Z","title":"Self-Supervised Prompt Optimization","version":3},"cited_work":{"arxiv_id":"2502.06855","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06855","snapshot_observed_at":"2026-07-03T21:28:58.691237Z","title":"arXiv preprint arXiv:2502.06855 , year=","venue":null,"work_id":"0180714a-43d2-48cb-939b-d1a9cd36a635","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2502.06855","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:213535fdd97e67eee2450a22c1322094a24c21856e9f030b745dd98020dce3e5","observation_id":"06ceceb9-7280-4be3-bd3a-eb5c6a0c7557","resolution":{"observed_at":"2026-05-10T12:10:23.492931Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06153","last_updated":"2025-02-27T13:33:55Z","snapshot_observed_at":"2026-08-04T17:21:11.505603Z","submitted_at":"2024-10-08T15:52:42Z","title":"AgentSquare: Automatic LLM Agent Search in Modular Design Space","version":3},"cited_work":{"arxiv_id":"2410.06153","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.06153","snapshot_observed_at":"2026-07-04T13:39:50.589123Z","title":"arXiv preprint arXiv:2410.06153 , year=","venue":null,"work_id":"8b514c0f-5fe5-45ca-a4f6-3a09b4e2ec8f","year":2024},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2410.06153","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:5f0b2d6d916e602399668b1fa82bfab63cdaafa1deb5374146010bf4ef7c4fa2","observation_id":"dcce4d15-6ae0-4bf0-9fa1-e067566a0210","resolution":{"observed_at":"2026-05-10T12:10:23.430752Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16673","last_updated":"2025-01-30T16:40:12Z","snapshot_observed_at":"2026-08-04T08:09:55.800216Z","submitted_at":"2025-01-28T03:18:48Z","title":"LLM-AutoDiff: Auto-Differentiate Any LLM Workflow","version":2},"cited_work":{"arxiv_id":"2501.16673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16673","snapshot_observed_at":"2026-07-02T09:16:48.986484Z","title":"Yin and Z","venue":null,"work_id":"01ccc99d-c834-450e-8229-a65274ddacdf","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2501.16673","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:b9029f396543273197f6b36c4258c40a9efa28aa2fe4070d93e3b28f02726353","observation_id":"cdc7e488-c35f-424b-a262-d0e067529dd5","resolution":{"observed_at":"2026-05-10T12:10:23.505093Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.25140","last_updated":"2026-03-16T20:49:28Z","snapshot_observed_at":"2026-08-02T12:08:17.149184Z","submitted_at":"2025-09-29T17:51:03Z","title":"ReasoningBank: Scaling Agent Self-Evolving with Reasoning Memory","version":2},"cited_work":{"arxiv_id":"2509.25140","doi":"10.48550/arxiv.2509.25140","metadata_source":"pith","pith_arxiv_id":"2509.25140","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"ReasoningBank: Scaling Agent Self-Evolving with Reasoning Memory","venue":"cs.AI","work_id":"551218b8-a306-4c1e-8795-6232cc30192b","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2509.25140","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:8e79fc87078219cc8264649e996e02523163c77f6e6a455df0e06231eb96c99d","observation_id":"3ee8dd9d-6854-4cd6-b9f9-2a2dbd5e64d8","resolution":{"observed_at":"2026-05-15T05:42:50.464031Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:34.995342+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:34.995342+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.18746","last_updated":"2025-12-21T14:26:14Z","snapshot_observed_at":"2026-07-06T22:39:43.359149Z","submitted_at":"2025-12-21T14:26:14Z","title":"MemEvolve: Meta-Evolution of Agent Memory Systems","version":1},"cited_work":{"arxiv_id":"2512.18746","doi":"10.48550/arxiv.2512.18746","metadata_source":"pith","pith_arxiv_id":"2512.18746","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"MemEvolve: Meta-Evolution of Agent Memory Systems","venue":"cs.CL","work_id":"69fd3342-cd0c-43d2-b12c-2d266dc000b2","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2512.18746","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:588918282658e6e5b16c3b219f45310086b79b56ff40db7e10a3115a3f4a161b","observation_id":"662956d9-6f95-4658-95b3-911ec4ab7f15","resolution":{"observed_at":"2026-05-15T22:18:15.377574Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T09:14:47.677823Z","title":"Expel: Llm agents are experiential learners","venue":null,"work_id":"55f72706-b61e-4ecd-aed4-86d9d2d2e906","year":2024},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:c24499acb1d8d7e98444ae2332903e67f4bc4040517c16673d7f50f503adcb3d","observation_id":"ceb3aabb-b435-497d-bc62-28752b1c4be3","resolution":{"observed_at":"2026-05-22T03:56:02.637560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Autoguide: Automated generation and selection of state-aware guidelines for large language model agents","venue":null,"work_id":"f6b89339-ea94-4389-ac6f-b345a9139e28","year":2024},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:5d42c925c09583438ee246efc9629bb90a680b059c697d48507aa099e3071453","observation_id":"01e52578-8665-4e3a-9c1e-48f3b390e376","resolution":{"observed_at":"2026-05-22T03:56:02.622496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12110","last_updated":"2025-10-08T01:46:37Z","snapshot_observed_at":"2026-08-03T02:27:06.991396Z","submitted_at":"2025-02-17T18:36:14Z","title":"A-MEM: Agentic Memory for LLM Agents","version":11},"cited_work":{"arxiv_id":"2502.12110","doi":"10.48550/arxiv.2502.12110","metadata_source":"pith","pith_arxiv_id":"2502.12110","snapshot_observed_at":"2026-07-11T03:27:46.348461Z","title":"A-MEM: Agentic Memory for LLM Agents","venue":"cs.CL","work_id":"3b98feb2-fdb1-479a-bbe4-2c298a4592e2","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2502.12110","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:f51f56d1c67e1ae6a8fac7ac4fddc3222bb0ee46d84496422e8f387b4197942b","observation_id":"79c62f3d-2616-43fc-a395-4b189b0be422","resolution":{"observed_at":"2026-05-11T00:47:29.054201Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19413","last_updated":"2025-04-28T01:46:35Z","snapshot_observed_at":"2026-08-02T07:32:11.339534Z","submitted_at":"2025-04-28T01:46:35Z","title":"Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory","version":1},"cited_work":{"arxiv_id":"2504.19413","doi":"10.48550/arxiv.2504.19413","metadata_source":"pith","pith_arxiv_id":"2504.19413","snapshot_observed_at":"2026-07-11T03:27:46.512344Z","title":"Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory","venue":"cs.CL","work_id":"a5aed26c-a248-48b6-a59e-f7693fcb180a","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2504.19413","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:9d979d37d102ade9d75fb565e9d02a09638373fba375bb1c1cc90a45a077e016","observation_id":"8b112bc3-88b0-4f4b-9966-0327c1cd6161","resolution":{"observed_at":"2026-05-10T23:10:49.561366Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22954","last_updated":"2026-03-12T23:47:40Z","snapshot_observed_at":"2026-07-06T21:32:33.515702Z","submitted_at":"2025-05-29T00:26:15Z","title":"Darwin Godel Machine: Open-Ended Evolution of Self-Improving Agents","version":3},"cited_work":{"arxiv_id":"2505.22954","doi":"10.48550/arxiv.2505.22954","metadata_source":"pith","pith_arxiv_id":"2505.22954","snapshot_observed_at":"2026-07-10T21:27:35.728535Z","title":"Darwin Godel Machine: Open-Ended Evolution of Self-Improving Agents","venue":"cs.AI","work_id":"c0d964a0-02a1-4ee2-a596-028489ba753f","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2505.22954","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:14b011a1dacf95ff74289e497df84dc28463dc780e4d78183e15c958441ac6aa","observation_id":"32b0ea56-4b4c-40ba-8354-ee0b55937d18","resolution":{"observed_at":"2026-05-16T04:41:03.163713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:19.626419+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:19.626419+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07079","last_updated":"2025-04-09T17:51:50Z","snapshot_observed_at":"2026-07-06T21:06:50.056353Z","submitted_at":"2025-04-09T17:51:50Z","title":"SkillWeaver: Web Agents can Self-Improve by Discovering and Honing Skills","version":1},"cited_work":{"arxiv_id":"2504.07079","doi":"10.48550/arxiv.2504.07079","metadata_source":"pith","pith_arxiv_id":"2504.07079","snapshot_observed_at":"2026-07-10T13:57:07.041797Z","title":"SkillWeaver: Web Agents can Self-Improve by Discovering and Honing Skills","venue":"cs.AI","work_id":"72b1aff0-91c3-4500-abc9-22129ca67748","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2504.07079","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:79c622f748d463dc8d842ef0330d1ab8eb83c48912ee1e000f73bde6311d1ea5","observation_id":"c0f7519b-80d9-4900-aad4-f6c105090e24","resolution":{"observed_at":"2026-05-14T19:35:55.589248Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08197","last_updated":"2025-02-26T03:24:58Z","snapshot_observed_at":"2026-07-06T19:31:23.072307Z","submitted_at":"2024-10-10T17:58:44Z","title":"From Exploration to Mastery: Enabling LLMs to Master Tools via Self-Driven Interactions","version":2},"cited_work":{"arxiv_id":"2410.08197","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.08197","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"From exploration to mastery: Enabling llms to master tools via self-driven interac- tions.arXiv preprint arXiv:2410.08197","venue":null,"work_id":"53da160d-5141-487e-a538-83f6112dc86b","year":2024},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2410.08197","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:143060099ae375e861b5b5d333036a6bb1973b6ed5f6b0f562f5593bf98b3c51","observation_id":"8e08c3d4-49bc-47e3-85a1-d889b57b9c05","resolution":{"observed_at":"2026-05-10T12:10:23.497270Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03439","last_updated":"2025-03-29T13:27:51Z","snapshot_observed_at":"2026-08-02T05:11:07.020968Z","submitted_at":"2024-10-04T13:52:32Z","title":"ToolGen: Unified Tool Retrieval and Calling via Generation","version":3},"cited_work":{"arxiv_id":"2410.03439","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03439","snapshot_observed_at":"2026-07-04T13:39:50.602618Z","title":"Toolgen: Unified tool retrieval and calling via generation","venue":null,"work_id":"6909f198-cead-46c7-9f60-286ef1b54096","year":2024},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2410.03439","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:2615333badb900b27f4c9af491b7cac17650954953217586d9397aa5152f1dc7","observation_id":"d9f8a8ca-5035-4450-912d-7044c6f54ea2","resolution":{"observed_at":"2026-05-10T12:10:23.375986Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.08558","last_updated":"2026-05-24T21:56:11Z","snapshot_observed_at":"2026-08-04T10:47:54.049813Z","submitted_at":"2025-10-09T17:59:17Z","title":"Agent Learning via Early Experience","version":3},"cited_work":{"arxiv_id":"2510.08558","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.08558","snapshot_observed_at":"2026-07-04T20:00:07.735443Z","title":"arXiv preprint arXiv:2510.08558 , year=","venue":"cs.AI","work_id":"f0d69349-a2c2-4250-8431-82719c22096f","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2510.08558","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:9fb6995ce7128fe7dc2594e1a0e3c2d502d2cd95f7833b4d79a6ab95f6dc7de7","observation_id":"0dd1f92d-876a-4411-bec9-2be34833247e","resolution":{"observed_at":"2026-05-26T03:04:06.268577Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21024","last_updated":"2025-08-21T05:55:43Z","snapshot_observed_at":"2026-07-06T21:16:36.894196Z","submitted_at":"2025-04-23T02:54:31Z","title":"WebEvolver: Enhancing Web Agent Self-Improvement with Coevolving World Model","version":2},"cited_work":{"arxiv_id":"2504.21024","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.21024","snapshot_observed_at":"2026-07-04T17:50:00.061649Z","title":"Webevolver: Enhancing web agent self-improvement with coevolving world model","venue":null,"work_id":"8649f9a0-9fc5-4a04-a2ac-45e2537dd314","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2504.21024","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:fec484b04b613ce6ca31bb497275f7f90592d0becb9fa8a4a5b10c87dd9b3d4c","observation_id":"112e82ec-4649-46d1-bbc9-c81e6ce1c8d7","resolution":{"observed_at":"2026-05-10T12:10:23.463113Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15651","last_updated":"2025-06-18T17:29:19Z","snapshot_observed_at":"2026-07-06T21:44:22.901650Z","submitted_at":"2025-06-18T17:29:19Z","title":"AutoRule: Reasoning Chain-of-thought Extracted Rule-based Rewards Improve Preference Learning","version":1},"cited_work":{"arxiv_id":"2506.15651","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.15651","snapshot_observed_at":"2026-07-04T08:09:40.705912Z","title":"Autorule: Reasoning chain-of-thought extracted rule-based rewards improve preference learning","venue":null,"work_id":"b8f39669-586f-4bf6-b41c-7e80bfca8595","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2506.15651","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:9f0c76635e514d85920c07aa788161f7f63e128afeacd106daba22f4d9ffe73d","observation_id":"0ca00ec7-4d2a-4e55-9fcd-e12388adae42","resolution":{"observed_at":"2026-05-10T12:10:23.451741Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20073","last_updated":"2025-05-26T17:19:30Z","snapshot_observed_at":"2026-07-06T21:15:59.063396Z","submitted_at":"2025-04-24T17:57:08Z","title":"RAGEN: Understanding Self-Evolution in LLM Agents via Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2504.20073","doi":"10.18653/v1/2025.acl-long.887","metadata_source":"pith","pith_arxiv_id":"2504.20073","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"RAGEN: Understanding Self-Evolution in LLM Agents via Multi-Turn Reinforcement Learning","venue":"cs.LG","work_id":"b96383ee-f8dc-471f-aba4-bc5ce9b0b632","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2504.20073","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:93768b4e277a0f13fb6a35ad683682af68d8a26e9915d91da5e5b8ac37afc38c","observation_id":"c5e44bd2-d50e-4964-b7d9-a0d1b125defe","resolution":{"observed_at":"2026-05-13T07:13:34.687091Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10893","last_updated":"2025-01-18T22:34:41Z","snapshot_observed_at":"2026-07-06T20:22:59.218985Z","submitted_at":"2025-01-18T22:34:41Z","title":"Learn-by-interact: A Data-Centric Framework for Self-Adaptive Agents in Realistic Environments","version":1},"cited_work":{"arxiv_id":"2501.10893","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.10893","snapshot_observed_at":"2026-07-04T14:29:53.362828Z","title":"Learn-by- interact: A data-centric framework for self-adaptive agents in realistic environments","venue":null,"work_id":"e0666af5-f5e5-46fc-b433-23777650da7d","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2501.10893","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:cbeeca403365d4d8b4594d80c6e265f242ac6deae93b339cd29547af24eea8ce","observation_id":"f34256b5-d1c3-4530-a970-0f95b022aaca","resolution":{"observed_at":"2026-05-10T12:10:23.455390Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.14438","last_updated":"2026-04-29T01:14:03Z","snapshot_observed_at":"2026-07-06T22:32:47.087967Z","submitted_at":"2025-10-16T08:37:42Z","title":"WebAggregator: Enhancing Compositional Reasoning Capabilities of Deep Research Agent Foundation Models","version":2},"cited_work":{"arxiv_id":"2510.14438","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.14438","snapshot_observed_at":"2026-07-03T10:27:56.469481Z","title":"WebAggregator: Enhancing Compositional Reasoning Capabilities of Deep Research Agent Foundation Models","venue":"cs.CL","work_id":"7a3011ea-9e47-48fc-b18e-11bb9acf0f96","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2510.14438","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:b9dd3404d7a3c7d2b5b6dc61d655679f0fd59466884832356a66bcd0896d611e","observation_id":"20cf6747-81f8-4cc0-b435-2a0115ac8bf7","resolution":{"observed_at":"2026-05-10T12:10:23.472158Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"cited_work":{"arxiv_id":"2601.15808","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.15808","snapshot_observed_at":"2026-07-09T03:45:55.587604Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","venue":"cs.AI","work_id":"4f60793b-7628-4e88-a712-def1ddd07b59","year":2026},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2601.15808","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:d36b5ddcd343aa646e277d62940619db3a4871c97025ee6540866b87164b20d6","observation_id":"f72d902f-f82e-445b-88b4-4500d7bcc4df","resolution":{"observed_at":"2026-05-10T12:10:23.484189Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.24684","doi":"10.48550/arxiv.2510.24684","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Spice: Self-play in corpus environments improves reasoning","venue":null,"work_id":"7bf84ba5-f40a-459f-b34c-8a73545856b4","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:c5dba92a9a9fb6c66357b6a66abca891aa13cf5378b05710d8fb6ed9ba86de34","observation_id":"4fb95ba2-e076-4cac-beab-8f23ec107d44","resolution":{"observed_at":"2026-05-10T12:10:23.381309Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-23T21:53:00.867858+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T21:53:00.867858+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.05004","last_updated":"2026-02-13T18:53:32Z","snapshot_observed_at":"2026-07-06T22:09:08.864232Z","submitted_at":"2025-08-07T03:38:16Z","title":"R-Zero: Self-Evolving Reasoning LLM from Zero Data","version":4},"cited_work":{"arxiv_id":"2508.05004","doi":"10.48550/arxiv.2508.05004","metadata_source":"pith","pith_arxiv_id":"2508.05004","snapshot_observed_at":"2026-07-10T18:17:33.697242Z","title":"R-Zero: Self-Evolving Reasoning LLM from Zero Data","venue":"cs.LG","work_id":"45b39aae-1151-4087-9b48-dd16313e6306","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2508.05004","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:17ecf415ac0fc0502b57b4ca3b420579b7595176e5c1c48e80f75d88feedc2c9","observation_id":"fb71f621-e6c8-4b55-ae8b-dba0204d34ac","resolution":{"observed_at":"2026-05-14T19:23:29.765778Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-23T21:53:06.742139+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T21:53:06.742139+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01716","last_updated":"2025-06-02T14:23:33Z","snapshot_observed_at":"2026-07-06T21:35:03.439393Z","submitted_at":"2025-06-02T14:23:33Z","title":"Self-Challenging Language Model Agents","version":1},"cited_work":{"arxiv_id":"2506.01716","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01716","snapshot_observed_at":"2026-07-04T20:40:08.275113Z","title":"arXiv:2506.01716 [cs] doi:10","venue":null,"work_id":"f17aef0d-21ef-4877-b0a2-e7492e1d481f","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2506.01716","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:b6b982332f4b9cf2a22302b5da1a654e5b742955eb6cf54b15c4bc08d03b80a1","observation_id":"c40d748a-1a6a-45f1-b923-dca4511200a7","resolution":{"observed_at":"2026-05-10T12:10:23.528665Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08827","last_updated":"2025-08-06T23:51:16Z","snapshot_observed_at":"2026-08-03T03:40:47.819174Z","submitted_at":"2025-05-12T23:51:04Z","title":"RLSR: Reinforcement Learning from Self Reward","version":2},"cited_work":{"arxiv_id":"2505.08827","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.08827","snapshot_observed_at":"2026-07-08T21:25:38.647436Z","title":"Omkar Thawakar, Dinura Dissanayake, Ketan More, Ritesh Thawkar, Ahmed Heakl, Noor Ahsan, Yuhao Li, Mohammed Zumri, Jean Lahoud, Rao Muhammad Anwer, et al","venue":"cs.LG","work_id":"456391de-7d99-4030-bc68-6b40bd8f35ff","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2505.08827","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:222fc73abadefd4d574d168d15816ec86086e50f52f51694ca1d3d255f176b45","observation_id":"b784f6f3-78d9-4dde-b611-bb52576ec7e8","resolution":{"observed_at":"2026-05-10T12:10:23.385138Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.07055","last_updated":"2026-07-21T08:07:01Z","snapshot_observed_at":"2026-08-03T11:19:27.879157Z","submitted_at":"2026-01-11T20:27:55Z","title":"Dr. Zero: Self-Evolving Search Agents without Training Data","version":2},"cited_work":{"arxiv_id":"2601.07055","doi":"10.48550/arxiv.2601.07055","metadata_source":"arxiv_reference","pith_arxiv_id":"2601.07055","snapshot_observed_at":"2026-07-22T03:22:03.468610Z","title":"Dr. zero: Self- evolving search agents without training data","venue":null,"work_id":"93485690-3255-4a12-a3e9-249f4fe7ad80","year":2026},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2601.07055","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:1f9fb4ca3b1654027e478e4e73a0af04ff55116be0070523027d2c6c00c28561","observation_id":"7c6352e8-f8e1-4f74-bb39-cd9da20a8999","resolution":{"observed_at":"2026-07-22T03:22:03.468610Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Test-time training with self-supervision for generalization under distribution shifts","venue":null,"work_id":"9ff57c6a-d0bf-4080-9589-522d29413a6a","year":2020},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:89c5f52698cfa14c17cfbaa397c65b66b53629762dd1e01abe63f9eafc7a0955","observation_id":"82ab8871-8a53-437e-80f6-67f5ea3fd3c1","resolution":{"observed_at":"2026-05-22T03:56:02.597526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23735","last_updated":"2025-05-29T17:57:16Z","snapshot_observed_at":"2026-07-06T21:33:07.415628Z","submitted_at":"2025-05-29T17:57:16Z","title":"ATLAS: Learning to Optimally Memorize the Context at Test Time","version":1},"cited_work":{"arxiv_id":"2505.23735","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23735","snapshot_observed_at":"2026-07-04T19:30:07.282576Z","title":"Atlas: Learning to optimally memorize the context at test time.arXiv preprint arXiv:2505.23735, 2025a","venue":null,"work_id":"88ad83a5-1a41-49a6-a975-2d9374634987","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2505.23735","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:2de637e9a1d4a6ec850ab57af68723ba62f4243864f618fb07b9c37de4b18e2d","observation_id":"939b283f-c44a-4a6f-9de8-66075a7d0af4","resolution":{"observed_at":"2026-05-10T12:10:23.480004Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00663","last_updated":"2024-12-31T22:32:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-31T22:32:03Z","title":"Titans: Learning to Memorize at Test Time","version":1},"cited_work":{"arxiv_id":"2501.00663","doi":"10.1016/j.est.2015.06.001","metadata_source":"pith","pith_arxiv_id":"2501.00663","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Titans: Learning to Memorize at Test Time","venue":"cs.LG","work_id":"fb2b7625-b733-43cb-af52-00b0a31a8d7f","year":2024},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2501.00663","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:5b0f49682ee62f9baf7a9e0959cb2d5da5a0addfed372a5ef01b7565007acd76","observation_id":"874e0c24-2587-4a71-88a0-93625cf750da","resolution":{"observed_at":"2026-05-14T22:08:15.778565Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-25T06:55:03.802588+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T06:55:03.802588+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.24695","doi":"10.48550/arxiv.2512.24695","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"arXiv preprint arXiv:2512.24695 , year=","venue":null,"work_id":"faa7da49-a9f6-4714-a8c8-5692f267f0b1","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:8f952885bef972244b4440906fbfd10f4e34feff2df070d9954f3e614b911906","observation_id":"61b4941e-a2eb-4f7d-94a6-c6c9ad753b08","resolution":{"observed_at":"2026-05-10T12:10:23.394732Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04620","last_updated":"2025-08-31T18:32:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-05T16:23:20Z","title":"Learning to (Learn at Test Time): RNNs with Expressive Hidden States","version":4},"cited_work":{"arxiv_id":"2407.04620","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.04620","snapshot_observed_at":"2026-07-09T18:46:26.563289Z","title":"Learning to (Learn at Test Time): RNNs with Expressive Hidden States","venue":"cs.LG","work_id":"c682430c-e7a2-4699-b82d-55287448dbba","year":2024},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2407.04620","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:0582161282cd3d4dbab3e58f5d49c3a86d2c751abec684dc75c790a5df5b7924","observation_id":"58c25473-602a-4c5c-aaf7-23436528b467","resolution":{"observed_at":"2026-05-15T05:20:12.625336Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11504","last_updated":"2024-09-11T02:22:58Z","snapshot_observed_at":"2026-07-06T17:18:28.323349Z","submitted_at":"2024-01-21T14:28:41Z","title":"With Greater Text Comes Greater Necessity: Inference-Time Training Helps Long Text Generation","version":3},"cited_work":{"arxiv_id":"2401.11504","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.11504","snapshot_observed_at":"2026-06-30T11:34:37.966981Z","title":"With greater text comes greater necessity: Inference-time training helps long text generation","venue":null,"work_id":"7137ae57-b629-4533-9ac8-50a46e826150","year":2024},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2401.11504","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:3b531540036eb74ab27f120807147770d3055d6b0093c4dfc6ad509257e52485","observation_id":"04b2e987-b6ec-4e41-95a6-d3c2f25f8008","resolution":{"observed_at":"2026-05-10T12:10:23.370274Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.21204","last_updated":"2026-05-12T22:37:21Z","snapshot_observed_at":"2026-08-03T04:44:07.548954Z","submitted_at":"2026-02-24T18:59:30Z","title":"Test-Time Training with KV Binding Is Secretly Linear Attention","version":4},"cited_work":{"arxiv_id":"2602.21204","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.21204","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Test-Time Training with KV Binding Is Secretly Linear Attention","venue":"cs.LG","work_id":"ca22be31-6774-43aa-aa2b-3a059b6e4c71","year":2026},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2602.21204","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:0ce6c5d1aa27348972125bdb5cac7fe5edfc06be0df986a27f697e66a444cf9b","observation_id":"4b1c9e7b-606c-4e76-9206-6aa4c7b3e169","resolution":{"observed_at":"2026-05-10T12:10:23.390076Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.05085","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T13:46:58.717211Z","title":"Locas: Your models are principled initializers of locally-supported parametric memories","venue":null,"work_id":"0c78c2cf-cd03-4db8-b4d3-d5b30775bdbe","year":2026},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:251be2bce1d6aa49ef8024c04135395628ad83a802f754d9b42a7375fd8890cd","observation_id":"93921f84-0d4b-4461-9eba-c54a805fa90a","resolution":{"observed_at":"2026-05-10T12:10:23.537277Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19475","last_updated":"2025-05-28T11:04:19Z","snapshot_observed_at":"2026-07-06T21:30:18.842268Z","submitted_at":"2025-05-26T03:54:47Z","title":"Continuous Self-Improvement of Large Language Models by Test-time Training with Verifier-Driven Sample Selection","version":2},"cited_work":{"arxiv_id":"2505.19475","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19475","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Continuous self-improvement of large language models by test-time training with verifier-driven sample selection.arXiv preprint arXiv:2505.19475","venue":null,"work_id":"a234dca2-f1c6-43d0-9a55-f0c3998dc969","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2505.19475","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:6a02f0280d320b10b4c34d81fbc20b71b9d558a968d5753e2aedb180e3c469ad","observation_id":"8c8461f9-393c-4608-9713-a5662f24200b","resolution":{"observed_at":"2026-05-10T12:10:23.467718Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20633","last_updated":"2025-05-27T02:18:59Z","snapshot_observed_at":"2026-08-04T06:54:42.095340Z","submitted_at":"2025-05-27T02:18:59Z","title":"Test-Time Learning for Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.20633","doi":"10.48550/arxiv.2505.20633","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20633","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Test-time learning for large language models","venue":null,"work_id":"70f2ec46-5ef6-47ed-a3a6-7bb1de9b7ed6","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2505.20633","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:b3162bc7507472e24ba697f5f1e5f597deaf14d44e138481a51dafd1f712a13b","observation_id":"60c42b99-93bb-4f17-9b2a-f1923f7ff9c3","resolution":{"observed_at":"2026-05-10T12:10:23.437950Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.559100Z","title":"Efficient memory management for large language model serving with pagedattention","venue":null,"work_id":"f1c67e7b-467e-4e0d-a0c7-c8c828f12738","year":2023},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:47ba63c2162e7a261b53bb7bb58934cdc69adc0c0a3a44724377936a488e9594","observation_id":"7ea67f49-1638-48a8-a956-4cb00ac93677","resolution":{"observed_at":"2026-05-22T03:56:02.544228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deepspeed-inference: enabling efficient inference of transformer models at unprecedented scale","venue":null,"work_id":"b6d11f3e-3d1a-477e-bee7-12ea70fda0e1","year":2022},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:a43cc98474f9502447ae6356ffb2a1bce6c3fc890bfed480a00beb5312d4c1b3","observation_id":"bd6beac7-a794-4e22-86a3-63b8b663881a","resolution":{"observed_at":"2026-05-22T03:56:02.608333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.00414","last_updated":"2026-04-22T08:14:17Z","snapshot_observed_at":"2026-08-02T16:42:25.825514Z","submitted_at":"2025-08-01T08:11:31Z","title":"Cognitive Kernel-Pro: A Framework for Deep Research Agents and Agent Foundation Models Training","version":3},"cited_work":{"arxiv_id":"2508.00414","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.00414","snapshot_observed_at":"2026-07-10T17:27:26.693631Z","title":"Cognitive Kernel-Pro: A Framework for Deep Research Agents and Agent Foundation Models Training","venue":"cs.AI","work_id":"37a98a38-d257-4ac7-a1c5-0a5b207f5e2b","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2508.00414","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:877c40b8bd21ad98f1b6a5c3289cb8612a760c86b733c60fc552e20261e3ae7f","observation_id":"2b57d1bc-1841-4ffc-a430-540c486ca2cd","resolution":{"observed_at":"2026-05-10T12:10:23.410135Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T06:34:42.387207Z","title":"Qwen2.5: A party of foundation models, September 2024","venue":null,"work_id":"6c796970-6476-4183-926b-4a42316e5ea6","year":2024},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:bb27bebb490f6fe68547db919bc411329340508b72a5f6e5c814ec3fefdeb41e","observation_id":"2501b603-95ae-4d8c-a412-3444d69b1b1c","resolution":{"observed_at":"2026-05-22T03:56:02.615015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"gpt-oss-120b and gpt-oss-20b model card","venue":null,"work_id":"f50aec5a-c56f-4629-96fb-fa91b60f15b9","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:05f73254927fc95629ae30b602c16e356719069fbcd6431e4b860c997367f56c","observation_id":"ab100d05-7a66-4adc-8e9e-67de88882312","resolution":{"observed_at":"2026-05-22T03:56:02.590859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20534","last_updated":"2026-02-03T04:57:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-28T05:35:43Z","title":"Kimi K2: Open Agentic Intelligence","version":2},"cited_work":{"arxiv_id":"2507.20534","doi":"10.1145/3448609","metadata_source":"pith","pith_arxiv_id":"2507.20534","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Kimi K2: Open Agentic Intelligence","venue":"cs.LG","work_id":"7f18284c-12d3-4137-bea1-1da97e8cf3c1","year":2025},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2507.20534","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:d57fcc4d0a7aae6f5df8f52b68b1240d954398d266d034f682bb8ad6af1031cd","observation_id":"393c8e84-5ab1-4fe2-9b43-4cda744dad59","resolution":{"observed_at":"2026-05-10T17:49:28.234076Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-25T01:23:16.170083+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T01:23:16.170083+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Feel free to choose any category that seems underdeveloped or has interesting URLs you haven’t explored yet","venue":null,"work_id":"788b522d-5522-43d3-8c83-868e2ea72feb","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:b0cd964c667b417727e155e20ce1e04a6172edd6e32a5ae484051e8f4bb31aad","observation_id":"0d6c6fcb-0e11-416f-98df-b0e2d073817b","resolution":{"observed_at":"2026-05-22T03:56:02.577891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a7d4627c-5161-453c-bc29-927b03c90c59","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:818b8d9663e670910608293640452a91cbd7bb62ab5b100251c412d07aeff313","observation_id":"66b87b25-1d12-4804-ab2f-8d9b53b7cafd","resolution":{"observed_at":"2026-05-22T03:56:02.584824Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Please rely on the actual webpage content to inspire your expansion and ensure accuracy","venue":null,"work_id":"467a201d-75f3-42d9-b846-a0566a815842","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:479ea001b2970f12105bbce1cdab209eb26cbedf05109e1d0f5bc28fd4faec13","observation_id":"be7619ac-8580-4da6-b1fd-761d2aad5bf3","resolution":{"observed_at":"2026-05-22T03:56:02.570079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"You can expand summaries, add new page entries, or provide deeper insights to make the section richer and more comprehensive","venue":null,"work_id":"0f80d6c9-3aea-45cd-bfc3-1cf364bb05f5","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:d3c027c8d272e9e1039e34c7abc21131a78eee8a96ea33e44c1ce19ebeacdc5a","observation_id":"c6470a4c-acf3-4f37-8d7e-8d2fbf6e2096","resolution":{"observed_at":"2026-05-22T03:56:02.566494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b6a7b105-08ef-4613-abb7-2a1149946062","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:88ff9ef72815f732b25a82b62f4a6b5c9de082f03a50a6ba58d8f7b1f6b57df8","observation_id":"34d3c242-89b7-4eff-a399-a2e72e4a6127","resolution":{"observed_at":"2026-05-22T03:56:02.562047Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Continue this exploration process until your guidebook reaches at least{min_token}tokens","venue":null,"work_id":"354c9268-b1d9-4787-b3ae-04d42bb49a2e","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:e0dae862d0e0045b8a6f3ffa0758b170a28e51f754b48b01f02fb08137b4e63d","observation_id":"176fa36e-3c89-4ec3-915c-d787f0176794","resolution":{"observed_at":"2026-05-22T03:56:02.573942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4ab442a7-226b-4801-a153-db40d99045ae","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:589f71e79888a3db91b9ace5f991869f4ca06845ac5695335cb0681955e9060c","observation_id":"f16c0a29-8118-4c8b-bdba-d9bc90b9e5ad","resolution":{"observed_at":"2026-05-22T03:56:02.625858Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f3f27851-8144-445d-baa3-663139108cbf","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:9a2f57fe5e837e47d380ec8df0894a0c1794db7fa9cdfae967638f61d6b6d010","observation_id":"a2a194c1-23f9-40d9-b412-d44d94ac72f3","resolution":{"observed_at":"2026-05-22T03:56:02.648018Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Repeat until all categories are done","venue":null,"work_id":"0ef843cb-d2db-4963-83e6-299b57d43b88","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:f32d2607f831232d723829ec221d74a58e23646208ff667ef85de41aa2cd4396","observation_id":"96babc0c-5e11-4181-a351-15ffde95257f","resolution":{"observed_at":"2026-05-22T03:56:02.662219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"If it exceeds {token_limit}, compress verbose sections withrewrite_category_section()","venue":null,"work_id":"185bcc3b-3e35-4f02-bfa1-b1d8d9677d25","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:db289ed83dadc236603655a8757312f44b6d52aa84704b46876a6799a8546e18","observation_id":"b3f85665-9d0f-41db-831c-d867fdfaebf0","resolution":{"observed_at":"2026-05-22T03:56:02.539974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2f829a15-9a25-400a-a2cc-baa2528a93f9","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:4be379f6b428d63e76f1755f37e5cf8851872ffbc18ed80ae307f8457781800d","observation_id":"52f7dd9d-b83f-4472-8836-d4534bf03178","resolution":{"observed_at":"2026-05-22T03:56:02.651497Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"43283b6d-a877-47d9-ad25-730df7ff3579","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:3187f3192fcd9cccc3fa4df9ff129ef9b8c26502f66af1441aea418c69f322e1","observation_id":"71e57e94-1c54-4ed9-91a7-bdc25a6f3674","resolution":{"observed_at":"2026-05-22T03:56:02.547728Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c328cb50-30bd-45dd-8dd8-ff3131b6de0a","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:191947b77d72041adf7cc45e107fce7a1aeac8398fb40025b419c60af7986300","observation_id":"b235c5d9-f83c-4bae-b306-0d675ff11594","resolution":{"observed_at":"2026-05-22T03:56:02.640872Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a17935da-6386-482b-aec4-347c9f2941d8","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:c7104e270e3c82593bba586e64994f0351ce264de6f0959b1bf2ed5f6332843d","observation_id":"fd8eb59d-4cd6-4b22-ad41-272272998251","resolution":{"observed_at":"2026-05-22T03:56:02.604719Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1bb53d5e-2986-4e14-a284-6bd542d2bf65","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:4a3ddc9f9426123a990e65a3160315e10f50439cd256afd72bcc22c91959b804","observation_id":"79ae878d-7290-402c-9509-c52442384ef0","resolution":{"observed_at":"2026-05-22T03:56:02.558664Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b116e273-be9c-46f7-8229-bc090ffb2e2b","year":2024},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:303592672e779a022ece996eafd188be42d7ce161559d1cb799cfd25e5ac46a7","observation_id":"3f573d24-0b0d-4c1d-b78a-8410e19e9e02","resolution":{"observed_at":"2026-05-22T03:56:02.536029Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e3e92742-d018-4bf2-a6be-453e4a8b18cf","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:7b12cdcb05918c598b94361717c042605c6913998d68303608ee3ecc7ee4b221","observation_id":"351bdc7b-7cf4-44d2-a676-ce1ad58446b3","resolution":{"observed_at":"2026-05-22T03:56:02.555065Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5c813b5a-d9a4-44e7-a08a-d8be26eee467","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:15688fb39b2a7a5d21e433f589e833bc0fc118fbe263087603f3d2d86a2d8da0","observation_id":"ccdfe041-528d-4f90-8a68-ae1cb642b913","resolution":{"observed_at":"2026-05-22T03:56:02.528844Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evaluation rules","venue":null,"work_id":"8a8d84dc-afc7-469a-b0ce-87980be20979","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:33fc3f01095a4a8c43bbd91b6d49cd8f4f8f09d6dee67d4717ec6abbd3f8d71c","observation_id":"bbfefa89-6bcb-4a11-bf45-8a4c089eff42","resolution":{"observed_at":"2026-05-22T03:56:02.581469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"be427e13-a5dd-469b-a794-7da828238e43","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:ea95ac155bd54aa50351d87653a8a8fcb55fff2970d961ef8b90313f1ed8b64c","observation_id":"d0c9c27e-c400-4fbc-9f6d-fe525f7fe2f4","resolution":{"observed_at":"2026-05-22T03:56:02.587623Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Do NOT assume missing information","venue":null,"work_id":"28baf5ce-c0fd-431c-beea-ca9a1a2bc24d","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:528393b76a999a792276bfa74b7aa600cccfac7432e52dff44fd148a4e10b391","observation_id":"375cfe5f-405c-4b2f-af46-98c3ef0d5366","resolution":{"observed_at":"2026-05-22T03:56:02.532431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4129cca9-d5f0-4c26-8fe6-5baf7ce777b0","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:ad618edd6d90cae795ee711f55e249e5a7c9f534088c04df77a801ccef2630b0","observation_id":"bf39d9e4-135c-4457-923e-5d74c286901f","resolution":{"observed_at":"2026-05-22T03:56:02.593973Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Missing any part leads to NOT SUCCESS","venue":null,"work_id":"f7e48466-b7fe-4172-aa5f-2c3c7e433b38","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:9045aeac345e2cf561f22df762a0443b55274ce079fddd9bdac67dd03c1d2dc5","observation_id":"3b898a50-bb3d-47c3-9db2-79c983262460","resolution":{"observed_at":"2026-05-22T03:56:02.618740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"aea1b896-a158-424e-bf18-ce37096641c8","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:994644f8db8ee1a0918fc0b44bf67a7089351507e2b14ad0581a87e9d1174417","observation_id":"ecbb0a0c-afc7-4239-9801-c92a676f3cd7","resolution":{"observed_at":"2026-05-22T03:56:02.611288Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9328e553-a6f4-4ce5-baca-c6c89ee07905","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:944aff7e499553948eeaec1cb06149669a5fadc5297b502a973143e8978ed7b2","observation_id":"438933b1-cc71-4fe6-a051-bd07cef1ddd4","resolution":{"observed_at":"2026-05-22T03:56:02.601411Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Instructions:You should briefly explain your reasoning before giving the final verdict","venue":null,"work_id":"ad012f87-0c1d-4ded-aa30-f867b238840c","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:51fe2813c6a601ea74e935e3579d2027ea3a682815556ebb291c07e9fe549bf7","observation_id":"d7a22fde-addd-4b6c-bd37-e334106b7f81","resolution":{"observed_at":"2026-05-22T03:56:02.551653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"933dda4b-74e5-42dc-b2bd-96d961f42eea","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:161ad3c073ad6a35612d49e7930e9592d879c589cde27dd0086ba0513bf4f749","observation_id":"658b7f15-dee3-415a-94e9-d44da434fca7","resolution":{"observed_at":"2026-05-22T03:56:02.520800Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"content summary","venue":null,"work_id":"62904921-47a5-4e8e-82c6-48109836ef8d","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:f6f87e0859e4dcdf123be463991c6fbfa8d2a10deee2939b932d88868aaccca0","observation_id":"649bee9c-9171-41e4-9714-66b2ec88bc0c","resolution":{"observed_at":"2026-05-22T03:56:02.525336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"content summary","venue":null,"work_id":"12ba8204-6f22-4017-bbdb-b98b04eb9be6","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:71a14a321aecccd49a909004806b7f428361d13e8952c1a9d08f083d9f3b4b61","observation_id":"1d32b665-8878-4ae6-9145-717d6996dc51","resolution":{"observed_at":"2026-05-22T03:56:02.644185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"About Us - Team Introduction","venue":null,"work_id":"e269b02e-6479-4d9d-a684-3bb25c1aecc6","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:841f720bb4ec0e8e6e818e5d64510da1eef62afbb615795cddaa11634278d32b","observation_id":"41de6431-8acb-43d0-a534-924bed26e4d0","resolution":{"observed_at":"2026-05-22T03:56:02.654833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In this case, you must decide to return to the [Main Page URL] to start looking for new clues from scratch","venue":null,"work_id":"c087f70b-b09c-423d-88ce-ca5392a84506","year":null},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:71226c5969efbaf5997cd9f51a64ff1e899e9ebdec68bb295d3316f5aeaabfed","observation_id":"2300fff7-852e-4bad-a06e-8613b565da7c","resolution":{"observed_at":"2026-05-22T03:56:02.658669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration"},"reference_resolution":{"displayed":81,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":17,"verified_exact":37,"verified_fuzzy":23},"total_outbound_references":81},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 81 of 81 outbound references and 1 inbound Pith citation observation for arXiv:2604.18131."}