{"as_of":"2026-08-05T13:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0da7fa1112154908463e8b04c438351807608406eae1086585db66aa4316e9f3","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T14:27:50.260308Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.02372/citation-record","integrity":"/paper/2606.02372/integrity","json":"/paper/2606.02372/citation-record.json","paper":"/paper/2606.02372"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:58ff5d6de57cbd10da566f8964be43bb73338bf0d3594013a1d0b60d93d69271","observation_id":"592d88b0-3acc-403c-b217-5aae4e96028a","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"and Le, Quoc V","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:36e55f9228765ba0cfb5120376b211497bbe9ef5280ec4790116307b52f1f710","observation_id":"e2708517-8215-45de-86a8-712f342b4e2b","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2600.2020","doi":"10.1109/cvpr42600.2020.000154","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer 25 Vision and Pattern Recognition, pp","venue":null,"work_id":"9da51225-b7bd-4032-b7db-ca577971dafe","year":2020},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:40682484f656aca4a98ec8f217424f9cecc294ebf29bb5b87ccc783d734f2993","observation_id":"a3f7b04b-b5d0-4b00-8a39-cd9852e5776e","resolution":{"observed_at":"2026-06-28T14:32:17.853200Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"S cience W orld: Is your Agent Smarter than a 5th Grader?","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:798019700ee891a74d123bc846dddacc9aa801db80915889fa5f4229ba859d78","observation_id":"56cbebcd-ec7e-4fa7-aac6-04b908ffa7e4","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:c2b3871ea56168147bb9ccf354f53f3755ab080bc1d492ab17df10c0cfe8fd5d","observation_id":"f6ea1aaf-171a-446d-9050-eabb7553d10e","resolution":{"observed_at":"2026-07-01T23:16:24.885748Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.15115","doi":"10.1145/3581783.3612503","metadata_source":"pith","pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5 Technical Report","venue":"cs.CL","work_id":"d8432992-4980-4a81-85c7-9fa2c2b87f85","year":2024},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:e0e2299c77e19d40462f231b533811276c316f474ffbba281be75826e5885e5c","observation_id":"c31ccf67-891e-4e7a-afdf-985e1829e9fc","resolution":{"observed_at":"2026-07-01T23:16:24.889022Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":"2407.10671","doi":"10.18653/v1/2024.naacl-long.246","metadata_source":"pith","pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2 Technical Report","venue":"cs.CL","work_id":"a1857881-ab9b-4b80-9b5f-9ae4b5c2566d","year":2024},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:b9a25727fdf647adb2bff7e01e489c3756471f0a0765e6aeeec6e40b8a51119c","observation_id":"81c39862-db4d-42ce-a088-26a5d8ba7fc7","resolution":{"observed_at":"2026-07-01T23:16:24.874924Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:87ba8660c0994bb36fe72c546ab60efdd56fc5e18ea455da54128d65ad420626","observation_id":"b3012bef-7146-403b-a358-98f4fd6257b8","resolution":{"observed_at":"2026-07-01T23:16:24.882110Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"2023 , html =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:4ea9c96cc8b6392c7bc144043604823ec511fd7acc529729e18a8496c97c850d","observation_id":"34b43788-e480-486a-8042-87a9e9222089","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-acl.604","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Findings of the","venue":null,"work_id":"05cebe88-6294-4f9f-9153-6d80935746b8","year":2025},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:292881e6519a21fbc4ac069053facf4371554f548ca2b1afbe1af6949e013967","observation_id":"e959e411-cd87-467b-b02c-d3e2fba3499b","resolution":{"observed_at":"2026-06-28T14:32:17.873827Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:756d5621693a8a76a6df10530511fffd27fb2427cb113f5c95fc27d72febf792","observation_id":"61747218-c581-42d7-bd3f-ff2c8a28ee43","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.409","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trial and error: Exploration- based trajectory optimization of LLM agents","venue":null,"work_id":"6ed76a90-a2b6-4e01-87b1-07263e66d208","year":2024},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:f9da7297848b4d0481e61ee455a5c7772a771f6f498f629ab8d2797223b2dcb9","observation_id":"9e8b46b5-0940-43b1-a369-51116a7cbb17","resolution":{"observed_at":"2026-06-28T14:32:17.859607Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T02:50:24.442065+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T02:50:24.442065+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.emnlp-main.93","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-level Process Refinement","venue":null,"work_id":"0f2e1301-e380-43ce-94a6-45e839505068","year":2024},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:ff95cfb60472e0479b2fd17e24e73ebb701db148bffe685fa5b8c854b0967c78","observation_id":"76f89884-2c92-4e71-96a6-b2819013c84c","resolution":{"observed_at":"2026-06-28T14:32:17.866306Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"Proceedings of the IEEE conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:1ba450e077afdd08ffbade7c485cb511c7f190762c098d64ad1d74813326d627","observation_id":"24e76ba3-a057-4edd-83b3-d148fec97472","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:933c75dd9c2eff4bc70774c6ccd92f4e3abf6e112e2106c80a69f21f1006c6f9","observation_id":"6d67faee-e2e0-4f25-a2b5-55937607e0a1","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"Transactions on Machine Learning Research , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:790beb8f3d9373a6e6dbe6b5ab046aeb7118e709dcca0ba065406cff90351000","observation_id":"80556699-0856-4e16-97f1-bcdab32edf65","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:f30af50e54b03ea33f3709cdaab2746fb01b44367c88a29d6519e08e2ea10999","observation_id":"1d4e5f1f-61ed-4f6a-99a4-76290e3ddc4c","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:3616f637097fe8b75e91eaa121f5fa02a449fa0f2819052924034a6492d2f24a","observation_id":"e2ef6de5-ec84-44d3-9e86-9da299b90348","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":"2301.04104","doi":"10.1126/sciadv.adu2488","metadata_source":"pith","pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mastering Diverse Domains through World Models","venue":"cs.AI","work_id":"6aeb260f-8c7c-4f9c-b98b-067cd7c59acd","year":2023},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:acf57f4518755885159756bbf51f94b1709b19fdf48d9497e804458e1368523e","observation_id":"460e0f56-f602-421b-bbd0-5ef885f55aee","resolution":{"observed_at":"2026-07-01T23:16:24.856641Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.acl-long.1044","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ISBN 979-8-89176-251-0","venue":null,"work_id":"799892c7-ba3e-41c2-90ea-0220787a7e35","year":2025},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:2354215fe2114b8f786cbd4450ffc78c400b053edae1f0d8c5ccaf1f64891572","observation_id":"29539f76-ee65-4b07-8fbd-fd314f3be267","resolution":{"observed_at":"2026-06-28T14:32:17.868283Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.507","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reasoning with language model is planning with world model","venue":null,"work_id":"59168056-5ef3-4558-8ed6-3024921b4fb3","year":2023},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:86668e4b9b34f37311aab2468ade7ecbc0ae7a216de4478795dd84738f390ec8","observation_id":"8685ffdc-48ce-404d-ba8c-3ba9f6bac4a3","resolution":{"observed_at":"2026-06-28T14:32:17.863966Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:37.824555+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:37.824555+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"2, 2022-06-27 , author=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:a40c619827728a34c851fade0cbac64f10576304aabe474527d6e8d15e935de1","observation_id":"a96fa9bf-5fb8-4039-a50c-ed2461d2aafe","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.22355","last_updated":"2025-07-07T15:42:11Z","snapshot_observed_at":"2026-07-06T21:48:45.170162Z","submitted_at":"2025-06-27T16:05:34Z","title":"Embodied AI Agents: Modeling the World","version":3},"cited_work":{"arxiv_id":"2506.22355","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.22355","snapshot_observed_at":"2026-07-04T11:29:51.053006Z","title":"Embodied AI Agents: Modeling the World","venue":null,"work_id":"54a68230-d29b-4113-96dc-ae0da1ebc38b","year":2025},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"cited_paper":"/paper/2506.22355","citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:ff567ea05c0b6e127f39d63e38c62c8f031b47564798bf7f477fc065e61bbee8","observation_id":"830b7493-9093-430f-9d56-a1602f1a5c68","resolution":{"observed_at":"2026-07-01T23:16:24.865257Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.emnlp-main.454","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W eb E volver: Enhancing Web Agent Self-Improvement with Co-evolving World Model","venue":null,"work_id":"2f44225d-b565-42a6-b32b-f7dde2507c4b","year":2025},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:99bcb24120fc8d97f45d2efdea14163c0c856c2bd98ab48b549c4e2b9a5b11d9","observation_id":"e93e7c95-1494-4d24-aac0-35532659fb6e","resolution":{"observed_at":"2026-06-28T14:32:17.857738Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.08558","last_updated":"2026-05-24T21:56:11Z","snapshot_observed_at":"2026-08-04T10:47:54.049813Z","submitted_at":"2025-10-09T17:59:17Z","title":"Agent Learning via Early Experience","version":3},"cited_work":{"arxiv_id":"2510.08558","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.08558","snapshot_observed_at":"2026-07-04T20:00:07.735443Z","title":"arXiv preprint arXiv:2510.08558 , year=","venue":"cs.AI","work_id":"f0d69349-a2c2-4250-8431-82719c22096f","year":2025},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"cited_paper":"/paper/2510.08558","citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:32efef856d585aa02557f5c119d04da1e49d0ba038861fbd4b922430ab17c313","observation_id":"37c3835c-7587-45f3-b4da-08b33bfee284","resolution":{"observed_at":"2026-07-01T23:16:24.862123Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:fdbce7c29db78ba9e6aa4f98fcbe6062ec62edd2db5808d87b2864038f6410ee","observation_id":"6ffe42a3-820f-485c-a9f8-b0608593b4bd","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-emnlp.448","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"E ^2 CL : Exploration-based Error Correction Learning for Embodied Agents","venue":null,"work_id":"d20d57e8-b88a-4bc9-880a-1fcfe3bd7bcc","year":2024},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:5cdde7803e08cf8e80776f08d9d3697cfbc2cd0f325b42018f144b2e35fb540f","observation_id":"e6e95a7e-df0a-44d1-a0be-01d2414379c6","resolution":{"observed_at":"2026-06-28T14:32:17.870127Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:085101f9de21e24fba36665d9001401e79387adcb00a867d009d48e4eec59be2","observation_id":"bda9057a-d22a-4ea4-89e3-4d7bccc8db14","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"The Thirty-ninth Annual Conference on Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:e2ab38ebc30986501eb81c3ca7418a03b3eed7c37276395f9ea2a73c88dbbabe","observation_id":"adea2fd2-ffa8-4e3b-9c14-dc222fb0d06d","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.15047","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T19:40:06.149325Z","title":"Internalizing world models via self-play finetuning for agentic RL.arXiv preprint arXiv:2510.15047","venue":null,"work_id":"f4defb5e-8e63-4dae-91bc-8581704f2ab3","year":2025},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:59cc8b6b2435030474febd0d7d7dad53fd0a982fe50c4bde4680afe9e2431f15","observation_id":"ee5d262d-73fd-4866-bd57-3d963b4fdbbf","resolution":{"observed_at":"2026-07-01T23:16:24.868517Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.18135","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T17:56:25.556592Z","title":"World-in-world: World models in a closed-loop world","venue":null,"work_id":"d4fadcbc-8645-49fa-8453-d804810c3428","year":2025},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:7f1955ff64bb82b19ebf86a1a9f7353ef11dbda39d79e6c06bf25f5b05b3ab0e","observation_id":"6bce61e4-efcb-428d-8a2f-8ace363db322","resolution":{"observed_at":"2026-07-01T23:16:24.871814Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"The Thirty-ninth Annual Conference on Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:6a900d81f30441e79b029abc4f39b1bb3e51f19cb9f275587ec47201b104b5c6","observation_id":"4f488945-d088-42b9-b7a9-1e91eeb1e0f5","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"Journal of Mathematical Analysis and Applications , volume=","venue":null,"work_id":null,"year":1965},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:976040c9b9cfa961239855886cbef71d70b014affc925b7b6dc08f58e0a27e68","observation_id":"3df2bf17-b51b-48ea-8eae-24aae8f8a73a","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11425","last_updated":"2025-03-24T10:18:56Z","snapshot_observed_at":"2026-07-06T20:23:22.709846Z","submitted_at":"2025-01-20T11:46:04Z","title":"Agent-R: Training Language Model Agents to Reflect via Iterative Self-Training","version":3},"cited_work":{"arxiv_id":"2501.11425","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.11425","snapshot_observed_at":"2026-07-09T13:56:19.181721Z","title":"Agent-r: Train- ing language model agents to reflect via iterative self-training","venue":"cs.AI","work_id":"96e9503b-b69c-42a2-920d-e67b3f95ab54","year":2025},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"cited_paper":"/paper/2501.11425","citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:8f0c670617e2e9d7e2263144d5b904893c7bb4a15d27ff6959c1a39082cf3b0f","observation_id":"ab2e037c-6af1-4670-ad6a-2f084ca6cb25","resolution":{"observed_at":"2026-07-01T23:16:24.851089Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"The Thirteenth International Conference on Learning Representations (ICLR) , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:e8dba4093750315a77fc32a2538f1fd35770ce247d8ebcd35a021cd2eff91cd1","observation_id":"ded509ee-ecd0-4801-82d9-129a6c15c27c","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.02556","last_updated":"2025-12-02T09:25:14Z","snapshot_observed_at":"2026-07-31T23:49:25.878472Z","submitted_at":"2025-12-02T09:25:14Z","title":"DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models","version":1},"cited_work":{"arxiv_id":"2512.02556","doi":"10.18653/v1/d18-1512","metadata_source":"pith","pith_arxiv_id":"2512.02556","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models","venue":"cs.CL","work_id":"07c85cc5-4086-4abc-823b-6d0f4ff784d0","year":2025},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"cited_paper":"/paper/2512.02556","citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:6f00825bfd925c1fed6870fea748c9a684245e20a22abb6361af13a9588dcb7c","observation_id":"239a0512-cfea-446f-8ea5-34574b876e54","resolution":{"observed_at":"2026-07-01T23:16:24.842873Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.18832","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T19:40:06.168340Z","title":"hallucinations","venue":null,"work_id":"32cca2ca-9dd4-4221-ac95-330f5d5d9fe1","year":2025},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:4db3ef5e7b6cf3a14d3588eb23d1c7621b924a6ec21060fadb94ff77d602328d","observation_id":"ef8abba5-6985-4d21-b199-954b308dd272","resolution":{"observed_at":"2026-07-01T23:16:24.859557Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:d8952397e7c1d81500260a00d2f0aeb3f0d69bc0a1ae4c426750a844464e6625","observation_id":"418615d7-b5c6-4671-964d-74f49596931f","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10978","last_updated":"2025-10-28T15:11:36Z","snapshot_observed_at":"2026-07-29T19:20:21.974239Z","submitted_at":"2025-05-16T08:26:59Z","title":"Group-in-Group Policy Optimization for LLM Agent Training","version":3},"cited_work":{"arxiv_id":"2505.10978","doi":"10.48550/arxiv.2505.10978","metadata_source":"pith","pith_arxiv_id":"2505.10978","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Group-in-Group Policy Optimization for LLM Agent Training","venue":"cs.LG","work_id":"bc65d492-e6ba-4522-874c-43d2f4fc5191","year":2025},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"cited_paper":"/paper/2505.10978","citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:79910f988020abdf98b1d02c74c052bb087b97e6df9bbf51f38c9ec926a4c4c8","observation_id":"642dd4a5-8929-4403-9a2e-6a19deb4134d","resolution":{"observed_at":"2026-07-01T23:16:24.845582Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20732","last_updated":"2025-05-27T05:21:04Z","snapshot_observed_at":"2026-07-06T21:31:06.662703Z","submitted_at":"2025-05-27T05:21:04Z","title":"SPA-RL: Reinforcing LLM Agents via Stepwise Progress Attribution","version":1},"cited_work":{"arxiv_id":"2505.20732","doi":"10.48550/arxiv.2505.20732","metadata_source":"pith","pith_arxiv_id":"2505.20732","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Spa-rl: Reinforcing llm agents via stepwise progress attribution","venue":"cs.CL","work_id":"bdf6b0d6-89db-4ff6-8ea9-29971abfcd69","year":2025},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"cited_paper":"/paper/2505.20732","citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:c5b21cb39092c0c5adeb05db16b676dd3ce86d737c806bea67754d40d8111066","observation_id":"c73e13c1-8c37-46c2-acd5-04a4f3a70e37","resolution":{"observed_at":"2026-07-01T23:16:24.853779Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:7100ed16814dd198272cf35b15af0df753c50cbf8e3da5cfbe601f9bffbab4ea","observation_id":"eff3736e-ae54-4ce2-9dca-f4f085091c60","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T12:32:09.130993Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":"2310.05915","doi":"10.48550/arxiv.2310.05915","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fireact: Toward language agent fine-tuning","venue":"arXiv (Cornell University)","work_id":"382904a8-a33f-42d0-ae77-b61c9f0cb7cb","year":2023},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:0722d3839eda27d99a317b73214605649609a9f57c0fccd662266891f0974b7a","observation_id":"64d64355-8c2a-4094-8ea1-bf6143d4dfe2","resolution":{"observed_at":"2026-07-01T23:16:24.848399Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-acl.664","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"StableToolBench: Towards Stable Large-Scale Benchmarking on Tool Learning of Large Language Models , booktitle =","venue":null,"work_id":"1aeceb1a-e2f8-4de5-8595-3eabd59d6a6c","year":2024},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:221c62e1b89c9269d40c0bfb406dbc9eebb7e3453aa83891beee78cf065ee43c","observation_id":"625a65c8-2f51-4e77-ba78-cc73bcefeacd","resolution":{"observed_at":"2026-06-28T14:32:17.861904Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-25T07:25:10.380452+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T07:25:10.380452+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"Griffiths and Yuan Cao and Karthik Narasimhan , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:1131d105ecaf22b3f8abf42dae1eb15fca1208bb71cd74f8ca4179919d496546","observation_id":"2dd16153-accb-4bfe-9bc9-63e83269880a","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/11871842_29","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bandit Based Monte- Carlo Planning","venue":"Lecture notes in computer science","work_id":"c0e981ee-9776-4ac8-ac29-06cf01b11696","year":2006},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:60a54f665b574db001c33f2491fc680902fb199e8934aa82c5a2501c2cfcc479","observation_id":"6f6dc489-95de-46e5-b53d-6b06669df510","resolution":{"observed_at":"2026-06-28T14:32:17.872057Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-14T11:49:50.223859+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T11:49:50.223859+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.08955","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T23:16:24.876887Z","title":"arXiv preprint arXiv:2601.08955 , year =","venue":null,"work_id":"2daa1b74-174d-47f5-951a-5294ddb98322","year":null},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:a52c8a757ed6a9b90accbaa3e95a666865915752987419bb3b5cc118e18564fd","observation_id":"da0cc049-1ff4-40c0-8b1a-9ad8a0a362e6","resolution":{"observed_at":"2026-07-01T23:16:24.878695Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:9d573531e88a237ac3234dba12b68f1f4e25a42ca50153b87f3fb04017a44447","observation_id":"c8174acc-f1b2-40b3-8cee-678fb32361f0","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"Frontiers of Computer Science , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:bce9688938b3d53c03d06ed589f3ecd040f116492a78512323659b04904d4023","observation_id":"ca082848-306b-4948-a8e3-40ffde446fac","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:af0f3a653b529fdaccb521d41aeac6d68205c2e57a69d82841a6f3d539c11b35","observation_id":"ee50a5c9-e90c-488d-97e6-8b0b60454394","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:2faf018497e13a4eb0ccd49d6b779eaae793d7d5ff3f5f78dee933743d23d4e7","observation_id":"53f7c989-0603-4141-a2ba-7a0440c09163","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"Findings of the Association for Computational Linguistics: EMNLP 2024 , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:0b3fb7350f7312d7a37bf7b54303292d8cc9fd080c2157e7f9228237520546ee","observation_id":"e76a7ce8-c029-43be-b855-457ceff6a965","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"2026 , month = mar, day =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:38d9aa18c434338f60c61d71e84964a138dd5d55ec03b94154646b969c378022","observation_id":"a8d46c1d-88fc-4e30-8777-e670b6df16aa","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.00626","last_updated":"2026-06-18T17:00:51Z","snapshot_observed_at":"2026-07-13T14:57:31.836214Z","submitted_at":"2026-04-01T08:32:34Z","title":"A Survey of On-Policy Distillation for Large Language Models","version":4},"cited_work":{"arxiv_id":"2604.00626","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.00626","snapshot_observed_at":"2026-07-10T00:26:39.257599Z","title":"A Survey of On-Policy Distillation for Large Language Models","venue":"cs.LG","work_id":"f6aaea8e-1f0d-43e3-b28f-6066d3e0a66b","year":2026},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"cited_paper":"/paper/2604.00626","citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:1c593891657970f9a0ca42d8d0cd073d8c958138dc95a7d0bc9535a451e381bb","observation_id":"1260d566-e990-490e-9897-6634ab23bf9d","resolution":{"observed_at":"2026-07-01T23:16:24.903694Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.10885","doi":"10.48550/arxiv.2602.10885","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2602.10885 , year=","venue":"Open MIND","work_id":"5d8fc15f-7645-43a2-a321-8f789d8d2d56","year":2026},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:9de7466d53c3e0e936d2b9570bec1ced33dec393aa2b6132341a8b6b67601ef6","observation_id":"134dd40d-0854-45d9-9c30-4fe8c5aa5f2a","resolution":{"observed_at":"2026-07-01T23:16:24.906998Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"2026 , howpublished =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:c887f06fc9fb2e9ba9d2c983bd924f1478e5ce51d3e6ef8e5c3197e498bceddf","observation_id":"1c64029c-b124-4b93-9742-f31c39b30054","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10134","last_updated":"2023-10-16T07:17:27Z","snapshot_observed_at":"2026-07-06T16:33:34.184498Z","submitted_at":"2023-10-16T07:17:27Z","title":"CLIN: A Continually Learning Language Agent for Rapid Task Adaptation and Generalization","version":1},"cited_work":{"arxiv_id":"2310.10134","doi":"10.48550/arxiv.2310.10134","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.10134","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Clin: A continually learning language agent for rapid task adaptation and generalization","venue":"arXiv (Cornell University)","work_id":"0fc7b135-d90d-461b-9ba7-f368a5158503","year":2023},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"cited_paper":"/paper/2310.10134","citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:db08c0e4aa63ba015f164e0ea23caa6341f084b8fee729fbdcfd186457b03516","observation_id":"842e1d8d-6e7e-4e85-9364-66442eb21dc5","resolution":{"observed_at":"2026-07-01T23:16:24.910742Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"2024 , eprint =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:dd163ec12641eaccc0ef8362237d6f427ecb10b28e0273ca67d2eafae364aee6","observation_id":"4b3626f4-db2c-4000-b3a3-abff3d4c29e6","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04151","last_updated":"2024-06-06T15:15:41Z","snapshot_observed_at":"2026-08-03T05:16:48.313052Z","submitted_at":"2024-06-06T15:15:41Z","title":"AgentGym: Evolving Large Language Model-based Agents across Diverse Environments","version":1},"cited_work":{"arxiv_id":"2406.04151","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.04151","snapshot_observed_at":"2026-07-08T04:04:29.283127Z","title":"Agentgym: Evolving large language model-based agents across diverse environments","venue":"cs.AI","work_id":"25d18264-9915-41ef-a01a-2290be48ba52","year":2024},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"cited_paper":"/paper/2406.04151","citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:8c4339ba32bc58a5b4cc516dc048a5cfc9cf8f3c07122256acc49a843568c5a0","observation_id":"cde52fbb-e5c7-4822-9c73-a604b322cb8c","resolution":{"observed_at":"2026-07-01T23:16:24.914814Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00533","last_updated":"2024-02-01T06:10:00Z","snapshot_observed_at":"2026-07-06T16:26:02.427780Z","submitted_at":"2023-10-01T00:52:24Z","title":"SELF: Self-Evolution with Language Feedback","version":4},"cited_work":{"arxiv_id":"2310.00533","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.00533","snapshot_observed_at":"2026-07-01T23:16:24.897833Z","title":"2310.00533 , archivePrefix =","venue":null,"work_id":"590e9125-9e76-42d4-87ed-d4e302d2bf85","year":null},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"cited_paper":"/paper/2310.00533","citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:0e0fbc11bfa80af3fa7fb26d3d03ecf897c5f6f4e164a24fd8161c2d89485588","observation_id":"a04e9254-d709-44fc-bc2e-66ba83586acf","resolution":{"observed_at":"2026-07-01T23:16:24.900057Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"2024 , eprint =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:babadd3a1aafe316c1e6f230cf2b42692368a1d85dc87bc2fb5097ff602b772c","observation_id":"7409ce49-bf73-4342-9170-66705b31eca7","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"2024 , eprint =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:930eacdad3bf0856000d8ad41143744581d13b2a4cb49b101bef8b4b67d4fa66","observation_id":"dd04e19f-f12b-458a-b4b2-618323de6f0c","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"2025 , url =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:8ca95e5639abe9a10d6ad104798ce12312eb4081e9503795f5c4bb065f68ac4e","observation_id":"e0f900a0-fbf9-4533-9fd8-babfa197f933","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.20987","last_updated":"2026-04-22T18:17:17Z","snapshot_observed_at":"2026-07-06T23:07:36.996629Z","submitted_at":"2026-04-22T18:17:17Z","title":"Co-Evolving LLM Decision and Skill Bank Agents for Long-Horizon Tasks","version":1},"cited_work":{"arxiv_id":"2604.20987","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.20987","snapshot_observed_at":"2026-07-03T14:28:31.253829Z","title":"Co-Evolving LLM Decision and Skill Bank Agents for Long-Horizon Tasks","venue":"cs.AI","work_id":"844eee2b-ca19-4955-82d2-f2da00daa0b1","year":2026},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"cited_paper":"/paper/2604.20987","citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:c44a3d58cb5a214316f7ee0b646c3672742e782e12add95c560571c5b526a252","observation_id":"8be31f00-38eb-4e04-8fcc-f70852be83f7","resolution":{"observed_at":"2026-07-01T23:16:24.896057Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.21725","last_updated":"2026-04-23T14:29:25Z","snapshot_observed_at":"2026-07-06T23:08:14.631453Z","submitted_at":"2026-04-23T14:29:25Z","title":"AEL: Agent Evolving Learning for Open-Ended Environments","version":1},"cited_work":{"arxiv_id":"2604.21725","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.21725","snapshot_observed_at":"2026-07-02T22:57:25.882212Z","title":"AEL: Agent Evolving Learning for Open-Ended Environments","venue":"cs.CL","work_id":"840da641-8a4f-453d-9a7b-1c7d93a8e413","year":2026},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"cited_paper":"/paper/2604.21725","citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:5e7a53a72eb2ac0160700f46c6f6ed2355df808faaf07ce168c2b18f8194a7bf","observation_id":"4dd31286-d32b-4f58-a848-5cc4b2eba807","resolution":{"observed_at":"2026-07-01T23:16:24.892608Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:27:50.260308Z","title":"2021 , url =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-06-28T14:27:50.260308Z"},"links":{"citing_paper":"/paper/2606.02372"},"observation_digest":"sha256:5e76cea74f3a6142f92658d468a8447c6e8c857381210314be9294fc07695dff","observation_id":"5199b4ae-9019-4757-879f-eabd9d4c2485","resolution":{"observed_at":"2026-06-28T14:27:50.260308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.02372","last_updated":"2026-06-01T15:21:17Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T15:21:17Z","title":"COMAP: Co-Evolving World Models and Agent Policies for LLM Agents"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":19,"parse_uncertain":0,"unresolved":32,"verified_exact":14,"verified_fuzzy":0},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2606.02372."}