{"as_of":"2026-08-08T20:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b97b156d29d66b968729ff34c3ed3ae2e5ec00962f9328f7c3a770b077d84ca6","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:06:58.046928Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T21:10:47.294719Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T00:29:16.281906Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"cited_work":{"arxiv_id":"2505.20023","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20023","snapshot_observed_at":"2026-07-04T00:29:16.281906Z","title":"arXiv preprint arXiv:2505.20023 , year=","venue":null,"work_id":"a650cfa6-43bf-46bb-8c20-bc5249d21397","year":null},"citing_paper":{"arxiv_id":"2605.10674","last_updated":"2026-05-11T14:55:20Z","snapshot_observed_at":"2026-08-05T06:43:24.460490Z","submitted_at":"2026-05-11T14:55:20Z","title":"Step Rejection Fine-Tuning: A Practical Distillation Recipe","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-12T03:44:33.525966Z"},"links":{"cited_paper":"/paper/2505.20023","citing_paper":"/paper/2605.10674"},"observation_digest":"sha256:5e10e7a0b40bd6cfce7c350b32cc3074dc19839b4bf120af6849ca8061dbd0a3","observation_id":"7bb4b43e-7867-4e7c-a441-d1d3a44ea4b7","resolution":{"observed_at":"2026-05-12T07:06:35.477603Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"cited_work":{"arxiv_id":"2505.20023","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20023","snapshot_observed_at":"2026-07-04T00:29:16.281906Z","title":"arXiv preprint arXiv:2505.20023 , year=","venue":null,"work_id":"a650cfa6-43bf-46bb-8c20-bc5249d21397","year":null},"citing_paper":{"arxiv_id":"2606.18890","last_updated":"2026-06-17T10:07:51Z","snapshot_observed_at":"2026-08-01T16:18:21.983276Z","submitted_at":"2026-06-17T10:07:51Z","title":"Skill-Guided Continuation Distillation for GUI Agents","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-06-26T21:10:47.294719Z"},"links":{"cited_paper":"/paper/2505.20023","citing_paper":"/paper/2606.18890"},"observation_digest":"sha256:e5f4c0fc063b62d8e380e6df1fc5657191d092d3a2ee381cadab92d4c3e54db1","observation_id":"79797b27-9d58-4d06-9879-8161996593c9","resolution":{"observed_at":"2026-07-04T00:29:16.284966Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.20023/citation-record","integrity":"/paper/2505.20023/integrity","json":"/paper/2505.20023/citation-record.json","paper":"/paper/2505.20023"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-07T14:06:53.542880Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:53.542880Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:13a2ffe6ba3128911d1fb9256ef8cc48ec769a4210ba58e917947715a23ace17","observation_id":"e1f5a3cb-f22d-44c6-96b2-3e9d125e437b","resolution":{"observed_at":"2026-08-07T14:06:53.542880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:53.607520Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:53.607520Z"},"links":{"citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:78ef8c6d0ca4a88f2acef6f52f69042d3fe75c06362d06a3ed7f577ea08a6d14","observation_id":"3a63268d-fe89-4237-8d65-9cffcf568265","resolution":{"observed_at":"2026-08-07T14:06:53.607520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05915","last_updated":"2023-10-09T17:58:38Z","snapshot_observed_at":"2026-08-05T18:32:49.850038Z","submitted_at":"2023-10-09T17:58:38Z","title":"FireAct: Toward Language Agent Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05915","snapshot_observed_at":"2026-08-07T14:06:53.740452Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:53.740452Z"},"links":{"cited_paper":"/paper/2310.05915","citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:e2057712362296205e16855500f5b0f33b32226ced008800ee5f3b6e643467e0","observation_id":"24ba30b1-3a1a-4744-9b32-ffb030550847","resolution":{"observed_at":"2026-08-07T14:06:53.740452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1080/019697297126029","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:58.138444Z","title":null,"venue":null,"work_id":"d35c5901-7a2c-4caa-a3f4-f37afa35bd67","year":1997},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:53.802374Z"},"links":{"citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:6db27d52e83fae1be7bbb79337fc9b0e93836f78dcd8552a4a4fac315352992b","observation_id":"0d46e696-3574-4da1-b540-ffe9b24aa833","resolution":{"observed_at":"2026-08-07T14:06:58.160732Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13009","last_updated":"2024-10-10T11:51:24Z","snapshot_observed_at":"2026-08-08T09:30:00.565800Z","submitted_at":"2024-05-13T10:51:43Z","title":"MetaReflection: Learning Instructions for Language Agents using Past Reflections","version":2},"cited_work":{"arxiv_id":"2405.13009","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.13009","snapshot_observed_at":"2026-08-07T14:06:58.868778Z","title":"MetaReflection: Learning Instructions for Language Agents using Past Reflections","venue":"cs.CL","work_id":"c2e1fcc6-ea9a-4f39-b6d5-34031831db4d","year":2024},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:53.976310Z"},"links":{"cited_paper":"/paper/2405.13009","citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:6c01f7e3b69025a9031cefea171939016169d074118c1b43100c4f69c98cfbee","observation_id":"e4d565e5-85eb-4ed4-b3d9-3d5854439c1d","resolution":{"observed_at":"2026-08-07T14:06:58.925514Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:01.858530Z","title":null,"venue":null,"work_id":"f659a530-ebb9-4f7f-b68c-9dfc05e6ad11","year":2024},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:54.092619Z"},"links":{"citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:e55dbe300a319a7306a64365fd7ea93968dcbc5247629e06c3effac68381324e","observation_id":"9e4bdf35-c8bd-46f1-924f-865297a22088","resolution":{"observed_at":"2026-08-07T14:07:01.907615Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T14:06:54.218467Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:54.218467Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:eb3588c87a4ae82e793aa403708cebca04c062c8248a13b9d6380f4c9ed54ca4","observation_id":"2b9ead3b-4938-45cd-b365-a3052cf44fc1","resolution":{"observed_at":"2026-08-07T14:06:54.218467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:54.388547Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:54.388547Z"},"links":{"citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:13895aa646e9c13a56c0db5a29dd45c5b2e67b0b81e89cf910c701c2c6f60080","observation_id":"1ab24e4c-74e9-4657-ae12-e0e1e9ed8206","resolution":{"observed_at":"2026-08-07T14:06:54.388547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:01.666195Z","title":null,"venue":null,"work_id":"22c551b4-bb65-4f20-87ef-b6851c5e1cf8","year":2023},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:54.441432Z"},"links":{"citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:64653efbfa9fd3d92a6af9be994c123685f3dcee01efde4bc16a51d379495137","observation_id":"406c1c69-051f-4f4b-8125-bd141f0051fb","resolution":{"observed_at":"2026-08-07T14:07:01.763957Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:01.479348Z","title":null,"venue":null,"work_id":"cd5eb686-2df0-46a9-a783-f372cf30cda3","year":2024},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:54.489782Z"},"links":{"citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:b7386310a0e2f211484728d8386030b8c8d3a24748cf0efd6eecccb409ff6d01","observation_id":"757251c9-9c98-43b8-9cf1-d81d0a2691b3","resolution":{"observed_at":"2026-08-07T14:07:01.551294Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:54.554746Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:54.554746Z"},"links":{"citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:2e73944972cb276647f607023f466f66c7b896d70882667a118447f8351c0b52","observation_id":"4e14beec-d708-4d71-a7e0-f43a78fb9a89","resolution":{"observed_at":"2026-08-07T14:06:54.554746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:01.241384Z","title":null,"venue":null,"work_id":"cae34c9d-6c8e-4978-8a7a-15f2b6c4e4b2","year":2024},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:54.656431Z"},"links":{"citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:ab4415892c177631739f38d0c477e8310fad2555d7fa6faddde0c33589e70573","observation_id":"75b55fe6-d004-4668-904a-239f9340e374","resolution":{"observed_at":"2026-08-07T14:07:01.354584Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:00.950431Z","title":null,"venue":null,"work_id":"7d98a8f6-2e2c-41af-b40f-d8cd039fcc62","year":2024},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:54.714515Z"},"links":{"citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:ca87231173d2dff78c66ddfc56345d48308b55cce7075f8ff57fcaa02089843d","observation_id":"6fb5fb70-ec4a-4479-a0c8-1b453ea29951","resolution":{"observed_at":"2026-08-07T14:07:01.065647Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T14:06:54.770766Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:54.770766Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:2638168e6734756888341e449b212bd4c83072f361b1a3f7a664034617e35232","observation_id":"ffbdea23-f3db-4bb2-95ea-00186e66ee8a","resolution":{"observed_at":"2026-08-07T14:06:54.770766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:00.642476Z","title":null,"venue":null,"work_id":"f4e71494-88bc-4a25-a154-d9c314c1157b","year":2024},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:54.826679Z"},"links":{"citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:5c916b4e7da0d4007f15339da58619a9d8a54d2ee82b46bcf34b955194bef648","observation_id":"8bca7f86-6c69-4f16-a6a4-4421f59280f6","resolution":{"observed_at":"2026-08-07T14:07:00.778903Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15334","last_updated":"2023-05-24T16:48:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-24T16:48:11Z","title":"Gorilla: Large Language Model Connected with Massive APIs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15334","snapshot_observed_at":"2026-08-07T14:06:54.892244Z","title":"Patil, Tianjun Zhang, Xin Wang, and Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:54.892244Z"},"links":{"cited_paper":"/paper/2305.15334","citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:73cdd10f9d74972a5474bcf13184cf68affbf8ceaf2549823266879f8b5fad00","observation_id":"888df397-25b2-4a4d-a86c-ac99790d5902","resolution":{"observed_at":"2026-08-07T14:06:54.892244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12813","last_updated":"2023-03-08T23:41:49Z","snapshot_observed_at":"2026-08-06T18:27:41.688063Z","submitted_at":"2023-02-24T18:48:43Z","title":"Check Your Facts and Try Again: Improving Large Language Models with External Knowledge and Automated Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12813","snapshot_observed_at":"2026-08-07T14:06:54.946192Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:54.946192Z"},"links":{"cited_paper":"/paper/2302.12813","citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:495f3f74c14246917e7230f19a5bf1d207f9d495bfa947d89b896e4ba23f8395","observation_id":"0cbbb406-f128-42c1-96e6-43677a2d47c9","resolution":{"observed_at":"2026-08-07T14:06:54.946192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:55.027332Z","title":"Pomerleau","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:55.027332Z"},"links":{"citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:146719815cc278e531ecff8246dcb73b795d73f273b9abe114fea96bfbd48094","observation_id":"cb4b500d-1b40-4b92-abe8-e355c20f6bff","resolution":{"observed_at":"2026-08-07T14:06:55.027332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13996","last_updated":"2024-01-25T07:47:49Z","snapshot_observed_at":"2026-08-08T10:32:34.630806Z","submitted_at":"2024-01-25T07:47:49Z","title":"Investigate-Consolidate-Exploit: A General Strategy for Inter-Task Agent Self-Evolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13996","snapshot_observed_at":"2026-08-07T14:06:55.122909Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:55.122909Z"},"links":{"cited_paper":"/paper/2401.13996","citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:3769abc0daea23d58d7b32573c24d8f95be5dcd707d4d333787042b00b4fb9ec","observation_id":"071d1a47-6753-47da-871d-9e4e3d31fdfe","resolution":{"observed_at":"2026-08-07T14:06:55.122909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14205","last_updated":"2025-01-03T16:44:55Z","snapshot_observed_at":"2026-07-06T18:18:21.334080Z","submitted_at":"2024-05-23T06:03:19Z","title":"Agent Planning with World Knowledge Model","version":4},"cited_work":{"arxiv_id":"2405.14205","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.14205","snapshot_observed_at":"2026-08-07T14:06:58.557897Z","title":"Agent Planning with World Knowledge Model","venue":"cs.CL","work_id":"98e551ec-5ac0-4aaa-bf45-dd30a3354fb5","year":2024},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:55.286037Z"},"links":{"cited_paper":"/paper/2405.14205","citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:44f8b82d3aea0ad2dc896ef520061ecee3920794a3926b18356a5972af0531e7","observation_id":"7e3097b8-42e0-4449-afa7-5b8a10a5948a","resolution":{"observed_at":"2026-08-07T14:06:58.636606Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:00.372425Z","title":null,"venue":null,"work_id":"729f66c9-f938-41cf-86b5-960de6fb7930","year":2024},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:55.459964Z"},"links":{"citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:7f1af914bd597c8d918392665fcc13eb436081c530f776ddfee7e2041aecf657","observation_id":"72568008-c0ef-4cea-89f8-09089843e5b9","resolution":{"observed_at":"2026-08-07T14:07:00.508858Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:55.635862Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:55.635862Z"},"links":{"citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:381d6b97cde340464f7392918e5211c72f553e5b189861cd76c1ffd640b451f9","observation_id":"48cd31e4-9195-4630-ad83-6bcd65afde44","resolution":{"observed_at":"2026-08-07T14:06:55.635862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:55.754994Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:55.754994Z"},"links":{"citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:70172d70a52b1631043c930077a0a45285bff40374c12fbad0729e93d730aa77","observation_id":"b11fc6e9-91c9-4190-8d61-1783208b8330","resolution":{"observed_at":"2026-08-07T14:06:55.754994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:59.982355Z","title":null,"venue":null,"work_id":"50e7d759-d764-4b3b-bfdc-bb000b443078","year":2020},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:55.881097Z"},"links":{"citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:07ad9c6fb6940de7fc7f6e4f048dfd66fb79582cf5e96bfe6a004ba7df904a68","observation_id":"9aee5b8c-0670-4752-8204-ac0065f682ea","resolution":{"observed_at":"2026-08-07T14:07:00.132607Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03768","last_updated":"2021-03-14T22:44:38Z","snapshot_observed_at":"2026-08-08T17:40:47.037804Z","submitted_at":"2020-10-08T05:13:36Z","title":"ALFWorld: Aligning Text and Embodied Environments for Interactive Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.03768","snapshot_observed_at":"2026-08-07T14:06:56.016515Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:56.016515Z"},"links":{"cited_paper":"/paper/2010.03768","citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:edb3f822cf08ad98cc463fd006ae11af1867f72b77ae77605c57aa53f0aabbea","observation_id":"99913d9f-e9dc-4951-824b-dcc62d59a377","resolution":{"observed_at":"2026-08-07T14:06:56.016515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02502","last_updated":"2024-07-10T17:36:25Z","snapshot_observed_at":"2026-08-07T22:37:26.229203Z","submitted_at":"2024-03-04T21:50:29Z","title":"Trial and Error: Exploration-Based Trajectory Optimization for LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02502","snapshot_observed_at":"2026-08-07T14:06:56.135534Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:56.135534Z"},"links":{"cited_paper":"/paper/2403.02502","citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:2572ae338f4ad6bd55ea765ff19ed3b2aabe838e217489305d1743c6fbab2b24","observation_id":"4221ee65-8241-4637-aca8-a09a0be48bff","resolution":{"observed_at":"2026-08-07T14:06:56.135534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T14:06:56.286740Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:56.286740Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:a9fd0327da050858ed28cf4cd3d36858d28beb3a572b27e9660964d23740cc6a","observation_id":"d7d1b60b-1ed6-413d-9c94-9611c613c178","resolution":{"observed_at":"2026-08-07T14:06:56.286740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:56.421739Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:56.421739Z"},"links":{"citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:4b0d39e0fe13abcd94065336aa1637dbb4666c7559a75df5bf72e7929c835a63","observation_id":"d25f5d6d-e68c-42c1-8267-708035f0f542","resolution":{"observed_at":"2026-08-07T14:06:56.421739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11651","last_updated":"2024-04-16T11:41:13Z","snapshot_observed_at":"2026-07-06T17:31:50.029722Z","submitted_at":"2024-02-18T17:10:07Z","title":"Learning From Failure: Integrating Negative Examples when Fine-tuning Large Language Models as Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11651","snapshot_observed_at":"2026-08-07T14:06:56.596041Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:56.596041Z"},"links":{"cited_paper":"/paper/2402.11651","citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:5ab452bfb8cdd97d7bba59360766e015fe1631c4fb09336b56c60b42e2f0d43b","observation_id":"6019eb82-e0fa-4fa5-b0a3-d7dce12e2c28","resolution":{"observed_at":"2026-08-07T14:06:56.596041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:56.750118Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:56.750118Z"},"links":{"citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:b65f2b7d7510de0746087cbbbabf6396f3e6c2ae3478fe034028a05073748396","observation_id":"f965e53c-b660-42e4-b5e4-f2361f908ad4","resolution":{"observed_at":"2026-08-07T14:06:56.750118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:56.919405Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:56.919405Z"},"links":{"citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:1de5c9a49794189b0bf80829257f4c6db19a10daa98b4088f933d382a2f5c24e","observation_id":"5b8306be-aec0-40e0-9765-ce942e2a0e84","resolution":{"observed_at":"2026-08-07T14:06:56.919405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07864","last_updated":"2023-09-19T08:29:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-14T17:12:03Z","title":"The Rise and Potential of Large Language Model Based Agents: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07864","snapshot_observed_at":"2026-08-07T14:06:57.038198Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:57.038198Z"},"links":{"cited_paper":"/paper/2309.07864","citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:b4c40c35eea76457dc161f43e56c326585a431ce365fad57fe375515ca208f26","observation_id":"af1016af-ef86-445a-bf1e-29a5cdf44b79","resolution":{"observed_at":"2026-08-07T14:06:57.038198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04151","last_updated":"2024-06-06T15:15:41Z","snapshot_observed_at":"2026-08-06T10:07:32.780355Z","submitted_at":"2024-06-06T15:15:41Z","title":"AgentGym: Evolving Large Language Model-based Agents across Diverse Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04151","snapshot_observed_at":"2026-08-07T14:06:57.158038Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:57.158038Z"},"links":{"cited_paper":"/paper/2406.04151","citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:700b5a128e27254739d0614b3ea7117e4e520776c742e23d672b62d30ce59894","observation_id":"316f7091-e032-42dd-ac81-1b3f3a273f74","resolution":{"observed_at":"2026-08-07T14:06:57.158038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:59.752492Z","title":null,"venue":null,"work_id":"61686303-7372-4abe-8cdb-1f36b5eae785","year":2024},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:57.320294Z"},"links":{"citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:c1a8dd6136d590a445068e6f1fa0f7a11ba3f4a41f8bda2c3e4b700e47616d4e","observation_id":"50aa65a6-12fc-4ecb-8cbe-07274b962c33","resolution":{"observed_at":"2026-08-07T14:06:59.870258Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07972","last_updated":"2024-05-30T08:55:12Z","snapshot_observed_at":"2026-08-07T10:10:50.201348Z","submitted_at":"2024-04-11T17:56:05Z","title":"OSWorld: Benchmarking Multimodal Agents for Open-Ended Tasks in Real Computer Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07972","snapshot_observed_at":"2026-08-07T14:06:57.471803Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:57.471803Z"},"links":{"cited_paper":"/paper/2404.07972","citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:be679669abbf8227090ff0e7e8ffed8f64139b3ba929f3fc0f0546287427685f","observation_id":"e4804db6-1420-4297-ba88-d5c0bbe94f67","resolution":{"observed_at":"2026-08-07T14:06:57.471803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-07T14:06:57.530924Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:57.530924Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:210c367e9a9b35069280c2699c3a8ceddca53172ab575882467279bf9a908a5d","observation_id":"e16cab6c-a3bc-44bb-93cf-586a0c28715c","resolution":{"observed_at":"2026-08-07T14:06:57.530924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15793","last_updated":"2024-11-11T20:01:15Z","snapshot_observed_at":"2026-07-06T18:19:29.996982Z","submitted_at":"2024-05-06T17:41:33Z","title":"SWE-agent: Agent-Computer Interfaces Enable Automated Software Engineering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15793","snapshot_observed_at":"2026-08-07T14:06:57.590394Z","title":"Jimenez, Alexander Wettig, Kilian Lieret, Shunyu Yao, Karthik Narasimhan, and Ofir Press","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:57.590394Z"},"links":{"cited_paper":"/paper/2405.15793","citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:5ae1fbed1bad84f26d956506a2bcb7d8a7848b095d7818d21888f291dbac8f1e","observation_id":"966c5ecc-d933-41b1-999b-3e067d337112","resolution":{"observed_at":"2026-08-07T14:06:57.590394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13669","last_updated":"2024-05-28T06:39:17Z","snapshot_observed_at":"2026-08-08T04:16:37.755062Z","submitted_at":"2024-02-21T10:06:08Z","title":"Self-Distillation Bridges Distribution Gap in Language Model Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13669","snapshot_observed_at":"2026-08-07T14:06:57.661196Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:57.661196Z"},"links":{"cited_paper":"/paper/2402.13669","citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:8a5a7b49871fb8e5a534b25c13421344a9d58147a4558c38cad489e6dd6b6b3b","observation_id":"ba55c0e8-4961-4680-88ee-a3e22e31fa6a","resolution":{"observed_at":"2026-08-07T14:06:57.661196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:59.514522Z","title":null,"venue":null,"work_id":"36f0628b-5967-42bc-bca4-e0f3e044428b","year":2022},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:57.720904Z"},"links":{"citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:898b47717ad3eec65706e156e03a0eb6232ae8520b56342d7af120a5790f786c","observation_id":"d62cf0bb-1259-4ed8-af62-35d741551974","resolution":{"observed_at":"2026-08-07T14:06:59.604142Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:57.779121Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:57.779121Z"},"links":{"citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:02732fcc40c6a07a3ebac7eb7184f696d298fd728502f7ff870e171cc209087c","observation_id":"63b0c490-9dc0-4b77-a5c9-20889cc92b9b","resolution":{"observed_at":"2026-08-07T14:06:57.779121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:59.143770Z","title":null,"venue":null,"work_id":"7869eac4-de25-4f26-a4f8-76568757a0a3","year":2024},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:57.820652Z"},"links":{"citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:e459a5a5061ffe75c84016df5c9cb4e1754acb289cc44aaafa0107cac44e3fda","observation_id":"e44a72af-f104-4f0f-a89c-dfc6a7bbe1c1","resolution":{"observed_at":"2026-08-07T14:06:59.239857Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12823","last_updated":"2023-10-22T16:19:16Z","snapshot_observed_at":"2026-08-07T22:31:11.195198Z","submitted_at":"2023-10-19T15:19:53Z","title":"AgentTuning: Enabling Generalized Agent Abilities for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12823","snapshot_observed_at":"2026-08-07T14:06:57.880383Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:57.880383Z"},"links":{"cited_paper":"/paper/2310.12823","citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:c186f3ada604bf835f7be796b9dc50e90af19fa7e96b7cf12198fc4dbd3b021f","observation_id":"67a2f167-7450-4a5a-939f-e8152a9ae841","resolution":{"observed_at":"2026-08-07T14:06:57.880383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13372","last_updated":"2024-06-27T22:44:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-20T08:08:54Z","title":"LlamaFactory: Unified Efficient Fine-Tuning of 100+ Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13372","snapshot_observed_at":"2026-08-07T14:06:57.940517Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:57.940517Z"},"links":{"cited_paper":"/paper/2403.13372","citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:03a144645585710bf394fa315f578e177df68ad214cb908c3e9b0da489a17a5d","observation_id":"1193f9fa-6d20-415a-bacb-91bb704bc34e","resolution":{"observed_at":"2026-08-07T14:06:57.940517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-07T14:06:58.021707Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:58.021707Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:0c38e79748fa8eaed9d39174196085897fbf428ad40b0d6c88b62dde8e06a043","observation_id":"786968d7-ee0e-41a0-b961-3baffbd09026","resolution":{"observed_at":"2026-08-07T14:06:58.021707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:58.041400Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:58.041400Z"},"links":{"citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:e36ef255196adc344872ac99e5d39eecbf2370256a1c6f0ee08b2ce1686a11f0","observation_id":"cccce28e-0198-4534-adfd-be9b68124ba1","resolution":{"observed_at":"2026-08-07T14:06:58.041400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:58.046928Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:58.046928Z"},"links":{"citing_paper":"/paper/2505.20023"},"observation_digest":"sha256:0bcc429f7bf2c1bda8d7a5b6cca38523f772d9b3e8dacf31dfe96dfddfe4a141","observation_id":"837078af-2b8c-4047-852c-ae4a1caf4a3f","resolution":{"observed_at":"2026-08-07T14:06:58.046928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.20023","last_updated":"2025-05-26T14:11:12Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T03:40:10.572527Z","submitted_at":"2025-05-26T14:11:12Z","title":"Training LLM-Based Agents with Synthetic Self-Reflected Trajectories and Partial Masking"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 2 inbound Pith citation observations for arXiv:2505.20023."}