{"as_of":"2026-08-07T22:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:76684ae4dc20a4dedec96d11459e941bb74dcfb7b45b8e45950fbb4ce8af42e9","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:51:42.816272Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T13:59:51.871553Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11176","snapshot_observed_at":"2026-08-07T13:51:42.816272Z","title":"Watch every step! llm agent learning via iterative step-level process refinement","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20737","last_updated":"2025-05-27T05:27:54Z","snapshot_observed_at":"2026-08-07T13:45:22.968013Z","submitted_at":"2025-05-27T05:27:54Z","title":"RRO: LLM Agent Optimization Through Rising Reward Trajectories","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:42.816272Z"},"links":{"cited_paper":"/paper/2406.11176","citing_paper":"/paper/2505.20737"},"observation_digest":"sha256:a34bd87d20fbd8bc91f003ea38c0062a0e9c6aa90db982aa5d1925c17d468b1c","observation_id":"9eb5afc0-64c0-48da-b24b-8ccaca91f770","resolution":{"observed_at":"2026-08-07T13:51:42.816272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11176","snapshot_observed_at":"2026-08-07T12:09:00.382912Z","title":"Watch every step! llm agent learning via iterative step-level process refinement.arXiv preprint arXiv:2406.11176, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00539","last_updated":"2025-06-04T13:39:54Z","snapshot_observed_at":"2026-08-07T12:00:51.376524Z","submitted_at":"2025-05-31T12:54:49Z","title":"ARIA: Training Language Agents with Intention-Driven Reward Aggregation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:00.382912Z"},"links":{"cited_paper":"/paper/2406.11176","citing_paper":"/paper/2506.00539"},"observation_digest":"sha256:97239b8d4a2474e673468c12231e73862fb906ff7b16dd0b9033ec6d5232e240","observation_id":"b0282fc0-9feb-4ac3-a30a-0f6c441ec3e6","resolution":{"observed_at":"2026-08-07T12:09:00.382912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11176","snapshot_observed_at":"2026-08-06T16:23:32.671182Z","title":"Watch every step! llm agent learning via iterative step-level process refinement","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.13712","last_updated":"2025-07-18T07:52:19Z","snapshot_observed_at":"2026-08-06T16:15:28.755545Z","submitted_at":"2025-07-18T07:52:19Z","title":"LLaPipe: LLM-Guided Reinforcement Learning for Automated Data Preparation Pipeline Construction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T16:23:32.671182Z"},"links":{"cited_paper":"/paper/2406.11176","citing_paper":"/paper/2507.13712"},"observation_digest":"sha256:f72799fb165d36d9ccc81b19101578c4aaed4436f016ed9cf4a69de836ce89d6","observation_id":"b1f80aea-97f8-48a6-95d1-188bcd44a41f","resolution":{"observed_at":"2026-08-06T16:23:32.671182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11176","snapshot_observed_at":"2026-08-05T20:35:47.501357Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10257","last_updated":"2025-08-14T00:51:36Z","snapshot_observed_at":"2026-08-07T13:33:54.413844Z","submitted_at":"2025-08-14T00:51:36Z","title":"Source Component Shift Adaptation via Offline Decomposition and Online Mixing Approach","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T20:35:47.501357Z"},"links":{"cited_paper":"/paper/2406.11176","citing_paper":"/paper/2508.10257"},"observation_digest":"sha256:81e543b0b2ec981b61519234b0c3ae75db4830302fee0d8eda5698d7b675bf4d","observation_id":"d41d0aa5-2fdd-42f2-b98b-92a9fc215029","resolution":{"observed_at":"2026-08-05T20:35:47.501357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11176","snapshot_observed_at":"2026-08-05T20:38:44.914638Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10259","last_updated":"2025-08-14T00:57:58Z","snapshot_observed_at":"2026-08-07T13:33:53.442792Z","submitted_at":"2025-08-14T00:57:58Z","title":"Leveraging OS-Level Primitives for Robotic Action Management","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-05T20:38:44.914638Z"},"links":{"cited_paper":"/paper/2406.11176","citing_paper":"/paper/2508.10259"},"observation_digest":"sha256:738ed30f1bfb5614d48b6abd2e62821a8960aae395bc9f70951a475ac1787b4f","observation_id":"b8a50294-3d51-4ab8-b6ae-ac7158af8ec7","resolution":{"observed_at":"2026-08-05T20:38:44.914638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11176","snapshot_observed_at":"2026-08-04T08:55:58.792516Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.18383","last_updated":"2026-06-18T07:59:59Z","snapshot_observed_at":"2026-08-07T17:59:55.480503Z","submitted_at":"2025-10-21T08:03:14Z","title":"MENTOR: Reinforcement Learning via Flexible Teacher-Optimized Rewards for Tool-Use Distillation","version":3},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-04T08:55:58.792516Z"},"links":{"cited_paper":"/paper/2406.11176","citing_paper":"/paper/2510.18383"},"observation_digest":"sha256:221553de7bb6006a6535ca8289f4250af30854395e182a185c652cba45e240c0","observation_id":"e141f2e5-c99d-43d4-acb4-8e21cc1a7426","resolution":{"observed_at":"2026-08-04T08:55:58.792516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement","version":2},"cited_work":{"arxiv_id":"2406.11176","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11176","snapshot_observed_at":"2026-07-04T13:59:51.871553Z","title":"Watch every step! llm agent learning via iterative step-level process refinement","venue":null,"work_id":"a4789c21-1d58-4330-961c-e34441f18132","year":2024},"citing_paper":{"arxiv_id":"2604.23194","last_updated":"2026-04-25T07:54:23Z","snapshot_observed_at":"2026-07-06T23:09:29.537323Z","submitted_at":"2026-04-25T07:54:23Z","title":"From Coarse to Fine: Self-Adaptive Hierarchical Planning for LLM Agents","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-08T08:10:36.579810Z"},"links":{"cited_paper":"/paper/2406.11176","citing_paper":"/paper/2604.23194"},"observation_digest":"sha256:2bcb09c64f7978ea9e211d4404b19dfaf52123537a1eb2a5ade160f2196bbc2f","observation_id":"d03d49af-80a8-499d-b8ca-7a88a1d5fd69","resolution":{"observed_at":"2026-05-11T20:46:10.629997Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement","version":2},"cited_work":{"arxiv_id":"2406.11176","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11176","snapshot_observed_at":"2026-07-04T13:59:51.871553Z","title":"Watch every step! llm agent learning via iterative step-level process refinement","venue":null,"work_id":"a4789c21-1d58-4330-961c-e34441f18132","year":2024},"citing_paper":{"arxiv_id":"2605.20061","last_updated":"2026-05-19T16:19:29Z","snapshot_observed_at":"2026-08-07T09:15:12.932880Z","submitted_at":"2026-05-19T16:19:29Z","title":"Rewarding Beliefs, Not Actions: Consistency-Guided Credit Assignment for Long-Horizon Agents","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-20T05:35:45.084011Z"},"links":{"cited_paper":"/paper/2406.11176","citing_paper":"/paper/2605.20061"},"observation_digest":"sha256:078a631243d00c85e8c4283b00d25ef608530fcebc305169f296a5418b33e477","observation_id":"17c7d3ff-d50a-45d5-868b-bfe81a49f6fa","resolution":{"observed_at":"2026-05-20T05:38:05.519281Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement","version":2},"cited_work":{"arxiv_id":"2406.11176","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11176","snapshot_observed_at":"2026-07-04T13:59:51.871553Z","title":"Watch every step! llm agent learning via iterative step-level process refinement","venue":null,"work_id":"a4789c21-1d58-4330-961c-e34441f18132","year":2024},"citing_paper":{"arxiv_id":"2606.22385","last_updated":"2026-06-21T08:22:23Z","snapshot_observed_at":"2026-08-01T18:23:09.613202Z","submitted_at":"2026-06-21T08:22:23Z","title":"MetaPS: Adaptive Programmatic Strategy Selection for Market Agents","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-06-26T11:06:28.690956Z"},"links":{"cited_paper":"/paper/2406.11176","citing_paper":"/paper/2606.22385"},"observation_digest":"sha256:2d1dd2b38eaa8e1829369b9404bc547d6b89f7ba62ed9b32e7899bfb1baff36a","observation_id":"e7d12215-7382-44ad-8576-043a4b10013d","resolution":{"observed_at":"2026-07-04T08:39:42.661633Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement","version":2},"cited_work":{"arxiv_id":"2406.11176","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11176","snapshot_observed_at":"2026-07-04T13:59:51.871553Z","title":"Watch every step! llm agent learning via iterative step-level process refinement","venue":null,"work_id":"a4789c21-1d58-4330-961c-e34441f18132","year":2024},"citing_paper":{"arxiv_id":"2606.27369","last_updated":"2026-06-25T17:59:36Z","snapshot_observed_at":"2026-08-03T05:17:54.539513Z","submitted_at":"2026-06-25T17:59:36Z","title":"Reinforcement Learning without Ground-Truth Solutions can Improve LLMs","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-26T04:47:47.691913Z"},"links":{"cited_paper":"/paper/2406.11176","citing_paper":"/paper/2606.27369"},"observation_digest":"sha256:5d7a7cc25863808fc2e8ef1108862e4e6269236b85615b42667c5e2a6d36b4b9","observation_id":"25f690f8-8941-470c-999a-6c17f4848234","resolution":{"observed_at":"2026-07-04T13:59:51.873179Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11176","snapshot_observed_at":"2026-08-01T13:54:21.160424Z","title":"arXiv preprint arXiv:2406.11176 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18979","last_updated":"2026-07-21T11:14:33Z","snapshot_observed_at":"2026-08-06T13:13:54.204332Z","submitted_at":"2026-07-21T11:14:33Z","title":"Fishing Out Free Riders: Shapley-Based Reward Attribution for Parallel Reasoning via Reinforcement Learning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-01T13:54:21.160424Z"},"links":{"cited_paper":"/paper/2406.11176","citing_paper":"/paper/2607.18979"},"observation_digest":"sha256:76d0382feddcc2dc173cf523185b4a41b5ed62f95a99d3f4c2cdc67a1336ed93","observation_id":"b00c4d8e-0e9d-4b43-a145-7500acd36a99","resolution":{"observed_at":"2026-08-01T13:54:21.160424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11176","snapshot_observed_at":"2026-07-31T00:46:12.901360Z","title":"Watch every step! llm agent learning via iterative step-level process refinement.arXiv preprint arXiv:2406.11176, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27443","last_updated":"2026-07-29T20:14:43Z","snapshot_observed_at":"2026-08-06T07:25:46.863771Z","submitted_at":"2026-07-29T20:14:43Z","title":"Leveraging Trajectory Graphs for Pre-Execution Error Diagnosis in Agentic LLM Systems","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-31T00:46:12.901360Z"},"links":{"cited_paper":"/paper/2406.11176","citing_paper":"/paper/2607.27443"},"observation_digest":"sha256:5ba55e03e52f909300344760cb4448a50ad90ad2f41edd7b0aa78d642e5aabd9","observation_id":"4c53a9ff-d3fa-4631-bbf8-a4207098375a","resolution":{"observed_at":"2026-07-31T00:46:12.901360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.11176/citation-record","integrity":"/paper/2406.11176/integrity","json":"/paper/2406.11176/citation-record.json","paper":"/paper/2406.11176"},"outbound":[],"paper":{"arxiv_id":"2406.11176","last_updated":"2024-09-24T10:01:31Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-01T17:35:58.677762Z","submitted_at":"2024-06-17T03:29:13Z","title":"Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2406.11176."}