{"as_of":"2026-08-08T05:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:319e7beb8a233dab27b622f71233fa0db7a86515a80e0d08f7760371f4eadafa","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T17:03:13.686066Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T12:47:38.487160Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.04574","snapshot_observed_at":"2026-08-01T12:47:38.487160Z","title":"Wenbo Zhang, Lijinghua Zhang, Liner Xiang, and Hengrui Cai","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19338","last_updated":"2026-07-30T18:56:15Z","snapshot_observed_at":"2026-08-05T23:11:03.030949Z","submitted_at":"2026-07-21T17:56:49Z","title":"CodeRescue: Budget-Calibrated Recovery Routing for Coding Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T12:47:38.487160Z"},"links":{"cited_paper":"/paper/2607.04574","citing_paper":"/paper/2607.19338"},"observation_digest":"sha256:7db527ba43a54eb4099999972c0536f83c1aa9076cdb97b350382b151e3c7be4","observation_id":"8a7730c7-d11b-4168-b77c-e229d5970a63","resolution":{"observed_at":"2026-08-01T12:47:38.487160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.04574/citation-record","integrity":"/paper/2607.04574/integrity","json":"/paper/2607.04574/citation-record.json","paper":"/paper/2607.04574"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.07885","last_updated":"2026-05-21T03:40:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-11T06:33:30Z","title":"Intelligence per Watt: Measuring Intelligence Efficiency of Local AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.07885","snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"cited_paper":"/paper/2511.07885","citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:fff49834e6334496aa280d076f3a4bb58c646784d05b01eebbf243da7cb7d56a","observation_id":"a4a6f1aa-9e60-421f-ac85-9843ab7cbd3c","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"and Zipser, David , journal=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:e866faf8a9752c99e360677f60639872c19965d3ad26eab508744018bc49d13b","observation_id":"8007d496-32b3-4591-9926-e6da7ea2e3b4","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:3a53550912ecbcfd3a4606712a2fa4e6fd4baf5009a6ac0ceee3d8b469a3f173","observation_id":"88a0abcf-61af-430d-8a42-75041dbfcbf4","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:79f318fe67a7505b6b1b86fe8378ab6969bb2a2a16d8f7329a3f88a5a4c7734e","observation_id":"de0143eb-3404-4753-b9ef-b992d7665222","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:9b0a1c97b09bb24b50c9d29de32e6c786d59eb0f74dc49cfb35c7513497143cc","observation_id":"6fa9354c-facb-4729-935e-d860104701c5","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.12913","last_updated":"2026-05-13T02:40:28Z","snapshot_observed_at":"2026-07-06T23:24:32.412966Z","submitted_at":"2026-05-13T02:40:28Z","title":"Revisiting DAgger in the Era of LLM-Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.12913","snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"arXiv preprint arXiv:2605.12913 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"cited_paper":"/paper/2605.12913","citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:79c07f3445e587836a7978d3bfb8ac27688faef696d971ae1c936647ef2e88cf","observation_id":"02d6f244-0343-4cbd-a70c-83666b5ff433","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1406.5979","last_updated":"2014-06-23T17:00:28Z","snapshot_observed_at":"2026-07-06T03:47:05.007723Z","submitted_at":"2014-06-23T17:00:28Z","title":"Reinforcement and Imitation Learning via Interactive No-Regret Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1406.5979","snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"arXiv preprint arXiv:1406.5979 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"cited_paper":"/paper/1406.5979","citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:cd2f1dfd47de85747060766ce649501abff1b1e8e9b6d550e981b3c151946f01","observation_id":"a7b4f5be-d21c-4bb6-9bb3-2a82f49e70c9","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"Decoupling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:782719fbf3c268121062624aadf3b77d099d6b8ae7521643524d5867369d5271","observation_id":"503ce140-825b-4954-a783-06d5cebd2ade","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03629","last_updated":"2023-03-10T01:00:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-06T01:00:32Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03629","snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"arXiv preprint arXiv:2210.03629 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"cited_paper":"/paper/2210.03629","citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:076f0990785b28ff0bb5987c1e6a147e9835c6d423a9a68330eba57e0e1dea23","observation_id":"57fbe80e-f47c-450f-99f0-4207c8bb0187","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"Artificial Intelligence , volume=","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:eabfd51416cf8af542ef517abadab7d7cb4f78af3af9c50963ce377a0bc28d40","observation_id":"b1516430-12f0-4d32-85f5-a58d3e592763","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"Operations Research , volume=","venue":null,"work_id":null,"year":1973},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:1650b7f26b2bebd15be6dd1624e0d7c74eea27c0bd151640c6ee8ed8e10e642c","observation_id":"a4cb4d53-42b6-423b-8fdf-d7055807ff9a","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"Proceedings of the 14th International Conference on Artificial Intelligence and Statistics (AISTATS) , pages=","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:c11bfe3b7c1a3b859509a5cdc663298fc1994f834598103fccb24cc869b2922b","observation_id":"7c85966e-e71f-43a4-9a14-5db49b224ac5","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"Proceedings of the Twentieth European Conference on Computer Systems , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:a515ac7f881a0b20ffb06d46aecb255c99380042a10a2b7794c1cec6da5e5fbe","observation_id":"5b2f55a6-dc5f-4a99-bd2c-f6059e8492ad","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"Second Conference on Language Modeling , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:fc6e7bb0056d72d125fb44348bc2e9d3c7b231b517994ea6c34ce8b8053847b6","observation_id":"853ef247-2c29-4387-9220-961243b26dcd","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"2019 International Conference on Robotics and Automation (ICRA) , pages=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:df4a5c3fb54504ae5e7c090c00bcd6f33964e1aec2327c2f1eb817e8ee4b265e","observation_id":"0472669e-6763-4ff9-95eb-19038e9afd55","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"Proceedings of the Thirteenth International Conference on Artificial Intelligence and Statistics , pages=","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:3794e3db3d825accbf37720f58e04085f81f7b0f9e04e553988077c5586a6dec","observation_id":"588f8a8e-d5b2-4120-9478-fa66f9ffd247","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"Findings of the Association for Computational Linguistics: EMNLP 2023 , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:a63179f453e5dd28294713bbcb6d1efd341c727319e99517ffafb4b264857464","observation_id":"d07c2bb6-61dc-4a3f-914b-16cde9dc33bb","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20783","last_updated":"2025-10-06T09:30:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T17:59:14Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20783","snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"arXiv preprint arXiv:2503.20783 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"cited_paper":"/paper/2503.20783","citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:7f3cb926161209858bebafdc2fa59c8bdd9a3300198b83d01f4753fdbb895896","observation_id":"cb3d2ddf-bffe-4685-8983-a26f6cd09e2f","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"arXiv preprint arXiv:2402.03300 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:49c1c4e9b2a1329a69274922fd58af1fed935b66e262c1d144f176f9117f2b4a","observation_id":"a225ac26-aac3-4622-83d2-e868b72d787c","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"Proceedings of the 61st annual meeting of the association for computational linguistics (volume 1: Long papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:5cf45c76b2d21dbec68ef132b3483d164db962795509e1522a062f6df28105cc","observation_id":"f9a07e87-650f-462e-82a2-7644e02e69cd","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"Transactions of the Association for Computational Linguistics , volume=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:8060fc00447fad5645cfda2e5c54a20aa76ff8ee6f04761acef8be4c2cb5622b","observation_id":"aeaca245-5a14-49a8-b05b-a12418aa4150","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"Proceedings of the 28th International Conference on Computational Linguistics , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:1a779e3cbcb7f6731efe61912369970c4b9f604452b1918eab13938c6d68638a","observation_id":"248d78b7-0775-4a04-97a5-d4f1c87411ee","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":", booktitle =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:fd925e027ba832b84db1407a79370985c2fe3496450b7a74c1c90115a3c6e043","observation_id":"2a5aa2f9-40a9-43ea-b933-e5fdaada0a3d","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"International Conference on Learning Representations , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:ef22d8aaa0cea744eab5f689624b11ca91b43bfc5c951d2073b8a2534fb29fbd","observation_id":"1636ccea-4aba-48e6-8343-5fdf78133542","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"2024 , journal =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:1af3d2acc2849dad27522ea75c3cbf2721be35b5803233383f69422915d95d68","observation_id":"09314f96-f9dd-4848-895b-6b7cc54ef882","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"Proceedings of the Fourteenth International Conference on Artificial Intelligence and Statistics , series =","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:03962f7b393957eda2cd00e9c998d387787def56fb3415a31dab06340ca3e3fc","observation_id":"f3f41295-1951-4ec3-8171-08b844327783","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"NeurIPS 2024 Workshop on Open-World Agents , year =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:da1dc1a4089ec6d490198437843dd9c8102b139d3a386a81a0e7fb0418fee813","observation_id":"e907ab96-05b5-4dcf-91c1-32fa797487d2","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"Better than Your Teacher:","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:9e849a8888bfd8c2a373fe1c0006ce8c6966642f988a9f5083cf95d1af849cab","observation_id":"47f6c88c-8c9f-4753-b4ff-868fb9103e9d","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"Imitation Learning for Multi-turn","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:34dc905ed36051de000535023505ad72be771588eda4f93abf675e4e1279f836","observation_id":"1aa0584e-d499-4442-89e9-c32061890140","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"arXiv preprint arXiv:2509.14257 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:7e65bd03832f7433b25b3fc1daf1f7aad372b8dd001d4a075f04ba961db4c0ee","observation_id":"f5e889cd-5754-4c01-930d-a39b34d02dd7","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"Training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:2ceafc4bf7a1f83fab5f3fc77a8c02cfadcbb63712865d667b6b3f58b72b15ea","observation_id":"7566ed59-c623-4f54-a6e2-63510dd04df1","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"Embodied Multi-Modal Agent trained by an","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:7885673795d277ab2b85c402619eb5b5dace9c72d470f7d3c0d7df5a44918cec","observation_id":"8887fa81-7399-464e-9b82-1e1030f2cfef","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"2025 , url =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:09ae70bcb30d9e37bc3f65e50eecafd89f16b748ed23cd315f51d8f13817aabe","observation_id":"c12213ec-23f7-4cf3-a4ae-86a95516436e","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:63d0c93020f54257dcde9dd79197ab1c02a9a2284971de5bde0e8196047e6dce","observation_id":"a7b871b0-ba42-4796-bc99-7bd3c9962462","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"2025 , url =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:da122553d98ea771f003bb125e54d2ff96136beda52bcd2ac78a47a384bf5971","observation_id":"f2a8967d-58be-4095-805c-67f9ddc5b2e2","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"Exploring Expert Failures Improves","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:e4cb8c8cc9fbaf01c08162769d66dd032ba2f4b1b954cbe8f5a20eec0d2b6313","observation_id":"b55981c8-268b-4ea0-9946-f82fc2f18af4","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"International Conference on Learning Representations , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:2aa206836d0640ff3379810b7cd2d174eac7821637a5997d419c5ad7fa8446cc","observation_id":"a77dc542-0136-4b45-a7e5-72b153350cd4","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"2024 , url =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:bf2daf953257b6825e0f2fa689ef5c4afd6c4f81f3e774f40698573d05961c4f","observation_id":"c3df3476-918e-41df-b903-4bfb0dda6760","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12275","last_updated":"2026-03-23T13:11:10Z","snapshot_observed_at":"2026-07-06T22:45:39.557598Z","submitted_at":"2026-02-12T18:58:28Z","title":"On-Policy Context Distillation for Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.12275","snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"arXiv preprint arXiv:2602.12275 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"cited_paper":"/paper/2602.12275","citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:b14198382de04336d0dbd922a8a80f8bfdfaa2b5adfb33c8cfb1f86d17cc24bd","observation_id":"6ce9c6f4-a653-4776-9a20-937823b2a816","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.18734","last_updated":"2026-03-20T15:40:19Z","snapshot_observed_at":"2026-08-07T20:24:25.671681Z","submitted_at":"2026-01-26T17:56:50Z","title":"Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.18734","snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"arXiv preprint arXiv:2601.18734 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"cited_paper":"/paper/2601.18734","citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:9f540b31c598fb3bbea2c2341f603ee039fbdf321d904363ea58047c157dc632","observation_id":"d0602a50-ce15-414b-93b8-a369437ef6fd","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"2026 , url =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:88cae709deaecc016f4ef8c94d0982fe7f2f1f4062f8b5cbf2c7a98cfc6a4777","observation_id":"0fd401ac-c066-45cc-8213-88020f972d53","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"arXiv preprint arXiv:2511.10643 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:b5603ab2c123b4f334691ffbd5caa4535b52873fd3484eb88e7f322d8e8f1933","observation_id":"c18eead2-63eb-4b81-a884-24cc6190f3c9","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.08979","last_updated":"2018-03-02T17:46:59Z","snapshot_observed_at":"2026-07-06T06:25:13.996890Z","submitted_at":"2018-02-25T09:52:24Z","title":"NL2Bash: A Corpus and Semantic Parser for Natural Language Interface to the Linux Operating System","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.08979","snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"Ernst , title =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"cited_paper":"/paper/1802.08979","citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:78bce357efa2b1ab14c9b9d1efeb3f20a19117af636b86f4a27cd9531e09ebb8","observation_id":"0cedad13-6618-49ef-875e-d3d4b4adc21c","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"2023 31st ACM Joint European Software Engineering Conference and Symposium on the Foundations of Software Engineering (ESEC/FSE 2023) , year=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:9f3766d9a386e5aa86cb3d5950ca4398a5c6baf21eb9d192519e0624b8611480","observation_id":"8f73cbfe-8871-4aba-ac4b-c7fe3dfa51cf","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12856","last_updated":"2025-09-06T23:54:03Z","snapshot_observed_at":"2026-08-06T16:34:28.307820Z","submitted_at":"2025-07-17T07:26:54Z","title":"Supervised Fine Tuning on Curated Data is Reinforcement Learning (and can be improved)","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.12856","snapshot_observed_at":"2026-07-11T17:03:13.686066Z","title":"arXiv preprint arXiv:2507.12856 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-07-11T17:03:13.686066Z"},"links":{"cited_paper":"/paper/2507.12856","citing_paper":"/paper/2607.04574"},"observation_digest":"sha256:62b39deda6708019a4b77bf7ed06f64afb51d3568c9cc3decb80070da6118760","observation_id":"6f56a063-4987-42b8-8411-20189f8b2049","resolution":{"observed_at":"2026-07-11T17:03:13.686066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.04574","last_updated":"2026-07-06T01:02:30Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T10:27:24.643931Z","submitted_at":"2026-07-06T01:02:30Z","title":"A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":44,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 1 inbound Pith citation observation for arXiv:2607.04574."}