{"as_of":"2026-08-05T07:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ba964087e17cd5337d560ff0f881642dc0f1411adabd9846a64d923046e9557a","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T11:50:26.030339Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T19:50:42.757895Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-03T09:07:47.405725Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"cited_work":{"arxiv_id":"2605.31228","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.31228","snapshot_observed_at":"2026-07-03T09:07:47.405725Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","venue":"cs.LG","work_id":"2828025a-fd4d-4c37-b61e-bbec5bb6f8d3","year":2026},"citing_paper":{"arxiv_id":"2606.08144","last_updated":"2026-06-06T12:46:19Z","snapshot_observed_at":"2026-07-06T23:47:43.942733Z","submitted_at":"2026-06-06T12:46:19Z","title":"IMAGINE: Adaptive Schema-Imagery Enhanced Composition for Composed Video Retrieval","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-27T19:50:42.757895Z"},"links":{"cited_paper":"/paper/2605.31228","citing_paper":"/paper/2606.08144"},"observation_digest":"sha256:f54745f30ed4d7a2d0c2b6a199ce7c75ffd5baf37a3b0b4ecb3cdb7c6258f761","observation_id":"9721f396-6a7d-421c-94d3-feff44fec044","resolution":{"observed_at":"2026-07-02T21:17:24.814295Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"cited_work":{"arxiv_id":"2605.31228","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.31228","snapshot_observed_at":"2026-07-03T09:07:47.405725Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","venue":"cs.LG","work_id":"2828025a-fd4d-4c37-b61e-bbec5bb6f8d3","year":2026},"citing_paper":{"arxiv_id":"2606.11689","last_updated":"2026-06-10T06:06:34Z","snapshot_observed_at":"2026-07-06T23:50:44.713490Z","submitted_at":"2026-06-10T06:06:34Z","title":"RankVR: Low-Rank Structure Perception and Value Recalibration for Robust Composed Image Retrieval","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T10:35:28.866038Z"},"links":{"cited_paper":"/paper/2605.31228","citing_paper":"/paper/2606.11689"},"observation_digest":"sha256:33a92ee279df1ea7358b5d07dc2395633fcdcd699c6c2f84370e182bf071c435","observation_id":"cff150e1-95b5-4e44-8333-41f44a1f5abb","resolution":{"observed_at":"2026-07-03T09:07:47.406939Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2605.31228/citation-record","integrity":"/paper/2605.31228/integrity","json":"/paper/2605.31228/citation-record.json","paper":"/paper/2605.31228"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.01456","last_updated":"2025-09-26T09:25:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-03T15:43:48Z","title":"Process Reinforcement through Implicit Rewards","version":2},"cited_work":{"arxiv_id":"2502.01456","doi":"10.48550/arxiv.2502.01456","metadata_source":"pith","pith_arxiv_id":"2502.01456","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Process Reinforcement through Implicit Rewards","venue":"cs.LG","work_id":"c31a2126-86f9-44f3-91f3-208d0fc1463a","year":2025},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2502.01456","citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:53b37a3ad2008c5070e7fecf88011a0a3ecd920c32b4d183bbf4dd1d5419c19c","observation_id":"2302aa4c-2d59-462a-b0aa-4d1157930e8f","resolution":{"observed_at":"2026-06-28T23:12:46.220546Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":"Schulman, J., Levine, S., Abbeel, P., Jordan, M., and Moritz, P","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:881ce3e50095a9b24dd102ac895b5a61e9c198f91a173899ea20046156eb8e51","observation_id":"056bac2c-7df8-470f-a2cc-97dffe61c078","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:8c32d4c897de73355eae93ca0a0ccfd366f6dcd4f29ba0e2296d912f3d7e99bd","observation_id":"64fdac0c-b326-4fdf-aef3-3d6dbb13befc","resolution":{"observed_at":"2026-06-28T23:12:46.217948Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":"Method In-Distribution Performance Out-of-Distribution Performance AIME24 AIME25 AMC MATH-500 Minerva OlympiadAvg","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:85894e1d11adc932f140cebb2844e5d7b3db984ad7cf49f9cab44fd382a4f80a","observation_id":"483ecc1a-e794-4d2a-aeb2-a3fb23e32404","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":"Actor Update Time","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:e73ab0f26889ecf025a2137428c2b769002f08a7b6e8fe40dd37dc9d9ee3693e","observation_id":"d4c1de3e-0f49-4268-aef4-1761696f16ca","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":"Then the difference between the largest and smallest roots of $fˆ{\\prime}(x)$ is $\\qquad$ Q2: What are the four rollouts (R1–R4)? A2:We list the full trajectories (verbatim) below","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:6a8b91c3969dbac954d9c027f517857eb09bd27ef6db7750d88e575221af6fa2","observation_id":"bd3ae559-313e-4d31-87e9-931b638c8cf9","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:3c8014a1c6c1ae3260400ec8d52b08b764df4b5d316ebc4bd4b4dae3287785a5","observation_id":"0a941b97-a4bc-4818-86db-e1b34db77770","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":"We need to find the difference between the largest and smallest roots of the derivative $fˆ{\\ prime}(x)$","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:1585f8fc499dbb5219d90a13fbfdc1b699304ec0996110c9a7a04069cedf18d4","observation_id":"a2e2cf9d-772d-43ab-b90e-9e2ee8431efd","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":"We can shift the polynomial to center the roots at the origin","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:9ee8cb552781af55e8b4bb02294ad902b1fd21a055c44c5379c3885ac0d5a655","observation_id":"080decef-5ad1-429a-a4b2-ca2437799678","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":"The polynomial in the shifted variable $y$ is $g (y) = (y-3)(y-1)(y+1)(y+3)$","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:5ee79e02a8be3a0fc44afff34eff6e557da28caa29c9d1f37c7424e07691eacf","observation_id":"4492f3a0-b194-480d-92a1-9a4e8faf8311","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:724c3ef1cd1d54f4d614788ee039b83f44348b9e618ed9a8666f51947090014e","observation_id":"1bf5d2d2-8350-479e-b5cf-85e889649063","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:77b114fbd1070b046516d19106971d03ef5576496a5ec2e6cc93b8f28c36a3da","observation_id":"0be60257-25a1-44f5-bcf0-71dde38d5970","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":"This will be the final answer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:e9803ad36325b2355640fe3915d1240724f55a499202f695299601e74da017a8","observation_id":"e07b9582-e346-44cd-91fc-6c34b94d51f3","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:90236560ee0152449476dee712c58e1fc992766d601450dbb321313ef7486ed4","observation_id":"9cb8966f-6268-434d-b06e-907d851ade8e","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":"Let’s map the roots to $\\pm \\frac{1}{2}, \\pm \\frac{3}{2}$","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:552aeb6820c0646575389f3d2da6ed6cbaec83c915c29138c281acf43bb5887d","observation_id":"cd34062a-6a9a-4934-b5ed-45d77e19c0d8","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:4b15d956ae2ca0f9d5a233653b2385db5bfa090170f47634db5976c59fb5fc11","observation_id":"55c8f786-a2a2-4d5a-8851-945767870ea4","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:64fc6f495c2d72b1eafdfaea72c0acf949fe6f88c5a8ee70f0ecc99c3b2c6d5b","observation_id":"b777a1ba-b483-4dfa-b7ca-06ef8d61cb7c","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":"Since we scaled the coordinates by $1/2$, the distances in the $z$- domain are half the distances in the $x$-domain","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:c685a74c836b497727cbd0eb2397d0a1f0027b6e512855d1d087cd64ce228127","observation_id":"e5487271-2967-4fbe-b9f9-697e5a70fc38","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":"Centering them at 0 yields the set $\\{-3, -1, 1, 3\\}$","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:319439dd70dde9f6ef3bdce0a387917833279be452970b2680982315e5f60bde","observation_id":"8b16f37f-bd0e-406c-9ef0-843c0b12740e","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:5f9e562f9fdfa6c62e43d6593b1c1eb203564f8f1f00ab551865fd15391e54f6","observation_id":"ec1fbbac-2603-46a6-8e82-e23e80ef2b76","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":"This immediately implies that $gˆ{\\prime}(0) = 0$, so $y=0$ is one critical point","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:5af3b51c40a3d0d9e43e58e1110caa771fafa8d129a6906775a2c4fae9e4be9f","observation_id":"ccaf6248-c933-43ec-887b-268ecc50a41c","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:97bbabba4a5eff33ebd66cdacc6f1a4bb6bdc89796796fa952c9e98c3aea386b","observation_id":"add22cf0-c8f2-4f1e-80fc-01e610a52872","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":"The difference between the largest and smallest roots is $c - (-c) = 2c$","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:eeadfa55923c4ee490da66471b18dcf5312666ea44350deb4ce9ea49cef8aebd","observation_id":"3138149a-a03f-4ec5-bb8d-1fcef383797e","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":"Let the shifted variable be $y$","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:57ffc37c0462dba13bbb23f5da9cbece4aefb5a802441062791e16365a965b84","observation_id":"8a352652-7b9e-47a2-acfa-ff874234c73e","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:be439516043501e1631257268559e8727b38d419f4195c1f07bfb7a81cf26417","observation_id":"bfc54b28-f004-4e32-b9d5-af6e66b4ecae","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:28617e532968854524203bb1670eb58f8e6ecfd8912344d4e32ae37144c0f9ae","observation_id":"ee7ab65e-eddf-444c-a392-97b20fd8e09e","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:c1dbaa29d436be417053d4affe1711ee763908e24bbc9d2da1a6ed3107133268","observation_id":"f488eec7-34ca-4f50-beba-cb567abdd6d2","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:f93e30e06f51765d238331f622802cc136d85b6a556209f47cf60d2982fc6bae","observation_id":"edf9124d-0542-402d-8a06-eca0ca640e3c","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":"Let’s solve using this method","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:8857f26b9179c208e7b77ea2903084092538f48ca55623306ff8ddee2183463e","observation_id":"83da192c-eb51-401a-b863-4e4841c6a0a2","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:821225c7f1daea962c61f6b9d92676fd1cc6ea9deeab66d4b2dd52358644966f","observation_id":"ded55c7d-fabc-47de-8082-8c83617c42c1","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:e8894fa22d4b2ad2fa9966318b0b64a7f9af0e413a5c897bf85df2b2198a4bf0","observation_id":"554a3841-e588-40ed-8c48-21329c553ae1","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:08:19.084708Z","title":"<think>\\n thoughts </think>\\n","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T23:08:19.084708Z"},"links":{"citing_paper":"/paper/2605.31228"},"observation_digest":"sha256:39a5a3c19e85d41e23136fca8ecb67ba114d54baf3cbfcec54eaaf6c02a37c94","observation_id":"a47eb624-3441-4af2-a2ae-32888c3ecd5b","resolution":{"observed_at":"2026-06-28T23:08:19.084708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2605.31228","last_updated":"2026-05-29T12:31:55Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T23:40:27.543522Z","submitted_at":"2026-05-29T12:31:55Z","title":"EchoRL: Reinforcement Learning via Rollout Echoing"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 2 inbound Pith citation observations for arXiv:2605.31228."}