{"as_of":"2026-08-07T10:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e965459bd8a0ea4e25ce15d5025a0e23599ce4b7f82f6ef940a80b103b8d8f92","coverage":[{"denominator":169,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T00:47:51.407786Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.25123/citation-record","integrity":"/paper/2607.25123/integrity","json":"/paper/2607.25123/citation-record.json","paper":"/paper/2607.25123"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.111968Z","title":"Neural computation , volume=","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.111968Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:3eb2df7a88bd26b2a54a62163934e199ce1ab1db448b963d8fb05fb5b4a4abc6","observation_id":"45234cf9-4400-42a6-8821-8512608626ea","resolution":{"observed_at":"2026-07-31T00:47:51.111968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.115173Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.115173Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:a19cba9ef9d1bb0b17a0c23409a86f3949324706cfceb97e8c3263c082224637","observation_id":"1fd74ced-a3ac-4b3b-a147-d65ebda6e86c","resolution":{"observed_at":"2026-07-31T00:47:51.115173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.121976Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.121976Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:2e35c5f86769ec48df25b22ac2fb3eaaab91a85ffeab3b9555aba4a5dea729eb","observation_id":"93ef2e0c-f033-4b11-b653-6cbe8bb1d275","resolution":{"observed_at":"2026-07-31T00:47:51.121976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.125411Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.125411Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:3f098e5c99d177275f870341c7c02fb265e26e36b1c31542ceeab1fb3a571bf4","observation_id":"68ac1859-130b-4acb-a992-8bcd2a9d1b8a","resolution":{"observed_at":"2026-07-31T00:47:51.125411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.128562Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.128562Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:b1f69a9e04bb99ba21742a772dcb1b20af41f723ba1cd902264871e281af541c","observation_id":"a6f473d3-ebb1-4bfe-bad6-7e719396f40d","resolution":{"observed_at":"2026-07-31T00:47:51.128562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.131816Z","title":"arXiv preprint arXiv:2507.09087 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.131816Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:1b65aedd0fb262fe2e38861d333767701ece2b25e56ef5ae6c467ad4d8fde74d","observation_id":"a877f7e8-0ca0-4faa-b352-c7079cfabfe4","resolution":{"observed_at":"2026-07-31T00:47:51.131816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.134917Z","title":"Proceedings of the AAAI conference on artificial intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.134917Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:2d1edf1ebd7eb6f9acb8999f444a4c3aaa9ba296dc1c7c71da160552bc9c29e8","observation_id":"a5a32b0a-1693-4b19-bebe-c27e87f25728","resolution":{"observed_at":"2026-07-31T00:47:51.134917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.137774Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.137774Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:c63bad27e63e8c8bfc75bacaefbe45e8d794a5fc492eb6c7b8c4c81e21d93dbc","observation_id":"30da7685-0c0d-4ba9-a491-4990b6241dac","resolution":{"observed_at":"2026-07-31T00:47:51.137774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.140868Z","title":"International Conference on Machine Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.140868Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:d3cf48ffb8a1d03d7c5ee7fc803a93f97da0b88806ffae73402ed7aed7b7859e","observation_id":"b9154672-8d24-4cae-aaf3-4e9672dbd946","resolution":{"observed_at":"2026-07-31T00:47:51.140868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.143802Z","title":"IEEE Transactions on Signal Processing , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.143802Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:522cb914dcb20c1d91c1a3e1a843c73073393c27a0c4e1e4ea47c1d57bb21228","observation_id":"052e6342-faed-4a20-8882-f179c54a7352","resolution":{"observed_at":"2026-07-31T00:47:51.143802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.146740Z","title":"Journal of Machine Learning Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.146740Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:bb0689831c4132b3295f4c5de344aff598f730a3a10cc74b382620c79f10fa7b","observation_id":"de9b2c58-6796-459f-b9b9-48c941f43d6f","resolution":{"observed_at":"2026-07-31T00:47:51.146740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.149479Z","title":"The Thirteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.149479Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:99685032bf5bbf5d5ddaf297b1a48c31d1fe7a2cb7d7837a5087e6a1bb346145","observation_id":"06a82a7a-6023-4766-b772-daddea8070b3","resolution":{"observed_at":"2026-07-31T00:47:51.149479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.152247Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.152247Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:2aaf83c05fc6d3a86026574b789f2e8c935ffed27238baa59a81130041db6934","observation_id":"6d1826ba-e9a2-4216-b9b0-f58483869b36","resolution":{"observed_at":"2026-07-31T00:47:51.152247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.155360Z","title":"Proceedings of the Thirty-Fourth International Joint Conference on Artificial Intelligence , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.155360Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:4c5bae785bf5f40b6f05adc25311269cfd9026080578dad8474ec763feb6790d","observation_id":"364f8049-682c-46b1-b13f-deb716d0b695","resolution":{"observed_at":"2026-07-31T00:47:51.155360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.158258Z","title":"IEEE Transactions on Signal Processing , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.158258Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:89254dee6f3c1442f638d9c5c2aad6e7984eb9d2b9c243553fc548c72fc9371a","observation_id":"c57c539b-75cc-4319-8775-d90ddce8ccab","resolution":{"observed_at":"2026-07-31T00:47:51.158258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.160903Z","title":"AAAI Conference on Artificial Intelligence , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.160903Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:99aed7458de1115724275742a6937593ab5313ca389f55bacac2aa656694989d","observation_id":"1c6db84b-f4e8-4f8a-a943-dff6ca0e9ce5","resolution":{"observed_at":"2026-07-31T00:47:51.160903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.163545Z","title":"2022 , journaltitle =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.163545Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:e8b9546c9a7a3fb7c317e9652913192014ce78fad3064f62b41f4a603644602c","observation_id":"6d6c9627-02e8-4f84-8ef8-ce4b0ef15126","resolution":{"observed_at":"2026-07-31T00:47:51.163545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.166711Z","title":"nature , volume=","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.166711Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:fd7d3a8824e004cf14293f7868ce1c8bb427d63b3232d1fde4f5b7130b00bdbc","observation_id":"94ba4c67-951f-434d-99db-bc5024a64d97","resolution":{"observed_at":"2026-07-31T00:47:51.166711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.169499Z","title":"Proceedings of the Ninth National Conference on Artificial Intelligence - Volume 2 , pages =","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.169499Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:6ea785eabd1f90a2ee6056a0f8ade925d12ea78b765dd71c92dac3a0ef1a29b0","observation_id":"ee8f269d-7982-4879-9c83-bcb337cf3a44","resolution":{"observed_at":"2026-07-31T00:47:51.169499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.175567Z","title":"and Barto, Andrew G","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.175567Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:f66d453a0c5ae4f01225e8444c8c872e96ac1b06fe039eb1791119f7a51e9794","observation_id":"8ed5cba1-d7d0-4092-880f-7b3b055961dd","resolution":{"observed_at":"2026-07-31T00:47:51.175567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.178600Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.178600Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:189d9f78cc30a258243fe355f186764530ceaa06ba87dae2778b38b0f9239cbf","observation_id":"8991ba46-585d-4be0-8792-51ccae132442","resolution":{"observed_at":"2026-07-31T00:47:51.178600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.181641Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.181641Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:35c422c900f954420a337e9df710e0b1acf62702bc868c05b8057b3b2e0f45b8","observation_id":"4290ba54-16a3-4e8a-b74e-1f022e2284a0","resolution":{"observed_at":"2026-07-31T00:47:51.181641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.184892Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.184892Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:f7897417b5ddd3a678267e07a6dd866250fa0f57c462a67a353cac126bb9839e","observation_id":"3035b10c-15d1-4142-b1dc-e24e58407a20","resolution":{"observed_at":"2026-07-31T00:47:51.184892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.187604Z","title":", title =","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.187604Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:2a19a0a3c765bb2815d285116d742d083aa80c4a1b8c468d83c99a7cc70d210e","observation_id":"cf9b20f5-f067-4f4d-9f4a-4119f4a4e0b9","resolution":{"observed_at":"2026-07-31T00:47:51.187604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.190230Z","title":"Journal of Machine Learning Research (JMLR) , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.190230Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:5f9e5c108322bced8a1855097d05de3bad87de118c8f865f629356d41b08fd97","observation_id":"b5f9b704-8fc0-4f05-b8df-8f4fb63d2ae9","resolution":{"observed_at":"2026-07-31T00:47:51.190230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.193039Z","title":"International Conference on Machine Learning (ICML) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.193039Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:191f2b23d99841d6bbb87015f5234630cd4e7be86f8fbfd7da0ddba7647eeae2","observation_id":"0996666c-7731-4ced-bdab-f238178969dc","resolution":{"observed_at":"2026-07-31T00:47:51.193039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.195874Z","title":"International Conference on Learning Representations (ICLR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.195874Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:d81812c63884b2779992735d53cfe646d42ce3b34d1079c1ba339c194a24b674","observation_id":"de98b11a-8451-4c7e-a19f-147e9bd8aadf","resolution":{"observed_at":"2026-07-31T00:47:51.195874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.198629Z","title":"3rd International Conference on Learning Representations (ICLR) , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.198629Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:e6175a9e73479d5ff484d47cf40c075960733d011229a6f7e41d821cd3e9fec0","observation_id":"c6ee6037-4406-4abc-aaa1-d6607998309b","resolution":{"observed_at":"2026-07-31T00:47:51.198629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.201269Z","title":"Sutton , title =","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.201269Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:f744c9b85786ce91c8c37fb4c5a03c088bb910646d1fe1342cf378c0bcf4bce1","observation_id":"0e8a92a9-3db2-41a6-8cc9-887e1dc50353","resolution":{"observed_at":"2026-07-31T00:47:51.201269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.205222Z","title":"The Reinforcement Learning Journal , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.205222Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:b493bcaffcdc15ae90afd7571f35f157372dfa23c3f6a7b4d42f76c1b0490e8e","observation_id":"9d1a75ae-2d2e-420e-89ef-78f727f8cfd2","resolution":{"observed_at":"2026-07-31T00:47:51.205222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.208047Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.208047Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:ea66035b51a484698b646279b15f9bdae43e1e7acb6293ac96d483624871266a","observation_id":"dd2c011d-125a-426f-add8-325669ecc021","resolution":{"observed_at":"2026-07-31T00:47:51.208047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.210879Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.210879Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:d0a88a6065a01bf33b4de009e95551cd40910e20118a277cd36cf524dfdfad25","observation_id":"6610599a-54fe-4e5c-b1e2-67b362e369b6","resolution":{"observed_at":"2026-07-31T00:47:51.210879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.213739Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.213739Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:4256cbc9b574e9d99d0896e3604c966871961c6424f157df84416f1e52fc05cd","observation_id":"27bc263d-1542-408c-b535-9bc22a559e6d","resolution":{"observed_at":"2026-07-31T00:47:51.213739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.216559Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.216559Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:242ed5bf41325c405af0e58ad5914f052e0ecb3055c55b95ab4108004ad5c9c6","observation_id":"22239a38-d20f-482b-adc0-0c46d0f5a30f","resolution":{"observed_at":"2026-07-31T00:47:51.216559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01603","last_updated":"2020-03-17T17:10:58Z","snapshot_observed_at":"2026-08-03T15:20:23.515607Z","submitted_at":"2019-12-03T18:57:16Z","title":"Dream to Control: Learning Behaviors by Latent Imagination","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01603","snapshot_observed_at":"2026-07-31T00:47:51.219491Z","title":"arXiv preprint arXiv:1912.01603 , year=","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.219491Z"},"links":{"cited_paper":"/paper/1912.01603","citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:8769688b0d7ca7665c35fa343607bb48ce26a7f798a05587c7049581cf027b88","observation_id":"3a53ca67-1c1e-4a00-a8c6-74945484f6ac","resolution":{"observed_at":"2026-07-31T00:47:51.219491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.00374","last_updated":"2024-04-03T14:26:32Z","snapshot_observed_at":"2026-07-06T07:36:24.725625Z","submitted_at":"2019-03-01T15:40:19Z","title":"Model-Based Reinforcement Learning for Atari","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.00374","snapshot_observed_at":"2026-07-31T00:47:51.222914Z","title":"arXiv preprint arXiv:1903.00374 , year=","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.222914Z"},"links":{"cited_paper":"/paper/1903.00374","citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:b4e99529c21984b9e2799527adb0e8b9fd82e43c7f899d7210b7f5af82d8829b","observation_id":"b2c4c851-7f80-4d88-9d86-5eb636633f27","resolution":{"observed_at":"2026-07-31T00:47:51.222914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.226248Z","title":"Medical Imaging with Deep Learning , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.226248Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:426fc38426486ce87250f0d22a850ec7d2ecbe2d803d747f9a425024bc2c7bc5","observation_id":"5a1426ba-c0e4-45b2-a565-c8159b12a24e","resolution":{"observed_at":"2026-07-31T00:47:51.226248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.229350Z","title":"Proceedings of the 40th International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.229350Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:dce5130adb6893b22da8cb710c2ea956b794d4b8e04bff8695154fff21fc360b","observation_id":"4fc92b92-5381-4178-8e59-a4bb4730aaf0","resolution":{"observed_at":"2026-07-31T00:47:51.229350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.232277Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.232277Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:8280236d3c2ee2b9726a5abfdd781f389719982e860b43173d9ddd4bf36fcf9c","observation_id":"ef3d9843-8ed9-41c3-9910-6dc5903fba91","resolution":{"observed_at":"2026-07-31T00:47:51.232277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.235131Z","title":"Artificial intelligence , volume=","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.235131Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:6d09736d8f6f811cb16817bf3af19fcaf55048dd146ce3245cddc3cc9e03fd1a","observation_id":"657360cc-ff7e-491f-915a-d8775078402f","resolution":{"observed_at":"2026-07-31T00:47:51.235131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.238145Z","title":"Artificial Intelligence , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.238145Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:49436b3c36267416fc7c0c552a6eda3d0902e4ac5420ff19c2a17f7be697000b","observation_id":"1f587b7b-3c35-4bea-945a-89fe0c854464","resolution":{"observed_at":"2026-07-31T00:47:51.238145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.241263Z","title":"Journal of Machine Learning Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.241263Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:2bcfeaf2dc1957632ffe1b7e1e03f056d77d1ed4b32aa16ffbcd2144f493c881","observation_id":"6de3314b-0a8f-4bce-ac2d-7fe4b9e83672","resolution":{"observed_at":"2026-07-31T00:47:51.241263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.244001Z","title":"Journal of Artificial Intelligence Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.244001Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:5416d15e7f54e1a2a6f58163e47a5a16f5757a540a57447d001420cfdbef7205","observation_id":"3102fc96-cbfc-4e9f-b593-9004e8608ea0","resolution":{"observed_at":"2026-07-31T00:47:51.244001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.246884Z","title":"Proceedings of the AAAI conference on artificial intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.246884Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:e20e3825f952522f3db6ceb148342811124f5c07ff12585dec1c238a147b0014","observation_id":"019fca96-1ba5-4cfd-8084-20817e61d0c3","resolution":{"observed_at":"2026-07-31T00:47:51.246884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.249797Z","title":"Machine learning , volume=","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.249797Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:88069bbe42550c965b33002fa8bf7852c0100162b03bc30ad1df95c99a04b4bf","observation_id":"f6750aa9-b94c-46c9-b1e1-e511b49b6fce","resolution":{"observed_at":"2026-07-31T00:47:51.249797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.253109Z","title":"and Naddaf, Yavar and Veness, Joel and Bowling, Michael , journal =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.253109Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:b1b2f4c171150232a9f2cac6ae4cd189d752f95f520d11eb1c22ecbf10b96b1b","observation_id":"9ade702c-f0ea-4369-a303-8682bc4d447a","resolution":{"observed_at":"2026-07-31T00:47:51.253109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.256027Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.256027Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:ba3be48c175ed8a91f2cf6aef7ddc4fae9505610347d68bc755d488b470c3da5","observation_id":"524fdad9-ecdf-49ff-a4ad-f611752f920d","resolution":{"observed_at":"2026-07-31T00:47:51.256027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.258986Z","title":"Proceedings of the AAAI conference on artificial intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.258986Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:00ac2c55d07fea1d6718d920eae7e269edff4a809cbb145f85beb081f2cd9dac","observation_id":"0f7c7488-6157-44ed-ae85-ec0899b82ca3","resolution":{"observed_at":"2026-07-31T00:47:51.258986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.261685Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.261685Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:dde88e4451c4b71b274a765d8a399fedfabc28d3de8be3f9660ea0c730551d3c","observation_id":"4dbe46aa-cb07-4e65-8aaf-982d79dc582b","resolution":{"observed_at":"2026-07-31T00:47:51.261685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.264576Z","title":"Proceedings of the 27th International Joint Conference on Artificial Intelligence , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.264576Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:3af0220f361bf372dadaadd13cd70a7baa765791352d1e6f1763078cc7189f59","observation_id":"3ef28edf-4514-40b1-a3f1-8375add670d8","resolution":{"observed_at":"2026-07-31T00:47:51.264576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.267536Z","title":"Proceedings of the 37th International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.267536Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:367da0d1d89fc12a22e263a6cdbe079f6aa61defd8586ff954b10deb8d23ee27","observation_id":"de1e8f5a-3b0a-456a-a002-75b51345f4bf","resolution":{"observed_at":"2026-07-31T00:47:51.267536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.270401Z","title":"Experience Selection in Deep Reinforcement Learning for Control , journal =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.270401Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:860a78e3ab1551648ffea7cc0aea4565bd5aedc468451e6ebf11d09ac36da837","observation_id":"b64dd735-12b1-484b-a0be-9fb0f8902b18","resolution":{"observed_at":"2026-07-31T00:47:51.270401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.273121Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.273121Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:41d22189fa89f1e20f2d79537f7ec22517d0dea03adbc94aa9d716d45dd25d62","observation_id":"cc5ee217-eb50-419e-88d4-9e84a64239a6","resolution":{"observed_at":"2026-07-31T00:47:51.273121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.276164Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.276164Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:7f3f1f039aa29b43b9e9679c1996084ceb127e2b3738f333a15aad2245825c35","observation_id":"ef3f48f9-fc69-4e5a-9369-155390bc2a1d","resolution":{"observed_at":"2026-07-31T00:47:51.276164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.278888Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.278888Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:8b5d3c208f840387638a5c8c9e46f4c56c4b0bac8dfb237d12e9be4c8f9c35b8","observation_id":"b2f01ea4-e143-4332-8afc-2266d79db41d","resolution":{"observed_at":"2026-07-31T00:47:51.278888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.281512Z","title":"Proceedings of the 40th International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.281512Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:0085049d6cdd2b57854a151ff2f4e30756a8adb4372bcdee0b295ca458d14d7c","observation_id":"92163691-dd61-4f87-ad44-c8674771b19c","resolution":{"observed_at":"2026-07-31T00:47:51.281512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.284198Z","title":"Proceedings of the Twenty-Seventh International Joint Conference on Artificial Intelligence,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.284198Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:4776ba9c6e829d32d884dc68b40c70ba953504d27678feec0aadc0e7402f5506","observation_id":"aa3bd543-ceff-4859-ab3c-4dca1ca96051","resolution":{"observed_at":"2026-07-31T00:47:51.284198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.287072Z","title":"No More Pesky Hyperparameters: Offline Hyperparameter Tuning for","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.287072Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:a9ba395ae46a567573a7a11bdd0dfe2e15771be0838e78f148d9aa9f19e3ebb0","observation_id":"aab31cad-ddde-4d0c-8a3d-c50a62bc7f9c","resolution":{"observed_at":"2026-07-31T00:47:51.287072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.289768Z","title":"2013 , journal=","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.289768Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:b18ab4aa3b6da3b35b6053d78aa05b04cb496e381f346b4516a78ead18dd1cc3","observation_id":"0fdaedc8-5b1c-4a17-bc99-cf280463634a","resolution":{"observed_at":"2026-07-31T00:47:51.289768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.292570Z","title":"International Conference on Learning Representations (ICLR) , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.292570Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:7af4ac4c9d90af624bb095b2004b42cbe5a6154b3d5865ca70855be2e43aefe2","observation_id":"4a179583-7bca-4919-b4f7-e9f76f28ee6c","resolution":{"observed_at":"2026-07-31T00:47:51.292570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.295192Z","title":"Reinforcement Learning Conference , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.295192Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:2a0b2b5f05b3efa00c69650d0cf45d82dc0217dd6e52c6fe5f282e8e4706b3ce","observation_id":"472f768a-6a7d-46db-b550-52c84a8cef89","resolution":{"observed_at":"2026-07-31T00:47:51.295192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.298022Z","title":"Reachability-Aware","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.298022Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:fa4743d1d9767e0e2f1845acdf3c41dca6916d00bd894ea0feec60b52d52ea4a","observation_id":"a4a7b849-4ea0-489a-9464-01d7f2c23a90","resolution":{"observed_at":"2026-07-31T00:47:51.298022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.300664Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.300664Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:ce89d239c95eeea55db9878c250990d84ab61b41c92258207a92c7878378e5fc","observation_id":"2726796e-27b9-4575-be55-851f0bd5ffa6","resolution":{"observed_at":"2026-07-31T00:47:51.300664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.303398Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.303398Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:40c8872bc0c59bc6c8edf1783ea68e6fc3e93468e4afe574afe7c65d02a726c5","observation_id":"d5a84089-6fd9-47f9-9bfa-d70c82916903","resolution":{"observed_at":"2026-07-31T00:47:51.303398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.309217Z","title":"Medical Imaging with Deep Learning , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.309217Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:71f11e6e9d0f73a74b4f6a865d21b0f19f56ce4fd32f154004b04cae6ef3a82b","observation_id":"8482040a-f0ff-4aaf-8260-a51378459d47","resolution":{"observed_at":"2026-07-31T00:47:51.309217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.311905Z","title":"SIAM Journal on Computing , volume=","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.311905Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:7b51c1820ac3b73b5cfd7527c426ac224cb2ac3894f2f5f6136e340cf2add503","observation_id":"c604cdb3-0947-4294-a8c8-22a5e0e13178","resolution":{"observed_at":"2026-07-31T00:47:51.311905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.314567Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.314567Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:a988b7116f3db59369b2ae72b0e0c0e5d5d39d1f683f4d90422452984e05a42d","observation_id":"a545f962-8ae8-4130-945b-efb23160e31e","resolution":{"observed_at":"2026-07-31T00:47:51.314567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.317250Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.317250Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:2b2ede49b0a1c81355733b181804cd635d6b59e40e18280274f0b1c73cb6877d","observation_id":"4946b300-bf26-4f3d-8f74-4d57b945c354","resolution":{"observed_at":"2026-07-31T00:47:51.317250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.320066Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.320066Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:0146ec6e84fdf1f5e1b24917835053e6386f9fd90f7e4d0a708c47a1e3f8bb6f","observation_id":"bbb72193-0d8e-4b17-ad4e-8de4f08a0db7","resolution":{"observed_at":"2026-07-31T00:47:51.320066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.322729Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.322729Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:22568a7ac4800baa0cbe6a8590ae9ba70ab3e4579bd7930318107ef126871cfd","observation_id":"f0e3eae7-ca3b-40f0-9aa5-620b17a19120","resolution":{"observed_at":"2026-07-31T00:47:51.322729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.325559Z","title":"Machine learning , volume=","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.325559Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:f35ef1232d689bf978b646f90bb9d1524b8c50c1c74af07b14febcad9a3f6b00","observation_id":"244772cd-4ba7-445a-8421-b06d152ca903","resolution":{"observed_at":"2026-07-31T00:47:51.325559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.328272Z","title":"arXiv preprint arXiv:2509.15032 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.328272Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:3c9c356f04870077dde6612b1b4413c5e611451176a7b920038af7d0dc7c4a32","observation_id":"7fa5ac10-b90e-4571-a35b-0560ef8296e0","resolution":{"observed_at":"2026-07-31T00:47:51.328272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.330972Z","title":"Transactions on Machine Learning Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.330972Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:cde85a22719c4c0e0e722509db7d096c114ccca2d3a07e1c397b091088079283","observation_id":"eec46e78-c114-454d-b710-c99d8307723e","resolution":{"observed_at":"2026-07-31T00:47:51.330972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.333596Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.333596Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:b2c0790c8df68f9522aecb06922789515ad06d505b3933a7d6741e32e8cf48be","observation_id":"9e476605-e3a3-4e92-bc3e-ba4eba5d651a","resolution":{"observed_at":"2026-07-31T00:47:51.333596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.342233Z","title":"Proceedings of the AAAI conference on artificial intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.342233Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:089b0ed312eb506503c5c988be9090959438b10fc7b46fa2177da56b2e714905","observation_id":"8af38a6f-ab00-4a50-af06-e623c110c2db","resolution":{"observed_at":"2026-07-31T00:47:51.342233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.344831Z","title":"2023 IEEE/CVF International Conference on Computer Vision (ICCV) , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.344831Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:bfcd4acefaf47ffce14d43b75d9f4c9d6e44d15190e3c3913c263327a2a6b7f7","observation_id":"2b487743-2185-4893-942b-0ad214f17e23","resolution":{"observed_at":"2026-07-31T00:47:51.344831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.347580Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.347580Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:7e4a4344e45665960ee21f6bae23c4924c23d69719dd3b5b767b49bdd491ad05","observation_id":"dd04982c-3034-4831-8c51-ca9cb281a5ce","resolution":{"observed_at":"2026-07-31T00:47:51.347580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.350201Z","title":"Proceedings of the 28th International Joint Conference on Artificial Intelligence , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.350201Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:722ac09f1a7f7fb40c94b591635fe8f1fb7b99bcab6c0df3238c4a097b8d6807","observation_id":"daa60760-9818-4002-9edd-5692ec8c5564","resolution":{"observed_at":"2026-07-31T00:47:51.350201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.352696Z","title":"Frontiers in neurorobotics , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.352696Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:c7a10f71c1cf64350c46db2441fd6754358839028bf9fa130266aeeccb5fbec3","observation_id":"efec67d3-ec0a-4038-8ecf-d06171a1503f","resolution":{"observed_at":"2026-07-31T00:47:51.352696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.355082Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.355082Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:c96631c388ead0dfe3fcbe2cad036de30badcecf8f1784728efe1412bb8ed18e","observation_id":"b11b6407-79e6-483a-b699-65b223780e4d","resolution":{"observed_at":"2026-07-31T00:47:51.355082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.357604Z","title":"Proceedings of the National Academy of Sciences of the United States of America , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.357604Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:f5dcb5d2d6f1e1142d6adcf3b44e1832c23e3624923b8b5e1e9712b79273926e","observation_id":"15573386-0f9b-4571-a83b-74c0b0859388","resolution":{"observed_at":"2026-07-31T00:47:51.357604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.360203Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.360203Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:d96e7c825159da81d7e29b8649d8d78351ade09cdd7885ee9877fa1580fe0fc9","observation_id":"00871f67-1c0f-458a-a823-68718eff5e04","resolution":{"observed_at":"2026-07-31T00:47:51.360203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.362948Z","title":"Transactions on Machine Learning Research , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.362948Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:df7655ecf0aafc8cd439cd71d164171c5435b8ab41124e4f159131fab4847166","observation_id":"39757fc9-691e-45c1-a3fe-1855e039e383","resolution":{"observed_at":"2026-07-31T00:47:51.362948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.365558Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.365558Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:0cbd9066b1d45a7d8bde1ccce41c38aa0ba056d6d9a67ffb25c43adf849ceb39","observation_id":"dcd26718-28dc-436d-b57c-3c2b61721b6b","resolution":{"observed_at":"2026-07-31T00:47:51.365558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.368111Z","title":"Applied Intelligence , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.368111Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:0cb8cf7e683f47f7c6969a9fe3e0ff1ca8be20fd58082adc87045c01805c9d29","observation_id":"330cf8da-5b93-4cf3-915d-7586212b4abd","resolution":{"observed_at":"2026-07-31T00:47:51.368111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.03261","last_updated":"2021-02-05T16:09:07Z","snapshot_observed_at":"2026-07-06T10:38:52.497164Z","submitted_at":"2021-02-05T16:09:07Z","title":"Revisiting Prioritized Experience Replay: A Value Perspective","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.03261","snapshot_observed_at":"2026-07-31T00:47:51.370566Z","title":"arXiv preprint arXiv:2102.03261 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.370566Z"},"links":{"cited_paper":"/paper/2102.03261","citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:6fbddbef2d0b33209ee1b572ddccdeaa6511df0cdb8dfa9e3463343f02ebe4e6","observation_id":"856b57c7-831e-4f62-9276-f22232da9ded","resolution":{"observed_at":"2026-07-31T00:47:51.370566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.373254Z","title":"The Eleventh International Conference on Learning Representations , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.373254Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:f53109874f8b54e452604cc3f509ed358c7f4aa5c3d5ee6cedcaef5323c65f3a","observation_id":"915533a3-bcc4-4e8c-abbd-daaf99b7c917","resolution":{"observed_at":"2026-07-31T00:47:51.373254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.375829Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.375829Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:0d90a2ef673ddc1d7e41a317e12c168bc4d6982dde9e6b261db0d817b34cabf5","observation_id":"4e18accf-f607-4f74-a613-1aea240238e9","resolution":{"observed_at":"2026-07-31T00:47:51.375829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.378509Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.378509Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:22656579c095279308e8d5f830f02a7793425b3ee5cf4c0a74a28961e85ed102","observation_id":"dc451ad3-3562-4bfc-b6bc-562f96f248ea","resolution":{"observed_at":"2026-07-31T00:47:51.378509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.381407Z","title":"arXiv preprint arXiv:2512.01034 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.381407Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:22c93ee58a1e319b146b57864a49a7fc686fe4bbd8f90fc2ac685cf64bfffbd8","observation_id":"bbc4f46d-6b72-4304-9e8c-f2f9587423a0","resolution":{"observed_at":"2026-07-31T00:47:51.381407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.384157Z","title":"Transactions on Machine Learning Research , issn=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.384157Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:6838041802e3c98eadaed286d06af0c4c8ae4f137627dca4e0d1b364b283618b","observation_id":"f70dd361-dff2-4e6c-809d-1e17df3933c4","resolution":{"observed_at":"2026-07-31T00:47:51.384157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.386754Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.386754Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:2958d3ec6af00c62d9b6e94099b6161c217222a5a03716d556d845b9432d69ca","observation_id":"626b81c8-0970-4776-bb6a-0fe1d17cb799","resolution":{"observed_at":"2026-07-31T00:47:51.386754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.389250Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.389250Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:1d0c34f01591ca0aa05271c6419e5ab7c744f94807d17d6f3f245123bf457df6","observation_id":"d5d41d7e-04b5-43e3-b086-55826a945dc5","resolution":{"observed_at":"2026-07-31T00:47:51.389250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.391764Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.391764Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:286e663d2dab24054a57fe7880aad85d761ea424134d0e4b9c4c98ad6360e0a5","observation_id":"8cf99441-2b28-4475-a473-429642c36da7","resolution":{"observed_at":"2026-07-31T00:47:51.391764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.394303Z","title":", booktitle=","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.394303Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:cf14f397f138b8e7575a6cd6738e60c1d6ce0014890662aef7b49d511b3e3f3d","observation_id":"6bf92801-822b-4fd9-8752-ff5bf75fdbf7","resolution":{"observed_at":"2026-07-31T00:47:51.394303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.397231Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":102,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.397231Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:409fee255e8809312c8cdaa0150fffd4d8cb569107e56b9e2d83cea7363c9573","observation_id":"63350b18-2b1a-4012-87a0-42a88e1d2368","resolution":{"observed_at":"2026-07-31T00:47:51.397231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.399786Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":103,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.399786Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:544d82c47e4b2ce5fbff951d2cb575f789debb9cd74a6b9f7b59744ba255d340","observation_id":"4c7b00cf-41f7-4e6c-af00-b945dc0df27d","resolution":{"observed_at":"2026-07-31T00:47:51.399786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.402403Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":104,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.402403Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:ad4cc2b149a1d3c514622186cfa171ab221ea1ff012165411709318b9f74b3d2","observation_id":"18a175fa-d86f-4fa3-aca7-51dccbcf15b5","resolution":{"observed_at":"2026-07-31T00:47:51.402403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.405209Z","title":"Learning for Dynamics and Control Conference , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":105,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.405209Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:4a61f09e9a3decd5e8cf12bbac7a0f90564a874d5ee51ad8374bb8bb746fb465","observation_id":"6b3ceb3d-0553-4e19-a783-c58c5069abdf","resolution":{"observed_at":"2026-07-31T00:47:51.405209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:47:51.407786Z","title":"Nature , volume=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning","version":1},"reference_index":106,"source":"arxiv_source","source_observed_at":"2026-07-31T00:47:51.407786Z"},"links":{"citing_paper":"/paper/2607.25123"},"observation_digest":"sha256:9ae0b8d67d32d805d7f1a25eb51c9eea50d78bd3e6b020be66227104d87c836b","observation_id":"3f4a6595-fa27-4cfa-812d-ca052af6dd47","resolution":{"observed_at":"2026-07-31T00:47:51.407786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.25123","last_updated":"2026-07-27T22:33:09Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-04T14:34:29.536691Z","submitted_at":"2026-07-27T22:33:09Z","title":"Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":100,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":169},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 100 of 169 outbound references and 0 inbound Pith citation observations for arXiv:2607.25123."}