{"as_of":"2026-08-11T09:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:80ce4ecb6d0d141a3afe06daa2b3c7f39056c14e72227be0140a11b175e48122","coverage":[{"denominator":60,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":60,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T18:28:23.217523Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.00601/citation-record","integrity":"/paper/2502.00601/integrity","json":"/paper/2502.00601/citation-record.json","paper":"/paper/2502.00601"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:24.683561Z","title":null,"venue":null,"work_id":"e9861419-beda-438e-8f37-0f30fc78db3b","year":2019},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.214969Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:db56e06b10dc97053f1322018cee3265299253a4f40e41d274ab5520c9b77dbf","observation_id":"d456e6b2-a516-4db6-b04c-19e9b6acf80a","resolution":{"observed_at":"2026-08-09T18:28:24.687087Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:24.665690Z","title":null,"venue":null,"work_id":"91ec3bd3-dc7f-4916-9fc1-ba61ca6c9059","year":2008},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.248921Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:b6e3ba0e19580c014ab6b848b71baf044ebf4bb5bb4d981b58d806728ae462bc","observation_id":"6b2c7cdf-ecc7-481f-9bd1-baf00d87c62e","resolution":{"observed_at":"2026-08-09T18:28:24.676297Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:24.657027Z","title":null,"venue":null,"work_id":"e4d25d85-e0fb-4907-916a-906d23741585","year":2023},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.332482Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:4c28dd32447f9e979179ccc6e3610e812501ddbaea5e9b660e091ee6b8987dcb","observation_id":"686b45cd-e5bd-469d-a765-1b08a23e37ae","resolution":{"observed_at":"2026-08-09T18:28:24.659998Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:24.646648Z","title":null,"venue":null,"work_id":"61b6f5ad-d2e0-411a-a7fc-e3ae88ca03d7","year":2011},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.376736Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:e9117db41aafa3c63918aa57edf84b56669494d131ab6cf4f7000311023fd3cf","observation_id":"c4822bb1-0355-4b7f-970e-817a51c40ff7","resolution":{"observed_at":"2026-08-09T18:28:24.649415Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:24.638186Z","title":null,"venue":null,"work_id":"bb3a05ad-0685-43fc-b3fc-37f2b58d38f8","year":null},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.433337Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:527da27ffe5a9f96d4a5ad72431b08d9deefab849f58eee8f69370c4f0a68f28","observation_id":"192413ed-06c8-4881-bf4b-5ab90104f6f6","resolution":{"observed_at":"2026-08-09T18:28:24.640744Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13916","last_updated":"2021-04-14T23:38:31Z","snapshot_observed_at":"2026-07-06T09:32:26.221291Z","submitted_at":"2020-06-24T17:47:37Z","title":"Off-Dynamics Reinforcement Learning: Training for Transfer with Domain Classifiers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13916","snapshot_observed_at":"2026-08-09T18:28:22.453591Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.453591Z"},"links":{"cited_paper":"/paper/2006.13916","citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:b269e172645e80c0eaf463233209f72d601aa32f1cd50ec0f1943d5301e825ad","observation_id":"24ef9fab-4eaf-4b8a-8ef0-7245139e09ef","resolution":{"observed_at":"2026-08-09T18:28:22.453591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-08-09T18:28:22.457076Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.457076Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:3a82cb5f0312d0f99c5b67a8c4536215e4bf93b8fa71ed151a75ecf763e41d4d","observation_id":"37be3bbc-750f-4908-ab19-28e83713318e","resolution":{"observed_at":"2026-08-09T18:28:22.457076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:22.461068Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.461068Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:9c1b830bc97eb2962365a92f6d80ade2f3661fe2f85dfa367f6bf150ced0a20e","observation_id":"25c15887-6d0d-4e9e-b02e-ae538d721a7e","resolution":{"observed_at":"2026-08-09T18:28:22.461068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:22.467659Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.467659Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:eeac4f6f5a33842ebee855616a10587b0616ae19d41ae3768b411e81f7a61b65","observation_id":"eaa8cfde-296c-4fcf-9969-7a340ddf5c00","resolution":{"observed_at":"2026-08-09T18:28:22.467659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:22.470102Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.470102Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:5a53f388f929c70945f375c1b73df51f2c8cff87c8ce6c834d468cf18e5abec0","observation_id":"2eb1984a-bf97-4c44-b64a-e37addfce0ae","resolution":{"observed_at":"2026-08-09T18:28:22.470102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:22.472858Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.472858Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:079104e826ce28c9a25c942580a2951017eb4d7b6e5d3054eee9bae618aa1888","observation_id":"cda5987a-66f1-4080-9b47-be5a1a7ef5a2","resolution":{"observed_at":"2026-08-09T18:28:22.472858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:24.581071Z","title":null,"venue":null,"work_id":"43126d56-f4ee-4253-89f7-145e90791d3b","year":null},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.477475Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:18c4f3c9bf1532f934213e596e53d2d53e3b9f5f987c9da709301b6c00217a63","observation_id":"b8b2e3fe-9fec-47cd-8816-f5009f266391","resolution":{"observed_at":"2026-08-09T18:28:24.584278Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:22.483807Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.483807Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:94011a076dfde3bf70205f6bb9a747a4ead9e4d776fcba5c2c2ee0c66b7c6c24","observation_id":"7c0d16d8-87a5-48e6-8583-17dc519be16f","resolution":{"observed_at":"2026-08-09T18:28:22.483807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:24.528675Z","title":null,"venue":null,"work_id":"47d19fab-e600-4c28-b579-698bd42990e9","year":2018},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.486943Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:d4cdef8c89d72babbf7e933e08cead654eceac5325b0fcb3c88aed58624c8284","observation_id":"2b432cd2-65c9-4b51-80b9-f9c1f70b6c01","resolution":{"observed_at":"2026-08-09T18:28:24.534846Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:22.490509Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.490509Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:6c982b394dca96e30ef6c373ad58940d987e24e1405ff4b314b6b67911cfdb1f","observation_id":"7058ddc8-8736-434f-8284-275fea3498e6","resolution":{"observed_at":"2026-08-09T18:28:22.490509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:24.508636Z","title":null,"venue":null,"work_id":"04e0378c-dafe-44d1-9e85-193f2596417a","year":null},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.493560Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:9578cd05f01307756160c6f7855f63bb5b72326ec6368687ced154fb78437367","observation_id":"c8208073-9328-455b-85da-b042069db279","resolution":{"observed_at":"2026-08-09T18:28:24.512643Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.00933","last_updated":"2018-03-02T16:21:46Z","snapshot_observed_at":"2026-07-06T06:26:20.207918Z","submitted_at":"2018-03-02T16:21:46Z","title":"Distributed Prioritized Experience Replay","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.00933","snapshot_observed_at":"2026-08-09T18:28:22.526443Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.526443Z"},"links":{"cited_paper":"/paper/1803.00933","citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:0e1254867786156ec880e0768daeef38b5815023e3057ed1971423e110b694bf","observation_id":"fda221c4-fbd0-4ba4-a92b-eec119008bff","resolution":{"observed_at":"2026-08-09T18:28:22.526443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:24.492352Z","title":null,"venue":null,"work_id":"cc416d77-f7ed-493e-b1fa-d03756b4b7d4","year":2017},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.584539Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:75b1715ee3ad33118c68927f5ad8f4604b448480f944b49c556da9a5528b88da","observation_id":"9bc6391d-2ab8-4ea1-9f23-204a9c0b0f94","resolution":{"observed_at":"2026-08-09T18:28:24.494861Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:24.483776Z","title":null,"venue":null,"work_id":"e39a8e3c-f93f-46de-b2f7-5c0c4890e240","year":2018},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.641582Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:3002e018ac3446cefe825485c59e0c25c309c8a4005f50dfa6cdd5bd018b9e66","observation_id":"800c23f8-7d02-4cd3-825d-21572ea5016e","resolution":{"observed_at":"2026-08-09T18:28:24.487086Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:24.439342Z","title":null,"venue":null,"work_id":"6695a32c-081f-4fd4-99e0-05a4d54abb35","year":null},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.677030Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:3fc8dd4747d1f44f17cbe1fb0aa4fe08b894402812285a64bda47a319e15e646","observation_id":"bb6ae6fe-ce48-455a-9481-2775c3c91119","resolution":{"observed_at":"2026-08-09T18:28:24.473124Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:24.414810Z","title":null,"venue":null,"work_id":"fd2d9e60-85d6-4e26-93fc-3d2d2bfca04e","year":null},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.767162Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:9f390e67257257fcee8caf40c2305fdf0b9e07603619283cfb002c5d95afe625","observation_id":"e38d40f5-71db-4a4d-a4c4-d2ba715378b2","resolution":{"observed_at":"2026-08-09T18:28:24.417863Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:24.394162Z","title":null,"venue":null,"work_id":"5fb90fdc-83aa-4f9e-832b-1cc0d05496c6","year":2021},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.817757Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:eb1a30da5fd8a6d01c518d70046b58cfc018353e825ba082874e6440b0d5ad8f","observation_id":"4d209b2c-c069-411b-9406-cb35ad081705","resolution":{"observed_at":"2026-08-09T18:28:24.396975Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06169","last_updated":"2021-10-12T17:05:05Z","snapshot_observed_at":"2026-08-06T15:42:21.967989Z","submitted_at":"2021-10-12T17:05:05Z","title":"Offline Reinforcement Learning with Implicit Q-Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06169","snapshot_observed_at":"2026-08-09T18:28:22.820421Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.820421Z"},"links":{"cited_paper":"/paper/2110.06169","citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:b2b8dc2dc305bec74de6ccf50e2864d691c4743f94f0df4b7204930a23b3f851","observation_id":"cd8f7862-7348-4aa4-8799-33b9b9615735","resolution":{"observed_at":"2026-08-09T18:28:22.820421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:24.353144Z","title":null,"venue":null,"work_id":"094d18ee-9a3e-43b2-a26e-e43feef699af","year":2019},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.823881Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:099302d86d915586ead23eaf608549b58ac27e37acc33e1121e070543bd859c2","observation_id":"6a6ba78e-ab4d-4e68-8275-84d12091b0fb","resolution":{"observed_at":"2026-08-09T18:28:24.373576Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:24.423968Z","title":"IEEE Access 9 (2021), 60296–60308","venue":null,"work_id":"68860bf1-9b65-4fbb-9a34-d48df4c2c721","year":2021},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.728451Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:fec8aacd4d8306c83c8a1aee9b9dfccfd801b8c3d5fe1af1502f092b373ee994","observation_id":"ff018151-9796-4782-9085-9c5082496a51","resolution":{"observed_at":"2026-08-09T18:28:24.428281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:24.242449Z","title":null,"venue":null,"work_id":"6b4c7762-08eb-46bd-aa9b-6ea784d371dd","year":2012},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.829230Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:bad7ccdb304da223158c9a6aa780e39f45879d04f5fe30b41f69389f6500e636","observation_id":"430d1725-8bfb-4b56-80d3-333d86dc42f2","resolution":{"observed_at":"2026-08-09T18:28:24.324356Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:24.402761Z","title":"Advances in neural information processing systems 33 (2020), 21810–21823","venue":null,"work_id":"8d24c3df-5667-4562-a523-ac20f803d358","year":2020},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.814963Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:76a91c3a344bf6642090abb64758bd8af21c8e3217127952d2c08e4b66b3d209","observation_id":"1b677aac-a3f8-4115-b675-16386cc62fe0","resolution":{"observed_at":"2026-08-09T18:28:24.406485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-09T18:28:22.835662Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.835662Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:f16738ccddf1e86776e632fed780ab5601d532eff404b352e64e832072eccf72","observation_id":"4a8a9d99-7b78-49da-92f5-5aa8839c2174","resolution":{"observed_at":"2026-08-09T18:28:22.835662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:24.058438Z","title":null,"venue":null,"work_id":"263b1677-b906-46f8-aa57-92a75337ee19","year":2021},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.838582Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:d3ab97f66382f08f9f795ece57f3ade3e9030174b7c330d8684b433922c86e5e","observation_id":"d1312bc3-003f-4ef6-bac2-03e503c521c9","resolution":{"observed_at":"2026-08-09T18:28:24.143817Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:24.046456Z","title":null,"venue":null,"work_id":"71140978-0bc3-4418-a9fc-f1d693b6df58","year":2022},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.841105Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:2bffbf332362789a7f3b00cc61621d93aebe21ba13e5ee1b7dfe5aa55c9e3e89","observation_id":"61eb6c85-3405-4fe4-81d6-f7c5b550b8c4","resolution":{"observed_at":"2026-08-09T18:28:24.049997Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:22.826609Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.826609Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:6bbbf03de4c385833a599d04a519269f34551850925f39ebd57c1e1fe184975b","observation_id":"e236f733-63aa-4066-b1df-090227cb09a7","resolution":{"observed_at":"2026-08-09T18:28:22.826609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.09359","last_updated":"2021-04-24T22:39:30Z","snapshot_observed_at":"2026-07-06T09:29:45.475911Z","submitted_at":"2020-06-16T17:54:41Z","title":"AWAC: Accelerating Online Reinforcement Learning with Offline Datasets","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.09359","snapshot_observed_at":"2026-08-09T18:28:22.846868Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.846868Z"},"links":{"cited_paper":"/paper/2006.09359","citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:6e3cc6b1cc39b3ed898b25f703e852e4d5f74b00f239fe1fd48e26aeef383be9","observation_id":"76fef752-52b9-433d-ad9d-f13e1f28c913","resolution":{"observed_at":"2026-08-09T18:28:22.846868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-09T18:28:22.832434Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.832434Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:889971f774d88baf2a02894e971c4a3b265fc21099e009a600c7166f7e7c6210","observation_id":"86189a53-b369-4b9a-b19a-3c3838e7dcfa","resolution":{"observed_at":"2026-08-09T18:28:22.832434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:22.852799Z","title":"Ng, Daishi Harada, and Stuart J","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.852799Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:77bb6fc0442ce5e66c1021c9a4f88dda6408aefd050409dceb8a565f8787f51e","observation_id":"a428b801-2f6f-4d45-8e5b-f5d8033ff1cc","resolution":{"observed_at":"2026-08-09T18:28:22.852799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:22.855075Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.855075Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:a718ddb9ca45c22971b1dbec0eb452f94e5c367724a8ba1159d03f268790d7ab","observation_id":"590c8253-ce12-4be2-8908-557c90af322f","resolution":{"observed_at":"2026-08-09T18:28:22.855075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:24.009119Z","title":null,"venue":null,"work_id":"2bb9ffd6-f252-48e9-81c3-e1b0c96d3a69","year":2018},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.860110Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:8e14056519c2c216ad846174a8ab49884b3f5002979d4fcccf5d8b80dfcc875c","observation_id":"5bdd8c19-c2f7-4b50-9dd2-32cad66d77a3","resolution":{"observed_at":"2026-08-09T18:28:24.012023Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:22.843989Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.843989Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:6670e7e94b4da5261e25d8c5530c30ee5bf43e9e1ac8eaa042d0ec23943c606b","observation_id":"45f175b1-4483-44b1-803a-26544722a29b","resolution":{"observed_at":"2026-08-09T18:28:22.843989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:23.972363Z","title":null,"venue":null,"work_id":"8586c567-a2e8-41c0-9f36-92bb56caee8f","year":2022},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.867363Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:bd89fd71f4ead478f538f2a249d71a58d11baf69d2fefdc45c86f82a9f6f1f3d","observation_id":"76df773f-7cbe-485a-b34d-b413b7013515","resolution":{"observed_at":"2026-08-09T18:28:23.993120Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:22.849596Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.849596Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:34d51db052a2c82e44b60a01a0d8f12faf8a0f6c40f67157e2d8f22b11a1dc5f","observation_id":"b65d8250-0b32-48fe-937c-6a9f3abd222c","resolution":{"observed_at":"2026-08-09T18:28:22.849596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:23.927280Z","title":null,"venue":null,"work_id":"b6d81f3a-4972-4798-b795-dffd581b7d99","year":2023},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.873803Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:86fd702927f8bbe548611de07dfc6987cb6ba0acf0719321be1f9195aaabf1cc","observation_id":"0cd47eb4-23de-4d06-ab76-1331cb24922f","resolution":{"observed_at":"2026-08-09T18:28:23.954728Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:23.828646Z","title":null,"venue":null,"work_id":"5f4090af-c107-4180-84bf-775d25bbcbad","year":1988},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.877010Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:8c2855295de137e378e7862a33e3636e1d7299079181997a9de329cb8c1a16a2","observation_id":"63a44a61-754d-4485-a446-6f6b3ab25d1e","resolution":{"observed_at":"2026-08-09T18:28:23.873614Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:22.857604Z","title":"IEEE Transactions on Neural Networks and Learning Systems (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.857604Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:8bf9b48d2d0f67ed3fd0fa636cbb4cd30507cf583d6c48536f2a77aa31902c99","observation_id":"624a9500-83bc-449a-87b7-1a77a3239188","resolution":{"observed_at":"2026-08-09T18:28:22.857604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:22.881800Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.881800Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:f4d3466794f58b58748224b28fa577c26b850a4c4fb7a7ddba5233e992cd627c","observation_id":"5eed5b87-4133-45e7-b782-b5a484ca0d3a","resolution":{"observed_at":"2026-08-09T18:28:22.881800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.05952","last_updated":"2016-02-25T17:55:31Z","snapshot_observed_at":"2026-07-06T04:37:00.543211Z","submitted_at":"2015-11-18T20:54:44Z","title":"Prioritized Experience Replay","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.05952","snapshot_observed_at":"2026-08-09T18:28:22.863408Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.863408Z"},"links":{"cited_paper":"/paper/1511.05952","citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:0fa483e266a9307d95796e3f676a6329ce7f67058709f980885daeef451c8d49","observation_id":"4e083f76-05e1-4fb6-a416-c6bbeca37488","resolution":{"observed_at":"2026-08-09T18:28:22.863408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:23.693749Z","title":null,"venue":null,"work_id":"be23612a-112e-4fe5-b204-46c7aa9a384c","year":1993},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.974264Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:f81d2dd0955119c6c2ef38773a91f9413ee5d4df8af0ef01fa94949f0c0dfb93","observation_id":"7430450f-2d04-43b5-a015-60c5447707b3","resolution":{"observed_at":"2026-08-09T18:28:23.697225Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.04849","last_updated":"2022-06-30T19:06:09Z","snapshot_observed_at":"2026-08-01T10:07:48.224645Z","submitted_at":"2022-02-10T05:43:41Z","title":"SAFER: Data-Efficient and Safe Reinforcement Learning via Skill Acquisition","version":2},"cited_work":{"arxiv_id":"2202.04849","doi":null,"metadata_source":"pith","pith_arxiv_id":"2202.04849","snapshot_observed_at":"2026-08-09T18:28:23.250385Z","title":"SAFER: Data-Efficient and Safe Reinforcement Learning via Skill Acquisition","venue":"cs.LG","work_id":"4acd182b-9df0-48c1-b80b-f18952083df6","year":2022},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.870526Z"},"links":{"cited_paper":"/paper/2202.04849","citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:b51046aba3a64426e2f841e1bc58402eeb5c0301f5fe977153e08d12ffd82899","observation_id":"fa051d1a-13b0-45c8-982f-728e2354499a","resolution":{"observed_at":"2026-08-09T18:28:23.256509Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:23.675644Z","title":"Tsybakov","venue":null,"work_id":"461b9d1b-f5e3-42fd-a489-ed57c5ff3f98","year":2008},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:23.063309Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:e674eccac573cfe284e3fc647cd0b46b12ec32aa2975ca3a645cec48c3d66300","observation_id":"fef95225-83f8-4cf8-8850-c267e589ce7a","resolution":{"observed_at":"2026-08-09T18:28:23.678740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:23.666880Z","title":null,"venue":null,"work_id":"c3aeebd0-db91-4399-90ba-bc7614f5e76c","year":2020},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:23.124613Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:826cf37bfc31d1c222c44774408667546b70654c94c30d323b88e97d55fa45ed","observation_id":"650cb5bc-fbfd-41d5-93f2-818e223fcd02","resolution":{"observed_at":"2026-08-09T18:28:23.669649Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:23.717422Z","title":null,"venue":null,"work_id":"99815d3f-2609-4c2b-b1b6-6fbd687cbd92","year":1988},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.879383Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:65cfb0014aa93482cc56fac94487ab16245397ded2fc40538ba1875a9fcc7795","observation_id":"e0ebc002-ad5a-4446-9481-e6724c096e76","resolution":{"observed_at":"2026-08-09T18:28:23.760324Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:23.530833Z","title":null,"venue":null,"work_id":"3d929e27-20ca-4b6e-9ee4-f648b70e0999","year":null},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:23.207860Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:b6641a8ca73f2b87ce43fc3217ecacb53943add8425c0a9960ec764f8b6a4c92","observation_id":"fd0c1a2f-4006-4ee4-aa05-beca6a1e2b12","resolution":{"observed_at":"2026-08-09T18:28:23.606035Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:23.703048Z","title":null,"venue":null,"work_id":"a87b50e5-e53d-44d6-8f01-c1bd7fb9e041","year":2021},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.884971Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:ea1e5c6341621820c083ca61cd7cb6e6f0e686641d7e95d462c80eed7945044a","observation_id":"28f98e3c-3491-4fb1-92b5-68bab3b2e3af","resolution":{"observed_at":"2026-08-09T18:28:23.706293Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:23.413539Z","title":null,"venue":null,"work_id":"11e7bbf4-e303-45ac-abf9-8021d0d0ef0d","year":2021},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:23.217523Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:c35fd931c9ce439e2caffce4e44622952d2646c58e37bb5940f496c4f0b2ca75","observation_id":"b9c3f1da-c556-4717-b5cc-5254806e5281","resolution":{"observed_at":"2026-08-09T18:28:23.418350Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:23.683877Z","title":null,"venue":null,"work_id":"7c412865-82e6-4fdb-bfd2-ec777057cf03","year":2012},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:23.019809Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:20c526583cdae29a62210a5d88f12d603d833fc4e063a700144a53ebef91f593","observation_id":"0c0f22ba-8c80-4a4d-81b9-70799919c591","resolution":{"observed_at":"2026-08-09T18:28:23.688203Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:23.205322Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:23.205322Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:70fbcf6ffc1421a9c8003f7aa12204a7c0172b82d7378c7f3996429e2fdb119d","observation_id":"2f923b0f-2d09-46f3-897c-a7bd1bfe9cf7","resolution":{"observed_at":"2026-08-09T18:28:23.205322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:23.435544Z","title":"In Proceedings of the AAAI Conference on Artificial Intelligence and Interactive Digital Entertainment, Vol","venue":null,"work_id":"01a7c71d-4434-4d81-91eb-4d645abfe3ad","year":null},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:23.211181Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:7425f091a67ebd6515960b0c1321f01e2fe9347bfcf8bf59795fe568c1f516c3","observation_id":"ffe1fda3-111f-455c-962a-e930d3bd3a4d","resolution":{"observed_at":"2026-08-09T18:28:23.450046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:23.425811Z","title":null,"venue":null,"work_id":"1955095d-264a-4b84-bb59-fc42764e04cf","year":2020},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:23.214660Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:1c9e673a29db5160660831afc68fb6f92dc07f4891d9e7fd1b43d6e0af2c8b88","observation_id":"68dac7c8-8819-4ca5-9e35-a6f743b88f7d","resolution":{"observed_at":"2026-08-09T18:28:23.428480Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01708","last_updated":"2019-10-03T20:15:55Z","snapshot_observed_at":"2026-08-07T14:18:01.067346Z","submitted_at":"2019-10-03T20:15:55Z","title":"Benchmarking Batch Deep Reinforcement Learning Algorithms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01708","snapshot_observed_at":"2026-08-09T18:28:22.464527Z","title":"arXiv preprint arXiv:1910.01708 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.464527Z"},"links":{"cited_paper":"/paper/1910.01708","citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:6b222e84689f7a4bee2b9f225509bbb3de8439e5bdf0c7aec4444c9bc359f695","observation_id":"60264791-448b-420b-b7ae-e530331b3bdc","resolution":{"observed_at":"2026-08-09T18:28:22.464527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:24.622227Z","title":"In International Conference on Machine Learning","venue":null,"work_id":"ef05391a-53aa-4eb2-bf57-b068a025eb96","year":null},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.442725Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:a83d467e3f5d455715a77a9106facbb65410129236bed43893a90b02e0f5adc6","observation_id":"e0d16651-81e9-49a5-9a00-8fa6e14db900","resolution":{"observed_at":"2026-08-09T18:28:24.632211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:28:24.569602Z","title":"Journal of Machine Learning Research 22, 77 (2021), 1–14","venue":null,"work_id":"77f49d5e-c6cd-4c07-b087-3e9152c49274","year":2021},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.480607Z"},"links":{"citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:41998239070b6ecd16d8653e7692edeac763f603ec38c61d963e83ce1dc6391e","observation_id":"34317db7-7bf4-49a4-99ee-f4bf89308bd4","resolution":{"observed_at":"2026-08-09T18:28:24.574657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13085","last_updated":"2023-06-22T17:58:02Z","snapshot_observed_at":"2026-08-07T11:08:08.355064Z","submitted_at":"2023-06-22T17:58:02Z","title":"Harnessing Mixed Offline Reinforcement Learning Datasets via Trajectory Weighting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13085","snapshot_observed_at":"2026-08-09T18:28:22.496988Z","title":"arXiv preprint arXiv:2306.13085 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T18:28:22.496988Z"},"links":{"cited_paper":"/paper/2306.13085","citing_paper":"/paper/2502.00601"},"observation_digest":"sha256:d7d9b6d9b0888f91ca1fbae114f97bbba8757e10491ebeef9534c937c26b4e81","observation_id":"e7808497-6836-470c-9dd5-24805ace33f6","resolution":{"observed_at":"2026-08-09T18:28:22.496988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.00601","last_updated":"2025-04-13T23:43:44Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T23:30:59.833301Z","submitted_at":"2025-02-02T00:03:53Z","title":"Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuation"},"reference_resolution":{"displayed":60,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":51,"verified_exact":1,"verified_fuzzy":6},"total_outbound_references":60},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 0 inbound Pith citation observations for arXiv:2502.00601."}