{"as_of":"2026-08-08T00:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9cea0d7e3e2c88b58d672d1fa685e665e4eca1fb2798a12b081dccabe94423df","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:24:59.912161Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.02577/citation-record","integrity":"/paper/2506.02577/integrity","json":"/paper/2506.02577/citation-record.json","paper":"/paper/2506.02577"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1912.02074","last_updated":"2019-12-04T16:06:10Z","snapshot_observed_at":"2026-08-05T10:28:32.357062Z","submitted_at":"2019-12-04T16:06:10Z","title":"AlgaeDICE: Policy Gradient from Arbitrary Experience","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.02074","snapshot_observed_at":"2026-08-07T11:24:59.457411Z","title":"Dualdice: Behavior-agnostic estimation of discounted stationary distribution corrections.Advances in neural information processing systems, 32, 2019a","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2506.02577","last_updated":"2025-06-03T07:55:57Z","snapshot_observed_at":"2026-08-07T13:50:57.173766Z","submitted_at":"2025-06-03T07:55:57Z","title":"Reachability Weighted Offline Goal-conditioned Resampling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:24:59.457411Z"},"links":{"cited_paper":"/paper/1912.02074","citing_paper":"/paper/2506.02577"},"observation_digest":"sha256:9f7bf70ea0bfe70efe6aed2faaa757406615ee1e9d1bdaabb0473f46876fc06d","observation_id":"d9821e9c-0035-4add-92d2-8b0841445205","resolution":{"observed_at":"2026-08-07T11:24:59.457411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.00177","last_updated":"2019-10-07T20:23:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-10-01T02:23:38Z","title":"Advantage-Weighted Regression: Simple and Scalable Off-Policy Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.00177","snapshot_observed_at":"2026-08-07T11:24:59.512012Z","title":"Advantage-weighted regression: Simple and scalable off-policy reinforcement learning.arXiv preprint arXiv:1910.00177,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2506.02577","last_updated":"2025-06-03T07:55:57Z","snapshot_observed_at":"2026-08-07T13:50:57.173766Z","submitted_at":"2025-06-03T07:55:57Z","title":"Reachability Weighted Offline Goal-conditioned Resampling","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:24:59.512012Z"},"links":{"cited_paper":"/paper/1910.00177","citing_paper":"/paper/2506.02577"},"observation_digest":"sha256:a9512e70f00949b09fceea5dfb03456f59cc726ddaf5584f33644c3a5b7a2c54","observation_id":"70231539-425d-4ded-afd6-812f326a3250","resolution":{"observed_at":"2026-08-07T11:24:59.512012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.20025","last_updated":"2024-05-16T14:08:55Z","snapshot_observed_at":"2026-07-06T16:40:51.343918Z","submitted_at":"2023-10-30T21:19:52Z","title":"GOPlan: Goal-conditioned Offline Reinforcement Learning by Planning with Learned Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.20025","snapshot_observed_at":"2026-08-07T11:24:59.745260Z","title":"Goplan: Goal-conditioned offline reinforcement learning by planning with learned models.arXiv preprint arXiv:2310.20025, 2023a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02577","last_updated":"2025-06-03T07:55:57Z","snapshot_observed_at":"2026-08-07T13:50:57.173766Z","submitted_at":"2025-06-03T07:55:57Z","title":"Reachability Weighted Offline Goal-conditioned Resampling","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:24:59.745260Z"},"links":{"cited_paper":"/paper/2310.20025","citing_paper":"/paper/2506.02577"},"observation_digest":"sha256:c4ba6b8e6f0985501ef22d302a66d68f5a022a108638be8a4ad70ce00f26414f","observation_id":"ed79dc79-5a62-4f48-a1cf-723761b15eaa","resolution":{"observed_at":"2026-08-07T11:24:59.745260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:24:59.912161Z","title":"Contrastive difference predictive coding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02577","last_updated":"2025-06-03T07:55:57Z","snapshot_observed_at":"2026-08-07T13:50:57.173766Z","submitted_at":"2025-06-03T07:55:57Z","title":"Reachability Weighted Offline Goal-conditioned Resampling","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:24:59.912161Z"},"links":{"citing_paper":"/paper/2506.02577"},"observation_digest":"sha256:debe268011cca48315a06f4c6aa2d7f271312177b2a38280816e5eb002dda294","observation_id":"e4597fd0-d8a6-4bf8-9af6-2792551268ac","resolution":{"observed_at":"2026-08-07T11:24:59.912161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.08909","last_updated":"2021-04-19T18:33:47Z","snapshot_observed_at":"2026-07-06T10:15:31.432847Z","submitted_at":"2020-11-17T19:58:56Z","title":"C-Learning: Learning to Achieve Goals via Recursive Classification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.08909","snapshot_observed_at":"2026-08-07T11:24:59.107111Z","title":"C-learning: Learning to achieve goals via recursive classification.arXiv preprint arXiv:2011.08909,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2506.02577","last_updated":"2025-06-03T07:55:57Z","snapshot_observed_at":"2026-08-07T13:50:57.173766Z","submitted_at":"2025-06-03T07:55:57Z","title":"Reachability Weighted Offline Goal-conditioned Resampling","version":1},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-07T11:24:59.107111Z"},"links":{"cited_paper":"/paper/2011.08909","citing_paper":"/paper/2506.02577"},"observation_digest":"sha256:855df6a12c72adf0be96a88506e3fefe807ea9cefb79481e497abdf6269a007d","observation_id":"bd193dd9-e705-4492-b848-f8bb6d6216f2","resolution":{"observed_at":"2026-08-07T11:24:59.107111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:25:00.566435Z","title":"Charles Elkan and Keith Noto","venue":null,"work_id":"ddd670ae-ee95-45e2-951b-bc665c955193","year":2014},"citing_paper":{"arxiv_id":"2506.02577","last_updated":"2025-06-03T07:55:57Z","snapshot_observed_at":"2026-08-07T13:50:57.173766Z","submitted_at":"2025-06-03T07:55:57Z","title":"Reachability Weighted Offline Goal-conditioned Resampling","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-07T11:24:59.044765Z"},"links":{"citing_paper":"/paper/2506.02577"},"observation_digest":"sha256:a0f41f528349b60755c3bda791bbcb732c35572c8d44d89ee235cf10ee43aa92","observation_id":"4a2c8f4e-4cca-4368-ae4b-bbeafb4a438c","resolution":{"observed_at":"2026-08-07T11:25:00.586978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.07749","last_updated":"2021-06-10T23:54:34Z","snapshot_observed_at":"2026-08-06T05:54:55.251384Z","submitted_at":"2021-04-15T20:10:11Z","title":"Actionable Models: Unsupervised Offline Reinforcement Learning of Robotic Skills","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.07749","snapshot_observed_at":"2026-08-07T11:24:59.006613Z","title":"Actionable models: Unsupervised offline reinforcement learning of robotic skills.arXiv preprint arXiv:2104.07749,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02577","last_updated":"2025-06-03T07:55:57Z","snapshot_observed_at":"2026-08-07T13:50:57.173766Z","submitted_at":"2025-06-03T07:55:57Z","title":"Reachability Weighted Offline Goal-conditioned Resampling","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T11:24:59.006613Z"},"links":{"cited_paper":"/paper/2104.07749","citing_paper":"/paper/2506.02577"},"observation_digest":"sha256:302ec172178bf3be51bdc1735a147c74bbc9de4241f37a231528b2bf4c69bfed","observation_id":"70300d74-6b40-4983-932a-2c0b16915638","resolution":{"observed_at":"2026-08-07T11:24:59.006613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.00716","last_updated":"2022-11-01T19:28:48Z","snapshot_observed_at":"2026-07-06T14:13:15.252546Z","submitted_at":"2022-11-01T19:28:48Z","title":"Optimal Conservative Offline RL with General Function Approximation via Augmented Lagrangian","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.00716","snapshot_observed_at":"2026-08-07T11:24:59.657584Z","title":"Optimal conservative offline rl with general function approximation via augmented lagrangian.arXiv preprint arXiv:2211.00716,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02577","last_updated":"2025-06-03T07:55:57Z","snapshot_observed_at":"2026-08-07T13:50:57.173766Z","submitted_at":"2025-06-03T07:55:57Z","title":"Reachability Weighted Offline Goal-conditioned Resampling","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-07T11:24:59.657584Z"},"links":{"cited_paper":"/paper/2211.00716","citing_paper":"/paper/2506.02577"},"observation_digest":"sha256:8114a0c50754dc2d8576f97c1af28ea05f463a064c4462f66e46eb861b21d7ab","observation_id":"5054200b-91b8-4a5c-ba16-086516345e00","resolution":{"observed_at":"2026-08-07T11:24:59.657584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.09464","last_updated":"2018-03-10T18:11:25Z","snapshot_observed_at":"2026-08-02T00:57:15.173797Z","submitted_at":"2018-02-26T17:20:14Z","title":"Multi-Goal Reinforcement Learning: Challenging Robotics Environments and Request for Research","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.09464","snapshot_observed_at":"2026-08-07T11:24:59.589610Z","title":"Multi-goal reinforcement learning: Chal- lenging robotics environments and request for research.arXiv preprint arXiv:1802.09464,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02577","last_updated":"2025-06-03T07:55:57Z","snapshot_observed_at":"2026-08-07T13:50:57.173766Z","submitted_at":"2025-06-03T07:55:57Z","title":"Reachability Weighted Offline Goal-conditioned Resampling","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T11:24:59.589610Z"},"links":{"cited_paper":"/paper/1802.09464","citing_paper":"/paper/2506.02577"},"observation_digest":"sha256:1c33502f78deb2210a45c26f057f8356b575a2322749c20cd247430e2c0f26bb","observation_id":"4bab6db8-93d1-449a-8602-98ad5fc15346","resolution":{"observed_at":"2026-08-07T11:24:59.589610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.04478","last_updated":"2022-02-14T04:26:50Z","snapshot_observed_at":"2026-07-06T12:36:04.284368Z","submitted_at":"2022-02-09T14:17:05Z","title":"Rethinking Goal-conditioned Supervised Learning and Its Connection to Offline RL","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.04478","snapshot_observed_at":"2026-08-07T11:24:59.838130Z","title":"Rethinking goal-conditioned supervised learning and its connection to offline rl.arXiv preprint arXiv:2202.04478, 2022a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02577","last_updated":"2025-06-03T07:55:57Z","snapshot_observed_at":"2026-08-07T13:50:57.173766Z","submitted_at":"2025-06-03T07:55:57Z","title":"Reachability Weighted Offline Goal-conditioned Resampling","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T11:24:59.838130Z"},"links":{"cited_paper":"/paper/2202.04478","citing_paper":"/paper/2506.02577"},"observation_digest":"sha256:b14910f6fbb3329dde3f5c42728e799f2871f68f016aa932f1095e25cfdadf4b","observation_id":"61bed893-79e2-4f54-a38c-6e486d73ed24","resolution":{"observed_at":"2026-08-07T11:24:59.838130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06648","last_updated":"2025-06-07T02:05:57Z","snapshot_observed_at":"2026-07-06T19:30:13.003609Z","submitted_at":"2024-10-09T08:00:12Z","title":"Q-WSL: Optimizing Goal-Conditioned RL with Weighted Supervised Learning via Dynamic Programming","version":5},"cited_work":{"arxiv_id":"2410.06648","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.06648","snapshot_observed_at":"2026-08-07T11:25:00.222817Z","title":"Q-WSL: Optimizing Goal-Conditioned RL with Weighted Supervised Learning via Dynamic Programming","venue":"cs.LG","work_id":"92034d79-9b63-4b2e-8ee4-e916ef4c7658","year":2024},"citing_paper":{"arxiv_id":"2506.02577","last_updated":"2025-06-03T07:55:57Z","snapshot_observed_at":"2026-08-07T13:50:57.173766Z","submitted_at":"2025-06-03T07:55:57Z","title":"Reachability Weighted Offline Goal-conditioned Resampling","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T11:24:59.239998Z"},"links":{"cited_paper":"/paper/2410.06648","citing_paper":"/paper/2506.02577"},"observation_digest":"sha256:cf0ec13050ef46d24d144001cddcc9bf9af70a174f48813cf0dde9eb95982ccc","observation_id":"5430f879-9cc5-415c-a712-75801213e893","resolution":{"observed_at":"2026-08-07T11:25:00.304005Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.08299","last_updated":"2022-09-02T10:46:40Z","snapshot_observed_at":"2026-07-06T12:29:20.225445Z","submitted_at":"2022-01-20T17:06:42Z","title":"Goal-Conditioned Reinforcement Learning: Problems and Solutions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.08299","snapshot_observed_at":"2026-08-07T11:24:59.397642Z","title":"Goal-conditioned reinforcement learning: Problems and solutions.arXiv preprint arXiv:2201.08299,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02577","last_updated":"2025-06-03T07:55:57Z","snapshot_observed_at":"2026-08-07T13:50:57.173766Z","submitted_at":"2025-06-03T07:55:57Z","title":"Reachability Weighted Offline Goal-conditioned Resampling","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T11:24:59.397642Z"},"links":{"cited_paper":"/paper/2201.08299","citing_paper":"/paper/2506.02577"},"observation_digest":"sha256:b0c809452c13abffb32cabf806e048b852b378ed5ce1ef7e2bb1ba413aa1a068","observation_id":"c5d1b977-6ba4-481b-a841-4a852e7a9bbc","resolution":{"observed_at":"2026-08-07T11:24:59.397642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20519","last_updated":"2025-09-02T16:54:57Z","snapshot_observed_at":"2026-08-06T17:05:36.643599Z","submitted_at":"2024-12-29T16:42:30Z","title":"Goal-Conditioned Data Augmentation for Offline Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2412.20519","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.20519","snapshot_observed_at":"2026-08-07T11:25:00.400663Z","title":"Goal-Conditioned Data Augmentation for Offline Reinforcement Learning","venue":"cs.LG","work_id":"4451325f-7093-4761-9718-81f7256e5cde","year":2024},"citing_paper":{"arxiv_id":"2506.02577","last_updated":"2025-06-03T07:55:57Z","snapshot_observed_at":"2026-08-07T13:50:57.173766Z","submitted_at":"2025-06-03T07:55:57Z","title":"Reachability Weighted Offline Goal-conditioned Resampling","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T11:24:59.175627Z"},"links":{"cited_paper":"/paper/2412.20519","citing_paper":"/paper/2506.02577"},"observation_digest":"sha256:0e7ddfe7fabdc3a0ff4fc02f8ebc9ec67738c97c826e01da0c6c437041fd85ba","observation_id":"431af040-bbdf-4ca6-a6d0-43b31425a43f","resolution":{"observed_at":"2026-08-07T11:25:00.491537Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-07T11:24:59.326200Z","title":"Offline reinforcement learning: Tutorial, review, and perspectives on open problems.arXiv preprint arXiv:2005.01643,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.02577","last_updated":"2025-06-03T07:55:57Z","snapshot_observed_at":"2026-08-07T13:50:57.173766Z","submitted_at":"2025-06-03T07:55:57Z","title":"Reachability Weighted Offline Goal-conditioned Resampling","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T11:24:59.326200Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2506.02577"},"observation_digest":"sha256:d73906faeb714a29abf88437040b05fcd0810308cdb2ca0ad2b060127acf42a4","observation_id":"8d910177-1e81-4cff-acaf-decefdb1575f","resolution":{"observed_at":"2026-08-07T11:24:59.326200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.02577","last_updated":"2025-06-03T07:55:57Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T13:50:57.173766Z","submitted_at":"2025-06-03T07:55:57Z","title":"Reachability Weighted Offline Goal-conditioned Resampling"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":2,"verified_fuzzy":1},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 0 inbound Pith citation observations for arXiv:2506.02577."}