{"as_of":"2026-08-08T00:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4c466e78b4d5191b252ecd95e9547b0f53a725c7355278f6545a3c8bfd195a35","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:01:02.986353Z","state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T10:27:47.896922Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T17:20:00.517702Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-07T04:52:09.211359Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2506.09202","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09202","snapshot_observed_at":"2026-07-04T17:20:00.517702Z","title":"Policy-based trajectory clustering in offline reinforce- ment learning","venue":null,"work_id":"db1bb90a-8403-444a-a953-45d7b2f48e9f","year":null},"citing_paper":{"arxiv_id":"2606.12200","last_updated":"2026-06-10T15:19:41Z","snapshot_observed_at":"2026-07-06T23:51:07.629939Z","submitted_at":"2026-06-10T15:19:41Z","title":"Implicit Neural Representations of Individual Behavior","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-06-27T10:27:47.896922Z"},"links":{"cited_paper":"/paper/2506.09202","citing_paper":"/paper/2606.12200"},"observation_digest":"sha256:d1b00bfb43661926831c7ea000706bda1bf8cc1ef88d1957dabc5398723b7733","observation_id":"513d2eda-a545-4fcd-b8e7-42e07391a589","resolution":{"observed_at":"2026-07-03T09:17:48.435994Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-07T04:52:09.211359Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2506.09202","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09202","snapshot_observed_at":"2026-07-04T17:20:00.517702Z","title":"Policy-based trajectory clustering in offline reinforce- ment learning","venue":null,"work_id":"db1bb90a-8403-444a-a953-45d7b2f48e9f","year":null},"citing_paper":{"arxiv_id":"2606.24601","last_updated":"2026-06-23T14:03:36Z","snapshot_observed_at":"2026-08-07T01:04:52.748978Z","submitted_at":"2026-06-23T14:03:36Z","title":"ASALT: Adaptive State Alignment for Lateral Transfer in Multi-agent Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-25T23:46:50.183064Z"},"links":{"cited_paper":"/paper/2506.09202","citing_paper":"/paper/2606.24601"},"observation_digest":"sha256:efda893072613e7cf6212e22d94979d333e7fef33fcfd055ec840796efa22fd5","observation_id":"7aa0886d-e7c1-4479-8a86-934233ff7c8d","resolution":{"observed_at":"2026-07-04T17:20:00.519286Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.09202/citation-record","integrity":"/paper/2506.09202/integrity","json":"/paper/2506.09202/citation-record.json","paper":"/paper/2506.09202"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:01:03.296203Z","title":null,"venue":null,"work_id":"07be56c3-7f6a-461c-92fd-37c9e14b5ab5","year":null},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-07T04:52:09.211359Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.962537Z"},"links":{"citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:21abe854336092307934baceed44ee6b20213aabc7339814dda012c9492bb6eb","observation_id":"c47bc253-0561-4887-8529-9a3809064937","resolution":{"observed_at":"2026-08-07T05:01:03.300603Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:01:03.282078Z","title":null,"venue":null,"work_id":"affea8da-bf0b-4bb3-b408-92be591eba7f","year":null},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-07T04:52:09.211359Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.966492Z"},"links":{"citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:907099c42540d3ff8ceb1db6db0384ddc0adb98cad8d835b5b5a107541d0ddd4","observation_id":"e1c511b1-b97e-4a24-ac76-3583315dfd99","resolution":{"observed_at":"2026-08-07T05:01:03.286204Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:01:03.266727Z","title":null,"venue":null,"work_id":"ddd8bfa7-f12a-4a54-9a84-a60c8f8c22c8","year":null},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-07T04:52:09.211359Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.970261Z"},"links":{"citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:6de71ee532147ed352d7d79647533d2f55c98e374feaccecfc6966f33a01ca13","observation_id":"379f1434-9361-4d59-8b59-4ccbd6333370","resolution":{"observed_at":"2026-08-07T05:01:03.271406Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:01:03.253029Z","title":null,"venue":null,"work_id":"6d25d56d-ce62-4ee9-a3f0-fa5b394716cc","year":null},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-07T04:52:09.211359Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.974127Z"},"links":{"citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:9b6498b8f7d9a8d6c19688bbab405b6dd44a8038e49337b484009ceaa4be9887","observation_id":"86f73a97-a64a-4d6b-9036-cd7c669c123f","resolution":{"observed_at":"2026-08-07T05:01:03.256975Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:01:03.239026Z","title":"Takeball There are four different rule-based policies, i-th policy will pick the i-th ball first","venue":null,"work_id":"f723aafb-c1b7-4385-b776-b51f5eca7f55","year":null},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-07T04:52:09.211359Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.977885Z"},"links":{"citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:55290d3be8d0ec9e706f419f170ee2d0193ed7dd4a94e880e7fec962cb9a0d13","observation_id":"9c94e70c-2d7b-46da-b108-9da3b240bee5","resolution":{"observed_at":"2026-08-07T05:01:03.243513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:01:03.225273Z","title":null,"venue":null,"work_id":"039806bf-e855-4d6d-9cc7-cd5ff6687a85","year":null},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-07T04:52:09.211359Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.981668Z"},"links":{"citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:ab9d3739132302e92af875ccd2bc0a3293e4ff35af60ecf99676b4fce64120e9","observation_id":"2cadc6d3-6a9d-4f48-83b9-e7a07950a58f","resolution":{"observed_at":"2026-08-07T05:01:03.229272Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:01:03.211250Z","title":"These policies are corresponding to: No preference, prefer to go up first and prefer to go right first","venue":null,"work_id":"aa6fa73f-70dc-4cbf-93e9-42e484e89481","year":2016},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-07T04:52:09.211359Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.986353Z"},"links":{"citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:01e4db2850986bac07aa9639af98a1aaec518ef2f926f0fd50158289c8365a1f","observation_id":"adb002fe-3f00-4860-a89e-3e72b48120bc","resolution":{"observed_at":"2026-08-07T05:01:03.215458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06335","last_updated":"2016-05-24T22:27:35Z","snapshot_observed_at":"2026-07-06T04:37:08.670695Z","submitted_at":"2015-11-19T20:06:14Z","title":"Unsupervised Deep Embedding for Clustering Analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06335","snapshot_observed_at":"2026-08-07T05:01:02.957217Z","title":"distance","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-07T04:52:09.211359Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.957217Z"},"links":{"cited_paper":"/paper/1511.06335","citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:612ea0c693806a095eb73c25dd5711cea98373afa2178a946e9d841b6ae852b4","observation_id":"d36b757d-f311-4590-ad1b-b9c86dbe2772","resolution":{"observed_at":"2026-08-07T05:01:02.957217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.11361","last_updated":"2019-11-26T06:11:34Z","snapshot_observed_at":"2026-07-06T08:39:58.361914Z","submitted_at":"2019-11-26T06:11:34Z","title":"Behavior Regularized Offline Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.11361","snapshot_observed_at":"2026-08-07T05:01:02.952757Z","title":"Junyuan Xie, Ross Girshick, and Ali Farhadi","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-07T04:52:09.211359Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.952757Z"},"links":{"cited_paper":"/paper/1911.11361","citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:e7e56bf66c7bedb189f1f2269275b1ec82e744c90769051ce49e8199652191c1","observation_id":"7d8c3380-d34b-49f4-9707-2f6ca7722d5e","resolution":{"observed_at":"2026-08-07T05:01:02.952757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.09687","last_updated":"2020-09-21T08:54:40Z","snapshot_observed_at":"2026-08-02T07:10:02.529655Z","submitted_at":"2020-09-21T08:54:40Z","title":"Contrastive Clustering","version":1},"cited_work":{"arxiv_id":"2009.09687","doi":null,"metadata_source":"pith","pith_arxiv_id":"2009.09687","snapshot_observed_at":"2026-08-07T05:01:03.181737Z","title":"Contrastive Clustering","venue":"cs.LG","work_id":"d1bdebd7-6a62-4e28-b5e6-b1ba5d892bbb","year":2020},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-07T04:52:09.211359Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.937922Z"},"links":{"cited_paper":"/paper/2009.09687","citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:597c7f8f7dc237243feb69114ee9b2274b446b5fafa2002627946703e0f380df","observation_id":"1b92c03a-6ad1-47e1-9b08-ad2ba2ea496f","resolution":{"observed_at":"2026-08-07T05:01:03.186412Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.00444","last_updated":"2021-01-23T17:02:01Z","snapshot_observed_at":"2026-07-06T08:54:20.007652Z","submitted_at":"2020-02-02T18:21:22Z","title":"Deep Reinforcement Learning for Autonomous Driving: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.00444","snapshot_observed_at":"2026-08-07T05:01:02.932706Z","title":"Martin Klissarov, Pierre-Luc Bacon, Joelle Pineau, and Doina Precup","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-07T04:52:09.211359Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.932706Z"},"links":{"cited_paper":"/paper/2002.00444","citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:260e86af47bea5f062be745744dd627e672dc7d2827a447f404639c7321aa917","observation_id":"2e6a45a0-9bee-4608-80df-30b917f176a3","resolution":{"observed_at":"2026-08-07T05:01:02.932706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09550","last_updated":"2024-02-14T20:01:41Z","snapshot_observed_at":"2026-07-06T17:30:16.881701Z","submitted_at":"2024-02-14T20:01:41Z","title":"Dataset Clustering for Improved Offline Policy Learning","version":1},"cited_work":{"arxiv_id":"2402.09550","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.09550","snapshot_observed_at":"2026-08-07T05:01:03.053933Z","title":"Dataset Clustering for Improved Offline Policy Learning","venue":"cs.LG","work_id":"5c0ddb92-3ab9-420f-9ba1-4665f151d72a","year":2024},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-07T04:52:09.211359Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.947723Z"},"links":{"cited_paper":"/paper/2402.09550","citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:37315bb60e3f102e21d922d15920f66729de2055267f3ff781356730f5205788","observation_id":"80ea89f9-9ee0-454e-bc69-aece7f06d8c5","resolution":{"observed_at":"2026-08-07T05:01:03.060042Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.32801","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:01:03.159882Z","title":"URL http://dx.doi.org/10.1109/TNNLS.2023","venue":null,"work_id":"c4e5c886-fb44-4869-82ab-7f120c92daaf","year":2023},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-07T04:52:09.211359Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":2388,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.942412Z"},"links":{"citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:e205bd24d374ba0d52080ee3393e79d33abcb18dcf3bb13545457b8c53bef9c0","observation_id":"7d86d253-c3c4-42db-ae9c-ef56f3c9b302","resolution":{"observed_at":"2026-08-07T05:01:03.166577Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T04:52:09.211359Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":8,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 2 inbound Pith citation observations for arXiv:2506.09202."}