{"as_of":"2026-08-05T21:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5dc63d4dc13add2ead941e09c0ec3d80525e4287f77afcfc64452f59549c3278","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":7,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":7,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T12:17:04.321971Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T19:25:32.450832Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.05333","last_updated":"2024-02-28T13:48:09Z","snapshot_observed_at":"2026-07-06T16:29:32.059905Z","submitted_at":"2023-10-09T01:29:17Z","title":"DiffCPS: Diffusion Model based Constrained Policy Search for Offline Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2310.05333","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05333","snapshot_observed_at":"2026-07-08T19:25:32.450832Z","title":"DiffCPS: Diffusion model based constrained policy search for offline reinforcement learning.ArXiv, abs/2310.05333","venue":"cs.LG","work_id":"13a81771-38f2-42a3-8c58-59826c13e271","year":2023},"citing_paper":{"arxiv_id":"2506.15799","last_updated":"2025-06-25T19:09:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-18T18:35:57Z","title":"Steering Your Diffusion Policy with Latent Space Reinforcement Learning","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-17T21:55:46.183007Z"},"links":{"cited_paper":"/paper/2310.05333","citing_paper":"/paper/2506.15799"},"observation_digest":"sha256:6036f9b8441a01ad02659415aad32a511a1c2d5519d0008d9f1a96e5996d245f","observation_id":"ad93aae3-08e3-47a4-afcd-98ceb0d59409","resolution":{"observed_at":"2026-05-17T21:55:46.439239Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05333","last_updated":"2024-02-28T13:48:09Z","snapshot_observed_at":"2026-07-06T16:29:32.059905Z","submitted_at":"2023-10-09T01:29:17Z","title":"DiffCPS: Diffusion Model based Constrained Policy Search for Offline Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2310.05333","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05333","snapshot_observed_at":"2026-07-08T19:25:32.450832Z","title":"DiffCPS: Diffusion model based constrained policy search for offline reinforcement learning.ArXiv, abs/2310.05333","venue":"cs.LG","work_id":"13a81771-38f2-42a3-8c58-59826c13e271","year":2023},"citing_paper":{"arxiv_id":"2605.06156","last_updated":"2026-05-08T08:54:11Z","snapshot_observed_at":"2026-07-06T23:18:41.400741Z","submitted_at":"2026-05-07T12:47:55Z","title":"Entropy-Regularized Adjoint Matching for Offline Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T13:46:35.806797Z"},"links":{"cited_paper":"/paper/2310.05333","citing_paper":"/paper/2605.06156"},"observation_digest":"sha256:876218eba113f4f1f2a69342efee7a394e7d8079749304080473fa3023a51762","observation_id":"7b93540b-88ae-4f18-af71-586b39265d22","resolution":{"observed_at":"2026-05-11T18:51:06.917673Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05333","last_updated":"2024-02-28T13:48:09Z","snapshot_observed_at":"2026-07-06T16:29:32.059905Z","submitted_at":"2023-10-09T01:29:17Z","title":"DiffCPS: Diffusion Model based Constrained Policy Search for Offline Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2310.05333","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05333","snapshot_observed_at":"2026-07-08T19:25:32.450832Z","title":"DiffCPS: Diffusion model based constrained policy search for offline reinforcement learning.ArXiv, abs/2310.05333","venue":"cs.LG","work_id":"13a81771-38f2-42a3-8c58-59826c13e271","year":2023},"citing_paper":{"arxiv_id":"2605.06156","last_updated":"2026-05-08T08:54:11Z","snapshot_observed_at":"2026-07-06T23:18:41.400741Z","submitted_at":"2026-05-07T12:47:55Z","title":"Entropy-Regularized Adjoint Matching for Offline Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-11T02:09:19.171348Z"},"links":{"cited_paper":"/paper/2310.05333","citing_paper":"/paper/2605.06156"},"observation_digest":"sha256:fe45e56ab24c82376d66e360fbe392c285d0bcc89ba5646db21241da3629068b","observation_id":"61ec0292-f4f6-4121-807c-4b591760c3c7","resolution":{"observed_at":"2026-05-11T03:55:54.735724Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05333","last_updated":"2024-02-28T13:48:09Z","snapshot_observed_at":"2026-07-06T16:29:32.059905Z","submitted_at":"2023-10-09T01:29:17Z","title":"DiffCPS: Diffusion Model based Constrained Policy Search for Offline Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2310.05333","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05333","snapshot_observed_at":"2026-07-08T19:25:32.450832Z","title":"DiffCPS: Diffusion model based constrained policy search for offline reinforcement learning.ArXiv, abs/2310.05333","venue":"cs.LG","work_id":"13a81771-38f2-42a3-8c58-59826c13e271","year":2023},"citing_paper":{"arxiv_id":"2606.11087","last_updated":"2026-06-09T16:45:57Z","snapshot_observed_at":"2026-08-02T20:45:09.177143Z","submitted_at":"2026-06-09T16:45:57Z","title":"Test-Time Gradient Guidance of Flow Policies in Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-27T14:05:01.073951Z"},"links":{"cited_paper":"/paper/2310.05333","citing_paper":"/paper/2606.11087"},"observation_digest":"sha256:21e80287eb828c6ccd6c0ee509cbcfe7a2f697bc4c000b12935d4fb637a0aaa0","observation_id":"8dad0427-e24e-4667-ac13-2760508aed98","resolution":{"observed_at":"2026-07-03T04:17:36.921256Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05333","last_updated":"2024-02-28T13:48:09Z","snapshot_observed_at":"2026-07-06T16:29:32.059905Z","submitted_at":"2023-10-09T01:29:17Z","title":"DiffCPS: Diffusion Model based Constrained Policy Search for Offline Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2310.05333","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05333","snapshot_observed_at":"2026-07-08T19:25:32.450832Z","title":"DiffCPS: Diffusion model based constrained policy search for offline reinforcement learning.ArXiv, abs/2310.05333","venue":"cs.LG","work_id":"13a81771-38f2-42a3-8c58-59826c13e271","year":2023},"citing_paper":{"arxiv_id":"2606.17551","last_updated":"2026-06-16T05:56:10Z","snapshot_observed_at":"2026-07-06T23:53:07.149182Z","submitted_at":"2026-06-16T05:56:10Z","title":"Reversal Q-Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T02:30:24.951689Z"},"links":{"cited_paper":"/paper/2310.05333","citing_paper":"/paper/2606.17551"},"observation_digest":"sha256:0bac30be6c177d518c8a3bada11ebd0784fe4427f1dede1aca206c076177770b","observation_id":"25136d03-3fba-49fa-8201-72b45ba92cfd","resolution":{"observed_at":"2026-07-03T18:38:49.827002Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05333","last_updated":"2024-02-28T13:48:09Z","snapshot_observed_at":"2026-07-06T16:29:32.059905Z","submitted_at":"2023-10-09T01:29:17Z","title":"DiffCPS: Diffusion Model based Constrained Policy Search for Offline Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2310.05333","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05333","snapshot_observed_at":"2026-07-08T19:25:32.450832Z","title":"DiffCPS: Diffusion model based constrained policy search for offline reinforcement learning.ArXiv, abs/2310.05333","venue":"cs.LG","work_id":"13a81771-38f2-42a3-8c58-59826c13e271","year":2023},"citing_paper":{"arxiv_id":"2607.06018","last_updated":"2026-07-07T08:58:29Z","snapshot_observed_at":"2026-08-02T17:41:12.664640Z","submitted_at":"2026-07-07T08:58:29Z","title":"RoboTALES: Learning Reasoning-Guided Robot Policies via Task-Aligned Simulated Futures","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-08T19:16:06.847356Z"},"links":{"cited_paper":"/paper/2310.05333","citing_paper":"/paper/2607.06018"},"observation_digest":"sha256:fcbc8155f2d2dcb0d4c1011fcb43d7eb4eddb2043a7a8fa8d2e50ae66bee16fb","observation_id":"f1fe4794-c59f-4eae-aea5-c62a00475bc2","resolution":{"observed_at":"2026-07-08T19:25:32.452051Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05333","last_updated":"2024-02-28T13:48:09Z","snapshot_observed_at":"2026-07-06T16:29:32.059905Z","submitted_at":"2023-10-09T01:29:17Z","title":"DiffCPS: Diffusion Model based Constrained Policy Search for Offline Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05333","snapshot_observed_at":"2026-07-14T12:17:04.321971Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10369","last_updated":"2026-07-11T15:45:12Z","snapshot_observed_at":"2026-07-16T23:18:20.490462Z","submitted_at":"2026-07-11T15:45:12Z","title":"VINE: Taming Generative Control Policies for Reinforcement Learning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-14T12:17:04.321971Z"},"links":{"cited_paper":"/paper/2310.05333","citing_paper":"/paper/2607.10369"},"observation_digest":"sha256:4ea52ce613a2e1d6b81351da184dba126fac0f762a48fbb39aab949126ee799a","observation_id":"b4065469-9bb8-4996-ab0d-9738cd5af3a7","resolution":{"observed_at":"2026-07-14T12:17:04.321971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2310.05333/citation-record","integrity":"/paper/2310.05333/integrity","json":"/paper/2310.05333/citation-record.json","paper":"/paper/2310.05333"},"outbound":[],"paper":{"arxiv_id":"2310.05333","last_updated":"2024-02-28T13:48:09Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T16:29:32.059905Z","submitted_at":"2023-10-09T01:29:17Z","title":"DiffCPS: Diffusion Model based Constrained Policy Search for Offline Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 7 inbound Pith citation observations for arXiv:2310.05333."}