{"as_of":"2026-08-09T04:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cd5e8272be36d425fec91db4ec6b1e90ba84b58556eb7db6d1260fafc050604b","coverage":[{"denominator":77,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":77,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T19:25:38.276643Z","state":"measured"},{"denominator":77,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":77,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.06015/citation-record","integrity":"/paper/2608.06015/integrity","json":"/paper/2608.06015/citation-record.json","paper":"/paper/2608.06015"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:41.643318Z","title":"The Tenth International Conference on Learning Representations,","venue":null,"work_id":"b722abad-a523-4520-a456-e77939666900","year":2022},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:36.791390Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:ea2b6ac269a45463dbf41b5dafadd3427ef37a4546d24d07d61f319993cbdd3e","observation_id":"cbc8dc63-f01a-4982-9003-fd1b168e97aa","resolution":{"observed_at":"2026-08-07T19:25:41.649659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:36.800921Z","title":"9th International Conference on Learning Representations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:36.800921Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:9f5d6916ee80a210c9d7705faa1d9c274dbe32d1c295cd222b90bad135768f7d","observation_id":"7cc84327-a471-47d2-a37e-cc730602e2be","resolution":{"observed_at":"2026-08-07T19:25:36.800921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:41.606510Z","title":"The Thirteenth International Conference on Learning Representations,","venue":null,"work_id":"a7de059a-65db-4644-89f6-fcf9649128a6","year":2025},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:36.808980Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:b71a25d8ba44c1c535b73e3ebe8e7e87e3c07a07d0d4dafbfa20a6058704a386","observation_id":"23050f19-45f0-42ce-a4e1-4550f3b0a8e5","resolution":{"observed_at":"2026-08-07T19:25:41.615232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:36.858057Z","title":"Devon Hjelm and Aaron C","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:36.858057Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:be551db72e10c7507e1dfee9fb63e559c2ec6e62d8b5472898681093dcf35893","observation_id":"7b6ea673-b9e9-46be-98a2-ea6558e980f4","resolution":{"observed_at":"2026-08-07T19:25:36.858057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:41.575147Z","title":null,"venue":null,"work_id":"3a54f23b-2961-4764-aa1e-58ad13279806","year":2023},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:36.903929Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:f9df527cd431310cee9173b99bf8c6a4ff85f28a17b7365aedcce079acb68819","observation_id":"a557ff01-a81c-443c-9dbc-c1f3df82696b","resolution":{"observed_at":"2026-08-07T19:25:41.581148Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05418","last_updated":"2025-06-05T00:36:54Z","snapshot_observed_at":"2026-08-09T00:14:33.104955Z","submitted_at":"2025-06-05T00:36:54Z","title":"Self-Predictive Dynamics for Generalization of Vision-based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2506.05418","doi":"10.48550/arxiv.2506.05418","metadata_source":"pith","pith_arxiv_id":"2506.05418","snapshot_observed_at":"2026-08-08T00:16:16.039225Z","title":"Self-Predictive Dynamics for Generalization of Vision-based Reinforcement Learning","venue":"cs.CV","work_id":"74f2e0c4-8e55-4f3f-810c-737e39d69724","year":2025},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:36.967559Z"},"links":{"cited_paper":"/paper/2506.05418","citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:41cae926f63193e37899ef480581f995770415d520d1b335386d678f745ab680","observation_id":"2ba75043-f3c5-4ecc-b372-3bf90744ea6a","resolution":{"observed_at":"2026-08-07T19:25:39.338235Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:37.012149Z","title":"Bootstrap Your Own Latent -","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.012149Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:186308b75c71882255aed5f39c69c51288b55c59dc1dee9a4ad738bf54688699","observation_id":"b3279185-5b0f-4965-8aa4-52fa938a6617","resolution":{"observed_at":"2026-08-07T19:25:37.012149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:41.522839Z","title":"Bellemare , editor =","venue":null,"work_id":"6100ed5a-ff87-416a-abd1-96232fbe15f5","year":2019},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.017650Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:c5865c6560bc1f7ff87eba6bafa2edc4f7d24a45570e3561fdcde8437c65e766","observation_id":"5bce98ca-b9ef-493f-9889-241d68778438","resolution":{"observed_at":"2026-08-07T19:25:41.529822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:37.023735Z","title":"Nature , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.023735Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:277d7c8b360417a490ff5f55822d778053f3895fd570c6f29c00144629762ca0","observation_id":"bbd1d980-1733-4298-bad3-4cbcbe2bc8e9","resolution":{"observed_at":"2026-08-07T19:25:37.023735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:41.477120Z","title":"The Twelfth International Conference on Learning Representations,","venue":null,"work_id":"c953d877-94fe-47fc-86f0-fcc96d80e18d","year":2024},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.029563Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:4ee621f9b4bbb7eae8aaeb5085224502261d61ccb0be7b638f111623ca1977d7","observation_id":"f40fc40e-dcf8-48f0-ac46-a2178205b786","resolution":{"observed_at":"2026-08-07T19:25:41.486292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:37.037579Z","title":"1998 , publisher=","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.037579Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:8c3c4ab7594156029963b74ba2f7925399bd589e4688783f80926dbf0a84885e","observation_id":"bd7549b2-3bc7-4ec0-8afe-2ab7deb1aacc","resolution":{"observed_at":"2026-08-07T19:25:37.037579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.00690","last_updated":"2018-01-02T15:48:14Z","snapshot_observed_at":"2026-08-01T20:24:08.300098Z","submitted_at":"2018-01-02T15:48:14Z","title":"DeepMind Control Suite","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.00690","snapshot_observed_at":"2026-08-07T19:25:37.044066Z","title":"Lillicrap and Martin A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.044066Z"},"links":{"cited_paper":"/paper/1801.00690","citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:333c3d494976de664fced8883b98da5c7783dea681a744be265fd55752684cb6","observation_id":"85482e7e-a74c-42b2-9bfe-23044aba2a42","resolution":{"observed_at":"2026-08-07T19:25:37.044066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:41.428976Z","title":"Learning Representations via a Robust Behavioral Metric for Deep Reinforcement Learning , booktitle =","venue":null,"work_id":"a33f819d-2281-4bc9-b50e-4326607f3cb8","year":2022},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.052935Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:d5eb942c826f75f76d10de9e3a533b3c8b4baa19f2d372a84c83c0f7668d83e0","observation_id":"d5a247c6-2181-448c-84b4-32b42151303f","resolution":{"observed_at":"2026-08-07T19:25:41.436449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:41.408908Z","title":"MICo: Improved representations via sampling-based state similarity for Markov decision processes , booktitle =","venue":null,"work_id":"e5829998-97a5-4d88-8bc8-e122cddd9694","year":2021},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.059463Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:838bf586a4c07c0c3a500f758b2bb1b165c7de4cbe563ccee144a8c364ec91e4","observation_id":"a6d6418c-7aef-4e17-96ab-a9b4dbc9421c","resolution":{"observed_at":"2026-08-07T19:25:41.414337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:41.385653Z","title":"The Twelfth International Conference on Learning Representations,","venue":null,"work_id":"96187aa1-8360-486c-b385-7d34589a24cd","year":2024},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.067583Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:75c26f5d721d7e1e693f632122416d3c7ea9d2db54917b80c37626735df80564","observation_id":"bcf3ac2e-6092-4b7c-a62e-e28afef81f31","resolution":{"observed_at":"2026-08-07T19:25:41.394790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:41.350776Z","title":"Why do We Need Large Batchsizes in Contrastive Learning?","venue":null,"work_id":"248ec15c-4c7b-4e28-8f3d-f1016aef97a6","year":2022},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.078716Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:5b319c8b54b2a533486b00907085ab69bb6edbbdda265fc0240a6893dd467d5e","observation_id":"06ff7ecd-1003-4a96-b7e6-cf41cb165d08","resolution":{"observed_at":"2026-08-07T19:25:41.367982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:41.324070Z","title":"Contrastive Learning as Goal-Conditioned Reinforcement Learning , booktitle =","venue":null,"work_id":"21c797ff-3e35-41d4-b6e4-2d241646100e","year":2022},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.084041Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:6ac7db3408df9e4f66312c98ef07e445069714bbdee1eeb38951f49a0f436146","observation_id":"454eeb37-80d2-4fe9-ad8c-5fc2912fca06","resolution":{"observed_at":"2026-08-07T19:25:41.332769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:41.257956Z","title":"The Thirteenth International Conference on Learning Representations,","venue":null,"work_id":"54cf4484-754a-497f-b7f0-105e702b1446","year":2025},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.089246Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:43584ffc038cc3947b80abcead8d04486bb3bdc3e3c9b395298ea185a48d50f1","observation_id":"3b272170-a79a-42b9-a685-e1411118309e","resolution":{"observed_at":"2026-08-07T19:25:41.264144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v37i7.26052","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:39.130664Z","title":"Policy-Independent Behavioral Metric-Based Representation for Deep Reinforcement Learning , booktitle =","venue":null,"work_id":"6ec0f139-64d3-48a6-9b42-35ee6bfa9e36","year":2023},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.097597Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:fe269b34d5ea0b3c3d1af23163df8e2fea77e9b39fa73d8eace844692c43b600","observation_id":"565b9d6d-1975-420b-90f8-29f499f1d415","resolution":{"observed_at":"2026-08-07T19:25:39.195987Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:37.103532Z","title":"Revisiting Bisimulation Metric for Robust Representations in Reinforcement Learning , journal =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.103532Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:7cf76725d34ee0302fe5f053b758ad452acd3cda350a30a793fae5aa008ed9f2","observation_id":"290bc261-7eba-47a6-bfe2-4c7277a088cd","resolution":{"observed_at":"2026-08-07T19:25:37.103532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:37.111165Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.111165Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:c0013555e836d0ddfcf5696a5ecff5086ccd922ff91ecbfa49734cf2b1465cf3","observation_id":"fd50d3b1-7642-46d6-a6dc-09ae2c98c80d","resolution":{"observed_at":"2026-08-07T19:25:37.111165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:37.117790Z","title":"Jha and Toshisada Mariyama and Daniel Nikovski , title =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.117790Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:c200a72d3fa932e822f597049f51b56d5640b23a1d88d4a4e9568cb0ccee0bcf","observation_id":"79cbfbd6-87d2-4933-a9f8-1f082d6e8568","resolution":{"observed_at":"2026-08-07T19:25:37.117790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:41.186865Z","title":"Lillicrap and Jimmy Ba and Mohammad Norouzi , title =","venue":null,"work_id":"ae9682c6-7497-47ae-bfd1-e3dede90e11b","year":2020},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.128880Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:2e5b1fcf8bf17788befd8ce8ca607983dcf10ba30df10dd04177948878701c30","observation_id":"c656cf73-5644-4e4f-a552-03ba102868f3","resolution":{"observed_at":"2026-08-07T19:25:41.195457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:41.155112Z","title":"Lillicrap and Mohammad Norouzi and Jimmy Ba , title =","venue":null,"work_id":"8d5e7621-e73c-4942-88f4-19d18ccc7135","year":2021},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.134059Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:2ae39e93f57faa08765b55eec60a24658b4dc418cc1cc31f705503ac7736734b","observation_id":"4caa86dc-8729-4b10-8ff3-a5403ae4d9c6","resolution":{"observed_at":"2026-08-07T19:25:41.164847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:37.140703Z","title":"Addressing Function Approximation Error in Actor-Critic Methods , booktitle =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.140703Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:cef69cf1d9f4816d4eaa416b9d112d88b11227c03d418f665648b2b5b7acbd10","observation_id":"df3a3128-c34e-4b6b-8019-d9cae9388c24","resolution":{"observed_at":"2026-08-07T19:25:37.140703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:40.068323Z","title":null,"venue":null,"work_id":"64bb1d47-05e1-4214-ab8c-0a6789f83d4e","year":2012},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.149648Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:07f583727f0a167102ccb297aa2b389ea2a200686ad40082fbe83f6012b7f217","observation_id":"0cc9fe9a-d92b-49ca-9506-747bd9826cbe","resolution":{"observed_at":"2026-08-07T19:25:40.074573Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:37.186595Z","title":"PyTorch: An Imperative Style, High-Performance Deep Learning Library , booktitle =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.186595Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:96d4d0a3e3a98806086176a0a6c1146f5ff6257ebf3fbe823abe92681d586aae","observation_id":"eb5890d5-d13b-4d2b-9e2d-95b6d1edf2f2","resolution":{"observed_at":"2026-08-07T19:25:37.186595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:41.102193Z","title":null,"venue":null,"work_id":"99c9a45e-a37d-4120-a062-1756f7d9c5ba","year":2020},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.235357Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:c3e0f4f710a49b463e0226a44d2339f1e8d7748bc8e7ac0fcf6ecc723c370f47","observation_id":"8a91c463-f414-43ad-a6e1-3a9f4a32ada8","resolution":{"observed_at":"2026-08-07T19:25:41.108728Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:37.292681Z","title":"Bellemare and Yavar Naddaf and Joel Veness and Michael Bowling , title =","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.292681Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:f7e8f86579cd43cf65c1ca084b0e13c3e9a2ec0e615859273fc62cb67270971c","observation_id":"734a10a7-7be1-4886-94ae-f0952b6dec71","resolution":{"observed_at":"2026-08-07T19:25:37.292681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02696","last_updated":"2024-06-04T18:15:44Z","snapshot_observed_at":"2026-08-03T10:05:14.805466Z","submitted_at":"2024-06-04T18:15:44Z","title":"iQRL -- Implicitly Quantized Representations for Sample-efficient Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02696","snapshot_observed_at":"2026-08-07T19:25:37.326777Z","title":"iQRL - Implicitly Quantized Representations for Sample-efficient Reinforcement Learning , journal =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.326777Z"},"links":{"cited_paper":"/paper/2406.02696","citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:ce98d12277ae2bf6db78af84bd8ecc4d2b80126b930cb0b1101882b53c9a9538","observation_id":"9072e5fb-3ca0-4336-b7d1-73b56496f75d","resolution":{"observed_at":"2026-08-07T19:25:37.326777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:41.070398Z","title":null,"venue":null,"work_id":"6341e6fd-af04-4f60-a6a7-012398f31358","year":2023},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.333958Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:9d83c136d3b3fb522fe6a927cd9939b23448fec2318ddd9da996a4991e5096f6","observation_id":"23539ab4-51c3-47f6-a7b1-419b97455cec","resolution":{"observed_at":"2026-08-07T19:25:41.078823Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:41.052527Z","title":"Riedmiller , title =","venue":null,"work_id":"7d651cfb-d4e2-4bd5-803f-1ec64f12c703","year":2014},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.348131Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:e7755ba55fc1c05e2642420b0f51fefb5010e6ba3e793f9caa3a391f29cb19de","observation_id":"ec41d5ca-ac4d-42eb-9cfd-1c7e53a82567","resolution":{"observed_at":"2026-08-07T19:25:41.057574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:37.354592Z","title":"Lillicrap and David Silver , title =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.354592Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:ad5596853901f477d13710af576cb222426f4a5564d55364d36daf02728e6b4f","observation_id":"38af85a0-89aa-4a82-83b3-c25cdedf7df3","resolution":{"observed_at":"2026-08-07T19:25:37.354592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:41.023651Z","title":"Dueling Network Architectures for Deep Reinforcement Learning , booktitle =","venue":null,"work_id":"f165bc6f-3e64-477a-9f92-99de830647e8","year":2016},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.361379Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:32e8d23de6dedb1c2988bbe411cdd5b813c0033ac732fe3d885e1f544a4fc5d9","observation_id":"0f7afee3-0500-4ac7-acb2-211e9d5cae2a","resolution":{"observed_at":"2026-08-07T19:25:41.037297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:40.995151Z","title":"Temporal Difference Learning for Model Predictive Control , booktitle =","venue":null,"work_id":"bc15ee43-eb50-422d-abc8-2c5ab93e26ba","year":2022},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.369342Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:bd6232f38db977591453c73109fe04443dfff01611eeb74002ad8559976d4a60","observation_id":"7dc03134-efb4-480c-9f4f-a032870ad720","resolution":{"observed_at":"2026-08-07T19:25:41.003297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-07T19:25:37.375052Z","title":"Riedmiller , title =","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.375052Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:6b35897ca35a22735556e394f1bb82cbbcdc0049e439dd3f79bcde524d5335d9","observation_id":"66089502-ca86-4a46-b6a9-1d83fd15ca32","resolution":{"observed_at":"2026-08-07T19:25:37.375052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:40.962087Z","title":null,"venue":null,"work_id":"ddb65be8-8564-4cad-b198-d3a0de676cc9","year":2025},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.382370Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:fded7f942b69aa74567be91eceffd33598c8ca045abf269fa0c46eba4233aead","observation_id":"efcfadb4-2b4c-41bb-b5ba-edc91e3f9a2e","resolution":{"observed_at":"2026-08-07T19:25:40.970558Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:40.941250Z","title":"An Equivalence between Loss Functions and Non-Uniform Sampling in Experience Replay , booktitle =","venue":null,"work_id":"cc74c062-6514-48e3-9f7b-accf8461292b","year":2020},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.387447Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:dcb99fb7e954e5af70a745ec80c2667b83cd23769638d6c9721b673b9a484694","observation_id":"a0760500-88f1-4d0d-b80d-50c6611e7b7d","resolution":{"observed_at":"2026-08-07T19:25:40.946366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:37.393149Z","title":"7th International Conference on Learning Representations,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.393149Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:211f456f3239b10ec9bf012ba0e3f0e008728f391b12e99cc7afc354aab35d16","observation_id":"b50ccd17-d587-4049-803c-9b6f71f211f7","resolution":{"observed_at":"2026-08-07T19:25:37.393149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:37.399674Z","title":"Rainbow: Combining Improvements in Deep Reinforcement Learning , booktitle =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.399674Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:eab33dee27859a8e8fd0b83cd805d69268d3e37100e3ff22572aa4b823bd20e8","observation_id":"b0111dee-9f00-44bf-a5c7-6aa47f713d3b","resolution":{"observed_at":"2026-08-07T19:25:37.399674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:40.904802Z","title":"Generating Code World Models with Large Language Models Guided by Monte Carlo Tree Search , booktitle =","venue":null,"work_id":"ade4b72f-e29e-4311-8225-00f3523e1740","year":2024},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.406764Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:672e17147e511dcc69ef82051b2d1c160437490d57423ba70fab6e51461247d8","observation_id":"810f0e40-cb41-45a3-89be-a6a72adf7674","resolution":{"observed_at":"2026-08-07T19:25:40.912667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:40.888526Z","title":"WorldCoder, a Model-Based","venue":null,"work_id":"0d234524-97fe-44ff-9d02-113194d5b9ac","year":2024},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.526632Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:f52c92949c2a6e7c348cb0a0825ef10d13063ac8064611794d2850ffbdd57b21","observation_id":"e4e88ff5-9f73-46a8-b204-6bf8eff4b480","resolution":{"observed_at":"2026-08-07T19:25:40.893756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:40.867124Z","title":"Cal-QL: Calibrated Offline","venue":null,"work_id":"6c126354-0762-4ba7-8b13-9d28f0b3c48a","year":2023},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.570618Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:02e998f228a84af05a03609a3a56d09c86b90d8fd7edd4276a5ba6ea289b851d","observation_id":"9dff6a6a-a753-497a-83cd-2ba0633378a2","resolution":{"observed_at":"2026-08-07T19:25:40.872131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:40.837344Z","title":"Martin and Mariano Phielipp and Chelsea Finn , editor =","venue":null,"work_id":"0d809ee8-1f66-40a0-a6f2-9dc1a383715e","year":2023},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.616329Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:0dbd4f1a03e21ab05fdbd86ac763e8326a0434972acfff5029d08b5e24dc28fa","observation_id":"62231c25-f2f9-45e6-9c31-89f42f365451","resolution":{"observed_at":"2026-08-07T19:25:40.847194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v38i11.29083","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:38.844025Z","title":"Thirty-Eighth","venue":null,"work_id":"6fa3c90e-d211-4b70-b453-00d229c23865","year":2024},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.699751Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:e545f5c5afecf9b6659f2a2af21753cd0b6cf02143a2dcf96c5c4e48f99b4b6a","observation_id":"80d0ed6d-43af-473c-8604-31ea0e4c09d0","resolution":{"observed_at":"2026-08-07T19:25:38.852385Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:39.838622Z","title":null,"venue":null,"work_id":"4ae6913a-06e6-419d-9735-da53aafeb792","year":2018},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.758436Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:ab8673e3bd54c065980176a510bb0c59c8f16f24d7cef2dcde3bf9e9fa4af119","observation_id":"bb955f5c-9ce5-4c66-8dcc-10a34a211a74","resolution":{"observed_at":"2026-08-07T19:25:39.846537Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:37.802696Z","title":"Robotics: Science and Systems XVII, Virtual Event, July 12-16, 2021 , year =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.802696Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:17ae3c8412a183ade28c7b59b229b1b61f1fcac372817c54246a59cef3f1f73c","observation_id":"b007244a-d441-44f4-8494-f1d70add8e16","resolution":{"observed_at":"2026-08-07T19:25:37.802696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:37.810321Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.810321Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:a70e6f3b7e9a9fbd40eb0b0714f932c3ec162363e729744c53b787ef1da071d8","observation_id":"8d10007d-6ced-402b-8565-8df3be535e32","resolution":{"observed_at":"2026-08-07T19:25:37.810321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:37.816068Z","title":"Model-Agnostic Meta-Learning for Fast Adaptation of Deep Networks , booktitle =","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.816068Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:0663890d70334691eb1a9e209988b7b2a5fe8e65852aecb5ac36999232bb74fe","observation_id":"359e04bc-a079-41a5-8d75-46da4bfaddb0","resolution":{"observed_at":"2026-08-07T19:25:37.816068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:40.786048Z","title":"7th International Conference on Learning Representations,","venue":null,"work_id":"005cb3f7-ba3b-48b0-9c7d-a8ffe6cb840d","year":2019},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.828720Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:8fa6c60f14b3863a7f3569e82150da7e9e8dbc07044df0afe3e4baa620e2d876","observation_id":"26fe8cb3-6aef-454e-bdc0-9965d5cb6ffd","resolution":{"observed_at":"2026-08-07T19:25:40.793762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:37.836604Z","title":"The Twelfth International Conference on Learning Representations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.836604Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:6c81e401d9da8214ba31b2f6e53ce1108806d1375834061ce2263b9747112523","observation_id":"38810412-501a-4803-9572-088d3604c81f","resolution":{"observed_at":"2026-08-07T19:25:37.836604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:37.843196Z","title":"RoboGen: Towards Unleashing Infinite Data for Automated Robot Learning via Generative Simulation , booktitle =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.843196Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:e36e39f031ad2b6907bc568d9dd0ac9a8ee3af78282953dc7e121ced3b703261","observation_id":"cee390e2-1bff-42c0-abb9-996d6bcb9269","resolution":{"observed_at":"2026-08-07T19:25:37.843196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:39.557487Z","title":"2024 , url =","venue":null,"work_id":"082b1bee-b1e5-41eb-b922-0dcb2a5da4de","year":2024},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.848802Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:0e38fbfb537c9abc8d28eb673da742ae4cd76a38147766a74d37c104d7c29185","observation_id":"9ff05b51-3015-431c-bed9-5c27970aa91e","resolution":{"observed_at":"2026-08-07T19:25:39.578948Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:37.855288Z","title":"Rusu and Joel Veness and Marc G","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.855288Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:ccf61e134d10638290c9de7977a02995cde8506ab1a91f4bf1fb5e9595bde50a","observation_id":"b1fbbf06-1435-481d-9f05-31f634ecd527","resolution":{"observed_at":"2026-08-07T19:25:37.855288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:37.860492Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.860492Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:2588e1cd436a8eaf040be5d92c8cdef7c5e2126b15677d16c8e202eb3157416f","observation_id":"2f24a28d-669b-44d7-a317-cb41adf8db25","resolution":{"observed_at":"2026-08-07T19:25:37.860492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.12901","last_updated":"2019-04-29T18:40:15Z","snapshot_observed_at":"2026-07-06T07:49:17.886466Z","submitted_at":"2019-04-29T18:40:15Z","title":"Challenges of Real-World Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.12901","snapshot_observed_at":"2026-08-07T19:25:37.866498Z","title":"Challenges of Real-World Reinforcement Learning , journal =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.866498Z"},"links":{"cited_paper":"/paper/1904.12901","citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:95103b44c1bc4e8d12de3b2a11e5c10f7c40fdad0915dfd56cc2ea7b482252da","observation_id":"71aab9e4-84e4-4dd4-8958-cffc7281efa2","resolution":{"observed_at":"2026-08-07T19:25:37.866498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:40.667624Z","title":"EfficientZero","venue":null,"work_id":"dd9c9f50-bdde-4a7e-9af4-8223be805f14","year":2024},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.872946Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:9fe38d192c910c14722b0384c09be4d4d24dc2dd4dfcf91a415cf4ecf0dd6d84","observation_id":"26feb134-8478-481b-833d-dccc29817d06","resolution":{"observed_at":"2026-08-07T19:25:40.692785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:37.879031Z","title":"9th International Conference on Learning Representations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.879031Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:e663e52edd050252f0f9572b45b8494a96dcf5580f4f1f97e28ebfbc8f8d9bfb","observation_id":"b5506be6-fbf0-4e48-ac7c-91f492cd9982","resolution":{"observed_at":"2026-08-07T19:25:37.879031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T19:25:37.894591Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.894591Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:dd86f5172be1f0111b2640e912f1f797a6ca99057d23b2ca8452e2015c2c6c8a","observation_id":"26611386-b047-47be-98bb-5f8e6d2b2972","resolution":{"observed_at":"2026-08-07T19:25:37.894591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03267","last_updated":"2026-05-01T23:55:43Z","snapshot_observed_at":"2026-08-02T10:52:10.211700Z","submitted_at":"2025-12-19T07:05:38Z","title":"OpenAI GPT-5 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.03267","snapshot_observed_at":"2026-08-07T19:25:37.901490Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.901490Z"},"links":{"cited_paper":"/paper/2601.03267","citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:8a8656079a9937e5a5f05058c732c185fcd46d77976e2991b286a2cebb2b3491","observation_id":"898a39d4-924c-4c17-a795-f75cf9925b7f","resolution":{"observed_at":"2026-08-07T19:25:37.901490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:37.912077Z","title":"Eureka: Human-Level Reward Design via Coding Large Language Models , booktitle =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.912077Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:e2b2144463508bb8d542db140a45e2595d4e1329c3b048a798763dbd06f0c6fb","observation_id":"ac220c56-8558-4072-a893-006e83dfd3bc","resolution":{"observed_at":"2026-08-07T19:25:37.912077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10861","last_updated":"2025-05-16T05:03:39Z","snapshot_observed_at":"2026-08-07T15:44:50.684850Z","submitted_at":"2025-05-16T05:03:39Z","title":"Improving the Data-efficiency of Reinforcement Learning by Warm-starting with LLM","version":1},"cited_work":{"arxiv_id":"2505.10861","doi":"10.48550/arxiv.2505.10861","metadata_source":"pith","pith_arxiv_id":"2505.10861","snapshot_observed_at":"2026-08-08T00:16:16.039225Z","title":"Improving the Data-efficiency of Reinforcement Learning by Warm-starting with LLM","venue":"cs.LG","work_id":"64f5173f-6c73-4318-84d7-ef9ceafa6f88","year":2025},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.918588Z"},"links":{"cited_paper":"/paper/2505.10861","citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:9cf124c3ed37340bffaa310887be647c3a412274d123197f816e9550227d5357","observation_id":"f2d30702-5654-451e-a9d5-872b374fdef9","resolution":{"observed_at":"2026-08-07T19:25:38.695370Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:37.958639Z","title":"Latent Reward: LLM-Empowered Credit Assignment in Episodic Reinforcement Learning , booktitle =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:37.958639Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:9b5734cd44a826ca208dd81c553d1e64aa28b1135ea0427d600723cd8a0f8946","observation_id":"d2ec8eba-3889-42d9-816c-09b75a5422af","resolution":{"observed_at":"2026-08-07T19:25:37.958639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:40.601108Z","title":"LLM-Explorer:","venue":null,"work_id":"8d93ba77-320e-4fb0-88c0-32992b4de555","year":2025},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:38.057982Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:5e9721fef4bc7d560f277fe948f97d7ff06f27601b92454a956e57c384f8724f","observation_id":"bb9651fb-50b2-49ff-ba9d-fd6a8e35222b","resolution":{"observed_at":"2026-08-07T19:25:40.611941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.21297","last_updated":"2026-06-19T10:21:04Z","snapshot_observed_at":"2026-07-06T23:56:21.824303Z","submitted_at":"2026-06-19T10:21:04Z","title":"NASDAQ: Normalized Observation Space Dynamics-Augmented Q-Learning","version":1},"cited_work":{"arxiv_id":"2606.21297","doi":"10.48550/arxiv.2606.21297","metadata_source":"pith","pith_arxiv_id":"2606.21297","snapshot_observed_at":"2026-08-08T00:16:16.039225Z","title":"NASDAQ: Normalized Observation Space Dynamics-Augmented Q-Learning","venue":"cs.LG","work_id":"447099da-33ef-4fe6-8c73-26bf7962f78d","year":2026},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:38.157587Z"},"links":{"cited_paper":"/paper/2606.21297","citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:84f5d2833c27c9dfe2bd051a8d36a004d4a002b6b141e51543f3b835b10722c1","observation_id":"0f5a31f3-017b-48bf-9a5a-4e7962ce4f1c","resolution":{"observed_at":"2026-08-07T19:25:38.442865Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:40.565241Z","title":"Balis and Gianluca De Cola and Tristan Deleu and Manuel Goul","venue":null,"work_id":"9510467a-93ed-465e-85b4-6c5191252bc1","year":2025},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:38.201357Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:ee60729b111f8ce0a93afefdc1a5450f331ce7aba467292e264a8336634e7812","observation_id":"cf285323-92fa-49fa-bd82-1f9e9e554582","resolution":{"observed_at":"2026-08-07T19:25:40.578639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:38.208303Z","title":"Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor , booktitle =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:38.208303Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:c27757885a68134f450cc92340149e44d6c64609dbffc022de30b14109363486","observation_id":"ff0f8758-5dbc-443f-985e-708b722035bc","resolution":{"observed_at":"2026-08-07T19:25:38.208303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:40.506171Z","title":"The Secret Sharer: Evaluating and Testing Unintended Memorization in Neural Networks , booktitle =","venue":null,"work_id":"edd05fd3-318b-4919-acfa-cc16584822f0","year":2019},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:38.215006Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:d717bafd38254fc5bca5ada875c4070047cb15e5eb1c9de629a0f2d294a2a8bb","observation_id":"0a2de91d-f8cf-44a3-98c8-b5b9b11149de","resolution":{"observed_at":"2026-08-07T19:25:40.517341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:40.459369Z","title":"Extracting Training Data from Large Language Models , booktitle =","venue":null,"work_id":"9972a692-8d42-4aa3-83d2-e26b80ea1e3f","year":2021},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:38.222345Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:c425e73eb134ea1bc8cd6eb0fb21bb84c7b64db09594db963629c14bdeb88779","observation_id":"a7b9460e-335f-4a1c-92ed-8fd4f0d3ba19","resolution":{"observed_at":"2026-08-07T19:25:40.480569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:40.433855Z","title":"Feder Cooper and Daphne Ippolito and Christopher A","venue":null,"work_id":"f38a1855-474d-4829-aed3-0a3769dbbd2e","year":2025},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:38.228375Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:b396aa18ffbc2c74178cba6fcc699b045e1226babe5430d0a5c7cdcf0d83c0fa","observation_id":"9025be03-8421-4825-b636-38619d580047","resolution":{"observed_at":"2026-08-07T19:25:40.439742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:40.366887Z","title":"LLM-Empowered State Representation for Reinforcement Learning , booktitle =","venue":null,"work_id":"b06e95a3-18c8-4dc1-b2db-fdb8a0fc29b8","year":2024},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:38.233390Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:541a2cc8d5473922a95c5ac13d1ca798e93d2de24c3b4d8094197bba0728ba35","observation_id":"498cb993-99ff-467d-949d-bb375411b7ab","resolution":{"observed_at":"2026-08-07T19:25:40.383259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:40.330389Z","title":"Machado , editor =","venue":null,"work_id":"a740c5cd-35ea-4a6d-a690-36d469bcce47","year":2023},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:38.240601Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:7135944a59429d3613ee989dfe72c43c4f14ebadd1a7e11e566f9b10207d8a26","observation_id":"3d6226e5-969d-4743-a68e-d8ae24864efe","resolution":{"observed_at":"2026-08-07T19:25:40.340525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:38.247955Z","title":"Fernando Hernandez","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:38.247955Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:6f3d29221cfd6ff0476192c18d93bbb5954412baa5fae67e9d2ef6bf126426e6","observation_id":"97bff039-c9d6-45d8-9598-263e437c1bf0","resolution":{"observed_at":"2026-08-07T19:25:38.247955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:40.291337Z","title":"Sample-Efficient Reinforcement Learning by Breaking the Replay Ratio Barrier , booktitle =","venue":null,"work_id":"9d1fce4f-274d-4a35-b784-ef2c3cfbe445","year":2023},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:38.254389Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:bf72105372b26659f2039e48065833bc636723405c97e9f2c1fe7df458f3fea0","observation_id":"5e7388b9-080a-4a30-89f1-8480d1af8711","resolution":{"observed_at":"2026-08-07T19:25:40.304122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:40.236928Z","title":"Spectral Normalisation for Deep Reinforcement Learning: An Optimisation Perspective , booktitle =","venue":null,"work_id":"8ee50687-2a1d-4b23-a64a-abe3fe179be8","year":2021},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:38.260137Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:adff1da7e28503000d97b75872ec0ceb4cb5573527baf3196a0ae0fd274846a7","observation_id":"98f9ef48-0071-4767-a864-9eade11aca07","resolution":{"observed_at":"2026-08-07T19:25:40.254629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:40.208238Z","title":"Gomes and Kilian Q","venue":null,"work_id":"216ebfcd-3501-43a7-8996-b5ce13f475b0","year":2021},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:38.266150Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:11049df5dcd4a10df1a04569f321c2d1d5cba213879dbd43d1daf60243f94ddf","observation_id":"aee57e84-63ea-4007-a180-3c19a3fb9bc3","resolution":{"observed_at":"2026-08-07T19:25:40.214987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:40.180904Z","title":"2026 , note =","venue":null,"work_id":"b7426280-35f0-47b0-a41a-17d0baff8d40","year":2026},"citing_paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:38.276643Z"},"links":{"citing_paper":"/paper/2608.06015"},"observation_digest":"sha256:16e0d65fc50c41a9149d703521186d69f9017214e91adebe19af8ef045ea3d1d","observation_id":"f257213f-79f6-44a2-9d7d-d1f462a5f811","resolution":{"observed_at":"2026-08-07T19:25:40.193143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.06015","last_updated":"2026-08-06T13:19:29Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T04:13:06.376898Z","submitted_at":"2026-08-06T13:19:29Z","title":"ProDVI: Programmatic Dynamics Priors for Value Network Initialization"},"reference_resolution":{"displayed":77,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":8,"verified_fuzzy":33},"total_outbound_references":77},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 77 of 77 outbound references and 0 inbound Pith citation observations for arXiv:2608.06015."}