{"as_of":"2026-08-10T16:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:61602b6a16e35341edf3e50185d99fed7825f34e5a274dbed3f50975293fd4ee","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:55:23.510044Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.00215/citation-record","integrity":"/paper/2509.00215/integrity","json":"/paper/2509.00215/citation-record.json","paper":"/paper/2509.00215"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.14341","last_updated":"2023-09-25T17:59:55Z","snapshot_observed_at":"2026-08-08T16:43:41.889054Z","submitted_at":"2023-09-25T17:59:55Z","title":"Extreme Parkour with Legged Robots","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14341","snapshot_observed_at":"2026-08-05T13:55:17.705449Z","title":"Cheng, K","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:17.705449Z"},"links":{"cited_paper":"/paper/2309.14341","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:47abf8b03ba4560c702ac63ef1416a88befe0810b1b29fea953bc84406632ddd","observation_id":"eefc5919-86d4-4184-9a9a-4d1b01a295a1","resolution":{"observed_at":"2026-08-05T13:55:17.705449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:31.050638Z","title":"Hoeller, N","venue":null,"work_id":"7d79ce8a-97c6-4f7e-82d7-fd160946d929","year":2024},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:17.780123Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:d7e99c853a00fe66ab10db49cf1d30d7410526136ac42d4803147bc13ee718c6","observation_id":"20b07706-be38-4367-839b-e684ae4ea10f","resolution":{"observed_at":"2026-08-05T13:55:31.199992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05665","last_updated":"2023-09-12T03:01:55Z","snapshot_observed_at":"2026-07-06T16:17:04.004519Z","submitted_at":"2023-09-11T17:59:17Z","title":"Robot Parkour Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05665","snapshot_observed_at":"2026-08-05T13:55:17.852881Z","title":"Zhuang, Z","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:17.852881Z"},"links":{"cited_paper":"/paper/2309.05665","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:d8144602eea4f35868b35158563f34c311db7c98a26d9f7c1976f810d64f32d5","observation_id":"4ffccb10-3ee9-4707-8fa7-3f6123bc4c36","resolution":{"observed_at":"2026-08-05T13:55:17.852881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18765","last_updated":"2024-03-27T17:03:31Z","snapshot_observed_at":"2026-08-09T19:53:02.866249Z","submitted_at":"2024-03-27T17:03:31Z","title":"CaT: Constraints as Terminations for Legged Locomotion Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2403.18765","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.18765","snapshot_observed_at":"2026-08-05T13:55:24.868000Z","title":"CaT: Constraints as Terminations for Legged Locomotion Reinforcement Learning","venue":"cs.RO","work_id":"b52e3318-9287-4a3d-9344-7c436ce91d0b","year":2024},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:17.938230Z"},"links":{"cited_paper":"/paper/2403.18765","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:49a9d1cbff5ac1c2663954a96cb95a61de9cab832e50226a7c992d661913e877","observation_id":"d6e9d1ba-0898-4233-93b1-18a791645247","resolution":{"observed_at":"2026-08-05T13:55:24.939410Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:30.878254Z","title":"Chane-Sane, J","venue":null,"work_id":"376502b0-79b7-4ca7-ba8b-af2f9474a672","year":2024},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:18.016466Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:faa234871c4c48ec309acfecb2f24b0218c329ffc20f0ac6afc8ee448e3ff07b","observation_id":"7ab7bf6e-59d9-4f60-8527-1b8dbeff5e71","resolution":{"observed_at":"2026-08-05T13:55:30.937927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:30.690267Z","title":"Radosavovic, T","venue":null,"work_id":"f460adee-4ea5-426e-a736-0eb6aad7ce23","year":2024},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:18.105156Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:f1c76718435896e4b785b45d90f03abaf04a5870cd63e503908af5b13eccb62b","observation_id":"54d827e1-b82c-4e8e-9211-ca6adcc49a9c","resolution":{"observed_at":"2026-08-05T13:55:30.796027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10759","last_updated":"2024-09-26T11:13:10Z","snapshot_observed_at":"2026-08-08T00:03:50.512548Z","submitted_at":"2024-06-15T23:21:10Z","title":"Humanoid Parkour Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10759","snapshot_observed_at":"2026-08-05T13:55:18.163096Z","title":"Zhuang, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:18.163096Z"},"links":{"cited_paper":"/paper/2406.10759","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:ab17169b17e11184745095369791a6216c9b050f40af17d86ac5c0a211af6c61","observation_id":"075de610-b309-4860-b4cf-3b4bce0fca15","resolution":{"observed_at":"2026-08-05T13:55:18.163096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:30.448617Z","title":"Handa, A","venue":null,"work_id":"e0a874cd-9913-4d6d-8b76-c6ec1ab69ebd","year":2023},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:18.247810Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:bfd80fa3b8e2d413caa9310ce80d00850246dc9bd917b2b5aaa5b018cc4fcb60","observation_id":"19b6c940-75e5-44fc-ac05-a36199f538e9","resolution":{"observed_at":"2026-08-05T13:55:30.550426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:30.216843Z","title":"Allshire, M","venue":null,"work_id":"eb7b2d84-563e-4397-b199-01ecd3af3345","year":2022},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:18.331093Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:6e8f00b7b672f876fb59e5f8763e8d009c6a5aa617ff2de52fce6e84af691c20","observation_id":"c697c475-481c-4266-a988-61977e697efc","resolution":{"observed_at":"2026-08-05T13:55:30.315915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-05T13:55:18.418230Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:18.418230Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:364e68c6661cf170fe158307e0d37fb84b886836f61081bab65ab8cf135fa972","observation_id":"e0019b8c-380b-448c-903f-dc8611d53942","resolution":{"observed_at":"2026-08-05T13:55:18.418230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:29.856422Z","title":"Haarnoja, A","venue":null,"work_id":"c6f921ab-c69f-4690-82fd-f9958f28257d","year":2018},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:18.526852Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:6c4fcc2c3786a8f5f7071f46bc8e27e20d7d0b5af5e6e0d9fd7553878d95d5ec","observation_id":"95ec361a-c007-43b6-b6a3-ee161519ffa8","resolution":{"observed_at":"2026-08-05T13:55:30.059121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.05905","last_updated":"2019-01-29T12:10:47Z","snapshot_observed_at":"2026-08-01T15:24:35.515954Z","submitted_at":"2018-12-13T04:44:29Z","title":"Soft Actor-Critic Algorithms and Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.05905","snapshot_observed_at":"2026-08-05T13:55:18.610364Z","title":"Haarnoja, A","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:18.610364Z"},"links":{"cited_paper":"/paper/1812.05905","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:2ea70a42fa847ec725f57b2ac5f8b4ec34d0a1d44a7543ec489d94dab3889409","observation_id":"dacb7721-7cc3-412a-aec8-d89b4dd0d079","resolution":{"observed_at":"2026-08-05T13:55:18.610364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T13:55:18.698361Z","title":"Schulman, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:18.698361Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:fe8271c47b69ad0de8e8628870f11a4065af833fd6df0b2265f6e14f95ccaeb8","observation_id":"977cd5ba-140c-44d0-9ee8-bc1bb6dc6900","resolution":{"observed_at":"2026-08-05T13:55:18.698361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:29.781019Z","title":"Makoviychuk, L","venue":null,"work_id":"8fee0287-b6bb-4ac3-a402-57d01fe76ffa","year":2021},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:18.784567Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:f82c2c13bd3c71db537bc2f18b70450d6a19c2caa629664c6dcd15ad9a7012b2","observation_id":"0f624531-13a9-4c2d-a8c5-cd3972e81bfe","resolution":{"observed_at":"2026-08-05T13:55:29.793507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:29.595662Z","title":"Rudin, D","venue":null,"work_id":"f9f8b580-8106-4c89-99a3-aa2bf1f588a0","year":2022},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:18.840672Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:e2bca780a3eaa97d1b3ceb7fda5b622b464ede6e8698f45ebd8e925c25e2abd5","observation_id":"9d08c49a-fbfc-48a0-b73d-d1720f17b0f5","resolution":{"observed_at":"2026-08-05T13:55:29.677897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:29.406634Z","title":"Todorov, T","venue":null,"work_id":"f2374c86-69c4-42c8-a558-41a91da8bc7b","year":2012},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:18.896535Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:a63708c1f95abfb7d8d55fb0361f334d4eb83babf3b6317be7ffd0250e2e76d8","observation_id":"35ea65e2-159c-41b9-aeee-bbd8a793a10d","resolution":{"observed_at":"2026-08-05T13:55:29.475120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13281","last_updated":"2021-06-24T19:09:12Z","snapshot_observed_at":"2026-07-06T11:22:55.799017Z","submitted_at":"2021-06-24T19:09:12Z","title":"Brax -- A Differentiable Physics Engine for Large Scale Rigid Body Simulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.13281","snapshot_observed_at":"2026-08-05T13:55:19.096958Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:19.096958Z"},"links":{"cited_paper":"/paper/2106.13281","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:07977d74e551907dd6f71f03f6bf673b34a93e17428418ee10858978b9dd995f","observation_id":"8f01a179-9e0a-415c-b58e-556d92eae544","resolution":{"observed_at":"2026-08-05T13:55:19.096958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:29.261230Z","title":null,"venue":null,"work_id":"d7132bb9-f579-4771-8067-2a4ddd602d84","year":2021},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:19.163383Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:f147a71bc9b13a38e8ea44dfbce59620366ea00fd4cc1d61736b3bc5b127faa6","observation_id":"ac7132db-fbe4-4691-99a4-ac60ccae28cf","resolution":{"observed_at":"2026-08-05T13:55:29.343852Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12089","last_updated":"2025-02-27T19:05:47Z","snapshot_observed_at":"2026-07-06T20:07:58.873037Z","submitted_at":"2024-12-16T18:56:24Z","title":"Stabilizing Reinforcement Learning in Differentiable Multiphysics Simulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12089","snapshot_observed_at":"2026-08-05T13:55:19.235569Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:19.235569Z"},"links":{"cited_paper":"/paper/2412.12089","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:f94a75ea1ed9e37e9c134427deabf748ad58726bae1e42e1ab9a57f7a18d4069","observation_id":"0c47a33e-6ec9-4403-8350-7707d2faef05","resolution":{"observed_at":"2026-08-05T13:55:19.235569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02193","last_updated":"2022-02-12T20:01:53Z","snapshot_observed_at":"2026-08-02T12:02:13.904371Z","submitted_at":"2020-10-05T17:52:14Z","title":"Mastering Atari with Discrete World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02193","snapshot_observed_at":"2026-08-05T13:55:19.319152Z","title":"Hafner, T","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:19.319152Z"},"links":{"cited_paper":"/paper/2010.02193","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:6eaa15ca09ad30a09ee4658453661a59de8b6cc179bf356d27c565698ed9438b","observation_id":"61eec1b2-2f94-4487-bc51-1761a1500957","resolution":{"observed_at":"2026-08-05T13:55:19.319152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-05T13:55:19.428516Z","title":"Hafner, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:19.428516Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:b8df94b63522b9e7875ad760a60da7a34e75e77e72ca5d920bdc666cdecef5d6","observation_id":"b03a9063-4f53-4ea5-ae15-85f352698399","resolution":{"observed_at":"2026-08-05T13:55:19.428516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:29.064299Z","title":"Janner, J","venue":null,"work_id":"b04b80b8-e4b8-4099-a986-ef5983a424e6","year":2019},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:19.510489Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:9ae18e3cc16adf14bc5f7b36881942ff896d7933b87dc26dec57adc1f0e3e8fb","observation_id":"680e74d3-2cfc-414a-b478-599c8cf5bb88","resolution":{"observed_at":"2026-08-05T13:55:29.147492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.08068","last_updated":"2020-05-16T19:18:10Z","snapshot_observed_at":"2026-08-09T14:24:39.416083Z","submitted_at":"2020-05-16T19:18:10Z","title":"Model-Augmented Actor-Critic: Backpropagating through Paths","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.08068","snapshot_observed_at":"2026-08-05T13:55:19.598311Z","title":"Clavera, V","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:19.598311Z"},"links":{"cited_paper":"/paper/2005.08068","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:9fd65cb1cb28ffc32bfd0618dca9f31eb60e762b6fc47bb45b8187d1bd6fcd0f","observation_id":"4ffff12c-f9a7-480d-9e73-db9e01eb0dce","resolution":{"observed_at":"2026-08-05T13:55:19.598311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:28.885323Z","title":"Elsayed, G","venue":null,"work_id":"f381d9d1-6eb5-4149-953e-d109741c3e62","year":2024},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:19.716043Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:874add7928b7636e2e0ba606387df7fb3e9cd55288b9fdaa1198ee78aa72f55a","observation_id":"64ea6ddf-bde0-4cb6-9ea5-5da30d3df045","resolution":{"observed_at":"2026-08-05T13:55:28.972100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:28.689780Z","title":null,"venue":null,"work_id":"5604d3b2-a935-4bac-b1bd-9bee1b9e4666","year":1990},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:19.778757Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:609a41802c403a7aacdfe6c88ab9f36441fddaca4ba0e4c4b9c25215f5b2a87e","observation_id":"71a99d3b-4717-479b-afab-4285b52cb69c","resolution":{"observed_at":"2026-08-05T13:55:28.773938Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:28.547588Z","title":null,"venue":null,"work_id":"70ec4761-7e88-4e85-8c06-d774393461c1","year":2016},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:19.830030Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:24ef5f8be8215ae7c9333b194aadd9c0cf237b7ed68223915a320f5bb64d6178","observation_id":"68c08023-1b46-4ee9-879d-1555f7d8b837","resolution":{"observed_at":"2026-08-05T13:55:28.609037Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.10592","last_updated":"2018-10-05T05:08:37Z","snapshot_observed_at":"2026-07-06T06:25:54.451916Z","submitted_at":"2018-02-28T18:58:22Z","title":"Model-Ensemble Trust-Region Policy Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.10592","snapshot_observed_at":"2026-08-05T13:55:19.943415Z","title":"Kurutach, I","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:19.943415Z"},"links":{"cited_paper":"/paper/1802.10592","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:f5c2525bdc05846c5334a31a51e08c4b45bc66faa36bf4f2cbc5f6f7e696514a","observation_id":"ec4010ee-412b-44cb-ae97-ca58571d7006","resolution":{"observed_at":"2026-08-05T13:55:19.943415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:28.324136Z","title":"Buckman, D","venue":null,"work_id":"08e32e0a-8863-437d-a12f-36602d8de9e4","year":2018},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:20.029857Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:5f78221c135baabe05b7bd05163bcccc74fd83d52edac2721ebfbc70afdce763","observation_id":"22d18bab-131e-4ae9-a557-c728b43ca344","resolution":{"observed_at":"2026-08-05T13:55:28.456772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.00101","last_updated":"2018-02-28T21:43:37Z","snapshot_observed_at":"2026-08-10T08:40:17.074438Z","submitted_at":"2018-02-28T21:43:37Z","title":"Model-Based Value Estimation for Efficient Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.00101","snapshot_observed_at":"2026-08-05T13:55:20.117830Z","title":"Feinberg, A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:20.117830Z"},"links":{"cited_paper":"/paper/1803.00101","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:ae1a200c120bc9c4145968c9be08eebda540c3d7cf1d19b3d2c96f8fb0ffc5c8","observation_id":"594ca297-3b01-4443-a962-40a96554657f","resolution":{"observed_at":"2026-08-05T13:55:20.117830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.13239","last_updated":"2020-11-22T07:04:17Z","snapshot_observed_at":"2026-08-06T03:32:02.156770Z","submitted_at":"2020-05-27T08:46:41Z","title":"MOPO: Model-based Offline Policy Optimization","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.13239","snapshot_observed_at":"2026-08-05T13:55:20.185179Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:20.185179Z"},"links":{"cited_paper":"/paper/2005.13239","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:99e91b993d0ea2b8de26c2fda93ce095a0539ec4cb84e6139f1bd16178d09d2d","observation_id":"09c7c563-8f98-43d7-aed8-844ec46b3436","resolution":{"observed_at":"2026-08-05T13:55:20.185179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:20.237446Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:20.237446Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:2d0e98d5a0a712424677b704f7b072b8a36efa3b56f41e3660886bc8f43c18a1","observation_id":"653bcfa5-8139-4704-967c-1e51c26eb743","resolution":{"observed_at":"2026-08-05T13:55:20.237446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:28.123973Z","title":"Hafner, T","venue":null,"work_id":"f4ff2c3a-9885-4351-a7ec-d376be755685","year":2020},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:20.292967Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:bac266fcd89a09b450c961b07782b3d4165a4c6cf1652b11a967bcb332a44a42","observation_id":"5ab08031-bec0-40cb-9980-beca6d74d684","resolution":{"observed_at":"2026-08-05T13:55:28.233670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:27.963275Z","title":null,"venue":null,"work_id":"939eca98-ca83-4162-a856-63b3148fb358","year":2023},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:20.349280Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:7f79a70fda95803c2e868ca389ed407aa9bc401ca1875d1a5f92f7b4b3b47a24","observation_id":"775f0621-a34a-403d-af76-ffc869ce7c45","resolution":{"observed_at":"2026-08-05T13:55:28.032285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.08466","last_updated":"2023-06-24T19:05:46Z","snapshot_observed_at":"2026-08-03T15:41:43.564872Z","submitted_at":"2022-09-18T03:51:58Z","title":"Simplifying Model-based RL: Learning Representations, Latent-space Models, and Policies with One Objective","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.08466","snapshot_observed_at":"2026-08-05T13:55:20.429792Z","title":"Ghugare, H","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:20.429792Z"},"links":{"cited_paper":"/paper/2209.08466","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:d85b83b6f75e59c7bdb9ec10b4e86a8c176eb58a0d94c693d993c909f34ab975","observation_id":"4bda6bbb-e76f-4d54-b507-8cfecbb5d497","resolution":{"observed_at":"2026-08-05T13:55:20.429792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02466","last_updated":"2025-02-24T06:56:00Z","snapshot_observed_at":"2026-08-09T06:24:28.286613Z","submitted_at":"2024-07-02T17:47:03Z","title":"PWM: Policy Learning with Multi-Task World Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02466","snapshot_observed_at":"2026-08-05T13:55:20.496902Z","title":"Georgiev, V","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:20.496902Z"},"links":{"cited_paper":"/paper/2407.02466","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:d8b20f2a0660491a9e76df94cfac75dd3e3434b013d65ca1ba8207436f5694a5","observation_id":"693e96f3-7121-4972-a386-c386cad89637","resolution":{"observed_at":"2026-08-05T13:55:20.496902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:27.762653Z","title":null,"venue":null,"work_id":"3f0ac7fd-f108-411f-bebc-413e802cf398","year":2021},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:20.545102Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:ce13e5bd70a2b1678dc654384e60727d91fd12d72f96e99b8193167ecc5c182a","observation_id":"48827b83-17c7-49ae-8b93-7942f7274a23","resolution":{"observed_at":"2026-08-05T13:55:27.868906Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:27.618773Z","title":"Byravan, J","venue":null,"work_id":"6fee5ef6-8431-4495-a11c-2d1abb7424df","year":2020},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:20.611392Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:2b02bb18d1800679b51e22f7bf5288a80c18a339795c88025b7a4caeaa4bcba6","observation_id":"e837638a-4467-4c75-938c-0764cbcb7fb0","resolution":{"observed_at":"2026-08-05T13:55:27.700206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.09637","last_updated":"2022-03-17T22:24:38Z","snapshot_observed_at":"2026-08-05T13:40:53.290916Z","submitted_at":"2022-03-17T22:24:38Z","title":"Investigating Compounding Prediction Errors in Learned Dynamics Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.09637","snapshot_observed_at":"2026-08-05T13:55:20.657421Z","title":"Lambert, K","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:20.657421Z"},"links":{"cited_paper":"/paper/2203.09637","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:7e3851c0a7cdd27c275431c5918786d65c05de3a2275a4d58b0487c7f7716df8","observation_id":"007910d5-d377-45ff-b125-47e0a9faaa0b","resolution":{"observed_at":"2026-08-05T13:55:20.657421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:27.427055Z","title":null,"venue":null,"work_id":"08fa1bbc-8d55-4899-8c50-cdc2dfe04191","year":2019},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:20.719938Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:e6b606cd5ce325f2b8189800e0345db9c0873cef2d207a3d406568b892fd45ee","observation_id":"c5cd8388-5340-412a-bf02-9f5b526181f2","resolution":{"observed_at":"2026-08-05T13:55:27.504389Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:20.772539Z","title":"Schrittwieser, I","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:20.772539Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:16f907f476d4997370b11f943ab4301e93e9dd964e6512e19067cd9ecf09d361","observation_id":"eb95f4fa-4416-4aec-bdfd-096b046a796d","resolution":{"observed_at":"2026-08-05T13:55:20.772539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:27.284245Z","title":null,"venue":null,"work_id":"a71685bd-006a-4380-ac83-b55fbba44e9c","year":2024},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:20.849035Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:e669c37be5afba7d6375b0931e5e3a3d50ccebf9027a62328c2ebdea96140fce","observation_id":"48b72f37-3a7c-43fd-8998-4fdd8b32e43b","resolution":{"observed_at":"2026-08-05T13:55:27.340950Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10667","last_updated":"2025-01-03T08:57:39Z","snapshot_observed_at":"2026-08-08T17:29:47.555814Z","submitted_at":"2024-06-15T15:24:15Z","title":"UniZero: Generalized and Efficient Planning with Scalable Latent World Models","version":2},"cited_work":{"arxiv_id":"2406.10667","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.10667","snapshot_observed_at":"2026-08-05T13:55:24.440129Z","title":"UniZero: Generalized and Efficient Planning with Scalable Latent World Models","venue":"cs.LG","work_id":"158aa750-10e5-4173-86e5-11a62a4da277","year":2024},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:20.914951Z"},"links":{"cited_paper":"/paper/2406.10667","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:dd848c5e2f86fc5b7d107305cb2579cfcc6d689ad8b24735828d18c37b649fac","observation_id":"f09a4039-a23d-4f12-9bdf-03f905177890","resolution":{"observed_at":"2026-08-05T13:55:24.530354Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16364","last_updated":"2024-12-31T16:30:03Z","snapshot_observed_at":"2026-07-06T18:05:20.955471Z","submitted_at":"2024-04-25T07:02:07Z","title":"ReZero: Boosting MCTS-based Algorithms by Backward-view and Entire-buffer Reanalyze","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16364","snapshot_observed_at":"2026-08-05T13:55:20.963281Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:20.963281Z"},"links":{"cited_paper":"/paper/2404.16364","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:7121089645bd3018f663ad90dc773b52bf6197a43b010a48f121cc48dc5fc294","observation_id":"33eda848-f580-4a23-be44-dd39c67bca79","resolution":{"observed_at":"2026-08-05T13:55:20.963281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:27.155993Z","title":null,"venue":null,"work_id":"ae8bcf1d-7754-422e-83a0-4c0243269aa8","year":2018},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:21.011388Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:7732c313b870b635983c0af98f53b5d60d47ebfc7b6f8de3fa360008ad9ea50e","observation_id":"ca67929b-3229-4bde-b562-3446472dc767","resolution":{"observed_at":"2026-08-05T13:55:27.216495Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:26.990974Z","title":"Hafner, T","venue":null,"work_id":"cfafa36f-e9fc-4231-97fd-7e607475cc86","year":2019},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:21.034688Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:a5ce28c8a1a49ff4fa6032dec764e4106c062269cb6201fcb159931d3f6592f2","observation_id":"5854caef-c246-4d7e-aeaa-a1964421580b","resolution":{"observed_at":"2026-08-05T13:55:27.066006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.08649","last_updated":"2019-06-20T14:13:12Z","snapshot_observed_at":"2026-07-06T08:01:41.630447Z","submitted_at":"2019-06-20T14:13:12Z","title":"Exploring Model-based Planning with Policy Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.08649","snapshot_observed_at":"2026-08-05T13:55:21.082630Z","title":"Wang and J","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:21.082630Z"},"links":{"cited_paper":"/paper/1906.08649","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:9c0116d352507fc5dd0cdb69b96392f7fdcd28c0d8629ac41a55485a1818e900","observation_id":"618f9a04-ba18-4de4-a780-fcb3a6eae88e","resolution":{"observed_at":"2026-08-05T13:55:21.082630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:26.848690Z","title":"Hansen, X","venue":null,"work_id":"68effa0a-e15b-4f86-8ec9-2684b4910bc9","year":2022},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:21.146692Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:f223807ea718ba81cb218a482df1d1ea75b4722465e3077fd1d3aa51ef70ce7e","observation_id":"9345e8fe-78bd-4b18-b067-51077119d230","resolution":{"observed_at":"2026-08-05T13:55:26.909512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:26.690961Z","title":"Hansen, H","venue":null,"work_id":"a3ce0c2b-ba00-47f0-aff1-b31f8c828240","year":2024},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:21.222621Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:4a6d088de56366e5858ad31c315940bf94839cba6ae2f246cad25df8ac5c50f8","observation_id":"a04319b7-4beb-4db4-ae33-c4b1062efd0b","resolution":{"observed_at":"2026-08-05T13:55:26.761180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:26.545019Z","title":"Bechtle, Y","venue":null,"work_id":"769fd3d3-2b14-46ba-984e-e7021aeca6c5","year":2019},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:21.326593Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:87393007eaf39e22b6d86aa495a2dc94e1a71df84148a2c460a5b1b62c9bc8ed","observation_id":"afb86c3c-f0e5-4abb-bfb6-58ef709a9bdb","resolution":{"observed_at":"2026-08-05T13:55:26.620863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:26.406970Z","title":"Deisenroth and C","venue":null,"work_id":"3a360c1d-a015-40c4-93f7-f33f9372e49c","year":2011},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:21.446969Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:ba0f0d889c716a8b7e47a23685c776e220302d54267b4c4fde5f8996e48338dc","observation_id":"a19eca37-e076-4abb-975e-a6ba667d39bf","resolution":{"observed_at":"2026-08-05T13:55:26.477989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:26.299199Z","title":"Levine and P","venue":null,"work_id":"c109f6a2-2c44-4dfe-b381-969718c16477","year":2014},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:21.602331Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:cc76114d643abbf7e0a41cbda30b0fab94b507a0aeb76c2fa9e1c51e65c28604","observation_id":"19bc6f9c-360e-40d9-a60f-46f00c766238","resolution":{"observed_at":"2026-08-05T13:55:26.359309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:26.171434Z","title":"Heess, G","venue":null,"work_id":"a1d5deae-92a6-41f2-9696-22e3fbb6e1c5","year":2015},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:21.687117Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:c3ab78ad6ed9cecd16f564ad748006fc456316f31fe7acd219fafe7847340bf6","observation_id":"4fb9c2ef-59ea-4c27-98aa-db6ab5d36c70","resolution":{"observed_at":"2026-08-05T13:55:26.236977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14864","last_updated":"2024-10-15T13:30:26Z","snapshot_observed_at":"2026-07-06T17:48:45.803098Z","submitted_at":"2024-03-21T22:18:59Z","title":"Learning Quadruped Locomotion Using Differentiable Simulation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14864","snapshot_observed_at":"2026-08-05T13:55:21.827834Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:21.827834Z"},"links":{"cited_paper":"/paper/2403.14864","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:e494526632e3511375e759b8d000b85096b25cdb12e969887c3716bea338fec0","observation_id":"69f9f701-fd97-43b0-bfc0-b04472cf1748","resolution":{"observed_at":"2026-08-05T13:55:21.827834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:26.000673Z","title":"Georgiev, K","venue":null,"work_id":"47de7253-c0a8-4eab-8e65-fb3a709ec1be","year":2024},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:21.921291Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:e0ef2a5bfef1e9fcf432d84c46baa4ab83c8a41a798dec4bf4d807188d9bd32f","observation_id":"8ec9fbc0-b9a5-4d33-a03e-bd284773b3b8","resolution":{"observed_at":"2026-08-05T13:55:26.073168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02189","last_updated":"2024-11-04T15:43:57Z","snapshot_observed_at":"2026-07-06T19:44:51.287226Z","submitted_at":"2024-11-04T15:43:57Z","title":"DiffSim2Real: Deploying Quadrupedal Locomotion Policies Purely Trained in Differentiable Simulation","version":1},"cited_work":{"arxiv_id":"2411.02189","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.02189","snapshot_observed_at":"2026-08-05T13:55:24.209502Z","title":"DiffSim2Real: Deploying Quadrupedal Locomotion Policies Purely Trained in Differentiable Simulation","venue":"cs.RO","work_id":"c2df7fd7-a4d8-4a24-aef1-9b8e070cefe8","year":2024},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:22.052102Z"},"links":{"cited_paper":"/paper/2411.02189","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:dc8260d4b5f0af810e6f08f02229e7aa0940141ead1e23594b03aa0b046693a6","observation_id":"69944340-2a28-4ecd-aab6-e4f18dba6519","resolution":{"observed_at":"2026-08-05T13:55:24.296962Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.05803","last_updated":"2022-01-21T02:07:54Z","snapshot_observed_at":"2026-08-08T19:00:30.082098Z","submitted_at":"2021-11-10T16:51:04Z","title":"Gradients are Not All You Need","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.05803","snapshot_observed_at":"2026-08-05T13:55:22.186464Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:22.186464Z"},"links":{"cited_paper":"/paper/2111.05803","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:1c79b5bfe94937ce5f8f115211087d78848ad67df2907e2f3bd315ae86d09feb","observation_id":"10e7b0e1-f90f-467e-9124-2eb1428c5f1b","resolution":{"observed_at":"2026-08-05T13:55:22.186464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:25.809909Z","title":null,"venue":null,"work_id":"6df7a3c1-adef-41e5-8729-760b26cddad6","year":2022},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:22.326714Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:e7cacbcab4e2f7240315a5763f0895f869c80e2350635df7a5fa7f45087bcd2c","observation_id":"2fd7649c-ea9f-4e03-9337-52188382dcfd","resolution":{"observed_at":"2026-08-05T13:55:25.891938Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.11884","last_updated":"2022-06-23T17:50:44Z","snapshot_observed_at":"2026-07-06T13:24:06.368922Z","submitted_at":"2022-06-23T17:50:44Z","title":"Augmenting differentiable physics with randomized smoothing","version":1},"cited_work":{"arxiv_id":"2206.11884","doi":null,"metadata_source":"pith","pith_arxiv_id":"2206.11884","snapshot_observed_at":"2026-08-05T13:55:24.005506Z","title":"Augmenting differentiable physics with randomized smoothing","venue":"cs.RO","work_id":"18fe7038-a5b5-4be3-b214-d5f8bcff182e","year":2022},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:22.463349Z"},"links":{"cited_paper":"/paper/2206.11884","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:c8a562aad6c9ce340a073fd6c25db86f5e033ce820784adc3933609a87f4ff92","observation_id":"6e203c8c-8dad-4ae0-bdc4-b65deea432e9","resolution":{"observed_at":"2026-08-05T13:55:24.086776Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-05T13:55:22.606247Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:22.606247Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:5660f4beb7ed939915134cf070e697abd7338a218434f8fac890ec65dcea94df","observation_id":"10c7cd55-80b2-4d48-9853-877010cacfb2","resolution":{"observed_at":"2026-08-05T13:55:22.606247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:25.643749Z","title":"Paszke, S","venue":null,"work_id":"7128d5e2-9885-4420-b52c-1ff19d0d0ffc","year":null},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:22.744349Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:fb80f960ae93e36e13f3d5ea3b8cf2b52c142ad564e25f8d3ad37b0087b9d802","observation_id":"1957ea35-044c-472f-acbd-b62b0fa20775","resolution":{"observed_at":"2026-08-05T13:55:25.733391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2410.08650","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:23.782680Z","title":"Duclusaud, G","venue":null,"work_id":"9d67ecb6-8b72-430e-99ef-4de588c7d938","year":2025},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:23.079785Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:8ae8cea8364dd3c24efbddc920ee584e9264310d4d0e081bea6569c0a1ed2652","observation_id":"9942d48c-07fa-41c4-b0a8-e9a3041fed5b","resolution":{"observed_at":"2026-08-05T13:55:23.887502Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:25.280512Z","title":null,"venue":null,"work_id":"fd68eb93-006d-485a-88dd-670d48f24675","year":2023},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:23.181297Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:c681a806454111e7e9c311bbe894364c7a15ea986885b099e4ccf56532123cfd","observation_id":"f9651942-70a5-4e1b-ba48-6e84b824f66f","resolution":{"observed_at":"2026-08-05T13:55:25.351188Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:25.057210Z","title":null,"venue":null,"work_id":"c03d53b4-989b-4ed1-99c3-4b73e2c758df","year":2024},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:23.352759Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:598f71b304d778591202ef9d9cab0a771995766a195b154dc1a34412ef50ee17","observation_id":"4e0aeab4-a41f-4fc1-ac77-351718ba7e13","resolution":{"observed_at":"2026-08-05T13:55:25.138132Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03046","last_updated":"2024-02-05T14:32:00Z","snapshot_observed_at":"2026-08-10T00:58:27.575137Z","submitted_at":"2024-02-05T14:32:00Z","title":"Open RL Benchmark: Comprehensive Tracked Experiments for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03046","snapshot_observed_at":"2026-08-05T13:55:23.510044Z","title":"0.2 0 −1.0 # (yaw-rotated world vector) – vf = RW B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:23.510044Z"},"links":{"cited_paper":"/paper/2402.03046","citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:c03c505c765f25f401b3ad53ad6f3b1f4765ce3516fc349785116c7ec3e541c9","observation_id":"f6dc4ca7-1866-4e94-b1f1-b848c7e4dc22","resolution":{"observed_at":"2026-08-05T13:55:23.510044Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:25.459390Z","title":null,"venue":null,"work_id":"10d2e23e-f1e5-49a6-b5dc-80895e12b41e","year":2019},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:22.906934Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:4c64bd3b075909a661c68a423a12aef8a6a7a0031a3e8a6fdfaba1b757a1bfca","observation_id":"b205752e-8567-49b5-a0b8-00d1ff2db7c3","resolution":{"observed_at":"2026-08-05T13:55:25.555373Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:19.009204Z","title":"doi:10.1109/IROS.2012.6386109","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation","version":2},"reference_index":5033,"source":"pdf_text","source_observed_at":"2026-08-05T13:55:19.009204Z"},"links":{"citing_paper":"/paper/2509.00215"},"observation_digest":"sha256:204d5ef44791b00d5d5ca52c3d075f4086383614fa000ca1243afeabd8ac6da5","observation_id":"90afc736-2faf-4d71-af1d-5b6579ec4709","resolution":{"observed_at":"2026-08-05T13:55:19.009204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.00215","last_updated":"2025-09-04T12:46:04Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-09T03:03:08.231230Z","submitted_at":"2025-08-29T19:55:25Z","title":"First Order Model-Based RL through Decoupled Backpropagation"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":5,"verified_fuzzy":23},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 0 inbound Pith citation observations for arXiv:2509.00215."}