{"as_of":"2026-08-23T15:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:39ea6f30a3b7a5e556ff6f46bb6c74668efd9144d4c8be6914db4efa468cba03","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T14:20:33.205947Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.21525/citation-record","integrity":"/paper/2606.21525/integrity","json":"/paper/2606.21525/citation-record.json","paper":"/paper/2606.21525"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2606.21525","last_updated":"2026-06-19T15:22:51Z","snapshot_observed_at":"2026-08-21T16:39:25.340216Z","submitted_at":"2026-06-19T15:22:51Z","title":"Backpropagating Through Simulation: Analytic Policy Gradients for Sample and Learning Efficient Differentiable Continuous Control","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T14:20:33.205947Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2606.21525"},"observation_digest":"sha256:bbdf12a2181f43d0bf2102450ee6ddf69b40eaa244c33fade8ab64675b353f82","observation_id":"907a6b65-1e2a-4917-87dd-5b6e12bb034e","resolution":{"observed_at":"2026-07-04T06:39:37.282473Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T14:20:33.205947Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.21525","last_updated":"2026-06-19T15:22:51Z","snapshot_observed_at":"2026-08-21T16:39:25.340216Z","submitted_at":"2026-06-19T15:22:51Z","title":"Backpropagating Through Simulation: Analytic Policy Gradients for Sample and Learning Efficient Differentiable Continuous Control","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T14:20:33.205947Z"},"links":{"citing_paper":"/paper/2606.21525"},"observation_digest":"sha256:058ce133aa0847499d59b3c5c65c741a5f59981a3e2992893ac8bd38c93d6cd8","observation_id":"3bd1908d-6a3b-4fb6-8d54-893da4107e23","resolution":{"observed_at":"2026-06-26T14:20:33.205947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T14:20:33.205947Z","title":null,"venue":null,"work_id":null,"year":1990},"citing_paper":{"arxiv_id":"2606.21525","last_updated":"2026-06-19T15:22:51Z","snapshot_observed_at":"2026-08-21T16:39:25.340216Z","submitted_at":"2026-06-19T15:22:51Z","title":"Backpropagating Through Simulation: Analytic Policy Gradients for Sample and Learning Efficient Differentiable Continuous Control","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T14:20:33.205947Z"},"links":{"citing_paper":"/paper/2606.21525"},"observation_digest":"sha256:62b6207e884cf8c64b814f7e01d8b0af3fb7a081627b7ecad6f784f4ef8fcf91","observation_id":"6aac06a4-2c89-4693-b4eb-6c986fa1e46a","resolution":{"observed_at":"2026-06-26T14:20:33.205947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14457","last_updated":"2023-06-05T15:59:41Z","snapshot_observed_at":"2026-08-21T16:39:06.732473Z","submitted_at":"2023-04-27T18:32:07Z","title":"Chromatic Homotopy is Monoidally Algebraic at Large Primes","version":2},"cited_work":{"arxiv_id":"2304.14457","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.14457","snapshot_observed_at":"2026-07-04T06:39:37.274736Z","title":null,"venue":null,"work_id":"ad028d28-92bc-4b03-9a0d-565b916fab08","year":2023},"citing_paper":{"arxiv_id":"2606.21525","last_updated":"2026-06-19T15:22:51Z","snapshot_observed_at":"2026-08-21T16:39:25.340216Z","submitted_at":"2026-06-19T15:22:51Z","title":"Backpropagating Through Simulation: Analytic Policy Gradients for Sample and Learning Efficient Differentiable Continuous Control","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T14:20:33.205947Z"},"links":{"cited_paper":"/paper/2304.14457","citing_paper":"/paper/2606.21525"},"observation_digest":"sha256:20d19dc7c74049f3d2ec745db1a7ba8450907cb70cd529ddeb7997813d5c5c5a","observation_id":"d0e11fee-f720-4452-9eff-554aaa3f67b8","resolution":{"observed_at":"2026-07-04T06:39:37.276279Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T14:20:33.205947Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.21525","last_updated":"2026-06-19T15:22:51Z","snapshot_observed_at":"2026-08-21T16:39:25.340216Z","submitted_at":"2026-06-19T15:22:51Z","title":"Backpropagating Through Simulation: Analytic Policy Gradients for Sample and Learning Efficient Differentiable Continuous Control","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T14:20:33.205947Z"},"links":{"citing_paper":"/paper/2606.21525"},"observation_digest":"sha256:edf3f23d024b31def3377a6162fbafed99ce6c543fc80c7215f6e2821f5d7c65","observation_id":"40a4f155-aa69-4973-be21-05867c9145f5","resolution":{"observed_at":"2026-06-26T14:20:33.205947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":"2301.04104","doi":"10.1126/sciadv.adu2488","metadata_source":"pith","pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mastering Diverse Domains through World Models","venue":"cs.AI","work_id":"6aeb260f-8c7c-4f9c-b98b-067cd7c59acd","year":2023},"citing_paper":{"arxiv_id":"2606.21525","last_updated":"2026-06-19T15:22:51Z","snapshot_observed_at":"2026-08-21T16:39:25.340216Z","submitted_at":"2026-06-19T15:22:51Z","title":"Backpropagating Through Simulation: Analytic Policy Gradients for Sample and Learning Efficient Differentiable Continuous Control","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T14:20:33.205947Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2606.21525"},"observation_digest":"sha256:9ff32df4bf38cf1f2a7c8cb6bdc70dd0fd1b05d9310765be57389a7e4d43f868","observation_id":"7e62e20a-211c-4e75-9fa7-1ca41c85729e","resolution":{"observed_at":"2026-07-04T06:39:37.285158Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T14:20:33.205947Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.21525","last_updated":"2026-06-19T15:22:51Z","snapshot_observed_at":"2026-08-21T16:39:25.340216Z","submitted_at":"2026-06-19T15:22:51Z","title":"Backpropagating Through Simulation: Analytic Policy Gradients for Sample and Learning Efficient Differentiable Continuous Control","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T14:20:33.205947Z"},"links":{"citing_paper":"/paper/2606.21525"},"observation_digest":"sha256:b54f45a3eb0d09f055f7274013fa242d9d897173dec938b721d24ce5d21034c8","observation_id":"8b42bcb1-6afb-4a4d-a4f4-b594c48e04d4","resolution":{"observed_at":"2026-06-26T14:20:33.205947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T14:20:33.205947Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2606.21525","last_updated":"2026-06-19T15:22:51Z","snapshot_observed_at":"2026-08-21T16:39:25.340216Z","submitted_at":"2026-06-19T15:22:51Z","title":"Backpropagating Through Simulation: Analytic Policy Gradients for Sample and Learning Efficient Differentiable Continuous Control","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T14:20:33.205947Z"},"links":{"citing_paper":"/paper/2606.21525"},"observation_digest":"sha256:ca639485c0fdc9cd06bd5dfd96baf0bf6a7b9ece3c77007d29444816e4609e5a","observation_id":"0716d78f-a2fc-487d-bdd5-dff5cb1565b5","resolution":{"observed_at":"2026-06-26T14:20:33.205947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T14:20:33.205947Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.21525","last_updated":"2026-06-19T15:22:51Z","snapshot_observed_at":"2026-08-21T16:39:25.340216Z","submitted_at":"2026-06-19T15:22:51Z","title":"Backpropagating Through Simulation: Analytic Policy Gradients for Sample and Learning Efficient Differentiable Continuous Control","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T14:20:33.205947Z"},"links":{"citing_paper":"/paper/2606.21525"},"observation_digest":"sha256:1982a853d15778eda397adcc2aca850e0331b20a2c0e1c60144c37620e5e976c","observation_id":"17f0a133-4017-4535-846d-4ec7557601a9","resolution":{"observed_at":"2026-06-26T14:20:33.205947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T14:20:33.205947Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.21525","last_updated":"2026-06-19T15:22:51Z","snapshot_observed_at":"2026-08-21T16:39:25.340216Z","submitted_at":"2026-06-19T15:22:51Z","title":"Backpropagating Through Simulation: Analytic Policy Gradients for Sample and Learning Efficient Differentiable Continuous Control","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T14:20:33.205947Z"},"links":{"citing_paper":"/paper/2606.21525"},"observation_digest":"sha256:cd1a82b0a0375491a29e6a6aacac2f6aef52773cc5a2e472ef519e26468ce6a5","observation_id":"8afa6b05-c228-4145-8464-d65a60a72b13","resolution":{"observed_at":"2026-06-26T14:20:33.205947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T14:20:33.205947Z","title":"J., Simchowitz, M., Zhang, K., & Tedrake, R","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.21525","last_updated":"2026-06-19T15:22:51Z","snapshot_observed_at":"2026-08-21T16:39:25.340216Z","submitted_at":"2026-06-19T15:22:51Z","title":"Backpropagating Through Simulation: Analytic Policy Gradients for Sample and Learning Efficient Differentiable Continuous Control","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T14:20:33.205947Z"},"links":{"citing_paper":"/paper/2606.21525"},"observation_digest":"sha256:a54505fc3494565e26fc95e99c0a1a0d3a87c58c393e230a0fe51cc5a2841584","observation_id":"c5b64a82-a0d9-46d0-af05-f22cbdd51824","resolution":{"observed_at":"2026-06-26T14:20:33.205947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T14:20:33.205947Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.21525","last_updated":"2026-06-19T15:22:51Z","snapshot_observed_at":"2026-08-21T16:39:25.340216Z","submitted_at":"2026-06-19T15:22:51Z","title":"Backpropagating Through Simulation: Analytic Policy Gradients for Sample and Learning Efficient Differentiable Continuous Control","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T14:20:33.205947Z"},"links":{"citing_paper":"/paper/2606.21525"},"observation_digest":"sha256:2b65cb89b188c0b20593269f05f759fddda587791755594bd6b7dcca6e2c0b1f","observation_id":"7fe45bd8-c761-4246-8086-020d8749d0c6","resolution":{"observed_at":"2026-06-26T14:20:33.205947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T14:20:33.205947Z","title":null,"venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2606.21525","last_updated":"2026-06-19T15:22:51Z","snapshot_observed_at":"2026-08-21T16:39:25.340216Z","submitted_at":"2026-06-19T15:22:51Z","title":"Backpropagating Through Simulation: Analytic Policy Gradients for Sample and Learning Efficient Differentiable Continuous Control","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-26T14:20:33.205947Z"},"links":{"citing_paper":"/paper/2606.21525"},"observation_digest":"sha256:9cda006915a2e20c997cf0508a138bc8653f498b0059544dbccbc9de5c6ba9b3","observation_id":"6bdc747e-037e-4e9a-bea3-674d58df19d8","resolution":{"observed_at":"2026-06-26T14:20:33.205947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T14:20:33.205947Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.21525","last_updated":"2026-06-19T15:22:51Z","snapshot_observed_at":"2026-08-21T16:39:25.340216Z","submitted_at":"2026-06-19T15:22:51Z","title":"Backpropagating Through Simulation: Analytic Policy Gradients for Sample and Learning Efficient Differentiable Continuous Control","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T14:20:33.205947Z"},"links":{"citing_paper":"/paper/2606.21525"},"observation_digest":"sha256:98efdcd4dca1ffc960d5b582ec64775929df6287e975f7855ae01b95dbb6b738","observation_id":"79abbb9f-f16b-4ef1-9bfe-7cafb58d8abe","resolution":{"observed_at":"2026-06-26T14:20:33.205947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T14:20:33.205947Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2606.21525","last_updated":"2026-06-19T15:22:51Z","snapshot_observed_at":"2026-08-21T16:39:25.340216Z","submitted_at":"2026-06-19T15:22:51Z","title":"Backpropagating Through Simulation: Analytic Policy Gradients for Sample and Learning Efficient Differentiable Continuous Control","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T14:20:33.205947Z"},"links":{"citing_paper":"/paper/2606.21525"},"observation_digest":"sha256:90f21b7d051dc3461dd6cff9700612ad8ea3409941aaf1d3f6bb18117a832ab9","observation_id":"c55b6024-98e8-43ac-bea1-6e4cc3da0ef0","resolution":{"observed_at":"2026-06-26T14:20:33.205947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T14:20:33.205947Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.21525","last_updated":"2026-06-19T15:22:51Z","snapshot_observed_at":"2026-08-21T16:39:25.340216Z","submitted_at":"2026-06-19T15:22:51Z","title":"Backpropagating Through Simulation: Analytic Policy Gradients for Sample and Learning Efficient Differentiable Continuous Control","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T14:20:33.205947Z"},"links":{"citing_paper":"/paper/2606.21525"},"observation_digest":"sha256:bc9069be8a943f5012b7ab767474c050957cd5409ee033bb9b0bfd7c4e3b6599","observation_id":"d9d3403b-ad82-42a1-b026-beb52232302a","resolution":{"observed_at":"2026-06-26T14:20:33.205947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13281","last_updated":"2021-06-24T19:09:12Z","snapshot_observed_at":"2026-08-16T18:14:40.079779Z","submitted_at":"2021-06-24T19:09:12Z","title":"Brax -- A Differentiable Physics Engine for Large Scale Rigid Body Simulation","version":1},"cited_work":{"arxiv_id":"2106.13281","doi":"10.48550/arxiv.2106.13281","metadata_source":"pith","pith_arxiv_id":"2106.13281","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brax–a differentiable physics engine for large scale rigid body simulation","venue":"cs.RO","work_id":"0ec42bc1-d52a-4486-a223-298fabbf8504","year":2021},"citing_paper":{"arxiv_id":"2606.21525","last_updated":"2026-06-19T15:22:51Z","snapshot_observed_at":"2026-08-21T16:39:25.340216Z","submitted_at":"2026-06-19T15:22:51Z","title":"Backpropagating Through Simulation: Analytic Policy Gradients for Sample and Learning Efficient Differentiable Continuous Control","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-26T14:20:33.205947Z"},"links":{"cited_paper":"/paper/2106.13281","citing_paper":"/paper/2606.21525"},"observation_digest":"sha256:852b063830e7b6508570371195b17ae01e2c1788d4031182de474be998af3b4e","observation_id":"0f2d1c84-56fc-49c7-95fe-7351fec531cd","resolution":{"observed_at":"2026-07-04T06:39:37.279781Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-03T14:38:10.488566+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T14:38:10.488566+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T14:20:33.205947Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2606.21525","last_updated":"2026-06-19T15:22:51Z","snapshot_observed_at":"2026-08-21T16:39:25.340216Z","submitted_at":"2026-06-19T15:22:51Z","title":"Backpropagating Through Simulation: Analytic Policy Gradients for Sample and Learning Efficient Differentiable Continuous Control","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T14:20:33.205947Z"},"links":{"citing_paper":"/paper/2606.21525"},"observation_digest":"sha256:a49dd72c811a074bf18feef51b9119b7d1726cc10a7d56558b7cda08c15646e6","observation_id":"9021b7a3-0341-49ab-b3ba-3f2ccc169d93","resolution":{"observed_at":"2026-06-26T14:20:33.205947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T14:20:33.205947Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.21525","last_updated":"2026-06-19T15:22:51Z","snapshot_observed_at":"2026-08-21T16:39:25.340216Z","submitted_at":"2026-06-19T15:22:51Z","title":"Backpropagating Through Simulation: Analytic Policy Gradients for Sample and Learning Efficient Differentiable Continuous Control","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T14:20:33.205947Z"},"links":{"citing_paper":"/paper/2606.21525"},"observation_digest":"sha256:64bdd76d0499c1d5846fb1c8d0b096671a59e877a728f0df844b55863f059f07","observation_id":"cc9684c6-0431-4f77-8f43-d47e55c01e80","resolution":{"observed_at":"2026-06-26T14:20:33.205947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T14:20:33.205947Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.21525","last_updated":"2026-06-19T15:22:51Z","snapshot_observed_at":"2026-08-21T16:39:25.340216Z","submitted_at":"2026-06-19T15:22:51Z","title":"Backpropagating Through Simulation: Analytic Policy Gradients for Sample and Learning Efficient Differentiable Continuous Control","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T14:20:33.205947Z"},"links":{"citing_paper":"/paper/2606.21525"},"observation_digest":"sha256:8358d36c4f4304b9f502a58d74910b27d16ccc1255bdfd3037292519383bf217","observation_id":"92c0baed-3895-43a3-9ce5-ee5872f0ffe7","resolution":{"observed_at":"2026-06-26T14:20:33.205947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.21525","last_updated":"2026-06-19T15:22:51Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-21T16:39:25.340216Z","submitted_at":"2026-06-19T15:22:51Z","title":"Backpropagating Through Simulation: Analytic Policy Gradients for Sample and Learning Efficient Differentiable Continuous Control"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":16,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 0 inbound Pith citation observations for arXiv:2606.21525."}