{"as_of":"2026-08-13T05:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9bdb7daa14f8908156f4d7871134e014ed1de5530b7b41a830a049388306a315","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-19T13:50:42.091642Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.19054/citation-record","integrity":"/paper/2505.19054/integrity","json":"/paper/2505.19054/citation-record.json","paper":"/paper/2505.19054"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7c92249c-46a3-467d-b384-8bf5cf1b68ab","year":2015},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:f8dbd29ebb62bb132ee5c03c2bef08baa50c80b1a9b0f7a0f3394ab70b68eb79","observation_id":"55344bec-6a96-43ff-a4e4-f44fc07d2a7f","resolution":{"observed_at":"2026-05-19T13:52:20.290963Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"1889-1897","venue":null,"work_id":"9389f913-080e-48cc-b5c4-d1308904c9bc","year":2015},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:a4046748e670958ad51d1fbaaaae4b7d4817567ecae3a23a3448797e84429fda","observation_id":"b6513092-1d96-4e77-bb30-43132cda5277","resolution":{"observed_at":"2026-05-19T13:52:20.300952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"747f5b30-3c8a-4fb6-8447-6eed1a900085","year":2016},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:936cf6a30d03babc32e759c136c7c0b4f3c6874aea3f3abce58b486069888441","observation_id":"b35a1235-6277-469d-bf9a-50818136defc","resolution":{"observed_at":"2026-05-19T13:52:20.295666Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"1861-1870","venue":null,"work_id":"e3a460e0-8410-4777-b6ea-0f6d175cbbc8","year":2018},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:f87c33dc6c9fb8be6ffcc18365c7129919eae08ff9ea3bd49a637d1e9c5566bd","observation_id":"60ae0425-41f3-4057-b218-76d458be3cd1","resolution":{"observed_at":"2026-05-19T13:52:20.288641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ddb8973a-c499-47ba-b72e-a919b2b34e4f","year":2017},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:0965021437d198dfe135a0c12708610224e80edd1a6934d6dd8cc9dce44b7085","observation_id":"83578248-09de-43ff-bc08-e8314399a6aa","resolution":{"observed_at":"2026-05-19T13:52:20.286043Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f74dbb78-f50d-428c-bfb4-62f1bfbd72d2","year":2016},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:93f10de42f8f689ebda382e0b5f5ebe40b2ef2e6f8a32c4d6f1916e8f1f433d2","observation_id":"15b43c41-1e60-4c5b-a852-f1e56d80819a","resolution":{"observed_at":"2026-05-19T13:52:20.324168Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"067acb27-d8f2-4e8e-bbfb-d6dbf550cc14","year":2018},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:3dd2856cb2f70fb794c92b90a0c59593e52a1524000e2b08b6f5434b1750dbe5","observation_id":"c0628d36-f101-45b4-b998-9291eaea52c4","resolution":{"observed_at":"2026-05-19T13:52:20.326703Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5ce3e44e-6439-4141-abb2-fe88e8e18b29","year":2022},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:0691be7c5fb52a40259794f1246f53dc0ea6b2ea55da5362111410bdfa180154","observation_id":"2bc58868-833b-4cc8-ac5b-d90b259b47c8","resolution":{"observed_at":"2026-05-19T13:52:20.303800Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0e61e065-329f-4b0d-90c1-657cb5127093","year":2022},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:17876c6267291893fbe10acba75c509294ce6113a86e0e657d6f98d5ee53234b","observation_id":"0d5c7311-39db-48ee-bec9-a868f09e10e0","resolution":{"observed_at":"2026-05-19T13:52:20.319197Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.04034","last_updated":"2021-07-08T17:59:59Z","snapshot_observed_at":"2026-08-11T14:16:10.135768Z","submitted_at":"2021-07-08T17:59:59Z","title":"RMA: Rapid Motor Adaptation for Legged Robots","version":1},"cited_work":{"arxiv_id":"2107.04034","doi":"10.48550/arxiv.2107.04034","metadata_source":"pith","pith_arxiv_id":"2107.04034","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RMA: Rapid Motor Adaptation for Legged Robots","venue":"cs.LG","work_id":"19c12f20-64f0-4a6d-b8c0-c4528f0a22e2","year":2021},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"cited_paper":"/paper/2107.04034","citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:51394f4b68dc87cd4341f0e9a83a38e7cb349c430879770389c21f31641a9703","observation_id":"5b6676e2-c9ff-42a7-93e7-644db5374122","resolution":{"observed_at":"2026-05-19T13:52:19.860921Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:49.116991+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:49.116991+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.08328","last_updated":"2021-05-18T07:49:15Z","snapshot_observed_at":"2026-08-13T01:19:49.430780Z","submitted_at":"2021-05-18T07:49:15Z","title":"Blind Bipedal Stair Traversal via Sim-to-Real Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2105.08328","doi":null,"metadata_source":"pith","pith_arxiv_id":"2105.08328","snapshot_observed_at":"2026-07-10T17:17:25.649508Z","title":"//arxiv.org/abs/2105.08328","venue":"cs.RO","work_id":"44d2e363-20b6-4cf7-bb83-e749d20defe5","year":2021},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"cited_paper":"/paper/2105.08328","citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:91995034ac90d9ce0e1a290cbf8143f8b69e574ff73bbab4350090a3f34468b1","observation_id":"308649c4-7701-45a1-9d9a-53abd625105b","resolution":{"observed_at":"2026-05-19T13:52:19.853610Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"46, 2008, pp 265-271","venue":null,"work_id":"af19bc7e-307f-4d95-b1d6-a62b1820aa9f","year":2008},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:7f12e757e47a9ce8ba57bfca0c38ebd50df23440051ef775307d979fae3c8d81","observation_id":"81b7dc85-f269-4da6-9f2e-a48822c4a872","resolution":{"observed_at":"2026-05-19T13:52:20.329112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"21","venue":null,"work_id":"5bf9d557-6565-4b46-a367-f8d14f668c7e","year":2008},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:2e0b506c2c9c64ca97acd1e79bb1ff2514637891374ae4aac61ee531844e8bfa","observation_id":"456ab353-0c74-4167-9360-ba8c98673a50","resolution":{"observed_at":"2026-05-19T13:52:20.331455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1a178360-f54c-47c0-9634-a3862c286599","year":2020},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:a3a73fcbf6da36a6cc639c3a4989118bfc1ae89125f2d3636ea9febdc28abf09","observation_id":"3c8b006f-04ff-4f1c-b838-7822b20a58ad","resolution":{"observed_at":"2026-05-19T13:52:20.308931Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:4734c2ccf020a9db3773a236b64af3b71f26f531ac59021c5e2c41ef6592ae6e","observation_id":"76f32a22-55cd-45b0-b2fc-1bc12023387c","resolution":{"observed_at":"2026-05-19T13:52:19.865256Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.04831","last_updated":"2025-11-06T21:43:02Z","snapshot_observed_at":"2026-08-07T13:59:26.312342Z","submitted_at":"2025-11-06T21:43:02Z","title":"Isaac Lab: A GPU-Accelerated Simulation Framework for Multi-Modal Robot Learning","version":1},"cited_work":{"arxiv_id":"2511.04831","doi":"10.48550/arxiv.2511.04831","metadata_source":"pith","pith_arxiv_id":"2511.04831","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Isaac Lab: A GPU-Accelerated Simulation Framework for Multi-Modal Robot Learning","venue":"cs.RO","work_id":"59a1bdfa-635f-4266-a860-c30157fa91f2","year":2025},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"cited_paper":"/paper/2511.04831","citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:6a3fe2cfa031fb4980be40fecb4043c16f850574120f395f288033599bc3143e","observation_id":"35b99efa-b75c-4e7a-9405-e40a0cc0c287","resolution":{"observed_at":"2026-05-19T13:52:19.869636Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-06-01T21:25:57.098968+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T21:25:57.098968+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-08-12T21:29:36.308819Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":"1506.02438","doi":"10.48550/arxiv.1506.02438","metadata_source":"pith","pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","venue":"cs.LG","work_id":"38e3ca94-96f0-4b19-a355-0754931af8be","year":2015},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:5d998c9542774ec82444fff735db5e859bc98a9f9096cac0c917612d70fcb9fe","observation_id":"03c6d283-1aa8-4f62-a89d-b4a258d62429","resolution":{"observed_at":"2026-05-19T13:52:19.848012Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8d6fae50-d43b-42b8-a1ad-8cdf63932e38","year":2017},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:3b546c1a54d84717f34c8ba1abf8f1e774790faced9b78e59279b0fb553d028d","observation_id":"a3390950-101d-4830-87f2-7da1be86c979","resolution":{"observed_at":"2026-05-19T13:52:20.321876Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"56d7e26f-5df1-4d94-9998-3fb8d2ba6a74","year":2006},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:bf12666504e9a2472b162ec88219d5aa9db91fac8e646e8a0482134fd1a30c3d","observation_id":"7973f8e0-1565-4793-af2d-96127b4d7fa8","resolution":{"observed_at":"2026-05-19T13:52:20.317020Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"872f0d10-8e77-4fda-9689-2e2fb3c41cd2","year":2021},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:f95d356b49a9cd592a395b4f1fe094ee50cc73ce62a24dff13439408eb1b886d","observation_id":"7924e550-1b45-4498-96d9-be1a596ad8ec","resolution":{"observed_at":"2026-05-19T13:52:20.312113Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f0e6d891-da4d-4900-885f-a69f5154a26b","year":2019},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:d63355fad049b3e7b7d37825d90144bdcd14c84985a2adfd8959a0d6c793279b","observation_id":"1d9d7b39-90de-4592-aa44-9cd04a01cbf5","resolution":{"observed_at":"2026-05-19T13:52:20.314713Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2934a86b-aad9-492e-830b-75f360c11452","year":2020},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:daee7095834017e3dfee5e228efa24ebcac89d0628bb9598b47bfca77887ba08","observation_id":"76367036-1c3b-411d-b406-cb6b50f0cb1e","resolution":{"observed_at":"2026-05-19T13:52:20.293490Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9422e0ee-54c2-4f72-b0c0-931c450fa853","year":2022},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:2bd2e4a5ec3342671e3184a50b252e604292678e4ca6409bdd79549e9032c9df","observation_id":"1014af90-6d43-45ed-9f0f-79021f000033","resolution":{"observed_at":"2026-05-19T13:52:20.298076Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"92b41a53-dfc9-4f9e-93e2-c4c1ddc42cef","year":2024},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:cd6995de4146068956fe0a29937ff3d6cc4e76d86a81a4e506cd15c1cde15e77","observation_id":"e3eff874-ee67-4213-b251-0276d2d2a56c","resolution":{"observed_at":"2026-05-19T13:52:20.306068Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10771","last_updated":"2025-09-13T01:31:43Z","snapshot_observed_at":"2026-08-08T00:00:46.147149Z","submitted_at":"2025-09-13T01:31:43Z","title":"RSL-RL: A Learning Library for Robotics Research","version":1},"cited_work":{"arxiv_id":"2509.10771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10771","snapshot_observed_at":"2026-07-04T19:40:06.222586Z","title":"Schwarke, M","venue":null,"work_id":"715d23f4-4767-4719-956d-ce4e005f53c5","year":2025},"citing_paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-19T13:50:42.091642Z"},"links":{"cited_paper":"/paper/2509.10771","citing_paper":"/paper/2505.19054"},"observation_digest":"sha256:99ebea97ae2a6e036af354cc167ef8e56adabe159475c1851264d715e3d9aac7","observation_id":"f5578e8b-4e33-4e1a-8997-c08afc1f36da","resolution":{"observed_at":"2026-05-19T13:52:19.873923Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.19054","last_updated":"2026-04-15T00:15:10Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T21:30:04.828669Z","submitted_at":"2025-05-25T09:17:22Z","title":"RANDPOL: Parameter-Efficient End-to-End Quadruped Locomotion via Randomized Policy Learning"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":6,"verified_fuzzy":4},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2505.19054."}