{"as_of":"2026-08-21T17:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:51e0e7e1c41d2cc3f8bfb232ce1b868e004c91f7abf38b9fa88e5ac553e70fe1","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:11:10.930242Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.18883/citation-record","integrity":"/paper/2507.18883/integrity","json":"/paper/2507.18883/citation-record.json","paper":"/paper/2507.18883"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:11:11.414013Z","title":"Cipriano, P","venue":null,"work_id":"3a5ab8d4-74b1-4e99-a52b-940d6599cd27","year":2023},"citing_paper":{"arxiv_id":"2507.18883","last_updated":"2025-07-25T01:51:12Z","snapshot_observed_at":"2026-08-21T15:16:35.116613Z","submitted_at":"2025-07-25T01:51:12Z","title":"Success in Humanoid Reinforcement Learning under Partial Observation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T18:11:10.819046Z"},"links":{"citing_paper":"/paper/2507.18883"},"observation_digest":"sha256:ffc23c1f4641acb027e177c2de03b19a3523e647d4af1f27edeafea3dc12277d","observation_id":"0ffdf3b3-c372-4e72-9bca-4fe0151eaa71","resolution":{"observed_at":"2026-08-15T18:11:11.421259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:11:11.396184Z","title":"Estevez, J","venue":null,"work_id":"e3ca70a2-11b9-4044-9d03-1329d146ae23","year":2020},"citing_paper":{"arxiv_id":"2507.18883","last_updated":"2025-07-25T01:51:12Z","snapshot_observed_at":"2026-08-21T15:16:35.116613Z","submitted_at":"2025-07-25T01:51:12Z","title":"Success in Humanoid Reinforcement Learning under Partial Observation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T18:11:10.826042Z"},"links":{"citing_paper":"/paper/2507.18883"},"observation_digest":"sha256:5fa7d7dc73ef0455acf3ed4869b9768b363a74ec582e5867ada3c9e28ae84a0b","observation_id":"37690468-5bf9-4288-8a48-9be8925a60c7","resolution":{"observed_at":"2026-08-15T18:11:11.401806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:11:11.375812Z","title":null,"venue":null,"work_id":"313122e0-e01f-47d5-b73f-c96d53f82340","year":2021},"citing_paper":{"arxiv_id":"2507.18883","last_updated":"2025-07-25T01:51:12Z","snapshot_observed_at":"2026-08-21T15:16:35.116613Z","submitted_at":"2025-07-25T01:51:12Z","title":"Success in Humanoid Reinforcement Learning under Partial Observation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T18:11:10.831258Z"},"links":{"citing_paper":"/paper/2507.18883"},"observation_digest":"sha256:5ced37a41b269df28e35501262d697674430ae5a006092bc957a0b4b06bf65c4","observation_id":"c1dfbadf-792d-4715-8fb1-fee5982e6045","resolution":{"observed_at":"2026-08-15T18:11:11.382550Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:11:11.358100Z","title":null,"venue":null,"work_id":"452674e3-9f45-41ca-b138-c8c0eb09a6ad","year":2022},"citing_paper":{"arxiv_id":"2507.18883","last_updated":"2025-07-25T01:51:12Z","snapshot_observed_at":"2026-08-21T15:16:35.116613Z","submitted_at":"2025-07-25T01:51:12Z","title":"Success in Humanoid Reinforcement Learning under Partial Observation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T18:11:10.836379Z"},"links":{"citing_paper":"/paper/2507.18883"},"observation_digest":"sha256:85eb6f4eb536e2e57933e14e7e7365eaea825b92bceb132942d22b89091e66dd","observation_id":"3c434fbe-43c8-49a7-9291-b06c5a8fbd78","resolution":{"observed_at":"2026-08-15T18:11:11.363776Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:11:11.340600Z","title":"Bellman, Dynamic Programming (Princeton University Press, Princeton, NJ) (1957), intro- duces the formalism of Markov decision processes (MDPs) and the principle of optimality","venue":null,"work_id":"cbe9afb8-5f00-4de3-a562-3362b5d57ef2","year":1957},"citing_paper":{"arxiv_id":"2507.18883","last_updated":"2025-07-25T01:51:12Z","snapshot_observed_at":"2026-08-21T15:16:35.116613Z","submitted_at":"2025-07-25T01:51:12Z","title":"Success in Humanoid Reinforcement Learning under Partial Observation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T18:11:10.842521Z"},"links":{"citing_paper":"/paper/2507.18883"},"observation_digest":"sha256:37321cb4bcd7508655d5d1635b32bf951c0e5b9f2f8083afe70feaa70e9f4160","observation_id":"4067b1c3-8aea-4b2d-878f-a8fca9b17162","resolution":{"observed_at":"2026-08-15T18:11:11.346834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:11:11.322346Z","title":null,"venue":null,"work_id":"30e59a17-9066-4c43-9904-611200139187","year":1965},"citing_paper":{"arxiv_id":"2507.18883","last_updated":"2025-07-25T01:51:12Z","snapshot_observed_at":"2026-08-21T15:16:35.116613Z","submitted_at":"2025-07-25T01:51:12Z","title":"Success in Humanoid Reinforcement Learning under Partial Observation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T18:11:10.847978Z"},"links":{"citing_paper":"/paper/2507.18883"},"observation_digest":"sha256:8a71647dc804b7e219e2c347f5191721541cec50b828d27fa1bd5a29a2f7632b","observation_id":"2bb8cd5e-fbac-41a8-9d65-c1e312c30cd5","resolution":{"observed_at":"2026-08-15T18:11:11.327533Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:11:11.303881Z","title":null,"venue":null,"work_id":"e71a8ef0-e1c7-459d-9fa9-602a1b77cfe3","year":2022},"citing_paper":{"arxiv_id":"2507.18883","last_updated":"2025-07-25T01:51:12Z","snapshot_observed_at":"2026-08-21T15:16:35.116613Z","submitted_at":"2025-07-25T01:51:12Z","title":"Success in Humanoid Reinforcement Learning under Partial Observation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T18:11:10.853493Z"},"links":{"citing_paper":"/paper/2507.18883"},"observation_digest":"sha256:6e79c1dc04b8b5a39e51ae5294a87e2e475d0faae1cd553d809991b4fad50d87","observation_id":"4d81ecb9-85bd-4e89-8303-950e820349c8","resolution":{"observed_at":"2026-08-15T18:11:11.309457Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:11:11.287641Z","title":null,"venue":null,"work_id":"464f916d-5601-4a92-a4b5-aa7bad2d1ac0","year":2023},"citing_paper":{"arxiv_id":"2507.18883","last_updated":"2025-07-25T01:51:12Z","snapshot_observed_at":"2026-08-21T15:16:35.116613Z","submitted_at":"2025-07-25T01:51:12Z","title":"Success in Humanoid Reinforcement Learning under Partial Observation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T18:11:10.859193Z"},"links":{"citing_paper":"/paper/2507.18883"},"observation_digest":"sha256:9cc69c5480054b8f9d281c67a93fa8014049261c49709e8a4771aa29e42940e6","observation_id":"f7e5f1c5-5923-487e-8baa-e09ab719a048","resolution":{"observed_at":"2026-08-15T18:11:11.292533Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:11:11.267126Z","title":null,"venue":null,"work_id":"421e58c8-b3af-40ba-9bb5-a0e3157ed39b","year":2022},"citing_paper":{"arxiv_id":"2507.18883","last_updated":"2025-07-25T01:51:12Z","snapshot_observed_at":"2026-08-21T15:16:35.116613Z","submitted_at":"2025-07-25T01:51:12Z","title":"Success in Humanoid Reinforcement Learning under Partial Observation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T18:11:10.864080Z"},"links":{"citing_paper":"/paper/2507.18883"},"observation_digest":"sha256:99d64f412b25db876418fe42802771ec248fa9fcf5265cf94bddeced26ba5317","observation_id":"d694c060-bbb5-4f71-964c-92cf6bb4486f","resolution":{"observed_at":"2026-08-15T18:11:11.275683Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:11:11.249851Z","title":null,"venue":null,"work_id":"5da17de2-9ece-4cbc-972b-b20d40a336b3","year":2023},"citing_paper":{"arxiv_id":"2507.18883","last_updated":"2025-07-25T01:51:12Z","snapshot_observed_at":"2026-08-21T15:16:35.116613Z","submitted_at":"2025-07-25T01:51:12Z","title":"Success in Humanoid Reinforcement Learning under Partial Observation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T18:11:10.870049Z"},"links":{"citing_paper":"/paper/2507.18883"},"observation_digest":"sha256:7a9ee35200017166aedf68e12760db6d72ea98977319354fde38feb4bc5bfaf2","observation_id":"33c6fef4-d456-4592-92b7-21f8aa5f728b","resolution":{"observed_at":"2026-08-15T18:11:11.254858Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:11:11.231844Z","title":"Hochreiter, J","venue":null,"work_id":"4de62904-b03b-4bfc-933a-6f3cde21ed35","year":1997},"citing_paper":{"arxiv_id":"2507.18883","last_updated":"2025-07-25T01:51:12Z","snapshot_observed_at":"2026-08-21T15:16:35.116613Z","submitted_at":"2025-07-25T01:51:12Z","title":"Success in Humanoid Reinforcement Learning under Partial Observation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T18:11:10.875545Z"},"links":{"citing_paper":"/paper/2507.18883"},"observation_digest":"sha256:426b07693e45ac2dd07b683bab152b3af225645bd22e793fac9c41ebc333befa","observation_id":"0f36d1c8-13eb-48aa-8ea0-da1530f32a02","resolution":{"observed_at":"2026-08-15T18:11:11.237605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:11:11.209976Z","title":null,"venue":null,"work_id":"421e45e7-5baf-40db-a8b3-1cba0972d53b","year":2021},"citing_paper":{"arxiv_id":"2507.18883","last_updated":"2025-07-25T01:51:12Z","snapshot_observed_at":"2026-08-21T15:16:35.116613Z","submitted_at":"2025-07-25T01:51:12Z","title":"Success in Humanoid Reinforcement Learning under Partial Observation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T18:11:10.880471Z"},"links":{"citing_paper":"/paper/2507.18883"},"observation_digest":"sha256:064ee9c2569e562c10bda4b5d026e478376cabab7d942b11522cc9c1721108bc","observation_id":"f16242e5-0751-4c0b-b493-40561be136db","resolution":{"observed_at":"2026-08-15T18:11:11.217435Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:11:11.184853Z","title":null,"venue":null,"work_id":"d8044007-aefe-4dd7-adcc-0d11354832c9","year":2022},"citing_paper":{"arxiv_id":"2507.18883","last_updated":"2025-07-25T01:51:12Z","snapshot_observed_at":"2026-08-21T15:16:35.116613Z","submitted_at":"2025-07-25T01:51:12Z","title":"Success in Humanoid Reinforcement Learning under Partial Observation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T18:11:10.886132Z"},"links":{"citing_paper":"/paper/2507.18883"},"observation_digest":"sha256:da5e7a104b31ce97cad6ab4423c0bf549a62d23313f0c2514e9f1b6f980e7d79","observation_id":"d5a7c946-349e-41ad-b066-855291a92ca0","resolution":{"observed_at":"2026-08-15T18:11:11.194171Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:11:11.166672Z","title":null,"venue":null,"work_id":"d23e3241-4bd9-4701-835e-8f74eb56f0ef","year":2023},"citing_paper":{"arxiv_id":"2507.18883","last_updated":"2025-07-25T01:51:12Z","snapshot_observed_at":"2026-08-21T15:16:35.116613Z","submitted_at":"2025-07-25T01:51:12Z","title":"Success in Humanoid Reinforcement Learning under Partial Observation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T18:11:10.891644Z"},"links":{"citing_paper":"/paper/2507.18883"},"observation_digest":"sha256:f0a13269bac4d172142876bcfbb58ebd7e148d9aea3998bcffefc89153f20698","observation_id":"f7f490aa-2a40-420d-b0af-34528ce028f8","resolution":{"observed_at":"2026-08-15T18:11:11.172333Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:11:11.147243Z","title":"Arcieri, et al., POMDP Inference and Robust Solution via Deep Reinforcement Learning: An Application to Railway Optimal Maintenance","venue":null,"work_id":"5d19f27b-66e7-41e1-844d-ef1cd5cca8a4","year":2024},"citing_paper":{"arxiv_id":"2507.18883","last_updated":"2025-07-25T01:51:12Z","snapshot_observed_at":"2026-08-21T15:16:35.116613Z","submitted_at":"2025-07-25T01:51:12Z","title":"Success in Humanoid Reinforcement Learning under Partial Observation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T18:11:10.896574Z"},"links":{"citing_paper":"/paper/2507.18883"},"observation_digest":"sha256:913a3efe81d5004dd0c17397bab77579c8fe8357f1a9ba00c9c26f839302ad13","observation_id":"90d0627e-a914-4568-a179-8993aa403def","resolution":{"observed_at":"2026-08-15T18:11:11.153183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:11:11.126846Z","title":"Lemmel, R","venue":null,"work_id":"9c7e6908-b098-456f-a8d4-fa2e319c59fb","year":2025},"citing_paper":{"arxiv_id":"2507.18883","last_updated":"2025-07-25T01:51:12Z","snapshot_observed_at":"2026-08-21T15:16:35.116613Z","submitted_at":"2025-07-25T01:51:12Z","title":"Success in Humanoid Reinforcement Learning under Partial Observation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T18:11:10.901994Z"},"links":{"citing_paper":"/paper/2507.18883"},"observation_digest":"sha256:74ddf26cfa536ef0a07f216eb0c086471e091f8e0f80852bf4b9ad631ca2de52","observation_id":"3ff6713b-873f-4e3a-abb9-738e86910c1c","resolution":{"observed_at":"2026-08-15T18:11:11.133464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-08-17T20:47:46.242385Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-15T18:11:10.906816Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18883","last_updated":"2025-07-25T01:51:12Z","snapshot_observed_at":"2026-08-21T15:16:35.116613Z","submitted_at":"2025-07-25T01:51:12Z","title":"Success in Humanoid Reinforcement Learning under Partial Observation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T18:11:10.906816Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2507.18883"},"observation_digest":"sha256:f8c49e3abaa33c92fc95bd95f10d09ca78bf608f600468781aec790468606bef","observation_id":"a1ab6c8b-4f4a-4989-8c4c-9930e88ca20d","resolution":{"observed_at":"2026-08-15T18:11:10.906816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:11:11.107453Z","title":null,"venue":null,"work_id":"64d13d82-8274-4be7-bcf4-fb35330cec9e","year":2024},"citing_paper":{"arxiv_id":"2507.18883","last_updated":"2025-07-25T01:51:12Z","snapshot_observed_at":"2026-08-21T15:16:35.116613Z","submitted_at":"2025-07-25T01:51:12Z","title":"Success in Humanoid Reinforcement Learning under Partial Observation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T18:11:10.913179Z"},"links":{"citing_paper":"/paper/2507.18883"},"observation_digest":"sha256:84458481260dba845309e9714c27737d1e8b1b7392ab633a4edbfbd7c4060030","observation_id":"3f30e640-9f71-4dab-bb45-3cab7c529e1e","resolution":{"observed_at":"2026-08-15T18:11:11.113614Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19925","last_updated":"2024-03-29T02:25:55Z","snapshot_observed_at":"2026-08-19T02:47:51.941686Z","submitted_at":"2024-03-29T02:25:55Z","title":"Decision Mamba: Reinforcement Learning via Sequence Modeling with Selective State Spaces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19925","snapshot_observed_at":"2026-08-15T18:11:10.919344Z","title":"Ota, Decision Mamba: Reinforcement Learning via Sequence Modeling with Selective State Spaces (2024), arXiv:2403.19925","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18883","last_updated":"2025-07-25T01:51:12Z","snapshot_observed_at":"2026-08-21T15:16:35.116613Z","submitted_at":"2025-07-25T01:51:12Z","title":"Success in Humanoid Reinforcement Learning under Partial Observation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T18:11:10.919344Z"},"links":{"cited_paper":"/paper/2403.19925","citing_paper":"/paper/2507.18883"},"observation_digest":"sha256:51e759a58059d60d955a81bfbf8dfd5379733c03a246f4cf8405d25fdf9ff2d4","observation_id":"c8306416-5b0e-4e2e-83ff-b8828f7659cf","resolution":{"observed_at":"2026-08-15T18:11:10.919344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09859","last_updated":"2024-03-14T20:40:36Z","snapshot_observed_at":"2026-08-19T07:53:41.830376Z","submitted_at":"2024-03-14T20:40:36Z","title":"MAMBA: an Effective World Model Approach for Meta-Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09859","snapshot_observed_at":"2026-08-15T18:11:10.924642Z","title":"Rimon, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18883","last_updated":"2025-07-25T01:51:12Z","snapshot_observed_at":"2026-08-21T15:16:35.116613Z","submitted_at":"2025-07-25T01:51:12Z","title":"Success in Humanoid Reinforcement Learning under Partial Observation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T18:11:10.924642Z"},"links":{"cited_paper":"/paper/2403.09859","citing_paper":"/paper/2507.18883"},"observation_digest":"sha256:6c92e1cca1ea2b81bdcf69be4b89b4b28e2606cab6f5e570458cb74504744693","observation_id":"118bf2cf-c6c2-43cb-936c-a8d46f7556d2","resolution":{"observed_at":"2026-08-15T18:11:10.924642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:11:10.930242Z","title":"Towers, et al., Gymnasium (2023), doi:10.5281/zenodo.8127026,https://zenodo.org/ record/8127025","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18883","last_updated":"2025-07-25T01:51:12Z","snapshot_observed_at":"2026-08-21T15:16:35.116613Z","submitted_at":"2025-07-25T01:51:12Z","title":"Success in Humanoid Reinforcement Learning under Partial Observation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T18:11:10.930242Z"},"links":{"citing_paper":"/paper/2507.18883"},"observation_digest":"sha256:9dfadb53cdff82b9a98603850eb09178365ebf51637b32e1edf88c0005750b78","observation_id":"424d8515-7bf4-4613-b66e-754ae0e53ebd","resolution":{"observed_at":"2026-08-15T18:11:10.930242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.18883","last_updated":"2025-07-25T01:51:12Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-21T15:16:35.116613Z","submitted_at":"2025-07-25T01:51:12Z","title":"Success in Humanoid Reinforcement Learning under Partial Observation"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":6},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2507.18883."}