{"as_of":"2026-08-22T00:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:42df8db60bab711c3c0fe8994b9b38be503d76a42f6013b9321afe4e50626ed9","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:02:17.856013Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.19437/citation-record","integrity":"/paper/2507.19437/integrity","json":"/paper/2507.19437/citation-record.json","paper":"/paper/2507.19437"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1612.00410","last_updated":"2019-10-23T22:47:44Z","snapshot_observed_at":"2026-08-16T15:45:06.346529Z","submitted_at":"2016-12-01T20:12:40Z","title":"Deep Variational Information Bottleneck","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1612.00410","snapshot_observed_at":"2026-08-15T18:02:17.776800Z","title":"Deep variational information bottleneck","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19437","last_updated":"2025-07-25T17:08:16Z","snapshot_observed_at":"2026-08-17T19:22:53.015683Z","submitted_at":"2025-07-25T17:08:16Z","title":"Observations Meet Actions: Learning Control-Sufficient Representations for Robust Policy Generalization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T18:02:17.776800Z"},"links":{"cited_paper":"/paper/1612.00410","citing_paper":"/paper/2507.19437"},"observation_digest":"sha256:2b0423e89b2cabfa6fff1f69227c192f592b396bb272182f10384cc86e9fa20a","observation_id":"70983f92-9837-4285-9b57-24a570670405","resolution":{"observed_at":"2026-08-15T18:02:17.776800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-08-16T22:06:26.835611Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-15T18:02:17.814371Z","title":"Continuous control with deep reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19437","last_updated":"2025-07-25T17:08:16Z","snapshot_observed_at":"2026-08-17T19:22:53.015683Z","submitted_at":"2025-07-25T17:08:16Z","title":"Observations Meet Actions: Learning Control-Sufficient Representations for Robust Policy Generalization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T18:02:17.814371Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2507.19437"},"observation_digest":"sha256:ec4ceddedc9352291644fd990bcfbb62f0837204025a74ecd5544bc32a84274a","observation_id":"ca3223a5-beeb-4180-8dda-abc423286f0d","resolution":{"observed_at":"2026-08-15T18:02:17.814371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:02:18.217515Z","title":"Sim-to-real transfer of robotic control with dynamics randomization","venue":null,"work_id":"ed5bc0bf-c119-49b7-aee4-c21c83a77500","year":2018},"citing_paper":{"arxiv_id":"2507.19437","last_updated":"2025-07-25T17:08:16Z","snapshot_observed_at":"2026-08-17T19:22:53.015683Z","submitted_at":"2025-07-25T17:08:16Z","title":"Observations Meet Actions: Learning Control-Sufficient Representations for Robust Policy Generalization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T18:02:17.823182Z"},"links":{"citing_paper":"/paper/2507.19437"},"observation_digest":"sha256:c2cd8663a96531a7d0dc76ca29d5186ec71de48827a559d75f1c700db6954768","observation_id":"337c7c55-a506-4949-8a30-2251b38d0264","resolution":{"observed_at":"2026-08-15T18:02:18.223567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.06893","last_updated":"2018-04-20T16:49:52Z","snapshot_observed_at":"2026-08-17T19:22:52.504906Z","submitted_at":"2018-04-18T19:49:13Z","title":"A Study on Overfitting in Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.06893","snapshot_observed_at":"2026-08-15T18:02:17.856013Z","title":"A study on overfitting in deep reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19437","last_updated":"2025-07-25T17:08:16Z","snapshot_observed_at":"2026-08-17T19:22:53.015683Z","submitted_at":"2025-07-25T17:08:16Z","title":"Observations Meet Actions: Learning Control-Sufficient Representations for Robust Policy Generalization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T18:02:17.856013Z"},"links":{"cited_paper":"/paper/1804.06893","citing_paper":"/paper/2507.19437"},"observation_digest":"sha256:afb7539e6a93430ba680146b7a60044ace09128827155e5f0750ba0535d78213","observation_id":"7ce1a859-25ea-4ec6-9fe9-989d437334d8","resolution":{"observed_at":"2026-08-15T18:02:17.856013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-08-14T23:50:45.029465Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-15T18:02:17.801493Z","title":"Auto-encoding variational bayes","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19437","last_updated":"2025-07-25T17:08:16Z","snapshot_observed_at":"2026-08-17T19:22:53.015683Z","submitted_at":"2025-07-25T17:08:16Z","title":"Observations Meet Actions: Learning Control-Sufficient Representations for Robust Policy Generalization","version":1},"reference_index":1960,"source":"pdf_text","source_observed_at":"2026-08-15T18:02:17.801493Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2507.19437"},"observation_digest":"sha256:d9fa3a450dedab88927bf8f08d624a8f70fe5f187bc34d5b207d3474bb2789b0","observation_id":"0353aa20-0aa4-437d-92fa-4ef4ba5679a1","resolution":{"observed_at":"2026-08-15T18:02:17.801493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03996","last_updated":"2022-05-26T04:39:01Z","snapshot_observed_at":"2026-08-20T10:49:37.757714Z","submitted_at":"2021-07-08T17:41:55Z","title":"Learning Vision-Guided Quadrupedal Locomotion End-to-End with Cross-Modal Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03996","snapshot_observed_at":"2026-08-15T18:02:17.851337Z","title":"Learning vision-guided quadrupedal locomotion end-to-end with cross-modal transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19437","last_updated":"2025-07-25T17:08:16Z","snapshot_observed_at":"2026-08-17T19:22:53.015683Z","submitted_at":"2025-07-25T17:08:16Z","title":"Observations Meet Actions: Learning Control-Sufficient Representations for Robust Policy Generalization","version":1},"reference_index":1968,"source":"pdf_text","source_observed_at":"2026-08-15T18:02:17.851337Z"},"links":{"cited_paper":"/paper/2107.03996","citing_paper":"/paper/2507.19437"},"observation_digest":"sha256:cbe12dcae6a42f7bd809dfa38995d4335d62d628547b981ae2a48874e1d9da42","observation_id":"75f893ae-98ab-45cc-9aee-f33f7bc4fd67","resolution":{"observed_at":"2026-08-15T18:02:17.851337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"physics/0004057","last_updated":"2000-04-24T15:22:30Z","snapshot_observed_at":"2026-08-16T09:10:10.815975Z","submitted_at":"2000-04-24T15:22:30Z","title":"The information bottleneck method","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"physics/0004057","snapshot_observed_at":"2026-08-15T18:02:17.833618Z","title":"The information bottleneck method","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19437","last_updated":"2025-07-25T17:08:16Z","snapshot_observed_at":"2026-08-17T19:22:53.015683Z","submitted_at":"2025-07-25T17:08:16Z","title":"Observations Meet Actions: Learning Control-Sufficient Representations for Robust Policy Generalization","version":1},"reference_index":1998,"source":"pdf_text","source_observed_at":"2026-08-15T18:02:17.833618Z"},"links":{"cited_paper":"/paper/physics/0004057","citing_paper":"/paper/2507.19437"},"observation_digest":"sha256:e6913c1af70b8018695b2005a2b5a15b5755ce2836447559d1bc8fdaccfc4eb2","observation_id":"51b43956-3996-4d02-bb88-fe14b3bf163e","resolution":{"observed_at":"2026-08-15T18:02:17.833618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:02:18.185107Z","title":"Domain randomization for transferring deep neural networks from simulation to the real world","venue":null,"work_id":"20f42ae1-6cfc-4b6f-811b-a16b68183c92","year":2017},"citing_paper":{"arxiv_id":"2507.19437","last_updated":"2025-07-25T17:08:16Z","snapshot_observed_at":"2026-08-17T19:22:53.015683Z","submitted_at":"2025-07-25T17:08:16Z","title":"Observations Meet Actions: Learning Control-Sufficient Representations for Robust Policy Generalization","version":1},"reference_index":2000,"source":"pdf_text","source_observed_at":"2026-08-15T18:02:17.837622Z"},"links":{"citing_paper":"/paper/2507.19437"},"observation_digest":"sha256:b3848914f899becfa61d34214e6421fa064411b002b198faa578a481db79b8d9","observation_id":"469cfc6f-c533-490f-b09e-7271adb2bb4d","resolution":{"observed_at":"2026-08-15T18:02:18.190990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.04062","last_updated":"2021-08-14T18:35:05Z","snapshot_observed_at":"2026-08-20T05:41:39.601452Z","submitted_at":"2018-01-12T05:42:58Z","title":"MINE: Mutual Information Neural Estimation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.04062","snapshot_observed_at":"2026-08-15T18:02:17.782913Z","title":"Mine: mutual information neural estimation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19437","last_updated":"2025-07-25T17:08:16Z","snapshot_observed_at":"2026-08-17T19:22:53.015683Z","submitted_at":"2025-07-25T17:08:16Z","title":"Observations Meet Actions: Learning Control-Sufficient Representations for Robust Policy Generalization","version":1},"reference_index":2004,"source":"pdf_text","source_observed_at":"2026-08-15T18:02:17.782913Z"},"links":{"cited_paper":"/paper/1801.04062","citing_paper":"/paper/2507.19437"},"observation_digest":"sha256:438d72e27e8978e2ff9969ffd98225f0f390f336551db01fce3e2806e056e1e9","observation_id":"57c516bd-a80d-45d9-8220-24d4ac42eedb","resolution":{"observed_at":"2026-08-15T18:02:17.782913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:02:17.845468Z","title":"Walter Murray Wonham","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.19437","last_updated":"2025-07-25T17:08:16Z","snapshot_observed_at":"2026-08-17T19:22:53.015683Z","submitted_at":"2025-07-25T17:08:16Z","title":"Observations Meet Actions: Learning Control-Sufficient Representations for Robust Policy Generalization","version":1},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-15T18:02:17.845468Z"},"links":{"citing_paper":"/paper/2507.19437"},"observation_digest":"sha256:3d9fd66485beb2700df9a36423a58db052896cbb434641f91bf089e1d45098dd","observation_id":"4700c26e-fce6-4649-9050-e7a759815e06","resolution":{"observed_at":"2026-08-15T18:02:17.845468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.00909","last_updated":"2018-05-20T20:03:59Z","snapshot_observed_at":"2026-08-08T20:31:18.897748Z","submitted_at":"2018-05-02T17:11:20Z","title":"Reinforcement Learning and Control as Probabilistic Inference: Tutorial and Review","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.00909","snapshot_observed_at":"2026-08-15T18:02:17.810339Z","title":"Stochastic latent actor- critic: Deep reinforcement learning with a latent variable model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19437","last_updated":"2025-07-25T17:08:16Z","snapshot_observed_at":"2026-08-17T19:22:53.015683Z","submitted_at":"2025-07-25T17:08:16Z","title":"Observations Meet Actions: Learning Control-Sufficient Representations for Robust Policy Generalization","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-15T18:02:17.810339Z"},"links":{"cited_paper":"/paper/1805.00909","citing_paper":"/paper/2507.19437"},"observation_digest":"sha256:9b1747f195c62d999d977dcc069a59f1f320ec47eaf23e46cd8f4abacacdf936","observation_id":"8a236c2b-9353-4e7a-8d9b-eeb2ca39a87d","resolution":{"observed_at":"2026-08-15T18:02:17.810339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:02:18.233677Z","title":"Generalization in reinforcement learning by soft data augmentation","venue":null,"work_id":"6a3effd0-3193-4e3a-93ed-e859fb0a9910","year":2021},"citing_paper":{"arxiv_id":"2507.19437","last_updated":"2025-07-25T17:08:16Z","snapshot_observed_at":"2026-08-17T19:22:53.015683Z","submitted_at":"2025-07-25T17:08:16Z","title":"Observations Meet Actions: Learning Control-Sufficient Representations for Robust Policy Generalization","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-15T18:02:17.797215Z"},"links":{"citing_paper":"/paper/2507.19437"},"observation_digest":"sha256:a9fd68a64124e8d1e827b97ffb0f6dc0c042f647f9f2ee2ab36a4850c100e461","observation_id":"10f9da3f-6aef-4d73-8cec-9d20d138b0a1","resolution":{"observed_at":"2026-08-15T18:02:18.238720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-08-14T18:53:38.574749Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-15T18:02:17.818865Z","title":"Representation learning with contrastive predictive coding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19437","last_updated":"2025-07-25T17:08:16Z","snapshot_observed_at":"2026-08-17T19:22:53.015683Z","submitted_at":"2025-07-25T17:08:16Z","title":"Observations Meet Actions: Learning Control-Sufficient Representations for Robust Policy Generalization","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-15T18:02:17.818865Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2507.19437"},"observation_digest":"sha256:1ab5e2aa2f9c5a120bf30b5f00f5842e87e076c7bfe6cc95450399879bae113b","observation_id":"8f882d01-bb77-4c65-a797-3929d89177d4","resolution":{"observed_at":"2026-08-15T18:02:17.818865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:02:18.165240Z","title":"Mujoco: A physics engine for model-based control","venue":null,"work_id":"80ff8a0a-b1f3-4276-b372-c922e89b069e","year":2012},"citing_paper":{"arxiv_id":"2507.19437","last_updated":"2025-07-25T17:08:16Z","snapshot_observed_at":"2026-08-17T19:22:53.015683Z","submitted_at":"2025-07-25T17:08:16Z","title":"Observations Meet Actions: Learning Control-Sufficient Representations for Robust Policy Generalization","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-15T18:02:17.841611Z"},"links":{"citing_paper":"/paper/2507.19437"},"observation_digest":"sha256:0490f8bf64566046ef2b2260f2ff77f1c50686df1d76f39d8b4e9507550732ea","observation_id":"7cb4e739-3c7b-4829-93cb-c7ea4135be31","resolution":{"observed_at":"2026-08-15T18:02:18.172372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-15T18:02:17.787376Z","title":"Danijar Hafner, Jurgis Pasukonis, Jimmy Ba, and Timothy Lillicrap","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19437","last_updated":"2025-07-25T17:08:16Z","snapshot_observed_at":"2026-08-17T19:22:53.015683Z","submitted_at":"2025-07-25T17:08:16Z","title":"Observations Meet Actions: Learning Control-Sufficient Representations for Robust Policy Generalization","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-15T18:02:17.787376Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2507.19437"},"observation_digest":"sha256:e6f9e7c50e87bdf7365d31e9bbb83a5702bb1e62087b7c112c2df19038c4ea21","observation_id":"f26b0cc8-15e2-4f0b-8763-da5ace3fcdea","resolution":{"observed_at":"2026-08-15T18:02:17.787376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:02:18.201087Z","title":"Eligibility traces for off-policy policy evaluation","venue":null,"work_id":"b44e154e-43db-48d0-b020-9b31637a09f4","year":2000},"citing_paper":{"arxiv_id":"2507.19437","last_updated":"2025-07-25T17:08:16Z","snapshot_observed_at":"2026-08-17T19:22:53.015683Z","submitted_at":"2025-07-25T17:08:16Z","title":"Observations Meet Actions: Learning Control-Sufficient Representations for Robust Policy Generalization","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-15T18:02:17.829040Z"},"links":{"citing_paper":"/paper/2507.19437"},"observation_digest":"sha256:84a56fe93e0536607826beccf5cf374f8bcedc3f663d4aed4777172a9fa175c7","observation_id":"40ed379c-bcb4-430c-b503-d18c057b64e0","resolution":{"observed_at":"2026-08-15T18:02:18.205894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.04034","last_updated":"2021-07-08T17:59:59Z","snapshot_observed_at":"2026-08-18T15:06:14.253218Z","submitted_at":"2021-07-08T17:59:59Z","title":"RMA: Rapid Motor Adaptation for Legged Robots","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.04034","snapshot_observed_at":"2026-08-15T18:02:17.805753Z","title":"Rma: Rapid motor adap- tation for legged robots","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19437","last_updated":"2025-07-25T17:08:16Z","snapshot_observed_at":"2026-08-17T19:22:53.015683Z","submitted_at":"2025-07-25T17:08:16Z","title":"Observations Meet Actions: Learning Control-Sufficient Representations for Robust Policy Generalization","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-15T18:02:17.805753Z"},"links":{"cited_paper":"/paper/2107.04034","citing_paper":"/paper/2507.19437"},"observation_digest":"sha256:3e4e2edf3e5fd1e0a0944c8040f04be3663ae4b19b989e7f6279ea33980b0995","observation_id":"bb0af7d3-9f7f-4909-902d-9b27d3bacdf1","resolution":{"observed_at":"2026-08-15T18:02:17.805753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1502.02259","last_updated":"2015-02-08T14:58:50Z","snapshot_observed_at":"2026-08-14T23:00:56.212471Z","submitted_at":"2015-02-08T14:58:50Z","title":"Contextual Markov Decision Processes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1502.02259","snapshot_observed_at":"2026-08-15T18:02:17.792608Z","title":"Contextual markov decision processes","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19437","last_updated":"2025-07-25T17:08:16Z","snapshot_observed_at":"2026-08-17T19:22:53.015683Z","submitted_at":"2025-07-25T17:08:16Z","title":"Observations Meet Actions: Learning Control-Sufficient Representations for Robust Policy Generalization","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-15T18:02:17.792608Z"},"links":{"cited_paper":"/paper/1502.02259","citing_paper":"/paper/2507.19437"},"observation_digest":"sha256:86117cfff941bf4e7b16da60bf7adb44eca5b914e0bf33c9f866e5dff8b30fde","observation_id":"6ebcc287-be0f-44a4-ab75-e18fc9934948","resolution":{"observed_at":"2026-08-15T18:02:17.792608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.19437","last_updated":"2025-07-25T17:08:16Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T19:22:53.015683Z","submitted_at":"2025-07-25T17:08:16Z","title":"Observations Meet Actions: Learning Control-Sufficient Representations for Robust Policy Generalization"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2507.19437."}