{"as_of":"2026-08-07T22:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8a230529797e28d02d87b7a28720ed709de9ca146a9961379e23ec496cd9c6e1","coverage":[{"denominator":157,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:34:41.099059Z","state":"measured"},{"denominator":106,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":106,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T08:46:26.662381Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T07:59:40.694649Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17518","snapshot_observed_at":"2026-08-04T08:46:26.662381Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-07T16:20:51.832863Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.662381Z"},"links":{"cited_paper":"/paper/2506.17518","citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:be3a4534ff6a6a65f9cd3e723457009d286b378a22429fdf0a54ce3389a3c4db","observation_id":"ed9024be-4180-4384-af60-c34f0e2c26fc","resolution":{"observed_at":"2026-08-04T08:46:26.662381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2506.17518","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17518","snapshot_observed_at":"2026-07-04T07:59:40.694649Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning, June 2025","venue":null,"work_id":"27e3bbd8-8b1c-4b24-9add-ee93fbad104e","year":2025},"citing_paper":{"arxiv_id":"2604.09671","last_updated":"2026-04-01T22:28:38Z","snapshot_observed_at":"2026-07-06T22:58:29.952947Z","submitted_at":"2026-04-01T22:28:38Z","title":"Belief-State RWKV for Reinforcement Learning under Partial Observability","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T21:56:09.642064Z"},"links":{"cited_paper":"/paper/2506.17518","citing_paper":"/paper/2604.09671"},"observation_digest":"sha256:f2dbe00424acf554d96d52092aa9933d7f7aa891136f977952fab9f81754b7cf","observation_id":"563ba66e-ff96-4b01-9e1e-b05806f4cb76","resolution":{"observed_at":"2026-05-13T21:58:19.908240Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2506.17518","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17518","snapshot_observed_at":"2026-07-04T07:59:40.694649Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning, June 2025","venue":null,"work_id":"27e3bbd8-8b1c-4b24-9add-ee93fbad104e","year":2025},"citing_paper":{"arxiv_id":"2605.09364","last_updated":"2026-05-10T06:27:20Z","snapshot_observed_at":"2026-07-31T06:28:20.350355Z","submitted_at":"2026-05-10T06:27:20Z","title":"Multi-scale Predictive Representations for Goal-conditioned Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-12T03:35:37.739085Z"},"links":{"cited_paper":"/paper/2506.17518","citing_paper":"/paper/2605.09364"},"observation_digest":"sha256:7d8179b523b42cbed8924828c35698887c3abdbc46b174a5cc54ef62b8e7297b","observation_id":"1919587a-f114-488e-a6e2-c5f4923b6f99","resolution":{"observed_at":"2026-05-12T07:16:26.328081Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2506.17518","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17518","snapshot_observed_at":"2026-07-04T07:59:40.694649Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning, June 2025","venue":null,"work_id":"27e3bbd8-8b1c-4b24-9add-ee93fbad104e","year":2025},"citing_paper":{"arxiv_id":"2605.22711","last_updated":"2026-05-21T16:50:26Z","snapshot_observed_at":"2026-07-06T23:32:59.663926Z","submitted_at":"2026-05-21T16:50:26Z","title":"Abstraction for Offline Goal-Conditioned Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-22T07:46:20.289421Z"},"links":{"cited_paper":"/paper/2506.17518","citing_paper":"/paper/2605.22711"},"observation_digest":"sha256:e7fa5c022571477f802ba08a914a84803424a99dc5164b5436d278a7d04cb02b","observation_id":"6f8e3d58-0158-49b3-bc5a-a4fbcba1d4c5","resolution":{"observed_at":"2026-05-22T07:51:16.511799Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17518","snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-06T16:01:13.657296Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"cited_paper":"/paper/2506.17518","citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:71bb04573830ceffc3a24ca5b78e3dcbf88fe2e1a1ac8a9f363f60a984717ea8","observation_id":"b635bf3c-5141-4366-8881-ccae312cd0f5","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2506.17518","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17518","snapshot_observed_at":"2026-07-04T07:59:40.694649Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning, June 2025","venue":null,"work_id":"27e3bbd8-8b1c-4b24-9add-ee93fbad104e","year":2025},"citing_paper":{"arxiv_id":"2606.21943","last_updated":"2026-06-20T08:20:41Z","snapshot_observed_at":"2026-07-06T23:56:54.959593Z","submitted_at":"2026-06-20T08:20:41Z","title":"Modularized Reinforcement Learning on LLMs: From MDP Creation to Exploration and Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-26T12:15:08.304150Z"},"links":{"cited_paper":"/paper/2506.17518","citing_paper":"/paper/2606.21943"},"observation_digest":"sha256:95d92e883d7928ae3ac74b25b391d17bf69300bfcbddee909ccf0a7111947ee4","observation_id":"593b92c4-385f-447f-bcf0-ee48330d63b3","resolution":{"observed_at":"2026-07-04T07:59:40.696101Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.17518/citation-record","integrity":"/paper/2506.17518/integrity","json":"/paper/2506.17518/citation-record.json","paper":"/paper/2506.17518"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2203.00397","last_updated":"2022-03-01T12:46:28Z","snapshot_observed_at":"2026-08-05T00:05:21.423392Z","submitted_at":"2022-03-01T12:46:28Z","title":"A Theory of Abstraction in Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.00397","snapshot_observed_at":"2026-08-06T23:34:30.715934Z","title":"A theory of abstraction in reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:30.715934Z"},"links":{"cited_paper":"/paper/2203.00397","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:d7afc9e6c2b2593e13a14bc86c52a23ec08b7e3d6bf703f9301cc5331ce5d84a","observation_id":"fc0284af-a214-4ae6-bd9a-17278f658440","resolution":{"observed_at":"2026-08-06T23:34:30.715934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:30.807529Z","title":"Machado, Pablo Samuel Castro, and Marc G Bellemare","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:30.807529Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:e3f5d6c38c063abc1e1e213e3eed08af22213e77595cbd3c1dfa106b95717b8a","observation_id":"7fbfffcb-2458-40b7-a767-c8b2f8e4502d","resolution":{"observed_at":"2026-08-06T23:34:30.807529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:30.950503Z","title":"Bellemare","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:30.950503Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:4021ab608504e615c95abe1737637ea6905cab30ad5cbf4256330c29f69e59e2","observation_id":"70c79a2a-a6f7-400c-8d9c-9cac30786a7d","resolution":{"observed_at":"2026-08-06T23:34:30.950503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19418","last_updated":"2025-03-11T17:41:54Z","snapshot_observed_at":"2026-08-06T09:29:35.371770Z","submitted_at":"2024-11-29T00:09:39Z","title":"Proto Successor Measure: Representing the Behavior Space of an RL Agent","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19418","snapshot_observed_at":"2026-08-06T23:34:31.066415Z","title":"Proto successor measure: Representing the space of all possible solutions of reinforcement learning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:31.066415Z"},"links":{"cited_paper":"/paper/2411.19418","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:510bc87696285f50e8ebd83cea89f489ee8b7880a2d87f42bb7f8a85648fe42f","observation_id":"683c03af-f7ca-44e0-96ef-bbf2d68e1bd0","resolution":{"observed_at":"2026-08-06T23:34:31.066415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:31.143480Z","title":"Alemi, Ian Fischer, Joshua V","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:31.143480Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:a158939ed10781bfb0a07bd1005c8a210eed9fcf9a2ec16cc5c2a1dcc8f1d299","observation_id":"9bebbd1f-1e5a-4262-86dd-9ec8928f9ab0","resolution":{"observed_at":"2026-08-06T23:34:31.143480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:31.242705Z","title":"Learning markov state abstractions for deep reinforcement learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:31.242705Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:ace349173e65ffcf508dda2e5b109410b0900183297663281ba5d7b45d9de28b","observation_id":"adedad9f-34c0-4fde-b579-135587ad0138","resolution":{"observed_at":"2026-08-06T23:34:31.242705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:31.356299Z","title":"A recipe for unbounded data augmentation in visual reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:31.356299Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:65c60cbfcf825d8ad3ff6ec0d1d03a121d3d3df7801e4e68321f323125b849e2","observation_id":"b3b1068e-a4d9-487b-bee4-7c892d5c1c0f","resolution":{"observed_at":"2026-08-06T23:34:31.356299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.08226","last_updated":"2020-11-05T23:10:28Z","snapshot_observed_at":"2026-07-06T08:01:27.238962Z","submitted_at":"2019-06-19T17:16:46Z","title":"Unsupervised State Representation Learning in Atari","version":6},"cited_work":{"arxiv_id":"1906.08226","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.08226","snapshot_observed_at":"2026-08-06T23:34:50.871053Z","title":"Unsupervised State Representation Learning in Atari","venue":"cs.LG","work_id":"1305721b-6a83-463e-b44d-43897e2a7fff","year":2019},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:31.477002Z"},"links":{"cited_paper":"/paper/1906.08226","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:b20490c6bdc8b53f1932f636f73fda5eb0543e11218ade20c265fb93dfe44ee7","observation_id":"ffa5f726-b3d2-4455-a861-9d7d46f2316e","resolution":{"observed_at":"2026-08-06T23:34:51.008715Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:31.578963Z","title":"Hindsight experience replay","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:31.578963Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:35bd89666b587b87564c91ca01cc5b5a03523ce63fd2e664a15fe51d79c9b892","observation_id":"1fb18abd-062d-4b92-a5b8-2b513c57520f","resolution":{"observed_at":"2026-08-06T23:34:31.578963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:31.654631Z","title":"Self-supervised learning from images with a joint-embedding predictive architecture","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:31.654631Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:2496120da069bc22fe6f05204454eb7afb9f4e5009ae85371b8855393e05d3f9","observation_id":"40eb1f6f-2920-43d9-a758-ecf0e3cb527f","resolution":{"observed_at":"2026-08-06T23:34:31.654631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.0473","last_updated":"2016-05-19T21:53:22Z","snapshot_observed_at":"2026-07-06T03:53:10.336430Z","submitted_at":"2014-09-01T16:33:02Z","title":"Neural Machine Translation by Jointly Learning to Align and Translate","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.0473","snapshot_observed_at":"2026-08-06T23:34:31.744229Z","title":"Neural machine translation by jointly learning to align and translate","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:31.744229Z"},"links":{"cited_paper":"/paper/1409.0473","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:3e9d670eea5f061d8db5b570f007abe4df86cc5fc8f28d4a0afcd6943bf5a4c0","observation_id":"9f2277d9-3556-4ae1-904b-9a1fe1c9f621","resolution":{"observed_at":"2026-08-06T23:34:31.744229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.04906","last_updated":"2022-01-28T12:23:37Z","snapshot_observed_at":"2026-07-06T11:08:17.373935Z","submitted_at":"2021-05-11T09:53:21Z","title":"VICReg: Variance-Invariance-Covariance Regularization for Self-Supervised Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.04906","snapshot_observed_at":"2026-08-06T23:34:31.814504Z","title":"Vicreg: Variance-invariance-covariance regularization for self-supervised learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:31.814504Z"},"links":{"cited_paper":"/paper/2105.04906","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:18c283b8e58771cd8d0f07d40b579fc23eeac47d85477cbed44dc0c1aac34b7b","observation_id":"b52123de-b84a-4f66-bcd7-9f470184f823","resolution":{"observed_at":"2026-08-06T23:34:31.814504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05342","last_updated":"2024-06-26T13:28:35Z","snapshot_observed_at":"2026-07-06T14:50:33.453443Z","submitted_at":"2023-02-10T15:57:20Z","title":"Combining Reconstruction and Contrastive Methods for Multimodal Representations in RL","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05342","snapshot_observed_at":"2026-08-06T23:34:31.865871Z","title":"Combining reconstruction and contrastive methods for multimodal representations in rl, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:31.865871Z"},"links":{"cited_paper":"/paper/2302.05342","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:607d88139ca03baf2d357e2f0d277367b125bcd9e4aca3ce8347fd016b0277ab","observation_id":"c6e9439b-652b-4a2f-9c31-bc0b655ce9d1","resolution":{"observed_at":"2026-08-06T23:34:31.865871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:31.975014Z","title":"The arcade learning environment: An evaluation platform for general agents","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:31.975014Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:3ea93b88a59544953144265829700da176701fea9080ff37e1eaa6e544aa465a","observation_id":"e00709d0-3b7e-4178-bb9a-6bc6f9229e38","resolution":{"observed_at":"2026-08-06T23:34:31.975014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1206.5538","last_updated":"2014-04-23T11:48:51Z","snapshot_observed_at":"2026-08-04T23:10:50.439752Z","submitted_at":"2012-06-24T20:51:38Z","title":"Representation Learning: A Review and New Perspectives","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1206.5538","snapshot_observed_at":"2026-08-06T23:34:32.042792Z","title":"Courville, and Pascal Vincent","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:32.042792Z"},"links":{"cited_paper":"/paper/1206.5538","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:92dd490f6b833455233f66046652b367ba41e684ccd25a085b483b7423735799","observation_id":"227c9b5b-29aa-4cf5-ba90-48338c9f003b","resolution":{"observed_at":"2026-08-06T23:34:32.042792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:32.123012Z","title":"Look where you look! saliency-guided q-networks for generalization in visual reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:32.123012Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:3a102091aeaf5a1138fd8d4c1d711492cad4d02fa7026fb9ebe2864b94a1b6d4","observation_id":"13381cb8-049f-4314-8761-03712ff125be","resolution":{"observed_at":"2026-08-06T23:34:32.123012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:32.207951Z","title":"Riedmiller, and Klaus Obermayer","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:32.207951Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:43783e2201e9f26043e7ddd695be810d9cb7d6339a5cca96da5e77b3468283e7","observation_id":"6a57f70d-d1ec-4662-ab92-de6fed824494","resolution":{"observed_at":"2026-08-06T23:34:32.207951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.14226","last_updated":"2024-05-01T13:00:39Z","snapshot_observed_at":"2026-07-06T13:46:52.990082Z","submitted_at":"2022-08-27T09:38:56Z","title":"Unsupervised Representation Learning in Deep Reinforcement Learning: A Review","version":3},"cited_work":{"arxiv_id":"2208.14226","doi":null,"metadata_source":"pith","pith_arxiv_id":"2208.14226","snapshot_observed_at":"2026-08-06T23:34:50.666018Z","title":"Unsupervised Representation Learning in Deep Reinforcement Learning: A Review","venue":"cs.LG","work_id":"7e3eca1e-4abc-41ae-b6e7-61e04cd8108b","year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:32.317937Z"},"links":{"cited_paper":"/paper/2208.14226","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:c7fbe56d4f04d6ce064402d9330b1c8d7b442fc455cf35be3fa136feff91ebf4","observation_id":"2619fb39-ead0-4c0b-8f64-469fe06d1997","resolution":{"observed_at":"2026-08-06T23:34:50.746395Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:32.420685Z","title":"Barlowrl: Barlow twins for data-efficient reinforcement learning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:32.420685Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:a6d8964ba6e4f8974c63a0779471bf29e15eb68d9a81e06d2bb0ae2e4d703c4f","observation_id":"56feb069-faba-436e-8b84-adafa5f7a471","resolution":{"observed_at":"2026-08-06T23:34:32.420685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:32.562977Z","title":"Scalable methods for computing state similarity in deterministic markov decision processes","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:32.562977Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:17e01af500cc2b835c27d6b7fee302df25a915158161123275816085a0ed8afd","observation_id":"2c7a5e28-6427-413e-8fa0-4eecf71701f8","resolution":{"observed_at":"2026-08-06T23:34:32.562977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:32.724712Z","title":"MIC o: Improved representations via sampling-based state similarity for markov decision processes","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:32.724712Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:4f44f4293a3d60623d45ef114d5135e245566e42ee146af13ed42558fc6311e4","observation_id":"ad3d8022-57be-4282-8bb6-a97501533644","resolution":{"observed_at":"2026-08-06T23:34:32.724712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:32.803959Z","title":"Learning action representations for reinforcement learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:32.803959Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:d06795c445dfc464c7b31b64239cc4f16608982a94bacab5b73fbca7284e52ce","observation_id":"0e012f29-b1e3-4c92-8aa2-ab8664145258","resolution":{"observed_at":"2026-08-06T23:34:32.803959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:32.914761Z","title":"Why do we need large batchsizes in contrastive learning? a gradient-bias perspective","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:32.914761Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:9194a78807497d3c76fbf3ef9e76ea012e4476a35b2e7a245e3b6312f0249fee","observation_id":"92d5298a-6545-475a-8464-58e8249438eb","resolution":{"observed_at":"2026-08-06T23:34:32.914761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:33.016166Z","title":"Focus-then-decide: Segmentation-assisted reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:33.016166Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:65975b684730cbc9c59d35b50563b628ae7a6b11753cb3c62f0f21f090542531","observation_id":"e48246f5-0fa4-4c5d-97f8-e4df61955af3","resolution":{"observed_at":"2026-08-06T23:34:33.016166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:33.152839Z","title":"Learning representations via a robust behavioral metric for deep reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:33.152839Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:9b92f6195cc878fa39bf5cfd8d11351c25a8780ec296e199361b05bceefa6a5c","observation_id":"dade7f15-f3f4-494a-ab8b-70f658e21596","resolution":{"observed_at":"2026-08-06T23:34:33.152839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:33.337965Z","title":"State chrono representation for enhancing generalization in reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:33.337965Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:aa10f5fbd32e13d9d4e3294ddf81840b71cd3f44d06b4391c3923a07626eb5ba","observation_id":"e44909d6-4cad-49b3-b706-f5a7fc74aa5e","resolution":{"observed_at":"2026-08-06T23:34:33.337965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02651","last_updated":"2024-05-23T01:04:11Z","snapshot_observed_at":"2026-08-06T16:39:13.609184Z","submitted_at":"2024-02-05T00:48:56Z","title":"Vision-Language Models Provide Promptable Representations for Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02651","snapshot_observed_at":"2026-08-06T23:34:33.529555Z","title":"Vision-language models provide promptable representations for reinforcement learning, 2024 c","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:33.529555Z"},"links":{"cited_paper":"/paper/2402.02651","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:46fceaeed72a03c9e65831d740ab61daaa70569757fcbc700aababe5cdfaaeda","observation_id":"4aa79829-9bce-4be4-b816-064769238ad5","resolution":{"observed_at":"2026-08-06T23:34:33.529555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:33.656564Z","title":"Exploring simple siamese representation learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:33.656564Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:77462d0b60d1bae3b30e529bba97d489eb20fc8c2f7353a82be3e9c947e13166","observation_id":"1974af94-c7bb-43b1-9a62-fe563ec95f7c","resolution":{"observed_at":"2026-08-06T23:34:33.656564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:33.732315Z","title":"Mudalige, Katharina Muelling, and John M","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:33.732315Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:4c955912de05532c8af50e3ed9dec8d0c2b88719ebf594a51214b53130a5538d","observation_id":"248f4eb1-ed0f-4dd6-b78a-e9817ccd050c","resolution":{"observed_at":"2026-08-06T23:34:33.732315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:33.846466Z","title":"Provable benefit of multitask representation learning in reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:33.846466Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:64b7cc5790ea68c853c1f3c2feb473e08b9e813cf87d923240ac8d60cec07af0","observation_id":"1be9d304-2034-4e27-b33d-6304a32383e7","resolution":{"observed_at":"2026-08-06T23:34:33.846466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:33.966441Z","title":"Improving generalisation for temporal difference learning: The successor representation","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:33.966441Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:fb703151e96806a3b051762a91910aed46083b9a16c2d6ec775358b233531583","observation_id":"a3185252-2ef7-4eca-a1e5-0787cbf31e40","resolution":{"observed_at":"2026-08-06T23:34:33.966441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:34.093588Z","title":"Integrating state representation learning into deep reinforcement learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:34.093588Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:e0bcb815be8b64706fbe2e831ed2309a25e67135840a92304257d15915028a7c","observation_id":"249a0d35-e33f-40b8-b04b-c598d219ce36","resolution":{"observed_at":"2026-08-06T23:34:34.093588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16468","last_updated":"2024-06-24T09:16:59Z","snapshot_observed_at":"2026-07-06T18:35:54.300599Z","submitted_at":"2024-06-24T09:16:59Z","title":"The Hidden Pitfalls of the Cosine Similarity Loss","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16468","snapshot_observed_at":"2026-08-06T23:34:34.199169Z","title":"The hidden pitfalls of the cosine similarity loss","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:34.199169Z"},"links":{"cited_paper":"/paper/2406.16468","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:e2ec814bfeb1f388219280649c9cefcfb4305ae493ead253130c320016cd7904","observation_id":"247d2adb-97eb-4705-a285-04f5296570b4","resolution":{"observed_at":"2026-08-06T23:34:34.199169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:34.296516Z","title":"Provably efficient rl with rich observations via latent state decoding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:34.296516Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:7cf7e58e31da668417ba075ef91dc79d87a160385bc8bbf79fc7e6a5dee96318","observation_id":"0ea8e572-ee52-4b48-b4ea-934b237d19fc","resolution":{"observed_at":"2026-08-06T23:34:34.296516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.02224","last_updated":"2020-11-25T19:33:00Z","snapshot_observed_at":"2026-07-06T07:19:25.218264Z","submitted_at":"2018-12-05T21:00:44Z","title":"Adapting Auxiliary Losses Using Gradient Similarity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.02224","snapshot_observed_at":"2026-08-06T23:34:34.373838Z","title":"Czarnecki, Siddhant M","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:34.373838Z"},"links":{"cited_paper":"/paper/1812.02224","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:b39629d26da12f713628ddccf1e3b5e2d3b628f1e6255a1d9cf55cd1327d6502","observation_id":"52d1e052-1648-407e-a701-f30c4224a965","resolution":{"observed_at":"2026-08-06T23:34:34.373838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:34.475817Z","title":"Multi-view disentanglement for reinforcement learning with multiple cameras","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:34.475817Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:fad02b2dfd9f4a38f1eb6fbf7a1db1e05534e5b09e309a055a97ca089703d85e","observation_id":"5e7ef77a-933e-402d-b3a3-f772ddcd6f7b","resolution":{"observed_at":"2026-08-06T23:34:34.475817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:34.560683Z","title":"Hanna, and Stefano V Albrecht","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:34.560683Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:342342b11011cf128da156a37122c9210c1967179b94a09a01401d42cd6014b4","observation_id":"5f7a9eeb-dcbe-4932-94c2-e03269cefae5","resolution":{"observed_at":"2026-08-06T23:34:34.560683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:34.640892Z","title":"Conditional mutual information for disentangled representations in reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:34.640892Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:11edf170c6cb869ec9597acc6f54f8df23096fb0606007db719ec7c1001b6bb4","observation_id":"0aafa79e-c019-4a88-bc8d-f0c2c87e6696","resolution":{"observed_at":"2026-08-06T23:34:34.640892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:34.789507Z","title":"Provable benefits of representational transfer in reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:34.789507Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:145e922faf91d250f51837420656bb1b75c4a9eba86f5d900c9b2dcf857829c8","observation_id":"769176f0-4365-4a03-aa81-988eafb6751e","resolution":{"observed_at":"2026-08-06T23:34:34.789507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:34.959646Z","title":"Dribo: Robust deep reinforcement learning via multi-view information bottleneck","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:34.959646Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:95a272583bcf1722922977257bac9d381bd545fb2b8599d913b88038a8a994fb","observation_id":"7dae1c0f-864c-4e9e-99d9-c9d633a39f6c","resolution":{"observed_at":"2026-08-06T23:34:34.959646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12567","last_updated":"2023-04-25T04:25:08Z","snapshot_observed_at":"2026-07-06T15:19:39.223171Z","submitted_at":"2023-04-25T04:25:08Z","title":"Proto-Value Networks: Scaling Representation Learning with Auxiliary Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.12567","snapshot_observed_at":"2026-08-06T23:34:35.083341Z","title":"Bellemare","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:35.083341Z"},"links":{"cited_paper":"/paper/2304.12567","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:b369b2e1b7b74b2dc8c1129cbe78357d569699ee7f1510f491fbf322a6df167d","observation_id":"ec63ff41-2aec-4ab2-97a1-0e9ff0cbbfad","resolution":{"observed_at":"2026-08-06T23:34:35.083341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.06865","last_updated":"2019-02-28T18:32:24Z","snapshot_observed_at":"2026-07-06T07:33:58.446265Z","submitted_at":"2019-02-19T02:36:14Z","title":"Hyperbolic Discounting and Learning over Multiple Horizons","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.06865","snapshot_observed_at":"2026-08-06T23:34:35.200811Z","title":"Hyperbolic discounting and learning over multiple horizons","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:35.200811Z"},"links":{"cited_paper":"/paper/1902.06865","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:c8cb2082225620520adfe2d1ceefce85fa7c2a7a956b3a49499daa6953a312cf","observation_id":"52ea7c01-1655-40b0-88f1-910a0bd89cf5","resolution":{"observed_at":"2026-08-06T23:34:35.200811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1207.4114","last_updated":"2012-07-11T14:43:04Z","snapshot_observed_at":"2026-07-06T02:52:02.941345Z","submitted_at":"2012-07-11T14:43:04Z","title":"Metrics for Finite Markov Decision Processes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1207.4114","snapshot_observed_at":"2026-08-06T23:34:35.347118Z","title":"Metrics for finite markov decision processes","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:35.347118Z"},"links":{"cited_paper":"/paper/1207.4114","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:bc9cfd2f2b2c9a0ddf73b9fefa560cd1efb045866da7597d316fc443f24c171f","observation_id":"0d3781db-7163-44f7-93ae-c881c3318f8a","resolution":{"observed_at":"2026-08-06T23:34:35.347118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.00943","last_updated":"2019-01-03T23:49:09Z","snapshot_observed_at":"2026-07-06T07:24:50.979679Z","submitted_at":"2019-01-03T23:49:09Z","title":"Self-supervised Learning of Image Embedding for Continuous Control","version":1},"cited_work":{"arxiv_id":"1901.00943","doi":null,"metadata_source":"pith","pith_arxiv_id":"1901.00943","snapshot_observed_at":"2026-08-06T23:34:50.406214Z","title":"Self-supervised Learning of Image Embedding for Continuous Control","venue":"cs.LG","work_id":"c085693b-022d-486d-a500-6f4b82527b17","year":2019},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:35.455306Z"},"links":{"cited_paper":"/paper/1901.00943","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:9ae16db8048ff4774682a21e4d7b8dfe19dd0761d450b2fcdffde5eb5a851b31","observation_id":"247920c0-a5e6-420c-a29b-e68af30476d1","resolution":{"observed_at":"2026-08-06T23:34:50.432408Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:35.531471Z","title":"For sale: State-action representation learning for deep reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:35.531471Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:aed854fc8129c67d78b068e95a4e847d63acf1533bf5a57ba51ef3fca6f934fe","observation_id":"0245ae6f-8232-4548-b34a-61184b23c1d9","resolution":{"observed_at":"2026-08-06T23:34:35.531471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16142","last_updated":"2025-01-27T15:36:37Z","snapshot_observed_at":"2026-07-06T20:26:46.276053Z","submitted_at":"2025-01-27T15:36:37Z","title":"Towards General-Purpose Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16142","snapshot_observed_at":"2026-08-06T23:34:35.620176Z","title":"Towards general-purpose model-free reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:35.620176Z"},"links":{"cited_paper":"/paper/2501.16142","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:36bd5c40202d369d0c905887c4fcac71b360784b3ccc7850e8f8a95957ebd122","observation_id":"d4b0f8b5-cc20-45b9-bed2-1406b5bfb2b8","resolution":{"observed_at":"2026-08-06T23:34:35.620176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:35.673088Z","title":"Rankme: Assessing the downstream performance of pretrained self-supervised representations by their rank","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:35.673088Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:2ca1db0d882c7d94260ab6981c7b8c0303d6ecd549b1ad3f9c272ab3331a1568","observation_id":"3d2ecb1d-08cd-4a12-a7b2-92a45a182603","resolution":{"observed_at":"2026-08-06T23:34:35.673088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-06T23:34:35.739408Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:35.739408Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:1dfa39115965137b73c87abe6e0e5f868d7e1e2995df59e770f6e289c2c309bb","observation_id":"fe9b8ed9-e92e-44c5-8d57-8c22feb906e1","resolution":{"observed_at":"2026-08-06T23:34:35.739408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:35.796368Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:35.796368Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:818fac783d3cf531bd16557704df617993f2c26eb8019c28a80b15c67caa209b","observation_id":"df0d1b2d-0bce-4672-9c03-a6f1cb2fa667","resolution":{"observed_at":"2026-08-06T23:34:35.796368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:35.916056Z","title":"Visualizing and understanding atari agents","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:35.916056Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:df305447f23101bf27db54d06d6495474f580c4fc47776624f2cb2a637f5a251","observation_id":"ae35fd39-5e53-4b9e-b7ab-5588b39982c1","resolution":{"observed_at":"2026-08-06T23:34:35.916056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.001995Z","title":"Bootstrap your own latent-a new approach to self-supervised learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:36.001995Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:cd7a834b7b58dcbb099fabbc18e02a2082dce5376c3ab6b5141d1a11d6fb5ffa","observation_id":"eca950bb-7425-4834-9125-57c302468bf8","resolution":{"observed_at":"2026-08-06T23:34:36.001995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.14646","last_updated":"2020-04-30T09:09:41Z","snapshot_observed_at":"2026-07-06T09:16:29.097337Z","submitted_at":"2020-04-30T09:09:41Z","title":"Bootstrap Latent-Predictive Representations for Multitask Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.14646","snapshot_observed_at":"2026-08-06T23:34:36.114222Z","title":"Bootstrap latent-predictive representations for multitask reinforcement learning","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:36.114222Z"},"links":{"cited_paper":"/paper/2004.14646","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:cccb0a82e4e8b31fc2f5d5713fabf76793c8420dbac03f9ace2df20e0a5a0ab2","observation_id":"fe79a99b-7be5-4b09-a73b-94efda088bd3","resolution":{"observed_at":"2026-08-06T23:34:36.114222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.221641Z","title":"Stabilizing deep q-learning with convnets and vision transformers under data augmentation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:36.221641Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:f10dd2dc4cd62b0a8eef44e8edc32fc9ef4e8703c58111562a6305401a75c2d5","observation_id":"1bba53d9-760b-481c-b512-251f2567ba96","resolution":{"observed_at":"2026-08-06T23:34:36.221641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.304016Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:36.304016Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:ad7c6fade9283ff55fd5cfdcdd6fa979baf3d75204a9a30400080c8b5daf9a17","observation_id":"e4c8e298-9480-419b-8506-7eced093effa","resolution":{"observed_at":"2026-08-06T23:34:36.304016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.386222Z","title":"Rainbow: Combining improvements in deep reinforcement learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:36.386222Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:2de9ff761b920bf379e6547d979087938255b4d401990e88671ef1fd0797de58","observation_id":"3319eecb-fbf2-4385-a9d8-20ad59358d79","resolution":{"observed_at":"2026-08-06T23:34:36.386222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.466449Z","title":"Multi-task deep reinforcement learning with popart","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:36.466449Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:1882006f3136434d187b2076adb7ec726ffef1398f3b61a42ad236e181b4ab08","observation_id":"e42fb4a2-6188-4938-8fb3-35b3692031e4","resolution":{"observed_at":"2026-08-06T23:34:36.466449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.568115Z","title":"Burgess, Xavier Glorot, Matthew M","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:36.568115Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:52fec67c2a07d27adfa965b39a7979dca432e49728f099579142f64e327ee584","observation_id":"d658735c-0c9c-4693-9503-2df3f5d78b0f","resolution":{"observed_at":"2026-08-06T23:34:36.568115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.642169Z","title":"Darla: Improving zero-shot transfer in reinforcement learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:36.642169Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:c4d18b9aef888da7c387d73d8dfecf639fd3137d627d741690837745d3365bb2","observation_id":"20063910-070a-40ae-8551-acb7357e343d","resolution":{"observed_at":"2026-08-06T23:34:36.642169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1808.06670","last_updated":"2019-02-22T18:38:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-08-20T19:52:51Z","title":"Learning deep representations by mutual information estimation and maximization","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.06670","snapshot_observed_at":"2026-08-06T23:34:36.711613Z","title":"Learning deep representations by mutual information estimation and maximization","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:36.711613Z"},"links":{"cited_paper":"/paper/1808.06670","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:9471b6ad39ccb85129f3d79f073101374c439c49d0cd1c3ea24c82042fb67bdd","observation_id":"e0e82cff-cc47-44db-942c-9e862567aa81","resolution":{"observed_at":"2026-08-06T23:34:36.711613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.855098Z","title":"Revisiting data augmentation in deep reinforcement learning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:36.855098Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:f724d8728eb7f92eed38ce586f04993db59049042eaeb3e9ecf568f5d8caa8fb","observation_id":"8bec8ca3-b945-41f2-90d3-e3da9bf3c7ce","resolution":{"observed_at":"2026-08-06T23:34:36.855098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:37.022592Z","title":"Spectrum random masking for generalization in image-based reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:37.022592Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:e9a5a9855f7f17e0bbf2d94d22e10f4d8b65d5bfd713312b57f6ea0f147e3731","observation_id":"1eda50b0-e177-42c7-a462-77a8cbae59a0","resolution":{"observed_at":"2026-08-06T23:34:37.022592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:37.261134Z","title":"Generalization in reinforcement learning with selective noise injection and information bottleneck","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:37.261134Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:d9ef949aca78ae63942c19a7f75e7a47916096e461a5fe2806d06322742de609","observation_id":"c01cccb3-b34b-4609-8163-e87fd82749fd","resolution":{"observed_at":"2026-08-06T23:34:37.261134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:37.449983Z","title":"Zero-shot reinforcement learning via function encoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:37.449983Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:25253ed00e8371d74b365088f0c135ef2154b9b9b4d04aad7315f79d4b512157","observation_id":"0433bb9d-31b3-4215-9bcc-8f11a457e792","resolution":{"observed_at":"2026-08-06T23:34:37.449983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:37.588177Z","title":"Offline multitask representation learning for reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:37.588177Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:769aea2ad36a5e14f688e164e14adf925a346873ea4431c367cd94edd5e1a905","observation_id":"0d12324e-724e-4463-a270-a5083354bba0","resolution":{"observed_at":"2026-08-06T23:34:37.588177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:37.663016Z","title":"Principled offline rl in the presence of rich exogenous information","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:37.663016Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:606b57e4fd75567253373501541520f947028d8c05959d89cd35753b38084300","observation_id":"7be4c4ed-aeee-4cbe-8eda-9393ce835ad4","resolution":{"observed_at":"2026-08-06T23:34:37.663016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:37.743091Z","title":"Representation learning in deep rl via discrete information bottleneck","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:37.743091Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:26b99ee38b23d82bb532daa5c4a4b9679ff17327df8fe801fdc0fce672901f85","observation_id":"65ac7c63-354d-422b-a49e-774ee331824f","resolution":{"observed_at":"2026-08-06T23:34:37.743091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:37.839439Z","title":"Zero-shot reinforcement learning from low quality data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:37.839439Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:8ba03534a334290affb3d041e82bf588f9239754f3bac087bd1715b5dcbe126d","observation_id":"9c91ce1a-d6fc-4b13-a839-2584aca7db98","resolution":{"observed_at":"2026-08-06T23:34:37.839439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:37.956454Z","title":"Contextual decision processes with low bellman rank are pac-learnable","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:37.956454Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:20f5cb4a81014b867507dd80e6ce0b5aa55acf4ae9f5408bda691b2db8aea561","observation_id":"b709a84a-fdaf-452f-a4d8-14eb2231df6f","resolution":{"observed_at":"2026-08-06T23:34:37.956454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.14188","last_updated":"2021-09-29T04:22:49Z","snapshot_observed_at":"2026-07-06T11:52:29.573608Z","submitted_at":"2021-09-29T04:22:49Z","title":"Information-Bottleneck-Based Behavior Representation Learning for Multi-agent Reinforcement learning","version":1},"cited_work":{"arxiv_id":"2109.14188","doi":null,"metadata_source":"pith","pith_arxiv_id":"2109.14188","snapshot_observed_at":"2026-08-06T23:34:50.161514Z","title":"Information-Bottleneck-Based Behavior Representation Learning for Multi-agent Reinforcement learning","venue":"cs.LG","work_id":"a0c9b59f-85f0-4005-ad10-33d61fc88c1b","year":2021},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:38.133164Z"},"links":{"cited_paper":"/paper/2109.14188","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:1582958d640085c2948c0525fffa0497dcb9aadc723aea4b75870b0362bf5e59","observation_id":"7d7f1d07-9b23-4454-b864-4851c395dc9d","resolution":{"observed_at":"2026-08-06T23:34:50.236797Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.09805","last_updated":"2017-07-24T12:15:40Z","snapshot_observed_at":"2026-07-06T05:44:30.594509Z","submitted_at":"2017-05-27T11:17:49Z","title":"PVEs: Position-Velocity Encoders for Unsupervised Learning of Structured State Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.09805","snapshot_observed_at":"2026-08-06T23:34:38.254561Z","title":"Riedmiller","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:38.254561Z"},"links":{"cited_paper":"/paper/1705.09805","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:189eb25ac4a51aa9944aedf176b7af05d15effce3a569093a0210c936d0a251a","observation_id":"e1d3cdb0-89c9-420a-b031-d3b7b0f09b42","resolution":{"observed_at":"2026-08-06T23:34:38.254561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:38.443902Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:38.443902Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:4ffbf4171a3d9bf1ae4999e7f832b0bbf9024ea824ab6e7690b09f15774e0fb9","observation_id":"31800c70-4ce7-4a0a-9ece-0ff30c243311","resolution":{"observed_at":"2026-08-06T23:34:38.443902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:38.671178Z","title":"Scaling up multi-task robotic reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:38.671178Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:1cdf1e7dd8e5def9b22d186b3450f227670e182edd54cf0e7acf1a8023544b59","observation_id":"c85309c9-25de-4d18-b020-ccf4c33d33cc","resolution":{"observed_at":"2026-08-06T23:34:38.671178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:38.806508Z","title":"Terminal prediction as an auxiliary task for deep reinforcement learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:38.806508Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:295f707c7641755c6381a2d9826b66f885e3701417180b5918ca63cf484e4931","observation_id":"a710befc-6a13-4041-b862-654ee240e9bd","resolution":{"observed_at":"2026-08-06T23:34:38.806508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14096","last_updated":"2021-10-27T00:32:07Z","snapshot_observed_at":"2026-08-06T08:41:55.367764Z","submitted_at":"2021-10-27T00:32:07Z","title":"Towards Robust Bisimulation Metric Learning","version":1},"cited_work":{"arxiv_id":"2110.14096","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.14096","snapshot_observed_at":"2026-08-06T23:34:49.829499Z","title":"Towards Robust Bisimulation Metric Learning","venue":"cs.LG","work_id":"6c4cce6a-ead1-49ea-b540-d95e5005d261","year":2021},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:38.893179Z"},"links":{"cited_paper":"/paper/2110.14096","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:191c9bcea6fd6701c8b80139996ae2f98a640a00cef892029e0a8724f3606efa","observation_id":"5f860681-6a52-44bd-8162-3a08283fc4dc","resolution":{"observed_at":"2026-08-06T23:34:49.900073Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02035","last_updated":"2024-06-04T07:22:12Z","snapshot_observed_at":"2026-07-30T23:49:31.630655Z","submitted_at":"2024-06-04T07:22:12Z","title":"A Unifying Framework for Action-Conditional Self-Predictive Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2406.02035","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.02035","snapshot_observed_at":"2026-08-06T23:34:49.588127Z","title":"A Unifying Framework for Action-Conditional Self-Predictive Reinforcement Learning","venue":"cs.LG","work_id":"8c8dae54-9c1c-4778-9b34-8a3973556098","year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.068965Z"},"links":{"cited_paper":"/paper/2406.02035","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:e405a534bd3bf1bbbe2dc6020954b0d22f1961e4e9ca8f18d4cc6390b57d9f30","observation_id":"f0c82f2f-9e5e-49b2-833d-cb51c9ae672b","resolution":{"observed_at":"2026-08-06T23:34:49.702870Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06037","last_updated":"2024-06-10T06:06:38Z","snapshot_observed_at":"2026-07-06T18:27:58.433967Z","submitted_at":"2024-06-10T06:06:38Z","title":"Investigating Pre-Training Objectives for Generalization in Vision-Based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2406.06037","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.06037","snapshot_observed_at":"2026-08-06T23:34:49.333636Z","title":"Investigating Pre-Training Objectives for Generalization in Vision-Based Reinforcement Learning","venue":"cs.LG","work_id":"2d6e3272-59c0-4c8c-af26-13b5baf0ca23","year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.159134Z"},"links":{"cited_paper":"/paper/2406.06037","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:6144c27af8d4a11d6421b4be6b0cd59b8d17c8cd6ccac1b250809e4795800b73","observation_id":"744b1512-e3c0-45ec-9d1e-50d5ebdc8aab","resolution":{"observed_at":"2026-08-06T23:34:49.424737Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-06T23:34:39.165844Z","title":"Auto-encoding variational bayes","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.165844Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:61063b95b558b3c913ad7e93ff6889f247d7f5755152a4bb0585dad9e4a2da2b","observation_id":"0dbccc72-5fb9-4044-918e-4a195eee8286","resolution":{"observed_at":"2026-08-06T23:34:39.165844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.13649","last_updated":"2021-03-07T16:37:37Z","snapshot_observed_at":"2026-08-04T06:44:16.616319Z","submitted_at":"2020-04-28T16:48:16Z","title":"Image Augmentation Is All You Need: Regularizing Deep Reinforcement Learning from Pixels","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.13649","snapshot_observed_at":"2026-08-06T23:34:39.216865Z","title":"Image augmentation is all you need: Regularizing deep reinforcement learning from pixels","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.216865Z"},"links":{"cited_paper":"/paper/2004.13649","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:89fb5e7c43487a91a1dc132ebfe8a1a3658c319f5b83a62addc2267ba65196b0","observation_id":"8fe5094d-cd03-427a-a807-38d940521959","resolution":{"observed_at":"2026-08-06T23:34:39.216865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:39.274360Z","title":"Pac reinforcement learning with rich observations","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.274360Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:0f4cf2ac39eeafe5800de441b534d7b495d1f4c89be83d9c951e51bc6e86ac79","observation_id":"89f31156-3149-4ae3-baab-e01d2f9308ec","resolution":{"observed_at":"2026-08-06T23:34:39.274360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:39.320161Z","title":"Guaranteed discovery of control-endogenous latent states with multi-step inverse models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.320161Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:2cc6d55ad41d9011e8937711e80221c4589e9a10172627e77ec8f368b7cf87ab","observation_id":"6bf1343d-dd05-4ffd-85eb-2a06c9066dc6","resolution":{"observed_at":"2026-08-06T23:34:39.320161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.14990","last_updated":"2020-11-05T06:04:50Z","snapshot_observed_at":"2026-08-05T15:54:05.188657Z","submitted_at":"2020-04-30T17:35:32Z","title":"Reinforcement Learning with Augmented Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.14990","snapshot_observed_at":"2026-08-06T23:34:39.383806Z","title":"Reinforcement learning with augmented data","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.383806Z"},"links":{"cited_paper":"/paper/2004.14990","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:7b78c25f639938b2dedc249619e5e5b2b6adaaed282b9e52b55ae793339a3f80","observation_id":"4f218946-ab8e-4744-b4c3-a7b34b8e74de","resolution":{"observed_at":"2026-08-06T23:34:39.383806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:39.433199Z","title":"Metrics and continuity in reinforcement learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.433199Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:0d4913f0e8308b4eff9c31b56c2819d6c689d9f2ae9c499bbd412fc88a53fd4d","observation_id":"a2fa7013-cd29-4408-868a-d9aa59bf8b5d","resolution":{"observed_at":"2026-08-06T23:34:39.433199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:39.490486Z","title":"A path towards autonomous machine intelligence version 0.9","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.490486Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:fa387aec2ada97b432eaa0b206bec0df501ae6ad6562db8ebea1da24869dbeba","observation_id":"90edb0d9-672e-4a28-8ef6-c372ec1c25e6","resolution":{"observed_at":"2026-08-06T23:34:39.490486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1709.05185","last_updated":"2017-09-15T13:15:58Z","snapshot_observed_at":"2026-07-06T05:59:49.044637Z","submitted_at":"2017-09-15T13:15:58Z","title":"Unsupervised state representation learning with robotic priors: a robustness benchmark","version":1},"cited_work":{"arxiv_id":"1709.05185","doi":null,"metadata_source":"pith","pith_arxiv_id":"1709.05185","snapshot_observed_at":"2026-08-06T23:34:49.111460Z","title":"Unsupervised state representation learning with robotic priors: a robustness benchmark","venue":"cs.AI","work_id":"478335c6-f17d-4a73-b658-05b76ff3ff80","year":2017},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.629835Z"},"links":{"cited_paper":"/paper/1709.05185","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:5d6b7783e01f4cd681b581166136068436caf48e28e47af80f545c004d4ed9a0","observation_id":"fb10e4d9-1a12-48df-8e88-fa51638cb088","resolution":{"observed_at":"2026-08-06T23:34:49.177840Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.04181","last_updated":"2018-06-05T13:52:23Z","snapshot_observed_at":"2026-07-06T06:22:57.064023Z","submitted_at":"2018-02-12T16:53:48Z","title":"State Representation Learning for Control: An Overview","version":2},"cited_work":{"arxiv_id":"1802.04181","doi":null,"metadata_source":"pith","pith_arxiv_id":"1802.04181","snapshot_observed_at":"2026-08-06T23:34:48.904734Z","title":"State Representation Learning for Control: An Overview","venue":"cs.AI","work_id":"de8c303f-128c-4b63-b572-84fef00760b4","year":2018},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.756981Z"},"links":{"cited_paper":"/paper/1802.04181","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:8323f6ad3a05bd6bb5e847f44e81467cbfead957c570cd60f5599c0924229b6a","observation_id":"453d13b6-58a2-45eb-89f8-95f7d3a24ff5","resolution":{"observed_at":"2026-08-06T23:34:48.979376Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:39.836538Z","title":"Normalization enhances generalization in visual reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.836538Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:02f4fd25e7149c49cb90db1612e1f1d6aef38794e9f64f15cce8129b16e223c0","observation_id":"e7d23b61-9307-4e5b-be45-8bcdc6ae0445","resolution":{"observed_at":"2026-08-06T23:34:39.836538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:39.891192Z","title":"Provable general function class representation learning in multitask bandits and mdp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.891192Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:c791d24643c5e60e71dfa5cd8c8f036b6719335ad84f7161f4365281a5df861b","observation_id":"c02c11b6-0b44-485c-ad2f-cbf3405d2689","resolution":{"observed_at":"2026-08-06T23:34:39.891192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.13089","last_updated":"2021-02-25T18:56:11Z","snapshot_observed_at":"2026-07-06T10:44:44.451935Z","submitted_at":"2021-02-25T18:56:11Z","title":"On The Effect of Auxiliary Tasks on Representation Dynamics","version":1},"cited_work":{"arxiv_id":"2102.13089","doi":null,"metadata_source":"pith","pith_arxiv_id":"2102.13089","snapshot_observed_at":"2026-08-06T23:34:48.629536Z","title":"On The Effect of Auxiliary Tasks on Representation Dynamics","venue":"cs.LG","work_id":"f91f7830-0d30-4197-88ce-f196b0a24710","year":2021},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.980915Z"},"links":{"cited_paper":"/paper/2102.13089","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:cdf9d587bf86235e92197481d50e13f756e8be08c081400af35aa77af7a2182d","observation_id":"e7eb5e7d-1038-4773-8ba9-97e034c0e064","resolution":{"observed_at":"2026-08-06T23:34:48.676098Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04561","last_updated":"2024-10-21T14:11:42Z","snapshot_observed_at":"2026-07-06T14:03:01.528958Z","submitted_at":"2022-10-10T11:01:57Z","title":"A Comprehensive Survey of Data Augmentation in Visual Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04561","snapshot_observed_at":"2026-08-06T23:34:40.091630Z","title":"A comprehensive survey of data augmentation in visual reinforcement learning, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:40.091630Z"},"links":{"cited_paper":"/paper/2210.04561","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:d3b3eab91b567062afcb316dd0874f3e3b56d1e7b6fb1c3fe62daf038b81dcd2","observation_id":"51bcdc9a-5394-4412-932f-b6e6ec3ea9ff","resolution":{"observed_at":"2026-08-06T23:34:40.091630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:40.183919Z","title":"Revisiting plasticity in visual reinforcement learning: Data, modules and training stages","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:40.183919Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:30ac454e56921590c9907b95acc1c441722b045e058830595eb6bd961a8ed08f","observation_id":"a91ebd6d-25b4-4462-894d-84d4a62889e3","resolution":{"observed_at":"2026-08-06T23:34:40.183919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.00030","last_updated":"2023-03-07T02:29:59Z","snapshot_observed_at":"2026-08-02T00:17:16.761436Z","submitted_at":"2022-09-30T18:14:07Z","title":"VIP: Towards Universal Visual Reward and Representation via Value-Implicit Pre-Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.00030","snapshot_observed_at":"2026-08-06T23:34:40.275191Z","title":"Vip: Towards universal visual reward and representation via value-implicit pre-training, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:40.275191Z"},"links":{"cited_paper":"/paper/2210.00030","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:532b5b35731da110f037db05f5b1fb9b84b7c245c8cbef2c47069ea048ac6444","observation_id":"567422ef-5732-429e-abac-83880cf997ca","resolution":{"observed_at":"2026-08-06T23:34:40.275191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:40.386436Z","title":"Where are we in the search for an artificial visual cortex for embodied intelligence? Advances in Neural Information Processing Systems, 36: 0 655--677, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:40.386436Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:8fb680f149f11aea2900d51dafc6f01f3c8d15359200330bb5c2177bd05d861b","observation_id":"8fb15b68-72f8-48fa-9d00-88093d78969a","resolution":{"observed_at":"2026-08-06T23:34:40.386436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:40.542795Z","title":"Deep reinforcement and infomax learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:40.542795Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:d910a0ad2114bcee7271478965a2682cf52e93fa37125791e37f762e68681632","observation_id":"7fb0d396-eee1-45ca-8b00-4bfa7703e8e4","resolution":{"observed_at":"2026-08-06T23:34:40.542795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:40.720190Z","title":"Multi-horizon representations with hierarchical forward models for reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:40.720190Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:bc1d944fd2c81bd0ee4412454e669d3b75fabad607f156312fbe0b9ec4056599","observation_id":"934a1bf8-71fe-4c20-8892-6045ae85f9c7","resolution":{"observed_at":"2026-08-06T23:34:40.720190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13765","last_updated":"2024-03-20T17:28:17Z","snapshot_observed_at":"2026-08-01T20:23:16.143117Z","submitted_at":"2024-03-20T17:28:17Z","title":"Towards Principled Representation Learning from Videos for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13765","snapshot_observed_at":"2026-08-06T23:34:40.760414Z","title":"Towards principled representation learning from videos for reinforcement learning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:40.760414Z"},"links":{"cited_paper":"/paper/2403.13765","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:ef41be50f5cae22b5506c24e0b742eac45aa9ff0b519bed7fe50f8f8fed83f83","observation_id":"248ddb6e-8d6f-42f7-9245-1ea4c28fb5c0","resolution":{"observed_at":"2026-08-06T23:34:40.760414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-06T23:34:40.865066Z","title":"Riedmiller","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:40.865066Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:7a79270d4eae17b822e0bf662862a2254e65b487d6f1037021e6b28c9f52541c","observation_id":"0f6b23f9-3eb1-4c57-9a74-015de97bc54f","resolution":{"observed_at":"2026-08-06T23:34:40.865066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.02500","last_updated":"2019-06-06T10:02:52Z","snapshot_observed_at":"2026-07-06T07:58:24.206559Z","submitted_at":"2019-06-06T10:02:52Z","title":"Towards Interpretable Reinforcement Learning Using Attention Augmented Agents","version":1},"cited_work":{"arxiv_id":"1906.02500","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.02500","snapshot_observed_at":"2026-08-06T23:34:48.205298Z","title":"Towards Interpretable Reinforcement Learning Using Attention Augmented Agents","venue":"cs.LG","work_id":"2168d75b-1a8d-4e42-9c38-617b5a5d2525","year":2019},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:40.942699Z"},"links":{"cited_paper":"/paper/1906.02500","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:03ee4c23c1d87f210909e110c2c1aa0c5ca3910b2cf2bc920e3cfed740f827d9","observation_id":"c766b3fe-7979-4301-9978-5fffa20c34fb","resolution":{"observed_at":"2026-08-06T23:34:48.339822Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:41.037102Z","title":"R3m: A universal visual representation for robot manipulation, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:41.037102Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:eccd4dffae50ca5fbae0c597920abfadf588c315b7007f65fd979caf5aa7a533","observation_id":"ea189003-f8f4-4171-ab06-f01a02fe996c","resolution":{"observed_at":"2026-08-06T23:34:41.037102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:41.090842Z","title":"Bridging state and history representations: Understanding self-predictive rl, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:41.090842Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:7759c30a1d516a6c5be5e6644701083496ad409c35a73614f3998cc8f20fcf00","observation_id":"ca1dcd19-da73-42e5-960c-7d4f0b9a39e0","resolution":{"observed_at":"2026-08-06T23:34:41.090842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:41.099059Z","title":"Foundation policies with H ilbert representations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:41.099059Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:a1cc9659f8f5fc1831996ed31a91cbfa778b9ac069e8a37650902336fa5a2f86","observation_id":"eb4a3993-ec1e-41fd-9423-4d58fd144a9c","resolution":{"observed_at":"2026-08-06T23:34:41.099059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T13:30:27.787034Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":89,"verified_exact":11,"verified_fuzzy":0},"total_outbound_references":157},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 100 of 157 outbound references and 6 inbound Pith citation observations for arXiv:2506.17518."}