{"as_of":"2026-08-07T07:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:938624f88036027c60438056d64f7048110a1273f43c45a2c7403e93e5bc1676","coverage":[{"denominator":77,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":77,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:57:01.366993Z","state":"measured"},{"denominator":78,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":78,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T13:52:43.033237Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T18:46:10.774659Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2507.14748","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.14748","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Skill learning via policy diversity yields identifiable representations for reinforcement learning","venue":null,"work_id":"b6d5d381-7f56-4c05-8b35-9d880e092601","year":2025},"citing_paper":{"arxiv_id":"2605.06145","last_updated":"2026-05-07T12:40:49Z","snapshot_observed_at":"2026-08-03T04:29:49.815774Z","submitted_at":"2026-05-07T12:40:49Z","title":"Unifying Goal-Conditioned RL and Unsupervised Skill Learning via Control-Maximization","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-08T13:52:43.033237Z"},"links":{"cited_paper":"/paper/2507.14748","citing_paper":"/paper/2605.06145"},"observation_digest":"sha256:51757aca38b5f197e86597732915db018616285f69d8cb623ea7f01596b0db0e","observation_id":"fddea20a-55cc-4c8e-89b2-870e83a32e70","resolution":{"observed_at":"2026-05-11T18:46:10.776690Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.14748/citation-record","integrity":"/paper/2507.14748/integrity","json":"/paper/2507.14748/citation-record.json","paper":"/paper/2507.14748"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1807.10299","last_updated":"2018-07-26T18:05:45Z","snapshot_observed_at":"2026-07-06T06:52:34.374453Z","submitted_at":"2018-07-26T18:05:45Z","title":"Variational Option Discovery Algorithms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.10299","snapshot_observed_at":"2026-08-06T15:56:53.346720Z","title":"Variational option discovery algorithms","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:53.346720Z"},"links":{"cited_paper":"/paper/1807.10299","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:d689709af5e2ffae6869c2fb7d48071fc16fc1e881bad714dd9f88b924b1679e","observation_id":"fc139d4b-d7ff-4d8a-9808-103d570122ff","resolution":{"observed_at":"2026-08-06T15:56:53.346720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01399","last_updated":"2024-10-15T13:16:13Z","snapshot_observed_at":"2026-08-07T00:05:16.454748Z","submitted_at":"2024-02-02T13:31:17Z","title":"A Probabilistic Model Behind Self-Supervised Learning","version":3},"cited_work":{"arxiv_id":"2402.01399","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.01399","snapshot_observed_at":"2026-08-06T15:57:04.021257Z","title":"A Probabilistic Model Behind Self-Supervised Learning","venue":"cs.LG","work_id":"31df0f7e-7e74-45fd-b798-27346e38b165","year":2024},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:53.588444Z"},"links":{"cited_paper":"/paper/2402.01399","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:d95d35c44e711a5619eca151a768a2a069115a36a55fb98b3a1f2c4846f0856f","observation_id":"84416315-b512-400e-a7bd-85f7a3164e71","resolution":{"observed_at":"2026-08-06T15:57:04.081831Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.352340Z","title":"Large-Scale Study of Curiosity-Driven Learning","venue":null,"work_id":"ab2672e6-ae25-4ca6-a8d0-e4179f5c5612","year":null},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:53.821931Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:0d275fb15524f43018246253a79f0dc4724f9c47b4681557ab7f7ee97d62d011","observation_id":"6a78414d-e5f8-4018-9c15-69d6b516ad85","resolution":{"observed_at":"2026-08-06T15:57:05.357197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05709","last_updated":"2020-07-01T00:09:08Z","snapshot_observed_at":"2026-08-02T19:54:26.138356Z","submitted_at":"2020-02-13T18:50:45Z","title":"A Simple Framework for Contrastive Learning of Visual Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05709","snapshot_observed_at":"2026-08-06T15:56:53.882919Z","title":"A Simple Framework for Contrastive Learning of Visual Representations","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:53.882919Z"},"links":{"cited_paper":"/paper/2002.05709","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:ce4cc485e110e6d8dd575faba42530bd1e76082c6d68662d2b2b8506acb5a772","observation_id":"9511bc6a-7463-452e-85ec-7ff3df3d3dfb","resolution":{"observed_at":"2026-08-06T15:56:53.882919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.337170Z","title":"Varia- tional Empowerment as Representation Learning for Goal-Conditioned Reinforcement Learning","venue":null,"work_id":"0991c668-f133-4a1a-b2a5-35d4d87243d3","year":1953},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:53.947155Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:7f6dcb1231bf830d98ac7bdc9557d9ed08cfc1c562e0f18623d94911e24acc3b","observation_id":"f9cd7a29-86ec-44e0-9b00-bb9a1444bc6c","resolution":{"observed_at":"2026-08-06T15:57:05.341973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.321404Z","title":"Analyse des liaisons de probabilité","venue":null,"work_id":"89013637-04ba-48a0-817e-19d750594573","year":1947},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:54.031118Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:38bad9708b773d0f15ab467bd7aebce9aad5179ff462a4626c94f72f9013c5a4","observation_id":"d57e1b78-ae1c-4bb1-bbc6-c7e6f4071329","resolution":{"observed_at":"2026-08-06T15:57:05.326291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.304874Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","venue":null,"work_id":"3d8bb8fd-a63e-45fa-a45a-684d5cf2c97b","year":2025},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:54.083100Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:6ba34bba2f7050d5151588fb1396f3d7349f46ad99ff0b2a92fb044015456920","observation_id":"5c750ad4-d147-42d1-a499-6146bc7e9a4e","resolution":{"observed_at":"2026-08-06T15:57:05.309845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.06070","last_updated":"2018-10-09T23:19:52Z","snapshot_observed_at":"2026-07-06T06:23:52.853341Z","submitted_at":"2018-02-16T18:57:57Z","title":"Diversity is All You Need: Learning Skills without a Reward Function","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.06070","snapshot_observed_at":"2026-08-06T15:56:54.147425Z","title":"Diversity is All You Need: Learning Skills without a Reward Function, October 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:54.147425Z"},"links":{"cited_paper":"/paper/1802.06070","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:ad5647ee5f52030b61311825b782ed4335d18bf48457730ae2c40c86072a0f30","observation_id":"4e63888f-9e2d-4d4b-ae1c-ac3a3bed76b5","resolution":{"observed_at":"2026-08-06T15:56:54.147425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.289468Z","title":"Salakhutdi- nov","venue":null,"work_id":"83da864d-16c4-4dc0-9c54-512267e87b79","year":null},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:54.287029Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:eb728ad8d0b7fa1413b8baf1e1c96664d00961f380e310f8152c76541026f892","observation_id":"992877dc-bd99-41b6-8206-e1bf7952c6b7","resolution":{"observed_at":"2026-08-06T15:57:05.294233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.252233Z","title":"Contrastive Representations Make Planning Easy","venue":null,"work_id":"d8b6706b-a925-409b-887f-e75056850c37","year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:54.509083Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:d48d20605d01988a40aedf6486070dae966caff6119efb13fe77140c32b0a986","observation_id":"038088b2-cc83-4ca0-b68c-7da92f699276","resolution":{"observed_at":"2026-08-06T15:57:05.257469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.237481Z","title":"Wichmann","venue":null,"work_id":"2b7566e3-58b1-41ce-92e1-880cd3b3bf25","year":2020},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:54.609736Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:159bbdf104a097c968e032e53bc441f90bf53835c20d08366c4aba751f52f457","observation_id":"57037876-c6d0-4bad-b1fb-9db86ccecdd5","resolution":{"observed_at":"2026-08-06T15:57:05.242054Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.222129Z","title":"Variational Intrinsic Control","venue":null,"work_id":"bd92dfa8-9a12-4ca0-b0ee-f64577ef7f1a","year":2017},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:54.738230Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:bfe0b9669c1390b743041a66332af7fbe2873b6bea056b2d0a0f9a720e1e42e6","observation_id":"d6ff4a52-4fbf-436f-8400-a2a8c8f68849","resolution":{"observed_at":"2026-08-06T15:57:05.226619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.06642","last_updated":"2019-08-01T09:57:35Z","snapshot_observed_at":"2026-08-05T22:35:03.906008Z","submitted_at":"2019-05-16T10:27:04Z","title":"The Incomplete Rosetta Stone Problem: Identifiability Results for Multi-View Nonlinear ICA","version":2},"cited_work":{"arxiv_id":"1905.06642","doi":null,"metadata_source":"pith","pith_arxiv_id":"1905.06642","snapshot_observed_at":"2026-08-06T15:57:03.739967Z","title":"The Incomplete Rosetta Stone Problem: Identifiability Results for Multi-View Nonlinear ICA","venue":"stat.ML","work_id":"894a86b6-32da-494d-8241-b924ec630aa2","year":2019},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:54.785815Z"},"links":{"cited_paper":"/paper/1905.06642","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:cbad8f2a4d9e2dc5ae06ea186af7c984c046615bc77fd9311f09912e7326b2cc","observation_id":"520a7abc-e7bf-469b-9a29-6bcdf6f4055f","resolution":{"observed_at":"2026-08-06T15:57:03.836978Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-07-31T21:36:45.596575Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-06T15:56:54.882452Z","title":"World Models","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:54.882452Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:842f8b1b6835ad01986973602552aa355d05a619220a3d39c9c73f5c3a818a4c","observation_id":"bc9739c7-521c-4f37-aa05-8b5ab77751c3","resolution":{"observed_at":"2026-08-06T15:56:54.882452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.205987Z","title":"Fast Task Inference with Variational Intrinsic Successor Features","venue":null,"work_id":"a285bf93-380b-44ec-ae09-faa48322b18d","year":null},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:54.987426Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:27078e2a3e39c5a92956d5c20f8ba8947b7d0a584bcbd50733d48073a61947ca","observation_id":"65f8b3e2-b2de-4c2d-8959-dd8a44173ada","resolution":{"observed_at":"2026-08-06T15:57:05.211157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.172610Z","title":"Momentum contrast for unsupervised visual representation learning","venue":null,"work_id":"5708bc4e-86cb-42f5-8bbd-b4588a09c1d6","year":2020},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:55.126819Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:4d05ed7160d1e746cfd4f90f6b807b713ab47a0d42d0ea1a4d0e0e05c674621f","observation_id":"007cd563-9818-4bdf-a81e-1d50a63431ff","resolution":{"observed_at":"2026-08-06T15:57:05.178309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1605.06336","last_updated":"2016-05-20T12:59:22Z","snapshot_observed_at":"2026-07-06T04:56:59.888669Z","submitted_at":"2016-05-20T12:59:22Z","title":"Unsupervised Feature Extraction by Time-Contrastive Learning and Nonlinear ICA","version":1},"cited_work":{"arxiv_id":"1605.06336","doi":null,"metadata_source":"pith","pith_arxiv_id":"1605.06336","snapshot_observed_at":"2026-08-06T15:57:03.562344Z","title":"Unsupervised Feature Extraction by Time-Contrastive Learning and Nonlinear ICA","venue":"stat.ML","work_id":"ceb62dc8-311d-4264-a8ad-b5846a03e5eb","year":2016},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:55.202038Z"},"links":{"cited_paper":"/paper/1605.06336","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:b3dfec63244e8bbd1087cb0db1768a38738719671a1c782b5838888aba401482","observation_id":"ce2e51ab-5b29-4241-b335-b5a24f255992","resolution":{"observed_at":"2026-08-06T15:57:03.613959Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.08651","last_updated":"2019-02-04T15:17:01Z","snapshot_observed_at":"2026-07-06T06:40:33.998972Z","submitted_at":"2018-05-22T15:01:22Z","title":"Nonlinear ICA Using Auxiliary Variables and Generalized Contrastive Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.08651","snapshot_observed_at":"2026-08-06T15:56:55.289803Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:55.289803Z"},"links":{"cited_paper":"/paper/1805.08651","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:587d3ff47c6790687e15edc8777cdb6bbd9f8dc104737bd32e907afbc532df41","observation_id":"ea2d45fe-1b1c-429e-a383-e45218786c93","resolution":{"observed_at":"2026-08-06T15:56:55.289803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:56:55.353431Z","title":"Nonlinear independent component analysis: Existence and uniqueness results","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:55.353431Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:20b59da023d98501b6dddc4b104111187b63a1da08deb6ce1213788f28a1c6e0","observation_id":"14d2673a-fcb0-40e3-84d5-fabd4005bfa7","resolution":{"observed_at":"2026-08-06T15:56:55.353431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09620","last_updated":"2021-10-27T11:19:39Z","snapshot_observed_at":"2026-08-01T16:40:37.093844Z","submitted_at":"2021-06-17T15:56:57Z","title":"Disentangling Identifiable Features from Noisy Data with Structured Nonlinear ICA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09620","snapshot_observed_at":"2026-08-06T15:56:55.422423Z","title":"Disentangling Identifiable Features from Noisy Data with Structured Nonlinear ICA","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:55.422423Z"},"links":{"cited_paper":"/paper/2106.09620","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:ecb7cf20e87ba4b46a2b347746e482e8f1691bb325fd824937db4a7d1d4d47d7","observation_id":"dd8db151-85d0-40e8-ac90-633cd01f57e1","resolution":{"observed_at":"2026-08-06T15:56:55.422423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10743","last_updated":"2024-06-15T21:42:15Z","snapshot_observed_at":"2026-07-06T18:31:36.504766Z","submitted_at":"2024-06-15T21:42:15Z","title":"Occam's Razor for Self Supervised Learning: What is Sufficient to Learn Good Representations?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10743","snapshot_observed_at":"2026-08-06T15:56:55.526192Z","title":"Occam’s Razor for Self Supervised Learning: What is Sufficient to Learn Good Representations?, June 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:55.526192Z"},"links":{"cited_paper":"/paper/2406.10743","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:e29cc353be51faad7c21244e6c524357f04343eb35770bfb2eac7a5a76719436","observation_id":"9c3ebaac-bc05-4e5e-809d-e72152281d3b","resolution":{"observed_at":"2026-08-06T15:56:55.526192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.156583Z","title":"Variational Autoencoders and Nonlinear ICA: A Unifying Framework","venue":null,"work_id":"dd055b68-fa4c-4054-a0e1-d961d622d5d8","year":2020},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:55.599606Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:0fb5dc7f4208adc468d0b1954032c7c149c5ec0969469478b1f363189cf7f129","observation_id":"d1e840fc-11f8-400d-848b-482bc3162c14","resolution":{"observed_at":"2026-08-06T15:57:05.161269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.11537","last_updated":"2020-10-26T17:49:11Z","snapshot_observed_at":"2026-07-06T09:00:17.987521Z","submitted_at":"2020-02-26T14:43:30Z","title":"ICE-BeeM: Identifiable Conditional Energy-Based Deep Models Based on Nonlinear ICA","version":4},"cited_work":{"arxiv_id":"2002.11537","doi":null,"metadata_source":"pith","pith_arxiv_id":"2002.11537","snapshot_observed_at":"2026-08-06T15:57:03.352957Z","title":"ICE-BeeM: Identifiable Conditional Energy-Based Deep Models Based on Nonlinear ICA","venue":"stat.ML","work_id":"57a5ae47-8a6f-49fc-9089-f26be9e9dddc","year":2020},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:55.665581Z"},"links":{"cited_paper":"/paper/2002.11537","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:66bc7a5b1a7b5d4d82a741ac3ac958d409845bfb4208bed7d57d58ff160db0d2","observation_id":"4a1b04dc-0abe-430a-9b5d-5ad16aee3729","resolution":{"observed_at":"2026-08-06T15:57:03.389080Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.137254Z","title":"Unsupervised Reinforcement Learning with Contrastive Intrinsic Con- trol","venue":null,"work_id":"c17e16d9-09cc-4dca-9a75-caa0312b344a","year":2022},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:55.743381Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:67a6701c757c852697dddd941a56df4ad367549a15be3e7ab14e5c192897b555","observation_id":"46f0ea1d-759e-4c41-97ee-30107decabfb","resolution":{"observed_at":"2026-08-06T15:57:05.143749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.03169","last_updated":"2022-06-15T13:39:56Z","snapshot_observed_at":"2026-08-04T14:35:01.693176Z","submitted_at":"2022-02-07T13:55:36Z","title":"CITRIS: Causal Identifiability from Temporal Intervened Sequences","version":3},"cited_work":{"arxiv_id":"2202.03169","doi":null,"metadata_source":"pith","pith_arxiv_id":"2202.03169","snapshot_observed_at":"2026-08-06T15:57:03.176965Z","title":"CITRIS: Causal Identifiability from Temporal Intervened Sequences","venue":"cs.LG","work_id":"492e9059-83fc-46f7-88f2-20f5ea75425a","year":2022},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:55.835942Z"},"links":{"cited_paper":"/paper/2202.03169","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:4f337f03408242f9a02858ba5628dc6cb79e3b84d452f5b973977fde27840311","observation_id":"e239c16d-cdae-4e06-afa5-19271d9e6f17","resolution":{"observed_at":"2026-08-06T15:57:03.266010Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.117778Z","title":"Asano, Taco Cohen, and Efstratios Gavves","venue":null,"work_id":"95d11902-7922-4d6f-a8c7-0375483230d7","year":null},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:55.933246Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:9410aa7ab8c1384943948dd3da16c646edb05258a9c30bbb12699ba920e83f73","observation_id":"4c83cd9b-9ec9-46cb-aa23-0d76c3af4ea0","resolution":{"observed_at":"2026-08-06T15:57:05.123132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05804","last_updated":"2024-08-11T15:49:00Z","snapshot_observed_at":"2026-08-03T08:06:11.237161Z","submitted_at":"2024-08-11T15:49:00Z","title":"A Single Goal is All You Need: Skills and Exploration Emerge from Contrastive RL without Rewards, Demonstrations, or Subgoals","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05804","snapshot_observed_at":"2026-08-06T15:56:56.081279Z","title":"A Single Goal is All You Need: Skills and Exploration Emerge from Contrastive RL without Rewards, Demonstrations, or Subgoals, August 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:56.081279Z"},"links":{"cited_paper":"/paper/2408.05804","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:4e1273e93613e1d52c159be5c54428b1b9901683473576a7cd0e90bb35e77c6e","observation_id":"84216d40-7969-43ad-970a-15f13301d793","resolution":{"observed_at":"2026-08-06T15:56:56.081279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11464","last_updated":"2022-10-20T17:58:30Z","snapshot_observed_at":"2026-07-06T14:08:22.637175Z","submitted_at":"2022-10-20T17:58:30Z","title":"Self-Supervised Learning via Maximum Entropy Coding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11464","snapshot_observed_at":"2026-08-06T15:56:56.165584Z","title":"Self-Supervised Learning via Maximum Entropy Coding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:56.165584Z"},"links":{"cited_paper":"/paper/2210.11464","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:d1879f57333ea63387b084c9e1b978e993d65653830f84ab3b3a9841beb46dfb","observation_id":"f8c1c38b-6f90-4b77-8408-92414a93841c","resolution":{"observed_at":"2026-08-06T15:56:56.165584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.100788Z","title":null,"venue":null,"work_id":"f1ef5165-62e1-4bb9-bbde-2970114e9d39","year":null},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:56.007714Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:f8602bacbf41ca4174aea2c98ea8a76d5354db2392d61ea656dc651ebecb9858","observation_id":"b292d8c2-9dab-4214-bdfe-66d8b5699f39","resolution":{"observed_at":"2026-08-06T15:57:05.105605Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.077277Z","title":"Challenging Common Assumptions in the Unsupervised Learning of Disentangled Representations","venue":null,"work_id":"3b794537-84e9-4108-b783-146faa2ca3f5","year":2019},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:56.340734Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:c1b9fcff2e6ea6d13296866722a5e16195277d9a1e726e1ca80ec3bb4a99ca2d","observation_id":"cb6ba701-b7df-420e-ae64-c777e65c5425","resolution":{"observed_at":"2026-08-06T15:57:05.085022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.02886","last_updated":"2020-10-20T15:22:16Z","snapshot_observed_at":"2026-08-04T22:44:07.116582Z","submitted_at":"2020-02-07T16:39:31Z","title":"Weakly-Supervised Disentanglement Without Compromises","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.02886","snapshot_observed_at":"2026-08-06T15:56:56.400791Z","title":"Weakly-Supervised Disentanglement Without Compromises","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:56.400791Z"},"links":{"cited_paper":"/paper/2002.02886","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:c04ece20873258b09d00d16c1a484530835c7cd3f167242ca711e65fd25ab2b7","observation_id":"985da5ed-2f67-4b57-a492-234cd4f8675b","resolution":{"observed_at":"2026-08-06T15:56:56.400791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.05169","last_updated":"2023-04-03T17:19:51Z","snapshot_observed_at":"2026-07-06T14:40:50.270024Z","submitted_at":"2023-01-12T17:43:38Z","title":"Causal Triplet: An Open Challenge for Intervention-centric Causal Representation Learning","version":2},"cited_work":{"arxiv_id":"2301.05169","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.05169","snapshot_observed_at":"2026-08-06T15:57:02.996410Z","title":"Causal Triplet: An Open Challenge for Intervention-centric Causal Representation Learning","venue":"cs.LG","work_id":"51d5d48a-46a9-4f36-8b22-c8bc538fa733","year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:56.249173Z"},"links":{"cited_paper":"/paper/2301.05169","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:3e9bcaf94e753edb89711f2a38630f3d57d41ea00fc05f46e0854fae25ad6ef0","observation_id":"26734092-9e00-41a2-a75e-cf85a83e636c","resolution":{"observed_at":"2026-08-06T15:57:03.076796Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.053940Z","title":"Variational Information Maximisation for Intrinsically Motivated Reinforcement Learning","venue":null,"work_id":"3377fd80-e3e8-4790-8331-328e4f8b8c18","year":2015},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:56.545446Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:7e74c2df9bb6561cd65a819e4b2e47722fff4c38b8fa795062ad5c53897dc8ec","observation_id":"7eac9cb8-2ee2-4489-9aaf-c47fa0650fa3","resolution":{"observed_at":"2026-08-06T15:57:05.059341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.034722Z","title":"Connectivity-contrastive learning: Combining causal discovery and representation learning for multimodal data","venue":null,"work_id":"01833d3a-5f54-438b-b0fe-29858657ee1c","year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:56.619425Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:42632f64eeeb6a5ad4aba86bc3aeb398064c71b831b8d286b01633539c6562db","observation_id":"49fdb825-b482-4f09-81ae-dc168920863b","resolution":{"observed_at":"2026-08-06T15:57:05.040960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06604","last_updated":"2023-02-13T18:59:09Z","snapshot_observed_at":"2026-07-06T14:51:22.788392Z","submitted_at":"2023-02-13T18:59:09Z","title":"ALAN: Autonomously Exploring Robotic Agents in the Real World","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.06604","snapshot_observed_at":"2026-08-06T15:56:56.461728Z","title":"ALAN: Autonomously Exploring Robotic Agents in the Real World, February 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:56.461728Z"},"links":{"cited_paper":"/paper/2302.06604","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:650499b8def5959418fca2d39c360c863dd7f8eb0e6043c0d9904cad357ec074","observation_id":"e281be36-6df0-4748-8d2b-b58f1c02c5eb","resolution":{"observed_at":"2026-08-06T15:56:56.461728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-06T15:56:56.830019Z","title":"Representation Learning with Contrastive Predictive Coding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:56.830019Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:da562eb66c2ce4ea2edcc9ddb68cdb5f0c0cb8852bb0731ff44e6178e4e24937","observation_id":"5e58dcc9-e66d-467a-a275-52dafe816490","resolution":{"observed_at":"2026-08-06T15:56:56.830019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03658","last_updated":"2024-07-17T22:24:27Z","snapshot_observed_at":"2026-07-06T16:43:58.947915Z","submitted_at":"2023-11-07T01:59:11Z","title":"The Linear Representation Hypothesis and the Geometry of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03658","snapshot_observed_at":"2026-08-06T15:56:56.928220Z","title":"The Linear Representation Hypothesis and the Geometry of Large Language Models, November 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:56.928220Z"},"links":{"cited_paper":"/paper/2311.03658","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:1f686c4865ebf94f0d5aebec954a8236c0e7576bfb3d231eea22b7824f64c3c7","observation_id":"d116b630-6a22-40cb-b42e-584a19aa715f","resolution":{"observed_at":"2026-08-06T15:56:56.928220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.10944","last_updated":"2021-02-26T02:25:22Z","snapshot_observed_at":"2026-08-05T13:26:14.831665Z","submitted_at":"2020-06-19T03:41:12Z","title":"Independent Innovation Analysis for Nonlinear Vector Autoregressive Process","version":2},"cited_work":{"arxiv_id":"2006.10944","doi":null,"metadata_source":"pith","pith_arxiv_id":"2006.10944","snapshot_observed_at":"2026-08-06T15:57:02.826866Z","title":"Independent Innovation Analysis for Nonlinear Vector Autoregressive Process","venue":"stat.ML","work_id":"051c7735-a7f5-41ae-a8d3-a1e193cfe9e4","year":2020},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:56.735139Z"},"links":{"cited_paper":"/paper/2006.10944","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:90eb167c973a6eff28e1668804b954a08479ef4e2c070028d6358ecdc0723209","observation_id":"dead8afa-0f32-4970-9c4f-514f48b523f6","resolution":{"observed_at":"2026-08-06T15:57:02.873559Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.019083Z","title":"Lipschitz- constrained Unsupervised Skill Discovery","venue":null,"work_id":"efaccde1-063f-4442-bcf1-2e88e32f6bce","year":2021},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:57.075014Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:68bc452cd119b00cef35e81fa08784fedebb24b5696681132e35ab49cea27435","observation_id":"4deb8c43-fc2a-453f-9a9a-e598cf53c61d","resolution":{"observed_at":"2026-08-06T15:57:05.023836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.001746Z","title":"Lipschitz- constrained unsupervised skill discovery","venue":null,"work_id":"ede533b9-223f-41e5-a749-6b193f3efed1","year":2022},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:57.154405Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:38221780e8603f13042c3a9414c63084a879be07e401a67f65c722a83c411e8c","observation_id":"f3881480-8ece-4640-baac-4cad6756b01f","resolution":{"observed_at":"2026-08-06T15:57:05.007209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01506","last_updated":"2025-02-18T02:23:45Z","snapshot_observed_at":"2026-07-06T18:24:34.736988Z","submitted_at":"2024-06-03T16:34:01Z","title":"The Geometry of Categorical and Hierarchical Concepts in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01506","snapshot_observed_at":"2026-08-06T15:56:57.016599Z","title":"The Geometry of Categorical and Hierarchical Concepts in Large Language Models, June 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:57.016599Z"},"links":{"cited_paper":"/paper/2406.01506","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:d913da85848173111c6cfef46bd033a6bc7433eb81c327b21711010e4bd289ab","observation_id":"cea19832-a4f6-40ff-95cc-529f1731985d","resolution":{"observed_at":"2026-08-06T15:56:57.016599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08887","last_updated":"2024-03-10T04:30:17Z","snapshot_observed_at":"2026-07-06T16:32:19.417168Z","submitted_at":"2023-10-13T06:43:11Z","title":"METRA: Scalable Unsupervised RL with Metric-Aware Abstraction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08887","snapshot_observed_at":"2026-08-06T15:56:57.311531Z","title":"METRA: Scalable Unsupervised RL with Metric-Aware Abstraction, March 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:57.311531Z"},"links":{"cited_paper":"/paper/2310.08887","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:cc14c1c88d3f96aee2bd491ea987ab2166a4f1bab819b2123f56cc2b77eb479d","observation_id":"9d030a42-b5d0-458d-be0b-23a1588a26c5","resolution":{"observed_at":"2026-08-06T15:56:57.311531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.06612","last_updated":"2021-04-14T03:38:32Z","snapshot_observed_at":"2026-07-06T10:59:26.299730Z","submitted_at":"2021-04-14T03:38:32Z","title":"Deep Data Density Estimation through Donsker-Varadhan Representation","version":1},"cited_work":{"arxiv_id":"2104.06612","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.06612","snapshot_observed_at":"2026-08-06T15:57:02.608956Z","title":"Deep Data Density Estimation through Donsker-Varadhan Representation","venue":"cs.LG","work_id":"a1f80cb5-1fc0-4700-a611-d40825fb7fe6","year":2021},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:57.413895Z"},"links":{"cited_paper":"/paper/2104.06612","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:9b929009eb5e8f2cd03b431c248e524dbee56cc61149aa57b8ad34a71373d902","observation_id":"b6c42f25-9c6b-4daa-9f49-35884287df9e","resolution":{"observed_at":"2026-08-06T15:57:02.675626Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05103","last_updated":"2023-06-03T23:35:22Z","snapshot_observed_at":"2026-08-06T05:06:22.979236Z","submitted_at":"2023-02-10T08:03:09Z","title":"Controllability-Aware Unsupervised Skill Discovery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05103","snapshot_observed_at":"2026-08-06T15:56:57.250665Z","title":"Controllability-Aware Unsupervised Skill Discovery, June 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:57.250665Z"},"links":{"cited_paper":"/paper/2302.05103","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:3dd381f12fbf054b991ca9e92ad977ffcca2c9644f41bb156d84c85c61106647","observation_id":"002d4c57-3123-40c7-804b-66561d9caf76","resolution":{"observed_at":"2026-08-06T15:56:57.250665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/8014804","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:02.446728Z","title":"Efros, and Trevor Darrell","venue":null,"work_id":"b2b85f4b-4fa8-4769-98b2-99d2551a6a7e","year":2017},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:57.707731Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:33b329526a5907b65412d38c6656613f3f173a14ceb0f15947050892e2e8c30b","observation_id":"7889167e-f311-4c3f-ae02-55e3da34aa74","resolution":{"observed_at":"2026-08-06T15:57:02.506408Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:56:57.854646Z","title":"Causality: Models, Reasoning, and Inference","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:57.854646Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:fa7815c3b237db3db5ff1260705eaae6b3b42387848067d3cf52dab23bb90df5","observation_id":"d32a5ecd-f6c4-4da6-9d82-8f1fdc0976f2","resolution":{"observed_at":"2026-08-06T15:56:57.854646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:04.984349Z","title":"Self-Supervised Exploration via Disagree- ment","venue":null,"work_id":"001a1ac3-bb33-4df3-af12-c2ba270b2b95","year":null},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:57.507930Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:e8b07e660c284ebc561349e807999502cc6aa2126ee4a1af99d5f787b24acfde","observation_id":"b0d8f9e2-b019-46f3-94cd-d354a03f6d27","resolution":{"observed_at":"2026-08-06T15:57:04.990019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:04.967879Z","title":"Jacobian-based Causal Discovery with Nonlinear ICA","venue":null,"work_id":"f8960564-88a1-43e6-90fb-f93af80d679b","year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:58.104276Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:89f97e9f9e05dfe30d883d804d77990f910329a2d5063d0a38524cb16e87f8ae","observation_id":"34c3d0fd-f132-4873-8515-adda5a65e253","resolution":{"observed_at":"2026-08-06T15:57:04.972418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:04.952073Z","title":"V ogt, Randall Balestriero, Wieland Brendel, and David Klindt","venue":null,"work_id":"99752bc0-15bb-4cdf-9f71-9177034babd2","year":2024},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:58.252833Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:86a093ee19ee52277e9feaf17d6eb5546d9f102c3fc02fee1bf383ffa13acb3d","observation_id":"050c96f2-bd51-4f64-8a1e-5ca627c8d07a","resolution":{"observed_at":"2026-08-06T15:57:04.957012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18048","last_updated":"2024-02-16T10:36:55Z","snapshot_observed_at":"2026-07-06T16:54:41.858193Z","submitted_at":"2023-11-29T19:51:35Z","title":"An Interventional Perspective on Identifiability in Gaussian LTI Systems with Independent Component Analysis","version":2},"cited_work":{"arxiv_id":"2311.18048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.18048","snapshot_observed_at":"2026-08-06T15:57:02.136477Z","title":"An Interventional Perspective on Identifiability in Gaussian LTI Systems with Independent Component Analysis","venue":"cs.LG","work_id":"7d3c567d-7736-42d3-b2da-20279a6b61e3","year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:58.000047Z"},"links":{"cited_paper":"/paper/2311.18048","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:e9b09c6e339d9b3e04c38f8036b0c778e376aabbb31b1bd34864c664c402558a","observation_id":"fbd60e6a-42cc-478e-a5d0-595a545366dc","resolution":{"observed_at":"2026-08-06T15:57:02.252791Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.00810","last_updated":"2020-07-08T03:51:28Z","snapshot_observed_at":"2026-07-06T09:34:39.590117Z","submitted_at":"2020-07-01T23:33:37Z","title":"On Linear Identifiability of Learned Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.00810","snapshot_observed_at":"2026-08-06T15:56:58.462920Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:58.462920Z"},"links":{"cited_paper":"/paper/2007.00810","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:c1ea24b9db5c489dc53b440493cca90fbdf997de6d9fda09ad10dd20b806e14c","observation_id":"a9f6024d-09bb-4c0d-8423-3861efb61d73","resolution":{"observed_at":"2026-08-06T15:56:58.462920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00143","last_updated":"2025-04-16T15:26:14Z","snapshot_observed_at":"2026-07-06T18:38:42.333605Z","submitted_at":"2024-06-28T16:08:26Z","title":"InfoNCE: Identifying the Gap Between Theory and Practice","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00143","snapshot_observed_at":"2026-08-06T15:56:58.625898Z","title":"Zimmermann, and Wieland Brendel","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:58.625898Z"},"links":{"cited_paper":"/paper/2407.00143","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:5883d27cc1881f5e9f69c89aa94c7f32b351b02d216075d1d24d83913f8eb094","observation_id":"3700c629-12f8-4c88-a252-45a5e2d64fdc","resolution":{"observed_at":"2026-08-06T15:56:58.625898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:04.935504Z","title":"Identifiable Exchangeable Mechanisms for Causal Structure and Representation Learning","venue":null,"work_id":"b9181abc-5b1d-462c-b97a-9f6c57f357ca","year":2024},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:58.357193Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:4133c0bd1fa28a8dd533d8a00abc8ed64a413a6e68a4369ec412871b74b015a3","observation_id":"54a8feed-b7f9-4438-b8ec-9d71a3205b24","resolution":{"observed_at":"2026-08-06T15:57:04.940702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.11107","last_updated":"2021-02-22T15:26:57Z","snapshot_observed_at":"2026-07-06T10:43:34.044435Z","submitted_at":"2021-02-22T15:26:57Z","title":"Towards Causal Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.11107","snapshot_observed_at":"2026-08-06T15:56:58.831755Z","title":"Towards Causal Representation Learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:58.831755Z"},"links":{"cited_paper":"/paper/2102.11107","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:f3813fa5e4cdd51326877af714183eeb36194c24479db99cd781ab358d825953","observation_id":"d986c1ed-d72c-47a8-ab54-03e8595e116d","resolution":{"observed_at":"2026-08-06T15:56:58.831755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.05960","last_updated":"2020-06-30T23:05:50Z","snapshot_observed_at":"2026-07-06T09:19:47.840044Z","submitted_at":"2020-05-12T17:59:45Z","title":"Planning to Explore via Self-Supervised World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.05960","snapshot_observed_at":"2026-08-06T15:56:58.996781Z","title":"Planning to Explore via Self-Supervised World Models","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:58.996781Z"},"links":{"cited_paper":"/paper/2005.05960","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:7a93b4313636fd473441db61b811946d6807e133a24dd15108a668065c082ec1","observation_id":"773662f9-d94a-4473-a5f5-3550ec1c59ea","resolution":{"observed_at":"2026-08-06T15:56:58.996781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:04.917364Z","title":"Regularity as Intrinsic Reward for Free Play","venue":null,"work_id":"d7899065-ede0-4dc2-a7c0-dc861f042911","year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:58.727385Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:2f27e1b1903527f865684684f49dc4b34c7b1c83e01384512842df57cd4f1332","observation_id":"f4c12374-054a-4030-9a5f-cf691627fd94","resolution":{"observed_at":"2026-08-06T15:57:04.923425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.10081","last_updated":"2022-07-20T04:44:26Z","snapshot_observed_at":"2026-07-06T13:33:32.029850Z","submitted_at":"2022-07-20T04:44:26Z","title":"What Do We Maximize in Self-Supervised Learning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.10081","snapshot_observed_at":"2026-08-06T15:56:59.202089Z","title":"What Do We Maximize in Self-Supervised Learning?, July 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:59.202089Z"},"links":{"cited_paper":"/paper/2207.10081","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:b36de05c3f09bf4a93dfbcfafce2019afb3d85af3c11b7096a91a62f75bab736","observation_id":"b9fa943e-ddb7-497a-812a-13bf5d882391","resolution":{"observed_at":"2026-08-06T15:56:59.202089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:04.902648Z","title":"MIT press, 2000","venue":null,"work_id":"c3d6b53d-d196-4f83-8008-f43275159151","year":2000},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:59.344907Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:82a0f87cb315359e96084426947dbe1eb4666651383515d42072d71a1a644136","observation_id":"ee2c44dd-6d89-4da9-b1bc-eb8761488c4e","resolution":{"observed_at":"2026-08-06T15:57:04.907280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01657","last_updated":"2020-02-14T23:20:43Z","snapshot_observed_at":"2026-08-07T06:01:49.776810Z","submitted_at":"2019-07-02T21:32:19Z","title":"Dynamics-Aware Unsupervised Discovery of Skills","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.01657","snapshot_observed_at":"2026-08-06T15:56:59.109038Z","title":"Dynamics- Aware Unsupervised Discovery of Skills, February 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:59.109038Z"},"links":{"cited_paper":"/paper/1907.01657","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:f109a8400d581d4d04d0528fd8eab06a45e3f57376a3cbe38e225ca617820622","observation_id":"15e5ecc8-53f5-4941-bf8a-32a8a5e781e0","resolution":{"observed_at":"2026-08-06T15:56:59.109038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:04.847321Z","title":"Optimistic Active Exploration of Dynamical Systems","venue":null,"work_id":"95556f1f-53ce-4a0b-bd87-becaeda67748","year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:59.556559Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:7c210627369db87cd2c66f2ac061958593aa56498a9149bec4bf4722f860ae4d","observation_id":"f16ee830-f988-4ec0-a73b-9bbb4b1cbcc6","resolution":{"observed_at":"2026-08-06T15:57:04.874463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.13625","last_updated":"2020-01-23T09:08:54Z","snapshot_observed_at":"2026-07-06T08:11:34.239342Z","submitted_at":"2019-07-31T17:50:51Z","title":"On Mutual Information Maximization for Representation Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.13625","snapshot_observed_at":"2026-08-06T15:56:59.660079Z","title":"Rubenstein, Sylvain Gelly, and Mario Lucic","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:59.660079Z"},"links":{"cited_paper":"/paper/1907.13625","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:0e26c9182e0eaa71d31caff798c873418f9d4551db395bdf9ca1de57246c5eb6","observation_id":"d7950e97-1992-4efa-bc1d-14d61aa1d00d","resolution":{"observed_at":"2026-08-06T15:56:59.660079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:04.886443Z","title":"Reinforcement learning: An introduction, volume 1","venue":null,"work_id":"c4bd6167-c3a4-4a11-b8cb-9e49dec258d0","year":1998},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:59.453878Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:df45474a3cad48779facb873f91c8c59907f8d2397565dc909373bd918037695","observation_id":"d2d02a1c-c386-4181-8e63-7c2cfe6fbf99","resolution":{"observed_at":"2026-08-06T15:57:04.891616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.13457","last_updated":"2022-05-27T09:29:45Z","snapshot_observed_at":"2026-07-06T12:52:16.992962Z","submitted_at":"2022-03-25T05:36:26Z","title":"Chaos is a Ladder: A New Theoretical Understanding of Contrastive Learning via Augmentation Overlap","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.13457","snapshot_observed_at":"2026-08-06T15:57:00.050531Z","title":"Chaos is a Ladder: A New Theoretical Understanding of Contrastive Learning via Augmentation Overlap, May 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:00.050531Z"},"links":{"cited_paper":"/paper/2203.13457","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:3b38b4af8a68c56becb3a9459276358ee19fc8c5dfc7731cd924a90fd52e04cf","observation_id":"af25d6eb-d14d-400a-adb3-42aaf21ee20b","resolution":{"observed_at":"2026-08-06T15:57:00.050531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.11359","last_updated":"2018-11-28T02:35:24Z","snapshot_observed_at":"2026-07-06T07:17:31.201039Z","submitted_at":"2018-11-28T02:35:24Z","title":"Unsupervised Control Through Non-Parametric Discriminative Rewards","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.11359","snapshot_observed_at":"2026-08-06T15:57:00.190972Z","title":"Unsupervised control through non-parametric discriminative rewards.arXiv preprint arXiv:1811.11359, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:00.190972Z"},"links":{"cited_paper":"/paper/1811.11359","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:c768438dbeac2b8749e62f36b41f98e00c9037d76de53454eed3fdf635dcc354","observation_id":"e56d1e4a-8ee7-4ce1-8856-64ea6bdfbf18","resolution":{"observed_at":"2026-08-06T15:57:00.190972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.10242","last_updated":"2022-08-15T22:04:26Z","snapshot_observed_at":"2026-07-06T09:22:05.728894Z","submitted_at":"2020-05-20T17:59:57Z","title":"Understanding Contrastive Representation Learning through Alignment and Uniformity on the Hypersphere","version":10},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.10242","snapshot_observed_at":"2026-08-06T15:56:59.769844Z","title":"Understanding Contrastive Representation Learning through Alignment and Uniformity on the Hypersphere","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:59.769844Z"},"links":{"cited_paper":"/paper/2005.10242","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:9d1a8264b3b20b7219ed5e89cd43c5af4acbd85321bd7fd2f59b3cd1f9d78343","observation_id":"bc08240c-f58a-4be5-b86e-1442546b8d65","resolution":{"observed_at":"2026-08-06T15:56:59.769844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:04.681904Z","title":"Correlation and causation","venue":null,"work_id":"8d094a7e-207a-41f0-b52d-84a7ffd56c1e","year":1921},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:00.502004Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:220be1105c38fabc589a1b28c87fc64e55acf94a20ba578182f839d2c811b054","observation_id":"6b7b1f8a-9e23-4ea9-9433-b83566332c68","resolution":{"observed_at":"2026-08-06T15:57:04.781340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:04.533570Z","title":"Yu, and Dahua Lin","venue":null,"work_id":"c972abe1-bd75-47f0-a421-034825a485fd","year":2018},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:00.672775Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:004561ae36f9e2854fd77a7fdd62e8c757e90e6b10db29a888b6b8228bbbd051","observation_id":"a32cba91-6d98-48c2-aa65-d3a653bb4ab5","resolution":{"observed_at":"2026-08-06T15:57:04.653934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17225","last_updated":"2024-01-17T14:22:19Z","snapshot_observed_at":"2026-07-31T02:10:01.446097Z","submitted_at":"2023-05-26T19:34:35Z","title":"Causal Component Analysis","version":3},"cited_work":{"arxiv_id":"2305.17225","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.17225","snapshot_observed_at":"2026-08-06T15:57:01.798541Z","title":"Causal Component Analysis","venue":"stat.ML","work_id":"b2f5e7f6-fe89-43e4-85ee-68cc13eb24b9","year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:00.364400Z"},"links":{"cited_paper":"/paper/2305.17225","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:6caaf744423e530d5aac01ec06b9698c87a58fc74abf0fc545318675dce842bc","observation_id":"4ff0d31b-df22-466d-8638-e0b651db5a16","resolution":{"observed_at":"2026-08-06T15:57:01.842388Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10629","last_updated":"2025-06-12T12:13:58Z","snapshot_observed_at":"2026-08-07T04:19:08.043815Z","submitted_at":"2025-06-12T12:13:58Z","title":"Task Adaptation from Skills: Information Geometry, Disentanglement, and New Objectives for Unsupervised Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10629","snapshot_observed_at":"2026-08-06T15:57:00.816877Z","title":"Task Adaptation from Skills: Information Geometry, Disentanglement, and New Objectives for Unsupervised Reinforcement Learning, June 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:00.816877Z"},"links":{"cited_paper":"/paper/2506.10629","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:c39e52bf42772882824502dc4ab7a737ca43320ae6c1ba2c4d052fba9bb78301","observation_id":"daaa26ea-fe07-4cce-9e16-de7d81188b90","resolution":{"observed_at":"2026-08-06T15:57:00.816877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:00.920777Z","title":"Contrastive Difference Predic- tive Coding, October 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:00.920777Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:a8e04100a9fdbd86ef85f8e02134998b930ed187c2069669acb2dc2509a85ff3","observation_id":"1e6c322a-fde6-44ba-baa5-8871bd66e296","resolution":{"observed_at":"2026-08-06T15:57:00.920777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.08697","last_updated":"2023-12-19T03:58:16Z","snapshot_observed_at":"2026-07-06T09:13:21.062796Z","submitted_at":"2020-04-18T20:09:34Z","title":"CausalVAE: Structured Causal Disentanglement in Variational Autoencoder","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.08697","snapshot_observed_at":"2026-08-06T15:57:00.750436Z","title":"CausalV AE: Structured Causal Disentanglement in Variational Autoencoder, December 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:00.750436Z"},"links":{"cited_paper":"/paper/2004.08697","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:242c795190dafb2956bc004ee9e23f748221fd2f68ba09b4642c20241a71e9e2","observation_id":"701e759f-cfc7-4e36-b8be-53e878600311","resolution":{"observed_at":"2026-08-06T15:57:00.750436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.08850","last_updated":"2022-04-07T07:40:49Z","snapshot_observed_at":"2026-07-06T10:42:12.490556Z","submitted_at":"2021-02-17T16:21:54Z","title":"Contrastive Learning Inverts the Data Generating Process","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.08850","snapshot_observed_at":"2026-08-06T15:57:01.142181Z","title":"Zimmermann, Yash Sharma, Steffen Schneider, Matthias Bethge, and Wieland Brendel","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:01.142181Z"},"links":{"cited_paper":"/paper/2102.08850","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:0068cdbf5b61ebcfc165cad23ef8329267762297122594b63b37ad9f8779105d","observation_id":"7679494a-75b4-4c30-a4fd-57d359728ddc","resolution":{"observed_at":"2026-08-06T15:57:01.142181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:01.022480Z","title":"Can a MISL Fly? Analysis and Ingredients for Mutual Information Skill Learning, December 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:01.022480Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:40f3d543d92dc11f5b3bcce834e06005c693d88d0bf114b3b278fc2b2770f665","observation_id":"3391fa63-217f-4ed8-aef6-9ed495a63c7e","resolution":{"observed_at":"2026-08-06T15:57:01.022480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:04.375648Z","title":null,"venue":null,"work_id":"0a2ba073-087d-46d5-8606-b82885d6ea8d","year":null},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:01.329426Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:229995cbbb535d79bfd137a0c4a232c859439e0ccd1a408e3006ee040d7c31bd","observation_id":"7eec6e22-f821-4523-8df3-69ace8064fd4","resolution":{"observed_at":"2026-08-06T15:57:04.469936Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:04.216096Z","title":null,"venue":null,"work_id":"143bfefb-fa01-4d38-80c8-71e02f67fa7b","year":null},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:01.366993Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:fa22729dd81beb4b6cd31f4cb30624bd5e6aeac1c04586255d7ce7c540fb9d38","observation_id":"7ae660a5-ec3a-41ce-90ed-91b6a525e1e2","resolution":{"observed_at":"2026-08-06T15:57:04.312876Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.189370Z","title":null,"venue":null,"work_id":"d6b1d2e4-9759-485f-bb7e-d39de70851aa","year":null},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:55.057117Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:662313d43e38c0e5295e67e99349ed3c677bc7d1c3fce303be8360ec70a683fb","observation_id":"15b984e2-dcf0-4b3f-b4f8-03845e30e3a6","resolution":{"observed_at":"2026-08-06T15:57:05.194691Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.269228Z","title":"1, 3, 4, 5, 9","venue":null,"work_id":"a74a1acf-1023-48d2-b4ee-7ae1b44b7bad","year":2022},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:54.403359Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:4cbcef98fc014fc564890742d0bfe8db6d68cd5b21cef45756be80eaad74b7b8","observation_id":"5010bf1c-db5d-467d-9b88-6ea248affe83","resolution":{"observed_at":"2026-08-06T15:57:05.278789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning"},"reference_resolution":{"displayed":77,"state_counts":{"malformed_identifier":1,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":37,"verified_exact":8,"verified_fuzzy":28},"total_outbound_references":77},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 77 of 77 outbound references and 1 inbound Pith citation observation for arXiv:2507.14748."}