{"as_of":"2026-08-08T09:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b2475d505421ac7f1e63a0762e40bcc28e1d1c34cc3a16ca766bbf9dcaa3f584","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:11:08.934687Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T04:39:34.298932Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1907.01657","last_updated":"2020-02-14T23:20:43Z","snapshot_observed_at":"2026-08-07T06:01:49.776810Z","submitted_at":"2019-07-02T21:32:19Z","title":"Dynamics-Aware Unsupervised Discovery of Skills","version":2},"cited_work":{"arxiv_id":"1907.01657","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1907.01657","snapshot_observed_at":"2026-07-04T04:39:34.298932Z","title":"arXiv preprint arXiv:1907.01657 , year=","venue":null,"work_id":"92399db2-9f80-42e3-bf01-1b2c303da7e4","year":1907},"citing_paper":{"arxiv_id":"2211.15657","last_updated":"2023-07-10T07:25:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-28T18:59:02Z","title":"Is Conditional Generative Modeling all you need for Decision-Making?","version":4},"reference_index":203,"source":"arxiv_source","source_observed_at":"2026-05-15T15:35:10.593969Z"},"links":{"cited_paper":"/paper/1907.01657","citing_paper":"/paper/2211.15657"},"observation_digest":"sha256:0cef8895be364428e5e071797e3d56382c24b66155cf8b0e8792b152a3317e5b","observation_id":"5acb6b12-c7c7-4c9e-accb-c3b05f64da49","resolution":{"observed_at":"2026-05-15T15:35:10.807333Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01657","last_updated":"2020-02-14T23:20:43Z","snapshot_observed_at":"2026-08-07T06:01:49.776810Z","submitted_at":"2019-07-02T21:32:19Z","title":"Dynamics-Aware Unsupervised Discovery of Skills","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.01657","snapshot_observed_at":"2026-08-07T13:11:08.934687Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-07T13:02:33.459571Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:08.934687Z"},"links":{"cited_paper":"/paper/1907.01657","citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:15ca62c6c151a4827a8bf096e59337d04b7cf024c4b11349931acf52941148f9","observation_id":"7f974e1c-aa56-4a94-9545-65687568ef72","resolution":{"observed_at":"2026-08-07T13:11:08.934687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01657","last_updated":"2020-02-14T23:20:43Z","snapshot_observed_at":"2026-08-07T06:01:49.776810Z","submitted_at":"2019-07-02T21:32:19Z","title":"Dynamics-Aware Unsupervised Discovery of Skills","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.01657","snapshot_observed_at":"2026-08-07T10:55:20.279140Z","title":"Dynamics-aware unsupervised discovery of skills","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.04302","last_updated":"2025-06-04T14:50:24Z","snapshot_observed_at":"2026-08-08T01:19:21.830190Z","submitted_at":"2025-06-04T14:50:24Z","title":"RedRFT: A Light-Weight Benchmark for Reinforcement Fine-Tuning-Based Red Teaming","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T10:55:20.279140Z"},"links":{"cited_paper":"/paper/1907.01657","citing_paper":"/paper/2506.04302"},"observation_digest":"sha256:67d9dfa17391b1ae76484a33263a80a0ed30c965b492f0c5980506276ebc22cf","observation_id":"e03d3241-ec77-42e9-b744-9191bd314146","resolution":{"observed_at":"2026-08-07T10:55:20.279140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01657","last_updated":"2020-02-14T23:20:43Z","snapshot_observed_at":"2026-08-07T06:01:49.776810Z","submitted_at":"2019-07-02T21:32:19Z","title":"Dynamics-Aware Unsupervised Discovery of Skills","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.01657","snapshot_observed_at":"2026-08-06T19:32:34.807117Z","title":null,"venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2507.05477","last_updated":"2025-07-07T21:09:16Z","snapshot_observed_at":"2026-08-06T19:23:07.095008Z","submitted_at":"2025-07-07T21:09:16Z","title":"Epistemically-guided forward-backward exploration","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T19:32:34.807117Z"},"links":{"cited_paper":"/paper/1907.01657","citing_paper":"/paper/2507.05477"},"observation_digest":"sha256:f448324b59c458c078ee672b6293c2a99461d734db13fbb2d976c6e0c20d9186","observation_id":"6c34781e-890b-4cc6-b75c-9f2be1a45cb6","resolution":{"observed_at":"2026-08-06T19:32:34.807117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01657","last_updated":"2020-02-14T23:20:43Z","snapshot_observed_at":"2026-08-07T06:01:49.776810Z","submitted_at":"2019-07-02T21:32:19Z","title":"Dynamics-Aware Unsupervised Discovery of Skills","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.01657","snapshot_observed_at":"2026-08-06T15:56:59.109038Z","title":"Dynamics- Aware Unsupervised Discovery of Skills, February 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-07T00:04:27.004989Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:59.109038Z"},"links":{"cited_paper":"/paper/1907.01657","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:f109a8400d581d4d04d0528fd8eab06a45e3f57376a3cbe38e225ca617820622","observation_id":"15e5ecc8-53f5-4941-bf8a-32a8a5e781e0","resolution":{"observed_at":"2026-08-06T15:56:59.109038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01657","last_updated":"2020-02-14T23:20:43Z","snapshot_observed_at":"2026-08-07T06:01:49.776810Z","submitted_at":"2019-07-02T21:32:19Z","title":"Dynamics-Aware Unsupervised Discovery of Skills","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.01657","snapshot_observed_at":"2026-08-06T15:17:34.996582Z","title":"Dynamics-aware unsupervised discovery of skills.arXiv preprint arXiv:1907.01657, 2019","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2507.16473","last_updated":"2025-07-24T08:23:56Z","snapshot_observed_at":"2026-08-06T15:06:25.831343Z","submitted_at":"2025-07-22T11:22:58Z","title":"Learning Temporal Abstractions via Variational Homomorphisms in Option-Induced Abstract MDPs","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T15:17:34.996582Z"},"links":{"cited_paper":"/paper/1907.01657","citing_paper":"/paper/2507.16473"},"observation_digest":"sha256:48406500a4badf5fae8c3d78e64c8278ea4d3a1ab49f83fd152c3b51b639435c","observation_id":"278294fc-c0de-4947-8e82-edd4710c55d0","resolution":{"observed_at":"2026-08-06T15:17:34.996582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01657","last_updated":"2020-02-14T23:20:43Z","snapshot_observed_at":"2026-08-07T06:01:49.776810Z","submitted_at":"2019-07-02T21:32:19Z","title":"Dynamics-Aware Unsupervised Discovery of Skills","version":2},"cited_work":{"arxiv_id":"1907.01657","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1907.01657","snapshot_observed_at":"2026-07-04T04:39:34.298932Z","title":"arXiv preprint arXiv:1907.01657 , year=","venue":null,"work_id":"92399db2-9f80-42e3-bf01-1b2c303da7e4","year":1907},"citing_paper":{"arxiv_id":"2604.24558","last_updated":"2026-04-27T14:47:22Z","snapshot_observed_at":"2026-07-06T23:10:33.821313Z","submitted_at":"2026-04-27T14:47:22Z","title":"Hierarchical Behaviour Spaces","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-08T03:33:48.527621Z"},"links":{"cited_paper":"/paper/1907.01657","citing_paper":"/paper/2604.24558"},"observation_digest":"sha256:55d1ed01027b739c98daa7341430edccfe96f8c2640e1b3811ce2b05003a3b5c","observation_id":"f91f9964-d241-4916-963c-270cb71cd320","resolution":{"observed_at":"2026-05-11T22:01:12.758712Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01657","last_updated":"2020-02-14T23:20:43Z","snapshot_observed_at":"2026-08-07T06:01:49.776810Z","submitted_at":"2019-07-02T21:32:19Z","title":"Dynamics-Aware Unsupervised Discovery of Skills","version":2},"cited_work":{"arxiv_id":"1907.01657","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1907.01657","snapshot_observed_at":"2026-07-04T04:39:34.298932Z","title":"arXiv preprint arXiv:1907.01657 , year=","venue":null,"work_id":"92399db2-9f80-42e3-bf01-1b2c303da7e4","year":1907},"citing_paper":{"arxiv_id":"2605.01862","last_updated":"2026-05-08T03:23:44Z","snapshot_observed_at":"2026-07-06T23:15:01.968194Z","submitted_at":"2026-05-03T13:11:28Z","title":"QHyer: Q-conditioned Hybrid Attention-mamba Transformer for Offline Goal-conditioned RL","version":2},"reference_index":165,"source":"arxiv_source","source_observed_at":"2026-05-11T01:17:48.643521Z"},"links":{"cited_paper":"/paper/1907.01657","citing_paper":"/paper/2605.01862"},"observation_digest":"sha256:9a07b9ad2007fee9a960b3368e1604cbeea39f9f93814f1f7d62a4511d29ffb9","observation_id":"f3455a21-b401-4303-8cf9-5db592cdf331","resolution":{"observed_at":"2026-05-11T04:30:58.267267Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01657","last_updated":"2020-02-14T23:20:43Z","snapshot_observed_at":"2026-08-07T06:01:49.776810Z","submitted_at":"2019-07-02T21:32:19Z","title":"Dynamics-Aware Unsupervised Discovery of Skills","version":2},"cited_work":{"arxiv_id":"1907.01657","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1907.01657","snapshot_observed_at":"2026-07-04T04:39:34.298932Z","title":"arXiv preprint arXiv:1907.01657 , year=","venue":null,"work_id":"92399db2-9f80-42e3-bf01-1b2c303da7e4","year":1907},"citing_paper":{"arxiv_id":"2605.06145","last_updated":"2026-05-07T12:40:49Z","snapshot_observed_at":"2026-08-03T04:29:49.815774Z","submitted_at":"2026-05-07T12:40:49Z","title":"Unifying Goal-Conditioned RL and Unsupervised Skill Learning via Control-Maximization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-08T13:52:43.033237Z"},"links":{"cited_paper":"/paper/1907.01657","citing_paper":"/paper/2605.06145"},"observation_digest":"sha256:783d74f981b3267586e54fb0624c076ce82a50c2f7bd8639cae753a09feaa14b","observation_id":"e924b165-9681-4871-ab40-5a8760a8dc21","resolution":{"observed_at":"2026-05-11T18:46:10.749389Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01657","last_updated":"2020-02-14T23:20:43Z","snapshot_observed_at":"2026-08-07T06:01:49.776810Z","submitted_at":"2019-07-02T21:32:19Z","title":"Dynamics-Aware Unsupervised Discovery of Skills","version":2},"cited_work":{"arxiv_id":"1907.01657","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1907.01657","snapshot_observed_at":"2026-07-04T04:39:34.298932Z","title":"arXiv preprint arXiv:1907.01657 , year=","venue":null,"work_id":"92399db2-9f80-42e3-bf01-1b2c303da7e4","year":1907},"citing_paper":{"arxiv_id":"2605.12261","last_updated":"2026-05-12T15:28:32Z","snapshot_observed_at":"2026-08-04T14:43:17.447713Z","submitted_at":"2026-05-12T15:28:32Z","title":"Delay-Empowered Causal Hierarchical Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-13T05:46:51.659283Z"},"links":{"cited_paper":"/paper/1907.01657","citing_paper":"/paper/2605.12261"},"observation_digest":"sha256:9e0a5947fdef774d541454334c37911b4772433f6f82a6d51ac898556a87deed","observation_id":"686c3abf-358b-43e8-93d9-8e92095cf7e7","resolution":{"observed_at":"2026-05-13T05:47:21.205769Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01657","last_updated":"2020-02-14T23:20:43Z","snapshot_observed_at":"2026-08-07T06:01:49.776810Z","submitted_at":"2019-07-02T21:32:19Z","title":"Dynamics-Aware Unsupervised Discovery of Skills","version":2},"cited_work":{"arxiv_id":"1907.01657","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1907.01657","snapshot_observed_at":"2026-07-04T04:39:34.298932Z","title":"arXiv preprint arXiv:1907.01657 , year=","venue":null,"work_id":"92399db2-9f80-42e3-bf01-1b2c303da7e4","year":1907},"citing_paper":{"arxiv_id":"2606.08735","last_updated":"2026-06-07T17:08:28Z","snapshot_observed_at":"2026-07-06T23:48:11.819398Z","submitted_at":"2026-06-07T17:08:28Z","title":"Structure-Conditioned Actor-Critic Branches for Quality-Diversity Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-27T18:37:48.259353Z"},"links":{"cited_paper":"/paper/1907.01657","citing_paper":"/paper/2606.08735"},"observation_digest":"sha256:0d2c09ca10af5881c7651f21adf2c68c60dd3b15f6ba5b587023658170f64245","observation_id":"1f4140f7-9c74-463d-bec6-c24b759d7fe7","resolution":{"observed_at":"2026-07-02T22:47:26.372151Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01657","last_updated":"2020-02-14T23:20:43Z","snapshot_observed_at":"2026-08-07T06:01:49.776810Z","submitted_at":"2019-07-02T21:32:19Z","title":"Dynamics-Aware Unsupervised Discovery of Skills","version":2},"cited_work":{"arxiv_id":"1907.01657","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1907.01657","snapshot_observed_at":"2026-07-04T04:39:34.298932Z","title":"arXiv preprint arXiv:1907.01657 , year=","venue":null,"work_id":"92399db2-9f80-42e3-bf01-1b2c303da7e4","year":1907},"citing_paper":{"arxiv_id":"2606.09476","last_updated":"2026-06-08T13:35:22Z","snapshot_observed_at":"2026-08-01T13:38:00.934917Z","submitted_at":"2026-06-08T13:35:22Z","title":"Goal Sets, Not Goal States: Queryable Robot Goals through Goal-Set Hindsight Relabeling","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-27T16:07:28.361043Z"},"links":{"cited_paper":"/paper/1907.01657","citing_paper":"/paper/2606.09476"},"observation_digest":"sha256:5e37b633cc7995d1634f07070442ac4da0097793d01e0b244e8400ea256b7c44","observation_id":"03c1cede-f8a5-4dd2-8a67-1c86337e9095","resolution":{"observed_at":"2026-07-03T02:07:34.177073Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01657","last_updated":"2020-02-14T23:20:43Z","snapshot_observed_at":"2026-08-07T06:01:49.776810Z","submitted_at":"2019-07-02T21:32:19Z","title":"Dynamics-Aware Unsupervised Discovery of Skills","version":2},"cited_work":{"arxiv_id":"1907.01657","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1907.01657","snapshot_observed_at":"2026-07-04T04:39:34.298932Z","title":"arXiv preprint arXiv:1907.01657 , year=","venue":null,"work_id":"92399db2-9f80-42e3-bf01-1b2c303da7e4","year":1907},"citing_paper":{"arxiv_id":"2606.19998","last_updated":"2026-06-18T09:34:22Z","snapshot_observed_at":"2026-08-06T01:11:24.313445Z","submitted_at":"2026-06-18T09:34:22Z","title":"Tri-Info: Generalizable, Interpretable Failure Prediction for VLA Models via Information Theory","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-06-26T16:53:53.441274Z"},"links":{"cited_paper":"/paper/1907.01657","citing_paper":"/paper/2606.19998"},"observation_digest":"sha256:0ee065423c7ebef5f14e8f278cb18a80863db411682f75f1ba922c415343830c","observation_id":"10b55895-2a64-4cd9-b449-f9a9328fd0fc","resolution":{"observed_at":"2026-07-04T04:39:34.301049Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01657","last_updated":"2020-02-14T23:20:43Z","snapshot_observed_at":"2026-08-07T06:01:49.776810Z","submitted_at":"2019-07-02T21:32:19Z","title":"Dynamics-Aware Unsupervised Discovery of Skills","version":2},"cited_work":{"arxiv_id":"1907.01657","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1907.01657","snapshot_observed_at":"2026-07-04T04:39:34.298932Z","title":"arXiv preprint arXiv:1907.01657 , year=","venue":null,"work_id":"92399db2-9f80-42e3-bf01-1b2c303da7e4","year":1907},"citing_paper":{"arxiv_id":"2606.29201","last_updated":"2026-06-28T05:01:27Z","snapshot_observed_at":"2026-07-07T00:03:12.330608Z","submitted_at":"2026-06-28T05:01:27Z","title":"Behavior Uncloning: Distilling Mode Redirection into Policy Weights without Inference-Time Steering","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-30T07:49:04.825693Z"},"links":{"cited_paper":"/paper/1907.01657","citing_paper":"/paper/2606.29201"},"observation_digest":"sha256:890fa93297fff8be2b5dc35b06ee5ebc884e625f86b07c23eec2e7b005dc3276","observation_id":"b7d65f84-7599-455f-a48e-20e67a2266d8","resolution":{"observed_at":"2026-06-30T07:54:22.206134Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01657","last_updated":"2020-02-14T23:20:43Z","snapshot_observed_at":"2026-08-07T06:01:49.776810Z","submitted_at":"2019-07-02T21:32:19Z","title":"Dynamics-Aware Unsupervised Discovery of Skills","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.01657","snapshot_observed_at":"2026-08-01T06:32:52.458556Z","title":"Xue Bin Peng, Yunrong Guo, Lina Halper, Sergey Levine, and Sanja Fidler","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2607.21867","last_updated":"2026-07-23T23:47:03Z","snapshot_observed_at":"2026-08-07T07:42:04.035180Z","submitted_at":"2026-07-23T23:47:03Z","title":"When Is a Learned Command Adapter Worth It? Closed-Loop Identification and Counterfactual Auditing of Frozen Locomotion Policies","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T06:32:52.458556Z"},"links":{"cited_paper":"/paper/1907.01657","citing_paper":"/paper/2607.21867"},"observation_digest":"sha256:2854aef688c50dbb801ee214a14527dfad8b2513b0197c318a740138ce56de98","observation_id":"534371e1-d8ba-4b70-9bdd-0db6848e22e7","resolution":{"observed_at":"2026-08-01T06:32:52.458556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01657","last_updated":"2020-02-14T23:20:43Z","snapshot_observed_at":"2026-08-07T06:01:49.776810Z","submitted_at":"2019-07-02T21:32:19Z","title":"Dynamics-Aware Unsupervised Discovery of Skills","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.01657","snapshot_observed_at":"2026-08-04T19:45:35.216572Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.01851","last_updated":"2026-08-03T07:58:35Z","snapshot_observed_at":"2026-08-07T23:22:57.641630Z","submitted_at":"2026-08-03T07:58:35Z","title":"Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills","version":1},"reference_index":229,"source":"pdf_text","source_observed_at":"2026-08-04T19:45:35.216572Z"},"links":{"cited_paper":"/paper/1907.01657","citing_paper":"/paper/2608.01851"},"observation_digest":"sha256:2c3e68d3fdffc3a39dae24bf13aec00ad779207dc3d0845cc2ff127c60df6121","observation_id":"1d53a89b-01a5-44af-929d-7b3fbc749eb3","resolution":{"observed_at":"2026-08-04T19:45:35.216572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1907.01657/citation-record","integrity":"/paper/1907.01657/integrity","json":"/paper/1907.01657/citation-record.json","paper":"/paper/1907.01657"},"outbound":[],"paper":{"arxiv_id":"1907.01657","last_updated":"2020-02-14T23:20:43Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T06:01:49.776810Z","submitted_at":"2019-07-02T21:32:19Z","title":"Dynamics-Aware Unsupervised Discovery of Skills"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 16 inbound Pith citation observations for arXiv:1907.01657."}