{"as_of":"2026-08-09T00:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:afff4b4eb26a78c9eabb807f12824a9bc140b763a271f98b7f8f2f3d33ecdb80","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:27:00.722538Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.14420/citation-record","integrity":"/paper/2506.14420/integrity","json":"/paper/2506.14420/citation-record.json","paper":"/paper/2506.14420"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.400282Z","title":"A general reinforcement learning algorithm that masters chess, shogi, and go through self-play,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.400282Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:a4d3641c7f30ca6a31fc044d0665e70aae518c403446650c0195cb95a0c9262d","observation_id":"71f17265-6779-4c69-a3c3-c18f62a0d420","resolution":{"observed_at":"2026-08-07T00:27:00.400282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.367589Z","title":"Mastering atari games with limited data,","venue":null,"work_id":"9395258c-7d19-414d-a381-35fe3fed7d5e","year":2021},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.406553Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:1c3a8cac258450b1dc1200e1c360b221bb37a9dcdcc71d1b8b72ad20cb25bc8e","observation_id":"ef1d3c3a-ae07-49e5-adc8-6e5fb3e25493","resolution":{"observed_at":"2026-08-07T00:27:01.370724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.357698Z","title":"Continu- ous improvement of self-driving cars using dynamic confidence-aware reinforcement learning,","venue":null,"work_id":"e72b7bff-3243-4ee2-85d8-f02d3f878074","year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.410591Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:47eb406a904cd111eae776b78430cc1bf15a4715f1178e6af1c3221a82429061","observation_id":"b2ec47ef-7373-48d0-a232-25be158a95b7","resolution":{"observed_at":"2026-08-07T00:27:01.360799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.347684Z","title":"Uncertainty-aware model-based reinforce- ment learning: Methodology and application in autonomous driving,","venue":null,"work_id":"e2c28c50-02a8-49b2-892f-c42307b14eb1","year":2022},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.415890Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:049cf7e44d12cdf5a430a65f5a076773d34bc07bdc3062c4da14d054f4b22c68","observation_id":"8394700b-fd26-46cf-b2d3-dd2159d76866","resolution":{"observed_at":"2026-08-07T00:27:01.350983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.337561Z","title":"Temporal difference learning for model predictive control,","venue":null,"work_id":"fe13fe58-6e7c-47c5-a87d-8313ef157e34","year":2022},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.421942Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:7c0e7df54800792f817f32ccd7a70fe70a6ff8109c45f2b6467315859436f494","observation_id":"704b35af-edb4-4fd9-9afc-82911f0acd5c","resolution":{"observed_at":"2026-08-07T00:27:01.340781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.327288Z","title":"Learning robust perceptive locomotion for quadrupedal robots in the wild,","venue":null,"work_id":"6b08e87b-f7fc-4029-be35-815ce7f9979b","year":2022},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.426007Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:fdf37bde833bf709b624bcce4c113f6c49d8794e9d691d7b44371014d100c141","observation_id":"ed24a445-4e3a-4971-a598-29b233b89200","resolution":{"observed_at":"2026-08-07T00:27:01.330608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.430953Z","title":"Relay hindsight experience replay: Self-guided continual reinforcement learning for sequential object manipulation tasks with sparse rewards,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.430953Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:574533ea7bf91531f54641fd10049e7366dfe5b4b78c62759e3294c6de263861","observation_id":"8dde356a-dbf6-43df-8776-353702a37f9c","resolution":{"observed_at":"2026-08-07T00:27:00.430953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.310271Z","title":"Reward design with language models,","venue":null,"work_id":"9b787363-7409-4d1b-ae09-089809456f69","year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.434350Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:3c92014c31948e76d55e3938981968bef822aef7b8d9e35bbb56b2455fbb401a","observation_id":"e58e16ff-5cdf-4271-b646-8e358a74f9e9","resolution":{"observed_at":"2026-08-07T00:27:01.314030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.300304Z","title":"Maniskill2: A unified benchmark for generalizable manipulation skills,","venue":null,"work_id":"921a6627-281d-4b27-863c-d33704eb83e2","year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.438282Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:2e3c8618350d09578d06f6056067a723b286b7b3ad9ab6bddf8ebe506c89b07c","observation_id":"d4c1edc9-f530-46c2-bf7b-c3e216841b4f","resolution":{"observed_at":"2026-08-07T00:27:01.303638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.289921Z","title":"Pre-trained models: Past, present and future,","venue":null,"work_id":"2621b3bf-8135-4806-9d5d-8f7a0373cc68","year":2021},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.443129Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:76767cebe0cf63457907148d0c7c3e32be181a2784e2c40709d95f079539037e","observation_id":"619f9568-8743-48ab-b70a-aa94a8152069","resolution":{"observed_at":"2026-08-07T00:27:01.293541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T00:27:00.448023Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.448023Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:aeba852fb8f9aec74121eac432da0d122ae7b619ed7885e03caa75f276722d24","observation_id":"4fd48582-3036-4fbe-860a-e6ca0ba79d71","resolution":{"observed_at":"2026-08-07T00:27:00.448023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.452438Z","title":"Training language models to follow instructions with human feedback,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.452438Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:106801626d8bcf90e45bb136ba4e327c780245c8187cc6a70f39211ff366f7c6","observation_id":"a57c93fb-c2b9-415d-9369-dde7bd856de2","resolution":{"observed_at":"2026-08-07T00:27:00.452438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T00:27:00.456970Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.456970Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:3dc94963ff47f26b7ed1761e57e1dc6be9b80ca1c0576bef8137328c7af6ca9f","observation_id":"6011ef50-a54c-4a95-9f8a-97e8b97c3e0f","resolution":{"observed_at":"2026-08-07T00:27:00.456970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.461759Z","title":"Masked au- toencoders are scalable vision learners,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.461759Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:3eab9afa2ff6b77e82900885d1ddbd3e1f0a9934c9fe38339e8cafa37a1ff39b","observation_id":"226fe321-0ecf-4b4d-aff0-bbe46e7b5c6e","resolution":{"observed_at":"2026-08-07T00:27:00.461759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.265313Z","title":"V-JEPA: Latent video prediction for visual representation learning,","venue":null,"work_id":"52f59ae8-a22e-44af-9d92-9d4c3e05e9a6","year":2024},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.465949Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:91220670e5fbdc50dfe389615c437845c3639e921d34264f602d372941b9ad10","observation_id":"fe02bf74-1ab5-4135-b72a-c480516daa08","resolution":{"observed_at":"2026-08-07T00:27:01.268456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.472353Z","title":"Bootstrap your own latent-a new approach to self-supervised learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.472353Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:579b254380163d420530715ec6783fae06ceb677340981c1d4a9a22e7d463aa6","observation_id":"b20b188b-cf5e-4a2c-8a52-136036aad63f","resolution":{"observed_at":"2026-08-07T00:27:00.472353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.246972Z","title":"Where are we in the search for an artificial visual cortex for embodied intelligence?","venue":null,"work_id":"0d82c016-0eb8-4ca6-98f5-b313ba9bdcb8","year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.478396Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:e9c547c7570032639802d5899d13411d77addc8d0464c1d3a8bd50230d0de0a3","observation_id":"30b3293a-b4c1-4a8c-83b1-2ed348eb81f4","resolution":{"observed_at":"2026-08-07T00:27:01.250413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.237010Z","title":"R3m: A universal visual representation for robot manipulation,","venue":null,"work_id":"5dddfd75-5c60-4821-9f8d-898ba80ea936","year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.485375Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:8994d0818893897b9e80981df90ea93b995904c64f4006d9d57758caf70ce9e3","observation_id":"220c38ac-5d7d-4b90-bcd2-44cddea60b37","resolution":{"observed_at":"2026-08-07T00:27:01.240433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.226153Z","title":"URLB: Unsupervised reinforcement learning benchmark,","venue":null,"work_id":"b383b909-e5b8-4144-81e3-5ceb17d03cb3","year":2021},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.489329Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:40da21da85afb9ac2b790b9690f634fbb17811de53f8b1c4b23d835c4d1df0a3","observation_id":"36d4a9dc-19eb-4d33-801a-cf0dfc0a383f","resolution":{"observed_at":"2026-08-07T00:27:01.230131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.07507","last_updated":"2016-11-22T20:44:39Z","snapshot_observed_at":"2026-08-02T15:05:52.307944Z","submitted_at":"2016-11-22T20:44:39Z","title":"Variational Intrinsic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.07507","snapshot_observed_at":"2026-08-07T00:27:00.497698Z","title":"Variational intrinsic control,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.497698Z"},"links":{"cited_paper":"/paper/1611.07507","citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:fd9ed9ddf1785b544f0dc48b136d7f5180e86fd5078e8d0e21f808f2e3d0bfa4","observation_id":"904361d9-e69c-40ef-bd35-575853178d1d","resolution":{"observed_at":"2026-08-07T00:27:00.497698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.215675Z","title":"Behavior from the void: Unsupervised active pre-training,","venue":null,"work_id":"67b63949-3d48-41f5-8fe5-31cd1c08678a","year":2021},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.501331Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:3965014b5c1a6a4e9c72591725297049b94121adb8dd142188bf9d9cca2f736e","observation_id":"7b6e1eed-5803-4e2e-8b8c-5842aef46ac9","resolution":{"observed_at":"2026-08-07T00:27:01.219172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.203505Z","title":"Understanding the limitations of variational mutual information estimators,","venue":null,"work_id":"548a9cf6-863b-4e34-a3c6-22ec9601ad69","year":2020},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.505838Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:4d84ea988504a1a288d4be1bea7d0f11b7e077e4053cd1f58d8cd082b3ab314c","observation_id":"a619baad-5a87-4765-9ed0-96b73d1ae417","resolution":{"observed_at":"2026-08-07T00:27:01.207390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.192535Z","title":"Diversity is all you need: Learning skills without a reward function,","venue":null,"work_id":"46e46f40-eb9e-4b45-bc3a-062f551be9ac","year":2019},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.510281Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:bf396fa20265a05bf57e49adaff9e467e2470f0cbd4bfbba971455bb22e60a51","observation_id":"310b62bc-be25-4cdf-96d8-474153cd3b5c","resolution":{"observed_at":"2026-08-07T00:27:01.196242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.182466Z","title":"Behavior contrastive learning for unsupervised skill discovery,","venue":null,"work_id":"d92ae496-1623-4209-8a25-eb80c9b7b846","year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.514388Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:a02c9388edfd420f652724f124acd68a9f87d40853bf68fb534b8e6f1fe14ef0","observation_id":"0eaa15a3-04d2-4e2a-b9e0-2a1cf9db9cdc","resolution":{"observed_at":"2026-08-07T00:27:01.185751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.171542Z","title":"METRA: Scalable unsupervised RL with metric-aware abstraction,","venue":null,"work_id":"0a064f8d-a33a-4823-90fa-654e5cb51bea","year":2024},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.520823Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:1d9141c0957f7141aa08cc8f0659a5c13c6a1043e0a2af171f46cae1bb420eec","observation_id":"5f7cea8d-1147-4b16-82f1-665d802b6b56","resolution":{"observed_at":"2026-08-07T00:27:01.174666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.530003Z","title":"Lipschitz-constrained unsupervised skill discovery,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.530003Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:8e5c9b8db95f1bcd10c99271d59b75a76f18b1c167ecba499c43c69ead18bbc7","observation_id":"455f1e32-4fc6-44e9-a00c-3ae7ae9e7605","resolution":{"observed_at":"2026-08-07T00:27:00.530003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.153881Z","title":"Controllability-aware unsuper- vised skill discovery,","venue":null,"work_id":"c90e1170-98a3-46e1-91e6-1eef2cf2a975","year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.540883Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:291fdc8233dc5d7c9f26e2a6dd3264af2c6ccbcb1474c7b49656395091684c09","observation_id":"8e11a816-fa34-4e9e-9f6b-eb50d1a3912a","resolution":{"observed_at":"2026-08-07T00:27:01.157930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.142595Z","title":"Unsupervised reinforcement learning with contrastive intrinsic control,","venue":null,"work_id":"9f0972b1-d7af-48d1-8172-15c9678998a0","year":2022},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.554184Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:255295f4af2e5acdf20da7b9abf69ca181581dcd81be7c19ce6d3502c0e740c4","observation_id":"0151c8b4-a341-4e52-add7-ba2c19c31fe1","resolution":{"observed_at":"2026-08-07T00:27:01.146584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.132003Z","title":"Mastering the unsupervised reinforce- ment learning benchmark from pixels,","venue":null,"work_id":"3afab83c-b132-4822-9d77-6fb083502730","year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.565679Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:3c174275c2c6c19095062c3cc8c411026f653d9d3bf2d1c2f88354c0c5218234","observation_id":"9834ffa6-f4e4-4a50-bde2-7cc8dff66686","resolution":{"observed_at":"2026-08-07T00:27:01.135541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-07T00:27:00.580787Z","title":"Auto-encoding variational bayes,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.580787Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:24274e1ca4f3f87dd4acd69c15ca5709c0bc8ef725c93f1141ca2d6b214b8972","observation_id":"eb901812-b8f3-4efb-8a55-47a2b42fc20c","resolution":{"observed_at":"2026-08-07T00:27:00.580787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.594940Z","title":"An introduction to variational autoencoders,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.594940Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:26f12eee05e41b3658b1a96b87251a9f18241ae83cdcfb74daa1d60d87e44e39","observation_id":"657529dc-3a0d-4c4c-b252-2c7bf0b89cc7","resolution":{"observed_at":"2026-08-07T00:27:00.594940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.114739Z","title":"Multi-task reinforcement learning with soft modularization,","venue":null,"work_id":"f303c3af-7539-43dd-987c-d844b172e513","year":2020},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.598765Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:7814aa8c19bdf2e210f3bf450c93fe525afba8acf842f6f3765e256b905ef1ca","observation_id":"bf395112-8f86-4dee-8e21-659391494978","resolution":{"observed_at":"2026-08-07T00:27:01.118194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.104109Z","title":"Near-bayesian exploration in polynomial time,","venue":null,"work_id":"1f8c46fc-ec19-46fc-bb4c-9c890da4aeb1","year":2009},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.606260Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:66da5a3f894898da320b4bb03033c99f838e9616f352ac7741c731751ebc4a9e","observation_id":"83799067-9158-4cf0-8018-88614f6ce87f","resolution":{"observed_at":"2026-08-07T00:27:01.107853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.093558Z","title":"An analysis of model-based interval estimation for markov decision processes,","venue":null,"work_id":"b5b8b1af-f741-468a-94c0-8f209747cac4","year":2008},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.609774Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:a5be9bd0955336229c5aaead5df30f7953b1095592c9ebbdc293f4161947073e","observation_id":"772d9560-1c81-45ba-bc53-39168129a0c9","resolution":{"observed_at":"2026-08-07T00:27:01.096620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.084499Z","title":"Unifying count-based exploration and intrinsic motivation,","venue":null,"work_id":"7eb532ca-e1b5-44de-a287-b009ae357fe8","year":2016},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.612633Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:1e654e84d0adb4a234b9a8eb8fbd2a021c9af3a82aae2ea455fd56a64a94f744","observation_id":"2809328a-2103-4dae-befb-55cdcac852fd","resolution":{"observed_at":"2026-08-07T00:27:01.087603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.074734Z","title":"Count-based exploration with neural density models,","venue":null,"work_id":"a11d7da9-0a83-4afb-bb95-c46732a1a0ae","year":2017},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.616640Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:323d24f8f9a7dd830aa5c1736e6007f2fc5aaef4a787d9e1c53a048a75360194","observation_id":"072ed9ba-5c18-4643-97a3-a90c2c7dcb13","resolution":{"observed_at":"2026-08-07T00:27:01.078190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.064814Z","title":"Dynamics- aware unsupervised discovery of skills,","venue":null,"work_id":"252993e7-ea50-40f3-8706-39961e9e6c43","year":2020},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.619907Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:27bfc29a8355dd68cb4622e9c31452ac99c96f779def4a39551fe608b8c487af","observation_id":"530eb6f2-b55d-4f03-9206-a4563300a6aa","resolution":{"observed_at":"2026-08-07T00:27:01.068018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.055474Z","title":"Explore, discover and learn: Unsupervised discovery of state-covering skills,","venue":null,"work_id":"86592fcd-8e9e-446e-8a0e-95526d0104b2","year":2020},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.623315Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:91d7c78a523e4ea7cba580c9e0902dafa703b05c11ac3fc37e400c5ade1221ee","observation_id":"cfa7a766-a5eb-47db-a842-e327c7ea0c66","resolution":{"observed_at":"2026-08-07T00:27:01.058443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.045509Z","title":"Unsupervised skill discovery via recurrent skill training,","venue":null,"work_id":"7aced0a7-cca6-4342-b32e-eece8112e81e","year":2022},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.626404Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:650f898993855cc666578c7c26b588706070cb7b9ad371f7cfa4e59fdb5eacb7","observation_id":"4a3bb0fb-7ccb-49ae-b38b-d94623953078","resolution":{"observed_at":"2026-08-07T00:27:01.048859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.035404Z","title":"Learning to discover skills with guidance,","venue":null,"work_id":"e64c720a-e34b-4d83-84a0-571457022786","year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.629803Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:582fbe043ee68caea5d993cbdd6ebf2957561f38b570bada567447a97e6422ef","observation_id":"03fd7f24-e87f-48cf-9479-f453ef079ad9","resolution":{"observed_at":"2026-08-07T00:27:01.038583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.024616Z","title":"Aps: Active pretraining with successor features,","venue":null,"work_id":"5db25783-2f72-47b2-bc7d-6ead5d87ad58","year":2021},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.633081Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:bc45aae8632f86d41e6f94180de5727fe60a543dac3afce6bd1c23bf2e11e706","observation_id":"5bc42a72-5855-459d-98d9-059d07f1d69e","resolution":{"observed_at":"2026-08-07T00:27:01.028714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.014687Z","title":"Efficient exploration via state marginal matching,","venue":null,"work_id":"6754df8c-1197-4a4f-8c33-b1c4a8396e78","year":null},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.636865Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:51df43b13272e84a88fbb771813312d76b1d64fbf9ef6868c223983cf44feea1","observation_id":"da26a86e-3728-495a-9390-35aa84fa09de","resolution":{"observed_at":"2026-08-07T00:27:01.017875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.993967Z","title":"Learning more skills through optimistic exploration,","venue":null,"work_id":"ffa5dd48-2609-46a6-a8b1-e992ce937471","year":2022},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.644518Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:349756dd24f20e4c85faacf835e037be986a737b63d9867a2fe428719c132c21","observation_id":"f32b9b01-64de-403f-95ca-bded11c4e539","resolution":{"observed_at":"2026-08-07T00:27:00.997823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.984583Z","title":"Choreographer: Learning and adapting skills in imagination,","venue":null,"work_id":"e155effd-66d2-4bd7-994b-7d4623d51e05","year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.647901Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:b1a3325a0600442a03906ac749c4aeb345c1493d7a1294f0d83a0a1e9bdb4002","observation_id":"f6728e22-9bc1-4fde-bf6b-b38aeb7858cf","resolution":{"observed_at":"2026-08-07T00:27:00.987631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.975184Z","title":"Curiosity-driven exploration by self-supervised prediction,","venue":null,"work_id":"6485ccb8-3e74-4cd1-ac80-50ccbf77fcbb","year":2017},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.651425Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:3d82ff4ab5ee7e2c9c661aa973890f3dd302ccd28151a35636db27b313bb570c","observation_id":"57370c5e-b6cf-4ac9-a791-2a0f30a6ab51","resolution":{"observed_at":"2026-08-07T00:27:00.978763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.965614Z","title":"Self-supervised exploration via disagreement,","venue":null,"work_id":"b8b46c18-6a20-467c-beb2-bad62c620190","year":2019},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.655593Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:9be038523666be5066e60b60e3f8b87037339b04a1538b6c8d149165dca6e37a","observation_id":"cd209605-fe50-4286-bb76-0bd9626397f5","resolution":{"observed_at":"2026-08-07T00:27:00.968809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.956046Z","title":"Exploration by random network distillation,","venue":null,"work_id":"e8e5ac30-5830-43da-a729-c963ed96289a","year":2019},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.659560Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:c6db6692002ec77d465e4d8adf3d19f4e408ac7ee5a5c38e29c825a2ae994277","observation_id":"6f595c2b-5c8a-4abe-95f3-e0ea93083b26","resolution":{"observed_at":"2026-08-07T00:27:00.959226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.946671Z","title":"Reinforcement learn- ing with prototypical representations,","venue":null,"work_id":"f6985e43-2576-4998-a75b-45e6c7237349","year":2021},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.662915Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:d8a10cc5ca3882403a42efeda3b6b9e9a6ac67db0122f3633a5c138f3408409c","observation_id":"e160b572-259a-4e80-b456-0ce9ac71b60d","resolution":{"observed_at":"2026-08-07T00:27:00.949840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.08398","last_updated":"2021-07-18T09:28:21Z","snapshot_observed_at":"2026-08-07T07:35:58.113947Z","submitted_at":"2021-07-18T09:28:21Z","title":"Unsupervised Skill-Discovery and Skill-Learning in Minecraft","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.08398","snapshot_observed_at":"2026-08-07T00:27:00.666160Z","title":"Unsupervised skill-discovery and skill-learning in minecraft,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.666160Z"},"links":{"cited_paper":"/paper/2107.08398","citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:74d632a1055c5742b0a1b3c0ebc046d71321097b36435f036f790531c613130a","observation_id":"60d6b8f5-1755-43fa-be8b-c905890209f9","resolution":{"observed_at":"2026-08-07T00:27:00.666160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.937250Z","title":"Rethinking mutual information for language conditioned skill discovery on imitation learning,","venue":null,"work_id":"c81c5801-954c-461f-bb1e-8b3031412f37","year":2024},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.670115Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:486ab42ff4e35ca9aaad085199f3fcce4fa23d3f9273313ac241fd6d533b9247","observation_id":"0174ae71-1d5d-4b66-b325-c726bebd3b3a","resolution":{"observed_at":"2026-08-07T00:27:00.940307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.927528Z","title":"Robust policy learning via offline skill diffusion,","venue":null,"work_id":"8963fa38-a66f-4c5c-9de3-99088bacd176","year":2024},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.673501Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:107cbb0a1743e9807263fb31fb84bc4bf54b0bf91c3796b6441f7d0ca38adf36","observation_id":"87d5dae8-0c73-47fd-adea-1a04ce1e5fd5","resolution":{"observed_at":"2026-08-07T00:27:00.930800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.917185Z","title":"EUCLID: Towards efficient unsupervised reinforcement learning with multi-choice dynamics model,","venue":null,"work_id":"5a685ef4-7698-44aa-b26b-e3c8498f17a4","year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.676484Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:ffa6b14e7cc41d6e5550536ce289708e9c8a75809a156ea6dc57491477b52b52","observation_id":"532129b3-6699-4fdc-a237-47c38bbbd6c6","resolution":{"observed_at":"2026-08-07T00:27:00.920765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.01404","last_updated":"2021-06-02T18:12:26Z","snapshot_observed_at":"2026-07-30T22:07:19.144088Z","submitted_at":"2021-06-02T18:12:26Z","title":"Variational Empowerment as Representation Learning for Goal-Based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.01404","snapshot_observed_at":"2026-08-07T00:27:00.680044Z","title":"Variational empowerment as representation learning for goal-based reinforcement learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.680044Z"},"links":{"cited_paper":"/paper/2106.01404","citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:54e596b6f5228a762d0e8d9cafe35c728fad33951e174808aa7e06d6d659a0a2","observation_id":"9b7851eb-dfa8-4001-93cb-37191848cf60","resolution":{"observed_at":"2026-08-07T00:27:00.680044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.906691Z","title":"Deep reinforcement learning at the edge of the statistical precipice,","venue":null,"work_id":"a49a3ca1-8156-448d-80f9-1e8e333bd43d","year":2021},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.683746Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:6955738ab4ba698a82e911a6aab96a17167d6de34f07d68812186cb704084911","observation_id":"c0d40dd6-4f94-410f-9d1e-31652ed883fa","resolution":{"observed_at":"2026-08-07T00:27:00.910096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.00690","last_updated":"2018-01-02T15:48:14Z","snapshot_observed_at":"2026-08-01T20:24:08.300098Z","submitted_at":"2018-01-02T15:48:14Z","title":"DeepMind Control Suite","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.00690","snapshot_observed_at":"2026-08-07T00:27:00.688031Z","title":"Deepmind control suite,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.688031Z"},"links":{"cited_paper":"/paper/1801.00690","citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:5003c7e2b4ab0a468c83f169b27d7cea3e8344db2870a7e5272c6f27d42d6d82","observation_id":"66b480bf-5b9a-445a-93bd-0ddbd0d3441a","resolution":{"observed_at":"2026-08-07T00:27:00.688031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-07T00:27:00.691720Z","title":"Continuous control with deep reinforcement learning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.691720Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:68c6da14e0af06589450f6f8bc673b4d31c5bb25d3abbd07884c5d9d7b38dd11","observation_id":"a9f30ed3-f669-4d5f-b7d8-e7b1c2a40bed","resolution":{"observed_at":"2026-08-07T00:27:00.691720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.897087Z","title":"Mastering visual continuous control: Improved data-augmented reinforcement learning,","venue":null,"work_id":"422e834f-a159-4f59-aa90-fc7c05fd16e8","year":2022},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.695397Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:55f3b0b7ec051bae981fd95b3c100055a12e34d1a3a1e98d44daa9586b100c7b","observation_id":"938e136d-270b-44d4-879d-efd40bcb47a9","resolution":{"observed_at":"2026-08-07T00:27:00.900348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.887521Z","title":"Mastering atari with discrete world models,","venue":null,"work_id":"60120aa8-c755-493c-8750-6f6e886222bf","year":2021},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.699020Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:c2ddbdc32de3ec4ace090d751b95d193d02698f7d89c8c1529fc259dd4c1f0a5","observation_id":"c14da304-2640-44aa-a0a0-67dbafd95f84","resolution":{"observed_at":"2026-08-07T00:27:00.890594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.877895Z","title":"Provably efficient rein- forcement learning with linear function approximation,","venue":null,"work_id":"197a00aa-adf2-41f1-a4e9-f39837c4587d","year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.702736Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:cda4266096a36027c626f6851b9037f0c7f3f61f70a5eb7c612abdad088e7961","observation_id":"05d9e23b-2958-4fc4-b1d1-809d2a638e31","resolution":{"observed_at":"2026-08-07T00:27:00.880897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.868103Z","title":"Reward-free model-based reinforcement learning with linear function approximation,","venue":null,"work_id":"52fa8217-54b4-496a-96e5-f19f5e602d06","year":2021},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.707318Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:2def72f0745b94f3a0814d8a35da4f355b56b200dfb3ae5134d517e4ddcaa2f5","observation_id":"cf051aba-497b-4290-b167-116d05c26cdd","resolution":{"observed_at":"2026-08-07T00:27:00.871448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.711258Z","title":"Deep variational information bottleneck,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.711258Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:eb34c1d302a0db8e550a68563c7fc8e75bd289d9e0e5c3d9e32031dee76e5491","observation_id":"ae0bbdbe-c31f-4a3d-8441-e11393c504ed","resolution":{"observed_at":"2026-08-07T00:27:00.711258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.851005Z","title":"Dynamic bottleneck for robust self-supervised exploration,","venue":null,"work_id":"2309e31d-0e02-4ecb-90ab-97308e8e5899","year":2021},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.715141Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:d81583abec54d9f9edf05bb2f9171ba62a69d71f6817d23c1c6e43c252092ca4","observation_id":"66625992-49c9-4b03-abe3-5d4fee27eec8","resolution":{"observed_at":"2026-08-07T00:27:00.854381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.840654Z","title":"Provably efficient exploration in policy optimization,","venue":null,"work_id":"491b6da2-f917-42ed-b5e5-dc866672c20a","year":2020},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.718687Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:3cc208a9d6188b733d44a71af9ba93aa43e0874f9dbcbbe843741fa0c30e581f","observation_id":"17e3e0cf-fcfd-4ab5-a163-7e6f6baa304e","resolution":{"observed_at":"2026-08-07T00:27:00.844208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.827260Z","title":"Logarithmic online regret bounds for undis- counted reinforcement learning,","venue":null,"work_id":"d35d6587-5076-45f1-a95c-1e6ceee6bdad","year":2006},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.722538Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:676ca54134f625145a146e5a8f0b34fde54eba571762c6b9a4e56c427036568f","observation_id":"d95da145-63a3-467a-88a2-5c8a91764329","resolution":{"observed_at":"2026-08-07T00:27:00.832856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.005153Z","title":"Available: https://openreview.net/forum?id=Hkla1eHFvS","venue":null,"work_id":"641f9d25-c863-4b56-a5f8-9eb740d6b39f","year":null},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.640914Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:0055727d145451b7f3ac7237cd801a385210d68c907deeeda4509db01d126e63","observation_id":"591aa826-3252-4443-a02e-6acff41e581c","resolution":{"observed_at":"2026-08-07T00:27:01.008510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T00:15:33.150474Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":49},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2506.14420."}