{"as_of":"2026-08-10T12:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b640f9dc5a65c4338e4abf4148db0cd547b992485f0672ba7a44d28fe910536f","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T09:13:46.110853Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2510.17059/citation-record","integrity":"/paper/2510.17059/integrity","json":"/paper/2510.17059/citation-record.json","paper":"/paper/2510.17059"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:38.005000Z","title":"u c l\\\" u , Julia Berezutskaya, Eva van den Borne, Ya g mur G\\","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:38.005000Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:7ceaf96322ce345f4b9a1d887c3065c9734b4b5454cac692e848e80d78963ae0","observation_id":"d38c9e45-22aa-49df-8dfb-a60714c4bd70","resolution":{"observed_at":"2026-08-04T09:13:38.005000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06565","last_updated":"2016-07-25T17:23:29Z","snapshot_observed_at":"2026-07-06T05:00:46.434335Z","submitted_at":"2016-06-21T13:37:05Z","title":"Concrete Problems in AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06565","snapshot_observed_at":"2026-08-04T09:13:38.158656Z","title":"Concrete problems in ai safety","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:38.158656Z"},"links":{"cited_paper":"/paper/1606.06565","citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:eb1f8a479eaca6a26a04ddbfbe96327bd50c3e4436a93cda10791c0fc397f6ad","observation_id":"c4e8c1b1-4b18-49f4-a95d-067d86376ab1","resolution":{"observed_at":"2026-08-04T09:13:38.158656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:38.354288Z","title":"Hindsight experience replay","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:38.354288Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:6ae7c2c0e233a6ce2d3533e5e59a561be74064b1ab5a39816de06a492b21e011","observation_id":"27cfe413-2135-4805-88ee-bed36f98326a","resolution":{"observed_at":"2026-08-04T09:13:38.354288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:38.500604Z","title":"End to end learning for self-driving cars","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:38.500604Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:93d088618345cb88352604977ea51530622d63685d6c3f31163e477bd41973c9","observation_id":"f7a59cdd-b8e4-4f37-9268-1934400f8236","resolution":{"observed_at":"2026-08-04T09:13:38.500604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:38.760654Z","title":"Hudson, Ehsan Adeli, Russ Altman, Simran Arora, Sydney von Arx, Michael S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:38.760654Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:ec741be01dbb8ab9f0e6a0bab851f44765b4cdb53902657b8a95ef0c6d5b05b6","observation_id":"929e2a63-46ac-40f7-9452-cdab8e71ae85","resolution":{"observed_at":"2026-08-04T09:13:38.760654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:38.937247Z","title":"Goodman, Elizabeth Spelke, and Laura Schulz","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:38.937247Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:a307d699b8105f7ac974ad59b2dceb0a44eb8242e3011cbb61d7269a2eec72c9","observation_id":"8385915e-2694-4219-b18c-0d5a2fe32b8f","resolution":{"observed_at":"2026-08-04T09:13:38.937247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:39.192551Z","title":"Accelerating Goal-Conditioned RL Algorithms and Research","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:39.192551Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:d17a7f1da3aa6b114c70e3459090561ade617ddd3ce64d4c8ea1ca0dba4cb991","observation_id":"70e91582-7f45-4163-b9a3-a158ae3c059c","resolution":{"observed_at":"2026-08-04T09:13:39.192551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:39.356566Z","title":"JAX : composable transformations of P ython+ N um P y programs, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:39.356566Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:ac29d86125991b188cfbfa83315ba30caddf820a4760c398be347b24ad404970","observation_id":"a8dba354-1957-4bfa-b265-7a7f5d51e41f","resolution":{"observed_at":"2026-08-04T09:13:39.356566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-08-09T23:24:21.399948Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-08-04T09:13:39.522753Z","title":"Openai gym","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:39.522753Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:311c5bd2ea1da63736e187e7c7d51140d07cdde9055bfd7cc8b5ffd0c498a51a","observation_id":"933ece06-7611-4693-88fd-ba67ee79357c","resolution":{"observed_at":"2026-08-04T09:13:39.522753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:39.649756Z","title":"Explore, discover and learn: Unsupervised discovery of state-covering skills","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:39.649756Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:c1f92c9959f39439c1c0a5b398cf0356e8e149456c2f0d2e4057b36b99b955ef","observation_id":"0a031eaf-ed5e-457c-bbcc-f06576b01b64","resolution":{"observed_at":"2026-08-04T09:13:39.649756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:39.799969Z","title":"Multi-task hierarchical adversarial inverse reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:39.799969Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:63debcdd4ede85d6d4fd126b992eae721a051ba95d0387198e7e8ea5e90237f3","observation_id":"c817bad4-b1f1-43b5-9b8d-3a8dabeaa8c0","resolution":{"observed_at":"2026-08-04T09:13:39.799969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:39.922016Z","title":"Diffusion policy: Visuomotor policy learning via action diffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:39.922016Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:e1f2a16ce4f973cc185cf8fd66dcf4fe9a0ad1fdcd9b76a52c569bb65dec2dc8","observation_id":"a74c84a0-7bbc-49a4-a91a-53a57f8ae4f0","resolution":{"observed_at":"2026-08-04T09:13:39.922016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:39.993261Z","title":"Diffusion policy: Visuomotor policy learning via action diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:39.993261Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:b3d7e7b2966dd4f76269ef4ee1a2adfaa38cb79c866e3b19678cca245f14fa7d","observation_id":"c13b1b3b-7d47-4fe6-be0c-434307c30129","resolution":{"observed_at":"2026-08-04T09:13:39.993261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:40.143681Z","title":"Dragan, Kenton C.T","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:40.143681Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:c4a2734235957c5b32585f6cd61d61c887709bc02ddba8bb05d94e0e38366f46","observation_id":"5eea04b8-b574-454e-ad1d-3d956bde30dd","resolution":{"observed_at":"2026-08-04T09:13:40.143681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:40.303485Z","title":"Rewriting history with inverse rl: hindsight inference for policy improvement","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:40.303485Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:8b0890148305ee090cd3a0ad098b8fb9aa8d3f60a03d8a8aebc2bff4006f9871","observation_id":"7a96a078-4972-4d8d-bf4a-7fdd65b57d3d","resolution":{"observed_at":"2026-08-04T09:13:40.303485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:40.432655Z","title":"Contrastive learning as goal-conditioned reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:40.432655Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:ff85e056ecdb5f73be01c0aa5990e7b5234ab80782c86229494e80de46580160","observation_id":"f932746c-25c1-4aa8-b391-b61dda89fa8f","resolution":{"observed_at":"2026-08-04T09:13:40.432655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:40.588013Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:40.588013Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:8faa8af1578058159f68292f722b4cc73ed33b9bb8aa8355a7cddf9cd35f9e6f","observation_id":"13a3fa3d-ce8e-473e-8a8a-341be9f88242","resolution":{"observed_at":"2026-08-04T09:13:40.588013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:40.650012Z","title":"One-shot visual imitation learning via meta-learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:40.650012Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:937857e21ca1efb110879d616437f5f0bc860804915b3243ade790a066c4ae50","observation_id":"267f0237-36f7-4078-a0e4-d30b274b1972","resolution":{"observed_at":"2026-08-04T09:13:40.650012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:40.831139Z","title":"Automatic goal generation for reinforcement learning agents","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:40.831139Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:e06a13691e53d32febc0a3ecf6336873104153ecbee854ed0c8405a7a16227b8","observation_id":"0933dbc6-7c66-4041-b83f-90b48b68630f","resolution":{"observed_at":"2026-08-04T09:13:40.831139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:40.951233Z","title":"Brax -- a differentiable physics engine for large scale rigid body simulation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:40.951233Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:b5f294e0a7ce2e522263064ab68b6c7816197c8240a99fa36454fb0fc5d7e9b7","observation_id":"6b3b7084-ff4a-4800-82d6-9fc02e59b706","resolution":{"observed_at":"2026-08-04T09:13:40.951233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:41.070975Z","title":"Learning robust rewards with adverserial inverse reinforcement learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:41.070975Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:cd43499f0c891ea30d2b3612368299280c609f2ec558819db4645af111d8393f","observation_id":"66b9b235-668e-4ae9-8d5d-579ee992a518","resolution":{"observed_at":"2026-08-04T09:13:41.070975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:41.192615Z","title":"Childhood as a solution to explore–exploit tensions","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:41.192615Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:85d685f7b586c4c7f2859b71ecc660025b59812160053f9ba5b28fd045456799","observation_id":"2d10fdfc-483b-4207-8d66-cadf61fac8b4","resolution":{"observed_at":"2026-08-04T09:13:41.192615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1111/cdev.13059","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From exploration to instruction: Children learn from exploration and tailor their demonstrations to observers’ goals and competence","venue":"Child Development","work_id":"cdd2190b-0325-410e-a6b1-471e53b8e876","year":2019},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:41.311477Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:83745333fe0a2e20dbb48cffadb0833941e203b01b9b30977180d15bf8ead0d8","observation_id":"d03e36c1-877c-4e58-b4ff-d2928353fc98","resolution":{"observed_at":"2026-08-04T09:19:41.762434Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:41.452871Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:41.452871Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:d2ecacfc82faa400c7e2f78c0ed10a6c7c8373b0e0efdfb8b8f3b190a4d13d65","observation_id":"5696ae83-8730-4b20-bfba-4ced83715268","resolution":{"observed_at":"2026-08-04T09:13:41.452871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:41.537974Z","title":"Generative adversarial imitation learning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:41.537974Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:7c1e34c22044550f5a739efe6ed19620552f46abae3983ab2a5369d5f800c2cd","observation_id":"8daca791-ef19-4094-8814-a16e157eda47","resolution":{"observed_at":"2026-08-04T09:13:41.537974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:41.660099Z","title":"BC -z: Zero-shot task generalization with robotic imitation learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:41.660099Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:e7859adee92aabc55753de65e7aa25ca9e42671be10a7f1d0ff1e4d9a94e9f80","observation_id":"63b13824-8cc7-47ff-a6a6-325743b7cce3","resolution":{"observed_at":"2026-08-04T09:13:41.660099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:41.838120Z","title":"Learning to achieve goals","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:41.838120Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:4635cc00a5f6b6edf67618345b05f4d9e64ef7004e20e758c85a61f0c1255249","observation_id":"9bf686f9-4498-4349-8947-ccd45e497db3","resolution":{"observed_at":"2026-08-04T09:13:41.838120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:42.003804Z","title":"Variational curriculum reinforcement learning for unsupervised discovery of skills","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:42.003804Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:7d63aba14b5fffb7589d68a84a2cacd530d1ca63b486b4da3a629342d14ad658","observation_id":"9a12263d-a1ec-4510-a767-041acaa4fa02","resolution":{"observed_at":"2026-08-04T09:13:42.003804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:42.137865Z","title":"Urlb: Unsupervised reinforcement learning benchmark","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:42.137865Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:d0679cb2a85d42b0eeb198f33ab9282f3b0804a477570f826142b04febcc8b9a","observation_id":"9b02b917-31a8-4c2d-9044-5b7ca7f5a9c0","resolution":{"observed_at":"2026-08-04T09:13:42.137865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:42.220660Z","title":"Learning Temporal Distances : Contrastive Successor Features Can Provide a Metric Structure for Decision-Making","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:42.220660Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:2b5a7e1616f678142af86e3f10a6ff2d32281c3f88b6d81018c7307ede29b7b2","observation_id":"d6493173-d5f7-4868-b4e6-20c443719648","resolution":{"observed_at":"2026-08-04T09:13:42.220660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:42.323979Z","title":"Visual reinforcement learning with imagined goals","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:42.323979Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:51eb16c432db08b28d63b7a811c32c46cc1df496ae25b05cb32aa273f9eae147","observation_id":"cd9059e9-b2a1-47f8-876b-98086928dd8d","resolution":{"observed_at":"2026-08-04T09:13:42.323979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:42.455819Z","title":"Ng and Stuart J","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:42.455819Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:6996e1f92a95ad41f1c2d077e77541cf08c65e7c861c21e951f2df9ebc9cfa53","observation_id":"9e60e639-0f2a-450a-9eee-4f6007570b0f","resolution":{"observed_at":"2026-08-04T09:13:42.455819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:42.587587Z","title":"Octo: An open-source generalist robot policy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:42.587587Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:60905ee2921de8d6b5cf59dd6173be6068e91b376c21ace568dbcfa10a3c8425","observation_id":"f9917932-8820-467f-8298-19e74cdf65d6","resolution":{"observed_at":"2026-08-04T09:13:42.587587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-04T09:13:42.702322Z","title":"Representation Learning with Contrastive Predictive Coding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:42.702322Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:111a782171a3ad9d9b88bca80a3c8555670a32198ad4f266fd9469734dbeec79","observation_id":"cb46936d-9b86-47b9-86e5-9e44e2605a7b","resolution":{"observed_at":"2026-08-04T09:13:42.702322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.04882","last_updated":"2021-01-13T05:20:20Z","snapshot_observed_at":"2026-08-05T15:46:28.102967Z","submitted_at":"2021-01-13T05:20:20Z","title":"Asymmetric self-play for automatic goal discovery in robotic manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.04882","snapshot_observed_at":"2026-08-04T09:13:42.758136Z","title":"Asymmetric self-play for automatic goal discovery in robotic manipulation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:42.758136Z"},"links":{"cited_paper":"/paper/2101.04882","citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:ba137866a800edee9f91c9852c089c04546ad1f696c4677fda87eca0db6e3a57","observation_id":"23208fef-b9b2-480f-97fd-fdc51c537970","resolution":{"observed_at":"2026-08-04T09:13:42.758136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:42.836550Z","title":"Efros, and Trevor Darrell","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:42.836550Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:9ee15a12b661aaba862aa5f9449ac5f35e1b5a7c3a92823d2c33237c26a18fb8","observation_id":"aada6a38-8403-4dba-a29e-08cba8f192a2","resolution":{"observed_at":"2026-08-04T09:13:42.836550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:42.923057Z","title":"Fast imitation via behavior foundation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:42.923057Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:64ef84bcd40a6e4275324db1ea136b773b8c1aba69e2569bb0d1ebb26b641f24","observation_id":"a7f85e20-d2e7-442e-80df-4e453e33b435","resolution":{"observed_at":"2026-08-04T09:13:42.923057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:42.979411Z","title":"Maximum entropy gain exploration for long horizon multi-goal reinforcement learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:42.979411Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:fed7a6428409d751837bc355742cf8710a892c10a2f9efa43070910a0656becd","observation_id":"b2e87f02-e280-4d7b-9352-3d269b26aa77","resolution":{"observed_at":"2026-08-04T09:13:42.979411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1111/cdev.14158","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mars, and Sabine Hunnius","venue":"Child Development","work_id":"d63eb092-7cee-424d-92ce-c1812429df5e","year":2025},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:43.199000Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:e811f93596a9a05cbc94e7d753562cad629266540572f4f28c6c4d2d9b11eacf","observation_id":"ab4d95a2-01c7-491d-97bb-4135905ae3a5","resolution":{"observed_at":"2026-08-04T09:19:41.601827Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:43.359512Z","title":"Pomerleau","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:43.359512Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:5386559c01c64c09b86b5adb38d40c8bf68ac6670826ff3a62534c2466b12d3c","observation_id":"faa3e819-622a-4b6a-9c86-76a2713778f8","resolution":{"observed_at":"2026-08-04T09:13:43.359512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:43.502039Z","title":"Pong, Murtaza Dalal, Steven Lin, Ashvin Nair, Shikhar Bahl, and Sergey Levine","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:43.502039Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:a25ed8a5cc983b44e9c411bf4e30edbb14d36eba85139a5d7a18f94e6fd117a7","observation_id":"ac747817-3d3b-47d2-bb4c-97ba83324c7e","resolution":{"observed_at":"2026-08-04T09:13:43.502039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:43.647391Z","title":"A generalist agent","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:43.647391Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:1fe561c6a7bd50b4f398e1adc9967a7b34fd4ee0b6b4af3b50186d36a245d4ee","observation_id":"2a9123f5-695d-4f51-9e5e-7051c01aea31","resolution":{"observed_at":"2026-08-04T09:13:43.647391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:43.766494Z","title":"A reduction of imitation learning and structured prediction to no-regret online learning","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:43.766494Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:20912555b9e1156a89cbf5727915207c7490513304faec80daf9158d4da3d6ba","observation_id":"d90bb985-c42b-4a32-baa3-27170d6f1817","resolution":{"observed_at":"2026-08-04T09:13:43.766494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:43.891571Z","title":"Universal value function approximators","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:43.891571Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:0446b7ef6af25b7de40eb59424dc874c19821992e9ceabec769a1d5452a498e4","observation_id":"d80a857d-b193-4492-8980-5d65faeeb44e","resolution":{"observed_at":"2026-08-04T09:13:43.891571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:44.027911Z","title":"Smile: Scalable meta inverse reinforcement learning through context-conditional policies","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:44.027911Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:b4bdca73de0874385bd12742b282296a5bbd47f703f126f2991d3f30e7afa356","observation_id":"82b2a3cb-db7e-45ad-b7bf-0f2bd16f9aaf","resolution":{"observed_at":"2026-08-04T09:13:44.027911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:44.203028Z","title":"Mastering the game of go with deep neural networks and tree search","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:44.203028Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:d9015007fd8aac58148dda30b660f09dfa4b4cb6532fa18f274fca728ab1b9eb","observation_id":"6e4f21bc-79db-4853-bed2-37e4dfe689b3","resolution":{"observed_at":"2026-08-04T09:13:44.203028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:44.325710Z","title":"Stahl and Lisa Feigenson","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:44.325710Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:337a2fde175d347113ad16f3f4dfef1482b593c6f9386e04d4f051c70155a933","observation_id":"60f17fd8-6fe3-45f6-b24a-d0f9f0fcac49","resolution":{"observed_at":"2026-08-04T09:13:44.325710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:44.503585Z","title":"Learning one representation to optimize all rewards","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:44.503585Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:24b96181ff70f6a22e420e94a356615bbe33e44c173612a32c600584fe976b64","observation_id":"cf57dec7-32bd-41e5-9762-40d321ff9d41","resolution":{"observed_at":"2026-08-04T09:13:44.503585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:44.671189Z","title":"Optimal goal-reaching reinforcement learning via quasimetric learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:44.671189Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:bad7e820325310f49dfa0bd25bc2e56bae26045ec0c1f52bca1654d11bd6251b","observation_id":"398d1796-5be7-4e43-b705-574bf8d6acbe","resolution":{"observed_at":"2026-08-04T09:13:44.671189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:44.807858Z","title":"Unsupervised control through non-parametric discriminative rewards","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:44.807858Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:24fbbeb1d8f0066063733367e0460db2e07dbf61f8ffea8ee80853a8b403f099","observation_id":"654b6e25-acf6-4c75-ab75-0a6419f0c76e","resolution":{"observed_at":"2026-08-04T09:13:44.807858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:44.967363Z","title":"Outracing champion gran turismo drivers with deep reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:44.967363Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:7d657419f7498eb776ae7b56ad8612bb35e5f8e0e59dc052b0629e443c513bf8","observation_id":"82d6db6b-eb09-4abb-bf89-2ce82df9d26b","resolution":{"observed_at":"2026-08-04T09:13:44.967363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:45.071186Z","title":"Meta-inverse reinforcement learning with probabilistic context variables","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:45.071186Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:8712f8af0dca99b0eae6547dc82165131ff177cb0d6098af030ae080264de5af","observation_id":"870cb88d-5996-4736-ae55-a4bc744497ec","resolution":{"observed_at":"2026-08-04T09:13:45.071186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:45.200047Z","title":"One-shot imitation from observing humans via domain-adaptive meta-learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:45.200047Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:b4e8d5326e2c69b206e295f73e92ae90cbabb28312763fa8ab4cc359ca5090e0","observation_id":"d0384562-177c-4940-b133-00a9e52b9452","resolution":{"observed_at":"2026-08-04T09:13:45.200047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:45.315827Z","title":"Maximum entropy inverse reinforcement learning","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:45.315827Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:66486c38754c73beb764abdc1b03cf9ed471b00bfdfc521e59444fb27c26b933","observation_id":"23645e0e-ee35-4ef3-afba-d509455796b3","resolution":{"observed_at":"2026-08-04T09:13:45.315827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:45.480466Z","title":"Brown, and Anca D","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:45.480466Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:7db2501c4179dbc4e57a3b9ee9b8fb102d0365fc34dd51d026aad6baf15f2ee5","observation_id":"35b39290-c102-4415-bfcc-594b03fa3fc2","resolution":{"observed_at":"2026-08-04T09:13:45.480466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:45.622822Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:45.622822Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:1e9f952ad785d9abfce8670ebfcdae5992dfa3dac9865a60a0cd04c22ea1a301","observation_id":"a5bed69c-756d-437b-bbe9-39533c8f78dc","resolution":{"observed_at":"2026-08-04T09:13:45.622822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:45.791789Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:45.791789Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:27c788358d91cdb485d5834acc53906269e168d4604e389f49319c3db68f4c3e","observation_id":"14c214e3-d300-4d91-bccf-0cfda30b598f","resolution":{"observed_at":"2026-08-04T09:13:45.791789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:45.928079Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:45.928079Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:67e8b146fcda02d4deac96d217df827f04213352abb60cbbe57ef33181a7d1d9","observation_id":"37c08ce4-105c-4d6d-aae1-fdd6cfdb6c5b","resolution":{"observed_at":"2026-08-04T09:13:45.928079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:13:46.110853Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-04T09:13:46.110853Z"},"links":{"citing_paper":"/paper/2510.17059"},"observation_digest":"sha256:35edb77bb27547a578307ca085ca65decc52bfbad44e214bae665e77f1eeb5eb","observation_id":"a838e487-a640-4b6c-b825-64fd357dffef","resolution":{"observed_at":"2026-08-04T09:13:46.110853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2510.17059","last_updated":"2026-06-24T01:47:38Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T12:47:32.941946Z","submitted_at":"2025-10-20T00:28:03Z","title":"Consistent Zero-Shot Imitation with Contrastive Goal Inference"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":57,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 0 inbound Pith citation observations for arXiv:2510.17059."}