{"as_of":"2026-08-05T15:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e032ad005f8c56d07ad6ca182f29642730b711fc252b7523afb6aab8c2459bce","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T00:28:21.497424Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T02:07:34.156817Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1712.00948","last_updated":"2019-09-03T21:05:21Z","snapshot_observed_at":"2026-07-06T06:12:32.936457Z","submitted_at":"2017-12-04T08:18:08Z","title":"Learning Multi-Level Hierarchies with Hindsight","version":5},"cited_work":{"arxiv_id":"1712.00948","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1712.00948","snapshot_observed_at":"2026-07-03T02:07:34.156817Z","title":"Learning Multi-Level Hi- erarchies with Hindsight, September 2019","venue":null,"work_id":"610e4e55-7fea-4113-bbed-a6a8ca756e07","year":2017},"citing_paper":{"arxiv_id":"1907.00664","last_updated":"2019-07-01T11:22:52Z","snapshot_observed_at":"2026-07-06T08:04:02.269421Z","submitted_at":"2019-07-01T11:22:52Z","title":"Learning World Graphs to Accelerate Hierarchical Reinforcement Learning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-25T12:31:38.848720Z"},"links":{"cited_paper":"/paper/1712.00948","citing_paper":"/paper/1907.00664"},"observation_digest":"sha256:d2076fcd4f99b3e7af30943f433464fb726f777b55e04f1802cd41d16313c33f","observation_id":"81199ecb-c522-41f6-b07a-18363b25401f","resolution":{"observed_at":"2026-05-25T12:35:49.133772Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.00948","last_updated":"2019-09-03T21:05:21Z","snapshot_observed_at":"2026-07-06T06:12:32.936457Z","submitted_at":"2017-12-04T08:18:08Z","title":"Learning Multi-Level Hierarchies with Hindsight","version":5},"cited_work":{"arxiv_id":"1712.00948","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1712.00948","snapshot_observed_at":"2026-07-03T02:07:34.156817Z","title":"Learning Multi-Level Hi- erarchies with Hindsight, September 2019","venue":null,"work_id":"610e4e55-7fea-4113-bbed-a6a8ca756e07","year":2017},"citing_paper":{"arxiv_id":"2409.12917","last_updated":"2024-10-04T17:28:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-19T17:16:21Z","title":"Training Language Models to Self-Correct via Reinforcement Learning","version":2},"reference_index":217,"source":"arxiv_source","source_observed_at":"2026-05-17T12:04:10.210508Z"},"links":{"cited_paper":"/paper/1712.00948","citing_paper":"/paper/2409.12917"},"observation_digest":"sha256:a869b76093e12aaa71d858c4669b0b7540ff03d87523d8172a5af19b5f03a0d6","observation_id":"257f28c5-d6ed-4b06-bfeb-5d0b6e4cb1e6","resolution":{"observed_at":"2026-05-17T12:04:10.833730Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.00948","last_updated":"2019-09-03T21:05:21Z","snapshot_observed_at":"2026-07-06T06:12:32.936457Z","submitted_at":"2017-12-04T08:18:08Z","title":"Learning Multi-Level Hierarchies with Hindsight","version":5},"cited_work":{"arxiv_id":"1712.00948","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1712.00948","snapshot_observed_at":"2026-07-03T02:07:34.156817Z","title":"Learning Multi-Level Hi- erarchies with Hindsight, September 2019","venue":null,"work_id":"610e4e55-7fea-4113-bbed-a6a8ca756e07","year":2017},"citing_paper":{"arxiv_id":"2506.21039","last_updated":"2026-05-20T06:53:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-26T06:35:42Z","title":"Strict Subgoal Execution: Reliable Long-Horizon Planning in Hierarchical Reinforcement Learning","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T00:53:46.002945Z"},"links":{"cited_paper":"/paper/1712.00948","citing_paper":"/paper/2506.21039"},"observation_digest":"sha256:92ba9b12772db52613eca7a2115b47a165f194c55fea72f219c07b93b9f0976f","observation_id":"55873d67-a843-40b5-a060-7d878673b2f0","resolution":{"observed_at":"2026-05-22T00:54:31.206433Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.00948","last_updated":"2019-09-03T21:05:21Z","snapshot_observed_at":"2026-07-06T06:12:32.936457Z","submitted_at":"2017-12-04T08:18:08Z","title":"Learning Multi-Level Hierarchies with Hindsight","version":5},"cited_work":{"arxiv_id":"1712.00948","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1712.00948","snapshot_observed_at":"2026-07-03T02:07:34.156817Z","title":"Learning Multi-Level Hi- erarchies with Hindsight, September 2019","venue":null,"work_id":"610e4e55-7fea-4113-bbed-a6a8ca756e07","year":2017},"citing_paper":{"arxiv_id":"2509.00338","last_updated":"2026-05-08T15:17:41Z","snapshot_observed_at":"2026-08-02T17:36:08.274992Z","submitted_at":"2025-08-30T03:42:10Z","title":"Scalable Option Learning in High-Throughput Environments","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-18T20:04:58.064472Z"},"links":{"cited_paper":"/paper/1712.00948","citing_paper":"/paper/2509.00338"},"observation_digest":"sha256:58f64e55bbb6799d6696f0f9967ef145df3f0be245d7e036f5d28465917bdcb2","observation_id":"c4a50341-8965-468d-98c0-0d740f3f11d1","resolution":{"observed_at":"2026-05-18T20:06:49.738978Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.00948","last_updated":"2019-09-03T21:05:21Z","snapshot_observed_at":"2026-07-06T06:12:32.936457Z","submitted_at":"2017-12-04T08:18:08Z","title":"Learning Multi-Level Hierarchies with Hindsight","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.00948","snapshot_observed_at":"2026-08-03T03:18:43.091575Z","title":"Hier- archical actor-critic.arXiv:1712.00948, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.08557","last_updated":"2026-06-30T09:31:26Z","snapshot_observed_at":"2026-08-04T13:53:54.524141Z","submitted_at":"2026-02-09T11:54:45Z","title":"Combined Constrained Sampling and Reinforcement Learning for Robotic Manipulation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T03:18:43.091575Z"},"links":{"cited_paper":"/paper/1712.00948","citing_paper":"/paper/2602.08557"},"observation_digest":"sha256:9fa99346a06c2bd88fedc9ea2618978b94c5bb1770727f582a2a87115215effa","observation_id":"5e35741b-8585-4856-96b7-a9ebb544b128","resolution":{"observed_at":"2026-08-03T03:18:43.091575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.00948","last_updated":"2019-09-03T21:05:21Z","snapshot_observed_at":"2026-07-06T06:12:32.936457Z","submitted_at":"2017-12-04T08:18:08Z","title":"Learning Multi-Level Hierarchies with Hindsight","version":5},"cited_work":{"arxiv_id":"1712.00948","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1712.00948","snapshot_observed_at":"2026-07-03T02:07:34.156817Z","title":"Learning Multi-Level Hi- erarchies with Hindsight, September 2019","venue":null,"work_id":"610e4e55-7fea-4113-bbed-a6a8ca756e07","year":2017},"citing_paper":{"arxiv_id":"2605.01862","last_updated":"2026-05-08T03:23:44Z","snapshot_observed_at":"2026-07-06T23:15:01.968194Z","submitted_at":"2026-05-03T13:11:28Z","title":"QHyer: Q-conditioned Hybrid Attention-mamba Transformer for Offline Goal-conditioned RL","version":2},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-05-11T01:17:48.643521Z"},"links":{"cited_paper":"/paper/1712.00948","citing_paper":"/paper/2605.01862"},"observation_digest":"sha256:90129fcc3ec253e7f1bbf2b52cf748d07562e7abb2823e472f3c78ff0820866d","observation_id":"a0c15070-9519-4b6b-864c-67ed56e00bd4","resolution":{"observed_at":"2026-05-11T04:30:58.065014Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.00948","last_updated":"2019-09-03T21:05:21Z","snapshot_observed_at":"2026-07-06T06:12:32.936457Z","submitted_at":"2017-12-04T08:18:08Z","title":"Learning Multi-Level Hierarchies with Hindsight","version":5},"cited_work":{"arxiv_id":"1712.00948","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1712.00948","snapshot_observed_at":"2026-07-03T02:07:34.156817Z","title":"Learning Multi-Level Hi- erarchies with Hindsight, September 2019","venue":null,"work_id":"610e4e55-7fea-4113-bbed-a6a8ca756e07","year":2017},"citing_paper":{"arxiv_id":"2605.12261","last_updated":"2026-05-12T15:28:32Z","snapshot_observed_at":"2026-08-04T14:43:17.447713Z","submitted_at":"2026-05-12T15:28:32Z","title":"Delay-Empowered Causal Hierarchical Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T05:46:51.659283Z"},"links":{"cited_paper":"/paper/1712.00948","citing_paper":"/paper/2605.12261"},"observation_digest":"sha256:36a7c261cea225c137ab0ba9c124da11b1802b9940ef2b9b9040778399de7483","observation_id":"10a79b59-f989-4d6f-9a5f-ff99fc4abf32","resolution":{"observed_at":"2026-05-13T05:47:21.233473Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.00948","last_updated":"2019-09-03T21:05:21Z","snapshot_observed_at":"2026-07-06T06:12:32.936457Z","submitted_at":"2017-12-04T08:18:08Z","title":"Learning Multi-Level Hierarchies with Hindsight","version":5},"cited_work":{"arxiv_id":"1712.00948","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1712.00948","snapshot_observed_at":"2026-07-03T02:07:34.156817Z","title":"Learning Multi-Level Hi- erarchies with Hindsight, September 2019","venue":null,"work_id":"610e4e55-7fea-4113-bbed-a6a8ca756e07","year":2017},"citing_paper":{"arxiv_id":"2605.22711","last_updated":"2026-05-21T16:50:26Z","snapshot_observed_at":"2026-07-06T23:32:59.663926Z","submitted_at":"2026-05-21T16:50:26Z","title":"Abstraction for Offline Goal-Conditioned Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-22T07:46:20.289421Z"},"links":{"cited_paper":"/paper/1712.00948","citing_paper":"/paper/2605.22711"},"observation_digest":"sha256:98a7b27f44ea75e02e690a73dbec0b7b137e78d822fbc073af37bd158e4b51ee","observation_id":"11ae49c6-7149-4f27-829e-509333980c88","resolution":{"observed_at":"2026-05-22T07:51:16.522569Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.00948","last_updated":"2019-09-03T21:05:21Z","snapshot_observed_at":"2026-07-06T06:12:32.936457Z","submitted_at":"2017-12-04T08:18:08Z","title":"Learning Multi-Level Hierarchies with Hindsight","version":5},"cited_work":{"arxiv_id":"1712.00948","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1712.00948","snapshot_observed_at":"2026-07-03T02:07:34.156817Z","title":"Learning Multi-Level Hi- erarchies with Hindsight, September 2019","venue":null,"work_id":"610e4e55-7fea-4113-bbed-a6a8ca756e07","year":2017},"citing_paper":{"arxiv_id":"2606.09476","last_updated":"2026-06-08T13:35:22Z","snapshot_observed_at":"2026-08-01T13:38:00.934917Z","submitted_at":"2026-06-08T13:35:22Z","title":"Goal Sets, Not Goal States: Queryable Robot Goals through Goal-Set Hindsight Relabeling","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-27T16:07:28.361043Z"},"links":{"cited_paper":"/paper/1712.00948","citing_paper":"/paper/2606.09476"},"observation_digest":"sha256:ae23aaf25ed90d40847953581248347d26889ea880645c33db5e76e560ab547c","observation_id":"4bd6a974-0da4-402a-b89c-7116527be498","resolution":{"observed_at":"2026-07-03T02:07:34.158320Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.00948","last_updated":"2019-09-03T21:05:21Z","snapshot_observed_at":"2026-07-06T06:12:32.936457Z","submitted_at":"2017-12-04T08:18:08Z","title":"Learning Multi-Level Hierarchies with Hindsight","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.00948","snapshot_observed_at":"2026-08-02T03:42:47.680209Z","title":"Learning multi-level hierarchies with hindsight.arXiv preprint arXiv:1712.00948, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.13799","last_updated":"2026-07-15T13:07:25Z","snapshot_observed_at":"2026-08-03T01:33:21.230740Z","submitted_at":"2026-07-15T13:07:25Z","title":"Vision-Based Obstacle Separation for Strawberry Harvesting in Clusters Using Hierarchical Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T03:42:47.680209Z"},"links":{"cited_paper":"/paper/1712.00948","citing_paper":"/paper/2607.13799"},"observation_digest":"sha256:e2d2b151efe3c44f30cee10eca8cdb3bccc5e91470ca08e749f7933996e217c6","observation_id":"99c8ec5e-840c-437a-9ce2-1e0ccfab4028","resolution":{"observed_at":"2026-08-02T03:42:47.680209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.00948","last_updated":"2019-09-03T21:05:21Z","snapshot_observed_at":"2026-07-06T06:12:32.936457Z","submitted_at":"2017-12-04T08:18:08Z","title":"Learning Multi-Level Hierarchies with Hindsight","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.00948","snapshot_observed_at":"2026-08-01T13:10:39.713561Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.19232","last_updated":"2026-07-21T16:03:34Z","snapshot_observed_at":"2026-08-05T15:19:00.226115Z","submitted_at":"2026-07-21T16:03:34Z","title":"S3: Stable Subgoal Selection by Constraining Uncertainty of Coarse Dynamics in Hierarchical Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T13:10:39.713561Z"},"links":{"cited_paper":"/paper/1712.00948","citing_paper":"/paper/2607.19232"},"observation_digest":"sha256:11292d41e520cc0ddcf98e3bbdc15fbac5a105ad60f73efc4bad8caae07a1cb3","observation_id":"fcd44bf2-ed5b-4e57-bc47-5d60f92935d3","resolution":{"observed_at":"2026-08-01T13:10:39.713561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.00948","last_updated":"2019-09-03T21:05:21Z","snapshot_observed_at":"2026-07-06T06:12:32.936457Z","submitted_at":"2017-12-04T08:18:08Z","title":"Learning Multi-Level Hierarchies with Hindsight","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.00948","snapshot_observed_at":"2026-07-30T14:49:29.163862Z","title":"Chenghao Liu, Fei Zhu, Quan Liu, and Yuchen Fu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23726","last_updated":"2026-07-26T15:41:52Z","snapshot_observed_at":"2026-08-01T19:15:02.106400Z","submitted_at":"2026-07-26T15:41:52Z","title":"Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-30T14:49:29.163862Z"},"links":{"cited_paper":"/paper/1712.00948","citing_paper":"/paper/2607.23726"},"observation_digest":"sha256:7100b5ac5afd599d0ce5bcf5485dc561d104f36bc911e761f4304c36e0eba16b","observation_id":"e82ab8b3-acef-4e7a-a1df-96add91289d3","resolution":{"observed_at":"2026-07-30T14:49:29.163862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.00948","last_updated":"2019-09-03T21:05:21Z","snapshot_observed_at":"2026-07-06T06:12:32.936457Z","submitted_at":"2017-12-04T08:18:08Z","title":"Learning Multi-Level Hierarchies with Hindsight","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.00948","snapshot_observed_at":"2026-08-05T00:28:21.497424Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-05T15:20:17.867979Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:21.497424Z"},"links":{"cited_paper":"/paper/1712.00948","citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:b34ffb68c6a3a8d3141e82a5b48037189286464dd21e05829ec09b561c84e356","observation_id":"460194cc-9184-4098-9d02-d495822f57c1","resolution":{"observed_at":"2026-08-05T00:28:21.497424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.00948","last_updated":"2019-09-03T21:05:21Z","snapshot_observed_at":"2026-07-06T06:12:32.936457Z","submitted_at":"2017-12-04T08:18:08Z","title":"Learning Multi-Level Hierarchies with Hindsight","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.00948","snapshot_observed_at":"2026-08-04T19:45:34.875368Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.01851","last_updated":"2026-08-03T07:58:35Z","snapshot_observed_at":"2026-08-05T15:25:03.408067Z","submitted_at":"2026-08-03T07:58:35Z","title":"Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills","version":1},"reference_index":132,"source":"pdf_text","source_observed_at":"2026-08-04T19:45:34.875368Z"},"links":{"cited_paper":"/paper/1712.00948","citing_paper":"/paper/2608.01851"},"observation_digest":"sha256:13b8a2929cba2063243d285fa4da0230334a386209330a0eeadcb7987ebd57e8","observation_id":"72a1f002-9694-4f28-b2f1-e02318a63af0","resolution":{"observed_at":"2026-08-04T19:45:34.875368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1712.00948/citation-record","integrity":"/paper/1712.00948/integrity","json":"/paper/1712.00948/citation-record.json","paper":"/paper/1712.00948"},"outbound":[],"paper":{"arxiv_id":"1712.00948","last_updated":"2019-09-03T21:05:21Z","latest_version":5,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T06:12:32.936457Z","submitted_at":"2017-12-04T08:18:08Z","title":"Learning Multi-Level Hierarchies with Hindsight"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:1712.00948."}