{"as_of":"2026-08-09T14:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f1aee0ce65a3a269b54f71236118e58c52c0a52212acc6f58289e13a86696a1b","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:46:46.313353Z","state":"measured"},{"denominator":74,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":74,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T09:18:02.907912Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T20:38:55.094889Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"cited_work":{"arxiv_id":"2509.00361","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00361","snapshot_observed_at":"2026-07-03T20:38:55.094889Z","title":"//arxiv.org/abs/2509.00361","venue":null,"work_id":"36cbd6be-b53f-4af1-8845-74c83e4bccb9","year":2025},"citing_paper":{"arxiv_id":"2604.04974","last_updated":"2026-06-03T17:05:28Z","snapshot_observed_at":"2026-08-05T03:49:14.637609Z","submitted_at":"2026-04-04T15:37:11Z","title":"From Video to Control: A Survey of Learning Manipulation Interfaces from Temporal Visual Data","version":1},"reference_index":108,"source":"arxiv_source","source_observed_at":"2026-05-13T17:02:18.358675Z"},"links":{"cited_paper":"/paper/2509.00361","citing_paper":"/paper/2604.04974"},"observation_digest":"sha256:8c255270c6823fa09be56bfb62a04cfbc39adbb463d2d719fa70c13b03987d5b","observation_id":"37a47e5d-9e6f-4853-b434-5c507f0f6260","resolution":{"observed_at":"2026-05-13T17:03:01.008057Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"cited_work":{"arxiv_id":"2509.00361","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00361","snapshot_observed_at":"2026-07-03T20:38:55.094889Z","title":"//arxiv.org/abs/2509.00361","venue":null,"work_id":"36cbd6be-b53f-4af1-8845-74c83e4bccb9","year":2025},"citing_paper":{"arxiv_id":"2607.00836","last_updated":"2026-07-25T08:02:03Z","snapshot_observed_at":"2026-08-02T09:17:59.992551Z","submitted_at":"2026-07-01T11:56:54Z","title":"From World Models to World Action Models: A Concise Tutorial for Robotics","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-02T11:26:48.626947Z"},"links":{"cited_paper":"/paper/2509.00361","citing_paper":"/paper/2607.00836"},"observation_digest":"sha256:c95d492de17fa82608921655dc0afec8fb5190edc1b592dfa59b117a83472d68","observation_id":"91ce92ec-3a04-4158-8b5d-6a9173613662","resolution":{"observed_at":"2026-07-02T11:26:53.650928Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"cited_work":{"arxiv_id":"2509.00361","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00361","snapshot_observed_at":"2026-07-03T20:38:55.094889Z","title":"//arxiv.org/abs/2509.00361","venue":null,"work_id":"36cbd6be-b53f-4af1-8845-74c83e4bccb9","year":2025},"citing_paper":{"arxiv_id":"2607.00836","last_updated":"2026-07-25T08:02:03Z","snapshot_observed_at":"2026-08-02T09:17:59.992551Z","submitted_at":"2026-07-01T11:56:54Z","title":"From World Models to World Action Models: A Concise Tutorial for Robotics","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-03T20:35:21.512564Z"},"links":{"cited_paper":"/paper/2509.00361","citing_paper":"/paper/2607.00836"},"observation_digest":"sha256:24f6df66ac7eda50c7291dc7edecb37a638f041f3e7076ebbb313a2bcc21fdb6","observation_id":"dc092ea0-6538-47b3-a14e-72d972c2dc29","resolution":{"observed_at":"2026-07-03T20:38:55.096306Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.00361","snapshot_observed_at":"2026-07-12T09:15:00.615740Z","title":"Zhen, H., Sun, Q., Zhang, H., Li, J., Zhou, S., Du, Y ., and Gan, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.00836","last_updated":"2026-07-25T08:02:03Z","snapshot_observed_at":"2026-08-02T09:17:59.992551Z","submitted_at":"2026-07-01T11:56:54Z","title":"From World Models to World Action Models: A Concise Tutorial for Robotics","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-12T09:15:00.615740Z"},"links":{"cited_paper":"/paper/2509.00361","citing_paper":"/paper/2607.00836"},"observation_digest":"sha256:39ebb22b52bc087b8c77fb98d760207ca70d06f695fba238f32ba9946cd387ba","observation_id":"d2a87dfa-fb0d-4396-8215-678890cb02d3","resolution":{"observed_at":"2026-07-12T09:15:00.615740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.00361","snapshot_observed_at":"2026-08-02T09:18:02.907912Z","title":"Zhen, H., Sun, Q., Zhang, H., Li, J., Zhou, S., Du, Y ., and Gan, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.00836","last_updated":"2026-07-25T08:02:03Z","snapshot_observed_at":"2026-08-02T09:17:59.992551Z","submitted_at":"2026-07-01T11:56:54Z","title":"From World Models to World Action Models: A Concise Tutorial for Robotics","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T09:18:02.907912Z"},"links":{"cited_paper":"/paper/2509.00361","citing_paper":"/paper/2607.00836"},"observation_digest":"sha256:ec07ad67eab90f60d971c981fe926bc3e3128a70ffeb4c6cd026f8e8a6b2d300","observation_id":"c113a405-02c9-49df-ab82-fdf76331c0a8","resolution":{"observed_at":"2026-08-02T09:18:02.907912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.00361/citation-record","integrity":"/paper/2509.00361/integrity","json":"/paper/2509.00361/citation-record.json","paper":"/paper/2509.00361"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s44271-024-00153-x","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:46.864303Z","title":"Pilacinski, A","venue":null,"work_id":"f28127cb-4e3d-455c-9d05-263705b2f6c9","year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:40.587378Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:a480b3df0cf55676495e4c7e52d1333fa0979e9d20d421533ebd1cbda41d6d48","observation_id":"44f85150-9ece-4105-bbd0-fe68104d0671","resolution":{"observed_at":"2026-08-05T13:46:47.004440Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/0956797613497968","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:46.655230Z","title":null,"venue":null,"work_id":"1a1fac5e-34ed-44ea-9ace-5f9ec04d3b22","year":2014},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:40.675463Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:a48607c5ef812e8d944e6353d96c6e92c3c0ca73fefe111f459567cf57973946","observation_id":"3f0c72b0-6b6d-41d9-899e-62e929e3b4cb","resolution":{"observed_at":"2026-08-05T13:46:46.704949Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[{"edge_observation":{"observed_at":"2026-08-05T18:20:27.254155+00:00","source":"paper_reference_links","state":"open"},"event_date":"2014-01-28","event_type":"correction","notice_doi":"10.1177/0956797613520537","provenance":{"observed_at":"2026-07-11T03:02:22.628099+00:00","source":"crossref","source_record_id":"10.1177/0956797613520537->10.1177/0956797613497968:correction"}}],"reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1097/wco.0000000000000160","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:46.422790Z","title":"Faivre, R","venue":null,"work_id":"b82ca5f9-32d7-4679-95ed-38ec18326a36","year":2015},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:40.716204Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:fe8fe392ddafbbe8ac20129382e5a8aeb87cfab8cba46ba74922955eefa22fcf","observation_id":"021175f1-6c5f-49e5-b084-53f7073574cf","resolution":{"observed_at":"2026-08-05T13:46:46.519013Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:53.148851Z","title":"Yokosaka, S","venue":null,"work_id":"47c3d127-af5a-4165-9121-fef97f7268b5","year":2015},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:40.774818Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:aaf5e93496bfc5533329027ac58b74c5ea06e39252539772bb30e46ab2c906b5","observation_id":"c72a4797-ab7f-454a-86e7-9bb7b9827eab","resolution":{"observed_at":"2026-08-05T13:46:53.162583Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-05T13:46:40.831539Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:40.831539Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:bd3a8643c8581166f92d72348c5b1aeb63ca83951df63e4eda51fc43e27bbf18","observation_id":"da4e8ebc-cbf2-489b-a368-29d1c68da847","resolution":{"observed_at":"2026-08-05T13:46:40.831539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:40.943971Z","title":"Ghosh, H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:40.943971Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:8fc2bf28e3e3ff15f18c17edbca7357248d54c9daf3f0bd34912bbebdaf6c129","observation_id":"1ae7a7ad-7b2a-4f4c-aee4-f847aee2a2cf","resolution":{"observed_at":"2026-08-05T13:46:40.943971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06817","last_updated":"2023-08-11T17:45:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-13T18:55:15Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06817","snapshot_observed_at":"2026-08-05T13:46:41.025653Z","title":"Brohan, N","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:41.025653Z"},"links":{"cited_paper":"/paper/2212.06817","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:8b59a83e21b87680cd66823c2e18acbf32ecffe9880f68adf8ca1ea5ad3052ad","observation_id":"1a4c6b88-bf8c-40a4-b512-c43c8d1d6b05","resolution":{"observed_at":"2026-08-05T13:46:41.025653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-05T13:46:41.128379Z","title":"Brohan, N","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:41.128379Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:2f4ab52dfa5a6ab6c3cd7184231debe2fa7c739a6edb346329cc3ade088d0430","observation_id":"040e83ec-8af6-406c-a80b-6b80fd64f26c","resolution":{"observed_at":"2026-08-05T13:46:41.128379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-05T13:46:41.215161Z","title":"Black, N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:41.215161Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:511f5121d19924959d9f5152a0e5afb4ffa3c5f1d44f537bfce6e63547ed402a","observation_id":"1fc43ed9-d9e4-4b61-be7c-5d1c4d81762b","resolution":{"observed_at":"2026-08-05T13:46:41.215161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.12601","last_updated":"2022-11-18T05:57:09Z","snapshot_observed_at":"2026-08-02T11:48:59.131827Z","submitted_at":"2022-03-23T17:55:09Z","title":"R3M: A Universal Visual Representation for Robot Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.12601","snapshot_observed_at":"2026-08-05T13:46:41.282467Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:41.282467Z"},"links":{"cited_paper":"/paper/2203.12601","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:db75b9b8ba5e5bfac926415581b7451b8c47a5255542bc77b9641a0ee5cb5d31","observation_id":"1f9721e8-1adc-4e06-8553-8efed08bd421","resolution":{"observed_at":"2026-08-05T13:46:41.282467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.22325","last_updated":"2024-10-30T03:33:08Z","snapshot_observed_at":"2026-07-06T19:41:46.397542Z","submitted_at":"2024-10-29T17:58:13Z","title":"Robots Pre-train Robots: Manipulation-Centric Robotic Representation from Large-Scale Robot Datasets","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.22325","snapshot_observed_at":"2026-08-05T13:46:41.329672Z","title":"Jiang, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:41.329672Z"},"links":{"cited_paper":"/paper/2410.22325","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:93f5a6466bdfc61411b9510daf65f56a4b2ab8e1510320b49bb92864e0d56352","observation_id":"83b2689b-57c4-43af-a915-33773a2848f5","resolution":{"observed_at":"2026-08-05T13:46:41.329672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11758","last_updated":"2025-05-15T12:13:37Z","snapshot_observed_at":"2026-07-06T19:33:57.090585Z","submitted_at":"2024-10-15T16:28:09Z","title":"Latent Action Pretraining from Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11758","snapshot_observed_at":"2026-08-05T13:46:41.391260Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:41.391260Z"},"links":{"cited_paper":"/paper/2410.11758","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:ae288c2a003b63dfb75ac07d675dc0b02a6e298833065571a42fd55d6177ab17","observation_id":"ebcfce30-e81e-449d-a0f6-1bf1ddd6b4d4","resolution":{"observed_at":"2026-08-05T13:46:41.391260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10639","last_updated":"2023-10-16T17:57:23Z","snapshot_observed_at":"2026-08-08T13:35:58.479807Z","submitted_at":"2023-10-16T17:57:23Z","title":"Zero-Shot Robotic Manipulation with Pretrained Image-Editing Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10639","snapshot_observed_at":"2026-08-05T13:46:41.485175Z","title":"Black, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:41.485175Z"},"links":{"cited_paper":"/paper/2310.10639","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:9e9470107b8437030621ef4dfc5a25309620e88b7641de52768cce8de8d2a748","observation_id":"7a53ce2d-b9be-45b5-96ad-327cac5362a9","resolution":{"observed_at":"2026-08-05T13:46:41.485175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:53.092049Z","title":null,"venue":null,"work_id":"b6ca0a5f-753f-4936-8359-a9d9305fa001","year":2023},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:41.544067Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:217e1d639205f5efb9069554602469890a3e6766cd56349ca537fb35400d4504","observation_id":"60703a6e-3893-4d0c-87e6-4b9839dca071","resolution":{"observed_at":"2026-08-05T13:46:53.101626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.09016","last_updated":"2024-10-16T08:38:07Z","snapshot_observed_at":"2026-08-09T06:58:27.479603Z","submitted_at":"2024-09-13T17:45:07Z","title":"Closed-Loop Visuomotor Control with Generative Expectation for Robotic Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.09016","snapshot_observed_at":"2026-08-05T13:46:41.645910Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:41.645910Z"},"links":{"cited_paper":"/paper/2409.09016","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:b2ad9ceab0d3162896bbca77e0e451629eb52876eafac97a6638f00421170340","observation_id":"3f787edb-d74e-4f69-bcf9-445b7a860f6d","resolution":{"observed_at":"2026-08-05T13:46:41.645910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00025","last_updated":"2024-07-12T12:51:00Z","snapshot_observed_at":"2026-07-06T17:09:59.848387Z","submitted_at":"2023-12-28T23:34:43Z","title":"Any-point Trajectory Modeling for Policy Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00025","snapshot_observed_at":"2026-08-05T13:46:41.715080Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:41.715080Z"},"links":{"cited_paper":"/paper/2401.00025","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:366aa8de3d28e59af6b13391070919d5005ef83c2aeb61c9907695afcf402932","observation_id":"a9114b8e-feb4-4d12-8dc2-270d94feba53","resolution":{"observed_at":"2026-08-05T13:46:41.715080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15208","last_updated":"2024-10-04T04:05:27Z","snapshot_observed_at":"2026-08-09T04:30:43.516525Z","submitted_at":"2024-07-21T16:15:02Z","title":"Flow as the Cross-Domain Manipulation Interface","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15208","snapshot_observed_at":"2026-08-05T13:46:41.800733Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:41.800733Z"},"links":{"cited_paper":"/paper/2407.15208","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:6503e136dbea834395e382cff9c66d3208ecdd3b77945d0ed563d7d22ccffd6d","observation_id":"fed99a58-86c5-4f89-97eb-930c96553666","resolution":{"observed_at":"2026-08-05T13:46:41.800733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08576","last_updated":"2023-10-12T17:59:23Z","snapshot_observed_at":"2026-08-05T14:38:36.869054Z","submitted_at":"2023-10-12T17:59:23Z","title":"Learning to Act from Actionless Videos through Dense Correspondences","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08576","snapshot_observed_at":"2026-08-05T13:46:41.955554Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:41.955554Z"},"links":{"cited_paper":"/paper/2310.08576","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:827aced3b43280481c9591ae210cc195430999e106393301e186fc3aa5dae447","observation_id":"5de35d0b-5b26-46dd-a4a7-6f8f71c7f439","resolution":{"observed_at":"2026-08-05T13:46:41.955554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:53.057047Z","title":"Luo and Y","venue":null,"work_id":"8cadd194-e893-49e0-9a3d-22ceb10d7059","year":null},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:42.045016Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:e770e3c10dcbd58cb8c1cf41ea84e44aa422090660aced9c007f44f61b3c86a9","observation_id":"2a6ed33d-b7c8-4712-ad44-080d99ede465","resolution":{"observed_at":"2026-08-05T13:46:53.067121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-08-04T07:35:11.914654Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-08-05T13:46:42.190907Z","title":"Liang, R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:42.190907Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:7082847d105c00a8e06da92e3a1666508265038d996e50f7df1b20ffc86cf2c7","observation_id":"ec15c64e-e179-40d1-842e-775872f48e36","resolution":{"observed_at":"2026-08-05T13:46:42.190907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07875","last_updated":"2024-10-08T17:43:06Z","snapshot_observed_at":"2026-08-04T13:52:26.603078Z","submitted_at":"2024-07-10T17:41:10Z","title":"Generative Image as Action Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07875","snapshot_observed_at":"2026-08-05T13:46:42.288905Z","title":"Shridhar, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:42.288905Z"},"links":{"cited_paper":"/paper/2407.07875","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:ae07000bfbde7eae7b3a8edbae01a502e9c4adabb22940e2ffe4f7146db09312","observation_id":"8072a741-9bb4-46c7-8fdf-617405354e20","resolution":{"observed_at":"2026-08-05T13:46:42.288905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15109","last_updated":"2024-12-19T17:52:50Z","snapshot_observed_at":"2026-07-06T20:10:19.704368Z","submitted_at":"2024-12-19T17:52:50Z","title":"Predictive Inverse Dynamics Models are Scalable Learners for Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15109","snapshot_observed_at":"2026-08-05T13:46:42.380714Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:42.380714Z"},"links":{"cited_paper":"/paper/2412.15109","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:ad3521c4e11a31f6643c2c8684e629f9bd084840d2272af35a4cf71ce06acb7c","observation_id":"629ff88f-05d0-40eb-9eb9-812fc9976e70","resolution":{"observed_at":"2026-08-05T13:46:42.380714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06158","last_updated":"2024-10-08T16:00:47Z","snapshot_observed_at":"2026-08-03T02:22:13.984027Z","submitted_at":"2024-10-08T16:00:47Z","title":"GR-2: A Generative Video-Language-Action Model with Web-Scale Knowledge for Robot Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06158","snapshot_observed_at":"2026-08-05T13:46:42.481513Z","title":"Cheang, G","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:42.481513Z"},"links":{"cited_paper":"/paper/2410.06158","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:a92419ca457651c9a48a33d5b06153eb0f78128f45939ab2feca234bc424eef9","observation_id":"b69a492f-c3ad-4efd-8d90-333674e1472f","resolution":{"observed_at":"2026-08-05T13:46:42.481513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13139","last_updated":"2023-12-21T05:34:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-20T16:00:43Z","title":"Unleashing Large-Scale Video Generative Pre-training for Visual Robot Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.13139","snapshot_observed_at":"2026-08-05T13:46:42.565886Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:42.565886Z"},"links":{"cited_paper":"/paper/2312.13139","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:faad1b21235d08777c89030c8d8b7a3f7f8d1ac77a3c96e1304bfc5ca7b24dce","observation_id":"d8b5e56c-f63d-4e68-b95d-32e5da9ad8e1","resolution":{"observed_at":"2026-08-05T13:46:42.565886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:53.028679Z","title":"Merrill, Y","venue":null,"work_id":"6b1e4606-0089-47aa-a832-3b1655a66c1c","year":2022},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:42.648312Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:399f27bcae5764ffcc4b3dfc1cb010190bfae6da3414589a3f60fae0e49b7690","observation_id":"d37cedc2-5fa8-49cd-83f3-79cac17edd63","resolution":{"observed_at":"2026-08-05T13:46:53.036358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:52.990056Z","title":"Rad and V","venue":null,"work_id":"cf6b3e82-b366-4444-8c53-dfec4fea0549","year":2017},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:42.702926Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:b8c728dd1df42770c1045a6f94bde53a5095408bb769211cf69df5182c3a092e","observation_id":"b089404d-bf89-4df3-83a1-25efea150187","resolution":{"observed_at":"2026-08-05T13:46:53.003283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:52.965136Z","title":null,"venue":null,"work_id":"ba52f9cd-4029-4164-8c9e-c810d3978c33","year":2020},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:42.794961Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:a8aa76ac1d8813ac37afa8cb39c5abcff5c7ce874de2d6a7d97fb8cbe98186fe","observation_id":"f2d07038-3a4a-4d64-aea9-b56abe5e1d81","resolution":{"observed_at":"2026-08-05T13:46:52.972115Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:52.933609Z","title":null,"venue":null,"work_id":"54e017f1-a638-472f-a458-7ef9740c33bc","year":2020},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:42.883191Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:c13aa9f02adb0b91acf37c4a9a8e2d4b770e14dde26423ebc2a4fc4ca17e5e27","observation_id":"a8156329-0910-402e-b78e-9388662acc65","resolution":{"observed_at":"2026-08-05T13:46:52.941192Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.10790","last_updated":"2018-09-27T22:45:53Z","snapshot_observed_at":"2026-08-09T11:03:11.134683Z","submitted_at":"2018-09-27T22:45:53Z","title":"Deep Object Pose Estimation for Semantic Robotic Grasping of Household Objects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.10790","snapshot_observed_at":"2026-08-05T13:46:42.950287Z","title":"Tremblay, T","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:42.950287Z"},"links":{"cited_paper":"/paper/1809.10790","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:4fe19ab94cde66ed7e78538d1f77c51bafe82bbf41a268b42f6792d5f7b7b524","observation_id":"7f695c63-31f5-40d3-aec6-e90e4780b4f7","resolution":{"observed_at":"2026-08-05T13:46:42.950287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.09418","last_updated":"2022-03-29T18:23:03Z","snapshot_observed_at":"2026-08-06T05:49:03.165698Z","submitted_at":"2022-03-17T16:16:24Z","title":"ZebraPose: Coarse to Fine Surface Encoding for 6DoF Object Pose Estimation","version":2},"cited_work":{"arxiv_id":"2203.09418","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.09418","snapshot_observed_at":"2026-08-05T13:46:50.386265Z","title":"ZebraPose: Coarse to Fine Surface Encoding for 6DoF Object Pose Estimation","venue":"cs.CV","work_id":"7297723c-5846-4657-b985-dbe01bc750bc","year":2022},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.014343Z"},"links":{"cited_paper":"/paper/2203.09418","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:fe54734e8a86b0fa28ee941422bd392d1b6c1828f3a63bdff7efcc28123f9982","observation_id":"89913f19-c4fe-4d6c-8ae1-df9afdc150c7","resolution":{"observed_at":"2026-08-05T13:46:50.454729Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:52.904240Z","title":"Zakharov, I","venue":null,"work_id":"56e6fea1-7d2b-4585-a863-0253c1b80fcf","year":2019},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.074416Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:3baf6eaacd08fb13466aca5109b49771c0aa696dae5df03c9bc69e8996c57268","observation_id":"845c57b1-b90c-49ec-a1bf-8f104dd82519","resolution":{"observed_at":"2026-08-05T13:46:52.919124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:52.865041Z","title":null,"venue":null,"work_id":"5ab9d1dc-8979-48c5-a225-307dc6354cd7","year":2022},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.124336Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:a83dce276c139cc60e46696283715692010e0fa2565616b9ace6393b6992a92d","observation_id":"a53b0db7-c6d3-48b5-b9c5-34b8d53120af","resolution":{"observed_at":"2026-08-05T13:46:52.877129Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.13254","last_updated":"2022-08-11T14:38:50Z","snapshot_observed_at":"2026-08-05T20:16:50.691135Z","submitted_at":"2022-03-24T17:59:49Z","title":"EPro-PnP: Generalized End-to-End Probabilistic Perspective-n-Points for Monocular Object Pose Estimation","version":4},"cited_work":{"arxiv_id":"2203.13254","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.13254","snapshot_observed_at":"2026-08-05T13:46:50.253077Z","title":"EPro-PnP: Generalized End-to-End Probabilistic Perspective-n-Points for Monocular Object Pose Estimation","venue":"cs.CV","work_id":"2d452a6c-40c4-4066-8692-4fb4d434ba20","year":2022},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.216499Z"},"links":{"cited_paper":"/paper/2203.13254","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:2e0e70b21b5d641010f0aaa3da91426f82d10006ef8ff8191cf30a765fdbaf22","observation_id":"3b23a736-06d3-43af-b179-9b8859b7821a","resolution":{"observed_at":"2026-08-05T13:46:50.311169Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.13489","last_updated":"2022-04-04T07:38:44Z","snapshot_observed_at":"2026-07-06T12:12:25.898094Z","submitted_at":"2021-11-26T13:39:38Z","title":"SurfEmb: Dense and Continuous Correspondence Distributions for Object Pose Estimation with Learnt Surface Embeddings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.13489","snapshot_observed_at":"2026-08-05T13:46:43.312801Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.312801Z"},"links":{"cited_paper":"/paper/2111.13489","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:a3e7c5bddaffa829c6ee48944955ac2910fb2b6267e18ba3968a439671e5ebea","observation_id":"3c194759-8c3b-4a7c-bd37-72af9301ec4e","resolution":{"observed_at":"2026-08-05T13:46:43.312801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:43.364738Z","title":"Tekin, S","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.364738Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:13064b26b9b2962394bba8f69d4d712a44f573e7e34585aa3bef6221039fe705","observation_id":"16c48553-1b8d-4bdf-a1dd-4cbbb5aa2af7","resolution":{"observed_at":"2026-08-05T13:46:43.364738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:52.836992Z","title":null,"venue":null,"work_id":"cfa06268-4045-4c31-84d6-655c805d7d8b","year":2023},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.417422Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:68ef96317224e11b988833201225cc81a6c7f6fa29edcfe09549025ff7f7bdca","observation_id":"f85261fd-3a42-429a-8597-c677863da204","resolution":{"observed_at":"2026-08-05T13:46:52.844222Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:52.728097Z","title":"Linfang, L","venue":null,"work_id":"e80e0ea3-014e-4f86-8e1b-42d136a706a9","year":2022},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.486931Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:4dd00f643b3ed99dc0380be32bd3ef82027f52cb7cebff07b4d4a0bc6ac25a83","observation_id":"3f184f02-4369-4670-99bc-36cd4b955f21","resolution":{"observed_at":"2026-08-05T13:46:52.810367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:52.402137Z","title":null,"venue":null,"work_id":"e173f334-067b-4b9d-918a-3d6126bd6f79","year":2020},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.529395Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:16e7d4cade008f714c286e669345345e6020210f9cd9b8992bdce5225a20fd12","observation_id":"6543a10e-2314-46cc-91e3-283f9e668c7e","resolution":{"observed_at":"2026-08-05T13:46:52.580152Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.12580","last_updated":"2022-04-06T02:13:28Z","snapshot_observed_at":"2026-07-06T12:11:49.912242Z","submitted_at":"2021-11-24T16:00:48Z","title":"UDA-COPE: Unsupervised Domain Adaptation for Category-level Object Pose Estimation","version":2},"cited_work":{"arxiv_id":"2111.12580","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.12580","snapshot_observed_at":"2026-08-05T13:46:49.912694Z","title":"UDA-COPE: Unsupervised Domain Adaptation for Category-level Object Pose Estimation","venue":"cs.CV","work_id":"88d25e82-7c29-40ef-ac04-9407b6638669","year":2021},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.581751Z"},"links":{"cited_paper":"/paper/2111.12580","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:f66057ab9332c6b75c6416586d186f5b449aca5aecd0a19e9042ff10d353d30d","observation_id":"2e2da9b9-3e29-4d46-9b01-8e0a8f621832","resolution":{"observed_at":"2026-08-05T13:46:49.965921Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:52.161355Z","title":null,"venue":null,"work_id":"ededab74-12ec-4787-bea4-e9af8139f521","year":2020},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.662026Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:d5d6e51ea22abb29640a5b69293ab824117430af17abfa5f4b8a0e2a2ffe590e","observation_id":"9fdbf2cf-8804-4c40-b72f-01e53252e67d","resolution":{"observed_at":"2026-08-05T13:46:52.218928Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.13691","last_updated":"2022-07-27T17:59:31Z","snapshot_observed_at":"2026-08-05T20:16:35.205970Z","submitted_at":"2022-07-27T17:59:31Z","title":"ShAPO: Implicit Representations for Multi-Object Shape, Appearance, and Pose Optimization","version":1},"cited_work":{"arxiv_id":"2207.13691","doi":null,"metadata_source":"pith","pith_arxiv_id":"2207.13691","snapshot_observed_at":"2026-08-05T13:46:49.574071Z","title":"ShAPO: Implicit Representations for Multi-Object Shape, Appearance, and Pose Optimization","venue":"cs.CV","work_id":"f2f9a479-151b-465a-885b-d78f7f5bc110","year":2022},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.700214Z"},"links":{"cited_paper":"/paper/2207.13691","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:36b4e652669abe8282ecd515ce24e9390e20b176b13d9b049cc9f6eb16dce6ac","observation_id":"90b1c3bc-6822-4ee3-89eb-57006e0f33e9","resolution":{"observed_at":"2026-08-05T13:46:49.805872Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.11139","last_updated":"2024-04-17T07:34:21Z","snapshot_observed_at":"2026-08-05T21:42:07.886262Z","submitted_at":"2024-04-17T07:34:21Z","title":"GeoReF: Geometric Alignment Across Shape Variation for Category-level Object Pose Refinement","version":1},"cited_work":{"arxiv_id":"2404.11139","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.11139","snapshot_observed_at":"2026-08-05T13:46:49.434096Z","title":"GeoReF: Geometric Alignment Across Shape Variation for Category-level Object Pose Refinement","venue":"cs.CV","work_id":"f922a1e3-b986-49f7-83ee-e762a2f77a19","year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.745414Z"},"links":{"cited_paper":"/paper/2404.11139","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:74470707a8add5a494f4d8cf8b546ec4955a4f33b804a328248d549af5fb31b4","observation_id":"b0c25d50-2972-42d3-a013-39b492420cb1","resolution":{"observed_at":"2026-08-05T13:46:49.495636Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:43.859874Z","title":"Zheng, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.859874Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:c0577193a80771a5b892a9e71f313eaede627c3c1bfbaacd2dd3b4ea8e1aa6fb","observation_id":"8d46a4e9-7c43-4623-a2cd-702f57ff9f72","resolution":{"observed_at":"2026-08-05T13:46:43.859874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01652","last_updated":"2024-11-12T04:33:26Z","snapshot_observed_at":"2026-07-29T23:37:00.228879Z","submitted_at":"2024-09-03T06:45:22Z","title":"ReKep: Spatio-Temporal Reasoning of Relational Keypoint Constraints for Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01652","snapshot_observed_at":"2026-08-05T13:46:43.950437Z","title":"Huang, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.950437Z"},"links":{"cited_paper":"/paper/2409.01652","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:51221416ec5286c0d74a4cbb605403b9aff9ee2add3bfbcc29bc71947f4cc6d7","observation_id":"2f5d29b2-4919-42f5-bc61-6b8b0fcbac9e","resolution":{"observed_at":"2026-08-05T13:46:43.950437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:52.052162Z","title":null,"venue":null,"work_id":"56c4b3c3-b58c-43ac-898b-b0b306395285","year":2019},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:44.010175Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:7a7ce6f3521fd23b508275f670ee6be7cbc37898f7a6af51e3a5790384a14240","observation_id":"2d87681e-9a3a-4620-af7e-9752f9a6640c","resolution":{"observed_at":"2026-08-05T13:46:52.109942Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.09231","last_updated":"2020-04-23T19:22:25Z","snapshot_observed_at":"2026-08-06T01:59:22.863157Z","submitted_at":"2019-11-21T01:06:19Z","title":"Camera-to-Robot Pose Estimation from a Single Image","version":4},"cited_work":{"arxiv_id":"1911.09231","doi":null,"metadata_source":"pith","pith_arxiv_id":"1911.09231","snapshot_observed_at":"2026-08-05T13:46:49.012864Z","title":"Camera-to-Robot Pose Estimation from a Single Image","venue":"cs.RO","work_id":"cfa79f22-5f7e-490a-b1ea-a241cf3fcbad","year":2019},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:44.113562Z"},"links":{"cited_paper":"/paper/1911.09231","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:1dc83748cebed363086ad038b51daf62a0daa7d8bc69bb68d77113d0669bd65c","observation_id":"ee5d0559-d455-41c4-a716-7c3fea93c4b5","resolution":{"observed_at":"2026-08-05T13:46:49.132776Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10441","last_updated":"2024-09-16T16:22:43Z","snapshot_observed_at":"2026-08-08T23:53:37.326632Z","submitted_at":"2024-09-16T16:22:43Z","title":"CtRNet-X: Camera-to-Robot Pose Estimation in Real-world Conditions Using a Single Camera","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10441","snapshot_observed_at":"2026-08-05T13:46:44.183313Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:44.183313Z"},"links":{"cited_paper":"/paper/2409.10441","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:84505ee848bb9c7dc2edeb3dd3d5b076423a994e07c1d9b1f9d8d7a72fde4663","observation_id":"4c5e547c-668b-48d3-8354-ad35a2df1ddd","resolution":{"observed_at":"2026-08-05T13:46:44.183313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:51.887818Z","title":"Simoni, G","venue":null,"work_id":"aea033ef-f620-4691-a865-650d20ef4c4f","year":null},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:44.268468Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:752afac0bebebcc5d36b4e67479ef1d5e94b65a1e52f52b10fe77c76a282c9df","observation_id":"543b93b4-68f6-40c8-9c78-b7f0407a61cd","resolution":{"observed_at":"2026-08-05T13:46:51.972395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18259","last_updated":"2024-03-27T05:15:48Z","snapshot_observed_at":"2026-08-08T08:40:28.571741Z","submitted_at":"2024-03-27T05:15:48Z","title":"RoboKeyGen: Robot Pose and Joint Angles Estimation via Diffusion-based 3D Keypoint Generation","version":1},"cited_work":{"arxiv_id":"2403.18259","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.18259","snapshot_observed_at":"2026-08-05T13:46:48.453602Z","title":"RoboKeyGen: Robot Pose and Joint Angles Estimation via Diffusion-based 3D Keypoint Generation","venue":"cs.RO","work_id":"fbab5501-aa18-4a21-9e61-589e88a4a5ad","year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:44.484263Z"},"links":{"cited_paper":"/paper/2403.18259","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:565768afda95bc453d09d71f50f28dad5affe326f816b70cb3d6a4213f50d25c","observation_id":"d100bc37-e2c4-4c25-9fd8-520fda0a353f","resolution":{"observed_at":"2026-08-05T13:46:48.502392Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.34928","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:48.729195Z","title":null,"venue":null,"work_id":"c8c8a47d-d651-482b-8df9-48643af4ef5c","year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:44.381801Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:898abc3e9eafdf1d5904c6ff7d2affdae3b0cf4cc1a108e9fc58aebf6d47fa9d","observation_id":"27e73985-31a6-4f8b-a427-a63ee6c9aec2","resolution":{"observed_at":"2026-08-05T13:46:48.889260Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08344","last_updated":"2024-03-26T19:25:53Z","snapshot_observed_at":"2026-07-06T17:01:13.998131Z","submitted_at":"2023-12-13T18:28:09Z","title":"FoundationPose: Unified 6D Pose Estimation and Tracking of Novel Objects","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08344","snapshot_observed_at":"2026-08-05T13:46:44.662957Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:44.662957Z"},"links":{"cited_paper":"/paper/2312.08344","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:6da2d8dc6db52d665eb2409da07bed2c8ab6c6c08c170c577fb574ea69c5ba01","observation_id":"eb6804db-1ac7-448e-a9cc-07b60c7d7dc6","resolution":{"observed_at":"2026-08-05T13:46:44.662957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09359","last_updated":"2021-04-19T14:48:29Z","snapshot_observed_at":"2026-08-09T08:06:15.482071Z","submitted_at":"2021-04-19T14:48:29Z","title":"Single-view robot pose and joint angle estimation via render & compare","version":1},"cited_work":{"arxiv_id":"2104.09359","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.09359","snapshot_observed_at":"2026-08-05T13:46:48.275213Z","title":"Single-view robot pose and joint angle estimation via render & compare","venue":"cs.CV","work_id":"ebedccfc-52cc-4957-9fae-84e2d0156ab1","year":2021},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:44.558242Z"},"links":{"cited_paper":"/paper/2104.09359","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:986a0c2be73f5143b6d4655393eda9074f7e89275be0a060d22065d1b05881fc","observation_id":"2623f24e-96cd-4f0d-bc39-21ce4e81fbe2","resolution":{"observed_at":"2026-08-05T13:46:48.337182Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:44.814669Z","title":"Cheng, Y","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:44.814669Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:687210f5d1eae3373cc2ba7bb09ea6bcf9297b4f467cec8e8147a449cbb7e062","observation_id":"7471e147-37bb-4b4d-9242-4248629a656b","resolution":{"observed_at":"2026-08-05T13:46:44.814669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14051","last_updated":"2025-03-18T09:12:49Z","snapshot_observed_at":"2026-08-09T09:35:14.584001Z","submitted_at":"2025-03-18T09:12:49Z","title":"Foundation Feature-Driven Online End-Effector Pose Estimation: A Marker-Free and Learning-Free Approach","version":1},"cited_work":{"arxiv_id":"2503.14051","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.14051","snapshot_observed_at":"2026-08-05T13:46:48.133570Z","title":"Foundation Feature-Driven Online End-Effector Pose Estimation: A Marker-Free and Learning-Free Approach","venue":"cs.RO","work_id":"130daea9-adc1-4a27-b090-a16892078280","year":2025},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:44.738612Z"},"links":{"cited_paper":"/paper/2503.14051","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:7457e8b5a999314227e22c9b1a3e479f13f85a3324a4b515292b71d1c2772689","observation_id":"de0651fd-4d71-472c-b830-c18794b4a1a0","resolution":{"observed_at":"2026-08-05T13:46:48.172502Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.03003","last_updated":"2022-09-07T08:59:55Z","snapshot_observed_at":"2026-07-06T13:49:40.974495Z","submitted_at":"2022-09-07T08:59:55Z","title":"Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.03003","snapshot_observed_at":"2026-08-05T13:46:45.060814Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:45.060814Z"},"links":{"cited_paper":"/paper/2209.03003","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:3f8cc7a6176e41f25c028a0fba56a97421b9bd70e798bb536b588263e8b590f6","observation_id":"1da652ed-ddd4-4e62-91e4-f2a70d958316","resolution":{"observed_at":"2026-08-05T13:46:45.060814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12375","last_updated":"2025-06-15T03:50:49Z","snapshot_observed_at":"2026-07-06T20:24:03.105038Z","submitted_at":"2025-01-21T18:53:30Z","title":"Video Depth Anything: Consistent Depth Estimation for Super-Long Videos","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12375","snapshot_observed_at":"2026-08-05T13:46:44.930591Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:44.930591Z"},"links":{"cited_paper":"/paper/2501.12375","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:ee8db8b3185ccb4037b650f03831d0fe30b494d8b1d53e26af804704160e169e","observation_id":"c11040f0-350d-4e24-a23f-8f6aa3498ec0","resolution":{"observed_at":"2026-08-05T13:46:44.930591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-05T13:46:45.315475Z","title":"Radford, J","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:45.315475Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:95a45df395348d12be5648151456a10480e8338b8f69ca65260f3a8f40b29ed0","observation_id":"92144d53-003f-4349-87bf-8085d6c8e8d0","resolution":{"observed_at":"2026-08-05T13:46:45.315475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:51.730761Z","title":"Zheng, X","venue":null,"work_id":"a57cb7a0-9936-4bb6-9f37-d910a433f8fa","year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:45.230031Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:2a69a9cb4be1e944ff43641c1fe9a0ab9d95885874062c9d54bc94cd2c4f1f78","observation_id":"d6c42801-1bc5-49c3-8ceb-fc0f1ec263c1","resolution":{"observed_at":"2026-08-05T13:46:51.752616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:51.558098Z","title":null,"venue":null,"work_id":"eaa5850e-3dae-459a-885c-b81017740f71","year":2023},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:45.532609Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:4bbd1fe011e4e8b0fc5b9766c090053fc415853eecd04b6430617489b61152be","observation_id":"19dabf07-def1-40fd-811d-ba892e781d5d","resolution":{"observed_at":"2026-08-05T13:46:51.638815Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-05T13:46:45.403072Z","title":"Dosovitskiy, L","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:45.403072Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:78348b515b705e265bc94c537cfcb571e37397812c610eee126c266dfd2379cd","observation_id":"05f7fdb8-b206-48b6-a0e5-5a65a19aca62","resolution":{"observed_at":"2026-08-05T13:46:45.403072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:45.846958Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:45.846958Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:88929ea0b4db3291e7ef5cecb701249f4a3651e16454048c3bcdd9989cb52bc4","observation_id":"7815ea1b-fb14-4404-8c61-31290f218d68","resolution":{"observed_at":"2026-08-05T13:46:45.846958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:51.374230Z","title":"Baker, I","venue":null,"work_id":"4780ba73-c7a5-432e-93ed-5890fe54928c","year":null},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:45.619632Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:9dda9c8a650acbcc133da02d41b3c302abc377607117262665fda6f3b8b9df1c","observation_id":"de554558-61f9-4fb8-a2cf-08f91408270e","resolution":{"observed_at":"2026-08-05T13:46:51.474578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-05T13:46:45.992940Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:45.992940Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:8f351f73908dba9916191df924a63ad8632255df57402648c5a5c56dfb1070f7","observation_id":"c9089ae7-6bb7-487f-bfaf-be48b18fcb62","resolution":{"observed_at":"2026-08-05T13:46:45.992940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15830","last_updated":"2025-05-19T02:40:18Z","snapshot_observed_at":"2026-07-06T20:26:31.558337Z","submitted_at":"2025-01-27T07:34:33Z","title":"SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15830","snapshot_observed_at":"2026-08-05T13:46:46.071296Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:46.071296Z"},"links":{"cited_paper":"/paper/2501.15830","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:7bd441f3e46a8c495318f892281f14fd9c9df3f4857ec5855eb0067dbc6f084f","observation_id":"1284c179-f571-4499-9075-79e7daff4a1d","resolution":{"observed_at":"2026-08-05T13:46:46.071296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:45.938102Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:45.938102Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:e92f5a3a327c012b4a97085c2dea10cdd7e43e7b5a4506010c8e0cb1a28431ff","observation_id":"0ce53cfd-604e-4e39-a0c6-e46e976fddb7","resolution":{"observed_at":"2026-08-05T13:46:45.938102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10345","last_updated":"2025-06-05T21:26:08Z","snapshot_observed_at":"2026-08-02T17:44:41.340688Z","submitted_at":"2024-12-13T18:40:51Z","title":"TraceVLA: Visual Trace Prompting Enhances Spatial-Temporal Awareness for Generalist Robotic Policies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10345","snapshot_observed_at":"2026-08-05T13:46:46.313353Z","title":"Zheng, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:46.313353Z"},"links":{"cited_paper":"/paper/2412.10345","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:65f17e7e32fe157ae4fc12d04fbeb7c9bd739ff51d2f92e452aca621bf5e4286","observation_id":"5d91e7c0-de91-4bea-9839-ad7bc8c05e21","resolution":{"observed_at":"2026-08-05T13:46:46.313353Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:46.210195Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:46.210195Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:8e7e820b0ab736f892aae6daff67f83f85dd6b483ab72073d5f73de97096283e","observation_id":"825d5de9-3834-46a5-b771-65f81723c67e","resolution":{"observed_at":"2026-08-05T13:46:46.210195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.11795","last_updated":"2022-06-23T16:01:11Z","snapshot_observed_at":"2026-07-06T13:24:02.173160Z","submitted_at":"2022-06-23T16:01:11Z","title":"Video PreTraining (VPT): Learning to Act by Watching Unlabeled Online Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.11795","snapshot_observed_at":"2026-08-05T13:46:45.747217Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:45.747217Z"},"links":{"cited_paper":"/paper/2206.11795","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:d87ee85bf0f5d901aeac24416fe49972d725dd37e08cc1744b691e94191b99e1","observation_id":"6737d5a0-3899-4a16-84f7-71eba7eb3c2a","resolution":{"observed_at":"2026-08-05T13:46:45.747217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07223","last_updated":"2025-03-12T17:03:25Z","snapshot_observed_at":"2026-07-06T19:48:36.508447Z","submitted_at":"2024-11-11T18:43:44Z","title":"Grounding Video Models to Actions through Goal Conditioned Exploration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07223","snapshot_observed_at":"2026-08-05T13:46:42.119053Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:42.119053Z"},"links":{"cited_paper":"/paper/2411.07223","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:e7c9f10670ec43996b871499137a18ae72fbc7fc6b4e63017f356d880a632e0f","observation_id":"7c0ecbae-d3d8-4323-8457-0a184ab58190","resolution":{"observed_at":"2026-08-05T13:46:42.119053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-09T09:27:18.513708Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":2,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":46,"verified_exact":12,"verified_fuzzy":8},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 5 inbound Pith citation observations for arXiv:2509.00361."}