{"as_of":"2026-08-20T17:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:37c93ba270b8703445235c22f4085c414ac1ce8a1a2f994c544e8908075d6c7f","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T05:24:28.744397Z","state":"measured"},{"denominator":148,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":148,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":220,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:33:00.779254Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":327,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":"1712.05474","doi":"10.48550/arxiv.1712.05474","metadata_source":"pith","pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","venue":"cs.CV","work_id":"9c86ed28-ea70-424c-bd56-34f59dcad861","year":2017},"citing_paper":{"arxiv_id":"1807.06757","last_updated":"2018-07-18T03:28:02Z","snapshot_observed_at":"2026-08-14T11:12:04.949259Z","submitted_at":"2018-07-18T03:28:02Z","title":"On Evaluation of Embodied Navigation Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-13T22:41:57.280449Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/1807.06757"},"observation_digest":"sha256:e89b0f34de975b54596ca85052e216ceb90db66f9295c3b3e3c8b47fecab987b","observation_id":"bfe0c636-9ec7-4b4b-86f6-43ae0b28bf27","resolution":{"observed_at":"2026-05-13T22:41:57.335040Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":"1712.05474","doi":"10.48550/arxiv.1712.05474","metadata_source":"pith","pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","venue":"cs.CV","work_id":"9c86ed28-ea70-424c-bd56-34f59dcad861","year":2017},"citing_paper":{"arxiv_id":"1906.09836","last_updated":"2019-06-24T10:19:56Z","snapshot_observed_at":"2026-07-06T08:02:19.492472Z","submitted_at":"2019-06-24T10:19:56Z","title":"Learning Grasp Affordance Reasoning through Semantic Relations","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-25T17:28:43.255094Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/1906.09836"},"observation_digest":"sha256:1e46ba98b6cc6986e3e6efe4975242112694a91df183ee5a8b763471d068e286","observation_id":"2690d810-9cb8-449e-afe1-d3651b1b0b02","resolution":{"observed_at":"2026-05-25T17:31:06.190816Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":"1712.05474","doi":"10.48550/arxiv.1712.05474","metadata_source":"pith","pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","venue":"cs.CV","work_id":"9c86ed28-ea70-424c-bd56-34f59dcad861","year":2017},"citing_paper":{"arxiv_id":"1907.08584","last_updated":"2019-07-19T17:25:07Z","snapshot_observed_at":"2026-08-19T05:11:11.862466Z","submitted_at":"2019-07-19T17:25:07Z","title":"CraftAssist: A Framework for Dialogue-enabled Interactive Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-24T19:09:00.377577Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/1907.08584"},"observation_digest":"sha256:6be7f9bc3aa5ea190ce1d40099c877abc035600424e408f43a2f50b206e1a227","observation_id":"22eba7d0-8e09-4f3d-b5dd-7eba458188d0","resolution":{"observed_at":"2026-05-24T19:09:50.152441Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":"1712.05474","doi":"10.48550/arxiv.1712.05474","metadata_source":"pith","pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","venue":"cs.CV","work_id":"9c86ed28-ea70-424c-bd56-34f59dcad861","year":2017},"citing_paper":{"arxiv_id":"1907.09273","last_updated":"2019-07-25T21:52:08Z","snapshot_observed_at":"2026-08-19T01:51:03.945098Z","submitted_at":"2019-07-22T12:32:15Z","title":"Why Build an Assistant in Minecraft?","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-24T18:20:58.081505Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/1907.09273"},"observation_digest":"sha256:54c49649b3bc61461368fb6a712f91a7b78a99acf5967760d515c9e2c361ad9c","observation_id":"a19ba7ae-3005-47be-a9e8-c4ddae5cc0a6","resolution":{"observed_at":"2026-05-24T18:24:48.477480Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-14T15:15:36.801423Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.01482","last_updated":"2019-08-05T06:17:03Z","snapshot_observed_at":"2026-08-20T08:41:58.584696Z","submitted_at":"2019-08-05T06:17:03Z","title":"Walking with MIND: Mental Imagery eNhanceD Embodied QA","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T15:15:36.801423Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/1908.01482"},"observation_digest":"sha256:fd54eb8fe5c04ed4e1224f83fbfa0a28cfe236bdb28e191a7b709ddaf15027b2","observation_id":"c35da86b-e42e-497d-9f20-2ca7a81bc6a2","resolution":{"observed_at":"2026-08-14T15:15:36.801423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-14T12:51:25.759225Z","title":"Ai2-thor: An interactive 3d environment for visual ai","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.06376","last_updated":"2019-08-18T04:24:08Z","snapshot_observed_at":"2026-08-16T18:28:50.916767Z","submitted_at":"2019-08-18T04:24:08Z","title":"VUSFA:Variational Universal Successor Features Approximator to Improve Transfer DRL for Target Driven Visual Navigation","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-14T12:51:25.759225Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/1908.06376"},"observation_digest":"sha256:3e321443502db55c34a92cb8375b2c7781d6e2c9ac94efc093fcd773cb5fb7eb","observation_id":"004cd057-1325-4ba0-ab44-658b0645589f","resolution":{"observed_at":"2026-08-14T12:51:25.759225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-14T05:39:19.817301Z","title":"Ai2-thor: An interactive 3d environment for visual ai","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1909.00889","last_updated":"2022-08-10T04:32:05Z","snapshot_observed_at":"2026-08-20T00:48:54.230631Z","submitted_at":"2019-09-02T23:33:47Z","title":"Domain Randomization and Pyramid Consistency: Simulation-to-Real Generalization without Accessing Target Domain Data","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T05:39:19.817301Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/1909.00889"},"observation_digest":"sha256:06f39ba93f89d0f9a378028c6343813c1f1fdb1aa50d92a7695e5c59540c7177","observation_id":"6eac0cdc-1adf-41fc-a40b-719ebe0bb742","resolution":{"observed_at":"2026-08-14T05:39:19.817301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-14T05:39:19.364744Z","title":"Kolve, R","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1909.00915","last_updated":"2019-09-03T01:50:17Z","snapshot_observed_at":"2026-08-16T08:51:59.737033Z","submitted_at":"2019-09-03T01:50:17Z","title":"Counterfactual Depth from a Single RGB Image","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T05:39:19.364744Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/1909.00915"},"observation_digest":"sha256:878609a6a778332e74625e76e4d89f0235dd8fee1ea394b3cc6d6ae35e5cae10","observation_id":"a30eda51-1b8f-4382-99b5-d12b335e7629","resolution":{"observed_at":"2026-08-14T05:39:19.364744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":"1712.05474","doi":"10.48550/arxiv.1712.05474","metadata_source":"pith","pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","venue":"cs.CV","work_id":"9c86ed28-ea70-424c-bd56-34f59dcad861","year":2017},"citing_paper":{"arxiv_id":"2009.12293","last_updated":"2025-01-18T02:57:38Z","snapshot_observed_at":"2026-08-19T01:31:41.184872Z","submitted_at":"2020-09-25T15:32:31Z","title":"robosuite: A Modular Simulation Framework and Benchmark for Robot Learning","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-12T22:37:13.401815Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2009.12293"},"observation_digest":"sha256:b0375e590bb0587a51b2c870cb0cee398783d4ff91ef19c34fd0697a10a989b8","observation_id":"43b838bb-180f-4c4f-9298-ba30687ead45","resolution":{"observed_at":"2026-05-12T22:37:13.462593Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":"1712.05474","doi":"10.48550/arxiv.1712.05474","metadata_source":"pith","pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","venue":"cs.CV","work_id":"9c86ed28-ea70-424c-bd56-34f59dcad861","year":2017},"citing_paper":{"arxiv_id":"2109.08238","last_updated":"2021-09-16T22:01:24Z","snapshot_observed_at":"2026-08-15T09:50:41.483833Z","submitted_at":"2021-09-16T22:01:24Z","title":"Habitat-Matterport 3D Dataset (HM3D): 1000 Large-scale 3D Environments for Embodied AI","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-14T18:24:57.956486Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2109.08238"},"observation_digest":"sha256:2767288aff238400bcf565f69dc034f188e8b1c6b86cd9f9b8aae5cb674460dc","observation_id":"ae27d77f-82d5-41a7-b0ef-640e9442abdf","resolution":{"observed_at":"2026-05-14T18:24:58.031279Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":"1712.05474","doi":"10.48550/arxiv.1712.05474","metadata_source":"pith","pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","venue":"cs.CV","work_id":"9c86ed28-ea70-424c-bd56-34f59dcad861","year":2017},"citing_paper":{"arxiv_id":"2302.11550","last_updated":"2023-02-22T18:47:51Z","snapshot_observed_at":"2026-08-11T09:48:55.827823Z","submitted_at":"2023-02-22T18:47:51Z","title":"Scaling Robot Learning with Semantically Imagined Experience","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-17T18:59:10.352342Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2302.11550"},"observation_digest":"sha256:dffd856effa1d3394267f0ccb9aebbcb3870c9d019f3e1ba33d26f63a4ae806b","observation_id":"05c84b09-1b43-4ebb-910d-b931dca8bee3","resolution":{"observed_at":"2026-05-17T18:59:10.408799Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":"1712.05474","doi":"10.48550/arxiv.1712.05474","metadata_source":"pith","pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","venue":"cs.CV","work_id":"9c86ed28-ea70-424c-bd56-34f59dcad861","year":2017},"citing_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-08-13T16:55:46.498156Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T13:11:40.995345Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2305.16291"},"observation_digest":"sha256:777f8356ddffbd4ffb942a05682ee81ed79f57bd80ea8db153e41910ad8333b5","observation_id":"d3981621-f233-4cb0-ab0b-b4e6d3e45482","resolution":{"observed_at":"2026-05-12T05:24:31.084211Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":"1712.05474","doi":"10.48550/arxiv.1712.05474","metadata_source":"pith","pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","venue":"cs.CV","work_id":"9c86ed28-ea70-424c-bd56-34f59dcad861","year":2017},"citing_paper":{"arxiv_id":"2401.03568","last_updated":"2024-01-25T21:20:27Z","snapshot_observed_at":"2026-08-12T12:11:22.336410Z","submitted_at":"2024-01-07T19:11:18Z","title":"Agent AI: Surveying the Horizons of Multimodal Interaction","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-18T14:25:58.876978Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2401.03568"},"observation_digest":"sha256:f19312dce4a39845c1b9e3f39326506dea7b369ac845c60fa4c82a31cf3098bc","observation_id":"fcd9de80-60b2-49a3-b441-02f5aff29195","resolution":{"observed_at":"2026-05-18T14:25:59.189438Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":"1712.05474","doi":"10.48550/arxiv.1712.05474","metadata_source":"pith","pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","venue":"cs.CV","work_id":"9c86ed28-ea70-424c-bd56-34f59dcad861","year":2017},"citing_paper":{"arxiv_id":"2405.14093","last_updated":"2026-05-01T01:50:44Z","snapshot_observed_at":"2026-08-04T06:47:25.827167Z","submitted_at":"2024-05-23T01:43:54Z","title":"A Survey on Vision-Language-Action Models for Embodied AI","version":8},"reference_index":176,"source":"pdf_text","source_observed_at":"2026-05-24T01:25:10.150459Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2405.14093"},"observation_digest":"sha256:c10574c49c7dcfea19719f81593387d250a1cfced9181f62a1c88427b9093fbf","observation_id":"74d7dfa0-0376-41a5-99aa-105225633984","resolution":{"observed_at":"2026-05-24T01:25:54.317439Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":"1712.05474","doi":"10.48550/arxiv.1712.05474","metadata_source":"pith","pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","venue":"cs.CV","work_id":"9c86ed28-ea70-424c-bd56-34f59dcad861","year":2017},"citing_paper":{"arxiv_id":"2406.02523","last_updated":"2024-06-04T17:41:31Z","snapshot_observed_at":"2026-08-16T06:47:25.140028Z","submitted_at":"2024-06-04T17:41:31Z","title":"RoboCasa: Large-Scale Simulation of Everyday Tasks for Generalist Robots","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-12T23:46:30.198761Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2406.02523"},"observation_digest":"sha256:f68663ba62c7d83ac8285c4cf724aa43d41487639182caf9c8ecc9a89c4532b6","observation_id":"239b312b-1165-4ec4-b1eb-5a1d79f2d5d6","resolution":{"observed_at":"2026-05-12T23:46:30.274608Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-12T21:10:46.183052Z","title":"Kolve, R","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.09052","last_updated":"2024-11-13T22:15:31Z","snapshot_observed_at":"2026-08-16T02:42:01.659737Z","submitted_at":"2024-11-13T22:15:31Z","title":"ClevrSkills: Compositional Language and Visual Reasoning in Robotics","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T21:10:46.183052Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2411.09052"},"observation_digest":"sha256:21c032fb5d95fbe7c414784483c694612147cf7f3471c8f53b916ad7959b797d","observation_id":"e17293a4-93aa-42b5-8cf0-622d757b3423","resolution":{"observed_at":"2026-08-12T21:10:46.183052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-12T17:06:34.166406Z","title":"Kolve, R","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.12960","last_updated":"2024-11-20T01:27:56Z","snapshot_observed_at":"2026-08-14T05:03:50.107435Z","submitted_at":"2024-11-20T01:27:56Z","title":"I Can Tell What I am Doing: Toward Real-World Natural Language Grounding of Robot Experiences","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T17:06:34.166406Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2411.12960"},"observation_digest":"sha256:b5aee83a24028841c27c283a991817d96f49e4939f76b987546e5f71d12ab344","observation_id":"bc355c25-811d-4d28-9f59-6bfd8e3e914b","resolution":{"observed_at":"2026-08-12T17:06:34.166406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-12T14:02:18.629784Z","title":"Ai2-THOR: An interactive 3d environment for visual ai","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.15714","last_updated":"2024-11-24T04:51:24Z","snapshot_observed_at":"2026-08-20T10:46:52.378130Z","submitted_at":"2024-11-24T04:51:24Z","title":"ROOT: VLM based System for Indoor Scene Understanding and Beyond","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T14:02:18.629784Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2411.15714"},"observation_digest":"sha256:3a2b11f64465193faf5c75bdcd3788a725c0e6d2816029af66fc1c6c4aa42b03","observation_id":"ddc1ef5c-9df6-4241-a33f-432e321158ad","resolution":{"observed_at":"2026-08-12T14:02:18.629784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-12T11:52:48.074549Z","title":"Ai2-thor: An interactive 3d environment for visual ai","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.17820","last_updated":"2025-04-22T01:16:08Z","snapshot_observed_at":"2026-08-20T03:27:15.577312Z","submitted_at":"2024-11-26T19:02:20Z","title":"CityWalker: Learning Embodied Urban Navigation from Web-Scale Videos","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T11:52:48.074549Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2411.17820"},"observation_digest":"sha256:fac49ebd451206bf4f151f737b6f1b29fcff05da76f54f08f80387f047197a2e","observation_id":"1495f859-8e6e-482d-9c80-cc8ae08a62bb","resolution":{"observed_at":"2026-08-12T11:52:48.074549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-12T11:31:14.362819Z","title":"Kolve, R","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.18147","last_updated":"2024-11-27T08:53:16Z","snapshot_observed_at":"2026-08-18T15:29:44.854738Z","submitted_at":"2024-11-27T08:53:16Z","title":"Online Knowledge Integration for 3D Semantic Mapping: A Survey","version":1},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-08-12T11:31:14.362819Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2411.18147"},"observation_digest":"sha256:946e32a4d11c7cc92fc0cf2d99c1df617b7f8899a1860d0b9ace3eecd8cedc0a","observation_id":"51bb2fdd-3d6a-4871-a4e7-7c4ded61b03b","resolution":{"observed_at":"2026-08-12T11:31:14.362819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-11T23:32:13.149398Z","title":"Ai2-thor: An interactive 3d environment for visual ai,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.02449","last_updated":"2024-12-03T13:34:42Z","snapshot_observed_at":"2026-08-19T12:38:19.013618Z","submitted_at":"2024-12-03T13:34:42Z","title":"BYE: Build Your Encoder with One Sequence of Exploration Data for Long-Term Dynamic Scene Understanding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T23:32:13.149398Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2412.02449"},"observation_digest":"sha256:e0aa15e6682b62af3caab8f2f5f33d7e8e67de13c686f38c0172fc755bf59047","observation_id":"765bf078-6c0e-4aeb-8ca6-43bfc85cbba4","resolution":{"observed_at":"2026-08-11T23:32:13.149398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-11T20:40:39.582082Z","title":"Ai2-thor: An interactive 3d environment for visual ai","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.05552","last_updated":"2024-12-07T06:12:53Z","snapshot_observed_at":"2026-08-13T08:22:23.403870Z","submitted_at":"2024-12-07T06:12:53Z","title":"SAME: Learning Generic Language-Guided Visual Navigation with State-Adaptive Mixture of Experts","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T20:40:39.582082Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2412.05552"},"observation_digest":"sha256:a66d7ef2800982d3484d7e415a12b013c9e596259884125e2e6b66f0067b5048","observation_id":"9b6acf39-ecee-4f1d-9e18-ccd3b154a435","resolution":{"observed_at":"2026-08-11T20:40:39.582082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-11T20:36:59.096170Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.05596","last_updated":"2025-02-24T10:27:39Z","snapshot_observed_at":"2026-08-19T12:29:44.821778Z","submitted_at":"2024-12-07T09:23:17Z","title":"TB-HSU: Hierarchical 3D Scene Understanding with Contextual Affordances","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T20:36:59.096170Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2412.05596"},"observation_digest":"sha256:217d139188bf469b224c015d6c3a836f5eb456ac3df0040260318a7d56452261","observation_id":"80be0ad9-0899-40eb-8f5a-61138d6a41fd","resolution":{"observed_at":"2026-08-11T20:36:59.096170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-11T21:22:36.624899Z","title":"Ai2-thor: An interactive 3d environment for visual ai","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.10402","last_updated":"2024-12-05T21:52:20Z","snapshot_observed_at":"2026-08-19T14:36:55.271943Z","submitted_at":"2024-12-05T21:52:20Z","title":"TANGO: Training-free Embodied AI Agents for Open-world Tasks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T21:22:36.624899Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2412.10402"},"observation_digest":"sha256:2afa764e1c28ddca9044849d21cccdbfd952c620875940a6d7cd42b197c1c0a2","observation_id":"50175490-f70b-4544-8417-83e4e04e0a24","resolution":{"observed_at":"2026-08-11T21:22:36.624899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-11T14:57:26.640943Z","title":"Ai2-thor: An interactive 3d environment for visual ai","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.11484","last_updated":"2024-12-16T06:53:00Z","snapshot_observed_at":"2026-08-18T14:59:52.650229Z","submitted_at":"2024-12-16T06:53:00Z","title":"Efficient Policy Adaptation with Contrastive Prompt Ensemble for Embodied Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T14:57:26.640943Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2412.11484"},"observation_digest":"sha256:8e9f81046fa27bbe9fbcd4dc4629b4e0118dbc5915be835c4923cef8a282e35e","observation_id":"3e10368a-630f-47ef-b5ea-756ea3814e72","resolution":{"observed_at":"2026-08-11T14:57:26.640943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-11T20:04:14.771119Z","title":"AI2-THOR: an interactive 3d environment for visual AI","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.13211","last_updated":"2025-02-28T10:10:33Z","snapshot_observed_at":"2026-08-19T04:36:38.412148Z","submitted_at":"2024-12-09T01:29:24Z","title":"ManiSkill-HAB: A Benchmark for Low-Level Manipulation in Home Rearrangement Tasks","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T20:04:14.771119Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2412.13211"},"observation_digest":"sha256:89e4093e32f8da8dc8bf085939c8dba810170cd88997ff280067fe8820c36e4b","observation_id":"569cd454-3df1-445a-97ad-79447ed790ec","resolution":{"observed_at":"2026-08-11T20:04:14.771119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-11T12:20:28.118313Z","title":"Kolve, R","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.14401","last_updated":"2025-05-23T21:41:56Z","snapshot_observed_at":"2026-08-16T19:48:06.405152Z","submitted_at":"2024-12-18T23:15:41Z","title":"The One RING: a Robotic Indoor Navigation Generalist","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T12:20:28.118313Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2412.14401"},"observation_digest":"sha256:1fa7ca88f20425fbb6da63fc0cbaf84f52586d234512a1e7445f69f5617f6abd","observation_id":"2c3728d9-80b9-46b8-b077-0a1a73c400dc","resolution":{"observed_at":"2026-08-11T12:20:28.118313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-11T05:42:03.784007Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.17288","last_updated":"2024-12-23T05:20:01Z","snapshot_observed_at":"2026-08-18T13:08:02.940708Z","submitted_at":"2024-12-23T05:20:01Z","title":"Multi-Modal Grounded Planning and Efficient Replanning For Learning Embodied Agents with A Few Examples","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T05:42:03.784007Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2412.17288"},"observation_digest":"sha256:66ea521b2dc9c8308073d9ccb34deffb745280cefb6614d3e8e06b024ae46c72","observation_id":"39bbe53f-2065-4bbc-9169-8fa60c692d74","resolution":{"observed_at":"2026-08-11T05:42:03.784007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-11T04:35:18.676758Z","title":"Ai2-thor: An interactive 3d environment for visual ai,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.18774","last_updated":"2025-08-18T07:13:27Z","snapshot_observed_at":"2026-08-19T23:06:23.078532Z","submitted_at":"2024-12-25T04:29:22Z","title":"Embodied Image Quality Assessment for Robotic Intelligence","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T04:35:18.676758Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2412.18774"},"observation_digest":"sha256:dc5b2ca825945c04a980c9aad181f3ee78ad95d3062948e582283ca964cf2a23","observation_id":"35066bc1-a63c-4196-8c90-e35bbedc7331","resolution":{"observed_at":"2026-08-11T04:35:18.676758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-11T00:55:36.072193Z","title":"Kolve, R","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.19159","last_updated":"2024-12-26T10:38:40Z","snapshot_observed_at":"2026-08-18T04:09:19.326093Z","submitted_at":"2024-12-26T10:38:40Z","title":"Mobile Robots through Task-Based Human Instructions using Incremental Curriculum Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T00:55:36.072193Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2412.19159"},"observation_digest":"sha256:d6e92def9c3faeea6b0f013e9530ac990c815d806f1379c9a5db964017b53e07","observation_id":"ebc91bea-74a8-48c3-8d77-baf0e7c38a5e","resolution":{"observed_at":"2026-08-11T00:55:36.072193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-10T23:08:23.012300Z","title":"AI2-THOR: An interactive 3d environment for visual ai","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.20977","last_updated":"2025-08-12T11:56:32Z","snapshot_observed_at":"2026-08-19T22:56:42.163560Z","submitted_at":"2024-12-30T14:31:01Z","title":"UnrealZoo: Enriching Photo-realistic Virtual Worlds for Embodied AI","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:23.012300Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2412.20977"},"observation_digest":"sha256:0ad8ef1bfec918ec5a9bc2606d9bce0fc0acbd3248eac713d0933a74780c7408","observation_id":"9dc14958-50c8-42bb-a725-d4710cab2b23","resolution":{"observed_at":"2026-08-10T23:08:23.012300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-10T22:17:23.201554Z","title":"Ai2-thor: An interactive 3d environment for visual ai","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.02189","last_updated":"2025-04-06T03:12:51Z","snapshot_observed_at":"2026-08-13T18:28:46.913210Z","submitted_at":"2025-01-04T04:59:33Z","title":"A Survey of State of the Art Large Vision Language Models: Alignment, Benchmark, Evaluations and Challenges","version":6},"reference_index":109,"source":"pdf_text","source_observed_at":"2026-08-10T22:17:23.201554Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2501.02189"},"observation_digest":"sha256:e3c8205cf4faf3bba8043a2b11a6604e2f531673dca6e4a810f5cb012cc686e3","observation_id":"6794fea9-146b-409e-8b10-5bf9c89e740f","resolution":{"observed_at":"2026-08-10T22:17:23.201554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-10T21:56:12.903085Z","title":"Ai2- thor: An interactive 3d environment for visual ai,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.03151","last_updated":"2025-01-06T17:18:47Z","snapshot_observed_at":"2026-08-16T16:12:12.950932Z","submitted_at":"2025-01-06T17:18:47Z","title":"Large language models for artificial general intelligence (AGI): A survey of foundational principles and approaches","version":1},"reference_index":226,"source":"pdf_text","source_observed_at":"2026-08-10T21:56:12.903085Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2501.03151"},"observation_digest":"sha256:da7a6df9ee40540099ba90ec81c515a9803abfee421561cdf0f1bdb31d5487a4","observation_id":"456dec47-d870-4d6d-accf-7a4808134c2d","resolution":{"observed_at":"2026-08-10T21:56:12.903085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-10T21:25:47.053331Z","title":"Ai2-thor: An interactive 3d environment for visual ai","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.05031","last_updated":"2025-03-13T07:45:55Z","snapshot_observed_at":"2026-08-16T08:14:12.523999Z","submitted_at":"2025-01-09T07:43:49Z","title":"ECBench: Can Multi-modal Foundation Models Understand the Egocentric World? A Holistic Embodied Cognition Benchmark","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T21:25:47.053331Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2501.05031"},"observation_digest":"sha256:7d5e5db6d38fd03be246ba46904a04aa931eb3b8427745c3ba78fbc31f91502d","observation_id":"4b4d039f-8fa7-49c7-af01-532f6f7b4cd7","resolution":{"observed_at":"2026-08-10T21:25:47.053331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-10T21:23:57.907464Z","title":"Ai2-thor: An interactive 3d environment for visual ai","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.05037","last_updated":"2025-03-27T09:39:11Z","snapshot_observed_at":"2026-08-15T23:52:44.354788Z","submitted_at":"2025-01-09T07:51:14Z","title":"LongViTU: Instruction Tuning for Long-Form Video Understanding","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T21:23:57.907464Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2501.05037"},"observation_digest":"sha256:f8b9746ef164fc3700de922d80d09e8568bd273a7a6b7ba7ce1d6c489bf67894","observation_id":"11f9d73c-fe41-4568-8245-86e8ee8fff3b","resolution":{"observed_at":"2026-08-10T21:23:57.907464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-10T17:51:10.556523Z","title":"Mukul Khanna, Yongsen Mao, Hanxiao Jiang, Sanjay Haresh, Brennan Shacklett, Dhruv Batra, Alexander Clegg, Eric Undersander, Angel X Chang, and Mano- lis Savva","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.11858","last_updated":"2025-04-11T04:26:42Z","snapshot_observed_at":"2026-08-17T14:05:20.638470Z","submitted_at":"2025-01-21T03:22:10Z","title":"EmbodiedEval: Evaluate Multimodal LLMs as Embodied Agents","version":2},"reference_index":373,"source":"pdf_text","source_observed_at":"2026-08-10T17:51:10.556523Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2501.11858"},"observation_digest":"sha256:029206011c36e9ab5af5c4962a021a566de7eefa99fb3e6b8fb7fda4d7c05a06","observation_id":"bbed4e1e-e391-49e0-a1e6-972445575f29","resolution":{"observed_at":"2026-08-10T17:51:10.556523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-09T19:24:17.640967Z","title":"Ai2- thor: An interactive 3d environment for visual ai","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.00342","last_updated":"2025-08-08T07:24:11Z","snapshot_observed_at":"2026-08-15T20:59:44.756476Z","submitted_at":"2025-02-01T07:01:33Z","title":"Embodied Intelligence for 3D Understanding: A Survey on 3D Scene Question Answering","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-09T19:24:17.640967Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2502.00342"},"observation_digest":"sha256:3b08331cfe34b3013d09f5981d00ebe5f8b57563a33f226421ae02cfb200ded1","observation_id":"30a559e7-2bf1-478c-853b-a462c84f49e3","resolution":{"observed_at":"2026-08-09T19:24:17.640967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-09T17:32:27.904372Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.00858","last_updated":"2025-09-12T15:09:06Z","snapshot_observed_at":"2026-08-17T05:34:02.055203Z","submitted_at":"2025-02-02T17:16:25Z","title":"Learning to Plan with Personalized Preferences","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T17:32:27.904372Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2502.00858"},"observation_digest":"sha256:4d5b279ee1be409f23f9995a87a24fd66cf1498e78beba4a8d206047266e2113","observation_id":"969c0735-d55a-4d67-a168-d874de1b3d23","resolution":{"observed_at":"2026-08-09T17:32:27.904372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-09T13:31:47.214651Z","title":"Ai2-thor: An interactive 3d environment for visual ai,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02067","last_updated":"2025-03-06T18:09:38Z","snapshot_observed_at":"2026-08-16T05:55:05.856004Z","submitted_at":"2025-02-04T07:32:39Z","title":"AdaptBot: Combining LLM with Knowledge Graphs and Human Input for Generic-to-Specific Task Decomposition and Knowledge Refinement","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T13:31:47.214651Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2502.02067"},"observation_digest":"sha256:f5edf66380c5ce35192aee6fc3cbc463e5173a3a6ca673b428e9ea5f4f7d0846","observation_id":"4d6953f3-5ed4-4dc1-a153-19fafc36328e","resolution":{"observed_at":"2026-08-09T13:31:47.214651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-08T19:19:43.887704Z","title":"IEEE transactions on neural networks and learning systems, 33(2): 494–514","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.05453","last_updated":"2025-02-08T05:26:02Z","snapshot_observed_at":"2026-08-19T08:21:17.457487Z","submitted_at":"2025-02-08T05:26:02Z","title":"LLM-Powered Decentralized Generative Agents with Adaptive Hierarchical Knowledge Graph for Cooperative Planning","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-08T19:19:43.887704Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2502.05453"},"observation_digest":"sha256:ffd439b60d00f6e6b77e336f1cb170daa9dd19e8f4b2e7a34baf800ed7806735","observation_id":"dfb9161b-1377-421c-bbe6-35c83f602c89","resolution":{"observed_at":"2026-08-08T19:19:43.887704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-08T11:47:48.987816Z","title":"Ai2-thor: An interactive 3d environment for visual ai","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.07732","last_updated":"2025-06-07T19:57:55Z","snapshot_observed_at":"2026-08-17T08:03:29.324121Z","submitted_at":"2025-02-11T17:51:52Z","title":"When Incentives Backfire, Data Stops Being Human","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-08T11:47:48.987816Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2502.07732"},"observation_digest":"sha256:d02fbaf3eb7b21091506f6fe024d6894ab8ea83914e1039f37fff9e81249c6a1","observation_id":"8f15c223-c8cc-4613-afd3-7072217fe6a7","resolution":{"observed_at":"2026-08-08T11:47:48.987816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":"1712.05474","doi":"10.48550/arxiv.1712.05474","metadata_source":"pith","pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","venue":"cs.CV","work_id":"9c86ed28-ea70-424c-bd56-34f59dcad861","year":2017},"citing_paper":{"arxiv_id":"2502.13498","last_updated":"2026-05-06T03:25:26Z","snapshot_observed_at":"2026-07-06T20:39:02.049006Z","submitted_at":"2025-02-19T07:33:10Z","title":"Collision-Aware Object-Goal Visual Navigation via Two-Stage Deep Reinforcement Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-23T02:56:05.029236Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2502.13498"},"observation_digest":"sha256:c1f0f6a9ef8efae47b88fb43ca4cbb9e6abfd389108962b6d8548df793de9eb5","observation_id":"4150904b-22e9-4022-a2d4-bacf6b558c74","resolution":{"observed_at":"2026-05-23T02:57:26.326481Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":"1712.05474","doi":"10.48550/arxiv.1712.05474","metadata_source":"pith","pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","venue":"cs.CV","work_id":"9c86ed28-ea70-424c-bd56-34f59dcad861","year":2017},"citing_paper":{"arxiv_id":"2503.03480","last_updated":"2026-04-19T06:23:17Z","snapshot_observed_at":"2026-08-17T00:52:22.037468Z","submitted_at":"2025-03-05T13:16:55Z","title":"SafeVLA: Towards Safety Alignment of Vision-Language-Action Model via Constrained Learning","version":4},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-23T01:27:33.123243Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2503.03480"},"observation_digest":"sha256:6134384ccf699b6399cd37bf9fda775c5e2e554405a85af65807f41be1d691a3","observation_id":"befa3b3e-d1ef-4c9d-ba7b-702da23e90fb","resolution":{"observed_at":"2026-05-23T01:32:22.461815Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-16T11:33:00.779254Z","title":"AI2-THOR: an interactive 3d environment for visual AI","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.15369","last_updated":"2025-04-21T18:20:13Z","snapshot_observed_at":"2026-08-20T02:04:33.343781Z","submitted_at":"2025-04-21T18:20:13Z","title":"Solving New Tasks by Adapting Internet Video Knowledge","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-16T11:33:00.779254Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2504.15369"},"observation_digest":"sha256:8a8eec11c51a4a7edc9fb367bc731775d430f700e0ca5a6f92bf3b9baa7020dd","observation_id":"52791cb4-2960-4c46-a48e-6ca3d44af7f6","resolution":{"observed_at":"2026-08-16T11:33:00.779254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-16T11:23:58.380803Z","title":"Ai2- thor: An interactive 3d environment for visual ai,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.15643","last_updated":"2025-04-22T07:01:00Z","snapshot_observed_at":"2026-08-19T23:37:07.882154Z","submitted_at":"2025-04-22T07:01:00Z","title":"Multimodal Perception for Goal-oriented Navigation: A Survey","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T11:23:58.380803Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2504.15643"},"observation_digest":"sha256:a95e163d867834f31235d28e93e9fc51f1cc3f28cbe7b521f26e5068a4279185","observation_id":"c611242e-b189-43b7-a533-4d88a3ec0684","resolution":{"observed_at":"2026-08-16T11:23:58.380803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-16T10:08:56.843366Z","title":"Ai2-thor: An interactive 3d environment for visual ai","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.18944","last_updated":"2025-04-26T15:07:22Z","snapshot_observed_at":"2026-08-19T01:11:53.085099Z","submitted_at":"2025-04-26T15:07:22Z","title":"Demonstrating DVS: Dynamic Virtual-Real Simulation Platform for Mobile Robotic Tasks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T10:08:56.843366Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2504.18944"},"observation_digest":"sha256:30358e562e382040ecb52f639e8801fb541e976f5de7e43fc8dee4eb1af7180b","observation_id":"94ae1922-af76-4704-8434-13d149ec429e","resolution":{"observed_at":"2026-08-16T10:08:56.843366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-16T04:56:01.064196Z","title":"Ai2-thor: An interactive 3d environment for visual ai,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.21853","last_updated":"2025-04-30T17:59:02Z","snapshot_observed_at":"2026-08-17T13:01:46.306390Z","submitted_at":"2025-04-30T17:59:02Z","title":"A Survey of Interactive Generative Video","version":1},"reference_index":164,"source":"pdf_text","source_observed_at":"2026-08-16T04:56:01.064196Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2504.21853"},"observation_digest":"sha256:cc78e9483d015339df8043be783cf81e72626b4cef7d82a49f18a807bdb31ec5","observation_id":"2e092315-257f-4cad-bee5-5ac852ae17db","resolution":{"observed_at":"2026-08-16T04:56:01.064196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-16T04:42:09.980699Z","title":"Ai2-thor: An interactive 3d environ- ment for visual ai","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.00690","last_updated":"2025-05-01T17:52:29Z","snapshot_observed_at":"2026-08-18T16:19:09.837846Z","submitted_at":"2025-05-01T17:52:29Z","title":"Towards Autonomous Micromobility through Scalable Urban Simulation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T04:42:09.980699Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2505.00690"},"observation_digest":"sha256:c13f7a1d623d368376ca87adaf8ccc1b1123f47aee5d43f1b35ebc693649a5ed","observation_id":"0723d6bd-77d0-481a-9c65-dd0c156d6dbc","resolution":{"observed_at":"2026-08-16T04:42:09.980699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-16T04:46:40.513321Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.01458","last_updated":"2026-06-09T09:31:25Z","snapshot_observed_at":"2026-08-18T00:26:05.992202Z","submitted_at":"2025-05-01T09:22:23Z","title":"A Survey of Robotic Navigation and Manipulation with Physics Simulators in the Era of Embodied AI","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-16T04:46:40.513321Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2505.01458"},"observation_digest":"sha256:1020427389bb619ea225b31026f1bc97cc835320da0facce07ac57e5680a7e82","observation_id":"4948ebea-2b16-4b5f-8133-1c9b30aa2375","resolution":{"observed_at":"2026-08-16T04:46:40.513321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-16T00:58:28.319894Z","title":"Ai2-thor: An interactive 3d environment for visual ai","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02388","last_updated":"2025-05-05T06:13:25Z","snapshot_observed_at":"2026-08-18T09:59:23.993414Z","submitted_at":"2025-05-05T06:13:25Z","title":"MetaScenes: Towards Automated Replica Creation for Real-world 3D Scans","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T00:58:28.319894Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2505.02388"},"observation_digest":"sha256:5ad529b681c8153c5c5a4e69d523344ae947552db587b83f602685e0062bde20","observation_id":"4072340f-ab85-4af5-8860-05fe200c0407","resolution":{"observed_at":"2026-08-16T00:58:28.319894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-16T00:46:00.508809Z","title":"Ai2-thor: An interactive 3d environment for visual ai","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02836","last_updated":"2025-05-05T17:59:58Z","snapshot_observed_at":"2026-08-16T00:37:24.796580Z","submitted_at":"2025-05-05T17:59:58Z","title":"Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T00:46:00.508809Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2505.02836"},"observation_digest":"sha256:fd2f8af2ef26a2525033e46baea38ddf2585fee26a896ab463622dc5630a2eeb","observation_id":"bb0d66e1-0446-4196-a93a-3e97cd5a5478","resolution":{"observed_at":"2026-08-16T00:46:00.508809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-15T23:21:13.060346Z","title":"AI2-THOR: an interactive 3d environment for visual AI","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.04921","last_updated":"2025-07-06T14:40:27Z","snapshot_observed_at":"2026-08-15T23:15:46.193892Z","submitted_at":"2025-05-08T03:35:23Z","title":"Perception, Reason, Think, and Plan: A Survey on Large Multimodal Reasoning Models","version":2},"reference_index":220,"source":"arxiv_source","source_observed_at":"2026-08-15T23:21:13.060346Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2505.04921"},"observation_digest":"sha256:4d7688f1ad10bcb823986b730d9dc54dd546934013fb8fd0d0fcec5d9250553b","observation_id":"88ac10ec-c4d1-4164-9f77-ca6f7e6d48b6","resolution":{"observed_at":"2026-08-15T23:21:13.060346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-15T21:31:50.388247Z","title":"Kolve, R","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.09698","last_updated":"2025-08-30T18:59:30Z","snapshot_observed_at":"2026-08-16T19:48:09.152747Z","submitted_at":"2025-05-14T18:01:00Z","title":"ManipBench: Benchmarking Vision-Language Models for Low-Level Robot Manipulation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T21:31:50.388247Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2505.09698"},"observation_digest":"sha256:c18d6d8c64fe23bd62b185aaaab54d32c43505715503fe7b4f9d99b2988ffd70","observation_id":"d6c6045b-9ea5-4ef1-9d8a-49f48a9e2800","resolution":{"observed_at":"2026-08-15T21:31:50.388247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-15T20:33:16.229244Z","title":"Ai2-thor: An interactive 3d environment for visual ai","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.12583","last_updated":"2025-05-30T07:28:49Z","snapshot_observed_at":"2026-08-17T16:56:07.176501Z","submitted_at":"2025-05-19T00:11:42Z","title":"A Comprehensive Survey on Physical Risk Control in the Era of Foundation Model-enabled Robotics","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T20:33:16.229244Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2505.12583"},"observation_digest":"sha256:6bbf3e779cd290165104d6b73c4e4cea216bc8d49633ea72ef80934f2a4655dc","observation_id":"31ea7cd4-766b-4f18-aa56-dda60a9b95c9","resolution":{"observed_at":"2026-08-15T20:33:16.229244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-15T20:13:45.403335Z","title":"Kolve, R","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.13729","last_updated":"2025-05-19T20:58:06Z","snapshot_observed_at":"2026-08-18T09:22:42.120355Z","submitted_at":"2025-05-19T20:58:06Z","title":"SayCoNav: Utilizing Large Language Models for Adaptive Collaboration in Decentralized Multi-Robot Navigation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:13:45.403335Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2505.13729"},"observation_digest":"sha256:63e157063abdfb0c55538b2133071d3d63c800c13d4737f53d6eea2fc947ab1e","observation_id":"d231788a-7b0b-4030-b383-4bd9994ffa09","resolution":{"observed_at":"2026-08-15T20:13:45.403335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-07T15:21:12.433304Z","title":"AI2-THOR: An interactive 3d environment for visual AI","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.15517","last_updated":"2025-06-18T21:24:31Z","snapshot_observed_at":"2026-08-16T11:58:05.128366Z","submitted_at":"2025-05-21T13:42:52Z","title":"Robo2VLM: Visual Question Answering from Large-Scale In-the-Wild Robot Manipulation Datasets","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:21:12.433304Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2505.15517"},"observation_digest":"sha256:d730cd0104855955ee5b1567ea4d4da3a2e0be83056e7f7f731219a13918c07e","observation_id":"89fac9a5-be2f-424e-96fa-2ecab99ce51e","resolution":{"observed_at":"2026-08-07T15:21:12.433304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-07T14:29:36.492540Z","title":"Ai2-thor: An interactive 3d environment for visual ai","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.18881","last_updated":"2025-05-24T21:37:06Z","snapshot_observed_at":"2026-08-18T20:45:31.882728Z","submitted_at":"2025-05-24T21:37:06Z","title":"SD-OVON: A Semantics-aware Dataset and Benchmark Generation Pipeline for Open-Vocabulary Object Navigation in Dynamic Scenes","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:36.492540Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2505.18881"},"observation_digest":"sha256:06ae9a0fdcb5c3e57e62a66f866cdbc2528c9d1f43d5bfcb4a90a0ab93f141f9","observation_id":"beacf3ad-ed9c-478f-8e48-347edec1419e","resolution":{"observed_at":"2026-08-07T14:29:36.492540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-07T14:02:29.202280Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20129","last_updated":"2025-07-04T15:28:37Z","snapshot_observed_at":"2026-08-13T16:56:10.704278Z","submitted_at":"2025-05-26T15:28:17Z","title":"Agentic 3D Scene Generation with Spatially Contextualized VLMs","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:02:29.202280Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2505.20129"},"observation_digest":"sha256:bb26d59778d813b7372a2779fa84990f73a0ccc8f8cbb73cbae808e711aef3a9","observation_id":"f9e58caf-ea94-495d-8865-a4b90c8a8882","resolution":{"observed_at":"2026-08-07T14:02:29.202280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-07T13:45:31.886169Z","title":"Kolve, R","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.21055","last_updated":"2025-05-27T11:44:50Z","snapshot_observed_at":"2026-08-20T10:24:23.017406Z","submitted_at":"2025-05-27T11:44:50Z","title":"Agent-Environment Alignment via Automated Interface Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:45:31.886169Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2505.21055"},"observation_digest":"sha256:4d0fc1fc9513d378a2f6199a7a055e6bfdbd1fff96596fc5f0c21772fe5e21f0","observation_id":"6db2704a-a6d9-4e34-8747-f03ec0022335","resolution":{"observed_at":"2026-08-07T13:45:31.886169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-07T13:22:23.067075Z","title":"Ai2-thor: An interactive 3d environment for visual ai","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.22050","last_updated":"2025-07-13T09:27:37Z","snapshot_observed_at":"2026-08-17T13:07:25.361824Z","submitted_at":"2025-05-28T07:21:37Z","title":"Reinforced Reasoning for Embodied Planning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:22:23.067075Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2505.22050"},"observation_digest":"sha256:1e03d4ed69bef447b9f9eae4c549d43074b67b4601bf251dd6fe52814d7ac241","observation_id":"59e6988c-2cf4-4ed4-b91d-b3763ddf060e","resolution":{"observed_at":"2026-08-07T13:22:23.067075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":"1712.05474","doi":"10.48550/arxiv.1712.05474","metadata_source":"pith","pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","venue":"cs.CV","work_id":"9c86ed28-ea70-424c-bd56-34f59dcad861","year":2017},"citing_paper":{"arxiv_id":"2506.01418","last_updated":"2026-02-03T14:58:31Z","snapshot_observed_at":"2026-08-14T21:52:52.508435Z","submitted_at":"2025-06-02T08:19:41Z","title":"SEMNAV: Enhancing Visual Semantic Navigation in Robotics through Semantic Segmentation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-22T01:36:25.526965Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2506.01418"},"observation_digest":"sha256:4d766eca5ec374242711b02a948a1de4bb3e0a3cf35d0c53fd19abe890218328","observation_id":"74c0df06-47c1-4d1d-b966-e713bb109112","resolution":{"observed_at":"2026-05-22T01:40:54.050191Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-07T10:24:24.937823Z","title":"Ai2-thor: An interactive 3d environment for visual ai.arXiv preprint arXiv:1712.05474, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.05815","last_updated":"2025-06-06T07:27:15Z","snapshot_observed_at":"2026-08-17T22:02:03.939902Z","submitted_at":"2025-06-06T07:27:15Z","title":"NTIRE 2025 Challenge on HR Depth from Images of Specular and Transparent Surfaces","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T10:24:24.937823Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2506.05815"},"observation_digest":"sha256:20af786d1492072e1a5b13ceed1e256f6406331ef073c86bae8be88e7f9e009c","observation_id":"b4094c0f-eece-4171-b7c4-6a40c3ad120c","resolution":{"observed_at":"2026-08-07T10:24:24.937823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-07T05:53:46.515374Z","title":"https://arxiv.org/abs/1712.05474","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.06862","last_updated":"2025-06-07T17:02:13Z","snapshot_observed_at":"2026-08-16T20:52:00.702708Z","submitted_at":"2025-06-07T17:02:13Z","title":"Multimodal Spatial Language Maps for Robot Navigation and Manipulation","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T05:53:46.515374Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2506.06862"},"observation_digest":"sha256:cef1492eb1f0507b2d27ced45f2b0e07d7fbafc02a26a8bc5ebcec6b133116bf","observation_id":"73dd62dc-55bc-43b5-974d-2b70083d1040","resolution":{"observed_at":"2026-08-07T05:53:46.515374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-07T04:44:03.106298Z","title":"Kolve, R","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09849","last_updated":"2025-06-11T15:21:16Z","snapshot_observed_at":"2026-08-12T15:10:44.435246Z","submitted_at":"2025-06-11T15:21:16Z","title":"IntPhys 2: Benchmarking Intuitive Physics Understanding In Complex Synthetic Environments","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:44:03.106298Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2506.09849"},"observation_digest":"sha256:0627d89c1093273b8e0a57d422c646f92bc3679c6f4dde7cadc2fcc4d363a819","observation_id":"8966c1d6-751b-461f-8ffb-5fcf74c4c5b1","resolution":{"observed_at":"2026-08-07T04:44:03.106298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-07T04:17:09.324886Z","title":"Ai2-thor: An interactive 3d environment for visual ai.arXiv preprint arXiv:1712.05474,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10966","last_updated":"2025-06-12T17:59:04Z","snapshot_observed_at":"2026-08-15T06:36:53.043556Z","submitted_at":"2025-06-12T17:59:04Z","title":"GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:09.324886Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2506.10966"},"observation_digest":"sha256:7c9039d9321cf40b7059f6507357a683a1a6dde44532c2f96835e2b8408dbf2b","observation_id":"65cf1253-22de-4e62-8a98-264988fc72db","resolution":{"observed_at":"2026-08-07T04:17:09.324886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":"1712.05474","doi":"10.48550/arxiv.1712.05474","metadata_source":"pith","pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","venue":"cs.CV","work_id":"9c86ed28-ea70-424c-bd56-34f59dcad861","year":2017},"citing_paper":{"arxiv_id":"2506.17212","last_updated":"2026-04-09T01:29:31Z","snapshot_observed_at":"2026-08-15T05:14:19.150613Z","submitted_at":"2025-06-20T17:59:12Z","title":"Part$^{2}$GS: Part-aware Modeling of Articulated Objects using 3D Gaussian Splatting","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-19T08:14:28.190409Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2506.17212"},"observation_digest":"sha256:1a4c8dfe9efd7974c303b1f21eb80e4e4307264f70959f27876d15fb18a1b8a6","observation_id":"86805c05-b5b2-4265-b8e7-87318e94d8dd","resolution":{"observed_at":"2026-05-19T08:17:11.015625Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-06T22:57:41.711826Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.20134","last_updated":"2025-06-25T05:05:09Z","snapshot_observed_at":"2026-08-17T14:41:09.622801Z","submitted_at":"2025-06-25T05:05:09Z","title":"From 2D to 3D Cognition: A Brief Survey of General World Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:41.711826Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2506.20134"},"observation_digest":"sha256:7d46d83fe01665b474867e895dd60a7a129a328e9e811d3f4b1496ba0674f1a6","observation_id":"e55f7c6f-893b-4940-8bd9-6c465762e31c","resolution":{"observed_at":"2026-08-06T22:57:41.711826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-06T22:22:09.752738Z","title":"AI2-THOR: an interactive 3d environment for visual AI,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.21860","last_updated":"2025-06-27T02:28:19Z","snapshot_observed_at":"2026-08-18T15:22:10.527792Z","submitted_at":"2025-06-27T02:28:19Z","title":"Embodied Domain Adaptation for Object Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T22:22:09.752738Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2506.21860"},"observation_digest":"sha256:8f0d6b95efee9f2035875b53ee269099e17d16fff9fb57a84f5cebb616345e78","observation_id":"9284a182-b22c-4f06-9947-62a1933ab909","resolution":{"observed_at":"2026-08-06T22:22:09.752738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-06T22:15:55.983398Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.22062","last_updated":"2025-08-10T15:28:05Z","snapshot_observed_at":"2026-08-17T13:40:07.319171Z","submitted_at":"2025-06-27T09:56:40Z","title":"MDC-R: The Minecraft Dialogue Corpus with Reference","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T22:15:55.983398Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2506.22062"},"observation_digest":"sha256:2dccc58ff473810520261f29ee2ee71077f9dc35fd11671aea0144172b8f455a","observation_id":"480211d8-933e-4bba-ad99-78aa383df567","resolution":{"observed_at":"2026-08-06T22:15:55.983398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-06T20:47:28.735777Z","title":"Ai2-thor: An interactive 3d environment for visual ai.arXiv preprint arXiv:1712.05474, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.02029","last_updated":"2025-09-14T06:49:43Z","snapshot_observed_at":"2026-08-12T20:24:27.893763Z","submitted_at":"2025-07-02T17:05:33Z","title":"RoboBrain 2.0 Technical Report","version":5},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:47:28.735777Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2507.02029"},"observation_digest":"sha256:bb4aca77e53c1cb6c927c97ba82c8146cf4ba663d1ea20dd6dc6abeab0994fac","observation_id":"45924ed9-0e18-4060-a563-080f6458ba87","resolution":{"observed_at":"2026-08-06T20:47:28.735777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-06T21:03:08.880761Z","title":"Ai2-thor: An interactive 3d environment for visual ai.arXiv preprint arXiv:1712.05474,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02997","last_updated":"2025-07-01T22:53:41Z","snapshot_observed_at":"2026-08-12T22:16:12.439160Z","submitted_at":"2025-07-01T22:53:41Z","title":"What to Do Next? Memorizing skills from Egocentric Instructional Video","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T21:03:08.880761Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2507.02997"},"observation_digest":"sha256:96b752e6b94ef6c8db167f3a624f8466dabc899693e942397a54dae7a34ff730","observation_id":"da88b9de-cdf6-4229-90d6-35f5bd6350e8","resolution":{"observed_at":"2026-08-06T21:03:08.880761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-06T19:50:05.106839Z","title":"AI2-THOR: An interactive 3D environment for visual AI","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.04522","last_updated":"2025-07-06T20:19:34Z","snapshot_observed_at":"2026-08-10T07:38:41.719154Z","submitted_at":"2025-07-06T20:19:34Z","title":"Grounded Gesture Generation: Language, Motion, and Space","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:50:05.106839Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2507.04522"},"observation_digest":"sha256:d4f0f9a69d819a241af7cfb2ff1eba37945c3ba45e3ba83fed089d92fd916412","observation_id":"20f1bb53-2066-4dfb-99de-171ef71815aa","resolution":{"observed_at":"2026-08-06T19:50:05.106839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-06T19:18:24.963271Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.06016","last_updated":"2025-07-08T14:23:41Z","snapshot_observed_at":"2026-08-17T17:12:27.222628Z","submitted_at":"2025-07-08T14:23:41Z","title":"Conditional Multi-Stage Failure Recovery for Embodied Agents","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T19:18:24.963271Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2507.06016"},"observation_digest":"sha256:835da7b5a70fdb3bd97590cd8e093b9c530b15954f151530b0a94c58a3e3e246","observation_id":"9002432d-a4cb-4570-8a56-14c69c567873","resolution":{"observed_at":"2026-08-06T19:18:24.963271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-06T18:43:21.582294Z","title":"arXiv preprint arXiv:1712.05474 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.07445","last_updated":"2026-06-28T16:34:15Z","snapshot_observed_at":"2026-08-16T18:40:54.285593Z","submitted_at":"2025-07-10T05:48:28Z","title":"StarDojo: Benchmarking Open-Ended Behaviors of Agentic Multimodal LLMs in Production-Living Simulations with Stardew Valley","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:43:21.582294Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2507.07445"},"observation_digest":"sha256:930573f8a4475d05bf7695cd90f83484ded75fd2ffc0150408da45e6ee908947","observation_id":"3d322b2e-9b0e-4be9-b880-f216c0232d5e","resolution":{"observed_at":"2026-08-06T18:43:21.582294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-06T18:10:16.832020Z","title":"Ai2-thor: An interactive 3d environment for visual ai","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.09177","last_updated":"2025-07-12T07:52:31Z","snapshot_observed_at":"2026-08-19T23:17:25.661157Z","submitted_at":"2025-07-12T07:52:31Z","title":"Continual Reinforcement Learning by Planning with Online World Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T18:10:16.832020Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2507.09177"},"observation_digest":"sha256:e2a2aad68b2aed4ef1c1e7ce175e7e3462867c3db7694f2eac9ebe8680051b4a","observation_id":"dd1b8742-3c0b-4850-ac32-dc19d36c1a78","resolution":{"observed_at":"2026-08-06T18:10:16.832020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-06T17:43:53.349863Z","title":"Ai2-thor: An inter- active 3d environment for visual ai,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.10087","last_updated":"2025-07-14T09:13:07Z","snapshot_observed_at":"2026-08-19T14:09:28.453297Z","submitted_at":"2025-07-14T09:13:07Z","title":"Foundation Model Driven Robotics: A Comprehensive Review","version":1},"reference_index":135,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.349863Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2507.10087"},"observation_digest":"sha256:e2bc40671a7be45bfc9e049583c58b468349415ed14258831848d6eeb45abcde","observation_id":"4138687e-0eca-461f-b720-3c91f2cfbb02","resolution":{"observed_at":"2026-08-06T17:43:53.349863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-06T17:18:26.474982Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.11334","last_updated":"2025-08-15T09:03:09Z","snapshot_observed_at":"2026-08-17T17:41:12.420997Z","submitted_at":"2025-07-15T14:06:24Z","title":"CogDDN: A Cognitive Demand-Driven Navigation with Decision Optimization and Dual-Process Thinking","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:18:26.474982Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2507.11334"},"observation_digest":"sha256:542a55e80163c8e9452093fa889b8bed172fc75ca9961c255bee4c789c224516","observation_id":"76fb6c6d-b446-41dc-bd32-301e38e460ed","resolution":{"observed_at":"2026-08-06T17:18:26.474982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-06T17:05:53.169401Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.11770","last_updated":"2025-07-15T22:20:47Z","snapshot_observed_at":"2026-08-14T04:22:53.814740Z","submitted_at":"2025-07-15T22:20:47Z","title":"Generating Actionable Robot Knowledge Bases by Combining 3D Scene Graphs with Robot Ontologies","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:53.169401Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2507.11770"},"observation_digest":"sha256:6d8ba7cd206ec419ff4e6af2ca88af1dc3b5e6fffc427c45156d44177ce88037","observation_id":"417b62cf-ba0b-45e8-b5cd-4e903fe9777e","resolution":{"observed_at":"2026-08-06T17:05:53.169401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-06T12:25:48.744855Z","title":"Ai2-thor: An interactive 3d environment for visual ai,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.21796","last_updated":"2025-07-29T13:33:43Z","snapshot_observed_at":"2026-08-18T06:56:54.433359Z","submitted_at":"2025-07-29T13:33:43Z","title":"MoDeSuite: Robot Learning Task Suite for Benchmarking Mobile Manipulation with Deformable Objects","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T12:25:48.744855Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2507.21796"},"observation_digest":"sha256:0c3511571fe20a1cfff887a1626f68b061215d3ac371da615f8b2a3ce676a7cc","observation_id":"2ba95108-0d47-42a1-81ff-89d81045138a","resolution":{"observed_at":"2026-08-06T12:25:48.744855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-06T11:20:06.683880Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.22791","last_updated":"2026-06-11T08:47:41Z","snapshot_observed_at":"2026-08-14T10:09:58.243398Z","submitted_at":"2025-07-30T15:56:36Z","title":"Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey","version":2},"reference_index":108,"source":"pdf_text","source_observed_at":"2026-08-06T11:20:06.683880Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2507.22791"},"observation_digest":"sha256:6785ada2d75654b111d409dfec0a3bf21699d154f6e96df270cb6d06ad514253","observation_id":"d253e52c-c7ad-44df-ba48-dfc4720cb8b6","resolution":{"observed_at":"2026-08-06T11:20:06.683880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-06T10:15:11.357220Z","title":"Ai2-thor: An interactive 3d environment for visual ai","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.00288","last_updated":"2026-07-27T08:09:58Z","snapshot_observed_at":"2026-08-17T22:23:15.163304Z","submitted_at":"2025-08-01T03:23:06Z","title":"UAV-ON: A Benchmark for Open-World Object Goal Navigation with Aerial Agents","version":5},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T10:15:11.357220Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2508.00288"},"observation_digest":"sha256:b5dd53b2ffe05dfe98a5b89b16c83d1068f0e6b87418d3566aec36702843472d","observation_id":"38aa89cb-9f60-45ab-9602-498fad752492","resolution":{"observed_at":"2026-08-06T10:15:11.357220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-06T10:12:28.856846Z","title":"Ai2-thor: An interactive 3d environment for visual ai,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.00400","last_updated":"2025-08-01T08:01:38Z","snapshot_observed_at":"2026-08-17T17:35:23.353875Z","submitted_at":"2025-08-01T08:01:38Z","title":"Sari Sandbox: A Virtual Retail Store Environment for Embodied AI Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T10:12:28.856846Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2508.00400"},"observation_digest":"sha256:26db6b7f75e315954420daaa9ef56859b02312053037cf5bae19c23714463a41","observation_id":"ae86a301-103b-4f4f-bd50-1bb35b4cb51c","resolution":{"observed_at":"2026-08-06T10:12:28.856846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T23:27:34.238419Z","title":"Ai2-thor: An interactive 3d environment for visual ai.arXiv preprint arXiv:1712.05474, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.05405","last_updated":"2025-08-07T13:58:19Z","snapshot_observed_at":"2026-08-16T09:59:33.427776Z","submitted_at":"2025-08-07T13:58:19Z","title":"DeepPHY: Benchmarking Agentic VLMs on Physical Reasoning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T23:27:34.238419Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2508.05405"},"observation_digest":"sha256:09be847813f8c7132ca40882c4c4448701725646757d840069338bd4c4eb51c7","observation_id":"f47733b2-a974-4525-aa58-312900138531","resolution":{"observed_at":"2026-08-05T23:27:34.238419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T23:09:55.608595Z","title":"Ai2-thor: An interactive 3d environment for visual ai,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.05838","last_updated":"2025-08-07T20:29:01Z","snapshot_observed_at":"2026-08-14T12:25:32.591021Z","submitted_at":"2025-08-07T20:29:01Z","title":"Integrating Vision Foundation Models with Reinforcement Learning for Enhanced Object Interaction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T23:09:55.608595Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2508.05838"},"observation_digest":"sha256:a892990a660ecb3d4949b39c5abdfb48dcaec028dfdb06a8e2e4384c391b6d4d","observation_id":"78d2c553-7450-48de-9bfc-cc78f2d38056","resolution":{"observed_at":"2026-08-05T23:09:55.608595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T21:05:31.831949Z","title":"Kolve, R","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.09444","last_updated":"2025-08-13T02:51:43Z","snapshot_observed_at":"2026-08-15T22:38:15.872635Z","submitted_at":"2025-08-13T02:51:43Z","title":"DAgger Diffusion Navigation: DAgger Boosted Diffusion Policy for Vision-Language Navigation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T21:05:31.831949Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2508.09444"},"observation_digest":"sha256:f82495890b8475efdba7415b2d3f6a6277e971ef3d4b7f0a586b3e4241ffed74","observation_id":"ee9d3479-84b1-49f9-9704-324457b388a9","resolution":{"observed_at":"2026-08-05T21:05:31.831949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T20:05:10.767543Z","title":"Ai2-thor: An interactive 3d environment for visual ai","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.11286","last_updated":"2025-08-15T07:48:51Z","snapshot_observed_at":"2026-08-17T03:23:54.723397Z","submitted_at":"2025-08-15T07:48:51Z","title":"Scene Graph-Guided Proactive Replanning for Failure-Resilient Embodied Agent","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T20:05:10.767543Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2508.11286"},"observation_digest":"sha256:f513e9fe85ad94bfbfa0faf464dcbf374c74b512781c4bbc461b749cf38a1a26","observation_id":"6424cdae-e634-487c-88fa-e16ac89e42f2","resolution":{"observed_at":"2026-08-05T20:05:10.767543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T19:54:56.935817Z","title":"Ai2-thor: An interactive 3d environment for visual ai.arXiv preprint arXiv:1712.05474,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.11476","last_updated":"2025-08-15T13:44:56Z","snapshot_observed_at":"2026-08-19T14:22:56.907190Z","submitted_at":"2025-08-15T13:44:56Z","title":"SPG: Style-Prompting Guidance for Style-Specific Content Creation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T19:54:56.935817Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2508.11476"},"observation_digest":"sha256:3f7af1e29c990b1fc19a18ee010e495affa557ad09b9e09c4aae9c251d67fb49","observation_id":"e8061d6f-a4eb-4ef1-9b63-699a5b383caa","resolution":{"observed_at":"2026-08-05T19:54:56.935817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-15T16:58:34.168782Z","title":"Ai2-thor: An inter- active 3d environment for visual ai,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.18627","last_updated":"2025-08-26T03:08:54Z","snapshot_observed_at":"2026-08-15T16:52:36.306158Z","submitted_at":"2025-08-26T03:08:54Z","title":"Integration of Robot and Scene Kinematics for Sequential Mobile Manipulation Planning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-15T16:58:34.168782Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2508.18627"},"observation_digest":"sha256:729591d365a9fade8ee5e8b66a112b44316bee28656f22cf416151390409f699","observation_id":"c6dcdfe3-7ea1-4943-82cd-0c3e62ee678a","resolution":{"observed_at":"2026-08-15T16:58:34.168782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":"1712.05474","doi":"10.48550/arxiv.1712.05474","metadata_source":"pith","pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","venue":"cs.CV","work_id":"9c86ed28-ea70-424c-bd56-34f59dcad861","year":2017},"citing_paper":{"arxiv_id":"2509.01728","last_updated":"2026-04-16T14:35:52Z","snapshot_observed_at":"2026-08-15T04:41:03.479641Z","submitted_at":"2025-09-01T19:17:40Z","title":"Constrained Decoding for Safe Robot Navigation Foundation Models","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-18T19:07:18.832187Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2509.01728"},"observation_digest":"sha256:71a37cbaf7ea8a3a46fa34c19f12a4431879a1b07aefd74c2e12eb2fe695c4d4","observation_id":"93ecc3fa-19b8-45a6-8695-d234e1dace8d","resolution":{"observed_at":"2026-05-18T19:11:47.478244Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T11:40:22.265805Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.02359","last_updated":"2025-09-02T14:22:43Z","snapshot_observed_at":"2026-08-16T23:55:53.439201Z","submitted_at":"2025-09-02T14:22:43Z","title":"Why Do MLLMs Struggle with Spatial Understanding? A Systematic Analysis from Data to Architecture","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T11:40:22.265805Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2509.02359"},"observation_digest":"sha256:d5afbccc7830198902aa9fd05ae743cb917a7b67fc7f1a6320b439e2b5f58bad","observation_id":"321e73f9-a5cb-4c18-9f98-8102aeccbeeb","resolution":{"observed_at":"2026-08-05T11:40:22.265805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T11:00:38.166570Z","title":"Ai2-thor: An interactive 3d environment for visual ai","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.03383","last_updated":"2025-09-03T15:00:28Z","snapshot_observed_at":"2026-08-20T01:33:55.062628Z","submitted_at":"2025-09-03T15:00:28Z","title":"ANNIE: Be Careful of Your Robots","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T11:00:38.166570Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2509.03383"},"observation_digest":"sha256:2bda6c734922b85e0119ecd5ae01ff3aa8d4e786175918f1d0319d9fa4efb16a","observation_id":"e1dc4d94-a903-4afe-bc49-7d95ce860bad","resolution":{"observed_at":"2026-08-05T11:00:38.166570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-04T19:39:06.723001Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.09154","last_updated":"2025-09-11T05:23:22Z","snapshot_observed_at":"2026-08-06T15:36:44.934159Z","submitted_at":"2025-09-11T05:23:22Z","title":"Mind Meets Space: Rethinking Agentic Spatial Intelligence from a Neuroscience-inspired Perspective","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-04T19:39:06.723001Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2509.09154"},"observation_digest":"sha256:b0d4225ff47d8571f3352e783bb93a8235844b523f8a69edb5ed18b2749bbce2","observation_id":"5a338012-32ac-4ad5-a0b2-ac783f65d162","resolution":{"observed_at":"2026-08-04T19:39:06.723001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-04T19:17:00.579682Z","title":"arXiv preprint arXiv:1712.05474 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.09356","last_updated":"2025-09-11T11:10:08Z","snapshot_observed_at":"2026-08-14T01:54:32.367392Z","submitted_at":"2025-09-11T11:10:08Z","title":"Curriculum-Based Multi-Tier Semantic Exploration via Deep Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T19:17:00.579682Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2509.09356"},"observation_digest":"sha256:54c06bba16d6d7ff6f543e3c7475d049dbf3f1cfa95cdf1df684ed5efdfd2844","observation_id":"14064f24-6d38-4391-b8ab-ea2fa9233a86","resolution":{"observed_at":"2026-08-04T19:17:00.579682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":"1712.05474","doi":"10.48550/arxiv.1712.05474","metadata_source":"pith","pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","venue":"cs.CV","work_id":"9c86ed28-ea70-424c-bd56-34f59dcad861","year":2017},"citing_paper":{"arxiv_id":"2509.10813","last_updated":"2026-04-28T04:11:01Z","snapshot_observed_at":"2026-08-16T17:25:51.996467Z","submitted_at":"2025-09-13T14:25:17Z","title":"InternScenes: A Large-scale Simulatable Indoor Scene Dataset with Realistic Layouts","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T17:11:26.524195Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2509.10813"},"observation_digest":"sha256:2b08d88ffcb6855b2b8b664cc1d7a866137bef01d2a949692563359b17db5867","observation_id":"f1bf732e-b3f5-4b80-86af-5bebc2436fcd","resolution":{"observed_at":"2026-05-18T17:11:40.134078Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":"1712.05474","doi":"10.48550/arxiv.1712.05474","metadata_source":"pith","pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","venue":"cs.CV","work_id":"9c86ed28-ea70-424c-bd56-34f59dcad861","year":2017},"citing_paper":{"arxiv_id":"2510.04978","last_updated":"2026-04-30T05:27:37Z","snapshot_observed_at":"2026-08-15T22:28:47.373430Z","submitted_at":"2025-10-06T16:16:03Z","title":"Aligning Perception, Reasoning, Modeling and Interaction: A Survey on Physical AI","version":5},"reference_index":241,"source":"pdf_text","source_observed_at":"2026-05-18T09:56:36.716680Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2510.04978"},"observation_digest":"sha256:1e6ea9987a888d97f438e21eb871e9fc92b02e866235676ed812ea47ac487882","observation_id":"696158e1-a3f7-44a2-a299-f5da49edcb44","resolution":{"observed_at":"2026-05-18T10:01:14.296374Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-04T09:33:39.183849Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.14828","last_updated":"2026-06-09T15:51:56Z","snapshot_observed_at":"2026-08-08T23:57:30.634515Z","submitted_at":"2025-10-16T16:04:35Z","title":"RoboGPT-R1: Enhancing Robot Task Planning with Reinforcement Learning","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T09:33:39.183849Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2510.14828"},"observation_digest":"sha256:f2be5ffeb853cb9eab88bea4374f060afbc42be48b839a6eb52e58d91935e8f9","observation_id":"7894e5b7-0ba8-48a8-a727-e74e6c2bce8e","resolution":{"observed_at":"2026-08-04T09:33:39.183849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-03T14:57:29.117151Z","title":"Ai2-thor: An interactive 3d environment for visual ai.arXiv preprint arXiv:1712.05474,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.18735","last_updated":"2026-05-25T12:55:14Z","snapshot_observed_at":"2026-08-07T05:11:54.627363Z","submitted_at":"2025-12-21T13:50:26Z","title":"$M^3-Verse$: A \"Spot the Difference\" Challenge for Large Multimodal Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T14:57:29.117151Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2512.18735"},"observation_digest":"sha256:c9c289983021db3dc6e379c4ce208f8bc21b22518484bdd3df88f900b91ebd9f","observation_id":"7f87c461-47f7-486a-ae0d-dfa0dcf1e794","resolution":{"observed_at":"2026-08-03T14:57:29.117151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-03T08:53:46.818451Z","title":"Ai2-thor: An inter- active 3d environment for visual ai,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2601.15614","last_updated":"2026-06-30T09:05:30Z","snapshot_observed_at":"2026-08-19T23:31:25.122449Z","submitted_at":"2026-01-22T03:35:34Z","title":"AION: Aerial Indoor Object-Goal Navigation Using Dual-Policy Reinforcement Learning","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T08:53:46.818451Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2601.15614"},"observation_digest":"sha256:29e3ea5eb267960670a9f0091693660817a17e0d74be7216f80e717481a0a505","observation_id":"fe4da3e3-1368-4eb5-bc67-624a44cb9f43","resolution":{"observed_at":"2026-08-03T08:53:46.818451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":"1712.05474","doi":"10.48550/arxiv.1712.05474","metadata_source":"pith","pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","venue":"cs.CV","work_id":"9c86ed28-ea70-424c-bd56-34f59dcad861","year":2017},"citing_paper":{"arxiv_id":"2602.04129","last_updated":"2026-05-06T00:09:55Z","snapshot_observed_at":"2026-08-13T09:58:27.987525Z","submitted_at":"2026-02-04T01:46:02Z","title":"KGLAMP: Knowledge Graph-guided Language model for Adaptive Multi-robot Planning and Replanning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-16T08:07:48.508022Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2602.04129"},"observation_digest":"sha256:3846f6e4ed748a324b9aa3c8dc4a5f0a0f1d6b941f9041324d3f1156738ca635","observation_id":"87ead5a3-d291-42b5-9272-f9225fbed674","resolution":{"observed_at":"2026-05-16T08:10:45.588045Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":"1712.05474","doi":"10.48550/arxiv.1712.05474","metadata_source":"pith","pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","venue":"cs.CV","work_id":"9c86ed28-ea70-424c-bd56-34f59dcad861","year":2017},"citing_paper":{"arxiv_id":"2602.08392","last_updated":"2026-04-04T07:19:18Z","snapshot_observed_at":"2026-08-09T04:39:04.658750Z","submitted_at":"2026-02-09T08:47:14Z","title":"ST-BiBench: Benchmarking Multi-Stream Multimodal Coordination in Bimanual Embodied Tasks for MLLMs","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-16T06:00:02.043029Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2602.08392"},"observation_digest":"sha256:e32af1d093d0303df4e0080d6bcd04fb772c8b7305100876975675fa7c77f989","observation_id":"6162131b-afa5-4c08-b73c-de5dd85db89a","resolution":{"observed_at":"2026-05-16T06:00:40.510559Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1712.05474/citation-record","integrity":"/paper/1712.05474/integrity","json":"/paper/1712.05474/citation-record.json","paper":"/paper/1712.05474"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Robothor: An open simulation-to-real embodied ai platform","venue":null,"work_id":"038de035-5464-4f00-9f5a-4992238e808a","year":2020},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:22ecfe8fa69565cb36e78b5352f4e980b13d5704c56e473dace889b42014523e","observation_id":"be93fe07-7e0c-4b92-aad3-90c2e6b31025","resolution":{"observed_at":"2026-05-12T05:24:28.813151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Procthor: Large-scale embodied ai using procedural generation","venue":null,"work_id":"e53a40cb-51ac-42af-93db-e23ae81e2cf4","year":2022},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:e58229dabea969875b763818fd28da6885de74f408e7c4df00718f1115a5f5da","observation_id":"29c10b23-84ac-45a8-8a9e-a4a67b4d4595","resolution":{"observed_at":"2026-05-12T05:24:28.855357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning object relation graph and tentative policy for visual navigation","venue":null,"work_id":"fd11d637-78d3-4005-ae7d-4cb00b2843ff","year":2020},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:b80ec1d88099defa7deb6a14698a6b162a9d1c6657edccab5adf7065aa26c010","observation_id":"16efcf7f-82a5-4dc4-b218-b3689b89b6ec","resolution":{"observed_at":"2026-05-12T05:24:28.927371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"What do navigation agents learn about their environment? In CVPR","venue":null,"work_id":"1ca0d16a-a849-4d33-a72e-4795dc5c237f","year":2022},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:9065903b4d682dcd300e1d268bd74efaeb0c7f768378c629bae8f8ee633d3697","observation_id":"fc325d26-3fb5-4a79-bc37-a96a156f60d5","resolution":{"observed_at":"2026-05-12T05:24:29.037718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Manipulathor: A framework for visual object manipulation","venue":null,"work_id":"f857e247-a05b-4a6e-a8f0-a9cdaa91e6ae","year":2021},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:c7bdf5951902e0c1fb87c5380d918a7cea0f04512c2171089fd8b180a5e57478","observation_id":"9472ad5d-ef99-48d2-86a8-18ce65deb386","resolution":{"observed_at":"2026-05-12T05:24:29.102653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Segan: Segmenting and generating the invisible","venue":null,"work_id":"d2ec2a94-79f6-42fb-91ad-67bef11080b3","year":2018},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:1d83ba5fb7b16b368dce9e8315da2ef961ca0b77f83ddbc0d4b0637e5c1e650c","observation_id":"e8cd9a68-9d1b-4ae5-9cae-ccbce1c6674f","resolution":{"observed_at":"2026-05-12T05:24:29.108218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Threedworld: A platform for interactive multi-modal physical simulation","venue":null,"work_id":"c24b7d71-070f-4bd9-99c1-e99a6d95f951","year":2020},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:fb7295d0d92b4d978c99606940c897b8be0767fe9259c669441a826eafc07def","observation_id":"1729c8a9-d1b8-4271-9aed-aa993485f06f","resolution":{"observed_at":"2026-05-12T05:24:29.197206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Look, listen, and act: Towards audio- visual embodied navigation","venue":null,"work_id":"e443e505-49e7-4994-a225-99e39cc44c52","year":2020},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:c7388b1372455aba26fdbb292834919da36687e311b4f633449ed76a5fa72338","observation_id":"f23cdb4d-92b9-4d2e-a378-54690a22e685","resolution":{"observed_at":"2026-05-12T05:24:29.266722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dialfred: Dialogue- enabled agents for embodied instruction following","venue":null,"work_id":"86fb6842-f1be-4111-a11e-bf0834c2b275","year":2022},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:fa3122efa4b802db098bb1790f78ad8e28b1686ee4c9bb86353e2cd463f1f570","observation_id":"60849c81-d144-4ab4-b742-158c0ada3cbd","resolution":{"observed_at":"2026-05-12T05:24:29.337206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Iqa: Visual question answering in interactive environments","venue":null,"work_id":"fe3b25a6-bef5-4867-a7d5-0449ebb0832a","year":2018},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:9b378d76a9fb3319e9cecb2bf2f11d9f164e03245f9d9b9f5f65cef430b615ae","observation_id":"2a6a60e8-ad26-4d56-a02f-6575306b9d94","resolution":{"observed_at":"2026-05-12T05:24:29.416575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2cc780b1-4675-4315-a0e1-94a0a142e64c","year":2020},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:de45d0232843fd4f2c670de36b087e9efcff316f93507be4fe9df8439fa979a8","observation_id":"513149e5-8c53-4dcf-9cda-82479efa9268","resolution":{"observed_at":"2026-05-12T05:24:29.442582Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Schwing, and Aniruddha Kembhavi","venue":null,"work_id":"daa9c6ad-2df5-4287-b68c-26917b47e9a0","year":2019},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:75d7dd7c8d5d6d04034615539a320199b4d6f00eb4913e57922e636f4de30b2e","observation_id":"6a1485bf-7da3-48c6-955b-606d75d2e715","resolution":{"observed_at":"2026-05-12T05:24:29.446751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning adaptive language interfaces through decomposition","venue":null,"work_id":"b7e0ae1b-cb83-44dd-84a1-15593d9911a5","year":2020},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:0e3a612b1fbac8d318527933b903ccde639f355591db3ed0b20d4f2fd5d553c0","observation_id":"14129ea1-51f5-45b4-b593-f3f175fc4d3e","resolution":{"observed_at":"2026-05-12T05:24:29.486904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The design of stretch: A compact, lightweight mobile manipulator for indoor human environments","venue":null,"work_id":"29eaf045-29d1-4ef1-9e57-99dc4eeb937f","year":2022},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:8c369d2a8b342e2219620cf24f16bb687533d62e9622ac0e2a031ad6463e608c","observation_id":"4b30b6c7-3d07-404b-8749-6aaff67a3a3d","resolution":{"observed_at":"2026-05-12T05:24:29.526641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Simple but effective: Clip embeddings for embodied ai","venue":null,"work_id":"b328febd-bf2b-436c-ad89-2b43c021b14d","year":2022},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:f00cb51b7a62a8c9730000ba7258a011c88fb92ad2ddcd86fb0a8c8a90bff07f","observation_id":"a3158ec2-1665-48f8-acbb-2817333f1497","resolution":{"observed_at":"2026-05-12T05:24:29.556583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Contrasting contrastive self- supervised representation learning pipelines","venue":null,"work_id":"8548f3ab-7683-4060-97d7-f912149b0397","year":2021},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:03369f87559e8b3a7ea8ffc01c1a6035496a25b2baec23540802272603969e2f","observation_id":"102f82cd-c0f6-4050-a31b-c08489b5756b","resolution":{"observed_at":"2026-05-12T05:24:29.673893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Interactron: Embodied adaptive object detection","venue":null,"work_id":"8a1b0a1a-3606-4c83-84d8-43ebedca778f","year":2022},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:d2a04886eaf788d157e302388409aafa84f5c47eced4bb1a71ebd1ee78b0b2f6","observation_id":"795e5939-e120-4d0f-b1c4-c6800358363b","resolution":{"observed_at":"2026-05-12T05:24:29.736720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"igibson 2.0: Object-centric simulation for robot learning of everyday household tasks","venue":null,"work_id":"3c00d5aa-a7b0-46df-aa8e-14886a152c80","year":2021},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:97a865a6110f25b6b09b252a50bfb29df1cca8691c7c386e5703056aeb737293","observation_id":"78cdc9c7-5396-4e1f-b006-4979963a9b66","resolution":{"observed_at":"2026-05-12T05:24:29.854261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ifr-explore: Learning inter-object functional relationships in 3d indoor scenes","venue":null,"work_id":"9710be92-e5c5-4468-9332-fa3702719225","year":2022},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:6ab7085be5c04bf31f5d1bbb5fd97028b6ed428c7ac6937bd43d2c4e1162b9bc","observation_id":"436ccb82-c447-401f-8ada-23e73f11df7e","resolution":{"observed_at":"2026-05-12T05:24:29.986655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-agent embodied visual semantic navigation with scene prior knowledge","venue":null,"work_id":"1dece458-808f-4b8e-a5d8-8d66da636ef5","year":2022},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:f3ccad88c1008f0fd4be6987084f7806365451e857a79b41bbdeded0af90ba84","observation_id":"9c92eb2a-a633-4020-93ec-0049fe33281a","resolution":{"observed_at":"2026-05-12T05:24:30.097129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning about objects by learning to interact with them","venue":null,"work_id":"5cfb378c-c0b5-4f57-a4de-492087408b7b","year":2020},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:3d4c4c5d86924fc34c62d60e9cdfa184b0cef3c7ba9b53304b4f660e7f5c22dc","observation_id":"23cae2b9-6ec8-41d5-8788-b99f93e3a4d3","resolution":{"observed_at":"2026-05-12T05:24:30.110601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mgrl: Graph neural network based inference in a markov network with reinforcement learning for visual navigation","venue":null,"work_id":"3186bc51-67b7-45e7-8b5c-4530f7a23b2d","year":2021},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:f04b1d2baec8b7da334f4aa1a18c797b4e22319ca342d7fc3a366497d1c63407","observation_id":"e52dc120-e6c3-4f7d-8421-c96c2b453504","resolution":{"observed_at":"2026-05-12T05:24:30.176745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Film: Following instructions in language with modular methods","venue":null,"work_id":"4532bb7a-b4f8-4ccc-bce7-e2f6a1e9f55b","year":2022},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:20e7d55fa9ce41ff9825c24409713a11acbf0824945d135355fc8e66aa59cc68","observation_id":"2215ee78-333b-4160-8b68-bf82433a1625","resolution":{"observed_at":"2026-05-12T05:24:30.276690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pyrobot: An open-source robotics framework for research and benchmarking","venue":null,"work_id":"40a9feb8-a3c8-47cc-87f2-86d0f3432510","year":2019},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:e36c973b3eeb00715d823a5ac4ef95c0ca294d76f13960e1318a75450fb0fd91","observation_id":"fc9fe8f7-6bf9-4625-85cc-d7f1ea29644d","resolution":{"observed_at":"2026-05-12T05:24:30.406705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning affordance landscapes for interaction exploration in 3d environments","venue":null,"work_id":"6d2839f7-62b2-400a-be19-10c060d10c66","year":2020},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:0adf98b2e421cd3d9d184afa0132cbebba238e1308e09efc3e7d1ddde7d1b29f","observation_id":"dc00aefc-8524-406b-a58e-626691f56b1b","resolution":{"observed_at":"2026-05-12T05:24:30.527063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shaping embodied agent behavior with activity-context priors from egocentric video","venue":null,"work_id":"b5f6ba29-e019-4166-a99e-ce31b8d5c621","year":2021},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:21d65a91546b829dd4d5614bf592d1ee2e0c24bd30b01bc3d906c3b211bfc3e9","observation_id":"fae9c8c5-9ef0-4e5a-b551-9345d0f068b1","resolution":{"observed_at":"2026-05-12T05:24:30.606632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Teach: Task-driven embodied agents that chat","venue":null,"work_id":"aae5e187-084d-4841-8b20-6df02d8ab888","year":null},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:03aee0d085da7dde30ddf5c40c29313e9d3dfc7f5c5c02672cc2d26f3e756687","observation_id":"bda267a4-ccb9-4ec2-b168-de00e6c5b736","resolution":{"observed_at":"2026-05-12T05:24:30.717375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Episodic transformer for vision-and-language navigation","venue":null,"work_id":"d99857fc-386d-4894-a4eb-78f302231e2e","year":2021},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:4c9bb2f9ce4b401ffb39bc9448f2fe1c8ff5536aab48a25e75961d9a631a1504","observation_id":"132bd50d-1d55-4ff1-bfcd-412dfcf1438a","resolution":{"observed_at":"2026-05-12T05:24:30.820777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Habitat-matterport 3d dataset (HM3d): 1000 large-scale 3d environments for embodied AI","venue":null,"work_id":"a76fb4c2-d8e9-42cf-8164-1b346fc6e721","year":2021},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:88318d60adc9c35713c722f3cd23ee75ce7dc56adeb9af41ae29cb678c18ff7a","observation_id":"a68c71d1-16f0-4c10-b0eb-833db1031528","resolution":{"observed_at":"2026-05-12T05:24:30.827895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Habitat: A platform for embodied ai research","venue":null,"work_id":"05e4f110-05d6-4a15-afe6-ab7089a0a911","year":null},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:64a696ebb863e9f7d3e3ca57100cac5be9c4aa640869950a40b46254f37cc0c6","observation_id":"8f381d19-49f9-4664-8946-71e44f9be417","resolution":{"observed_at":"2026-05-12T05:24:30.897086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Alfred: A benchmark for interpreting grounded instructions for everyday tasks","venue":null,"work_id":"a2c91d67-cfc0-4b7b-98f5-33163951e903","year":2020},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:8b496f06b00c57a7b8f4980f13a0b0854aa0c54a78b38dccdf5d62b49bdbc254","observation_id":"8d2972a4-0c46-40e9-a9ce-ed814a55a815","resolution":{"observed_at":"2026-05-12T05:24:30.901394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chang, Zsolt Kira, Vladlen Koltun, Jitendra Malik, Manolis Savva, and Dhruv Batra","venue":null,"work_id":"431e94d3-9599-45f5-99da-7d0051712610","year":2021},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:5703b02b1ae7842650d9e2f56a6eb3205662d92356a0f0df36bdc5fe20475ee5","observation_id":"dabb1184-7b90-487d-b6ee-62a554a985c9","resolution":{"observed_at":"2026-05-12T05:24:30.908522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-agent embodied question answering in interactive environments","venue":null,"work_id":"9e3c9e46-7815-4be9-a227-71fd41795fc1","year":2020},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:b64909a1ebc8d87cc3dc4613261fd9b49e937ff5d34613edefc2021bfc542aa7","observation_id":"8872e4fb-1201-423f-a0be-523dc5976758","resolution":{"observed_at":"2026-05-12T05:24:30.912288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual room rearrangement","venue":null,"work_id":"31e47869-ee38-4905-8a32-37ec8906d174","year":2021},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:51a4f7d94b3f95cb2fc320ca64e6c808b2b6458b152bf8812913630e96b0fcee","observation_id":"b8d82bab-0d17-4822-b733-5737c11154b4","resolution":{"observed_at":"2026-05-12T05:24:30.919459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning generalizable visual representations via interactive gameplay","venue":null,"work_id":"2cb9b362-f816-4aff-ae1e-ed4d31acf1d6","year":2021},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:158a4c365e9d1cdedf4aef863c637f24ba2321dcddf3c6d93e2e7a2b00667fb7","observation_id":"2dc2e787-58cb-4eb0-a899-9d0e93d00e85","resolution":{"observed_at":"2026-05-12T05:24:30.947120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Allenact: A framework for embodied AI research","venue":null,"work_id":"66cd4f64-469e-4d01-9fea-8e21c621f03d","year":2020},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:e3bc9fdfaac0960ddeedff16b61e84544d8787c6ef970c2060d89e66acb32354","observation_id":"7873169d-2d9c-4c77-bcab-2dd8fb327af7","resolution":{"observed_at":"2026-05-12T05:24:30.960632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to learn how to learn: Self-adaptive visual navigation using meta-learning","venue":null,"work_id":"2e5f89e1-42d7-440f-af8e-5888e0bdb59b","year":2019},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:695b70a6c88ffa4b12256be1f382a5896032ccdbdde56dbf54453b7ec62b5c89","observation_id":"7676895c-8847-49b4-abb3-111c6af347c0","resolution":{"observed_at":"2026-05-12T05:24:30.970543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Communicative learning with natural gestures for embodied navigation agents with human-in-the-scene","venue":null,"work_id":"2ed6749d-c978-415a-a145-3ae96988ad69","year":2021},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:7c6a48cba39f7f385061778f6e792e5bd04a23a14a9559e6a26e43d0d0e84129","observation_id":"b6ac0b0b-0f46-44b6-8a36-91b882ece799","resolution":{"observed_at":"2026-05-12T05:24:30.976336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chang, Leonidas J","venue":null,"work_id":"9c7325e1-7ffa-4d8b-8f8e-172e0bca9669","year":2020},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:c7a4e07168d8d2fcfe50be07937d466b2a7e6e83990a1c4294a720f40a88d043","observation_id":"8c957aa7-e28b-4a15-b243-2c1e60b86738","resolution":{"observed_at":"2026-05-12T05:24:30.982338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual semantic navigation using scene priors","venue":null,"work_id":"6bfab1da-aa22-44ef-9ebd-1e7880bbe1cd","year":2019},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:deb22a6f1d406ed79a8d52e765dd1c5ca0eaf1117082232fddf597cd2c5d4c39","observation_id":"7471b744-72ba-41e6-90fe-925c83924597","resolution":{"observed_at":"2026-05-12T05:24:31.003221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Peters, Roozbeh Mottaghi, Aniruddha Kembhavi, Ali Farhadi, and Yejin Choi","venue":null,"work_id":"e653f4e3-c837-45fa-be8d-c6093b5dab4d","year":2021},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:7e6339c5553959240ec513cafde7853b3b0e41f14c9e94a7f1a471ab23854223","observation_id":"99b83760-c71b-4208-93ba-d7917bba777e","resolution":{"observed_at":"2026-05-12T05:24:31.007942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual reaction: Learning to play catch with your drone","venue":null,"work_id":"dd33d3dd-1fa3-429f-a4ad-1c455b7754c4","year":2020},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:aa64b71825872535f9b386800b1b8ea84b8836907e959dbd40509074c2befcd4","observation_id":"b634326b-4c13-4f70-9c9d-1a170d07d0cc","resolution":{"observed_at":"2026-05-12T05:24:31.012106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lumi- nous: Indoor scene generation for embodied ai challenges","venue":null,"work_id":"ab7f99dc-48e2-467f-ad5a-25a61dbea426","year":2021},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:eab561b5522d9789e497f7d6f26b8123845cff12454014891dcbd3cea5426b3a","observation_id":"e655a536-27b4-4ff8-bc86-fa2c33f12b1f","resolution":{"observed_at":"2026-05-12T05:24:31.023334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards optimal correlational object search","venue":null,"work_id":"2e60ab64-4a27-4785-9ec5-a71953c6a644","year":2022},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:34562a357004c3b9f5a6caa1e5ff730a5a22f3523bd3ab40ecb45178e41961f4","observation_id":"da27a9b8-8f86-4f00-bb29-eb806ba093f5","resolution":{"observed_at":"2026-05-12T05:24:31.036352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Target-driven visual navigation in indoor scenes using deep reinforcement learning","venue":null,"work_id":"70689803-a99a-4e27-b2df-6385abbc477d","year":2017},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:26c98863d9e07e47214a2150df9ffe1b8b6b1019410751170c54c04dea986c4c","observation_id":"3fcde670-87dd-464c-9696-2b380e82dc43","resolution":{"observed_at":"2026-05-12T05:24:31.047618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AI2-THOR supports many different types of agents, including the Ma- nipulaTHOR, Abstract, and LoCoBot agents","venue":null,"work_id":"87c082c9-a4ce-4a82-af52-9d7fd5ab62b4","year":null},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:116dd99b9c2bd68969eee9fd9be1dac16bb51240262382fa7942d6b82ba521ad","observation_id":"74fe8c3c-1672-45a1-b684-dd0efff26d30","resolution":{"observed_at":"2026-05-12T05:24:31.054345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AI2-THOR","venue":null,"work_id":"3f8ac337-b586-4f18-acc2-b29082648596","year":null},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:ee8289d5fd75f16f5d0cbcdabeb344ff0a9583545662d9280ddcbb73998bad92","observation_id":"1fdc1b5a-c3d7-4294-ac55-7d03af181ac2","resolution":{"observed_at":"2026-05-12T05:24:31.067946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"These factors include: (a) Model forward pass when computing agent rollouts","venue":null,"work_id":"54c80692-9f57-4370-b447-359ae8ec84a8","year":2080},"citing_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-12T05:24:28.744397Z"},"links":{"citing_paper":"/paper/1712.05474"},"observation_digest":"sha256:ba7a75d098d665647421e381a812656f0ad58def37c6455a2ee2c00fa3127ca4","observation_id":"34bb5d04-6765-4478-b729-3e313fa17c6c","resolution":{"observed_at":"2026-05-12T05:24:31.080353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T05:42:22.751765Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":1,"verified_exact":0,"verified_fuzzy":47},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 100 inbound Pith citation observations for arXiv:1712.05474."}