{"as_of":"2026-08-11T09:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cac04642d8ff32d294b78328c751c2c0c9a30be6b3bd835ea2d5094f56f59f8c","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T17:52:01.089277Z","state":"measured"},{"denominator":67,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":67,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2503.15500/citation-record","integrity":"/paper/2503.15500/integrity","json":"/paper/2503.15500/citation-record.json","paper":"/paper/2503.15500"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:00.834916Z","title":"Interactive language: Talking to robots in real time,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.834916Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:cc42cb0f0bf6da88664934bf260baaef3144645efc098e8d85d640d89a60ed8f","observation_id":"59704f86-b35b-48e8-b5ce-4a844c806a1f","resolution":{"observed_at":"2026-08-10T17:52:00.834916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:00.839929Z","title":"A survey of robot learning from demonstration,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.839929Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:46cb43cc6ca1589b5bfd237d64f131fcfaeab37748ce0824a722cb1c8f06b85d","observation_id":"78dc169b-3c3e-4692-b701-22ef60d820b5","resolution":{"observed_at":"2026-08-10T17:52:00.839929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.868986Z","title":"A survey on end-user robot programming,","venue":null,"work_id":"4fef1a12-6935-446c-9c1e-766c92b37d45","year":2021},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.843922Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:5d2fa5041ab1dda1407418a86b6ed89c64f484a6355e0a3426f013865c2796cd","observation_id":"3b59cf21-26f7-41b4-b205-9851c83c74d1","resolution":{"observed_at":"2026-08-10T17:52:01.873273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.855335Z","title":"Direct manipulation: A step beyond programming languages,","venue":null,"work_id":"a78dea9a-5e76-42b9-b7d0-42172d5928fc","year":1983},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.848174Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:5c5dafce61f9360c32ab84a3af97c9d1528bb7bdf4c5a794ad1602cf3261b407","observation_id":"00793ffd-9493-4969-81f0-78852cc75b7c","resolution":{"observed_at":"2026-08-10T17:52:01.859457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.842858Z","title":"Directgpt: A direct manipulation interface to interact with large language models,","venue":null,"work_id":"2b5e7d24-da54-417b-a34b-ec03af33112c","year":2024},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.852087Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:74ca448446f0ec3184c227892a186f06c6b50903a39664933a88fdd4a1ec456b","observation_id":"68926136-c094-4f9e-a8e3-700f4a687cf5","resolution":{"observed_at":"2026-08-10T17:52:01.847248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.830262Z","title":"Human–robot interaction: a survey,","venue":null,"work_id":"59a4d918-255a-4d8b-865b-af133c02a14c","year":2008},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.856091Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:de1b7c935994a2c62a139e1d3715549d352f7b6a052505c0316e1e20a43350d9","observation_id":"e77a310f-f4ca-4fca-9ce6-b3300b5602aa","resolution":{"observed_at":"2026-08-10T17:52:01.834556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.817168Z","title":"Human-in-the-loop optimization of shared autonomy in assistive robotics,","venue":null,"work_id":"6ce1f6f3-238e-41a9-85f5-eebcba670f8a","year":2016},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.860151Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:97c17a413d9763fa08a29e462d61ef9fdbd0efb1dc23776f43a6674dd18974bd","observation_id":"04da43c7-0c79-4ca3-9de9-bcaf7f0b29c7","resolution":{"observed_at":"2026-08-10T17:52:01.821890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.804149Z","title":"Third-person piloting: Increasing situational awareness using a spatially coupled second drone,","venue":null,"work_id":"a41ed43d-7c18-410b-ba7b-f32f9b3f5ad0","year":2019},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.863752Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:822b5a1f88378e927a19563ffd0ebf23b7df1e1fbc0e9da758a662e9e2a2d956","observation_id":"91241f96-a208-4101-8a19-a7175b8e2c43","resolution":{"observed_at":"2026-08-10T17:52:01.808457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:00.867585Z","title":"Teleoperation of humanoid robots: A survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.867585Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:ae108febb91fcd43be3ab82a19b44c1ea014ab14cd164d2d912b272c139adfd6","observation_id":"5406d705-71b0-4295-9cfd-50846477eb2c","resolution":{"observed_at":"2026-08-10T17:52:00.867585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.784127Z","title":"Still not solved: A call for renewed focus on user-centered teleoperation interfaces,","venue":null,"work_id":"af815f17-fdd5-4bb5-9a49-2460933bf15f","year":2022},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.871732Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:f94aa6c48d8b112cdcd971be3d6e614a35e0088cc1f953cfaead6c9d8d334471","observation_id":"a8512dbe-00d0-4a84-9c46-188631410f39","resolution":{"observed_at":"2026-08-10T17:52:01.788183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.772718Z","title":"Effects of onset latency and robot speed delays on mimicry-control teleoperation,","venue":null,"work_id":"1a04a63c-294d-482f-a33a-0ea8d57a143b","year":2020},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.875110Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:740137d6450b615a9ce5d42eb42f5d41b480e2579dd3643653f0ad585a63cc94","observation_id":"f089438d-3d56-4f65-af63-59610829634b","resolution":{"observed_at":"2026-08-10T17:52:01.776574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.760281Z","title":"Multi-view merging for robot teleop- eration with virtual reality,","venue":null,"work_id":"0f636f41-2a9c-49e8-9626-cbab2f947cf7","year":2021},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.878865Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:a080b95da4e9fc08ce3b1fb6c71721ec7dc6ef4ab2da5668639dcacad5145300","observation_id":"b33b9634-9b11-40ce-8e43-e66ccd31573f","resolution":{"observed_at":"2026-08-10T17:52:01.764809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:00.882599Z","title":"Towards a virtual reality interface for remote robotic teleoperation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.882599Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:04b089816289177a85962338eeaa6ca8a4bbc234941c2bef32912a1733e1d816","observation_id":"d8be0d81-056a-49f4-941b-480d97288fed","resolution":{"observed_at":"2026-08-10T17:52:00.882599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.739545Z","title":"An autonomous dynamic camera method for effective remote teleoperation,","venue":null,"work_id":"09998269-a082-47ab-8c1b-a74e6b734c05","year":2018},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.886107Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:d8a56be41a77296dfb91503d0c3342271dab2bb71fb106b26e21e49b736f49da","observation_id":"72cfada2-c29f-4d8f-8191-aff3f3213c0f","resolution":{"observed_at":"2026-08-10T17:52:01.744552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:00.889766Z","title":"A comparison of remote robot teleoperation interfaces for general object manipulation,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.889766Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:2f84ce79a1b853c6da6ebb0030e539ba150717426bd4f95f9eff0a57c55abab2","observation_id":"1a802306-b5df-472d-8057-abdf1591235a","resolution":{"observed_at":"2026-08-10T17:52:00.889766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.718853Z","title":"Starhopper: A touch interface for remote object-centric drone navigation,","venue":null,"work_id":"c8293735-41e3-4437-a8ab-0d4715f92877","year":2020},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.893360Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:7a08bd8833c1cb94ff77539a2089b2a841a1bbdb34fd98c7c6937619aac0afb7","observation_id":"28922717-9430-4ed0-8bf0-84351c5b7e3d","resolution":{"observed_at":"2026-08-10T17:52:01.723143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.706597Z","title":"Communicating robot arm motion intent through mixed reality head-mounted displays,","venue":null,"work_id":"a7102313-ed1f-484f-a43a-f76fbf0e88d3","year":2020},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.896948Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:910baa772dfbf54bcb539aa3f3ec23b57e950df67994a58e46a6885052e3e7f6","observation_id":"ade8e3c5-7bc3-4d28-b563-2ada00873fb5","resolution":{"observed_at":"2026-08-10T17:52:01.710879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.689840Z","title":"Robot teleoperation with augmented reality virtual surrogates,","venue":null,"work_id":"9870f844-b58d-45b2-a2d4-39097496e643","year":2019},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.901288Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:924f38c3e1af5af19c358cd22590e41824114f1c7fa4c8f6ef5dff2a072e23ec","observation_id":"64fd7f09-6998-4872-be08-8a60a77c6555","resolution":{"observed_at":"2026-08-10T17:52:01.695742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.675614Z","title":"Robot programming through augmented trajectories in augmented reality,","venue":null,"work_id":"29d5bfa0-926e-474d-af0a-f42dd630dfe2","year":2018},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.905204Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:a454e94c6e36245fb92810ff5cbe2df3af16caf71750cf1bb905b5a7a6d5d4d9","observation_id":"4b65597e-a0dd-4b4e-b798-a0ed0c05f7f3","resolution":{"observed_at":"2026-08-10T17:52:01.680201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.663243Z","title":"Mimic: In-situ recording and re-use of demonstrations to support robot teleoperation,","venue":null,"work_id":"3f61b721-bd20-4175-ace4-5c1dfae49067","year":2022},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.908773Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:a80c7e8919e29afb6252ade1857dbe6a41b53c254fb61ebf9d8aee09219f4e29","observation_id":"706a67fc-e6f5-4078-8af0-ee7d63177a4a","resolution":{"observed_at":"2026-08-10T17:52:01.667790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.650430Z","title":"Scene editing as teleoperation: A case study in 6dof kit assembly,","venue":null,"work_id":"9f5cd5f7-2a4b-4d88-bd1a-9ba7fffe5e90","year":2022},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.912280Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:8dd41b8118e10a1d22e49ab971e940f4fc0a183b6e4d79940eb3297397e38949","observation_id":"ec8e64f9-30d3-4064-9740-6ecee234e446","resolution":{"observed_at":"2026-08-10T17:52:01.654824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.637702Z","title":"Asynchronously assigning, monitoring, and managing assembly goals in virtual reality for high-level robot teleoperation,","venue":null,"work_id":"99fd75d2-941a-4a35-8205-b00205add8d0","year":2024},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.916430Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:34c279a018905dc81168f2a316eb0b55400a3d9f23b37bf1cc8eb6b1bd02bf93","observation_id":"1845ca08-8697-4fab-8665-ccd9a05d89c2","resolution":{"observed_at":"2026-08-10T17:52:01.642167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.625123Z","title":"Learning to parse natural language commands to a robot control system,","venue":null,"work_id":"fb7a476a-c382-496e-8b50-9a53603677cd","year":2013},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.920283Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:4cb2d337c027eb68c19768bbd544b74d94745ec8fca2719078f7cc921f61d429","observation_id":"4bcce9ff-1d2c-48b0-9935-1952ccad078d","resolution":{"observed_at":"2026-08-10T17:52:01.629755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:00.923798Z","title":"Robots that use language,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.923798Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:38f5e23d81e8cd2c0e7ae5181109cb2511bfcdedba3b30a2a77939f6b940f759","observation_id":"c5a59618-834c-41d1-ad9e-8e545bd9c53a","resolution":{"observed_at":"2026-08-10T17:52:00.923798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.605218Z","title":"Inner monologue: Embod- ied reasoning through planning with language models,","venue":null,"work_id":"d36891de-148c-4fe8-a45a-b1ba7ada15f9","year":2023},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.927320Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:c0d44fa86b4e6f7aaca8f0eb2cbf0adc5849a63e2331f1a5eb2ae5cf38913f13","observation_id":"c1de24dd-e189-44dd-9491-058452fd304b","resolution":{"observed_at":"2026-08-10T17:52:01.609509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.592298Z","title":"Robots that ask for help: Uncer- tainty alignment for large language model planners,","venue":null,"work_id":"655607f4-8336-468c-ac91-c242e10ed4d6","year":2023},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.930987Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:7900d67307e8244144189a727b036a5e8830378068cec1ca0f317ca98801bfdb","observation_id":"00be73e5-8cfd-4288-b4e2-129ffae7a47c","resolution":{"observed_at":"2026-08-10T17:52:01.596451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.580354Z","title":"Distilling and retrieving generalizable knowledge for robot manipulation via language corrections,","venue":null,"work_id":"977dd471-9475-4bfb-badc-5c39e451104a","year":2024},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.934590Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:15a64c149a9a002d235992f7a76b20f6b452d1bef6722a8d231cd82329f43108","observation_id":"9e3bf01a-4431-4cb0-a114-89a939777f04","resolution":{"observed_at":"2026-08-10T17:52:01.584606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11450","last_updated":"2024-05-31T17:25:38Z","snapshot_observed_at":"2026-07-06T17:31:41.687799Z","submitted_at":"2024-02-18T04:16:24Z","title":"Learning to Learn Faster from Human Feedback with Language Model Predictive Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11450","snapshot_observed_at":"2026-08-10T17:52:00.938578Z","title":"Learning to learn faster from human feedback with language model predictive control,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.938578Z"},"links":{"cited_paper":"/paper/2402.11450","citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:07d10d7bef4101adca3af34828160dc5b4fa73edd79db0bf9270c4e83a5940f7","observation_id":"963a6166-f77b-4ac4-b96e-e5b214db1e0e","resolution":{"observed_at":"2026-08-10T17:52:00.938578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:00.942676Z","title":"Code as policies: Language model programs for embodied control,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.942676Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:fcac183d4144a32fbf65dfe7566e252d10f322dac036cd1515030c108352aea0","observation_id":"5c7ec3a8-a0d0-477f-8410-214a2f5653c8","resolution":{"observed_at":"2026-08-10T17:52:00.942676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:00.946277Z","title":"Progprompt: Generating situated robot task plans using large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.946277Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:0ed57f26dcac63d0d34eb5d401017d08ce553d21841082b7424533950156a7ef","observation_id":"48347a64-14f7-47d3-87d6-fd95b5f188e5","resolution":{"observed_at":"2026-08-10T17:52:00.946277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12202","last_updated":"2024-02-29T17:20:08Z","snapshot_observed_at":"2026-08-04T04:35:05.950904Z","submitted_at":"2024-01-22T18:42:20Z","title":"OK-Robot: What Really Matters in Integrating Open-Knowledge Models for Robotics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12202","snapshot_observed_at":"2026-08-10T17:52:00.949939Z","title":"Ok-robot: What really matters in integrating open-knowledge models for robotics,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.949939Z"},"links":{"cited_paper":"/paper/2401.12202","citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:2baadde95f887182162ccd90960dcf99bbf1fdd07fe05c877435899c3df3c277","observation_id":"dd57985d-c046-415a-a88d-5ff197bd7247","resolution":{"observed_at":"2026-08-10T17:52:00.949939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.554087Z","title":"Generative expressive robot behaviors using large language models,","venue":null,"work_id":"bfd0e1e4-f1eb-4bbe-be5d-11a9eb7c16a8","year":2024},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.953846Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:81ef2b7c33502fe0c95d2582f4c3c5a865ad4899e2b726b2d0985a358623dd0b","observation_id":"5e2def3e-34b0-4c50-8d71-51db83ea209c","resolution":{"observed_at":"2026-08-10T17:52:01.558312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.541812Z","title":"Rt-1: Robotics transformer for real-world control at scale,","venue":null,"work_id":"7e6a3be4-e2be-4775-8550-9f5dd9e159b0","year":2023},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.957606Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:dc2a94e014d30057615ac99ecb0dbcc07ffea426064b5b7eb963bd87aaaa3338","observation_id":"9169d1bb-f9c9-45ce-a33b-6f2a9b05be7b","resolution":{"observed_at":"2026-08-10T17:52:01.546234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.530052Z","title":"Octo: An open-source generalist robot policy,","venue":null,"work_id":"b0458b2d-56de-4f9f-8f54-e6a5e31c8207","year":2024},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.961415Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:5a33906abf8411be80811a4fcee5b95f7ce8b091857b6a3e6b4e1676f9de0979","observation_id":"817077d7-61a5-47b2-a5c0-a671ce868450","resolution":{"observed_at":"2026-08-10T17:52:01.534131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-10T17:52:00.965101Z","title":"Open- vla: An open-source vision-language-action model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.965101Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:5ba0633f52874a6a86390d8965aabbf3d872a5ad2d3d7e1f23357fba18153938","observation_id":"468b6f21-d92b-411f-93a9-ca1da63b65e3","resolution":{"observed_at":"2026-08-10T17:52:00.965101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.517579Z","title":"Code3: A system for end-to-end pro- gramming of mobile manipulator robots for novices and experts,","venue":null,"work_id":"0ba51a82-c5fd-4be8-b9da-2b4f05335141","year":2017},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.969256Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:0d33997e49e6c46af5fd257ddfd2405a9c4ea824b5a81c68c98edff4bb272b88","observation_id":"37377a0b-8df2-4c02-adbe-7ddb742418a8","resolution":{"observed_at":"2026-08-10T17:52:01.522044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.504082Z","title":"Design and evaluation of a rapid programming system for service robots,","venue":null,"work_id":"c9e843fa-ffa7-4da6-ba64-93b5a0fe8075","year":2016},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.972884Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:4c53b43fcab8a6b36da16fe1fee4397bde062dd62aae7cb38e747cb48dce389d","observation_id":"97aad3ee-cf70-41c1-b738-f39c87c91fe0","resolution":{"observed_at":"2026-08-10T17:52:01.508587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.492028Z","title":"Evaluating coblox: A comparative study of robotics programming environments for adult novices,","venue":null,"work_id":"45b5fbe2-1575-4a8f-94a9-dcab7440d988","year":2018},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.976398Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:6acc4a89c06304aebe1b2d77b8b949f3f6327ed6092c8260d83e7c153af4417d","observation_id":"a0a589f1-9feb-4c1d-aad6-b80b3a0c3ab6","resolution":{"observed_at":"2026-08-10T17:52:01.496101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.479927Z","title":"Roboflow: A flow- based visual programming language for mobile manipulation tasks,","venue":null,"work_id":"28eca546-7882-4ab8-b3dd-04bd774ccd4f","year":2015},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.980059Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:e0106abdaef42c9e449c5f993341841e88d049eec487f76a54787d1763e5b804","observation_id":"e4e8d7ca-3e5f-46b9-b70e-7c1285f4cbc0","resolution":{"observed_at":"2026-08-10T17:52:01.484116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.468666Z","title":"Authoring and verifying human-robot interactions,","venue":null,"work_id":"c1db1630-1601-4b74-a6a5-0d19c946434c","year":2018},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.983745Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:a03e7758472e4e3f67ea60ca8ae8f2626987bd2c621bac81784b86041503722a","observation_id":"1bb0b57a-2682-43a3-b25c-6bfa7e9216ad","resolution":{"observed_at":"2026-08-10T17:52:01.472592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.456924Z","title":"Programar: Augmented reality end-user robot programming,","venue":null,"work_id":"5a2e271f-23ac-4f87-b43a-d56721780634","year":2024},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.987699Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:393c918fec335f58bdb5d7fcdceea72ce34ff1b13873bf024bbd2d504d33a416","observation_id":"3ba86067-024b-4ef4-b3af-5d40a7ac0404","resolution":{"observed_at":"2026-08-10T17:52:01.461227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:00.991959Z","title":"Aug- mented reality and robotics: A survey and taxonomy for ar-enhanced human-robot interaction and robotic interfaces,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.991959Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:3acac819d351fb3422046651f8b5fd155969c2595fd2f3ef163491230890886a","observation_id":"7fcd5374-0dec-4466-b345-97f0db40de1c","resolution":{"observed_at":"2026-08-10T17:52:00.991959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.437768Z","title":"Projection-based augmented reality interface for robot grasping tasks,","venue":null,"work_id":"76dea569-08ff-4640-85af-a53081184d93","year":2019},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:00.995902Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:6a643c7c6e87bf40631fb71027c83e761b0358468368ca66ddb81d0ebb1e5bf6","observation_id":"f5c5b18b-04e5-44aa-b27e-084228bab1a9","resolution":{"observed_at":"2026-08-10T17:52:01.441865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.425025Z","title":"Ghostar: A time-space editor for embodied authoring of human-robot collaborative task with augmented reality,","venue":null,"work_id":"d89efd2c-75c5-43e2-854f-d5d14a6f906d","year":2019},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:01.000104Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:111e54fc37daaa871a1a907197a115e2ba3c105ed089e34bf9d717fa73b298cd","observation_id":"0a3cc319-05ba-4cc1-aa00-b125d0bfe685","resolution":{"observed_at":"2026-08-10T17:52:01.429586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.410075Z","title":"Sketch and run: a stroke-based interface for home robots,","venue":null,"work_id":"6c2c297f-fc62-4cb9-85f7-50b3694a2187","year":2009},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:01.003990Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:7233a8439fd89878bb9a8133373741bd8f1eee78804c9c1ecb67e99354060fa5","observation_id":"0086a0d2-0562-4058-9639-a048f2181f61","resolution":{"observed_at":"2026-08-10T17:52:01.414485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.397423Z","title":"Sketching robot programs on the fly,","venue":null,"work_id":"8965d734-4b52-46ed-b58e-1ae5745922b5","year":2023},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:01.007689Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:84b36a933b868272d2ed0cae117c2dcb062b6bed3133c174e2f884061101282c","observation_id":"f8ee5231-d5b9-4f21-9b30-b83ef2f64542","resolution":{"observed_at":"2026-08-10T17:52:01.401608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.384999Z","title":"Situated tangible robot programming,","venue":null,"work_id":"b1815474-f81f-4eb6-a295-da4e4d9ec73a","year":2017},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:01.011318Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:ba1e089cbcea1ddf3ccecbc11a4b62191a2a65c6564237ab1e96bb504df7f893","observation_id":"26aecbca-410a-4b61-98eb-bbd49703693b","resolution":{"observed_at":"2026-08-10T17:52:01.389531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.373412Z","title":"Pati: a projection-based augmented table- top interface for robot programming,","venue":null,"work_id":"2f506850-aaf4-462c-a56e-b3564dd68373","year":2019},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:01.015052Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:f19dd46d8c0915c052bf68be749c93e6992b29a728866394fe62d67dd1afe4a6","observation_id":"d6cf7b80-016b-460f-b864-bd40dc18483b","resolution":{"observed_at":"2026-08-10T17:52:01.377170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.361914Z","title":"Figaro: A tabletop authoring environment for human-robot interaction,","venue":null,"work_id":"41f421c1-b294-41c1-a342-deade9409875","year":2021},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:01.019040Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:c9a8759849a87cf96d8dc20a2efb8ba12ae2cddfc38dfec35fcb46deb946f08d","observation_id":"5e9808a2-93b4-46b0-bff3-17eeeefcd245","resolution":{"observed_at":"2026-08-10T17:52:01.365910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.022743Z","title":"Alchemist: Llm-aided end-user development of robot applications,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:01.022743Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:0372a191ee5e61e1d4117ba210918065b3599f5936114f92d2dd02ecbcb43815","observation_id":"f008c044-3693-4109-bc8c-39f1943348c6","resolution":{"observed_at":"2026-08-10T17:52:01.022743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.342235Z","title":"Cocobo: Exploring large language models as the engine for end-user robot programming,","venue":null,"work_id":"5f5449ba-e475-45b9-b8ae-651f2b34c5e7","year":2024},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:01.026546Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:e9be20ebb93904f612f43f1644eca4c1f98850ef30cb8ce439d19171620812f4","observation_id":"7fcd20b1-5c23-43c8-adf6-135ad030cc1e","resolution":{"observed_at":"2026-08-10T17:52:01.346227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.329586Z","title":"Robotist: Interactive situated tangible robot programming,","venue":null,"work_id":"0d47774f-8cfb-43d1-a063-fe9468fee742","year":2018},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:01.030593Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:d154e986b4a90d2545c1ab6a9ad25c4ada1021ba4eaa1c3479a0c255c8176df4","observation_id":"da5733f6-21d4-47f1-bec8-d8d9f4261493","resolution":{"observed_at":"2026-08-10T17:52:01.334247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.315832Z","title":"Vipo: Spatial-visual programming with functions for robot-iot workflows,","venue":null,"work_id":"68d9d7ff-2d32-4516-bac3-4877d56bbbf9","year":2020},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:01.034441Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:c9c1ca287a261e179e10675dd9acf2d4a6d9196e7c87cf605b11f4c733c9779d","observation_id":"1a42cdfc-0c33-4a74-9557-54b9d704ef40","resolution":{"observed_at":"2026-08-10T17:52:01.320292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.302747Z","title":"Bodystorming human-robot interactions,","venue":null,"work_id":"4577c3b0-16c3-4779-b29a-371307d129c4","year":2019},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:01.038294Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:efab8d51d4f7b4005c7d2b04844d31c041815145a9b6742e53ff6f7418c6ab61","observation_id":"c7c7d04f-3e83-4800-b421-a99375f1e0aa","resolution":{"observed_at":"2026-08-10T17:52:01.307078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02523","last_updated":"2024-06-04T17:41:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T17:41:31Z","title":"RoboCasa: Large-Scale Simulation of Everyday Tasks for Generalist Robots","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02523","snapshot_observed_at":"2026-08-10T17:52:01.042078Z","title":"Robocasa: Large-scale simulation of ev- eryday tasks for generalist robots,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:01.042078Z"},"links":{"cited_paper":"/paper/2406.02523","citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:3e678eead0eec81e401dc9a88b268f58bacb7982be6edbdd0d6110eac01d10d6","observation_id":"8a0ce1b8-2089-4030-8cfe-ef064e9c353a","resolution":{"observed_at":"2026-08-10T17:52:01.042078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.289962Z","title":"Robot see robot do: Imitating articulated object manip- ulation with monocular 4d reconstruction,","venue":null,"work_id":"3a45de68-a096-4430-8ede-a5868a2fc80b","year":2024},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:01.046155Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:9bb0de785a8f9f898e226561317ccb8090a55b5ed7a62f17ef7e41eb652e04c3","observation_id":"00fbc25c-28d6-4ac3-9731-4077a434ef4e","resolution":{"observed_at":"2026-08-10T17:52:01.294244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.277496Z","title":"Joint discovery of object states and manipulation actions,","venue":null,"work_id":"653034e9-3fbc-4fd1-85b6-676838bc0bf6","year":2017},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:01.050136Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:ad172006e80194d98108fa2a680305f3fe791513941ae3249ac20374503051d9","observation_id":"7d7a76ad-5c4c-4498-9a08-462f86c1d2bf","resolution":{"observed_at":"2026-08-10T17:52:01.281666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.266170Z","title":"Under- standing 3d object articulation in internet videos,","venue":null,"work_id":"4d8fb6c9-9855-4ddf-ad0b-282abc1f0785","year":2022},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:01.053838Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:80e3ed733a0a976f710447bf2a901c24146db1f87931b7d619b851e4c5465c91","observation_id":"091ad373-b6d6-4569-a09a-8cc1979d8f90","resolution":{"observed_at":"2026-08-10T17:52:01.270082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05941","last_updated":"2024-05-09T17:30:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-09T17:30:16Z","title":"Evaluating Real-World Robot Manipulation Policies in Simulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05941","snapshot_observed_at":"2026-08-10T17:52:01.057934Z","title":"Evaluating real-world robot manipulation policies in simulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:01.057934Z"},"links":{"cited_paper":"/paper/2405.05941","citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:560726782d8ea564e8e5f28bd3bd24159fd229841ad330feaa6b65673fe3ae83","observation_id":"2cf74c8f-253f-4d44-b6e7-b7582a02f0a1","resolution":{"observed_at":"2026-08-10T17:52:01.057934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.063449Z","title":"Instructpix2pix: Learning to follow image editing instructions,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:01.063449Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:86adafacfd337be5dca6e1ff28830e898b68ed03e516b523f234f040fcb98a41","observation_id":"84d711f5-fd75-43a3-8868-16bb311059c6","resolution":{"observed_at":"2026-08-10T17:52:01.063449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10639","last_updated":"2023-10-16T17:57:23Z","snapshot_observed_at":"2026-08-08T13:35:58.479807Z","submitted_at":"2023-10-16T17:57:23Z","title":"Zero-Shot Robotic Manipulation with Pretrained Image-Editing Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10639","snapshot_observed_at":"2026-08-10T17:52:01.067309Z","title":"Zero-shot robotic manipulation with pretrained image- editing diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:01.067309Z"},"links":{"cited_paper":"/paper/2310.10639","citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:9a124dc2396afcc5419adfdb4be26b8254a40587ea53fa8bc0e2e06a34000ace","observation_id":"2cc7229b-4bf4-483c-bb2b-8db3f763a023","resolution":{"observed_at":"2026-08-10T17:52:01.067309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.247170Z","title":"Image inpainting: A review,","venue":null,"work_id":"d09b1134-6052-40d7-8f56-62c391894542","year":2007},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:01.071484Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:cac1eb55a036ce62e74b718e5deddbd6b4d490ddc9df765358a71eb37127e35a","observation_id":"6e8cb7a2-e436-4175-8ebd-0c848084bac2","resolution":{"observed_at":"2026-08-10T17:52:01.251225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.234186Z","title":"Scaling open-vocabulary object detection,","venue":null,"work_id":"11148301-9d28-4bee-8dea-63e1ff6dede1","year":2024},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:01.074811Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:ed7a1f1c1711b356c71bd5246c055c5c89b724c3e04728cca792308341bc8d3d","observation_id":"b36814a7-0b65-4909-aa6e-f605b4545db0","resolution":{"observed_at":"2026-08-10T17:52:01.238635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.078231Z","title":"Segment anything,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:01.078231Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:ef9005a89dea156b8685dae19eef00fbb980ab7e8ba7efa4ff43bac22f235c05","observation_id":"b8823b5a-ab6b-4b27-a8e3-8be1904fa6ab","resolution":{"observed_at":"2026-08-10T17:52:01.078231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.214036Z","title":"Nasa-task load index (nasa-tlx); 20 years later,","venue":null,"work_id":"418630be-d58d-4c67-833f-52bd3412ece5","year":2006},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:01.081925Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:33153f4fb47efeeb43d67ee019f8b486cd66bc85ff2e9fe6086c0b8a3b55a406","observation_id":"8a127dfa-d505-4141-8020-880cf7b2b74d","resolution":{"observed_at":"2026-08-10T17:52:01.218443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.201691Z","title":"An empirical evaluation of the system usability scale,","venue":null,"work_id":"506d0f66-1a61-418e-92b0-f1859fb65c21","year":2008},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:01.085602Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:c931f477a4e8b8e69ecf9e3dd961b0fb5d4ed2fd5843318739965b22a879d758","observation_id":"c7b088eb-a603-4694-8273-652bced5813c","resolution":{"observed_at":"2026-08-10T17:52:01.205920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:52:01.186761Z","title":"Contact- graspnet: Efficient 6-dof grasp generation in cluttered scenes,","venue":null,"work_id":"bb590917-7430-4be5-93d1-3af553fa455c","year":2021},"citing_paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-10T17:52:01.089277Z"},"links":{"citing_paper":"/paper/2503.15500"},"observation_digest":"sha256:8d7cb6cc1b0292a069628c250a73fd4740aa3d054bb68047d720cba331137cba","observation_id":"bd916cbd-a5ae-4b20-910a-96ac2dbb0cbe","resolution":{"observed_at":"2026-08-10T17:52:01.192741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2503.15500","last_updated":"2025-01-21T02:27:07Z","latest_version":1,"primary_category":"cs.HC","snapshot_observed_at":"2026-08-10T17:46:32.431774Z","submitted_at":"2025-01-21T02:27:07Z","title":"ImageInThat: Manipulating Images to Convey User Instructions to Robots"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":49},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 0 inbound Pith citation observations for arXiv:2503.15500."}