{"as_of":"2026-08-07T10:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0a854a042f7e44ebb8db5fe67f061e669a72cbcf7995b30d1aca311806dd2dff","coverage":[{"denominator":85,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":85,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:14:16.767481Z","state":"measured"},{"denominator":88,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":88,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T23:32:57.715826Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T07:35:58.284991Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"cited_work":{"arxiv_id":"2506.14727","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.14727","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Casper: Inferring diverse intents for assistive teleoperation with vision language models","venue":null,"work_id":"bd64faff-2811-420f-8cda-5a6966a098f2","year":2025},"citing_paper":{"arxiv_id":"2604.09462","last_updated":"2026-04-10T16:19:43Z","snapshot_observed_at":"2026-08-03T03:55:28.765311Z","submitted_at":"2026-04-10T16:19:43Z","title":"Adaptor: Advancing Assistive Teleoperation with Few-Shot Learning and Cross-Operator Generalization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T17:06:05.637760Z"},"links":{"cited_paper":"/paper/2506.14727","citing_paper":"/paper/2604.09462"},"observation_digest":"sha256:c5af63de42b4b213236f230c2c0c2636cfeac21204f4dff8f9b7546ee4a65e99","observation_id":"cf8f5ff3-35e7-4111-a37c-4ae5eb02f904","resolution":{"observed_at":"2026-05-11T07:35:58.287030Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.14727","snapshot_observed_at":"2026-08-01T23:32:57.715826Z","title":"Casper: Inferring diverse intents for assistive teleoperation with vision language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15395","last_updated":"2026-07-16T18:49:44Z","snapshot_observed_at":"2026-08-01T23:32:53.283329Z","submitted_at":"2026-07-16T18:49:44Z","title":"NeuroCommitSSM: Decision-Centric Shared Autonomy for Safe Assistive Manipulation via EEG-EMG-ET Commit Readiness","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T23:32:57.715826Z"},"links":{"cited_paper":"/paper/2506.14727","citing_paper":"/paper/2607.15395"},"observation_digest":"sha256:1bd647b2da2641e6c390d05b017424b086db5fc419871d442bffeb733e9a2add","observation_id":"33ab4492-3cfb-449d-8e96-aa526825ab92","resolution":{"observed_at":"2026-08-01T23:32:57.715826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.14727","snapshot_observed_at":"2026-08-01T23:17:15.525688Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15487","last_updated":"2026-07-16T22:23:20Z","snapshot_observed_at":"2026-08-07T05:23:54.191239Z","submitted_at":"2026-07-16T22:23:20Z","title":"Environment Design for Reliable Shared Autonomy with Probabilistic Guarantees","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-01T23:17:15.525688Z"},"links":{"cited_paper":"/paper/2506.14727","citing_paper":"/paper/2607.15487"},"observation_digest":"sha256:2fb6fd5e340fb41718a85b3d3cf9bff9bbaf219958fd16a6068f1c401a5dca53","observation_id":"1701c248-53de-4d87-94c1-ae550ac26079","resolution":{"observed_at":"2026-08-01T23:17:15.525688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.14727/citation-record","integrity":"/paper/2506.14727/integrity","json":"/paper/2506.14727/citation-record.json","paper":"/paper/2506.14727"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/electronics11193065","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:17.089619Z","title":"Cantucci and R","venue":null,"work_id":"ee68216c-9dda-4f76-bf74-eca745eea00c","year":2022},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:08.644912Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:8210b6fc496c4cbd78672782e5427f3839be2954bacec8a28f165afdeaa90f34","observation_id":"701f79a7-cf21-4281-826d-34cd11121d41","resolution":{"observed_at":"2026-08-07T00:14:17.166183Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:08.775252Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:08.775252Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:435e972299be598b7f8e3cc726b1e1016de0ad92cbadaf04c69249dc70d4f76c","observation_id":"8556bebb-6f98-4ea4-a61a-d9b5225478ef","resolution":{"observed_at":"2026-08-07T00:14:08.775252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5898/jhri.3.2","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:16.894050Z","title":null,"venue":null,"work_id":"c7aa4e60-1bfc-4d00-af7c-bb5fc4b79de5","year":2014},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:08.924103Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:90edcce19b97b14915371e93411f97b8dccac6753da447557d0eaa77cfdbdb5d","observation_id":"c5b51746-f640-4254-bec2-a5d2936ebb46","resolution":{"observed_at":"2026-08-07T00:14:16.979930Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07462","last_updated":"2025-01-13T16:32:13Z","snapshot_observed_at":"2026-08-07T02:35:07.781858Z","submitted_at":"2025-01-13T16:32:13Z","title":"The Sense of Agency in Assistive Robotics Using Shared Autonomy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.07462","snapshot_observed_at":"2026-08-07T00:14:09.086514Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:09.086514Z"},"links":{"cited_paper":"/paper/2501.07462","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:a2bce9017241029a6b544e52210416f55cd0f442783bbc533d5297459f3ac8f5","observation_id":"3b597553-a12a-458c-80d1-a12826941d29","resolution":{"observed_at":"2026-08-07T00:14:09.086514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:09.213210Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:09.213210Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:0a78ca712c907eb08e371fcfbb745aa258c4ba1cfcf6c64fd4178af8c47c4ed8","observation_id":"1725b1d6-baca-4443-981b-84d432870a83","resolution":{"observed_at":"2026-08-07T00:14:09.213210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:09.341201Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:09.341201Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:923000a7b9a86f91cee28b74934d699a539bcf5775ee9ab8dd2cd93c17407301","observation_id":"e7fc69c1-2d50-4fa4-b977-95406fc42ee2","resolution":{"observed_at":"2026-08-07T00:14:09.341201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:09.457575Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:09.457575Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:f147bf1a36d449a4fc947bff54ece0f8164ffd6711152d54b1670fa798e09760","observation_id":"3f40c314-6848-4150-8535-f221cca757ac","resolution":{"observed_at":"2026-08-07T00:14:09.457575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:09.534757Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:09.534757Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:03e07a77bd865b8f41f841a7475320c4d6dffdbc48e3ed51e935fadf4ddb743d","observation_id":"736835bf-f212-4eb0-9486-3db95bbbe524","resolution":{"observed_at":"2026-08-07T00:14:09.534757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:09.633228Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:09.633228Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:e7d34da3e5520506327e376dce590691f514a07ff6bf719b400b5f2016a4f568","observation_id":"bae4bd8a-4947-48d0-8e90-eeb4c5d011ef","resolution":{"observed_at":"2026-08-07T00:14:09.633228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.02465","last_updated":"2022-02-05T02:01:19Z","snapshot_observed_at":"2026-08-01T11:59:57.265408Z","submitted_at":"2022-02-05T02:01:19Z","title":"ASHA: Assistive Teleoperation via Human-in-the-Loop Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2202.02465","doi":null,"metadata_source":"pith","pith_arxiv_id":"2202.02465","snapshot_observed_at":"2026-08-07T00:14:19.138512Z","title":"ASHA: Assistive Teleoperation via Human-in-the-Loop Reinforcement Learning","venue":"cs.RO","work_id":"e89e06a7-ae76-4ba8-b769-ed27875b2116","year":2022},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:09.758244Z"},"links":{"cited_paper":"/paper/2202.02465","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:c746ef47725a69e09628685c54caaeecd56d14717bc255e5183ed2599e11f48b","observation_id":"db9678f8-6e80-4fbb-b4cf-6c7d111327b7","resolution":{"observed_at":"2026-08-07T00:14:19.211207Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:27.717016Z","title":null,"venue":null,"work_id":"391478ff-de34-415b-9ebb-98f9c38fc1c4","year":2010},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:09.894484Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:acda8235e1dbe52f9644868adeda0040a5cdc10135d98c68174e7ffb2d5ab19f","observation_id":"5d300d03-565c-4e09-827c-8bcd6a8d503c","resolution":{"observed_at":"2026-08-07T00:14:27.822164Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:27.413402Z","title":null,"venue":null,"work_id":"30858237-12cf-4520-93f1-d49da780d318","year":1998},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:10.027375Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:3e71e6a5532599216990d197ae31e1fa24ba48fb2bad6fb3d512bb67207a46ca","observation_id":"dcfd4424-f30e-41bf-bc6e-16b5951d13c2","resolution":{"observed_at":"2026-08-07T00:14:27.563517Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08389","last_updated":"2025-01-14T19:06:44Z","snapshot_observed_at":"2026-07-06T20:21:04.675084Z","submitted_at":"2025-01-14T19:06:44Z","title":"Toward Zero-Shot User Intent Recognition in Shared Autonomy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08389","snapshot_observed_at":"2026-08-07T00:14:10.137805Z","title":"Belsare, Z","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:10.137805Z"},"links":{"cited_paper":"/paper/2501.08389","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:0bd5fbcd580a4a1e65204dbf25862d9f6cca419bc9a8adafb2b49740f0c19eed","observation_id":"46bb46f4-0c55-4968-911f-dc7585acbeb1","resolution":{"observed_at":"2026-08-07T00:14:10.137805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07767","last_updated":"2024-07-10T18:34:05Z","snapshot_observed_at":"2026-07-06T18:29:17.280082Z","submitted_at":"2024-06-11T23:16:46Z","title":"Conformalized Teleoperation: Confidently Mapping Human Inputs to High-Dimensional Robot Actions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07767","snapshot_observed_at":"2026-08-07T00:14:10.256880Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:10.256880Z"},"links":{"cited_paper":"/paper/2406.07767","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:43041c1320a9278f9a7831e85db9c167b0c2fdc7d5902c0cf02010df0712affe","observation_id":"8701fff8-55c5-4933-91d5-8d3127f310ad","resolution":{"observed_at":"2026-08-07T00:14:10.256880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:10.483524Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:10.483524Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:153d2dd66413937deec4af6ce1a890d51c077694269c57b16a2bae5be55a5f12","observation_id":"d777138b-3888-42d7-b943-f05c0ab2f7b8","resolution":{"observed_at":"2026-08-07T00:14:10.483524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:27.049780Z","title":"Karamcheti, M","venue":null,"work_id":"6594a929-5151-44b3-8e76-bda1fccd7187","year":null},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:10.673138Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:6c8351c464eece27979b20735db05e0b8fd2b1bea0d9f854aa6068a4077862fe","observation_id":"00427d39-80b0-41d7-b65c-bbad33b7ede4","resolution":{"observed_at":"2026-08-07T00:14:27.254344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06237","last_updated":"2024-10-08T17:52:29Z","snapshot_observed_at":"2026-08-06T03:12:41.018982Z","submitted_at":"2024-10-08T17:52:29Z","title":"BUMBLE: Unifying Reasoning and Acting with Vision-Language Models for Building-wide Mobile Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06237","snapshot_observed_at":"2026-08-07T00:14:10.931859Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:10.931859Z"},"links":{"cited_paper":"/paper/2410.06237","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:47cb70e180ace56425b62c8ff23a65008b3b7173ecb783802497892648974134","observation_id":"cfd060c8-63cc-45e1-93ec-c4f6eb9e9701","resolution":{"observed_at":"2026-08-07T00:14:10.931859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-07T00:14:11.035366Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:11.035366Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:f63a060c3b15dbd2cff4e8cf1184b45aa095b0fd5c061cd5c6925102e9e3e2d8","observation_id":"c588d2d6-3682-4768-b1c6-ad04eebdf123","resolution":{"observed_at":"2026-08-07T00:14:11.035366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:26.472409Z","title":"https://pal-robotics.com/robot/tiago","venue":null,"work_id":"fc0ab365-35d3-4491-a9f1-75551fae114e","year":null},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:11.108043Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:0b0521ccf504e1f4cc3f736c1242c1baa825c8b77bf56cf72b6514be902d0ac9","observation_id":"90d249f1-5cff-4f26-b9ca-3684d4a739ab","resolution":{"observed_at":"2026-08-07T00:14:26.609080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:11.249870Z","title":"Padmanabha, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:11.249870Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:ee8adfd30fa309892dcb198ee45217fe22fd61f003af1ebe47dce811ac2088c9","observation_id":"d0666d25-9eda-4792-9c5f-e2d62a1d8dda","resolution":{"observed_at":"2026-08-07T00:14:11.249870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07561","last_updated":"2024-07-10T11:38:57Z","snapshot_observed_at":"2026-07-06T18:44:12.101916Z","submitted_at":"2024-07-10T11:38:57Z","title":"FLAIR: Feeding via Long-horizon AcquIsition of Realistic dishes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07561","snapshot_observed_at":"2026-08-07T00:14:11.370147Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:11.370147Z"},"links":{"cited_paper":"/paper/2407.07561","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:8b8ab300a048a4eba2623fa9d42d07081b4d31bca6a3944e053c7ecbf1eb9674","observation_id":"aa593be3-63a0-45d1-be04-750d31ad6ddc","resolution":{"observed_at":"2026-08-07T00:14:11.370147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:26.239264Z","title":null,"venue":null,"work_id":"aebfe2e7-9e21-4714-ba4c-072e8a140123","year":2024},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:11.476217Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:6373cf8f6584e89a3dce8c5fad524d67f4a39945639a533c87e4582abeefe9f7","observation_id":"ca9d889f-d00e-4cb9-9321-774d338d7757","resolution":{"observed_at":"2026-08-07T00:14:26.374925Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:25.967130Z","title":"Karamcheti, A","venue":null,"work_id":"6d2cfa19-4139-43b9-ac2e-5212be9da4b6","year":2021},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:11.559780Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:c07621138d790e1b10763604c8f7d3414d738cb806e10f8088f157303bbf91a6","observation_id":"886ef0b8-e95f-4128-a519-20c872623b2c","resolution":{"observed_at":"2026-08-07T00:14:26.112388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:25.696529Z","title":"You and K","venue":null,"work_id":"cd13bc08-5e29-4443-984f-7c806a667f53","year":2011},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:11.646267Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:3d1c36d0819d375ab36456cafd472c6cb59bd5612a1f7c855c5739666dc7a91c","observation_id":"ca845613-d98b-4777-9db2-2b18bcf0c36a","resolution":{"observed_at":"2026-08-07T00:14:25.817422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1808.08268","last_updated":"2018-08-24T19:07:10Z","snapshot_observed_at":"2026-08-02T18:53:37.996205Z","submitted_at":"2018-08-24T19:07:10Z","title":"Learning Models for Shared Control of Human-Machine Systems with Unknown Dynamics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.08268","snapshot_observed_at":"2026-08-07T00:14:11.784895Z","title":"Broad, T","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:11.784895Z"},"links":{"cited_paper":"/paper/1808.08268","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:da45b3afdd3c74d4a73ad7af584de5630824fa57c4a2957f668dc4e7828ab96f","observation_id":"edb8081d-82bf-4ccf-aa5c-89b3b94b79b9","resolution":{"observed_at":"2026-08-07T00:14:11.784895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:25.513551Z","title":"Javdani, H","venue":null,"work_id":"77450759-19a5-4760-8509-97bddb5edab8","year":2017},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:11.935185Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:ea0e08d6d542152aef01a582d83fa22362b34adc9b80721170940944c1f01a07","observation_id":"59a1be7a-9a8c-4252-8470-a291b49cb68d","resolution":{"observed_at":"2026-08-07T00:14:25.595812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:25.352191Z","title":null,"venue":null,"work_id":"810a1157-5c4f-4b85-93ff-25a33d915a19","year":2020},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:12.071078Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:e91278ceb9ad7936a73af8b63e741e04bd670fe811717a94f67aba6a38590db3","observation_id":"4e1d6317-1c68-4eec-b53d-7fbaa0f0d217","resolution":{"observed_at":"2026-08-07T00:14:25.432996Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:25.138435Z","title":"Hoffman, T","venue":null,"work_id":"313e229d-44bf-4ed6-b21b-8f3103546231","year":2024},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:12.165094Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:0033567c8a839b591bf46bb60d802b1e2960788c633de32dcf49041e16655eae","observation_id":"d3b2b7d4-b596-40ed-8a7d-4ebd97a7a275","resolution":{"observed_at":"2026-08-07T00:14:25.258400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:24.960508Z","title":"Admoni and S","venue":null,"work_id":"69e4a869-5776-4f4c-b0ce-b5d5905b71ad","year":2016},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:12.235935Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:da20768bd4c1a4dd344cc5f2036edc0a34b61f28f9c0d44e1d4734e1f1308826","observation_id":"9187d93b-cf70-4b63-a763-2d305b02d7c7","resolution":{"observed_at":"2026-08-07T00:14:25.044210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:12.339607Z","title":"Brooks and D","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:12.339607Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:8a14f0069295ad97ac674084cc27c58f68cb4f6da90a20b816c007e4fcaf4336","observation_id":"e6262d7b-8a9d-4450-bcf9-57bd1487f38f","resolution":{"observed_at":"2026-08-07T00:14:12.339607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:12.445200Z","title":"Nikolaidis, Y","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:12.445200Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:ecdc07e01b887f33ca60d03b9541665aac14235462f352ab7a349e03f8eefdcb","observation_id":"20066ac3-f463-4fdb-a228-ce153db3133a","resolution":{"observed_at":"2026-08-07T00:14:12.445200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.11154","last_updated":"2020-07-31T00:26:33Z","snapshot_observed_at":"2026-07-06T06:52:58.479955Z","submitted_at":"2018-07-30T02:55:18Z","title":"HARMONIC: A Multimodal Dataset of Assistive Human-Robot Collaboration","version":2},"cited_work":{"arxiv_id":"1807.11154","doi":null,"metadata_source":"pith","pith_arxiv_id":"1807.11154","snapshot_observed_at":"2026-08-07T00:14:18.329743Z","title":"HARMONIC: A Multimodal Dataset of Assistive Human-Robot Collaboration","venue":"cs.RO","work_id":"a74c144f-9293-46a7-a77d-01c3d3b1a91c","year":2018},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:12.536886Z"},"links":{"cited_paper":"/paper/1807.11154","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:fbc4bf3bc3f37a4577df9978176b96ece1f465fdc10bfa35178fb25741ecece9","observation_id":"09c734dd-83de-42c4-8ace-95180e005178","resolution":{"observed_at":"2026-08-07T00:14:18.384034Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12244","last_updated":"2025-08-27T02:12:36Z","snapshot_observed_at":"2026-08-03T01:19:46.894905Z","submitted_at":"2023-02-23T18:58:36Z","title":"To the Noise and Back: Diffusion for Shared Autonomy","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12244","snapshot_observed_at":"2026-08-07T00:14:12.676272Z","title":"Yoneda, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:12.676272Z"},"links":{"cited_paper":"/paper/2302.12244","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:456839e28923880d5bbf9e054f018bcae3a49d4449219475b2b80b224c99864b","observation_id":"17a8bfff-a7e1-4767-95cc-dd00445b6d0f","resolution":{"observed_at":"2026-08-07T00:14:12.676272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.09795","last_updated":"2024-02-16T16:23:37Z","snapshot_observed_at":"2026-07-06T13:11:50.069827Z","submitted_at":"2022-05-19T18:27:06Z","title":"SARI: Shared Autonomy across Repeated Interaction","version":3},"cited_work":{"arxiv_id":"2205.09795","doi":null,"metadata_source":"pith","pith_arxiv_id":"2205.09795","snapshot_observed_at":"2026-08-07T00:14:18.142147Z","title":"SARI: Shared Autonomy across Repeated Interaction","venue":"cs.RO","work_id":"b06bd451-fc3d-4f25-bfef-ab8bce8e23cd","year":2022},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:12.774230Z"},"links":{"cited_paper":"/paper/2205.09795","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:0ce7d1d7e11e189d51739598ca0b5ecd3161e78e129aabd46552437ca33e4c90","observation_id":"192c0e1e-4f99-465a-9337-47a7203e9120","resolution":{"observed_at":"2026-08-07T00:14:18.228239Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:24.796554Z","title":"Zurek, A","venue":null,"work_id":"3f3c76f3-50d7-4f99-ad60-0d179be3cb0a","year":2021},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:12.951453Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:06c9a54504c0c54c8aa268d923e27e71d25251bebb2f72cc2f8dcf52ecccb930","observation_id":"8fd39c67-b7ca-4887-a2ec-91e179806bdd","resolution":{"observed_at":"2026-08-07T00:14:24.866073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05097","last_updated":"2020-07-10T15:00:42Z","snapshot_observed_at":"2026-07-06T09:11:31.665721Z","submitted_at":"2020-04-10T16:31:15Z","title":"Residual Policy Learning for Shared Autonomy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05097","snapshot_observed_at":"2026-08-07T00:14:13.062319Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:13.062319Z"},"links":{"cited_paper":"/paper/2004.05097","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:c20d78afc46ecf2db9c80639d7e05bb2eddf4862d306bb27280c4548e63f2057","observation_id":"7dba2ea7-be06-479a-a44b-1d81d077db0e","resolution":{"observed_at":"2026-08-07T00:14:13.062319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14045","last_updated":"2024-10-17T21:37:40Z","snapshot_observed_at":"2026-07-06T19:35:39.803671Z","submitted_at":"2024-10-17T21:37:40Z","title":"Human Action Anticipation: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14045","snapshot_observed_at":"2026-08-07T00:14:13.150766Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:13.150766Z"},"links":{"cited_paper":"/paper/2410.14045","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:8ac3e239209cbb8a50e544c6424a93070fd817ff3a9843c516fcded86330749a","observation_id":"e93bb2cb-5e46-415f-a677-ba7727481e71","resolution":{"observed_at":"2026-08-07T00:14:13.150766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:24.623754Z","title":null,"venue":null,"work_id":"8a90840f-fac2-46f1-9242-94bdda8f6587","year":2023},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:13.227987Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:c128206c1b8f4f950f3526bacc0ac3854b0f92b84b43b5d57975e465cd8e2875","observation_id":"8336b580-d7d6-4b10-b430-d1a8f0840881","resolution":{"observed_at":"2026-08-07T00:14:24.707239Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.08236","last_updated":"2021-09-17T16:38:31Z","snapshot_observed_at":"2026-07-06T11:39:20.255905Z","submitted_at":"2021-08-18T16:57:03Z","title":"LOKI: Long Term and Key Intentions for Trajectory Prediction","version":3},"cited_work":{"arxiv_id":"2108.08236","doi":null,"metadata_source":"pith","pith_arxiv_id":"2108.08236","snapshot_observed_at":"2026-08-07T00:14:17.815358Z","title":"LOKI: Long Term and Key Intentions for Trajectory Prediction","venue":"cs.CV","work_id":"643696ef-7db1-45f2-a55a-3aff5739853a","year":2021},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:13.319556Z"},"links":{"cited_paper":"/paper/2108.08236","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:2a40713c794f168d2ae0a5a175961ee8f55130bf4fe2180c8bb9013d5e863534","observation_id":"797e5065-f3fe-4faa-b976-f13efaceb7ce","resolution":{"observed_at":"2026-08-07T00:14:17.897112Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:13.388889Z","title":"Rasouli, I","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:13.388889Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:b7dc5625a5170f1d7abc1dab8c2195aedc13546c9e9deee1113b7b700018b42d","observation_id":"ca29cb5a-920d-4060-aec5-01cbe0471847","resolution":{"observed_at":"2026-08-07T00:14:13.388889Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.08945","last_updated":"2020-02-20T18:50:44Z","snapshot_observed_at":"2026-07-06T08:58:55.604018Z","submitted_at":"2020-02-20T18:50:44Z","title":"Spatiotemporal Relationship Reasoning for Pedestrian Intent Prediction","version":1},"cited_work":{"arxiv_id":"2002.08945","doi":null,"metadata_source":"pith","pith_arxiv_id":"2002.08945","snapshot_observed_at":"2026-08-07T00:14:17.632545Z","title":"Spatiotemporal Relationship Reasoning for Pedestrian Intent Prediction","venue":"cs.CV","work_id":"ece74f32-0efd-4106-b647-26f3fa12f7cd","year":2020},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:13.509367Z"},"links":{"cited_paper":"/paper/2002.08945","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:87b22e0f64f8f439031265f4f9ac15aefa8321133c3aea6960e60aa32b92144b","observation_id":"3f646ff5-aa65-4763-9c07-27887392dc4a","resolution":{"observed_at":"2026-08-07T00:14:17.703466Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13787","last_updated":"2024-06-19T19:18:40Z","snapshot_observed_at":"2026-07-06T18:33:54.443005Z","submitted_at":"2024-06-19T19:18:40Z","title":"LIT: Large Language Model Driven Intention Tracking for Proactive Human-Robot Collaboration -- A Robot Sous-Chef Application","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13787","snapshot_observed_at":"2026-08-07T00:14:13.598722Z","title":"Huang, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:13.598722Z"},"links":{"cited_paper":"/paper/2406.13787","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:81c66fed375190dd6b520e0507568c157bffc3c4c333ac573124a8297ae091f0","observation_id":"0396fc9e-f76d-48a8-be7f-db62a44932fb","resolution":{"observed_at":"2026-08-07T00:14:13.598722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08424","last_updated":"2025-04-08T10:48:19Z","snapshot_observed_at":"2026-07-06T17:59:21.208430Z","submitted_at":"2024-04-12T12:15:14Z","title":"Comparing Apples to Oranges: LLM-powered Multimodal Intention Prediction in an Object Categorization Task","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08424","snapshot_observed_at":"2026-08-07T00:14:13.685516Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:13.685516Z"},"links":{"cited_paper":"/paper/2404.08424","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:f0a52998903798ff8061b48c8cb773af1a6207aa18bb74bda99cc4933e1c73c9","observation_id":"df2b19cb-1551-48be-9eaa-9f3e8ab99b23","resolution":{"observed_at":"2026-08-07T00:14:13.685516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.09063","last_updated":"2023-08-06T23:05:26Z","snapshot_observed_at":"2026-08-05T18:39:26.282960Z","submitted_at":"2022-03-17T03:48:54Z","title":"Hierarchical Intention Tracking for Robust Human-Robot Collaboration in Industrial Assembly Tasks","version":4},"cited_work":{"arxiv_id":"2203.09063","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.09063","snapshot_observed_at":"2026-08-07T00:14:17.455430Z","title":"Hierarchical Intention Tracking for Robust Human-Robot Collaboration in Industrial Assembly Tasks","venue":"cs.RO","work_id":"7885d7f0-9913-4670-8623-09c19f709875","year":2022},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:13.767081Z"},"links":{"cited_paper":"/paper/2203.09063","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:f3dcd343ace59fd92fd098b48a844c808d9f1390ea360bc70ebdd9b76cc4ca41","observation_id":"ab2a949f-c852-4db3-8beb-74d709a282de","resolution":{"observed_at":"2026-08-07T00:14:17.517227Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:24.466429Z","title":null,"venue":null,"work_id":"a18f9273-052d-4ae5-b70d-fd94e3d1570b","year":2023},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:13.831225Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:c0b5b3c694d946f1e8cc87a08185b2e83f485aa9c34c5d1f2a163e02bd0d51bc","observation_id":"2e315bb7-ed5b-477e-a13a-c6b9e87da174","resolution":{"observed_at":"2026-08-07T00:14:24.532809Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:24.301456Z","title":null,"venue":null,"work_id":"c57bacdd-9617-4005-b2b6-26ca54910713","year":2021},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:13.906877Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:f72454db391a993fac6b31b044ce5dccf0c6732aef637887418ab5e5940c77e4","observation_id":"6087f7a7-e147-42cd-a4ed-47e09a2b22b2","resolution":{"observed_at":"2026-08-07T00:14:24.337156Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:24.114019Z","title":null,"venue":null,"work_id":"54a59df7-7f8e-4f6b-9e3d-7ee12aa5dba8","year":2022},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:13.990748Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:fb6c402d66430a70413990a2010955279f681555185ad6b7483b0f779ca9a37a","observation_id":"7b45581c-ca84-4a83-a7ae-c5be764453ea","resolution":{"observed_at":"2026-08-07T00:14:24.203687Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:23.927736Z","title":null,"venue":null,"work_id":"d393a706-1a8e-44f0-87c6-64f0d60f6de7","year":2024},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:14.062746Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:ad708b700eaf7f0aadfcca233c25307d42c1e3f10cb3cc6d75674b2b235774e4","observation_id":"54cf94f0-42ec-4dc8-ab47-a7df116e7460","resolution":{"observed_at":"2026-08-07T00:14:24.030929Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:23.727354Z","title":"Chang, S","venue":null,"work_id":"ce4b5003-3802-4d60-9f0a-d4a68f696305","year":2020},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:14.143653Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:947693c6f683eae0514f90776f050327793cc73b7faec806d0267d013ba3dae9","observation_id":"08169543-4174-4fab-8dc2-ea2de4ee0988","resolution":{"observed_at":"2026-08-07T00:14:23.826988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:23.547658Z","title":null,"venue":null,"work_id":"c3b58b29-b274-47c1-9f63-863aaa06948d","year":2023},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:14.214035Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:c7c321728373fc6c52c9e28b389380570d61713f025e05bff0d999f14d0853e3","observation_id":"efd5fecf-00e7-4fe8-ad07-b1985377f4c2","resolution":{"observed_at":"2026-08-07T00:14:23.636283Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:23.316305Z","title":null,"venue":null,"work_id":"476536ce-f39b-4d27-8e63-349bc085805d","year":2024},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:14.285579Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:9cecf230d7122c410bab0ea3201928ce4a7e3eb53d1d33e8551761566d5ecc31","observation_id":"8fdc6ba1-2b94-4a87-89fc-b85ea655cbc7","resolution":{"observed_at":"2026-08-07T00:14:23.433883Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-07T00:14:14.364053Z","title":"Bommasani, D","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:14.364053Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:b314c648400c0fa6ad520c9faad0f6e19dcddd7b261f0526f05e469d8a11b917","observation_id":"d225046a-aee3-4a5e-9e68-107bce859a6e","resolution":{"observed_at":"2026-08-07T00:14:14.364053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:23.162452Z","title":"Firoozi, J","venue":null,"work_id":"52839d79-60ca-4483-81be-0107fa8e9e3f","year":2023},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:14.445807Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:43314ec4506cc2a287b10385482eceab0be677c2644ca31dd1bbb800d3d03e6c","observation_id":"55a3eb69-aeb8-4d71-9b5b-13826ffd5869","resolution":{"observed_at":"2026-08-07T00:14:23.242921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10220","last_updated":"2025-03-07T05:09:28Z","snapshot_observed_at":"2026-07-06T18:00:44.208590Z","submitted_at":"2024-04-16T02:01:56Z","title":"Closed-Loop Open-Vocabulary Mobile Manipulation with GPT-4V","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10220","snapshot_observed_at":"2026-08-07T00:14:14.515444Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:14.515444Z"},"links":{"cited_paper":"/paper/2404.10220","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:ac00981b12d91e32665a6c018ed5474e600c36af52408b0ccc45f8a801b1f36d","observation_id":"2c4465f5-69e6-4ce1-be75-a69803ac589d","resolution":{"observed_at":"2026-08-07T00:14:14.515444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:23.005095Z","title":"Liang, W","venue":null,"work_id":"5bf028f9-a467-404d-a90c-b7aa305be81c","year":2023},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:14.593656Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:9d580935d84a013b9fe3ce9aa7adffd04d1a15e142035e915160240817934912","observation_id":"98d2f5bf-1645-43a8-acb0-5485b1fa64f0","resolution":{"observed_at":"2026-08-07T00:14:23.079982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:22.863905Z","title":null,"venue":null,"work_id":"11d92023-0f12-4e95-b604-7e93dc8d0a64","year":2023},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:14.680078Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:de8b7d6dbae367e8c8d9191acacfab787e566e344d1035daf9d1692f2439a010","observation_id":"63c742b8-eef4-4a0f-a597-9a49241f1269","resolution":{"observed_at":"2026-08-07T00:14:22.930342Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:22.717212Z","title":null,"venue":null,"work_id":"e2917cbb-2eb0-4803-a4fd-988990058df7","year":2022},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:14.773829Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:926e1f351eef9fb1b31c3e3288c7032a163622bdd09dd05d8bd4cd2089d447f1","observation_id":"28690d43-2602-4282-a121-372eddc9bb9f","resolution":{"observed_at":"2026-08-07T00:14:22.791793Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05608","last_updated":"2022-07-12T15:20:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-12T15:20:48Z","title":"Inner Monologue: Embodied Reasoning through Planning with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05608","snapshot_observed_at":"2026-08-07T00:14:14.842361Z","title":"Huang, F","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:14.842361Z"},"links":{"cited_paper":"/paper/2207.05608","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:9872fa66c4271c448176e78b9193841842ba5411e4796544a07034ad8d29d547","observation_id":"32777cad-8309-43a7-ae25-6b482e5e9010","resolution":{"observed_at":"2026-08-07T00:14:14.842361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:22.525984Z","title":"Zhang and H","venue":null,"work_id":"16b2687f-36d7-4c16-9b79-524378a8aaa6","year":2023},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:14.923798Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:97abcdcaaa2e6a88fa0be82591883d77f6af658daae26d6f5a7bf75dec4efdd0","observation_id":"4028948c-f532-467e-8c14-aa9432ecc9a6","resolution":{"observed_at":"2026-08-07T00:14:22.609304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01928","last_updated":"2023-09-04T16:06:48Z","snapshot_observed_at":"2026-08-04T18:40:25.819787Z","submitted_at":"2023-07-04T21:25:12Z","title":"Robots That Ask For Help: Uncertainty Alignment for Large Language Model Planners","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01928","snapshot_observed_at":"2026-08-07T00:14:14.982236Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:14.982236Z"},"links":{"cited_paper":"/paper/2307.01928","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:50cabedba6d87c395af11c84eb09fab88e0ac01c13ff4bdb84bafc5bec9031d8","observation_id":"91787b78-b3eb-4c9f-84b1-9d1ae1e5094c","resolution":{"observed_at":"2026-08-07T00:14:14.982236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:22.331665Z","title":"Chang, S","venue":null,"work_id":"7c972065-aa24-4340-98bf-175dcce8b92c","year":2023},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:15.054367Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:183490389789460e8137969b814cb316348c6eec5220fb08abbe799088e40637","observation_id":"bfd6471d-aa01-4ed0-9f3d-5c17548c54f6","resolution":{"observed_at":"2026-08-07T00:14:22.425938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:22.111275Z","title":"Chang, S","venue":null,"work_id":"489433b2-5dc9-4844-b7ce-645e5288c1f6","year":2023},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:15.127582Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:25b0bed245892030f9710e86c4b2556fb8b6f6990ca2bc076afa8655f049d530","observation_id":"bc1c867d-f433-4528-ac2e-daee3410d1b4","resolution":{"observed_at":"2026-08-07T00:14:22.195887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17274","last_updated":"2022-06-03T17:52:04Z","snapshot_observed_at":"2026-07-06T12:55:27.843060Z","submitted_at":"2022-03-31T17:59:30Z","title":"Exploring Visual Prompts for Adapting Large-Scale Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17274","snapshot_observed_at":"2026-08-07T00:14:15.210742Z","title":"Bahng, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:15.210742Z"},"links":{"cited_paper":"/paper/2203.17274","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:591ff22680991832a4ffe19001322d0b4256e4e45c71424527fcfe286b975fe3","observation_id":"f059a6d5-a6e6-4e84-a65e-8b9f95e79385","resolution":{"observed_at":"2026-08-07T00:14:15.210742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07872","last_updated":"2024-02-12T18:33:47Z","snapshot_observed_at":"2026-08-02T06:03:03.152035Z","submitted_at":"2024-02-12T18:33:47Z","title":"PIVOT: Iterative Visual Prompting Elicits Actionable Knowledge for VLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07872","snapshot_observed_at":"2026-08-07T00:14:15.277552Z","title":"Nasiriany, F","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:15.277552Z"},"links":{"cited_paper":"/paper/2402.07872","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:2eccfd84f1ea1d66df565abf301866659ceb92cb00d1ff24699f790b80a62b2b","observation_id":"facb93a0-e113-4668-a409-e49abe72a247","resolution":{"observed_at":"2026-08-07T00:14:15.277552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11441","last_updated":"2023-11-06T07:39:49Z","snapshot_observed_at":"2026-08-04T03:29:49.409446Z","submitted_at":"2023-10-17T17:51:31Z","title":"Set-of-Mark Prompting Unleashes Extraordinary Visual Grounding in GPT-4V","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11441","snapshot_observed_at":"2026-08-07T00:14:15.347301Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:15.347301Z"},"links":{"cited_paper":"/paper/2310.11441","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:c8d5671cf7d493f41d19afcd06769b2ce633bb3223e8ef73ed358a3884595d48","observation_id":"e2547a5a-7d0e-4163-915d-e15c71820b1e","resolution":{"observed_at":"2026-08-07T00:14:15.347301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:21.958176Z","title":"NASA-TLX — Wikipedia, The Free Encyclopedia, 2025","venue":null,"work_id":"35b431a7-4f00-439f-820d-4d31374c1c9c","year":2025},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:15.417432Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:74207d534bd1a86a5a555b67b7b197356bbc6d20ad563e68aef10a82a369e47b","observation_id":"66454774-c8c9-415b-ae3d-48baf91708de","resolution":{"observed_at":"2026-08-07T00:14:22.044812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:21.808917Z","title":"Grannen, S","venue":null,"work_id":"1c60d1e5-d42a-4ac1-814d-8bd96b408269","year":2024},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:15.511218Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:2b25e7b105f8b7885f3d9a37cd724984efb8f965e7b7a1a627e5d5f987ed8ef1","observation_id":"5c1f882b-60f9-49d1-be48-bf8be952f3e9","resolution":{"observed_at":"2026-08-07T00:14:21.875599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:21.623625Z","title":"Parakh, A","venue":null,"work_id":"74cc5af3-a994-40d1-9e5a-3f0ddc8f9028","year":2024},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:15.617444Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:440ef84400b1e2c61bfed6df4fe44a787babb594f4276ca68bdb559f34a6d865","observation_id":"0b72f248-266d-4814-affc-fae4d38c5249","resolution":{"observed_at":"2026-08-07T00:14:21.715439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:21.445305Z","title":null,"venue":null,"work_id":"1e9511fe-1aae-4409-8dea-eef2f965649e","year":2023},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:15.690425Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:706475586c683ad3e4d4cccc12593ae3bd8df270a61e2472f90ca3148e63194f","observation_id":"c36093b1-937d-4dc2-bc06-fe7d7cb8dd44","resolution":{"observed_at":"2026-08-07T00:14:21.528692Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.02058","last_updated":"2024-11-23T06:28:06Z","snapshot_observed_at":"2026-07-06T16:42:48.073439Z","submitted_at":"2023-11-03T17:38:35Z","title":"LOTUS: Continual Imitation Learning for Robot Manipulation Through Unsupervised Skill Discovery","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.02058","snapshot_observed_at":"2026-08-07T00:14:15.758187Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:15.758187Z"},"links":{"cited_paper":"/paper/2311.02058","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:710acc21e92e37ded129f770b2601236f6174c70a6c82002031658cbf287fbdf","observation_id":"54a61c61-6213-4c71-8ba3-fb37058ea135","resolution":{"observed_at":"2026-08-07T00:14:15.758187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:15.822858Z","title":"Mahadevan, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:15.822858Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:7a5e01dae909cdcaa154efe155a84dca249bbafbdab1abb510fd0f18a9e83831","observation_id":"fa94ca2a-425e-46ca-b5ce-793aecbcb4a5","resolution":{"observed_at":"2026-08-07T00:14:15.822858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:21.289915Z","title":null,"venue":null,"work_id":"4018e69b-6562-418a-832e-3085e7811feb","year":2024},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:15.893650Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:dfb13d1c9d2b523607feda78242fe3f3df3e874c344f2415d0631f57c4f45e07","observation_id":"32ffb249-48ab-445a-9c4e-fa577f9f832f","resolution":{"observed_at":"2026-08-07T00:14:21.372116Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-07-06T15:00:58.804337Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-07T00:14:15.963747Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:15.963747Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:e71794921d9114bbb023643751a487f7626868dcd0fae896a5feaa2d9155f93e","observation_id":"7ce2dc97-b02a-4356-8a10-8227ae4bd65b","resolution":{"observed_at":"2026-08-07T00:14:15.963747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:21.093270Z","title":"Note: - The robot can only manipulate objects that are within 0.7 meters of the robot","venue":null,"work_id":"0881f6a0-cb4f-45d3-be91-afa63b8e1476","year":null},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:16.022056Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:b58f1d263f50d7b80d1389805b294bd6170e8d11e0c55c5f3d2a88c7a3d92aba","observation_id":"7e39f755-eb17-47cd-bffb-396da22dc637","resolution":{"observed_at":"2026-08-07T00:14:21.183395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:20.907209Z","title":"The images are taken from the camera on a mobile robot that is moving its base","venue":null,"work_id":"b10d5a1d-7064-4565-aa4d-444702498cd8","year":null},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:16.112698Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:0d6674262308a6da445ced8598214be8fbd34e54104f2169c951a7419917c918","observation_id":"9d6cdecd-0c46-4a73-8832-6e61a15a818f","resolution":{"observed_at":"2026-08-07T00:14:20.984077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:20.714147Z","title":null,"venue":null,"work_id":"502a0611-a62d-483c-bb5c-c9734cff2f24","year":null},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:16.181559Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:80dfe77ce60ade2c4396677c354ee843849f1356f2f48b9aebf0fecb0e1bc534","observation_id":"005dd361-ff5a-454b-b395-c1b091bcff51","resolution":{"observed_at":"2026-08-07T00:14:20.806527Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:20.541446Z","title":"17 If the robot gripper is moving, see where the gripper (as masked in the image) is moving towards based on the green arrow, and use that to determine the task choice option","venue":null,"work_id":"e5989df8-a26e-4e04-86d6-091802f362a8","year":null},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:16.250079Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:0f8f920d1b51b37b93354bee49912217b5e2832046955e5214b3b924743a089d","observation_id":"0ecf1e43-8a67-4383-952b-4f26fdf4ee8c","resolution":{"observed_at":"2026-08-07T00:14:20.610507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:20.374821Z","title":"Finally, answer: What is the robot trying to do? Choose from the list of possible task choices","venue":null,"work_id":"34f2c177-6f09-4e41-985e-8555f3771b03","year":null},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:16.331225Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:4acb01d5151dfa756a8ef3c4c1a501e61ccc5df07e638b055585c75d75520ea7","observation_id":"2fc57bc5-0e8a-4fac-b83a-fdefb9aa8418","resolution":{"observed_at":"2026-08-07T00:14:20.459890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:20.202112Z","title":"assist helpfully","venue":null,"work_id":"458893fe-c4c5-4532-a5f1-c23cdef07f08","year":null},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:16.399251Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:9b507f89da972bde347174e3b927cc01f2ab4b0e9cf0b1f76921caa004e555ef","observation_id":"6ea1b072-2473-4ba7-85d7-2aee9492e6b8","resolution":{"observed_at":"2026-08-07T00:14:20.281210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:20.008367Z","title":"I need to do all the control work by myself for [Full Teleop]","venue":null,"work_id":"1315c11d-0ccf-4051-97f4-41e1095428ad","year":null},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:16.466156Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:14c5901d2c3bbbd42e77325e6a345d1a5f3be259ae243a95c97b611d63689e22","observation_id":"0259ba71-2ba2-4a1a-b7b3-181bcc22455b","resolution":{"observed_at":"2026-08-07T00:14:20.094719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:19.843488Z","title":"was a bit alarming","venue":null,"work_id":"3be6e2c7-dd4a-4d6d-817f-e7eb69cd8d48","year":null},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:16.561940Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:4a753c264e8eb4c672e7f5c1f8e0f0dd919c4e2cc5b0db6640e6f064864f91ba","observation_id":"4b375302-89d0-48f3-92eb-2bec5a694f6c","resolution":{"observed_at":"2026-08-07T00:14:19.923000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:19.652198Z","title":"The inferred intent is always wrong, and the control over the robot actions are always weird and potentially have security issues ... Would it accelerate towards me and hit me?","venue":null,"work_id":"1b4476b0-fcbc-4474-8b5f-ff7fe9bfcacd","year":null},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:16.629930Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:1e9fda84f4357cf7917a5e83d9e4dbc0f957535edefaabf84bcaaae2e75c2758","observation_id":"4203c060-0040-4b3d-8f9b-c8380c697988","resolution":{"observed_at":"2026-08-07T00:14:19.766417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:19.491114Z","title":"Although the robot knew what I was going to do, it sometimes failed in finishing the task and led to a state where it was harder to control the robot","venue":null,"work_id":"ac09f662-ce09-4963-8c0e-f6c90a22424f","year":null},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:16.696603Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:9e35ed2e6bedcbe1618d318960da9f3b179bc4f24ec9acde433ce681ce2c5312","observation_id":"4e5ff511-a57a-4611-b6e6-e6b46b491a00","resolution":{"observed_at":"2026-08-07T00:14:19.571442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:19.322061Z","title":"It was a bit slow while I was in control","venue":null,"work_id":"bd5b5dce-6b1c-479f-8b52-bb53e83f0957","year":null},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:16.767481Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:4feac6356e7c89c588f840b0c4fb4e597345cda9afd056b9762f9cd30e7e528c","observation_id":"3fbec4da-eeca-4719-9317-73eaa370623e","resolution":{"observed_at":"2026-08-07T00:14:19.423774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:14:26.729872Z","title":"URL https://proceedings.mlr.press/v164/ karamcheti22a.html","venue":null,"work_id":"f770ed28-1ba0-4f7f-9f06-88738b24d018","year":2022},"citing_paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models","version":2},"reference_index":1390,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:10.819107Z"},"links":{"citing_paper":"/paper/2506.14727"},"observation_digest":"sha256:e8c20ff7c23991ef0c9287928c9d3d449723a906143c64184fda830323932f24","observation_id":"b3d13226-7f76-4e04-b752-4cc1fa3420bc","resolution":{"observed_at":"2026-08-07T00:14:26.854318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.14727","last_updated":"2025-07-04T20:27:52Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-07T00:07:50.493263Z","submitted_at":"2025-06-17T17:06:43Z","title":"Casper: Inferring Diverse Intents for Assistive Teleoperation with Vision Language Models"},"reference_resolution":{"displayed":85,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":48,"verified_exact":8,"verified_fuzzy":28},"total_outbound_references":85},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 85 of 85 outbound references and 3 inbound Pith citation observations for arXiv:2506.14727."}