{"as_of":"2026-08-07T13:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:42b98f18a50ba456fb71621a6b1b05a9ff5c4391fae3259368feea20a581a009","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T05:11:57.092685Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.11498/citation-record","integrity":"/paper/2607.11498/integrity","json":"/paper/2607.11498/citation-record.json","paper":"/paper/2607.11498"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":"Zitkovich et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:d9ebb3ed367fcb40bb4b267885fbc8cc53b308ff176b9e7a9fbca09c569ff472","observation_id":"a3c3b54e-0fe3-440c-8d73-339bef2185ea","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:418ef280ef9467ce61589ccfe14640f51b2ae1ba5e729b78916a136b65af7d21","observation_id":"c24dc617-bd4b-4275-aa78-819bb16ec0dd","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":"Black et al.π 0 : A vision-language-action flow model for general robot control.arXiv preprint arXiv:2410.24164, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:a68ccdfa9b847976c2edaa3222136779e751f1e50c37bf34b186d455903dfbfe","observation_id":"f9b993c6-3093-4bcc-aebc-a356f35427c4","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":"Black, N","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:4cf98180755a803680640c44e0b90ba9cfb94bcc5769f539e94b261c7ae47be1","observation_id":"e23bdc21-79f0-40a9-afea-5f6265aefcc3","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":"Bjorck et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:500932bde8846638d0287a1193214aee50cf679289550f98322b89a88263ba3d","observation_id":"25abef0b-aeaa-4a95-bcfb-eb8b77096a52","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":"O’Neill et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:e47edb3b4662675f4bae812867c0dffabe34aea86f73d0c926ef5a0244d34bf7","observation_id":"3d8340ae-032f-4399-8213-32c95421c27b","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":"Bu et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:2562a93ddcc31885aad9b3d579b19d8bf3d4eeafd9bf03da24545cabd48f9bd7","observation_id":"1215509c-0216-4905-bb3d-c70d7be83602","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12945","last_updated":"2025-04-22T17:57:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-19T17:48:38Z","title":"DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12945","snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":"Khazatsky et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"cited_paper":"/paper/2403.12945","citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:b5e0d3390091a1beaecf123b1736867379bc6cb77f2b95497c61dd1df8ba4eb1","observation_id":"2c6f86c0-e124-48f0-a080-ef2b77426c6f","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":"Nasiriany, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:5bff6ea852c854d85000b701e4cbb342b51d78cac1066c3de725c1101c78dab4","observation_id":"85d2a9c9-1de6-4fdd-9ed3-49d0585c3081","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.13626","last_updated":"2025-12-26T12:19:56Z","snapshot_observed_at":"2026-07-06T22:32:42.381894Z","submitted_at":"2025-10-15T14:51:36Z","title":"LIBERO-Plus: In-depth Robustness Analysis of Vision-Language-Action Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.13626","snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"cited_paper":"/paper/2510.13626","citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:15d01e4886253c66fb716180adc5a49b0e59ef3d802d5b7c8c12d08194daa2c3","observation_id":"120a58ad-bed3-4d7d-b381-0366d8b66637","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:a407689f061e0e3f4beb01cd6c51d0f42daebe082afd4cd4a09f6feecbc50f7b","observation_id":"a5b99080-504c-410b-8425-912d534c7381","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":"URLhttps://doi.org/10.1145/3729343","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:7637f36a4a98ae05079acc480953982736008cea110c0984cb17fe36b3d6a563","observation_id":"0dc0d555-7885-4de7-aaff-56eaf165aa26","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":"Walke, K","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:e0dd343360a83741fc99963c35083d0dbd175738724495ddbb0fa5a74dd156e0","observation_id":"21c81181-9ae9-438c-9d8c-d6ca9f460aed","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:76bc439b626a1be4180c69f93216286b4d13ea4f1c9305484529d0f9bf6144d2","observation_id":"14c5c8f3-4e9e-4b2f-8d1c-0f6fe8cf399b","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.27759","last_updated":"2026-05-26T23:17:39Z","snapshot_observed_at":"2026-07-06T23:37:27.309837Z","submitted_at":"2026-05-26T23:17:39Z","title":"Colosseum V2: Benchmarking Generalization for Vision Language Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.27759","snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":"Morgan, P","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"cited_paper":"/paper/2605.27759","citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:c3b85222f2bc26f93bb4acfc3241d9797fc421772f7e2c65f22ed3b0eb4a3ac1","observation_id":"9fc87436-d7ab-4b77-bd4e-777affaf6790","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:e917fac85018a63789a105fa8086297dca5ba8880f7c83896bd5f8c0f7df9736","observation_id":"1d5e81b9-805a-4528-9887-559d93cdf810","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":"Jiang, J","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:fb3e8c2edd63c6184dd3a54f3a7144c0ff1f08c84a98a225128556c031a9d612","observation_id":"906650d3-91c4-42e8-bfe4-ac901654a331","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":"Zhang, Y","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:b0a4c7911bdcf0122187a15bd6106e8f995fe2ea7a4434e8ebf33d4f3c024a5f","observation_id":"d95a6ff3-6617-480a-8724-27b4227fd17d","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15830","last_updated":"2025-05-19T02:40:18Z","snapshot_observed_at":"2026-07-06T20:26:31.558337Z","submitted_at":"2025-01-27T07:34:33Z","title":"SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15830","snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"cited_paper":"/paper/2501.15830","citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:3eb660e79764809e39d30fb6ce140f0b9b06eef6ffd8faab48344e084e06d46e","observation_id":"468af12a-baff-4aca-8403-f022a35adb90","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":"Zhang, H","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:7ec4b5d6726f56139f66010637a1535659ca526f8f2d852da1db47d74930a205","observation_id":"8c53f4c3-f13c-45cf-b4ac-7570cc9c3f56","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:a2b5dfc33fb826fe6a83d989972445eeaa07d5dabb4df5ea33122c3bee614394","observation_id":"087c2aa2-f832-4a1a-9d98-6160285a53f3","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:27c3db199b91ceb43882034976beab37946c69aa36b3f3f40727901996770522","observation_id":"d438cde4-df7f-44c3-bd41-4f8c480688ca","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:1b2c6c2e2522b9343de133ec7f981819c70fdfef53f5584deb507d999dfbc744","observation_id":"a6ecae22-1a4d-45fe-97ca-c0d3a2c3bbed","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:4e988cf9f6d60aa7dd9e8aee6cedabbf71c812bdaacece2527ddf49302f33e5b","observation_id":"21c43583-d784-4638-95de-0fa5b46d2c8e","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18977","last_updated":"2024-09-12T03:24:58Z","snapshot_observed_at":"2026-07-06T18:37:47.471616Z","submitted_at":"2024-06-27T08:13:33Z","title":"RoboUniView: Visual-Language Model with Unified View Representation for Robotic Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18977","snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"cited_paper":"/paper/2406.18977","citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:e30eae53c7c81a31453c3fc99d2da2d898d05f97fa6dc329e559cbd2f3f8e06b","observation_id":"f224d7ca-3f47-4b48-a66e-c3283211afe9","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":"Wilcox, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:afd24e92bb9f0fbbe75299a1d4585f5dff791cdec2f7eb4c93f4a738c9bc57ea","observation_id":"b5b3e22f-8e72-4428-8fb8-cb7e60480cdd","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09071","last_updated":"2025-08-13T16:47:50Z","snapshot_observed_at":"2026-08-07T01:01:25.526564Z","submitted_at":"2025-08-12T16:46:05Z","title":"GeoVLA: Empowering 3D Representations in Vision-Language-Action Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.09071","snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"cited_paper":"/paper/2508.09071","citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:39c25de41f5118741a46b43b6b4d6dc5980f4614d173330a5c849f715cffe859","observation_id":"f7dcc86c-a1b0-4b2b-a6fb-29884bb9807e","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:03dc5416b3ed88f1a4c9acce210d6554e75832e640b8f783ed3fc608896f0c5c","observation_id":"3cd48cf8-f562-42b0-8a90-3800e6ad4aab","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":"Bhat, Y .-H","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:dfc844fb96db176662364ac626ddfa1972b2bb69ba4f8d05aad33ecffd5c2216","observation_id":"4ae199eb-1ca8-4f24-a103-2368deda2c30","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:7905cf592b0d4ec1e81cc86d735aca2371d69a370248f086fb5d721cb1fa30b4","observation_id":"5c41b934-3f88-4e3d-9746-6ad962712ca8","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.00807","last_updated":"2026-05-14T15:06:31Z","snapshot_observed_at":"2026-07-06T22:43:55.785732Z","submitted_at":"2026-01-31T16:34:52Z","title":"Any3D-VLA: Enhancing VLA Robustness via Diverse Point Clouds","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.00807","snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"cited_paper":"/paper/2602.00807","citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:ea4ec6c363c4dd4731322ed4f7da77b236253398c8afd6bc37689cf69854f91e","observation_id":"9ea4da0e-2264-4042-9195-39f59cf1f6a8","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.21414","last_updated":"2026-05-20T17:10:31Z","snapshot_observed_at":"2026-07-06T23:31:51.443407Z","submitted_at":"2026-05-20T17:10:31Z","title":"PointACT: Vision-Language-Action Models with Multi-Scale Point-Action Interaction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.21414","snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"cited_paper":"/paper/2605.21414","citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:b588eefaa1fd060a0d55618459f7d5f2d06d9276ddda896f81293a5dfdce7417","observation_id":"a87680da-e9e3-48f4-8333-3eb72b90759f","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:6fe73c90a2525e5a031ddd5dad433905b8f444975d1fc37aef07c5e409891819","observation_id":"edf03f8a-c592-405c-9205-015045c3d353","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":"Singh, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:fc98b35de0ffd21dbc2e310c0e13c5883c466e2fb551a5a794ab05cb3dcdbe8a","observation_id":"849f3db1-14c9-4ec3-8462-aadd07168f6c","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:f0906c63fd4b20fb335ca125ded106f454a4faef9d69f741c89936ca0ba99bf9","observation_id":"fd5200ad-79fa-499b-8782-4da5b95fee43","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:13c05c768d7d25c83949d3491e47eb2c9ef7f8feb5c9aa85d622ab9c734fa88d","observation_id":"9525cb8b-9eaf-4452-9f4d-700f5ea66c41","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:455f2fc6e27eb24ff89ff034e300f139b27aacaef66fcfe7481488fa0f4be057","observation_id":"9a54de51-fc4b-4d02-b7ce-af290a760e31","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:50fbe534e553db7d3c115af80dee164d6789ef65fc48ff9c1f68b62563ba2fdd","observation_id":"15ca4f1b-c3a8-4a36-992d-e6c760ba2e75","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":"Leroy, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:7290738895ea0e2d3994a9305e6e4ead251c35cea9de155e596599a20cab1ed4","observation_id":"b60f8644-1e23-47e1-833a-427b35a3e3f5","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:fcb34878e1d7c0ed545c3b25e51f18e4f38787516d4d3934f6dc48e16966943c","observation_id":"11d1b02d-852a-4d69-a9b3-143253af6a2c","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:3b3205d1c7181c9fa6a8902a487a9da1daa3f627ba9a4629f65a341cfc9a6b0d","observation_id":"795791bd-7118-4440-82d6-423a417f7332","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:348c24e1fa1bfe79967342c916263c912c31ed2609645ceed2472559b7df31fb","observation_id":"9b664346-4d3b-4c28-9429-305fc3336344","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":"Wang*, Y","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:230dfa317534245a6c2244ffaab38c5fc9e763b95e80e36f63790cd5138e4646","observation_id":"c989fcda-f6c5-4342-a4d2-531fe3cc1b84","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:743b37b33aef8e02ec854dbb57a1f14e7109bd5964341c9d93139f3373dc71b7","observation_id":"855eeceb-487b-4d43-894c-b6b46187c61f","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:a8cbecc2986c3a08d0e3e3e8d79e5c697e49c6dd681ae353e2b9da9c4d4d364d","observation_id":"60120bef-3537-463f-a619-bed90363be22","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:8cb819cf22e822275632a0185484f01f43ec38ed653c814483059bdbc529be76","observation_id":"88fc0097-e437-4061-8337-4be334f7daeb","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:b3d6fdbecbf9a95a8913e59101a7550125ae9bbd3803f6210171dead0d1d0889","observation_id":"be18e89d-a06e-4f10-bb18-15f43bf7e555","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07726","last_updated":"2024-10-10T17:28:23Z","snapshot_observed_at":"2026-08-05T10:06:10.880743Z","submitted_at":"2024-07-10T14:57:46Z","title":"PaliGemma: A versatile 3B VLM for transfer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07726","snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":"Beyer et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"cited_paper":"/paper/2407.07726","citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:ebc33b5e343884b16e96d01021913b360d7781ebeb83f956e32ecf5fcc776fdd","observation_id":"5be7f2e0-acc1-497e-9cb4-b6c07f1e5d25","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:da4e4e7c76de5d466f601e01cab927aa4d3ea1e6c4ec9944362285f3b5bb1b99","observation_id":"2fedeb3d-e4c2-4621-bfbe-ee7e5a87e98e","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:04070c3515e4dfc6e285972caf2ab67c2b07a98a8b27a5e7308231e2850e1fdd","observation_id":"aa9052bb-d0b6-4fa6-b7ef-05e5d22d7d95","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:73b6e7f9bf453316a25bfa6fc1c6bad3a4925191fed272b750bdcd0ee2eaf30d","observation_id":"152dbe22-88cb-415d-bc43-2f0c8ecf3f88","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:15cc910c0e2763f62c60a1cefea324cad46059ab97282858825a8738eae315b9","observation_id":"ff0bf2cc-277c-40f5-975e-3bc5bef913ef","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":"Zhang, Z","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:efe1bd1d98f3f189dd4944c4ddc66f2c5ca93ba91afa328947077e1aee136f79","observation_id":"40a63fa2-c794-488c-9956-80c385e19326","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01844","last_updated":"2025-06-02T16:30:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-02T16:30:19Z","title":"SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01844","snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":"Shukor, D","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"cited_paper":"/paper/2506.01844","citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:a5f16cfb77684b4888b44c5e25dbceba689ffa9c92a582ac343fb7f9498d0d26","observation_id":"83d3defa-cf68-42f3-84b3-9bf07850a3be","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:cd5896d0aebcfd24fc1f332bc04c5337c54e6071b3efb0e8b6bd31019a05ba5c","observation_id":"8d0eee6e-a756-4a07-855f-84ae4410f0c3","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08950","last_updated":"2025-03-11T23:01:08Z","snapshot_observed_at":"2026-08-06T07:28:42.627611Z","submitted_at":"2025-03-11T23:01:08Z","title":"FP3: A 3D Foundation Policy for Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08950","snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":"8, 18, 20","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"cited_paper":"/paper/2503.08950","citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:46bcf85f1007cd06ba02d575999c3c965cbf42d53682fc80f85ea14cc08b7bef","observation_id":"1b32a608-1a5f-497e-b6ef-1ff94ac9423c","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:4333d3f03ab308187de5ce72c6909e1f0017f00c5abbf5ceeda511e7add2e940","observation_id":"82fb9302-5a29-4438-8799-89d4aa821d28","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T05:11:57.092685Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-14T05:11:57.092685Z"},"links":{"citing_paper":"/paper/2607.11498"},"observation_digest":"sha256:1d0085bd9d82526d53bb73fb52dc60b79fc0fc067a242555cae54483dc3ddd36","observation_id":"3a45a623-fdee-4a6f-81b0-f9e897f9ee73","resolution":{"observed_at":"2026-07-14T05:11:57.092685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.11498","last_updated":"2026-07-13T12:50:32Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-06T19:17:49.055959Z","submitted_at":"2026-07-13T12:50:32Z","title":"See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":58,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 0 inbound Pith citation observations for arXiv:2607.11498."}