{"as_of":"2026-08-05T01:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c4e9d00d73d7d9b4ab715ba2279988bd082cfa9daca93413aa22d8d6d3e23e8d","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T23:17:23.965554Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-02T11:11:39.584755Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-02T11:16:52.691444Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"cited_work":{"arxiv_id":"2605.31196","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.31196","snapshot_observed_at":"2026-07-02T11:16:52.691444Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","venue":"cs.CV","work_id":"a52a8dc7-7c03-4690-92d8-69284104ae5c","year":2026},"citing_paper":{"arxiv_id":"2607.01088","last_updated":"2026-07-01T15:45:08Z","snapshot_observed_at":"2026-08-02T11:41:51.446909Z","submitted_at":"2026-07-01T15:45:08Z","title":"ROSA: A Robotics Foundation Model Serving System for Robot Factories","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-02T11:11:39.584755Z"},"links":{"cited_paper":"/paper/2605.31196","citing_paper":"/paper/2607.01088"},"observation_digest":"sha256:13f594a220c065a564579e70feb0d00d3955da3af29828720773e9e5b8f58692","observation_id":"5013aea9-dbfa-4bd6-a2fb-5b342f404f53","resolution":{"observed_at":"2026-07-02T11:16:52.692873Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2605.31196/citation-record","integrity":"/paper/2605.31196/integrity","json":"/paper/2605.31196/citation-record.json","paper":"/paper/2605.31196"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:6d99a1f1f017c99b7d2d4801d279016dfb537ab09c25215b869796897b795e17","observation_id":"afc93be0-aec5-4324-b4dc-0ed66cee216c","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:a6c3ea5bb09da1db3c62ac18ba884620ed2793121ecb9cb29ba46c72e97ce505","observation_id":"55c912e3-b36a-43c4-b0f6-01fcf8aea47d","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.20644","last_updated":"2026-07-09T17:59:10Z","snapshot_observed_at":"2026-08-03T20:15:29.231318Z","submitted_at":"2025-11-25T18:59:02Z","title":"Vision-Language Memory for Spatial Reasoning","version":2},"cited_work":{"arxiv_id":"2511.20644","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2511.20644","snapshot_observed_at":"2026-07-10T02:19:33.841733Z","title":"Vision-language memory for spatial reasoning","venue":null,"work_id":"47fbcf3b-b919-4ee8-b354-f7f2676ede8b","year":2025},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"cited_paper":"/paper/2511.20644","citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:dba96a7733f2d53c606e6a80413f1b89eba12027016c08dcd6155038bf6689d2","observation_id":"34ac189a-f244-449a-ac58-39c17812b5d6","resolution":{"observed_at":"2026-07-10T02:19:33.841733Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":"ISO 10218-1:2011 Robots and robotic devices – Safety requirements for industrial robots – Part 1: Robots, 2011","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:de94a5bb33fd74a14c8e0f95f8e9d186831ec44528d8b67fbbfd18aa6b55df06","observation_id":"d49de948-0886-4f70-b526-a95930310974","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":"ISO/TS 15066:2016 Robots and robotic devices – Collaborative robots, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:7b72c6f622b4f523e17859763e4d1d6d833415fc1247374bfb295d8478213047","observation_id":"1699ffb0-3757-4259-a20a-ef72718746ca","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":"Sermanet, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:c07e65f30675ccdfbac3f4aa70a150e4499f31db3427414fa91f8ffe2e7e3425","observation_id":"fd936aa8-6ad2-47da-8de1-601ba493d8e6","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.21651","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T02:56:29.051254Z","title":"Can AI perceive physical danger and intervene?","venue":null,"work_id":"5b6227a0-f0cb-4dad-8e5c-83f565aaa905","year":2025},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:4389181dc6e7597bdde36d70a16ce32b6893fa593ab72cb9125ffd27b329d0ac","observation_id":"15e072d3-4ac1-4831-bfbb-0dec2233ec14","resolution":{"observed_at":"2026-06-28T23:22:47.361172Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":"Sultani, C","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:0e41480703c203d6237f61b84fc39482b2df9aeec79ea0a7bd215763eea6fe95","observation_id":"723787e6-f279-46ce-81a0-72816bbd490b","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":"Zanella, W","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:4f3b6ed2e2cdf458f26137358be5269547137a7d3679d75d64d39f2dc84158aa","observation_id":"8a9974da-7d86-4aee-b2ae-abf97a06b49b","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"cited_work":{"arxiv_id":"2510.17801","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.17801","snapshot_observed_at":"2026-07-07T03:18:10.074313Z","title":"Robobench: A com- prehensive evaluation benchmark for multimodal large language models as embodied brain","venue":null,"work_id":"69e91bbc-a8c0-4c65-b917-43f5f097f0a9","year":2025},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"cited_paper":"/paper/2510.17801","citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:c92f2060af2701e318698ebef263eb58e18269d80ae16d30a262a45b9c66397a","observation_id":"a8abd85b-21ab-4888-b00b-50d8bb0e32f2","resolution":{"observed_at":"2026-07-07T03:18:10.074313Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:0a5063d9c5623f358269b621220c79173f4881805749862ab5d579e23c53d0dd","observation_id":"12a309eb-1bcb-42dc-8c67-168dc2c40d07","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:9c89086a567597bfdf937ea574c4b1ac7594be64d41065dc69f2d2f1b271be89","observation_id":"dd85a5c1-4a4a-47fb-85ff-2978a9bc795e","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05474","last_updated":"2022-08-26T17:12:17Z","snapshot_observed_at":"2026-07-06T06:14:28.435222Z","submitted_at":"2017-12-14T23:17:24Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","version":4},"cited_work":{"arxiv_id":"1712.05474","doi":"10.48550/arxiv.1712.05474","metadata_source":"pith","pith_arxiv_id":"1712.05474","snapshot_observed_at":"2026-07-11T02:27:48.710404Z","title":"AI2-THOR: An Interactive 3D Environment for Visual AI","venue":"cs.CV","work_id":"9c86ed28-ea70-424c-bd56-34f59dcad861","year":2017},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"cited_paper":"/paper/1712.05474","citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:7ab2dc53d610e08eb4758b4088bf0e5e4d7f6e783ad4f0ebf94529312ca46ac3","observation_id":"30d1f9f7-04a5-4902-adb3-2daf209dcc8a","resolution":{"observed_at":"2026-06-28T23:22:47.359170Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:8e21fdf5549e549d558428f33aeec955ee35ecd4143bcd817d57a1b850cbcabc","observation_id":"9fa94be5-20c6-4583-b1e5-6150afacbf22","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:8fc9ae0f83cabaeff5d741b1a138b07ecab5acbe63b5dd0d6175a7b02bfe8b5f","observation_id":"c0466990-f300-4ba2-a901-40fb288e9383","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:7f481b2931f9fe076ff045af1e1fc86623910a9324aa0b9bd41dbe35cd3692ed","observation_id":"b1cc8d29-f5bc-4802-934e-f56595de46b6","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2412.13178","doi":"10.48550/arxiv.2412.13178","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"SafeAgentBench: A benchmark for safe task planning of embodied LLM agents","venue":null,"work_id":"8b30e459-3b56-42ae-b523-fb6541f40655","year":2024},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:27be2b54c21b997bec91d169da35e67a3d48fa197fb16aa6dc17bb412cc8a207","observation_id":"2f799adf-2e54-4bfb-a2e6-360e54fc1580","resolution":{"observed_at":"2026-06-28T23:22:47.361845Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:69cd42e3485b33cb324fad3f83d92c4dd5b10e462a7c06de649513024e562255","observation_id":"adc683ce-cc98-41db-85bb-90e2d1e3477c","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.14697","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T13:49:51.074751Z","title":"Agentsafe: Benchmarking the safety of embodied agents on hazardous instructions","venue":null,"work_id":"80442e4b-93fa-448a-bcb4-e8f3856cadb5","year":2025},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:9f26a688d3e8e32f501c3c466dafaf1dd5566c1700e90c901377c81450250ea0","observation_id":"b3e557fb-86b0-4a85-8ed7-9ab1f45ddf8f","resolution":{"observed_at":"2026-06-28T23:22:47.350919Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.04308","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T14:15:47.331129Z","title":"Responsiblerobotbench: Benchmarking responsible robot manipulation using multi-modal large language models","venue":null,"work_id":"2f8da541-8856-49c8-a240-9186b19560d4","year":2025},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:5cd19db77a518ec8acf0fd185c17a01d2a6429a52cbe4b959363e9709ebdf305","observation_id":"c5018350-c5f1-41fa-8b64-29d9bce339cc","resolution":{"observed_at":"2026-06-28T23:22:47.342069Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.25885","doi":"10.48550/arxiv.2509.25885","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Safemind: benchmark- ing and mitigating safety risks in embodied llm agents","venue":null,"work_id":"dfcb5a6a-35d8-4253-bb68-349d55d57057","year":2025},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:4f78f8cf2562e8d3dafb0850b0bcc351cbcdd2a19d7cbeb34b92f046f2f2b12c","observation_id":"0a99953a-a554-4999-a285-99bc4bab4bbc","resolution":{"observed_at":"2026-06-28T23:22:47.345467Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:74dcb72c4df1762dab22fafbf5568a31d4aac4e63376ce3460c472257f36281e","observation_id":"9b36122a-d605-4e4a-aca5-64e03b8b767d","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14203","last_updated":"2025-08-19T18:50:49Z","snapshot_observed_at":"2026-07-06T22:15:18.057066Z","submitted_at":"2025-08-19T18:50:49Z","title":"A Survey on Video Anomaly Detection via Deep Learning: Human, Vehicle, and Environment","version":1},"cited_work":{"arxiv_id":"2508.14203","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.14203","snapshot_observed_at":"2026-07-01T13:55:45.266202Z","title":"A survey on video anomaly detection via deep learning: Human, vehicle, and environment","venue":null,"work_id":"debafb93-ae6b-49d3-90fc-241061cb87d7","year":2025},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"cited_paper":"/paper/2508.14203","citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:ff38aa5881293436fc04500a7e48b2443f94a328ae4a29d1374a008c48ca215f","observation_id":"576e75af-93e3-432a-9e84-cbd02a73a97c","resolution":{"observed_at":"2026-06-28T23:22:47.342342Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:21b6e2313ae39a3e16c5d4cd93c133742a2044f63afb3523998e0eedb7c550e7","observation_id":"d07331f9-65d5-4f6e-a59d-8b6ef8ee205d","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12235","last_updated":"2024-06-29T08:15:27Z","snapshot_observed_at":"2026-07-06T18:32:40.207270Z","submitted_at":"2024-06-18T03:19:24Z","title":"Holmes-VAD: Towards Unbiased and Explainable Video Anomaly Detection via Multi-modal LLM","version":2},"cited_work":{"arxiv_id":"2406.12235","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.12235","snapshot_observed_at":"2026-07-01T14:25:47.040463Z","title":"Holmes-vad: Towards unbiased and explainable video anomaly detection via multi-modal llm","venue":null,"work_id":"bf8a4f0b-9fae-4b81-bad2-022df25aa058","year":2024},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"cited_paper":"/paper/2406.12235","citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:8304d8dd6c1401daef60657d524447d6d4d65746ad208c868cf9620116aae2e1","observation_id":"37471d6a-a8ee-4190-9da6-bb4d4c938387","resolution":{"observed_at":"2026-06-28T23:22:47.336243Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":"Zhang, X","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:aef775250b4cd825bbe7125fe5f7d56854f2024ce0503f8de9db433c845ca712","observation_id":"d59c7a0d-c6e5-47ea-84ba-61b6c9e139a9","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:b8f93c53f3c32c497ec2cd9e3551c25282f365844a6bb5ba7fdedad827e8c3af","observation_id":"ff5115a1-93ad-4958-b771-f845fda77cda","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:d946c1267a1432dc5095cae75c439dd2d21a97b61cc910c7325226c1daf86f28","observation_id":"c72a5703-4611-4481-b73b-8db4ae30dca6","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.24125","last_updated":"2026-07-26T09:02:49Z","snapshot_observed_at":"2026-08-04T11:27:48.952895Z","submitted_at":"2025-12-30T10:18:42Z","title":"Unified Embodied VLM Reasoning with Robotic Action via Autoregressive Discretized Pre-training","version":3},"cited_work":{"arxiv_id":"2512.24125","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.24125","snapshot_observed_at":"2026-07-28T02:22:25.972283Z","title":null,"venue":null,"work_id":"f37aaf0f-7982-4734-a688-4c0bb1c99ba5","year":2025},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"cited_paper":"/paper/2512.24125","citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:f4759c7c1889e567cc199254b4a53a12d32e98e763e50b7af0a098cd96a67388","observation_id":"ea4ad50f-3976-4186-946c-b76f51e4a7b6","resolution":{"observed_at":"2026-07-28T02:22:25.972283Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:0c53557c195d9e08e5d6a9b58b09265cbf5c7a7edca9a71f433c95555a3ef087","observation_id":"22c21883-e610-4ef8-9fe1-a90f43717f48","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:11a6887361f4d2c4f39521f1c3607100bf18d8ee99e313ea7183a5cf33464c33","observation_id":"938dad32-c417-4d86-8d47-7d21f7a69297","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:6789b6bbe6bf4f0aecef04226b927e09716151f9a3c114930cc16e8428ea837d","observation_id":"2f520488-4e4c-42fc-86ae-5ca216ecc6cf","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":"Zhang, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:9ed6f5bbbcce5f5ab3f31dfeecfb19028315a35784ee4fdf1a7af2bc75103c07","observation_id":"9c51168c-a7c0-44c2-b023-f835c09bd61b","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.09826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T14:13:30.690793Z","title":null,"venue":null,"work_id":"4d7feefd-f05e-4c16-bbd7-a72f907fbd5b","year":2026},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:7144f39b8944ba2cc6c6257b46f59bd53a89a32f802c99a4692dfd06eff2e577","observation_id":"b2e6faf5-e258-48d6-8ec1-335f73c71c09","resolution":{"observed_at":"2026-06-28T23:22:47.330354Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:a701da3216f99203c7b9c5d7aae499f5c9cdcfe8e9120039be34c36f782e3322","observation_id":"77076ab3-1a1a-4c1d-802f-3c8ffb03aa32","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20020","last_updated":"2025-03-25T19:02:56Z","snapshot_observed_at":"2026-08-02T07:15:58.798604Z","submitted_at":"2025-03-25T19:02:56Z","title":"Gemini Robotics: Bringing AI into the Physical World","version":1},"cited_work":{"arxiv_id":"2503.20020","doi":"10.48550/arxiv.2503.20020","metadata_source":"pith","pith_arxiv_id":"2503.20020","snapshot_observed_at":"2026-07-10T23:07:47.582320Z","title":"Gemini Robotics: Bringing AI into the Physical World","venue":"cs.RO","work_id":"f7c5ce10-8364-4fbe-964f-2802b81c3a98","year":2025},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"cited_paper":"/paper/2503.20020","citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:02cc1d9c445668e9fe6eba45858ccefc4f541375a09233e0f052b96a3104b5bc","observation_id":"244d8bf6-20ba-42f2-a139-75d187aea648","resolution":{"observed_at":"2026-06-28T23:22:47.330471Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":null,"venue":null,"work_id":null,"year":1914},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:4c00ae1fdd4d0949091f7e77431d9a0da3a5b00c3c4bd789750193d22a3cc307","observation_id":"2e255e35-7b4b-4e0b-b2a6-f1379db045fe","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":"GPT-5.5 system card","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:cea108a1e410f286c8c7a297e181c9f5dfb6bb5f8f4a4ada0b3ac7df3f58a207","observation_id":"ecbf6859-6185-4dd9-8dcd-4bac399300a3","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":"Gemini 3.1 Pro model card","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:648321650a0f7740237f3241e916efb85232d20d123c75dafe2859310244ef1a","observation_id":"2c26e0b1-f7bb-4850-8af5-b12e4f3e8e18","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":"Gemini Robotics-ER 1.6: Powering real-world robotics tasks through enhanced embodied reasoning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:178c1919db5fcbb65f16392880556337c315612f38d374597ae0688db44e27f2","observation_id":"f4c8b557-546a-4444-b334-472da8540a2c","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:8e63a34103df806804c24ac1a5ec4cebfcb2a4555a4ad3489736bb5922c61d75","observation_id":"0cb087a7-df04-476a-a216-6718e75822af","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:a4649aac0c29367299a2eedc0927989b15af8f041e2845f9377de77fc0b5ac47","observation_id":"32aaa1ba-ce5f-485d-b4f6-0af72e863c9d","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:7bdb1f738b9e8c04feef3a6061802de397be246c18ea98303487cdb1af2081aa","observation_id":"43738ef0-88a4-4f10-9266-55191181d60d","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":"Guiochet, M","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:6d4cb8310f7afd21d63b6ecf71b96012235f20bf78b076b1d5dc7939e2efaf46","observation_id":"0f1ce212-3d84-4140-8c8f-0aee7e7b4038","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:17:23.965554Z","title":"Failure pattern A brick wall fills the entire arm camera at step 103 (scene flags all True), yet themodel dismisses this because","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:668b809c15eb12a99c2ec90a29216e37923b97b7a219fd5e38200716431cd6ae","observation_id":"ae8ca32b-9392-4938-a867-b8d89a879849","resolution":{"observed_at":"2026-06-28T23:17:23.965554Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T08:09:42.028884Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":13,"verified_fuzzy":0},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 1 inbound Pith citation observation for arXiv:2605.31196."}