{"as_of":"2026-08-08T08:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3bc9dc8cc3748f1194b2b6ea5d1ad8464fa3af15e2910812ea1393801c3163a0","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:55:45.575246Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.23266/citation-record","integrity":"/paper/2505.23266/integrity","json":"/paper/2505.23266/citation-record.json","paper":"/paper/2505.23266"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:57.618314Z","title":"Efficient qos-aware service recommendation for multi-tenant service-based systems in cloud,","venue":null,"work_id":"4e3bae96-fead-4b86-849e-15dd421583c7","year":2017},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:40.989429Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:d75d07db0278aafe1d894741e47bab0b862e2203f24f6118b5e0e7d41b64efa3","observation_id":"43cbb966-dc05-4ee4-93c2-94844c765b72","resolution":{"observed_at":"2026-08-07T12:55:57.705556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:57.425590Z","title":"Edge computing for internet of everything: A survey,","venue":null,"work_id":"a5a42027-b2e7-44b8-8f66-649b64e9ee0d","year":2022},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.064782Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:15172f76bf3bbc51f63b01d7091258dc731b2720a1ea419e6bc7aea341ef0d33","observation_id":"020a1040-15ee-4c34-9991-79568735500d","resolution":{"observed_at":"2026-08-07T12:55:57.508740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:57.372228Z","title":"Groupchain: Towards a scalable public blockchain in fog computing of iot services com- puting,","venue":null,"work_id":"f19c71bd-a7a3-4d0b-a136-6e39b47030f2","year":2020},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.141507Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:9a254f08862d3f70667e22536ef5c5cbd6fda55cc57909002791e92d2ca037e4","observation_id":"f41b9cf3-2ca0-4544-a1dc-06831aae0294","resolution":{"observed_at":"2026-08-07T12:55:57.405828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:57.180407Z","title":"Vision-and-language navigation: Interpreting visually-grounded navigation instruc- tions in real environments,","venue":null,"work_id":"f8f07010-8144-486d-a929-b6e9fd88ad7e","year":2018},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.178878Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:bf3bc9656d455ea4411b5969b38fb6449fc92f391451958b7289fb5effbc1e78","observation_id":"3ad741cf-2845-49b6-848e-19586b3c755e","resolution":{"observed_at":"2026-08-07T12:55:57.257118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:57.035621Z","title":"Transferable representation learning in vision-and- language navigation,","venue":null,"work_id":"1f76f3d6-cdc6-4061-827f-1621e1be277f","year":2019},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.206202Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:df7cece0bda9ae816729029ff5e484155cd4e793a04a26de899ee24792fd5878","observation_id":"4792086a-1113-4e75-bf55-e6188292a6d6","resolution":{"observed_at":"2026-08-07T12:55:57.104658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:56.905789Z","title":"Look before you leap: Bridging model-free and model-based reinforcement learning for planned-ahead vision-and-language navigation,","venue":null,"work_id":"c2935b2e-40b4-4b92-8688-3c1ebbd8bedf","year":2018},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.273851Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:f3fa17b17f3bb33590edb7efbfb2f8f04eb74f80092852cc5f20ee71d9332f25","observation_id":"1a01e039-e93d-4ba3-bbcd-fb52ee459322","resolution":{"observed_at":"2026-08-07T12:55:56.965674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:56.750715Z","title":"Reinforced cross-modal matching and self-supervised imitation learning for vision-language navi- gation,","venue":null,"work_id":"216440a0-5556-44b5-8b50-3618ad48ac49","year":2019},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.343471Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:b5e02ce0e2c912559c0d72e4504167aafa930b2258302da23a3bed5eeb466499","observation_id":"3a42df36-2c7e-48b0-8934-5c47cefdfc33","resolution":{"observed_at":"2026-08-07T12:55:56.834519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:41.380892Z","title":"Lan- guage models are few-shot learners,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.380892Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:c5f901453a1ae0dcfebb49266d9c0dab5aec8ee2e246b1068e2a978ec6836ecc","observation_id":"572c89d8-ab0c-4834-9a04-54e869033d7c","resolution":{"observed_at":"2026-08-07T12:55:41.380892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T12:55:41.413755Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.413755Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:7413b2a9d07658bb92a32f1787e4fcea16176b425c5f72f57bcb9e1df9b2c68b","observation_id":"0f9d8a55-fb09-412c-b2b6-c696e59251ee","resolution":{"observed_at":"2026-08-07T12:55:41.413755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:56.602449Z","title":"When search engine services meet large language models: visions and challenges,","venue":null,"work_id":"fbd7666a-d76b-47d3-8deb-1d40de8b684a","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.471334Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:3225c07862311c773ec92f0411e34315198aca8d0fbf04c56f9c8cc74d44c51c","observation_id":"28ce8d90-2a20-4ba1-ac9e-51554da7159d","resolution":{"observed_at":"2026-08-07T12:55:56.648796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:56.460202Z","title":"Learning transfer- able visual models from natural language supervision,","venue":null,"work_id":"2b2a8777-b262-44ea-b6bd-5cd3a29a847f","year":2021},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.568647Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:db71e014b56b2ad4fb7ad44d3b39caffeb86f70cd81507765bed75c65ca14aeb","observation_id":"e0813451-16e1-44ff-b17e-9f1090c9a394","resolution":{"observed_at":"2026-08-07T12:55:56.518858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:41.606730Z","title":"Visual instruction tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.606730Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:bd5ec542e2a49560a8021dce9ce3d0ac66c582fda65f516a36cf563c66183d99","observation_id":"53faae4e-8063-4039-9e1e-2b4087c75830","resolution":{"observed_at":"2026-08-07T12:55:41.606730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:56.382046Z","title":"Jarvis: Joining adversarial training with vision transformers in next-activity prediction,","venue":null,"work_id":"1773161c-587e-4cd8-b28a-425d39d52228","year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.657474Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:eeebc4395872b8062a91078b7dfff2f2619141729d90be1342b4d6abc4ad58b8","observation_id":"8a4b4603-d9b1-4bb1-9eb2-4dbe14e0f693","resolution":{"observed_at":"2026-08-07T12:55:56.390354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11398","last_updated":"2024-08-21T07:45:43Z","snapshot_observed_at":"2026-07-06T19:03:52.342045Z","submitted_at":"2024-08-21T07:45:43Z","title":"Generative AI based Secure Wireless Sensing for ISAC Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11398","snapshot_observed_at":"2026-08-07T12:55:41.724319Z","title":"Generative ai based secure wireless sensing for isac networks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.724319Z"},"links":{"cited_paper":"/paper/2408.11398","citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:3e2e6d4733bdb3dd0c7c062a37f47082c7095fe69eeed7bb5edb442b24c93ed5","observation_id":"66831869-6fcf-4392-8b6d-3b31b01dc01f","resolution":{"observed_at":"2026-08-07T12:55:41.724319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:56.228254Z","title":"Multi-objective aerial collaborative secure communication opti- mization via generative diffusion model-enabled deep reinforce- ment learning,","venue":null,"work_id":"8d2ccc14-a34f-4de7-92a4-c850d7a6e05e","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.829216Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:fc3ae6b183b4189548515e44e1f3667815130783f8cd63cb03d7e352ba28fe19","observation_id":"fd670b19-bf84-4c5a-b124-dfdc57abbc6f","resolution":{"observed_at":"2026-08-07T12:55:56.318593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:56.050566Z","title":"Visual language maps for robot navigation,","venue":null,"work_id":"49b8d678-a6cf-490f-a261-aaf506af4fa9","year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.893056Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:182adf9196caf33369db41acbb7e88d3cfe417992c784c2034a8cbb11a4542c3","observation_id":"3a70fc58-9d51-4096-b8a5-5b1d8e686a3b","resolution":{"observed_at":"2026-08-07T12:55:56.128356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:55.900984Z","title":"Cows on pasture: Baselines and benchmarks for language-driven zero-shot object navigation,","venue":null,"work_id":"ad872331-5e6f-4c49-b3d1-46ea539a5c4f","year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:41.963669Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:dc8ae9bd4ddf33ffdd369445db0c9f429fb5d6157096fe78607957140a2e22b9","observation_id":"7403c7cd-1aba-4d90-a011-ad2ffb058f85","resolution":{"observed_at":"2026-08-07T12:55:55.963687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:55.681416Z","title":"Think, act, and ask: Open- world interactive personalized robot navigation,","venue":null,"work_id":"fc1e3f7c-0f52-4a76-81ce-c285dc9a6acc","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.041142Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:1e688ee9bd0ea66bb27136b1515f34d52bfff89f8c59b408fd9d4e46d1258c2b","observation_id":"265707a8-6def-4b0e-972b-e69a78093d31","resolution":{"observed_at":"2026-08-07T12:55:55.805560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:55.510585Z","title":"CLIP-fields: Weakly supervised semantic fields for robotic mem- ory,","venue":null,"work_id":"d10a1982-c292-48c6-b502-f8383a3b25d9","year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.088066Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:365815a3d3ea451baca17b9f5b2d8acc8dc6fa0024db023fca91015caf301f7f","observation_id":"7a496e9f-0874-4b6c-8dea-206ea02060b4","resolution":{"observed_at":"2026-08-07T12:55:55.577706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02385","last_updated":"2024-02-04T07:55:01Z","snapshot_observed_at":"2026-08-04T15:45:08.679135Z","submitted_at":"2024-02-04T07:55:01Z","title":"A Survey on Robotics with Foundation Models: toward Embodied AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02385","snapshot_observed_at":"2026-08-07T12:55:42.152234Z","title":"A survey on robotics with foundation models: toward embodied ai,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.152234Z"},"links":{"cited_paper":"/paper/2402.02385","citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:f9deb159c61b62e67e96f4848030120ec16df8fd4ca03c8d9f10997f68e2cfd3","observation_id":"c7ec27f7-f820-4853-ad2e-6c7b1915d4e0","resolution":{"observed_at":"2026-08-07T12:55:42.152234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:55.268443Z","title":"Real-world robot applications of foundation models: A review,","venue":null,"work_id":"47f8a9ee-cd1c-43c5-b571-01e2bcfc2fcf","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.258006Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:0670452a863a11d3f021bbee93ec8d41af0e4d9ae4e661efd04a8daa75f6f3c8","observation_id":"000ef238-7809-4a03-b33b-3457c6791212","resolution":{"observed_at":"2026-08-07T12:55:55.390508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:55.003136Z","title":"Velma: Verbalization embodiment of llm agents for vision and language navigation in street view,","venue":null,"work_id":"7a676402-0666-4ae4-82bf-2c8ebef4eef7","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.334932Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:676fd19370f083539003bfedaf777d9eb940e90049c7f07dd2fff1179d9aed7a","observation_id":"73a7ce84-e4b8-4773-a9d3-81d159ee93f3","resolution":{"observed_at":"2026-08-07T12:55:55.142129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:54.706431Z","title":"Segment anything,","venue":null,"work_id":"60acc20a-2528-497f-8ab4-a0a35196198d","year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.433974Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:647e37230a4a5e78fe4bcef9aead73afc836a0c759a2c7b588c1d75b113832e1","observation_id":"6b561261-76a0-4491-8b42-1b9cbe67a195","resolution":{"observed_at":"2026-08-07T12:55:54.832478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:54.428187Z","title":"Defending adversarial attacks via semantic feature manipulation,","venue":null,"work_id":"f07bd325-fafb-47b1-8ebc-0aa88dfcd00a","year":2021},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.488806Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:258384b8ff147713a74afde867e7fcbaf5cc9e4fd60d36af10acefe2ad750f0d","observation_id":"3e50becc-b616-4c14-a248-274f996eafec","resolution":{"observed_at":"2026-08-07T12:55:54.553165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19802","last_updated":"2024-07-16T14:43:51Z","snapshot_observed_at":"2026-07-06T18:22:31.384923Z","submitted_at":"2024-05-30T08:12:08Z","title":"Exploring the Robustness of Decision-Level Through Adversarial Attacks on LLM-Based Embodied Models","version":3},"cited_work":{"arxiv_id":"2405.19802","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.19802","snapshot_observed_at":"2026-08-07T12:55:46.011292Z","title":"Exploring the Robustness of Decision-Level Through Adversarial Attacks on LLM-Based Embodied Models","venue":"cs.MM","work_id":"1996808b-e270-4711-a687-d4f2211e43f6","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.538240Z"},"links":{"cited_paper":"/paper/2405.19802","citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:de6fcdf903dbf0d8fc6e759af66384257bac74b563323966990200fd775866e0","observation_id":"3f47adb3-e7f8-4e81-b960-ee7118f0f02d","resolution":{"observed_at":"2026-08-07T12:55:46.138149Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16633","last_updated":"2025-08-11T08:29:19Z","snapshot_observed_at":"2026-08-04T21:48:56.724147Z","submitted_at":"2024-12-21T13:58:27Z","title":"POEX: Towards Policy Executable Jailbreak Attacks Against the LLM-based Robots","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16633","snapshot_observed_at":"2026-08-07T12:55:42.577926Z","title":"Poex: Policy executable embodied ai jailbreak attacks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.577926Z"},"links":{"cited_paper":"/paper/2412.16633","citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:1afd45519cba5c554c0bc407fd548d13dd2d93cc507661612fbd11f1ac65efd6","observation_id":"b10d2c34-ab2c-4234-b254-e10cb23343bb","resolution":{"observed_at":"2026-08-07T12:55:42.577926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13587","last_updated":"2025-08-01T03:41:06Z","snapshot_observed_at":"2026-07-06T19:53:21.444233Z","submitted_at":"2024-11-18T01:52:20Z","title":"Exploring the Adversarial Vulnerabilities of Vision-Language-Action Models in Robotics","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13587","snapshot_observed_at":"2026-08-07T12:55:42.620886Z","title":"Exploring the adversarial vulnerabili- ties of vision-language-action models in robotics,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.620886Z"},"links":{"cited_paper":"/paper/2411.13587","citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:4eb31007235ab97c3950b416bd1fde55eb9aaa6c36459a58f71a3583c8fbae17","observation_id":"f4887ff2-dc75-4ae1-8a98-155163198b38","resolution":{"observed_at":"2026-08-07T12:55:42.620886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09546","last_updated":"2025-05-23T04:03:34Z","snapshot_observed_at":"2026-08-06T09:22:08.600405Z","submitted_at":"2024-02-14T19:45:17Z","title":"How Secure Are Large Language Models (LLMs) for Navigation in Urban Environments?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09546","snapshot_observed_at":"2026-08-07T12:55:42.693196Z","title":"How secure are large language models (llms) for navigation in urban environ- ments?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.693196Z"},"links":{"cited_paper":"/paper/2402.09546","citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:b37b83ee035489e66437157e8910ac2085fce48378dbddea96b7c9acc3056c34","observation_id":"e685e762-154f-4f61-8e5d-68c0781ca82a","resolution":{"observed_at":"2026-08-07T12:55:42.693196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-07T12:55:42.770160Z","title":"Universal and transferable adversarial attacks on aligned language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.770160Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:74ab811703f2fb96380c2e66850ab7026939c27b86c183c8b2029f426716643b","observation_id":"bb79b84b-6126-4e70-be40-3c3b4e62f5ca","resolution":{"observed_at":"2026-08-07T12:55:42.770160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:54.234342Z","title":"Accelerating greedy coordinate gradient and general prompt optimization via probe sampling,","venue":null,"work_id":"da5e0408-6c62-4c90-87f3-a798f8af8373","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.810093Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:de399b9c909ad907220ca90ab951095e2dc8942546ae5ef089dfdef985f2c151","observation_id":"eba4eaa4-5414-4c85-97f2-581b2a78ceb0","resolution":{"observed_at":"2026-08-07T12:55:54.309694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:53.938662Z","title":"Jailbreaker: Automated jailbreak across multiple large language model chatbots,","venue":null,"work_id":"063866ae-7385-4604-a278-175a8cd88d8d","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.848322Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:fb19f68452045c8785e58615ce594ab11f26230c13c7cc0868c16c8fc98532ba","observation_id":"b939b809-3c73-40bf-89af-0352a46c9de7","resolution":{"observed_at":"2026-08-07T12:55:54.059777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:53.652433Z","title":"Tree of attacks: Jailbreaking black- box llms automatically,","venue":null,"work_id":"18b9d515-fce0-4e54-87f8-70b1bd349e4a","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.904784Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:99fa9ab92761a7ea1c10d9d7930ffd42c25fa33275a4dc26b985bfcd405892e6","observation_id":"6c3497c3-2667-4860-ae0b-5d3c07acfa37","resolution":{"observed_at":"2026-08-07T12:55:53.771372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:53.480051Z","title":"Adv- clip: Downstream-agnostic adversarial examples in multimodal contrastive learning,","venue":null,"work_id":"aa2682e6-cb59-437f-afa9-54a55acf3f9b","year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:42.977734Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:48017f3c032ef2e3a87e4e91f0aef6e4292db90109966ca59fa068c21d5cb9de","observation_id":"d06daf9e-cbac-4a77-bf29-05b2f0f23fc3","resolution":{"observed_at":"2026-08-07T12:55:53.559952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:53.269998Z","title":"On evaluating adversarial robustness of large vision- language models,","venue":null,"work_id":"c05d343a-1566-4c3f-95b8-3fc4d25b1652","year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.042855Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:c562e0b43c5f7fa38209144e444531e35774cbe26eb7cd747b1b02d554ae5482","observation_id":"b70ca1fa-7d1b-434c-ae57-471068deefce","resolution":{"observed_at":"2026-08-07T12:55:53.377324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:53.035220Z","title":"Spatiotemporal attacks for embodied agents,","venue":null,"work_id":"056823ad-b06e-4f69-80f0-98d5daa2588d","year":2020},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.079773Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:58b2ed3ee50b1038c848a8973a5571aba27e3061b0f8903b42f814c8f482970f","observation_id":"d45f4cbe-4cbe-4517-8b39-806856f8f180","resolution":{"observed_at":"2026-08-07T12:55:53.157158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:52.768068Z","title":"Towards transferable targeted 3d adversarial attack in the physical world,","venue":null,"work_id":"1d39b772-4d97-4cf4-9443-0cdb3782ddb9","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.141251Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:e3a5f757ae1271e8dc1bef86a9176ba9d41a4ad695e615ea622206f6dad4e236","observation_id":"0b5e5d00-e24e-4823-b469-2cb0320115bd","resolution":{"observed_at":"2026-08-07T12:55:52.885380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-07-06T03:53:32.549552Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-07T12:55:43.213801Z","title":"Very deep convolutional networks for large-scale image recognition,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.213801Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:a64a00edd80fc8f5266ae39edf0d73048acc1d8af4311ea7206eb6e5bcc58882","observation_id":"54c4bf8e-f90f-4cf9-b102-1c859894130d","resolution":{"observed_at":"2026-08-07T12:55:43.213801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:52.554354Z","title":"Mask r-cnn,","venue":null,"work_id":"991037bc-be29-4c5e-83b7-965722e21ac2","year":2017},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.254115Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:7e583a8d846b51ff0ddbf4345af8be4f4e0456f4379bdcb571c26f04d5eef6d4","observation_id":"c41c2683-e34c-4ef9-8dcf-1a25eec59dbd","resolution":{"observed_at":"2026-08-07T12:55:52.655197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:43.299701Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.299701Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:c022cc395847b80008feb612846482e35430412fb76bceb08d24af4c22bbd47d","observation_id":"049d4d6e-7997-4da6-ac86-239453b711b7","resolution":{"observed_at":"2026-08-07T12:55:43.299701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:43.329973Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.329973Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:c1e275ce804bf3940baa377984641c832621ac575cdc408c9430a6d6d77a7215","observation_id":"4b113e4b-9193-4c90-bd02-426f98effdfe","resolution":{"observed_at":"2026-08-07T12:55:43.329973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:52.261976Z","title":"An embodied generalist agent in 3d world,","venue":null,"work_id":"a32c36ff-d786-422b-b552-a8c261c4be8f","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.413740Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:1c006bba918e98681cbf33b19b949cbb204472c44edd4eaece907341a52a2cda","observation_id":"6101c2e4-985d-4639-a540-359041f7beb2","resolution":{"observed_at":"2026-08-07T12:55:52.353320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:52.075636Z","title":"Llm-planner: Few-shot grounded planning for embodied agents with large language models,","venue":null,"work_id":"9478e5d7-7615-46ad-a0db-6eec05260800","year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.475406Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:47da8bec6b388c4fd2e9fdff2ab32fb62e85661ac0bc3c8d579339c104c49975","observation_id":"94196732-3c77-4fb7-8081-645b92a51efc","resolution":{"observed_at":"2026-08-07T12:55:52.172402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:51.852100Z","title":"Towards learning a generalist model for embodied navigation,","venue":null,"work_id":"b0d6d9ee-83cc-42ab-a703-ec5e63a08604","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.507083Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:f9d545d4769782a6e1417d06b3703fa4e8627dbffbe75269f0401bc22436264a","observation_id":"5a38d97f-1031-4632-9261-3d99a168536b","resolution":{"observed_at":"2026-08-07T12:55:51.955381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:51.620214Z","title":"Zson: Zero-shot object-goal navigation using multimodal goal embeddings,","venue":null,"work_id":"da93c3b0-201f-4f19-a8ef-c6089d5b3fda","year":2022},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.542483Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:cd5c616bfbeecaa817a1bc870f719c3e9c50e4f55917f3874bec6cd2626f03db","observation_id":"e3339324-e279-4ab4-8b2e-8ad73d97f409","resolution":{"observed_at":"2026-08-07T12:55:51.698573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:43.619639Z","title":"A survey on large language model (llm) security and privacy: The good, the bad, and the ugly,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.619639Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:d20d7cb711b9af33c0184a0ac657b199759a0bdef8e318ef1b85e8bade53d86a","observation_id":"6e1f70aa-03e2-46cd-b9e0-98b465c43086","resolution":{"observed_at":"2026-08-07T12:55:43.619639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15025","last_updated":"2023-09-26T15:49:23Z","snapshot_observed_at":"2026-07-06T16:23:53.247204Z","submitted_at":"2023-09-26T15:49:23Z","title":"Large Language Model Alignment: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15025","snapshot_observed_at":"2026-08-07T12:55:43.687467Z","title":"Large language model alignment: A survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.687467Z"},"links":{"cited_paper":"/paper/2309.15025","citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:a8ebf1a4d3b7825b2a20b3cd6f4838e696d118b93f868cb646d71af734d05338","observation_id":"f2b6e47e-684e-43cd-8f17-eb50bbac43dc","resolution":{"observed_at":"2026-08-07T12:55:43.687467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:51.404538Z","title":"Bert-attack: Adversarial attack against bert using bert,","venue":null,"work_id":"ebf515b7-5b28-4b7c-ab38-7427a15f4534","year":2020},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.750501Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:0505275c98c17de49dcbeaa0d3e04b4361473e3f17dcd108447bf6f98df7925d","observation_id":"690ec15c-c341-4483-8717-a6791d5f5e59","resolution":{"observed_at":"2026-08-07T12:55:51.480843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11751","last_updated":"2023-10-14T12:56:13Z","snapshot_observed_at":"2026-08-02T21:47:41.540245Z","submitted_at":"2023-09-21T03:24:30Z","title":"How Robust is Google's Bard to Adversarial Image Attacks?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11751","snapshot_observed_at":"2026-08-07T12:55:43.788243Z","title":"How robust is google’s bard to adversarial image attacks?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.788243Z"},"links":{"cited_paper":"/paper/2309.11751","citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:302d949ae8bf82a782ea5b721b1d052bd7862c2600c7c8748d9f9722bdf0f760","observation_id":"0c7dfc16-043a-4a3b-bac7-d25029946a27","resolution":{"observed_at":"2026-08-07T12:55:43.788243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:51.178825Z","title":"Re- thinking model ensemble in transfer-based adversarial attacks,","venue":null,"work_id":"fe394e69-f5a8-4205-816e-5cd57da4bc6b","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.836312Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:e067b8daa5a3475a17860e0864598c420da5dd565f1b468a84e5cc1e7ecf4912","observation_id":"6c17ad81-bf3a-499e-b683-57714f353522","resolution":{"observed_at":"2026-08-07T12:55:51.269759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:50.994804Z","title":"Physical adversarial attack meets computer vision: A decade survey,","venue":null,"work_id":"b20f338a-06b5-4f3d-b556-d995fff0d0de","year":2024},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.911357Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:4ee895e1d73443a0b771148fbf3866bd9e3a646f388e3a825863591efb48d639","observation_id":"dddf400e-4eeb-43cb-b918-7e17710112ce","resolution":{"observed_at":"2026-08-07T12:55:51.090746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:50.762941Z","title":"Robust adversarial objects against deep learning models,","venue":null,"work_id":"9e1e8245-b288-4361-b45b-5cc2497139af","year":2020},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:43.966963Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:41fe4998d31fd8bbacfe01946e269c0cad1f4ff558145ff31bfcb8a80fb5f21f","observation_id":"ccb39dee-944b-477a-bdce-ace14fc531fb","resolution":{"observed_at":"2026-08-07T12:55:50.874958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:50.482587Z","title":"Pointcloud saliency maps,","venue":null,"work_id":"8d5eeb91-12f6-4c75-a9ee-137f90240761","year":2019},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.011713Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:3bb187395981e28c6224f63db1b96000a58b0be6291036c4a582ba0beff66c59","observation_id":"a0ecc492-b712-4753-8d06-787888df9d0a","resolution":{"observed_at":"2026-08-07T12:55:50.603670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:50.180132Z","title":"Advpc: Transfer- able adversarial perturbations on 3d point clouds,","venue":null,"work_id":"dbb4bb43-089e-4b31-8969-1d4394e57402","year":2020},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.068658Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:539cb98576f593554c2d4824d618aaa1ebe1c5a6a369463e42400afbe2ecb75c","observation_id":"0a4742d7-5b70-4677-bb49-f844bb749dbd","resolution":{"observed_at":"2026-08-07T12:55:50.326003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:49.900242Z","title":"Lg-gan: Label guided adversarial network for flexible targeted attack of point cloud based deep networks,","venue":null,"work_id":"91e25b63-37ac-4ff2-962d-4eca779a143c","year":2020},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.108820Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:e7eb5720ce8191e4f335df8f46c1149a1e70cecc5e0d479b22b38b60a93bfcab","observation_id":"b19216ee-e960-49de-b48a-5ea4170a11df","resolution":{"observed_at":"2026-08-07T12:55:50.012816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:49.642353Z","title":"Dta: Physical camouflage attacks using differentiable transformation network,","venue":null,"work_id":"ccb4d450-29d8-49f1-bab3-14f4f87ed731","year":2022},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.188342Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:0eb892467a3afa33b07b807b25ee593ad38e4c316ef433b4a13bfac41e1e4351","observation_id":"e864ea27-76dc-4234-a43d-57a0e4eb4c9e","resolution":{"observed_at":"2026-08-07T12:55:49.772933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:49.398884Z","title":"Active: Towards highly trans- ferable 3d physical camouflage for universal and robust vehicle evasion,","venue":null,"work_id":"98978cb8-14a2-48c4-b590-d74f5695197d","year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.308458Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:aa6521ff2b5cc62c4c010989e87752ebc649bb33d69092689d855ffa69d0e4e9","observation_id":"371ec765-6a0c-4382-b48b-68d26745c2d9","resolution":{"observed_at":"2026-08-07T12:55:49.514367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:49.242569Z","title":"Learning from simulated and unsupervised images through adversarial training,","venue":null,"work_id":"521d6922-aebd-4f31-8e4c-9482bff94b71","year":2017},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.372283Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:0451c951ee98da4079e424a21fe94158993811270d7f58309b6b7ba19ab46144","observation_id":"8542560d-960c-4112-8687-da2556bbe594","resolution":{"observed_at":"2026-08-07T12:55:49.305975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:49.032957Z","title":"Pointnet: Deep learning on point sets for 3d classification and segmentation,","venue":null,"work_id":"addd59b7-7ce0-491b-b77b-7a61c74cfb3f","year":2017},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.454090Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:87b44b022d83b548a88ca496ae21e6d456598fc18e4cd6a1407430a02c83f32c","observation_id":"5928d782-5c66-49f9-abec-12cc6ffcc32b","resolution":{"observed_at":"2026-08-07T12:55:49.138597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:48.815686Z","title":"Pointnet++: Deep hierarchical feature learning on point sets in a metric space,","venue":null,"work_id":"1a495787-ef67-49f2-b672-f46a93bd40ca","year":2017},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.542688Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:24ce0b4be707df161aec9e5314354c534ea1ab023a0aa00a134a66dc61937f5c","observation_id":"fded94e6-74d1-454b-9893-ecc3d24c13f6","resolution":{"observed_at":"2026-08-07T12:55:48.897186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:48.523058Z","title":"Faster r-cnn: Towards real-time object detection with region proposal networks,","venue":null,"work_id":"1a61e12c-6a20-45f2-a7ee-352e1e57666c","year":2016},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.624605Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:656a14b7923a319ab5af71970798f3547f2b0ea8829bd02decf8002eeda3d71c","observation_id":"863efbe3-6f0a-4b44-b486-725d7ad17524","resolution":{"observed_at":"2026-08-07T12:55:48.616056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:48.315835Z","title":"You only look once: Unified, real-time object detec- tion,","venue":null,"work_id":"101e5055-12ea-4dd3-b789-dedb66e24510","year":2016},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.680234Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:5c4677a1c2e16e107fb87d395a8daab773126e0f213c54b2637d61bccc4c405c","observation_id":"f1f1ac9c-209d-46f6-925e-7219b61e6234","resolution":{"observed_at":"2026-08-07T12:55:48.392319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:48.134314Z","title":"Beyond the nav-graph: Vision-and-language navigation in continuous en- vironments,","venue":null,"work_id":"b65819b1-cdfb-4dc6-99e4-386787690776","year":2020},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.722317Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:d516689a228b2bb4f197590d104dce039a130c3a3ef7f83d7cb1a316c5f8ea2b","observation_id":"173bf764-7a4f-45e3-9846-746d7ee839aa","resolution":{"observed_at":"2026-08-07T12:55:48.227370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:47.947641Z","title":"A frontier-based approach for autonomous explo- ration,","venue":null,"work_id":"724aa01e-3ab6-4933-ba0b-d42f381d5dba","year":1997},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.815390Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:f83c603d48fccb920edbf0ecdc379aa40003d22399f53c647f55a0c92c87cc88","observation_id":"853cf257-4941-4c70-bfe1-af63977001c5","resolution":{"observed_at":"2026-08-07T12:55:48.031204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:47.716514Z","title":"Large language models can be easily distracted by irrelevant context,","venue":null,"work_id":"69d2b620-6cd4-4ced-b7a7-6e949239ca57","year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.884657Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:b4201c182d43ae1d5f09cdb0e8d222d536fa2ec82cd1a405e88da7ff8326720c","observation_id":"bd21b96e-1df4-446c-b2ad-759fa287dddb","resolution":{"observed_at":"2026-08-07T12:55:47.787446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:47.523522Z","title":"Ad- versarial camouflage: Hiding physical-world attacks with natural styles,","venue":null,"work_id":"bbfd043f-aac1-4969-acf6-cee859ffa590","year":2020},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:44.955800Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:0b036edc5c6e8262eb679306fcbf69739c4299bdc5bed4c2f179f80e8c954d24","observation_id":"5301e129-8442-44c0-b9da-2fb38c5b5a37","resolution":{"observed_at":"2026-08-07T12:55:47.614993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:47.359202Z","title":"An overview on 3d printing technology: Technological, materials, and applications,","venue":null,"work_id":"c6f97bbf-64d8-4381-83c2-512c9478acf3","year":2019},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:45.030406Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:9fb5906d0400ad224d84b1aae31f21e31b18b1466aeb61b0aac525b241e01556","observation_id":"c9be45bf-4c05-4f2d-b81d-3407842f4283","resolution":{"observed_at":"2026-08-07T12:55:47.432991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-07-06T15:00:58.804337Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-07T12:55:45.073029Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:45.073029Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:6e1518080cb03c7347a5704138dea41ded090a55455d4160d56acd207f3457b3","observation_id":"878c1399-a36c-4fd9-a79d-5068cc588f48","resolution":{"observed_at":"2026-08-07T12:55:45.073029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:47.091481Z","title":"A density-based algorithm for discovering clusters in large spatial databases with noise,","venue":null,"work_id":"5e9c6fa9-e22d-4dcb-8431-bf4d25270834","year":1996},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:45.156959Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:32fd24153ae7cd2a42d6b675790c911207e7503f330a7e14f576ee904aa9abe8","observation_id":"f6879cde-9548-4d49-858a-eaa5b942884b","resolution":{"observed_at":"2026-08-07T12:55:47.278082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:46.977582Z","title":"Matterport3d: Learning from rgb-d data in indoor environments,","venue":null,"work_id":"3cc4c2b1-fc1a-4f2d-bce5-be830ebf223b","year":2017},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:45.255065Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:ccdc4d9841c33eb86da65e6596c16bbccbbdd66b0ddf61a13f235dd98e3a5610","observation_id":"96c6b29b-58ce-440d-ac05-4623eda8e6ec","resolution":{"observed_at":"2026-08-07T12:55:47.024568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:46.756143Z","title":"Language-driven semantic segmentation,","venue":null,"work_id":"442e751f-f9b4-48a2-b3ff-728c93c0053c","year":2022},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:45.307289Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:21e6aead973f6f3a9287605545028bfe241d1eb5cde3c3a80909f97c52f2ca36","observation_id":"d079ba97-2aef-4a90-8cd2-398a3368aa98","resolution":{"observed_at":"2026-08-07T12:55:46.879752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:46.635391Z","title":"Habitat-matterport 3d dataset (HM3d): 1000 large-scale 3d environments for embod- ied AI,","venue":null,"work_id":"bdf01e91-5661-4de5-b727-edaee6f64ee1","year":2021},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:45.407217Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:8c4cb76b219f28289a671df867d69737a64b7bfd1c8657c530caa992ed9836cf","observation_id":"6d103038-079e-4def-9577-c5c6479d23a6","resolution":{"observed_at":"2026-08-07T12:55:46.685475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:55:46.352888Z","title":"Habitat: A platform for embodied ai research,","venue":null,"work_id":"1a472f9e-1417-4ef1-9cb2-5aba81ed8fb6","year":2019},"citing_paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:45.575246Z"},"links":{"citing_paper":"/paper/2505.23266"},"observation_digest":"sha256:095cfcb59e4a71842ce99c5f96930c63b0cf94e3412cf55ff23679d00b3a64b8","observation_id":"6b0c93be-0b9a-40c8-97c9-d12eb49c3501","resolution":{"observed_at":"2026-08-07T12:55:46.506520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.23266","last_updated":"2025-05-29T09:14:50Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-07T12:46:52.777693Z","submitted_at":"2025-05-29T09:14:50Z","title":"Disrupting Vision-Language Model-Driven Navigation Services via Adversarial Object Fusion"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":1,"verified_fuzzy":55},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 0 inbound Pith citation observations for arXiv:2505.23266."}