{"as_of":"2026-08-20T16:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:722f1d6bfc3f637c70ab8d369b10384cd8c66ca1cc7d526a37606e96365fa944","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:18:43.252360Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T20:31:58.978117Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.01971","last_updated":"2024-10-02T19:29:24Z","snapshot_observed_at":"2026-08-18T04:36:19.106546Z","submitted_at":"2024-10-02T19:29:24Z","title":"Run-time Observation Interventions Make Vision-Language-Action Models More Visually Robust","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01971","snapshot_observed_at":"2026-08-09T14:27:40.978978Z","title":"Run-time observation interventions make vision- language-action models more visually robust","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01828","last_updated":"2025-05-02T17:53:34Z","snapshot_observed_at":"2026-08-19T20:46:49.965780Z","submitted_at":"2025-02-03T21:11:02Z","title":"From Foresight to Forethought: VLM-In-the-Loop Policy Steering via Latent Alignment","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T14:27:40.978978Z"},"links":{"cited_paper":"/paper/2410.01971","citing_paper":"/paper/2502.01828"},"observation_digest":"sha256:6b766c414c5c3241f379a7b0ce6db89329a7ed0dd0043cea0ff3a75c0c164db6","observation_id":"3ce77235-0230-4751-ad79-d126cc403196","resolution":{"observed_at":"2026-08-09T14:27:40.978978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01971","last_updated":"2024-10-02T19:29:24Z","snapshot_observed_at":"2026-08-18T04:36:19.106546Z","submitted_at":"2024-10-02T19:29:24Z","title":"Run-time Observation Interventions Make Vision-Language-Action Models More Visually Robust","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01971","snapshot_observed_at":"2026-08-08T15:04:10.944309Z","title":"Run-time observation interventions make vision-language-action models more visually robust.arXiv preprint arXiv:2410.01971, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06575","last_updated":"2025-02-10T15:44:34Z","snapshot_observed_at":"2026-08-14T03:12:46.772367Z","submitted_at":"2025-02-10T15:44:34Z","title":"Predictive Red Teaming: Breaking Policies Without Breaking Robots","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T15:04:10.944309Z"},"links":{"cited_paper":"/paper/2410.01971","citing_paper":"/paper/2502.06575"},"observation_digest":"sha256:487033260a00de6c0d636ff0154de2a6b28e14a43e2efad7c95574d00d7a3190","observation_id":"4de93102-b7f0-43f9-924f-c83d4ff5d8b7","resolution":{"observed_at":"2026-08-08T15:04:10.944309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01971","last_updated":"2024-10-02T19:29:24Z","snapshot_observed_at":"2026-08-18T04:36:19.106546Z","submitted_at":"2024-10-02T19:29:24Z","title":"Run-time Observation Interventions Make Vision-Language-Action Models More Visually Robust","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01971","snapshot_observed_at":"2026-08-15T21:18:43.252360Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10219","last_updated":"2025-05-15T12:22:21Z","snapshot_observed_at":"2026-08-20T13:17:16.049761Z","submitted_at":"2025-05-15T12:22:21Z","title":"Towards Safe Robot Foundation Models Using Inductive Biases","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T21:18:43.252360Z"},"links":{"cited_paper":"/paper/2410.01971","citing_paper":"/paper/2505.10219"},"observation_digest":"sha256:f947f11b47aaf08f113cb56009420a8795d08b1e2662713340e8692fd8677549","observation_id":"1b7900ce-c109-4cbb-abac-f3827499a9a6","resolution":{"observed_at":"2026-08-15T21:18:43.252360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01971","last_updated":"2024-10-02T19:29:24Z","snapshot_observed_at":"2026-08-18T04:36:19.106546Z","submitted_at":"2024-10-02T19:29:24Z","title":"Run-time Observation Interventions Make Vision-Language-Action Models More Visually Robust","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01971","snapshot_observed_at":"2026-08-07T00:48:49.729209Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12678","last_updated":"2025-06-15T01:17:30Z","snapshot_observed_at":"2026-08-19T20:47:33.902506Z","submitted_at":"2025-06-15T01:17:30Z","title":"Adapting by Analogy: OOD Generalization of Visuomotor Policies via Functional Correspondence","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:48:49.729209Z"},"links":{"cited_paper":"/paper/2410.01971","citing_paper":"/paper/2506.12678"},"observation_digest":"sha256:8cf9e630e71546a17e9f4673c3b98b082c06d629baaa3c9ddfd25c24c46a4678","observation_id":"e12293da-265c-4756-b7e4-4cb05abb2b2f","resolution":{"observed_at":"2026-08-07T00:48:49.729209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01971","last_updated":"2024-10-02T19:29:24Z","snapshot_observed_at":"2026-08-18T04:36:19.106546Z","submitted_at":"2024-10-02T19:29:24Z","title":"Run-time Observation Interventions Make Vision-Language-Action Models More Visually Robust","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01971","snapshot_observed_at":"2026-08-15T19:30:24.101858Z","title":"Run-time observation interventions make vision- language-action models more visually robust.arXiv preprint arXiv:2410.01971, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16565","last_updated":"2025-06-19T19:41:29Z","snapshot_observed_at":"2026-08-17T18:17:09.293655Z","submitted_at":"2025-06-19T19:41:29Z","title":"Reimagination with Test-time Observation Interventions: Distractor-Robust World Model Predictions for Visual Model Predictive Control","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T19:30:24.101858Z"},"links":{"cited_paper":"/paper/2410.01971","citing_paper":"/paper/2506.16565"},"observation_digest":"sha256:454c494c9eb5e9388d60fce97b480e31043058b43e3e668d0abe0d7ef00e5ea5","observation_id":"171bb5be-add2-4f07-9a49-c7928b3fe600","resolution":{"observed_at":"2026-08-15T19:30:24.101858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01971","last_updated":"2024-10-02T19:29:24Z","snapshot_observed_at":"2026-08-18T04:36:19.106546Z","submitted_at":"2024-10-02T19:29:24Z","title":"Run-time Observation Interventions Make Vision-Language-Action Models More Visually Robust","version":1},"cited_work":{"arxiv_id":"2410.01971","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.01971","snapshot_observed_at":"2026-08-05T20:31:58.978117Z","title":"Run-time Observation Interventions Make Vision-Language-Action Models More Visually Robust","venue":"cs.RO","work_id":"c7dcf771-1da6-4bfd-8e27-8bada69cfd44","year":2024},"citing_paper":{"arxiv_id":"2508.10399","last_updated":"2025-08-14T06:56:16Z","snapshot_observed_at":"2026-08-17T18:39:16.964832Z","submitted_at":"2025-08-14T06:56:16Z","title":"Large Model Empowered Embodied AI: A Survey on Decision-Making and Embodied Learning","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-05T20:31:41.927324Z"},"links":{"cited_paper":"/paper/2410.01971","citing_paper":"/paper/2508.10399"},"observation_digest":"sha256:824fbf36aa6b8674961dff2e00c99b6f6eec689a29d155064e19ddf9c7114954","observation_id":"97b6d0b1-e046-4c62-85bd-67df50ba72e2","resolution":{"observed_at":"2026-08-05T20:31:59.051016Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2410.01971/citation-record","integrity":"/paper/2410.01971/integrity","json":"/paper/2410.01971/citation-record.json","paper":"/paper/2410.01971"},"outbound":[],"paper":{"arxiv_id":"2410.01971","last_updated":"2024-10-02T19:29:24Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-18T04:36:19.106546Z","submitted_at":"2024-10-02T19:29:24Z","title":"Run-time Observation Interventions Make Vision-Language-Action Models More Visually Robust"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2410.01971."}