{"as_of":"2026-08-05T17:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8ef1d2c5f2477e05b3deddd3e1f9aca224f22b900b61ca5e8496d80ac093bf84","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T09:08:15.654858Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T05:36:01.255549Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.05116","last_updated":"2026-07-08T17:09:24Z","snapshot_observed_at":"2026-07-11T23:19:14.611343Z","submitted_at":"2025-07-07T15:30:55Z","title":"VOTE: Vision-Language-Action Optimization with Trajectory Ensemble Voting","version":5},"cited_work":{"arxiv_id":"2507.05116","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.05116","snapshot_observed_at":"2026-07-09T05:36:01.255549Z","title":"V ote: vision-language-action optimization with trajectory ensemble voting","venue":"cs.CV","work_id":"577786f7-7545-48fe-b085-1c37abd6a879","year":2025},"citing_paper":{"arxiv_id":"2508.13073","last_updated":"2025-09-01T08:10:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-18T16:45:48Z","title":"Large VLM-based Vision-Language-Action Models for Robotic Manipulation: A Survey","version":2},"reference_index":109,"source":"pdf_text","source_observed_at":"2026-05-17T20:28:15.818016Z"},"links":{"cited_paper":"/paper/2507.05116","citing_paper":"/paper/2508.13073"},"observation_digest":"sha256:03aebf676f6578926ad92b059fb11b975b70cd03f89316e2bb1e702dae845c76","observation_id":"e6df99e5-6f91-4b17-aa77-f34e0db2dec4","resolution":{"observed_at":"2026-07-09T02:20:27.970763Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05116","last_updated":"2026-07-08T17:09:24Z","snapshot_observed_at":"2026-07-11T23:19:14.611343Z","submitted_at":"2025-07-07T15:30:55Z","title":"VOTE: Vision-Language-Action Optimization with Trajectory Ensemble Voting","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.05116","snapshot_observed_at":"2026-08-04T09:08:15.654858Z","title":"V ote: vision-language-action optimization with trajectory ensemble voting.arXiv preprint arXiv:2507.05116, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.17111","last_updated":"2025-10-23T15:06:39Z","snapshot_observed_at":"2026-08-04T09:08:06.048583Z","submitted_at":"2025-10-20T02:59:45Z","title":"Efficient Vision-Language-Action Models for Embodied Manipulation: A Systematic Survey","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-04T09:08:15.654858Z"},"links":{"cited_paper":"/paper/2507.05116","citing_paper":"/paper/2510.17111"},"observation_digest":"sha256:a18f006f261b95cbbdbc436d47a551ac38bae95ad79d6468f0cfcb874c1006aa","observation_id":"a1651af6-f46b-4280-9f52-a8537f756317","resolution":{"observed_at":"2026-08-04T09:08:15.654858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05116","last_updated":"2026-07-08T17:09:24Z","snapshot_observed_at":"2026-07-11T23:19:14.611343Z","submitted_at":"2025-07-07T15:30:55Z","title":"VOTE: Vision-Language-Action Optimization with Trajectory Ensemble Voting","version":5},"cited_work":{"arxiv_id":"2507.05116","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.05116","snapshot_observed_at":"2026-07-09T05:36:01.255549Z","title":"V ote: vision-language-action optimization with trajectory ensemble voting","venue":"cs.CV","work_id":"577786f7-7545-48fe-b085-1c37abd6a879","year":2025},"citing_paper":{"arxiv_id":"2604.16592","last_updated":"2026-04-17T17:51:46Z","snapshot_observed_at":"2026-07-06T23:03:52.631613Z","submitted_at":"2026-04-17T17:51:46Z","title":"Human Cognition in Machines: A Unified Perspective of World Models","version":1},"reference_index":108,"source":"pdf_text","source_observed_at":"2026-05-10T08:12:15.663761Z"},"links":{"cited_paper":"/paper/2507.05116","citing_paper":"/paper/2604.16592"},"observation_digest":"sha256:ba143c677754a9fafb8655c2dcaf21084d8284e5f47064bad813b2bb6164ff4f","observation_id":"6d7b1da5-4b15-4a25-9913-1dc72f49ae4b","resolution":{"observed_at":"2026-07-09T02:20:27.970763Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05116","last_updated":"2026-07-08T17:09:24Z","snapshot_observed_at":"2026-07-11T23:19:14.611343Z","submitted_at":"2025-07-07T15:30:55Z","title":"VOTE: Vision-Language-Action Optimization with Trajectory Ensemble Voting","version":5},"cited_work":{"arxiv_id":"2507.05116","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.05116","snapshot_observed_at":"2026-07-09T05:36:01.255549Z","title":"V ote: vision-language-action optimization with trajectory ensemble voting","venue":"cs.CV","work_id":"577786f7-7545-48fe-b085-1c37abd6a879","year":2025},"citing_paper":{"arxiv_id":"2604.17787","last_updated":"2026-07-21T08:00:29Z","snapshot_observed_at":"2026-08-02T15:56:07.155228Z","submitted_at":"2026-04-20T04:25:24Z","title":"AnchorRefine: Synergy-Manipulation Based on Trajectory Anchor and Residual Refinement for Vision-Language-Action Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T05:11:52.984680Z"},"links":{"cited_paper":"/paper/2507.05116","citing_paper":"/paper/2604.17787"},"observation_digest":"sha256:e75e1e229248a4845c47a67f1191b1665e38ca38fc3633b8af31ea9e30c14fec","observation_id":"6a7c1953-01be-49dc-be94-3e098ffe693e","resolution":{"observed_at":"2026-07-09T02:20:27.970763Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05116","last_updated":"2026-07-08T17:09:24Z","snapshot_observed_at":"2026-07-11T23:19:14.611343Z","submitted_at":"2025-07-07T15:30:55Z","title":"VOTE: Vision-Language-Action Optimization with Trajectory Ensemble Voting","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.05116","snapshot_observed_at":"2026-08-02T15:56:08.326817Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.17787","last_updated":"2026-07-21T08:00:29Z","snapshot_observed_at":"2026-08-02T15:56:07.155228Z","submitted_at":"2026-04-20T04:25:24Z","title":"AnchorRefine: Synergy-Manipulation Based on Trajectory Anchor and Residual Refinement for Vision-Language-Action Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T15:56:08.326817Z"},"links":{"cited_paper":"/paper/2507.05116","citing_paper":"/paper/2604.17787"},"observation_digest":"sha256:a941adcd41d1f39085785fb06c1f949990964a8a5f8c477c0fd79a0a7a9f499d","observation_id":"8e788380-0f35-4f94-8021-b386b0d88566","resolution":{"observed_at":"2026-08-02T15:56:08.326817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05116","last_updated":"2026-07-08T17:09:24Z","snapshot_observed_at":"2026-07-11T23:19:14.611343Z","submitted_at":"2025-07-07T15:30:55Z","title":"VOTE: Vision-Language-Action Optimization with Trajectory Ensemble Voting","version":5},"cited_work":{"arxiv_id":"2507.05116","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.05116","snapshot_observed_at":"2026-07-09T05:36:01.255549Z","title":"V ote: vision-language-action optimization with trajectory ensemble voting","venue":"cs.CV","work_id":"577786f7-7545-48fe-b085-1c37abd6a879","year":2025},"citing_paper":{"arxiv_id":"2605.19242","last_updated":"2026-05-19T01:28:52Z","snapshot_observed_at":"2026-07-06T23:30:02.207108Z","submitted_at":"2026-05-19T01:28:52Z","title":"PhyWorld: Physics-Faithful World Model for Video Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-20T07:28:20.248452Z"},"links":{"cited_paper":"/paper/2507.05116","citing_paper":"/paper/2605.19242"},"observation_digest":"sha256:a21d281218742999910bdbe599f9aacc8cf7de4b60f5336b396b4481cc6b7d10","observation_id":"d1936401-242f-4e89-94b2-bf03d872615a","resolution":{"observed_at":"2026-07-09T02:20:27.970763Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05116","last_updated":"2026-07-08T17:09:24Z","snapshot_observed_at":"2026-07-11T23:19:14.611343Z","submitted_at":"2025-07-07T15:30:55Z","title":"VOTE: Vision-Language-Action Optimization with Trajectory Ensemble Voting","version":5},"cited_work":{"arxiv_id":"2507.05116","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.05116","snapshot_observed_at":"2026-07-09T05:36:01.255549Z","title":"V ote: vision-language-action optimization with trajectory ensemble voting","venue":"cs.CV","work_id":"577786f7-7545-48fe-b085-1c37abd6a879","year":2025},"citing_paper":{"arxiv_id":"2605.24890","last_updated":"2026-06-08T07:28:33Z","snapshot_observed_at":"2026-08-04T02:11:27.874111Z","submitted_at":"2026-05-24T06:28:53Z","title":"QuoVLA: Quotient Space for Vision-Language-Action Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T12:09:12.124995Z"},"links":{"cited_paper":"/paper/2507.05116","citing_paper":"/paper/2605.24890"},"observation_digest":"sha256:54ac150a9c89714fb79da5864e94bdc8a043e8b7ae9aee0363cc5a6ba3460484","observation_id":"67461939-4baf-44ee-9823-4ca56e207122","resolution":{"observed_at":"2026-07-09T02:20:27.970763Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05116","last_updated":"2026-07-08T17:09:24Z","snapshot_observed_at":"2026-07-11T23:19:14.611343Z","submitted_at":"2025-07-07T15:30:55Z","title":"VOTE: Vision-Language-Action Optimization with Trajectory Ensemble Voting","version":5},"cited_work":{"arxiv_id":"2507.05116","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.05116","snapshot_observed_at":"2026-07-09T05:36:01.255549Z","title":"V ote: vision-language-action optimization with trajectory ensemble voting","venue":"cs.CV","work_id":"577786f7-7545-48fe-b085-1c37abd6a879","year":2025},"citing_paper":{"arxiv_id":"2606.05254","last_updated":"2026-06-03T15:29:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-03T15:29:57Z","title":"Flash-WAM: Modality-Aware Distillation for World Action Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T07:00:46.566214Z"},"links":{"cited_paper":"/paper/2507.05116","citing_paper":"/paper/2606.05254"},"observation_digest":"sha256:f4f3306031d70860c852357689d95ecf5a640241cca7a44eb66c94bea21e2eb1","observation_id":"94f44ce0-77ed-42e4-926c-ddb43c4e056c","resolution":{"observed_at":"2026-07-09T02:20:27.970763Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05116","last_updated":"2026-07-08T17:09:24Z","snapshot_observed_at":"2026-07-11T23:19:14.611343Z","submitted_at":"2025-07-07T15:30:55Z","title":"VOTE: Vision-Language-Action Optimization with Trajectory Ensemble Voting","version":5},"cited_work":{"arxiv_id":"2507.05116","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.05116","snapshot_observed_at":"2026-07-09T05:36:01.255549Z","title":"V ote: vision-language-action optimization with trajectory ensemble voting","venue":"cs.CV","work_id":"577786f7-7545-48fe-b085-1c37abd6a879","year":2025},"citing_paper":{"arxiv_id":"2607.07608","last_updated":"2026-07-08T16:26:06Z","snapshot_observed_at":"2026-07-11T23:20:16.411671Z","submitted_at":"2026-07-08T16:26:06Z","title":"Dual Latent Memory in Vision-Language-Action Models for Robotic Manipulation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-09T05:29:36.753268Z"},"links":{"cited_paper":"/paper/2507.05116","citing_paper":"/paper/2607.07608"},"observation_digest":"sha256:3bea3235e4d51adc4897fad365732a889fafc7e077879720c20f2e529ed8fee7","observation_id":"0816f57c-57e0-4f93-ad67-b58a0d26215a","resolution":{"observed_at":"2026-07-09T05:36:01.257153Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.05116/citation-record","integrity":"/paper/2507.05116/integrity","json":"/paper/2507.05116/citation-record.json","paper":"/paper/2507.05116"},"outbound":[],"paper":{"arxiv_id":"2507.05116","last_updated":"2026-07-08T17:09:24Z","latest_version":5,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-11T23:19:14.611343Z","submitted_at":"2025-07-07T15:30:55Z","title":"VOTE: Vision-Language-Action Optimization with Trajectory Ensemble Voting"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2507.05116."}