{"as_of":"2026-08-11T06:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fa441a191c2448e167070d8da79c73bbb024c819c83578d2400da52f2c64bbc1","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T14:58:26.525113Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T17:10:25.159616Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.08725","last_updated":"2025-05-13T16:36:51Z","snapshot_observed_at":"2026-08-07T15:45:41.816606Z","submitted_at":"2025-05-13T16:36:51Z","title":"Extending Large Vision-Language Model for Diverse Interactive Tasks in Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.08725","snapshot_observed_at":"2026-08-10T14:58:26.525113Z","title":"Extending large vision-language model for diverse interac- tive tasks in autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2501.14729","last_updated":"2025-08-13T09:10:30Z","snapshot_observed_at":"2026-08-10T14:48:56.693920Z","submitted_at":"2025-01-24T18:59:51Z","title":"HERMES: A Unified Self-Driving World Model for Simultaneous 3D Scene Understanding and Generation","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-10T14:58:26.525113Z"},"links":{"cited_paper":"/paper/2505.08725","citing_paper":"/paper/2501.14729"},"observation_digest":"sha256:28c9a80b276f2c6ca7599bb74f830121fd450a116b801ac00b73f9a3f8b82f88","observation_id":"155de858-f381-424b-992f-64d33929750e","resolution":{"observed_at":"2026-08-10T14:58:26.525113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08725","last_updated":"2025-05-13T16:36:51Z","snapshot_observed_at":"2026-08-07T15:45:41.816606Z","submitted_at":"2025-05-13T16:36:51Z","title":"Extending Large Vision-Language Model for Diverse Interactive Tasks in Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.08725","snapshot_observed_at":"2026-08-06T21:31:04.895175Z","title":"Extending large vision- language model for diverse interactive tasks in autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.24044","last_updated":"2025-06-30T16:50:02Z","snapshot_observed_at":"2026-08-07T14:33:37.793120Z","submitted_at":"2025-06-30T16:50:02Z","title":"A Survey on Vision-Language-Action Models for Autonomous Driving","version":1},"reference_index":160,"source":"pdf_text","source_observed_at":"2026-08-06T21:31:04.895175Z"},"links":{"cited_paper":"/paper/2505.08725","citing_paper":"/paper/2506.24044"},"observation_digest":"sha256:30b882cff6ab1f095dc8dfa4a0a3d8aa1009587afe98e57baece670792b2ae64","observation_id":"e782e27f-1a09-42ab-bbfc-eb2796f514da","resolution":{"observed_at":"2026-08-06T21:31:04.895175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08725","last_updated":"2025-05-13T16:36:51Z","snapshot_observed_at":"2026-08-07T15:45:41.816606Z","submitted_at":"2025-05-13T16:36:51Z","title":"Extending Large Vision-Language Model for Diverse Interactive Tasks in Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.08725","snapshot_observed_at":"2026-08-03T16:27:29.207219Z","title":"Extending large vision-language model for diverse interactive tasks in autonomous driving.arXiv preprint arXiv:2505.08725, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-10T09:41:13.055186Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:29.207219Z"},"links":{"cited_paper":"/paper/2505.08725","citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:d7c7ddee95e0d2ed1d883233469a65b24e54d3049cf8079715a06b228ba7a318","observation_id":"1e6634ed-9689-4ee4-83a8-c1f5137017f3","resolution":{"observed_at":"2026-08-03T16:27:29.207219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08725","last_updated":"2025-05-13T16:36:51Z","snapshot_observed_at":"2026-08-07T15:45:41.816606Z","submitted_at":"2025-05-13T16:36:51Z","title":"Extending Large Vision-Language Model for Diverse Interactive Tasks in Autonomous Driving","version":1},"cited_work":{"arxiv_id":"2505.08725","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.08725","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Extending large vision-language model for diverse interactive tasks in autonomous driving","venue":null,"work_id":"85272d91-8588-4e97-9460-c30a2adfa147","year":2025},"citing_paper":{"arxiv_id":"2512.23180","last_updated":"2026-05-16T07:53:20Z","snapshot_observed_at":"2026-08-03T04:34:56.955960Z","submitted_at":"2025-12-29T03:40:05Z","title":"GaussianDWM: 3D Gaussian Driving World Model for Unified Scene Understanding and Multi-Modal Generation","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-21T17:06:34.398973Z"},"links":{"cited_paper":"/paper/2505.08725","citing_paper":"/paper/2512.23180"},"observation_digest":"sha256:d7d577eab382784a004074d7f9cdf99ebd2b139abfd84a6c228f1e328bff866b","observation_id":"a561ba29-651a-49e2-bdc8-6f643e12bc5e","resolution":{"observed_at":"2026-05-21T17:10:25.162426Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08725","last_updated":"2025-05-13T16:36:51Z","snapshot_observed_at":"2026-08-07T15:45:41.816606Z","submitted_at":"2025-05-13T16:36:51Z","title":"Extending Large Vision-Language Model for Diverse Interactive Tasks in Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.08725","snapshot_observed_at":"2026-08-02T21:19:52.534231Z","title":"Extending large vision-language model for diverse interactivetasksinautonomousdriving[J].arXivpreprintarXiv:2505.08725,2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.20575","last_updated":"2026-07-18T07:58:59Z","snapshot_observed_at":"2026-08-10T16:12:16.799623Z","submitted_at":"2026-02-24T05:57:18Z","title":"An interactive enhanced driving dataset for autonomous driving","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-02T21:19:52.534231Z"},"links":{"cited_paper":"/paper/2505.08725","citing_paper":"/paper/2602.20575"},"observation_digest":"sha256:8f9b3c6caef836d24269681a8066497c50dc1a53845ab25de206e84877af3609","observation_id":"42e96adf-e3de-4b3a-932b-4faf347be58e","resolution":{"observed_at":"2026-08-02T21:19:52.534231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08725","last_updated":"2025-05-13T16:36:51Z","snapshot_observed_at":"2026-08-07T15:45:41.816606Z","submitted_at":"2025-05-13T16:36:51Z","title":"Extending Large Vision-Language Model for Diverse Interactive Tasks in Autonomous Driving","version":1},"cited_work":{"arxiv_id":"2505.08725","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.08725","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Extending large vision-language model for diverse interactive tasks in autonomous driving","venue":null,"work_id":"85272d91-8588-4e97-9460-c30a2adfa147","year":2025},"citing_paper":{"arxiv_id":"2604.28196","last_updated":"2026-04-30T17:59:58Z","snapshot_observed_at":"2026-07-06T23:13:29.310140Z","submitted_at":"2026-04-30T17:59:58Z","title":"HERMES++: Toward a Unified Driving World Model for 3D Scene Understanding and Generation","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-07T05:31:59.676725Z"},"links":{"cited_paper":"/paper/2505.08725","citing_paper":"/paper/2604.28196"},"observation_digest":"sha256:4cfab859d8731f2d2b609dcfdf3c26ec98b8aa2722285af75b248b93173f0195","observation_id":"57171dc6-a398-4e4b-ab3f-c89d872d27c7","resolution":{"observed_at":"2026-05-12T10:36:30.079222Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.08725/citation-record","integrity":"/paper/2505.08725/integrity","json":"/paper/2505.08725/citation-record.json","paper":"/paper/2505.08725"},"outbound":[],"paper":{"arxiv_id":"2505.08725","last_updated":"2025-05-13T16:36:51Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T15:45:41.816606Z","submitted_at":"2025-05-13T16:36:51Z","title":"Extending Large Vision-Language Model for Diverse Interactive Tasks in Autonomous Driving"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2505.08725."}