{"as_of":"2026-08-05T06:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5837f4151f830790c6ced817c8c6aac5f0d7195365dc4a08938c9594de237519","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T10:37:41.277166Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-25T05:46:39.977556Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.02095","last_updated":"2025-08-06T19:21:50Z","snapshot_observed_at":"2026-07-06T22:07:16.776694Z","submitted_at":"2025-08-04T06:06:06Z","title":"VLM4D: Towards Spatiotemporal Awareness in Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02095","snapshot_observed_at":"2026-08-04T10:37:41.277166Z","title":"Vlm4d: Towards spatiotemporal awareness in vision language models.arXiv preprint arXiv:2508.02095,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.09606","last_updated":"2026-05-26T09:02:06Z","snapshot_observed_at":"2026-08-04T10:37:28.653177Z","submitted_at":"2025-10-10T17:59:46Z","title":"SpaceVista: All-Scale Visual Spatial Reasoning from mm to km","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T10:37:41.277166Z"},"links":{"cited_paper":"/paper/2508.02095","citing_paper":"/paper/2510.09606"},"observation_digest":"sha256:84983fa26c717ef66b7592aa62c11ab86dc18bb9c19d345c1b929b253b9622a2","observation_id":"52903efc-fbc8-49af-b197-4bdc8b134722","resolution":{"observed_at":"2026-08-04T10:37:41.277166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02095","last_updated":"2025-08-06T19:21:50Z","snapshot_observed_at":"2026-07-06T22:07:16.776694Z","submitted_at":"2025-08-04T06:06:06Z","title":"VLM4D: Towards Spatiotemporal Awareness in Vision Language Models","version":2},"cited_work":{"arxiv_id":"2508.02095","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.02095","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vlm4d: Towards spatiotemporal awareness in vision language models","venue":null,"work_id":"fd121458-5940-4f1f-8f85-380ea73e3a51","year":2025},"citing_paper":{"arxiv_id":"2511.00062","last_updated":"2026-02-24T21:52:50Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-10-28T22:44:13Z","title":"World Simulation with Video Foundation Models for Physical AI","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-12T23:01:13.546110Z"},"links":{"cited_paper":"/paper/2508.02095","citing_paper":"/paper/2511.00062"},"observation_digest":"sha256:2f9b95fc8a1bfe09a823e94132cefc6205dcc5cc75f0131c906f3f57c855eb75","observation_id":"b9d7bddd-8785-4d5c-bb5e-1031eda8cec5","resolution":{"observed_at":"2026-05-12T23:01:13.883037Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02095","last_updated":"2025-08-06T19:21:50Z","snapshot_observed_at":"2026-07-06T22:07:16.776694Z","submitted_at":"2025-08-04T06:06:06Z","title":"VLM4D: Towards Spatiotemporal Awareness in Vision Language Models","version":2},"cited_work":{"arxiv_id":"2508.02095","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.02095","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vlm4d: Towards spatiotemporal awareness in vision language models","venue":null,"work_id":"fd121458-5940-4f1f-8f85-380ea73e3a51","year":2025},"citing_paper":{"arxiv_id":"2511.21471","last_updated":"2026-05-07T07:59:46Z","snapshot_observed_at":"2026-08-02T23:27:20.204280Z","submitted_at":"2025-11-26T15:04:18Z","title":"SpatialBench: Benchmarking Multimodal Large Language Models for Spatial Cognition","version":4},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-17T04:54:59.903644Z"},"links":{"cited_paper":"/paper/2508.02095","citing_paper":"/paper/2511.21471"},"observation_digest":"sha256:654fb12054a71cb4ba5fcf358a2182546f936fac9be32e3eb94ea49866ccb877","observation_id":"b428e44c-bccd-4e54-903b-c1e3f9ef82b3","resolution":{"observed_at":"2026-05-17T04:59:04.226528Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02095","last_updated":"2025-08-06T19:21:50Z","snapshot_observed_at":"2026-07-06T22:07:16.776694Z","submitted_at":"2025-08-04T06:06:06Z","title":"VLM4D: Towards Spatiotemporal Awareness in Vision Language Models","version":2},"cited_work":{"arxiv_id":"2508.02095","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.02095","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vlm4d: Towards spatiotemporal awareness in vision language models","venue":null,"work_id":"fd121458-5940-4f1f-8f85-380ea73e3a51","year":2025},"citing_paper":{"arxiv_id":"2605.23045","last_updated":"2026-07-15T09:38:22Z","snapshot_observed_at":"2026-08-02T18:10:47.588058Z","submitted_at":"2026-05-21T21:22:42Z","title":"The TIME Machine: On The Power of Motion for Efficient Perception","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-25T05:40:33.752341Z"},"links":{"cited_paper":"/paper/2508.02095","citing_paper":"/paper/2605.23045"},"observation_digest":"sha256:90a0faaf1967f6bfb259b3ac93e0e545ecb4a4f347e2d834a49d2c9ddb6cebd6","observation_id":"261994e6-167f-4bdc-b274-17dfea95c1c4","resolution":{"observed_at":"2026-05-25T05:46:39.980679Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02095","last_updated":"2025-08-06T19:21:50Z","snapshot_observed_at":"2026-07-06T22:07:16.776694Z","submitted_at":"2025-08-04T06:06:06Z","title":"VLM4D: Towards Spatiotemporal Awareness in Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02095","snapshot_observed_at":"2026-07-15T11:06:23.089564Z","title":"Vlm4d: Towards spatiotemporal awareness in vision language models.arXiv preprint arXiv:2508.02095, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.23045","last_updated":"2026-07-15T09:38:22Z","snapshot_observed_at":"2026-08-02T18:10:47.588058Z","submitted_at":"2026-05-21T21:22:42Z","title":"The TIME Machine: On The Power of Motion for Efficient Perception","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-15T11:06:23.089564Z"},"links":{"cited_paper":"/paper/2508.02095","citing_paper":"/paper/2605.23045"},"observation_digest":"sha256:6bf6815aceb59c946ef6eb9dfdbc1357891bc98e8cac4b73ea53f4a974161523","observation_id":"febf3a8a-1ac7-4b17-b709-d0e8ce2faf8b","resolution":{"observed_at":"2026-07-15T11:06:23.089564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02095","last_updated":"2025-08-06T19:21:50Z","snapshot_observed_at":"2026-07-06T22:07:16.776694Z","submitted_at":"2025-08-04T06:06:06Z","title":"VLM4D: Towards Spatiotemporal Awareness in Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02095","snapshot_observed_at":"2026-08-02T13:27:52.231964Z","title":"Vlm4d: Towards spatiotemporal awareness in vision language models.arXiv preprint arXiv:2508.02095, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.23045","last_updated":"2026-07-15T09:38:22Z","snapshot_observed_at":"2026-08-02T18:10:47.588058Z","submitted_at":"2026-05-21T21:22:42Z","title":"The TIME Machine: On The Power of Motion for Efficient Perception","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-02T13:27:52.231964Z"},"links":{"cited_paper":"/paper/2508.02095","citing_paper":"/paper/2605.23045"},"observation_digest":"sha256:a78d60387f969908cb045aa5f25c44cde4e2c822e0d7d301f8f4e839ddbf16c1","observation_id":"493af086-78f3-47ac-ba1f-8cd2174e622e","resolution":{"observed_at":"2026-08-02T13:27:52.231964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.02095/citation-record","integrity":"/paper/2508.02095/integrity","json":"/paper/2508.02095/citation-record.json","paper":"/paper/2508.02095"},"outbound":[],"paper":{"arxiv_id":"2508.02095","last_updated":"2025-08-06T19:21:50Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T22:07:16.776694Z","submitted_at":"2025-08-04T06:06:06Z","title":"VLM4D: Towards Spatiotemporal Awareness in Vision Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2508.02095."}