{"as_of":"2026-08-06T03:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e9937055ce073198f5e31524fb166e4802efd7c1c537d8e064691eaa58316336","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T18:43:43.563351Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T00:26:39.628379Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.15212","last_updated":"2025-07-09T16:58:07Z","snapshot_observed_at":"2026-07-06T20:10:24.217625Z","submitted_at":"2024-12-19T18:59:51Z","title":"Scaling 4D Representations","version":2},"cited_work":{"arxiv_id":"2412.15212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.15212","snapshot_observed_at":"2026-07-10T00:26:39.628379Z","title":"Scaling 4d representations","venue":"cs.CV","work_id":"d708ea1a-01d4-401d-ada6-b36a346e7bf9","year":2024},"citing_paper":{"arxiv_id":"2506.09985","last_updated":"2025-06-11T17:57:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-11T17:57:09Z","title":"V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-11T00:33:50.471804Z"},"links":{"cited_paper":"/paper/2412.15212","citing_paper":"/paper/2506.09985"},"observation_digest":"sha256:6b7e2dc4d17d29631de84da7bf92475401c3044900dbccc7cb2fc1408aec5e3d","observation_id":"3f95764d-646c-414b-9d2c-358331e7599a","resolution":{"observed_at":"2026-05-11T00:33:50.730654Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15212","last_updated":"2025-07-09T16:58:07Z","snapshot_observed_at":"2026-07-06T20:10:24.217625Z","submitted_at":"2024-12-19T18:59:51Z","title":"Scaling 4D Representations","version":2},"cited_work":{"arxiv_id":"2412.15212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.15212","snapshot_observed_at":"2026-07-10T00:26:39.628379Z","title":"Scaling 4d representations","venue":"cs.CV","work_id":"d708ea1a-01d4-401d-ada6-b36a346e7bf9","year":2024},"citing_paper":{"arxiv_id":"2507.13942","last_updated":"2026-04-15T13:59:47Z","snapshot_observed_at":"2026-07-31T09:25:03.034282Z","submitted_at":"2025-07-18T14:14:19Z","title":"Frozen Forecasting: A Unified Evaluation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-19T03:42:54.620069Z"},"links":{"cited_paper":"/paper/2412.15212","citing_paper":"/paper/2507.13942"},"observation_digest":"sha256:896a045cafcc1c3cdcc6159405cddccd456050c38d023077442903d691cf4f09","observation_id":"987e4f4f-0610-45b9-a150-53cfdb66061e","resolution":{"observed_at":"2026-05-19T03:42:57.307979Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15212","last_updated":"2025-07-09T16:58:07Z","snapshot_observed_at":"2026-07-06T20:10:24.217625Z","submitted_at":"2024-12-19T18:59:51Z","title":"Scaling 4D Representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15212","snapshot_observed_at":"2026-08-03T18:43:43.563351Z","title":"Scal- ing 4d representations.arXiv preprint arXiv:2412.15212,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-03T18:43:41.712073Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:43.563351Z"},"links":{"cited_paper":"/paper/2412.15212","citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:829af3f11ffce3a19cc17b984f739e0a86beda617165fbdb4039babe8d665474","observation_id":"b38649bd-72f1-4353-8d6a-7c3454b70b61","resolution":{"observed_at":"2026-08-03T18:43:43.563351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15212","last_updated":"2025-07-09T16:58:07Z","snapshot_observed_at":"2026-07-06T20:10:24.217625Z","submitted_at":"2024-12-19T18:59:51Z","title":"Scaling 4D Representations","version":2},"cited_work":{"arxiv_id":"2412.15212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.15212","snapshot_observed_at":"2026-07-10T00:26:39.628379Z","title":"Scaling 4d representations","venue":"cs.CV","work_id":"d708ea1a-01d4-401d-ada6-b36a346e7bf9","year":2024},"citing_paper":{"arxiv_id":"2604.27448","last_updated":"2026-04-30T05:43:10Z","snapshot_observed_at":"2026-07-06T23:12:57.730833Z","submitted_at":"2026-04-30T05:43:10Z","title":"LA-Pose: Latent Action Pretraining Meets Pose Estimation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-07T08:57:27.503349Z"},"links":{"cited_paper":"/paper/2412.15212","citing_paper":"/paper/2604.27448"},"observation_digest":"sha256:958d443790d35fe3293912725543549c160f053bd4573453e93e96f1383b2003","observation_id":"17bdcb93-8b3e-47f5-953b-7f19a69424b2","resolution":{"observed_at":"2026-05-12T09:51:28.839842Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15212","last_updated":"2025-07-09T16:58:07Z","snapshot_observed_at":"2026-07-06T20:10:24.217625Z","submitted_at":"2024-12-19T18:59:51Z","title":"Scaling 4D Representations","version":2},"cited_work":{"arxiv_id":"2412.15212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.15212","snapshot_observed_at":"2026-07-10T00:26:39.628379Z","title":"Scaling 4d representations","venue":"cs.CV","work_id":"d708ea1a-01d4-401d-ada6-b36a346e7bf9","year":2024},"citing_paper":{"arxiv_id":"2605.19137","last_updated":"2026-05-18T21:35:09Z","snapshot_observed_at":"2026-07-06T23:29:57.003383Z","submitted_at":"2026-05-18T21:35:09Z","title":"Towards Data-Efficient Video Pre-training with Frozen Image Foundation Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-20T10:28:42.027773Z"},"links":{"cited_paper":"/paper/2412.15212","citing_paper":"/paper/2605.19137"},"observation_digest":"sha256:1348388c80a30cdcfde4440ca8cc9a607b95fb5a882930ae6b1f59b04b9d0ccc","observation_id":"7f655eea-b5fc-4541-8a3f-5952a9598b38","resolution":{"observed_at":"2026-05-20T10:33:13.031523Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15212","last_updated":"2025-07-09T16:58:07Z","snapshot_observed_at":"2026-07-06T20:10:24.217625Z","submitted_at":"2024-12-19T18:59:51Z","title":"Scaling 4D Representations","version":2},"cited_work":{"arxiv_id":"2412.15212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.15212","snapshot_observed_at":"2026-07-10T00:26:39.628379Z","title":"Scaling 4d representations","venue":"cs.CV","work_id":"d708ea1a-01d4-401d-ada6-b36a346e7bf9","year":2024},"citing_paper":{"arxiv_id":"2606.03837","last_updated":"2026-06-02T16:19:58Z","snapshot_observed_at":"2026-08-03T07:26:33.859542Z","submitted_at":"2026-06-02T16:19:58Z","title":"Where Do We (Not) Need Temporal Context in Low-Resource Video Task Adaptation?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T10:31:10.409674Z"},"links":{"cited_paper":"/paper/2412.15212","citing_paper":"/paper/2606.03837"},"observation_digest":"sha256:9ee92fd0ac9381d0d5669bf29efab51c362a36645cab4bebd13578387f03c2c0","observation_id":"394c74aa-a514-4f79-96b3-0293b0ebf52c","resolution":{"observed_at":"2026-07-02T02:56:28.965993Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15212","last_updated":"2025-07-09T16:58:07Z","snapshot_observed_at":"2026-07-06T20:10:24.217625Z","submitted_at":"2024-12-19T18:59:51Z","title":"Scaling 4D Representations","version":2},"cited_work":{"arxiv_id":"2412.15212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.15212","snapshot_observed_at":"2026-07-10T00:26:39.628379Z","title":"Scaling 4d representations","venue":"cs.CV","work_id":"d708ea1a-01d4-401d-ada6-b36a346e7bf9","year":2024},"citing_paper":{"arxiv_id":"2607.06856","last_updated":"2026-07-07T23:17:26Z","snapshot_observed_at":"2026-08-06T00:32:20.564348Z","submitted_at":"2026-07-07T23:17:26Z","title":"Gen4U: Unifying Video Generation and Understanding via Diffusion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-10T00:16:43.190961Z"},"links":{"cited_paper":"/paper/2412.15212","citing_paper":"/paper/2607.06856"},"observation_digest":"sha256:091366371abed722167c341fec2c2d9d8a908392bedca8e584178973883bfa9e","observation_id":"a3458577-a4a7-4f4c-a660-a63981166db6","resolution":{"observed_at":"2026-07-10T00:26:39.630147Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15212","last_updated":"2025-07-09T16:58:07Z","snapshot_observed_at":"2026-07-06T20:10:24.217625Z","submitted_at":"2024-12-19T18:59:51Z","title":"Scaling 4D Representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15212","snapshot_observed_at":"2026-08-02T02:49:58.712379Z","title":"Carreira, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14228","last_updated":"2026-07-15T18:00:31Z","snapshot_observed_at":"2026-08-03T05:46:27.339391Z","submitted_at":"2026-07-15T18:00:31Z","title":"SeeSE3: Emergence of 3D Space in Vision Features","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-02T02:49:58.712379Z"},"links":{"cited_paper":"/paper/2412.15212","citing_paper":"/paper/2607.14228"},"observation_digest":"sha256:5106a61ff49dca2cdc4e5906276007cc427ccafadd2d89ce377f14dc0c01a449","observation_id":"50b5a864-d3ae-4dc9-a564-937d49a0c200","resolution":{"observed_at":"2026-08-02T02:49:58.712379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15212","last_updated":"2025-07-09T16:58:07Z","snapshot_observed_at":"2026-07-06T20:10:24.217625Z","submitted_at":"2024-12-19T18:59:51Z","title":"Scaling 4D Representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15212","snapshot_observed_at":"2026-08-01T07:07:43.307749Z","title":"Scaling 4d representations.arXiv preprint arXiv:2412.15212, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21576","last_updated":"2026-07-23T17:55:07Z","snapshot_observed_at":"2026-08-01T07:07:41.854955Z","submitted_at":"2026-07-23T17:55:07Z","title":"Self-Supervised Learning of Structured Dynamics from Videos","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T07:07:43.307749Z"},"links":{"cited_paper":"/paper/2412.15212","citing_paper":"/paper/2607.21576"},"observation_digest":"sha256:c21250eeda4c842d08bd8cd3eb36630eb7ab710595fc8818caa6d20c20daa189","observation_id":"9b3a923d-c9c3-4986-9f24-86606157a485","resolution":{"observed_at":"2026-08-01T07:07:43.307749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.15212/citation-record","integrity":"/paper/2412.15212/integrity","json":"/paper/2412.15212/citation-record.json","paper":"/paper/2412.15212"},"outbound":[],"paper":{"arxiv_id":"2412.15212","last_updated":"2025-07-09T16:58:07Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T20:10:24.217625Z","submitted_at":"2024-12-19T18:59:51Z","title":"Scaling 4D Representations"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2412.15212."}