{"as_of":"2026-08-20T19:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5d6c7b236ec7aa749c72e7cc540dc0f406f8384698162d728bfe7aa29871438a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":17,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:21:29.978421Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T11:38:04.583669Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2106.13195","last_updated":"2021-06-24T17:20:21Z","snapshot_observed_at":"2026-08-18T18:02:38.906795Z","submitted_at":"2021-06-24T17:20:21Z","title":"FitVid: Overfitting in Pixel-Level Video Prediction","version":1},"cited_work":{"arxiv_id":"2106.13195","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2106.13195","snapshot_observed_at":"2026-07-03T11:38:04.583669Z","title":"Fitvid: Overfitting in pixel-level video prediction.arXiv preprint arXiv:2106.13195","venue":null,"work_id":"98b75ffa-1d61-4641-a59f-5967267b7d2c","year":2021},"citing_paper":{"arxiv_id":"2204.03458","last_updated":"2022-06-22T20:22:29Z","snapshot_observed_at":"2026-08-17T13:08:14.312126Z","submitted_at":"2022-04-07T14:08:02Z","title":"Video Diffusion Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T14:38:27.919104Z"},"links":{"cited_paper":"/paper/2106.13195","citing_paper":"/paper/2204.03458"},"observation_digest":"sha256:60ce665b3bba9807c68ef2e5ff751f1646c6e44e8bd5ca0d095d2a72951e9d84","observation_id":"6c18a44a-d8d0-43f6-ace2-7fb804c3be46","resolution":{"observed_at":"2026-05-13T14:38:27.960088Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13195","last_updated":"2021-06-24T17:20:21Z","snapshot_observed_at":"2026-08-18T18:02:38.906795Z","submitted_at":"2021-06-24T17:20:21Z","title":"FitVid: Overfitting in Pixel-Level Video Prediction","version":1},"cited_work":{"arxiv_id":"2106.13195","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2106.13195","snapshot_observed_at":"2026-07-03T11:38:04.583669Z","title":"Fitvid: Overfitting in pixel-level video prediction.arXiv preprint arXiv:2106.13195","venue":null,"work_id":"98b75ffa-1d61-4641-a59f-5967267b7d2c","year":2021},"citing_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-08-18T00:41:06.039123Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-11T03:31:08.155347Z"},"links":{"cited_paper":"/paper/2106.13195","citing_paper":"/paper/2210.02303"},"observation_digest":"sha256:1837d146c7bae45c0db724425aa4654024adcf4afd1649e9403d43b971f0a9ee","observation_id":"f482da99-14b8-4e1d-b1e9-5ca8a5b3665e","resolution":{"observed_at":"2026-05-11T03:31:08.192650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13195","last_updated":"2021-06-24T17:20:21Z","snapshot_observed_at":"2026-08-18T18:02:38.906795Z","submitted_at":"2021-06-24T17:20:21Z","title":"FitVid: Overfitting in Pixel-Level Video Prediction","version":1},"cited_work":{"arxiv_id":"2106.13195","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2106.13195","snapshot_observed_at":"2026-07-03T11:38:04.583669Z","title":"Fitvid: Overfitting in pixel-level video prediction.arXiv preprint arXiv:2106.13195","venue":null,"work_id":"98b75ffa-1d61-4641-a59f-5967267b7d2c","year":2021},"citing_paper":{"arxiv_id":"2210.02399","last_updated":"2022-10-05T17:18:28Z","snapshot_observed_at":"2026-08-20T02:03:55.720553Z","submitted_at":"2022-10-05T17:18:28Z","title":"Phenaki: Variable Length Video Generation From Open Domain Textual Description","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-17T01:43:34.024375Z"},"links":{"cited_paper":"/paper/2106.13195","citing_paper":"/paper/2210.02399"},"observation_digest":"sha256:6ffa936f65ce802767c268935ae5e62f8eb91854ab59224d2f64c47bdbbb13ff","observation_id":"aa2f687b-557d-4f0c-aa7b-9ba40bc185f9","resolution":{"observed_at":"2026-05-17T01:43:34.050645Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13195","last_updated":"2021-06-24T17:20:21Z","snapshot_observed_at":"2026-08-18T18:02:38.906795Z","submitted_at":"2021-06-24T17:20:21Z","title":"FitVid: Overfitting in Pixel-Level Video Prediction","version":1},"cited_work":{"arxiv_id":"2106.13195","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2106.13195","snapshot_observed_at":"2026-07-03T11:38:04.583669Z","title":"Fitvid: Overfitting in pixel-level video prediction.arXiv preprint arXiv:2106.13195","venue":null,"work_id":"98b75ffa-1d61-4641-a59f-5967267b7d2c","year":2021},"citing_paper":{"arxiv_id":"2211.11018","last_updated":"2023-05-11T11:23:03Z","snapshot_observed_at":"2026-08-16T05:49:16.026825Z","submitted_at":"2022-11-20T16:40:31Z","title":"MagicVideo: Efficient Video Generation With Latent Diffusion Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T18:47:57.322437Z"},"links":{"cited_paper":"/paper/2106.13195","citing_paper":"/paper/2211.11018"},"observation_digest":"sha256:6b095412d76c4196ea2421a9a8b7ae295063311ae71e6abf9e11fc81aca2219c","observation_id":"abce743b-f5bf-4dc1-b0f0-75f3068540f9","resolution":{"observed_at":"2026-05-15T18:47:57.426709Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13195","last_updated":"2021-06-24T17:20:21Z","snapshot_observed_at":"2026-08-18T18:02:38.906795Z","submitted_at":"2021-06-24T17:20:21Z","title":"FitVid: Overfitting in Pixel-Level Video Prediction","version":1},"cited_work":{"arxiv_id":"2106.13195","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2106.13195","snapshot_observed_at":"2026-07-03T11:38:04.583669Z","title":"Fitvid: Overfitting in pixel-level video prediction.arXiv preprint arXiv:2106.13195","venue":null,"work_id":"98b75ffa-1d61-4641-a59f-5967267b7d2c","year":2021},"citing_paper":{"arxiv_id":"2310.05737","last_updated":"2024-03-29T17:44:41Z","snapshot_observed_at":"2026-08-02T18:23:02.746177Z","submitted_at":"2023-10-09T14:10:29Z","title":"Language Model Beats Diffusion -- Tokenizer is Key to Visual Generation","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-13T20:06:44.480769Z"},"links":{"cited_paper":"/paper/2106.13195","citing_paper":"/paper/2310.05737"},"observation_digest":"sha256:19ca58ee72920a6c2e87454b0e7bb927aa6f3e2d5c6b691c945412914dde1a91","observation_id":"69b97509-1433-41ef-a792-cb9db08b0e5a","resolution":{"observed_at":"2026-05-13T20:06:44.737606Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13195","last_updated":"2021-06-24T17:20:21Z","snapshot_observed_at":"2026-08-18T18:02:38.906795Z","submitted_at":"2021-06-24T17:20:21Z","title":"FitVid: Overfitting in Pixel-Level Video Prediction","version":1},"cited_work":{"arxiv_id":"2106.13195","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2106.13195","snapshot_observed_at":"2026-07-03T11:38:04.583669Z","title":"Fitvid: Overfitting in pixel-level video prediction.arXiv preprint arXiv:2106.13195","venue":null,"work_id":"98b75ffa-1d61-4641-a59f-5967267b7d2c","year":2021},"citing_paper":{"arxiv_id":"2310.10639","last_updated":"2023-10-16T17:57:23Z","snapshot_observed_at":"2026-08-08T13:35:58.479807Z","submitted_at":"2023-10-16T17:57:23Z","title":"Zero-Shot Robotic Manipulation with Pretrained Image-Editing Diffusion Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T05:54:58.940428Z"},"links":{"cited_paper":"/paper/2106.13195","citing_paper":"/paper/2310.10639"},"observation_digest":"sha256:a15ae021de2ba83352167634b458b683d4d45d3d508f458273b34e0ee4867141","observation_id":"3562646d-d0dc-4a2d-ad79-b43e8dc7ea2e","resolution":{"observed_at":"2026-05-16T05:54:59.044933Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13195","last_updated":"2021-06-24T17:20:21Z","snapshot_observed_at":"2026-08-18T18:02:38.906795Z","submitted_at":"2021-06-24T17:20:21Z","title":"FitVid: Overfitting in Pixel-Level Video Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.13195","snapshot_observed_at":"2026-08-12T14:53:01.341460Z","title":"Fitvid: Overfitting in pixel-level video prediction.arXiv preprint arXiv:2106.13195, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.14833","last_updated":"2026-07-03T07:34:00Z","snapshot_observed_at":"2026-08-20T13:43:17.563210Z","submitted_at":"2024-11-22T10:16:35Z","title":"Cell as Point: One-Stage Framework for Efficient Cell Tracking","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T14:53:01.341460Z"},"links":{"cited_paper":"/paper/2106.13195","citing_paper":"/paper/2411.14833"},"observation_digest":"sha256:b8a806c1ac36f566641a9e1f498b8dfd9427792ecf59c8aa320d4292292d288f","observation_id":"b7e0497a-368c-4635-ba60-af7f4c7e5131","resolution":{"observed_at":"2026-08-12T14:53:01.341460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13195","last_updated":"2021-06-24T17:20:21Z","snapshot_observed_at":"2026-08-18T18:02:38.906795Z","submitted_at":"2021-06-24T17:20:21Z","title":"FitVid: Overfitting in Pixel-Level Video Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.13195","snapshot_observed_at":"2026-08-11T21:15:07.339610Z","title":"Fitvid: Overfitting in pixel-level video prediction","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.339610Z"},"links":{"cited_paper":"/paper/2106.13195","citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:0aae9ba693dc2f8dcfbd40aa51acde245cc1161397636122fc6ed6c9ab5e35b4","observation_id":"5ec36a95-9b70-4d7c-9087-5e50c676d990","resolution":{"observed_at":"2026-08-11T21:15:07.339610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13195","last_updated":"2021-06-24T17:20:21Z","snapshot_observed_at":"2026-08-18T18:02:38.906795Z","submitted_at":"2021-06-24T17:20:21Z","title":"FitVid: Overfitting in Pixel-Level Video Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.13195","snapshot_observed_at":"2026-08-11T20:35:18.752749Z","title":"Fitvid: Overfitting in pixel-level video prediction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.05633","last_updated":"2024-12-07T12:11:25Z","snapshot_observed_at":"2026-08-19T11:31:04.818693Z","submitted_at":"2024-12-07T12:11:25Z","title":"Efficient Continuous Video Flow Model for Video Prediction","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-11T20:35:18.752749Z"},"links":{"cited_paper":"/paper/2106.13195","citing_paper":"/paper/2412.05633"},"observation_digest":"sha256:6bf7b775a5cc9ba7b1bd0735ad3101791f131e1768a71fd07b0cb959eb76d557","observation_id":"63bb87c6-876d-4857-82a6-4f2ff2273f44","resolution":{"observed_at":"2026-08-11T20:35:18.752749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13195","last_updated":"2021-06-24T17:20:21Z","snapshot_observed_at":"2026-08-18T18:02:38.906795Z","submitted_at":"2021-06-24T17:20:21Z","title":"FitVid: Overfitting in Pixel-Level Video Prediction","version":1},"cited_work":{"arxiv_id":"2106.13195","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2106.13195","snapshot_observed_at":"2026-07-03T11:38:04.583669Z","title":"Fitvid: Overfitting in pixel-level video prediction.arXiv preprint arXiv:2106.13195","venue":null,"work_id":"98b75ffa-1d61-4641-a59f-5967267b7d2c","year":2021},"citing_paper":{"arxiv_id":"2503.19325","last_updated":"2025-05-18T02:27:31Z","snapshot_observed_at":"2026-08-15T15:00:19.916941Z","submitted_at":"2025-03-25T03:38:06Z","title":"Long-Context Autoregressive Video Modeling with Next-Frame Prediction","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-16T23:05:17.201790Z"},"links":{"cited_paper":"/paper/2106.13195","citing_paper":"/paper/2503.19325"},"observation_digest":"sha256:15fecf25939bbce41fd9667ca747884e23fa438c6c5c91db68776a81c48ec20b","observation_id":"fe3c55c9-84b8-4521-ade6-8839b8b8fb9f","resolution":{"observed_at":"2026-05-16T23:05:17.391798Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13195","last_updated":"2021-06-24T17:20:21Z","snapshot_observed_at":"2026-08-18T18:02:38.906795Z","submitted_at":"2021-06-24T17:20:21Z","title":"FitVid: Overfitting in Pixel-Level Video Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.13195","snapshot_observed_at":"2026-08-15T21:21:29.978421Z","title":"Fitvid: Overfitting in pixel-level video prediction","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.10075","last_updated":"2025-05-15T08:27:16Z","snapshot_observed_at":"2026-08-20T05:07:36.943569Z","submitted_at":"2025-05-15T08:27:16Z","title":"FlowDreamer: A RGB-D World Model with Flow-based Motion Representations for Robot Manipulation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T21:21:29.978421Z"},"links":{"cited_paper":"/paper/2106.13195","citing_paper":"/paper/2505.10075"},"observation_digest":"sha256:0fd55fdb3c290865ddc722f5713d0f6ec31b27d8be7502ff5b56f951373ae5be","observation_id":"c7aa28f1-f9b9-4140-a3fa-8389ad11989d","resolution":{"observed_at":"2026-08-15T21:21:29.978421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13195","last_updated":"2021-06-24T17:20:21Z","snapshot_observed_at":"2026-08-18T18:02:38.906795Z","submitted_at":"2021-06-24T17:20:21Z","title":"FitVid: Overfitting in Pixel-Level Video Prediction","version":1},"cited_work":{"arxiv_id":"2106.13195","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2106.13195","snapshot_observed_at":"2026-07-03T11:38:04.583669Z","title":"Fitvid: Overfitting in pixel-level video prediction.arXiv preprint arXiv:2106.13195","venue":null,"work_id":"98b75ffa-1d61-4641-a59f-5967267b7d2c","year":2021},"citing_paper":{"arxiv_id":"2510.02311","last_updated":"2026-04-13T04:19:16Z","snapshot_observed_at":"2026-08-16T14:40:36.543389Z","submitted_at":"2025-10-02T17:59:50Z","title":"Inferring Dynamic Physical Properties from Video Foundation Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-18T10:08:11.191706Z"},"links":{"cited_paper":"/paper/2106.13195","citing_paper":"/paper/2510.02311"},"observation_digest":"sha256:759b840a04c40d21b6b080934edf7259d116d9da48a9f5afeedb97b08bb89345","observation_id":"25ada730-dc2c-4e25-add8-77e9bf2b3b62","resolution":{"observed_at":"2026-05-18T10:11:14.091739Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13195","last_updated":"2021-06-24T17:20:21Z","snapshot_observed_at":"2026-08-18T18:02:38.906795Z","submitted_at":"2021-06-24T17:20:21Z","title":"FitVid: Overfitting in Pixel-Level Video Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.13195","snapshot_observed_at":"2026-08-03T18:30:01.052327Z","title":"Fitvid: Overfitting in pixel-level video prediction.arXiv preprint arXiv:2106.13195, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2512.05044","last_updated":"2026-07-08T17:50:45Z","snapshot_observed_at":"2026-08-18T10:34:23.122747Z","submitted_at":"2025-12-04T17:59:10Z","title":"Geometry-Aware Single-Image 4D Synthesis via Dense Trajectory Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T18:30:01.052327Z"},"links":{"cited_paper":"/paper/2106.13195","citing_paper":"/paper/2512.05044"},"observation_digest":"sha256:b010f6988ee88e48f9740f1673c3ba09190e6b42383f7d144d2a243efd129b20","observation_id":"a2b64de2-c769-4c68-809f-fd99638de2cb","resolution":{"observed_at":"2026-08-03T18:30:01.052327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13195","last_updated":"2021-06-24T17:20:21Z","snapshot_observed_at":"2026-08-18T18:02:38.906795Z","submitted_at":"2021-06-24T17:20:21Z","title":"FitVid: Overfitting in Pixel-Level Video Prediction","version":1},"cited_work":{"arxiv_id":"2106.13195","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2106.13195","snapshot_observed_at":"2026-07-03T11:38:04.583669Z","title":"Fitvid: Overfitting in pixel-level video prediction.arXiv preprint arXiv:2106.13195","venue":null,"work_id":"98b75ffa-1d61-4641-a59f-5967267b7d2c","year":2021},"citing_paper":{"arxiv_id":"2605.29194","last_updated":"2026-05-28T00:10:45Z","snapshot_observed_at":"2026-08-17T18:14:12.318468Z","submitted_at":"2026-05-28T00:10:45Z","title":"Stochastic Lifting for Generating Trajectories of Stochastic Physical Systems","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T08:48:25.141614Z"},"links":{"cited_paper":"/paper/2106.13195","citing_paper":"/paper/2605.29194"},"observation_digest":"sha256:1963c17f2785f13be1aab93465e84ca55fa427574f3eeebaeacf1e7ba63ba0d6","observation_id":"796d7e21-43de-40bb-9d2e-c90dd14f03bd","resolution":{"observed_at":"2026-06-29T08:53:15.996121Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13195","last_updated":"2021-06-24T17:20:21Z","snapshot_observed_at":"2026-08-18T18:02:38.906795Z","submitted_at":"2021-06-24T17:20:21Z","title":"FitVid: Overfitting in Pixel-Level Video Prediction","version":1},"cited_work":{"arxiv_id":"2106.13195","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2106.13195","snapshot_observed_at":"2026-07-03T11:38:04.583669Z","title":"Fitvid: Overfitting in pixel-level video prediction.arXiv preprint arXiv:2106.13195","venue":null,"work_id":"98b75ffa-1d61-4641-a59f-5967267b7d2c","year":2021},"citing_paper":{"arxiv_id":"2607.02195","last_updated":"2026-07-02T14:03:44Z","snapshot_observed_at":"2026-08-08T00:26:55.177474Z","submitted_at":"2026-07-02T14:03:44Z","title":"Bridge-WA: Predicting Where and How the World Changes for Robotic Action","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-03T11:28:50.286894Z"},"links":{"cited_paper":"/paper/2106.13195","citing_paper":"/paper/2607.02195"},"observation_digest":"sha256:2865d145bcd8c42603f427ca1c21cea0941adc764dfe0eb50e53d0aa4fcce335","observation_id":"04a51190-0d50-4a96-97ca-a72f17930270","resolution":{"observed_at":"2026-07-03T11:38:04.585207Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13195","last_updated":"2021-06-24T17:20:21Z","snapshot_observed_at":"2026-08-18T18:02:38.906795Z","submitted_at":"2021-06-24T17:20:21Z","title":"FitVid: Overfitting in Pixel-Level Video Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.13195","snapshot_observed_at":"2026-08-07T00:13:50.539483Z","title":"FitVid: Overfitting in pixel-level video prediction.arXiv preprint arXiv:2106.13195, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.02713","last_updated":"2026-08-03T17:59:58Z","snapshot_observed_at":"2026-08-19T05:31:42.921754Z","submitted_at":"2026-08-03T17:59:58Z","title":"Quo Vadis, World Modeling?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:50.539483Z"},"links":{"cited_paper":"/paper/2106.13195","citing_paper":"/paper/2608.02713"},"observation_digest":"sha256:41215aa6966372af658eb00916bf3ce8f2e4b24cdd27463387c5a1885d2c0131","observation_id":"e47c69d9-50e8-4966-9a5c-3e5cf2c231d8","resolution":{"observed_at":"2026-08-07T00:13:50.539483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13195","last_updated":"2021-06-24T17:20:21Z","snapshot_observed_at":"2026-08-18T18:02:38.906795Z","submitted_at":"2021-06-24T17:20:21Z","title":"FitVid: Overfitting in Pixel-Level Video Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.13195","snapshot_observed_at":"2026-08-06T19:49:02.076976Z","title":"2021 , eprint =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04653","last_updated":"2026-08-05T10:10:36Z","snapshot_observed_at":"2026-08-20T04:25:50.533584Z","submitted_at":"2026-08-05T10:10:36Z","title":"Overcoming Statistical Bias in Action-Controllable World Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T19:49:02.076976Z"},"links":{"cited_paper":"/paper/2106.13195","citing_paper":"/paper/2608.04653"},"observation_digest":"sha256:ef4cbc9044bcf4c4bb239ebe390540628bcd8a6d6cc18419a7b8612f7d56ffe2","observation_id":"e63d17cc-ab61-4758-b102-ec7bdf1bde34","resolution":{"observed_at":"2026-08-06T19:49:02.076976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2106.13195/citation-record","integrity":"/paper/2106.13195/integrity","json":"/paper/2106.13195/citation-record.json","paper":"/paper/2106.13195"},"outbound":[],"paper":{"arxiv_id":"2106.13195","last_updated":"2021-06-24T17:20:21Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T18:02:38.906795Z","submitted_at":"2021-06-24T17:20:21Z","title":"FitVid: Overfitting in Pixel-Level Video Prediction"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 17 inbound Pith citation observations for arXiv:2106.13195."}