{"as_of":"2026-08-11T13:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:78caef7559adc89867024862cd1b5b0727518bd0ac1da743354a68f905eac502","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T19:48:08.135556Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T05:27:40.599122Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2204.03638","last_updated":"2022-09-24T20:49:24Z","snapshot_observed_at":"2026-07-06T12:57:58.716731Z","submitted_at":"2022-04-07T17:59:02Z","title":"Long Video Generation with Time-Agnostic VQGAN and Time-Sensitive Transformer","version":4},"cited_work":{"arxiv_id":"2204.03638","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2204.03638","snapshot_observed_at":"2026-07-03T05:27:40.599122Z","title":"2022 , journal =","venue":null,"work_id":"83e7f977-dcd8-45f3-9605-f4fd41758d04","year":2022},"citing_paper":{"arxiv_id":"2205.15868","last_updated":"2022-05-29T19:02:15Z","snapshot_observed_at":"2026-07-06T13:15:58.303738Z","submitted_at":"2022-05-29T19:02:15Z","title":"CogVideo: Large-scale Pretraining for Text-to-Video Generation via Transformers","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-11T12:24:30.071822Z"},"links":{"cited_paper":"/paper/2204.03638","citing_paper":"/paper/2205.15868"},"observation_digest":"sha256:89d7024469ae5062fbc2146ffda978ceb2fd08f178b94298ec1247dcf63b0216","observation_id":"67597821-2c1c-4a13-bc11-49e7516a0a3f","resolution":{"observed_at":"2026-05-11T12:24:30.181165Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.03638","last_updated":"2022-09-24T20:49:24Z","snapshot_observed_at":"2026-07-06T12:57:58.716731Z","submitted_at":"2022-04-07T17:59:02Z","title":"Long Video Generation with Time-Agnostic VQGAN and Time-Sensitive Transformer","version":4},"cited_work":{"arxiv_id":"2204.03638","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2204.03638","snapshot_observed_at":"2026-07-03T05:27:40.599122Z","title":"2022 , journal =","venue":null,"work_id":"83e7f977-dcd8-45f3-9605-f4fd41758d04","year":2022},"citing_paper":{"arxiv_id":"2211.13221","last_updated":"2023-03-20T17:29:45Z","snapshot_observed_at":"2026-08-10T00:51:42.114461Z","submitted_at":"2022-11-23T18:58:39Z","title":"Latent Video Diffusion Models for High-Fidelity Long Video Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T04:27:43.019940Z"},"links":{"cited_paper":"/paper/2204.03638","citing_paper":"/paper/2211.13221"},"observation_digest":"sha256:f4cf619fbbce57c099c4e2843d262f01a3f28287d780015f05d4af1d8595f3b6","observation_id":"bf101d3b-eb4d-475f-845f-be1e5a5b6298","resolution":{"observed_at":"2026-05-15T04:27:43.184025Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.03638","last_updated":"2022-09-24T20:49:24Z","snapshot_observed_at":"2026-07-06T12:57:58.716731Z","submitted_at":"2022-04-07T17:59:02Z","title":"Long Video Generation with Time-Agnostic VQGAN and Time-Sensitive Transformer","version":4},"cited_work":{"arxiv_id":"2204.03638","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2204.03638","snapshot_observed_at":"2026-07-03T05:27:40.599122Z","title":"2022 , journal =","venue":null,"work_id":"83e7f977-dcd8-45f3-9605-f4fd41758d04","year":2022},"citing_paper":{"arxiv_id":"2308.08089","last_updated":"2023-08-16T01:43:41Z","snapshot_observed_at":"2026-07-06T16:06:38.424057Z","submitted_at":"2023-08-16T01:43:41Z","title":"DragNUWA: Fine-grained Control in Video Generation by Integrating Text, Image, and Trajectory","version":1},"reference_index":257,"source":"arxiv_source","source_observed_at":"2026-05-20T13:03:57.828598Z"},"links":{"cited_paper":"/paper/2204.03638","citing_paper":"/paper/2308.08089"},"observation_digest":"sha256:3ad6c1db152b82a46484e007fb127f7e0a0c66c44371dcdce48d3edb3058460d","observation_id":"ba484fe8-d9f4-41a7-aac1-6934ac3fe784","resolution":{"observed_at":"2026-05-20T13:03:58.193602Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.03638","last_updated":"2022-09-24T20:49:24Z","snapshot_observed_at":"2026-07-06T12:57:58.716731Z","submitted_at":"2022-04-07T17:59:02Z","title":"Long Video Generation with Time-Agnostic VQGAN and Time-Sensitive Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.03638","snapshot_observed_at":"2026-08-10T19:48:08.135556Z","title":"Long video generation with time-agnostic vqgan and time-sensitive transformer, 2022.https://arxiv.org/abs/2204.03638","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.09755","last_updated":"2025-01-16T18:59:04Z","snapshot_observed_at":"2026-08-10T19:39:02.178593Z","submitted_at":"2025-01-16T18:59:04Z","title":"Learnings from Scaling Visual Tokenizers for Reconstruction and Generation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-10T19:48:08.135556Z"},"links":{"cited_paper":"/paper/2204.03638","citing_paper":"/paper/2501.09755"},"observation_digest":"sha256:8ea72b94c4d0524a334398c290b238c1f58d46a641a3952e2a92eca30551aaf0","observation_id":"b843b63e-f2d6-4f91-82ec-6f8eff33911f","resolution":{"observed_at":"2026-08-10T19:48:08.135556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.03638","last_updated":"2022-09-24T20:49:24Z","snapshot_observed_at":"2026-07-06T12:57:58.716731Z","submitted_at":"2022-04-07T17:59:02Z","title":"Long Video Generation with Time-Agnostic VQGAN and Time-Sensitive Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.03638","snapshot_observed_at":"2026-08-10T11:17:24.751477Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-11T12:35:17.875177Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.751477Z"},"links":{"cited_paper":"/paper/2204.03638","citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:9639eb95e36416a5c93aabc3e9adce004fd4423225f86a22aaba5f06cde4778f","observation_id":"08a1bc57-c39a-47f3-943f-1c15b1c1d9e3","resolution":{"observed_at":"2026-08-10T11:17:24.751477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.03638","last_updated":"2022-09-24T20:49:24Z","snapshot_observed_at":"2026-07-06T12:57:58.716731Z","submitted_at":"2022-04-07T17:59:02Z","title":"Long Video Generation with Time-Agnostic VQGAN and Time-Sensitive Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.03638","snapshot_observed_at":"2026-08-09T19:21:56.208010Z","title":"Gu, S., Chen, D., Bao, J., Wen, F., Zhang, B., Chen, D., Yuan, L., and Guo, B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00382","last_updated":"2025-02-01T09:41:01Z","snapshot_observed_at":"2026-08-09T21:47:44.085629Z","submitted_at":"2025-02-01T09:41:01Z","title":"Masked Generative Nested Transformers with Decode Time Scaling","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T19:21:56.208010Z"},"links":{"cited_paper":"/paper/2204.03638","citing_paper":"/paper/2502.00382"},"observation_digest":"sha256:0d7ecd7c46130aaccec0021d766cc1cc2f1f551c1ebd83a9a6d27c5ce72b7dd7","observation_id":"63c1c70b-3ba1-4d43-a700-cf71dd1f3ea8","resolution":{"observed_at":"2026-08-09T19:21:56.208010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.03638","last_updated":"2022-09-24T20:49:24Z","snapshot_observed_at":"2026-07-06T12:57:58.716731Z","submitted_at":"2022-04-07T17:59:02Z","title":"Long Video Generation with Time-Agnostic VQGAN and Time-Sensitive Transformer","version":4},"cited_work":{"arxiv_id":"2204.03638","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2204.03638","snapshot_observed_at":"2026-07-03T05:27:40.599122Z","title":"2022 , journal =","venue":null,"work_id":"83e7f977-dcd8-45f3-9605-f4fd41758d04","year":2022},"citing_paper":{"arxiv_id":"2604.09168","last_updated":"2026-07-23T07:42:32Z","snapshot_observed_at":"2026-08-06T11:01:30.223629Z","submitted_at":"2026-04-10T09:53:27Z","title":"ELT: Elastic Looped Transformers for Visual Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T17:19:22.543462Z"},"links":{"cited_paper":"/paper/2204.03638","citing_paper":"/paper/2604.09168"},"observation_digest":"sha256:947764ceb82cdb28cf7970a3b66903e4ce7e9ec97c7dc8c0953c6ed99a499592","observation_id":"29ece65a-06f1-4bd6-829d-197a19a08a39","resolution":{"observed_at":"2026-05-11T07:06:00.145124Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.03638","last_updated":"2022-09-24T20:49:24Z","snapshot_observed_at":"2026-07-06T12:57:58.716731Z","submitted_at":"2022-04-07T17:59:02Z","title":"Long Video Generation with Time-Agnostic VQGAN and Time-Sensitive Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.03638","snapshot_observed_at":"2026-08-02T16:35:03.177296Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2604.09168","last_updated":"2026-07-23T07:42:32Z","snapshot_observed_at":"2026-08-06T11:01:30.223629Z","submitted_at":"2026-04-10T09:53:27Z","title":"ELT: Elastic Looped Transformers for Visual Generation","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T16:35:03.177296Z"},"links":{"cited_paper":"/paper/2204.03638","citing_paper":"/paper/2604.09168"},"observation_digest":"sha256:ba60723ab2a8b1f632ce162e34ea1e083b2f88be8064e87b0e7fa700ea1a15ac","observation_id":"1ec01d9a-d528-431f-9ab0-a04bfdc268dc","resolution":{"observed_at":"2026-08-02T16:35:03.177296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.03638","last_updated":"2022-09-24T20:49:24Z","snapshot_observed_at":"2026-07-06T12:57:58.716731Z","submitted_at":"2022-04-07T17:59:02Z","title":"Long Video Generation with Time-Agnostic VQGAN and Time-Sensitive Transformer","version":4},"cited_work":{"arxiv_id":"2204.03638","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2204.03638","snapshot_observed_at":"2026-07-03T05:27:40.599122Z","title":"2022 , journal =","venue":null,"work_id":"83e7f977-dcd8-45f3-9605-f4fd41758d04","year":2022},"citing_paper":{"arxiv_id":"2606.11096","last_updated":"2026-06-09T16:53:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-09T16:53:30Z","title":"IDEAL: In-DEpth ALignment Makes A Discrete Representation AutoEncoder","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T13:10:14.308216Z"},"links":{"cited_paper":"/paper/2204.03638","citing_paper":"/paper/2606.11096"},"observation_digest":"sha256:4a5f964ad1027b3d11cdc46755e85f890a97dea64955d5cb6a2f4368fdee07e6","observation_id":"f0612a31-cdc8-4585-8221-891bffb55bc5","resolution":{"observed_at":"2026-07-03T05:27:40.600866Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.03638","last_updated":"2022-09-24T20:49:24Z","snapshot_observed_at":"2026-07-06T12:57:58.716731Z","submitted_at":"2022-04-07T17:59:02Z","title":"Long Video Generation with Time-Agnostic VQGAN and Time-Sensitive Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.03638","snapshot_observed_at":"2026-08-02T02:51:44.235751Z","title":"Long video generation with time-agnostic vqgan and time-sensitive transformer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14088","last_updated":"2026-07-15T17:59:23Z","snapshot_observed_at":"2026-08-03T01:46:55.792689Z","submitted_at":"2026-07-15T17:59:23Z","title":"VideoRAE: Taming Video Foundation Models for Generative Modeling via Representation Autoencoders","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-02T02:51:44.235751Z"},"links":{"cited_paper":"/paper/2204.03638","citing_paper":"/paper/2607.14088"},"observation_digest":"sha256:0b3105d4e6504321b574d9c75e489b9bf33e2f443cd833b984d4c68b716469d5","observation_id":"0f3d40c5-5f23-40b6-ad25-193b00edfbd8","resolution":{"observed_at":"2026-08-02T02:51:44.235751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.03638","last_updated":"2022-09-24T20:49:24Z","snapshot_observed_at":"2026-07-06T12:57:58.716731Z","submitted_at":"2022-04-07T17:59:02Z","title":"Long Video Generation with Time-Agnostic VQGAN and Time-Sensitive Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.03638","snapshot_observed_at":"2026-08-01T17:45:00.981903Z","title":"arXiv preprint arXiv:2204.03638 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17560","last_updated":"2026-07-20T05:09:36Z","snapshot_observed_at":"2026-08-05T13:38:45.921055Z","submitted_at":"2026-07-20T05:09:36Z","title":"Reinforcement Learning: From Algorithms To Foundation Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-01T17:45:00.981903Z"},"links":{"cited_paper":"/paper/2204.03638","citing_paper":"/paper/2607.17560"},"observation_digest":"sha256:57007ef348d228920d010aa53ef4c3aaadb43221cd15f9695823a0c6131788a1","observation_id":"6662caa6-708a-44db-99c8-e9d3f65da8b8","resolution":{"observed_at":"2026-08-01T17:45:00.981903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2204.03638/citation-record","integrity":"/paper/2204.03638/integrity","json":"/paper/2204.03638/citation-record.json","paper":"/paper/2204.03638"},"outbound":[],"paper":{"arxiv_id":"2204.03638","last_updated":"2022-09-24T20:49:24Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T12:57:58.716731Z","submitted_at":"2022-04-07T17:59:02Z","title":"Long Video Generation with Time-Agnostic VQGAN and Time-Sensitive Transformer"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2204.03638."}