{"as_of":"2026-08-08T10:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f3ebc571d75840e31dc8f46d08e6b07dac3793e857ca1bce6cd072e00e08b74d","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:22:19.245131Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:57:21.407355Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T09:45:40.325116Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.22167","snapshot_observed_at":"2026-08-06T19:57:21.407355Z","title":"Q-vdit: Towards accurate quantization and distillation of video-generation diffusion transformers,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04290","last_updated":"2025-07-06T08:16:50Z","snapshot_observed_at":"2026-08-08T08:13:06.170937Z","submitted_at":"2025-07-06T08:16:50Z","title":"MPQ-DMv2: Flexible Residual Mixed Precision Quantization for Low-Bit Diffusion Models with Temporal Distillation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:21.407355Z"},"links":{"cited_paper":"/paper/2505.22167","citing_paper":"/paper/2507.04290"},"observation_digest":"sha256:7e8186a5ff9cb3db74bf8139ec772c2282b62733afdbdd0b8677371562ba1840","observation_id":"86e26931-433c-4b03-9323-d7a8c20173eb","resolution":{"observed_at":"2026-08-06T19:57:21.407355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.22167","snapshot_observed_at":"2026-08-05T15:32:34.035597Z","title":"arXiv preprint arXiv:2505.22167 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02581","last_updated":"2026-06-18T10:35:57Z","snapshot_observed_at":"2026-08-06T21:17:50.512643Z","submitted_at":"2025-08-27T09:46:50Z","title":"Charting the Future of Scholarly Knowledge with AI: A Community Perspective","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T15:32:34.035597Z"},"links":{"cited_paper":"/paper/2505.22167","citing_paper":"/paper/2509.02581"},"observation_digest":"sha256:dd6db616b0b60d7c14f537cda30aed5cd81e0c73f3bf877b9eeeacf791214f84","observation_id":"70c3ba28-5907-4e58-81f2-9d6de20f1b70","resolution":{"observed_at":"2026-08-05T15:32:34.035597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.22167","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.22167","snapshot_observed_at":"2026-07-01T09:45:40.325116Z","title":"Q-vdit: Towards accurate quantization and distillation of video-generation diffusion transformers","venue":null,"work_id":"50b11121-a334-439d-bea9-d77d57d0861f","year":2025},"citing_paper":{"arxiv_id":"2604.15911","last_updated":"2026-04-17T10:11:39Z","snapshot_observed_at":"2026-07-06T23:03:21.422544Z","submitted_at":"2026-04-17T10:11:39Z","title":"Efficient Video Diffusion Models: Advancements and Challenges","version":1},"reference_index":268,"source":"pdf_text","source_observed_at":"2026-05-10T08:28:29.706249Z"},"links":{"cited_paper":"/paper/2505.22167","citing_paper":"/paper/2604.15911"},"observation_digest":"sha256:ac2664e1de6ef9dbdd1fda355e0ca7830081a244f7aa15a9c38b3dd712c734bb","observation_id":"339c94ae-8a93-4a77-bc8f-8a0a3936726e","resolution":{"observed_at":"2026-05-10T09:03:26.011053Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.22167","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.22167","snapshot_observed_at":"2026-07-01T09:45:40.325116Z","title":"Q-vdit: Towards accurate quantization and distillation of video-generation diffusion transformers","venue":null,"work_id":"50b11121-a334-439d-bea9-d77d57d0861f","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T15:40:03.605239Z"},"links":{"cited_paper":"/paper/2505.22167","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:79035c0edd9109f9f64b875eb8f025cd9fa996c8cdbafe313c5e550b9018e565","observation_id":"e50a9651-5348-45c8-8bf9-5e9b24e45328","resolution":{"observed_at":"2026-05-11T10:06:01.664270Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.22167","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.22167","snapshot_observed_at":"2026-07-01T09:45:40.325116Z","title":"Q-vdit: Towards accurate quantization and distillation of video-generation diffusion transformers","venue":null,"work_id":"50b11121-a334-439d-bea9-d77d57d0861f","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2505.22167","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:b32f74a9328d22527a2774055ef807cdc90ab929c41da05e58713af2175f1313","observation_id":"c2f1e0ec-12c9-459a-ac92-6bb3a2cbdbc5","resolution":{"observed_at":"2026-05-15T07:19:49.953112Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.22167","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.22167","snapshot_observed_at":"2026-07-01T09:45:40.325116Z","title":"Q-vdit: Towards accurate quantization and distillation of video-generation diffusion transformers","venue":null,"work_id":"50b11121-a334-439d-bea9-d77d57d0861f","year":2025},"citing_paper":{"arxiv_id":"2605.12431","last_updated":"2026-05-12T17:27:56Z","snapshot_observed_at":"2026-08-06T07:19:18.552294Z","submitted_at":"2026-05-12T17:27:56Z","title":"GaitProtector: Impersonation-Driven Gait De-Identification via Training-Free Diffusion Latent Optimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T06:38:08.198271Z"},"links":{"cited_paper":"/paper/2505.22167","citing_paper":"/paper/2605.12431"},"observation_digest":"sha256:a64c91e2d12547d69237a7cf66f6f957268a514bcef6d463e723c27ee6f0ac1a","observation_id":"96c9f718-ccb3-4199-a61b-182df46185dc","resolution":{"observed_at":"2026-05-13T06:42:26.399267Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.22167","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.22167","snapshot_observed_at":"2026-07-01T09:45:40.325116Z","title":"Q-vdit: Towards accurate quantization and distillation of video-generation diffusion transformers","venue":null,"work_id":"50b11121-a334-439d-bea9-d77d57d0861f","year":2025},"citing_paper":{"arxiv_id":"2605.16003","last_updated":"2026-05-15T14:33:09Z","snapshot_observed_at":"2026-07-06T23:27:15.745896Z","submitted_at":"2026-05-15T14:33:09Z","title":"Echo-Forcing: A Scene Memory Framework for Interactive Long Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T20:02:45.505404Z"},"links":{"cited_paper":"/paper/2505.22167","citing_paper":"/paper/2605.16003"},"observation_digest":"sha256:ca20d65bcfed9d820e0d8e9572f54048d2a384eee52531d859b936f5c840ba8b","observation_id":"2a6325cd-d752-4a01-9ac2-00aa73dbf8bd","resolution":{"observed_at":"2026-05-20T20:03:43.577064Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.22167","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.22167","snapshot_observed_at":"2026-07-01T09:45:40.325116Z","title":"Q-vdit: Towards accurate quantization and distillation of video-generation diffusion transformers","venue":null,"work_id":"50b11121-a334-439d-bea9-d77d57d0861f","year":2025},"citing_paper":{"arxiv_id":"2606.30849","last_updated":"2026-06-29T19:26:13Z","snapshot_observed_at":"2026-08-02T00:44:38.626792Z","submitted_at":"2026-06-29T19:26:13Z","title":"SyncCache: Exploiting Asymmetric Dynamics for Fast Audio-Driven Portrait Animation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-01T06:13:11.504526Z"},"links":{"cited_paper":"/paper/2505.22167","citing_paper":"/paper/2606.30849"},"observation_digest":"sha256:0482bfc8db6f401ce41510db379df38aa09ca42222a20ae295ef35462f47f5de","observation_id":"d33759d6-44da-41f4-aa79-f6fde75df3c1","resolution":{"observed_at":"2026-07-01T09:45:40.326505Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.22167/citation-record","integrity":"/paper/2505.22167/integrity","json":"/paper/2505.22167/citation-record.json","paper":"/paper/2505.22167"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.00456","last_updated":"2024-10-29T11:09:12Z","snapshot_observed_at":"2026-08-05T10:45:45.389337Z","submitted_at":"2024-03-30T19:20:06Z","title":"QuaRot: Outlier-Free 4-Bit Inference in Rotated LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00456","snapshot_observed_at":"2026-08-07T13:22:14.388940Z","title":"L., Li, B., Cameron, P., Jaggi, M., Alistarh, D., Hoefler, T., and Hensman, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:14.388940Z"},"links":{"cited_paper":"/paper/2404.00456","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:ceb754b5539239224e3083cfcd3e8d3d24773eadb8a9571e5ea251cb319082af","observation_id":"42d44208-69e9-4fcc-9441-8c13ebb60427","resolution":{"observed_at":"2026-08-07T13:22:14.388940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:24.475315Z","title":"Flux.1, 2024","venue":null,"work_id":"4c56cada-a887-4084-87b0-508caf0c52c9","year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:14.478875Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:e3c780827d28927c8be6789895ba9bc0476cf79f6497b2b1b62fdf60d691be10","observation_id":"40c4f2ad-234e-4d18-8350-a871dd7ea002","resolution":{"observed_at":"2026-08-07T13:22:24.533266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:24.270201Z","title":"W., Fidler, S., and Kreis, K","venue":null,"work_id":"85c377f7-8436-4d3e-9522-7f270ef67030","year":2023},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:14.595248Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:ab4af98f41483791f4040adff8f0b80a7af6859c80e741d707205b87aa447ca1","observation_id":"225abec8-677d-4cbd-9e17-2370230b5db9","resolution":{"observed_at":"2026-08-07T13:22:24.371012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17343","last_updated":"2024-11-19T09:58:07Z","snapshot_observed_at":"2026-07-06T18:36:34.369503Z","submitted_at":"2024-06-25T07:57:27Z","title":"Q-DiT: Accurate Post-Training Quantization for Diffusion Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17343","snapshot_observed_at":"2026-08-07T13:22:14.679938Z","title":"Q-dit: Accurate post-training quantization for diffusion transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:14.679938Z"},"links":{"cited_paper":"/paper/2406.17343","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:154a6cba58e3f9a9cce80060e54ca1aa32fae3e5aa431b6608f7bbff9d3b50e0","observation_id":"90373be9-13dd-4fbe-aeaf-99e779030ca8","resolution":{"observed_at":"2026-08-07T13:22:14.679938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:24.122383Z","title":"T., Mittal, S., Emani, M., Vishwanath, V., and Somani, A","venue":null,"work_id":"e8b23dbe-3ca7-418f-9d09-79c61cbfe31f","year":2023},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:14.773041Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:dc11cfdba05ffc0d817ad1e79bca6caa270cde4d52f70be64b0eb7b757cb38ed","observation_id":"99e10386-786a-42a3-bc20-fa9ac6979d47","resolution":{"observed_at":"2026-08-07T13:22:24.195991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:14.879626Z","title":"and Nichol, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:14.879626Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:77a2c4fb98a1e3dc75404104c9cce8ddef48184f803acd1ab753cfa1457bb953","observation_id":"8b92dc1c-2ac6-4c30-98ef-1d7928aa49b8","resolution":{"observed_at":"2026-08-07T13:22:14.879626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:23.868485Z","title":"Reg-ptq: Regression-specialized post-training quantization for fully quantized object detector","venue":null,"work_id":"d1d6f44e-3f12-4c71-991f-7a55979af7bb","year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:14.973295Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:e915e6831970e7826b8dd8dde15ee9f9142aeed917526fe45bf0b6d19115071a","observation_id":"73e66e29-b3e5-4e4a-8028-ce67f7e2491f","resolution":{"observed_at":"2026-08-07T13:22:23.986454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:15.169329Z","title":"Perceptual quality assessment of smartphone photography","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:15.169329Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:4be3e6c86bccbfa5e79e4901a7732e505a34f7e9ed705b565535b1fe89bfd908","observation_id":"9efc581a-8040-4922-967a-61e21c4e9258","resolution":{"observed_at":"2026-08-07T13:22:15.169329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:23.707975Z","title":"Relational diffusion distillation for efficient image generation","venue":null,"work_id":"d325fec4-afd7-4949-9ef8-94847a31a198","year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:15.276248Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:e21ba98426b50a36c2ee96c7b096758686c5d9ad4159e7709672c38b095793ab","observation_id":"f7efd17d-7b02-4aca-85f0-c890982605ed","resolution":{"observed_at":"2026-08-07T13:22:23.769463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:23.532053Z","title":"Mpq-dm: Mixed precision quantization for extremely low bit diffusion models","venue":null,"work_id":"0684c79f-4ccd-44e1-a32f-ea6a4a5aaf3e","year":2025},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:15.443773Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:e70e84c951c24464e12e548b99a2bcac4262a6b76e0a61254cf8185623327014","observation_id":"90bfd641-b19e-4967-94b9-43bd724397d4","resolution":{"observed_at":"2026-08-07T13:22:23.620119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:23.369513Z","title":"W., and Keutzer, K","venue":null,"work_id":"82e1de93-4397-4997-9bb9-b09b5dfcb0ca","year":2022},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:15.615845Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:6534457b873cb90e58c18247c81e5901d71e1cb2b949c5c227e709a5a1bd8f2e","observation_id":"d3258729-ce03-4162-9886-8b38b4d43b53","resolution":{"observed_at":"2026-08-07T13:22:23.473188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:15.742538Z","title":"Delving deep into rectifiers: Surpassing human-level performance on imagenet classification","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:15.742538Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:eb6fcb7dbc384e5eef17631a4c72c410e01d7da2205015297912c71496b7d1f3","observation_id":"6d9e08ff-bd26-4e8e-ab81-cfdec2384fd8","resolution":{"observed_at":"2026-08-07T13:22:15.742538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03270","last_updated":"2024-04-13T07:33:57Z","snapshot_observed_at":"2026-07-06T16:27:58.898609Z","submitted_at":"2023-10-05T02:51:53Z","title":"EfficientDM: Efficient Quantization-Aware Fine-Tuning of Low-Bit Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03270","snapshot_observed_at":"2026-08-07T13:22:15.860417Z","title":"Efficientdm: Efficient quantization-aware fine-tuning of low-bit diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:15.860417Z"},"links":{"cited_paper":"/paper/2310.03270","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:55b7391c8b6f7308a4af9929bc5733bc3a3c973fd4e7fd59b1449704096af748","observation_id":"52e4babf-c224-4b40-9737-37d8f88dc76d","resolution":{"observed_at":"2026-08-07T13:22:15.860417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:23.170622Z","title":"Ptqd: Accurate post-training quantization for diffusion models","venue":null,"work_id":"b899968a-22a7-4560-8f8a-896bb9aaf72c","year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:15.968162Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:c8a8989bd4a21415fc2b354af0c92dffc146cbacd2f1f88a91e92f661cb1da76","observation_id":"eae52490-2fda-4090-9e12-7bfd982d02ef","resolution":{"observed_at":"2026-08-07T13:22:23.240856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:16.117647Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:16.117647Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:b69ce780db5ab2a820b94b1fec5818339109f59a8309787e72f73fffc9f2f843","observation_id":"b3a443b6-5165-4796-855c-53475dda801e","resolution":{"observed_at":"2026-08-07T13:22:16.117647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:23.033486Z","title":"Open-sora, 2024","venue":null,"work_id":"7a597827-0488-403e-b0b6-275c7275a09b","year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:16.208110Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:2cbdfff90f5cb241c29e539438278238235d7b77a16134b309793c8ad2500b18","observation_id":"323a40c9-3090-4006-b106-74b51a9da9b4","resolution":{"observed_at":"2026-08-07T13:22:23.083920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T13:22:16.361887Z","title":"J., Shen, Y., Wallis, P., Allen-Zhu, Z., Li, Y., Wang, S., Wang, L., and Chen, W","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:16.361887Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:6b401c7853ca7a5b54972a2e02ac3404f16d20d3325b540b4c009d51c3a93efd","observation_id":"2d97c5c7-ea68-43b1-be7e-0f6ed0eed961","resolution":{"observed_at":"2026-08-07T13:22:16.361887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:22.851761Z","title":"Tfmq-dm: Temporal feature maintenance quantization for diffusion models","venue":null,"work_id":"ec178f4f-531a-47a4-a407-7c3130af2123","year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:16.515893Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:c02865b323f9fadcfcb0775392aa92733e4028df663949afa4485d89fb47d2e7","observation_id":"6d543b78-e708-4246-8000-54d87bda162f","resolution":{"observed_at":"2026-08-07T13:22:22.952337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:22.604442Z","title":"Vbench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":"46f9d4e7-bc77-4a8f-b0c5-bb4fef0b7015","year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:16.627765Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:9217d057f17c651265bdf4dfc244a27ce3e677eba268153df5890dddac601cba","observation_id":"aab944f5-3a73-49af-b2da-dd4fbd82466a","resolution":{"observed_at":"2026-08-07T13:22:22.742449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:16.762681Z","title":"Musiq: Multi-scale image quality transformer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:16.762681Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:8622492821d4ac1adc253d0ce1ee625fae359486d2076bee642d5bcce98e65f5","observation_id":"a1a72d73-8869-4817-90fd-b8f191d0d3f1","resolution":{"observed_at":"2026-08-07T13:22:16.762681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:22.387442Z","title":"Aesthetic-predictor, 2022","venue":null,"work_id":"f2df11ab-55b2-4e92-a308-529a0a561000","year":2022},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:16.897187Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:7028c8f173909ee5dc0a482c7ace312d89a9b4d7c17cfbf132bdfb406cb35abb","observation_id":"7bd28cb6-65a6-43ee-8f50-7c8d2285d6c6","resolution":{"observed_at":"2026-08-07T13:22:22.494392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:17.043124Z","title":"Svdqunat: Absorbing outliers by low-rank components for 4-bit diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:17.043124Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:a9ecdf6d32fe12ea81f3423192a08cdf5d22fb90d3cbdd989c01943f8ffe5ea0","observation_id":"92e45033-8877-45b2-ad9a-d33be3e662cc","resolution":{"observed_at":"2026-08-07T13:22:17.043124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:22.157239Z","title":"Q-diffusion: Quantizing diffusion models","venue":null,"work_id":"2c76a5a0-ac7b-4501-a529-4d7f8f67160c","year":2023},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:17.149968Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:a1513f663b493863a46066b377348b25a41ba6e20b8bf70c0eea8d41305c1fb3","observation_id":"408c8b91-7402-41b8-bae1-7f2d1ac272ae","resolution":{"observed_at":"2026-08-07T13:22:22.248683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:21.965145Z","title":"Q-dm: An efficient low-bit quantized diffusion model","venue":null,"work_id":"9a156367-8797-4137-9618-f6d55493a718","year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:17.254209Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:7208f7464856d10a7a5e743362b58e39c65b49cac18c144469131085e635e1be","observation_id":"a05a1368-8788-4dd2-b4a5-4ae7cbfc5ad1","resolution":{"observed_at":"2026-08-07T13:22:22.065546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:21.675852Z","title":"Diffbir: Toward blind image restoration with generative diffusion prior","venue":null,"work_id":"855b0ecd-9d7e-4f6a-a415-2bde715c2f77","year":2025},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:17.404799Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:2994192ba91ef97cc918ffe45d20481d0a87107476c5e84eb3632d8540d5a1c1","observation_id":"72106f91-22a9-43b2-8c18-76f86e94a4b2","resolution":{"observed_at":"2026-08-07T13:22:21.826663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:21.432379Z","title":"Evalcrafter: Benchmarking and evaluating large video generation models","venue":null,"work_id":"cd626a0a-f144-4006-809f-6290e1b3565c","year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:17.521124Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:099d4d54afab567831af3161a392c7e7588023af22c6342afbb8c9384fcfd9ad","observation_id":"d0f5f311-aa17-428b-b22d-c72ae042fd5d","resolution":{"observed_at":"2026-08-07T13:22:21.555393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:21.181587Z","title":"Reactnet: Towards precise binary neural network with generalized activation functions","venue":null,"work_id":"8b9b88cd-3d93-4d87-b9c3-342bbca157e9","year":2020},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:17.638786Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:b01b9824bda179524b79dfdae5cbefc4f2cfcef586f3640baf03e7b2d07d27c6","observation_id":"37d4edee-b4ad-4b64-9c50-f5b904eff26e","resolution":{"observed_at":"2026-08-07T13:22:21.299496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14854","last_updated":"2025-04-06T10:46:47Z","snapshot_observed_at":"2026-08-04T01:43:39.476803Z","submitted_at":"2024-05-23T17:57:24Z","title":"TerDiT: Ternary Diffusion Models with Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14854","snapshot_observed_at":"2026-08-07T13:22:17.757779Z","title":"Terdit: Ternary diffusion models with transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:17.757779Z"},"links":{"cited_paper":"/paper/2405.14854","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:f88ccfb15ae6dc59b552edf46b8984736799e099833f3572ede5fb3ead1a7358","observation_id":"15fca04d-d514-431a-b9d1-c6a51528e5d3","resolution":{"observed_at":"2026-08-07T13:22:17.757779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03048","last_updated":"2025-05-01T09:40:21Z","snapshot_observed_at":"2026-08-02T13:01:06.918463Z","submitted_at":"2024-01-05T19:55:15Z","title":"Latte: Latent Diffusion Transformer for Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03048","snapshot_observed_at":"2026-08-07T13:22:17.824915Z","title":"Latte: Latent diffusion transformer for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:17.824915Z"},"links":{"cited_paper":"/paper/2401.03048","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:e4b9c66466c54d58259953bbb5b098a5152e81917ca1adcfd9fa9173ecc917b3","observation_id":"cbdb5888-dff9-421e-be28-64ef064057a5","resolution":{"observed_at":"2026-08-07T13:22:17.824915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:17.905892Z","title":"and Xie, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:17.905892Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:b23a93d6c30f3656dff26a5afa6c8e7b644ec72156e354068ab6924d7761396b","observation_id":"4c4a7afb-cf45-486d-b404-0b2e52be06df","resolution":{"observed_at":"2026-08-07T13:22:17.905892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:20.918785Z","title":"Compression of convolutional neural networks: A short survey","venue":null,"work_id":"f0100ff5-c322-4bbf-83b8-92a320f633b3","year":2018},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:17.964318Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:af4f9ab80b0687342cfae5cc2a845e4ecc4b62fc29cd91f6305125215f85b5de","observation_id":"d142ae07-177d-4d20-be8e-4e839ce5207a","resolution":{"observed_at":"2026-08-07T13:22:21.007247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:20.763747Z","title":"Forward and backward information retention for accurate binary neural networks","venue":null,"work_id":"f50016bf-c769-44a8-b8ec-7476db1bcca7","year":2020},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.014265Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:3a4a0451f686e481bc6ab0e5b0ebe43456f06c632a1669f740260597ef56a3d0","observation_id":"ad7da9c4-8d16-4dfc-b56b-cbed9b599890","resolution":{"observed_at":"2026-08-07T13:22:20.831361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:18.065263Z","title":"W., Hallacy, C., Ramesh, A., Goh, G., Agarwal, S., Sastry, G., Askell, A., Mishkin, P., Clark, J., et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.065263Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:7c305bafc6a6623ee6ef311f97dc3a2597e44686402215fd63b2828b3edb6719","observation_id":"20986bf5-0d0c-4d9a-acb2-97619d7785a8","resolution":{"observed_at":"2026-08-07T13:22:18.065263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:18.138370Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.138370Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:bc9ad9e0b60e22478304e4032591b24b3dcf0c9dcd60b41057434d2ccf1de0d0","observation_id":"3e533fcf-643a-49b7-955c-41e150957a42","resolution":{"observed_at":"2026-08-07T13:22:18.138370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:20.629777Z","title":"Post-training quantization on diffusion models","venue":null,"work_id":"0c075dc6-223e-4571-88c8-4297d67df158","year":1972},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.222690Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:d161e30ac27182231b46c6088566d28714b23ec82dd42a07c42315aa198c7572","observation_id":"9dfc85ce-922a-48ab-aaa9-327edbf0e9ef","resolution":{"observed_at":"2026-08-07T13:22:20.687033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-07T13:22:18.279026Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.279026Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:7c36cfad6ab0a85324cd5f189209d4e31416c9adcc43baa38b175ef4df95592d","observation_id":"f2e6ac20-41a5-46cd-87d4-a3c0bb051fe5","resolution":{"observed_at":"2026-08-07T13:22:18.279026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-07-06T03:01:10.229407Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-07T13:22:18.342697Z","title":"Ucf101: A dataset of 101 human actions classes from videos in the wild","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.342697Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:a9608a349d4095298570f2834aad1c4be111a2d80bd0a4b2d40d6bc1fc6a8781","observation_id":"0dc5d63a-890d-4b28-815d-add6d080260c","resolution":{"observed_at":"2026-08-07T13:22:18.342697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:18.406400Z","title":"and Deng, J","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.406400Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:fb9d5429e7f005fa256183657489844a3c5346fd542dea892dd09f825590759f","observation_id":"dbfd2305-85e4-402a-8188-a3b9bcdc8462","resolution":{"observed_at":"2026-08-07T13:22:18.406400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03666","last_updated":"2025-07-15T15:33:13Z","snapshot_observed_at":"2026-08-03T14:10:40.641611Z","submitted_at":"2024-02-06T03:39:44Z","title":"QuEST: Low-bit Diffusion Model Quantization via Efficient Selective Finetuning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03666","snapshot_observed_at":"2026-08-07T13:22:18.467794Z","title":"Quest: Low-bit diffusion model quantization via efficient selective finetuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.467794Z"},"links":{"cited_paper":"/paper/2402.03666","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:30d9acde0b6b31bf602a27439a6a461d226295e50feb42a4c62a0c49aa2f7d05","observation_id":"3f693415-93eb-4e22-8899-e416ba6e79aa","resolution":{"observed_at":"2026-08-07T13:22:18.467794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:20.484568Z","title":"C., and Loy, C","venue":null,"work_id":"7e5dc4a8-939c-4800-ac4f-2ebea9df226e","year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.547599Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:a6762e0dd9c76cccd30b857e64b248f234456e59ae696d8ffbbc1200f8d15f5a","observation_id":"5f5434b8-0cf7-4697-ba23-6297227cb4bd","resolution":{"observed_at":"2026-08-07T13:22:20.556048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06942","last_updated":"2024-01-04T05:00:34Z","snapshot_observed_at":"2026-07-06T15:53:46.393481Z","submitted_at":"2023-07-13T17:58:32Z","title":"InternVid: A Large-scale Video-Text Dataset for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06942","snapshot_observed_at":"2026-08-07T13:22:18.607441Z","title":"Internvid: A large-scale video-text dataset for multimodal understanding and generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.607441Z"},"links":{"cited_paper":"/paper/2307.06942","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:0893d9d4fada0e9b4d7ae8e323a03d7afc8f0b5be1ba1676362bdc71dc2aa434","observation_id":"7d3d1fc9-29a7-43ef-ba22-2208dff8b6e8","resolution":{"observed_at":"2026-08-07T13:22:18.607441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:20.298276Z","title":"Exploring video quality assessment on user generated contents from aesthetic and technical perspectives","venue":null,"work_id":"00021da7-123d-403e-a070-74145b13020e","year":2023},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.667166Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:cb6056556accd01e7f1f0578d640e0058472a0f0c5b6d12319ec6c4d4d3ba59c","observation_id":"4e226ceb-9057-44eb-9210-88343ad97e01","resolution":{"observed_at":"2026-08-07T13:22:20.374069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16005","last_updated":"2024-10-17T15:28:15Z","snapshot_observed_at":"2026-08-03T01:09:43.526278Z","submitted_at":"2024-05-25T02:02:08Z","title":"PTQ4DiT: Post-training Quantization for Diffusion Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16005","snapshot_observed_at":"2026-08-07T13:22:18.742485Z","title":"Ptq4dit: Post-training quantization for diffusion transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.742485Z"},"links":{"cited_paper":"/paper/2405.16005","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:66923a91ded41510977e93eb4bd1de2879034e7afdf449fb8002800b0dcc80e4","observation_id":"67ca7b77-e310-4a14-a0ef-dda0cd4b0cf3","resolution":{"observed_at":"2026-08-07T13:22:18.742485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:20.163043Z","title":"Seesr: Towards semantics-aware real-world image super-resolution","venue":null,"work_id":"141f452d-0e97-49e2-a2db-95dce605b148","year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.828047Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:a8d13a99423f5081432eb01c4e593674f67aed2f8637414dc582261278bedbda","observation_id":"9be99d43-2628-4b21-87e9-ee4b8becf7bf","resolution":{"observed_at":"2026-08-07T13:22:20.257269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:19.999363Z","title":"Smoothquant: Accurate and efficient post-training quantization for large language models","venue":null,"work_id":"61e29950-0ebb-43e6-8567-417b166be364","year":2023},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.883254Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:733ddb2a1252277e218e8e5a5d5b03aa2d5b780042c877b678464fac5f9fb3b7","observation_id":"319346f7-cb07-4548-961e-a5ac96d4e5cc","resolution":{"observed_at":"2026-08-07T13:22:20.070306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:19.826067Z","title":"Cross-image relational knowledge distillation for semantic segmentation","venue":null,"work_id":"b26393a0-5c42-401f-a97f-d51d8ac1be32","year":2022},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:18.927942Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:b17e23976985cbbe55bfceb5959db026b104cc3e0c4fb8b9c0bf101e021118af","observation_id":"e4478665-50af-4895-a7bc-93f0e3507d7b","resolution":{"observed_at":"2026-08-07T13:22:19.915750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.01428","last_updated":"2025-04-02T12:45:49Z","snapshot_observed_at":"2026-08-07T16:14:46.034578Z","submitted_at":"2025-04-02T12:45:49Z","title":"Multi-party Collaborative Attention Control for Image Customization","version":1},"cited_work":{"arxiv_id":"2505.01428","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.01428","snapshot_observed_at":"2026-08-07T13:22:19.392798Z","title":"Multi-party Collaborative Attention Control for Image Customization","venue":"cs.CV","work_id":"dfe8d002-0a7b-465f-91f4-3fd94d836c9c","year":2025},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:19.008369Z"},"links":{"cited_paper":"/paper/2505.01428","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:ccd89a6609175e07e12f447ad1736b580d06c9f9bc659555fad97c220c9584bc","observation_id":"8647242a-2de7-427f-9024-6d18698c105e","resolution":{"observed_at":"2026-08-07T13:22:19.445271Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02540","last_updated":"2025-02-22T16:29:03Z","snapshot_observed_at":"2026-07-06T18:25:22.852874Z","submitted_at":"2024-06-04T17:57:10Z","title":"ViDiT-Q: Efficient and Accurate Quantization of Diffusion Transformers for Image and Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02540","snapshot_observed_at":"2026-08-07T13:22:19.011966Z","title":"Vidit-q: Efficient and accurate quantization of diffusion transformers for image and video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:19.011966Z"},"links":{"cited_paper":"/paper/2406.02540","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:7b2bf39f284667988eb4ff53957e6423c862cc905db83425092f0162461e03fd","observation_id":"2d4d10d1-c9d0-4362-90da-73bc24428fa1","resolution":{"observed_at":"2026-08-07T13:22:19.011966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:19.685111Z","title":"Mixdq: Memory-efficient few-step text-to-image diffusion models with metric-decoupled mixed precision quantization","venue":null,"work_id":"63dd8474-ad62-49f2-8b39-f76d70600365","year":2025},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:19.016977Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:2f476119a7a9a4f7fabb28b756cd8e608a77005086c15f81c724a4b6541589ab","observation_id":"fc47f83c-143d-43d3-941e-21785bf0e418","resolution":{"observed_at":"2026-08-07T13:22:19.779782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05926","last_updated":"2024-12-08T12:45:21Z","snapshot_observed_at":"2026-07-06T20:03:29.510169Z","submitted_at":"2024-12-08T12:45:21Z","title":"BiDM: Pushing the Limit of Quantization for Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05926","snapshot_observed_at":"2026-08-07T13:22:19.082312Z","title":"Bidm: Pushing the limit of quantization for diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:19.082312Z"},"links":{"cited_paper":"/paper/2412.05926","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:12285e4a696c667c201e32319032c9cad6bfa3495d5410e12969191cf4184a0f","observation_id":"001445c0-a054-4550-9768-f08cd23d8106","resolution":{"observed_at":"2026-08-07T13:22:19.082312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05662","last_updated":"2025-01-31T07:11:43Z","snapshot_observed_at":"2026-07-06T17:57:19.117933Z","submitted_at":"2024-04-08T16:46:25Z","title":"BinaryDM: Accurate Weight Binarization for Efficient Diffusion Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05662","snapshot_observed_at":"2026-08-07T13:22:19.150573Z","title":"Binarydm: Towards accurate binarization of diffusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:19.150573Z"},"links":{"cited_paper":"/paper/2404.05662","citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:075535eb321f93cab5c1820385f8ee69367d63c8ba9d7a924f6d6b121607b853","observation_id":"4ab4c250-2d33-4397-8f28-0e6eaee11392","resolution":{"observed_at":"2026-08-07T13:22:19.150573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:22:19.245131Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T13:22:19.245131Z"},"links":{"citing_paper":"/paper/2505.22167"},"observation_digest":"sha256:40dff3201e6ecd4835d4e30fd027068efe7522fe0f5926280f2139aedd3b7460","observation_id":"7fe76973-9da6-49ee-b460-20caadec97c8","resolution":{"observed_at":"2026-08-07T13:22:19.245131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T13:11:09.143863Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":1,"verified_fuzzy":26},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 8 inbound Pith citation observations for arXiv:2505.22167."}