{"as_of":"2026-08-06T03:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a75ed8229093f377e03a2cbcbf6380729dd13ea584f00c38cc786c769ba1c186","coverage":[{"denominator":89,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":89,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T07:16:05.225105Z","state":"measured"},{"denominator":89,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":89,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.01725/citation-record","integrity":"/paper/2605.01725/integrity","json":"/paper/2605.01725/citation-record.json","paper":"/paper/2605.01725"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":"2311.15127","doi":"10.48550/arxiv.2311.15127","metadata_source":"pith","pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","venue":"cs.CV","work_id":"4f68eada-27e3-437a-a2fe-6e4ca524d0d3","year":2023},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:c21b780b389a81927757b001c3c819c9f265a250a7a1875ca306369f0108e649","observation_id":"db32befb-0d8d-4588-87c8-6482658fc18e","resolution":{"observed_at":"2026-05-15T07:19:49.896056Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:24.472993+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:24.472993+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video generation models as world simulators.OpenAI Blog, 1(8):1","venue":null,"work_id":"9da2c350-7ff5-4ba2-98a7-c641ea0ab2bd","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:942f64ebe8164fc39162e8f2cbf285bc966e65e38460112d4eaf50350716572d","observation_id":"3930bfdd-8942-4184-99aa-9b2f52e4a6b2","resolution":{"observed_at":"2026-05-15T07:19:50.898588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.17356","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T13:39:50.632827Z","title":"Dicache: Let diffusion model determine its own cache","venue":null,"work_id":"c2389322-8839-490a-8d61-34832e66ebb6","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:4f98b7311a8a69705caf4185d488ccb44cb6a573056d4bd0cc5c8b28285f27da","observation_id":"eb9701d3-7ff5-4407-b7a7-9db24b731904","resolution":{"observed_at":"2026-05-15T07:19:49.930970Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion forcing: Next-token prediction meets full-sequence diffusion.Advancesin Neural Information Processing Systems, 37:24081–24125","venue":null,"work_id":"9d20d335-5d78-4362-b7ce-11f7495019af","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:f5d30eb8def6d32341ef297d33711ff691b00619d16c945dd0822635c8045987","observation_id":"2fe5a6a5-c74c-41ff-b21e-77e5e2315049","resolution":{"observed_at":"2026-05-15T07:19:50.888297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13074","last_updated":"2025-04-21T10:34:50Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-17T16:37:27Z","title":"SkyReels-V2: Infinite-length Film Generative Model","version":3},"cited_work":{"arxiv_id":"2504.13074","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.13074","snapshot_observed_at":"2026-07-10T01:46:41.058772Z","title":"SkyReels-V2: Infinite-length Film Generative Model","venue":"cs.CV","work_id":"2ce11350-273e-4f0d-ae78-292aa3151060","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2504.13074","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:da004d7d1fd319b6c99266c46893dec6cc081b92ce18aa2b53d72b39bc90614e","observation_id":"99424ea2-498f-4655-83a5-586b3c7514b9","resolution":{"observed_at":"2026-05-15T07:19:49.947598Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01125","last_updated":"2024-06-03T09:10:44Z","snapshot_observed_at":"2026-07-06T18:24:17.711867Z","submitted_at":"2024-06-03T09:10:44Z","title":"$\\Delta$-DiT: A Training-Free Acceleration Method Tailored for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2406.01125","doi":"10.48550/arxiv.2406.01125","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.01125","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"δ-DiT: A training-free acceleration method tailored for diffusion transformers","venue":"arXiv (Cornell University)","work_id":"a9eb5bf3-fc76-45d5-9721-87061c21a0ba","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2406.01125","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:97edd4135d1a1b078c64c01ad8f53f7ac465bd21074beb937092cbcab6ae0226","observation_id":"e64af7d8-3a35-41e5-b244-bd06d9fe164f","resolution":{"observed_at":"2026-05-15T07:19:49.921424Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"E2net: Excitative- expansile learning for weakly supervised object localization","venue":null,"work_id":"8e31a166-e938-432a-af43-d4f2ebee7283","year":2021},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:dc53927b46e2ff00a8aa9fea9180db91733c604285683f531bac9ad49bde8a97","observation_id":"78123c58-eafa-44a6-afcb-ee7e0363980e","resolution":{"observed_at":"2026-05-15T07:19:50.919334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lctr: On awakening the local continuity of transformer for weakly supervised object localization","venue":null,"work_id":"c40b4e31-9967-448d-957b-0e8eaa7d35b1","year":2022},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:7ca8c19dbe9f2337f39b86a6836be2a908e62c632083f6ac16fa3b1212c56aff","observation_id":"f1b582b5-469f-4dff-8efd-b827c36378f7","resolution":{"observed_at":"2026-05-15T07:19:50.892211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Category-aware allocation transformer for weakly supervised object localization","venue":null,"work_id":"a4433a2e-040d-4e6d-9d37-4e2f952c8e98","year":2023},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:38578568d5f5a9d95a039895ec8436b47e5d96bcdf3cbd97c6736f7f3589bab4","observation_id":"a234dbd7-fb63-4df9-bd6b-de89dc38214c","resolution":{"observed_at":"2026-05-15T07:19:50.916183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adaptive zone learning for weakly supervised object localization.IEEE Transactions on Neural Networks and Learning Systems, 36(4):7211–7224","venue":null,"work_id":"ef928819-19e9-4b0b-8ee8-a03907989829","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:80a361d8e93df76aa1f519d10fe55acf2c16e12ac76eab49041edf5246ca581f","observation_id":"56033a54-24fb-40fc-abc2-d7f4989c6983","resolution":{"observed_at":"2026-05-15T07:19:50.908696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Clip-driven transformer for weakly supervised object localization.IEEE Transactions on Pattern Analysis and Machine Intelligence","venue":null,"work_id":"66119424-411b-44a9-b018-a2244626124d","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:7d27c9df8865f400e91ff53ca679e4756199be31d27028bf66ea4d876c75478e","observation_id":"4b1eca82-c7fe-4f22-ad7a-846c868ade13","resolution":{"observed_at":"2026-05-15T07:19:50.905199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.13789","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T22:19:00.477179Z","title":"Bwcache: Accelerating video diffusion transformers through block-wise caching","venue":null,"work_id":"1032cdfc-2bd4-4616-8d70-608849135487","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:bee5e086bbfbfc36ea4104e923f7833d003180933170b7c9b809ca792bc0d927","observation_id":"d4086274-bace-4f17-b2f8-e1f0284a1cd4","resolution":{"observed_at":"2026-05-15T07:19:49.915809Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22167","last_updated":"2025-05-28T09:33:52Z","snapshot_observed_at":"2026-07-06T21:32:04.296403Z","submitted_at":"2025-05-28T09:33:52Z","title":"Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.22167","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.22167","snapshot_observed_at":"2026-07-01T09:45:40.325116Z","title":"Q-vdit: Towards accurate quantization and distillation of video-generation diffusion transformers","venue":null,"work_id":"50b11121-a334-439d-bea9-d77d57d0861f","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2505.22167","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:58c2ef91b6a16f8cd4c59b10455c662ecd0cac1dc454ec452810080089b3e1ad","observation_id":"c2f1e0ec-12c9-459a-ac92-6bb3a2cbdbc5","resolution":{"observed_at":"2026-05-15T07:19:49.953112Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.23301","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mdreid: Modality-decoupled learning for any-to-any multi-modal object re-identification","venue":null,"work_id":"0e23a1ce-1d44-4429-97df-b369ea1a17c7","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:3f2d74431879a6f8b967c3ed032e89c04819af9c934a69c54f97d792bfb31fa8","observation_id":"7158db05-0736-469a-85fc-32fb20ba3bcd","resolution":{"observed_at":"2026-05-15T07:19:49.936641Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-modal object re-identification via sparse mixture-of- experts","venue":null,"work_id":"d143d189-ca0a-40b1-8e07-c021aedf4541","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:38b47c1bdef74beb90f0c5d344996f972eee4947c34c1759ca983a9c46526a20","observation_id":"271c8514-27e6-41f4-b81f-a6abfd8dde50","resolution":{"observed_at":"2026-05-15T07:19:50.931039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02914","last_updated":"2024-11-05T08:58:35Z","snapshot_observed_at":"2026-07-06T19:45:25.884330Z","submitted_at":"2024-11-05T08:58:35Z","title":"Exploring the Interplay Between Video Generation and World Models in Autonomous Driving: A Survey","version":1},"cited_work":{"arxiv_id":"2411.02914","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.02914","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Exploring the interplay between video generation and world models in autonomous driving: A survey","venue":null,"work_id":"7986281d-041e-4aca-9ef3-b8ce3d716a15","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2411.02914","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:c3daaf0e94d1c22d017a9d908fb5aa7033dd9d174a4a51768dc1ac32bb8af15e","observation_id":"3c8f16c5-1af2-4f8a-91c4-3b2fac20e7fe","resolution":{"observed_at":"2026-05-15T07:19:49.925578Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Magicdrive-v2: High-resolution long video generation for autonomous driving with adaptive control","venue":null,"work_id":"29620836-0b36-4d0e-a4fe-d844ec08bd92","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:ec2ddca3e513d37b3362da2cfabdacfb7fb68b28c46f9c0ee178d8376a475b7e","observation_id":"943613f0-7593-4027-94e2-e9dd7daa0396","resolution":{"observed_at":"2026-05-15T07:19:50.928370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09113","last_updated":"2025-06-28T11:58:23Z","snapshot_observed_at":"2026-08-01T16:09:18.068564Z","submitted_at":"2025-06-10T17:56:11Z","title":"Seedance 1.0: Exploring the Boundaries of Video Generation Models","version":2},"cited_work":{"arxiv_id":"2506.09113","doi":"10.48550/arxiv.2506.09113","metadata_source":"pith","pith_arxiv_id":"2506.09113","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Seedance 1.0: Exploring the Boundaries of Video Generation Models","venue":"cs.CV","work_id":"b2e36b5d-99e4-45b4-9358-64f6d3501983","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2506.09113","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:fa6c06a5189fad08ddeca412de7ab31f3a9e0ed73f0b5272f6cd3540f15a3e61","observation_id":"672af5f5-38b8-4ece-957e-8a2b1951cef6","resolution":{"observed_at":"2026-05-15T07:19:49.960186Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T01:20:38.029679Z","title":"Image quality metrics: Psnr vs","venue":null,"work_id":"fd5133ac-3e98-4ef0-84cc-81c2b24768cf","year":2010},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:c5e2415a583097810dca2ef08cbd598c70d727103247bc6bca829d8b248bb9f4","observation_id":"dceb1060-3fe8-4255-be2e-dda5054d3509","resolution":{"observed_at":"2026-05-15T07:19:50.937125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T23:44:22.326016Z","title":"Vbench: Comprehensive benchmark suite for video generative models","venue":null,"work_id":"9f23bd16-4e15-463f-941a-93528f3b5926","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:0e73f16b394df42a02645a6029638ba890d92913e685523796d250487bc1ec94","observation_id":"966beaf0-7c13-451c-890a-214f194ab4c5","resolution":{"observed_at":"2026-05-15T07:19:50.901849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ir evaluation methods for retrieving highly relevant documents","venue":null,"work_id":"f52dd330-34f6-4474-aeef-754a7a30e6d4","year":2017},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:6a1343f634fa31ddc9d9ef8ba0f20ebe2dd21954128b44b90027c918f7acf683","observation_id":"1520e239-bcc9-4167-81ed-2d93e7f09488","resolution":{"observed_at":"2026-05-15T07:19:50.911731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adaptive caching for faster video generation with diffusion transformers","venue":null,"work_id":"2f29e4d5-2ee7-4aa1-a2a3-89ad4e415d2a","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:cdac9f9883ae8bb36eb308d89641a16b586940992a40ac58f9e3958bf8b5b3b8","observation_id":"9ceddbd8-4135-4a62-847a-d24978c56410","resolution":{"observed_at":"2026-05-15T07:19:50.925517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Elucidating the design space of diffusion-based generative models","venue":null,"work_id":"3e7c6c5d-a9a2-4e91-9b0e-6f4c22aa1e21","year":2022},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:41b740318305d5141f4d7345ca6436d57630d3802ca41ef4c4ef109c94cd63ed","observation_id":"c5ec4900-5ae2-406e-8de2-a0f99560fbeb","resolution":{"observed_at":"2026-05-15T07:19:50.949659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":"2412.03603","doi":"10.48550/arxiv.2412.03603","metadata_source":"pith","pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","venue":"cs.CV","work_id":"881efa7e-7e73-4c66-9cc3-2803e551061c","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:979c6bcf23600cdb060113716b67923b56464dec339b3233653e4ab1e75e1769","observation_id":"8a1b4af7-5e03-41ee-ac3a-22fb0a578258","resolution":{"observed_at":"2026-05-15T07:19:49.942409Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.433177+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.433177+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rle: A unified perspective of data augmentation for cross-spectral re-identification.Advances in Neural Information Processing Systems, 37:126977–126996","venue":null,"work_id":"4ceaf236-226d-4e09-8e11-92e59c5dbd11","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:7c43cb24cbe352ae87e57f4d655fee73de373885a9e8f4b93554707d7b96e8c3","observation_id":"ea025c3a-bee0-40fb-ad9a-8ab7a5636bf2","resolution":{"observed_at":"2026-05-15T07:19:50.903214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Find: A simple yet effective baseline for diffusion- generated image detection","venue":null,"work_id":"17c23458-aba9-49b6-891b-5a1a898f02fc","year":2026},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:51a7050614a3b07a6d21f34d0caad3a98fddf43cf680a86c56da9abd9b3d9a39","observation_id":"89e528a4-3bc3-4217-b251-aeb5a2a72668","resolution":{"observed_at":"2026-05-15T07:19:50.946911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Apoavatar: Expressive audio-driven avatar generation via refocused audio-pose priors","venue":null,"work_id":"b061133d-d47e-426a-85a8-19bd371243fe","year":null},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:c5839e26a7a8db2b69cf284c340618bfd00faee6a7a14318b3dc4f20f407566d","observation_id":"d6ea5eb1-0e6b-4391-a349-64db6df93854","resolution":{"observed_at":"2026-05-15T07:19:50.940845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An end-to-end scene text detector with dynamic attention","venue":null,"work_id":"7d93ecfc-bc85-42bc-ae13-83ab41f3152d","year":2022},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:97acd7c315723a7897bd1c911bcf65a963fd3a4416945c810e36ed95e4871f5d","observation_id":"4e182a9c-d53d-428a-94d3-75ca5755e7b2","resolution":{"observed_at":"2026-05-15T07:19:50.933977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A dual-path transformer network for scene text detection","venue":null,"work_id":"5ced23c9-b01a-46d6-9c82-7bd678612a45","year":2023},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:c716bf1338b77f90daffb4444c18eef4be48605d74efb6bca770459829bfe874","observation_id":"1c053e8b-6740-4bac-b439-3b8d27d6a235","resolution":{"observed_at":"2026-05-15T07:19:50.922084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pair-id: A dual modal framework for identity preserving image generation.IEEE Signal Processing Letters, 31:2715–2719","venue":null,"work_id":"11611d0c-14ff-44c4-80e9-bd5330d61698","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:2c674b96aca8c753273228006812c770d3f5866e9e68df6b906658e7097c0429","observation_id":"b8a3eea2-5658-4149-86df-2467162743fa","resolution":{"observed_at":"2026-05-15T07:19:50.943687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Difftv: Identity-preserved thermal-to-visible face translation via feature alignment and dual-stage conditions","venue":null,"work_id":"241eca6e-4e9e-463c-ac39-11979baf38e5","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:f8b09a4cc5c8afe54dd48b774b721577fd09904d3429cfdac91df694077c47c5","observation_id":"3298242d-5766-44fc-8862-1781e1b3eb54","resolution":{"observed_at":"2026-05-15T07:19:50.952536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":"2210.02747","doi":"10.1038/s41467-024-47656-z","metadata_source":"pith","pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flow Matching for Generative Modeling","venue":"cs.LG","work_id":"6edb71c4-5d64-40af-a394-9757ea051a36","year":2022},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:ca6c3c29cd3a0b361b6d084ee26627e670b99d9731b2c4c427c74423ddbe94a2","observation_id":"1aae08bf-0b24-4b94-9386-d843e71badc8","resolution":{"observed_at":"2026-05-15T07:19:49.920458Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Timestep embedding tells: It’s time to cache for video diffusion model","venue":null,"work_id":"ff1036c1-3d00-441c-9d89-a9d495ac2a9f","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:a23c74d8c993a2a4430dadb222b42083fe6be3454deac7ff44096ec5b5e2826c","observation_id":"2672b17f-b1d6-4318-8998-6ff1ea2e607d","resolution":{"observed_at":"2026-05-15T07:19:50.790916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06923","last_updated":"2025-08-11T14:15:27Z","snapshot_observed_at":"2026-08-06T00:31:29.273721Z","submitted_at":"2025-03-10T05:09:42Z","title":"From Reusing to Forecasting: Accelerating Diffusion Models with TaylorSeers","version":2},"cited_work":{"arxiv_id":"2503.06923","doi":"10.48550/arxiv.2503.06923","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.06923","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"From reusing to forecasting: Accel- erating diffusion models with taylorseers","venue":null,"work_id":"82c2bd18-3da0-4e08-9fc7-1004b25de6d5","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2503.06923","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:22a6d9489841932a736e212d253d6a05322615f5276781876ca269a32e3b41c6","observation_id":"7dbf68a4-0b9a-4043-8f39-5bcb49efbffa","resolution":{"observed_at":"2026-05-15T07:19:49.790547Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Speca: Accelerating diffusion transformers with speculative feature caching","venue":null,"work_id":"4f7b33a1-df1c-496e-9386-c089e1281efd","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:63b9be075cb6d39a806da88d63bc668785546e30620033b6c04c115903aee0e0","observation_id":"15f88856-ccec-4472-8c61-d599eb844574","resolution":{"observed_at":"2026-05-15T07:19:50.874725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2409.18523","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T12:34:39.300383Z","title":"Token caching for diffusion transformer acceleration","venue":null,"work_id":"727f9538-9b14-4afa-ad69-cfb4927b457c","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:5b5fc82af8e27fdffa6f790585f15134de6ce33a2ce3933a3ff47556687b760b","observation_id":"cb840779-20bc-4a8c-a259-407673469531","resolution":{"observed_at":"2026-05-15T07:19:49.754855Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03048","last_updated":"2025-05-01T09:40:21Z","snapshot_observed_at":"2026-08-02T13:01:06.918463Z","submitted_at":"2024-01-05T19:55:15Z","title":"Latte: Latent Diffusion Transformer for Video Generation","version":3},"cited_work":{"arxiv_id":"2401.03048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.03048","snapshot_observed_at":"2026-07-10T01:46:41.160163Z","title":"Latte: Latent Diffusion Transformer for Video Generation","venue":"cs.CV","work_id":"5328e907-7278-4781-a2bb-c5ef40dc87fb","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2401.03048","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:8c36cc6c3409cd4fb34c0a69ab11ae1d7c9d12206af8941ae63500440b2a845a","observation_id":"3a709a7a-8672-4711-aa65-34fd25f5b6de","resolution":{"observed_at":"2026-05-15T07:19:49.901356Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ompq: Orthogonal mixed precision quantization","venue":null,"work_id":"53dc5087-26f1-43f9-bd74-1accce8d2ad3","year":2023},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:019251a23742f7559af1d2cb07f2aa54d3d8dc74baaa71e35307f7b7256bea0b","observation_id":"fd5e47f3-940d-469e-ad32-68c318977958","resolution":{"observed_at":"2026-05-15T07:19:50.877612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Solving oscillation problem in post-training quantization through a theoretical perspective","venue":null,"work_id":"a3fb38ab-831b-4957-b3f8-6b8d38cad85c","year":2023},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:a84586231d2d10063e81582195a685ebe19136fb55c4d89ab7e1e54e269cff0c","observation_id":"f74eeee5-112d-440e-89ab-26a0e003790d","resolution":{"observed_at":"2026-05-15T07:19:50.886808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12544","last_updated":"2024-03-19T08:40:21Z","snapshot_observed_at":"2026-07-06T17:46:54.639222Z","submitted_at":"2024-03-19T08:40:21Z","title":"AffineQuant: Affine Transformation Quantization for Large Language Models","version":1},"cited_work":{"arxiv_id":"2403.12544","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.12544","snapshot_observed_at":"2026-07-04T12:59:52.371019Z","title":"Affinequant: Affine transformation quantization for large language models","venue":null,"work_id":"31122bd5-2c5e-487f-bd8b-55b19b7abaea","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2403.12544","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:332ce5258a2187126ff138400dfbf5272c241e8fe825109d4b3a4bf7bb2a4156","observation_id":"c3561847-6032-44bf-b86a-fcc7e660e178","resolution":{"observed_at":"2026-05-15T07:19:49.936510Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Outlier-aware slicing for post-training quantization in vision transformer","venue":null,"work_id":"2d04203c-5e00-48b4-95c3-2e762f4533a4","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:45d2163e7d54ba57cfa9957954d1967b11749aa4c9d51d28044089caf7df1b45","observation_id":"d28ad9d3-d7fe-4a60-8af6-a7ce6aeaea59","resolution":{"observed_at":"2026-05-15T07:19:50.868048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.10825","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T03:09:30.638787Z","title":"Flow caching for autoregressive video generation","venue":null,"work_id":"932b1def-4129-40dd-8061-dbec8c89413b","year":2026},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:ed6a5db63cb230d1b9807fff9073717f26ded59e8a9912f82dfcdf8c69bc6c68","observation_id":"0fb2d52e-4f6f-4e74-8b80-5fd992b00411","resolution":{"observed_at":"2026-05-15T07:19:49.819366Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.17621","last_updated":"2026-06-27T05:27:06Z","snapshot_observed_at":"2026-08-02T15:15:01.125656Z","submitted_at":"2026-03-18T11:38:01Z","title":"Complementary RL: Towards Efficient Experience-Driven Agent Learning","version":2},"cited_work":{"arxiv_id":"2603.17621","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.17621","snapshot_observed_at":"2026-07-02T07:56:47.808877Z","title":"Complementary reinforcement learning","venue":"cs.LG","work_id":"29c03fa5-0abe-4865-b9e8-51a49c113ae1","year":2026},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2603.17621","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:443a3d5555df942524481994c9e1d1f11d51f3d596fe1512f494b1c24fdc779b","observation_id":"b6d18226-6221-4d49-af70-795890db1c78","resolution":{"observed_at":"2026-06-30T02:15:38.360582Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.15389","last_updated":"2026-06-27T04:53:36Z","snapshot_observed_at":"2026-08-01T17:36:36.240938Z","submitted_at":"2026-03-16T15:04:16Z","title":"When Does Sparsity Mitigate the Curse of Depth in LLMs","version":2},"cited_work":{"arxiv_id":"2603.15389","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.15389","snapshot_observed_at":"2026-06-30T02:15:38.277012Z","title":"Muhtar, X","venue":null,"work_id":"901b1bbf-57d9-421a-81e0-c7fe70723248","year":2026},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2603.15389","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:7a2b94f9853b80ab3f27eb53f4299ab0c7ad3a07231e6e2f4448d1835baa6646","observation_id":"a2b673c4-53ee-4638-97d9-e4b174070a20","resolution":{"observed_at":"2026-06-30T02:15:38.277012Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T02:27:53.186413Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"0c67bec8-6388-449f-9600-64c8ea9bc79f","year":2023},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:d9ca4aa015d94d31e750abc5d267454238a489607cd4079c90057b9ae17013f7","observation_id":"7b10d252-d2ee-4ad9-bf42-6b3cc0a78412","resolution":{"observed_at":"2026-05-15T07:19:50.861250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09642","last_updated":"2026-03-02T11:31:23Z","snapshot_observed_at":"2026-08-02T11:33:41.662779Z","submitted_at":"2025-03-12T05:00:07Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","version":3},"cited_work":{"arxiv_id":"2503.09642","doi":"10.48550/arxiv.2503.09642","metadata_source":"pith","pith_arxiv_id":"2503.09642","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k","venue":"cs.GR","work_id":"c22f9060-268c-4cc9-8018-dee486a23da1","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2503.09642","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:c8d019805d3ae2d82f4f236db05c1ef1783ac92a25b1df0bc06cd309b602c9d0","observation_id":"51fd0951-e744-4f08-9daf-4557e8e93091","resolution":{"observed_at":"2026-05-16T12:09:39.930389Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.21091","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T14:28:31.559562Z","title":"Ertacache: Error rectification and timesteps adjustment for efficient diffusion","venue":null,"work_id":"d28932d3-3c33-48d2-a2ce-29d0f013b8db","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:dc32fb217502f7336f332b4883707b452725d7ae565fd8eae25bb4a541751bd7","observation_id":"efa01418-a84a-491a-92a3-a07c54616757","resolution":{"observed_at":"2026-05-15T07:19:49.749703Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":"2204.06125","doi":"10.48550/arxiv.2204.06125","metadata_source":"pith","pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","venue":"cs.CV","work_id":"0c6a768b-70b8-4242-bb0e-459f1008c9fc","year":2022},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:af6c9cf8457a8db31b37df5c30a07dfb2fe6649f10cfafcd535a2b02ec2b7cb5","observation_id":"1e7ed50e-e777-4fdf-bf6e-e2798d5c7383","resolution":{"observed_at":"2026-05-15T07:19:49.866738Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-14T13:50:02.412412+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T13:50:02.412412+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T01:46:41.705184Z","title":"U-net: Convolutional networks for biomedical image segmentation","venue":null,"work_id":"b114346e-512c-4e00-a712-991c1c5df538","year":2015},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:1f7b7089dabf4db7427e6e69ba3df261c85ee396ab4a1b325d009e62260a0d52","observation_id":"272ed6cd-17f6-4ef0-9a0a-af1e5ced0c32","resolution":{"observed_at":"2026-05-15T07:19:50.864690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Photorealistic text-to-image diffusion models with deep language understanding.Advancesin neural information processing systems, 35:36479–36494","venue":null,"work_id":"4db4b5a2-7d5b-487c-a0dd-5378c97f24f5","year":2022},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:e690c3d7a6726827b81570b5e8452d7d7590f0adb69e071e50fbd80e111f2a12","observation_id":"8f5deb06-2fe8-4cdf-9c4a-d961be40bc97","resolution":{"observed_at":"2026-05-15T07:19:50.871595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01425","last_updated":"2024-07-01T16:14:37Z","snapshot_observed_at":"2026-08-03T16:18:03.005579Z","submitted_at":"2024-07-01T16:14:37Z","title":"FORA: Fast-Forward Caching in Diffusion Transformer Acceleration","version":1},"cited_work":{"arxiv_id":"2407.01425","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.01425","snapshot_observed_at":"2026-07-04T13:39:50.629924Z","title":"Fora: Fast-forward caching in diffusion transformer acceleration.arXiv preprint arXiv:2407.01425","venue":null,"work_id":"ab422c0e-b5e6-43cd-b3a8-795ef0b18902","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2407.01425","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:87b9cda9ec2b625c633b03dbe34afd741ce535d31fa800698e910974216d96a2","observation_id":"8464736e-39e8-4bc1-9145-d9d16d4bc7a5","resolution":{"observed_at":"2026-05-15T07:19:49.873021Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06564","last_updated":"2025-03-09T11:37:11Z","snapshot_observed_at":"2026-08-05T11:44:02.244889Z","submitted_at":"2025-03-09T11:37:11Z","title":"TR-DQ: Time-Rotation Diffusion Quantization","version":1},"cited_work":{"arxiv_id":"2503.06564","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.06564","snapshot_observed_at":"2026-06-30T07:34:22.105176Z","title":"Tr-dq: Time-rotation diffusion quantization","venue":null,"work_id":"8223857a-976f-46d1-865c-915402ce1ca1","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2503.06564","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:e7318c50e2fa598f7c1b14117c364c9ea8e45e02699d12621f834c34b2b353d3","observation_id":"77184a8d-7117-4fd2-b3d1-7d350e105790","resolution":{"observed_at":"2026-05-15T07:19:49.860305Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06764","last_updated":"2025-07-24T03:58:47Z","snapshot_observed_at":"2026-07-06T20:34:11.407726Z","submitted_at":"2025-02-10T18:44:25Z","title":"History-Guided Video Diffusion","version":2},"cited_work":{"arxiv_id":"2502.06764","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.06764","snapshot_observed_at":"2026-07-08T03:24:28.724863Z","title":"History-Guided Video Diffusion","venue":"cs.LG","work_id":"7822dfb2-a168-4080-8673-2dfafbe1a2ab","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2502.06764","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:56733cf9124d97577cfcaff8c98940eba3612c9b80645e7072ce21054fdea0ac","observation_id":"d97d8e3b-0611-4377-b16b-1e8115f2458e","resolution":{"observed_at":"2026-05-16T12:00:14.880011Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusionfake: Enhancing generalization in deepfake detection via guided stable diffusion.Advances in Neural Information Processing Systems, 37:101474–101497","venue":null,"work_id":"6f7ce5b0-7698-4fa9-a9bf-3862b225fdd8","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:fcd0623f1bd2295dbdf58a6e37d4b53ecb55c8e33b1b6c7f4f1f2eb1180e29ce","observation_id":"dc2eff0a-a3e4-4a88-8905-304675b4c807","resolution":{"observed_at":"2026-05-15T07:19:50.880747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Continual face forgery detection via historical distribution preserving.International Journal of Computer Vision, 133(3):1067–1084","venue":null,"work_id":"d91fc9cb-2fc4-403d-8b2a-ddc056cdd04f","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:720b7c963a4c8509aaa049ec48a1f2eec789c750e74ee89214cbc88fa85c5863","observation_id":"c59e2262-922e-48b8-9d1e-4b6d8b98681a","resolution":{"observed_at":"2026-05-15T07:19:50.884111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards general visual-linguistic face forgery detection","venue":null,"work_id":"1b0c5da6-3fbf-4154-86e1-c5612e95cae0","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:4f77339abe86f23845c69f1d32ca892ef2dd36d47a5c66c1f1460073b21f110a","observation_id":"a81a0fed-0a1d-4244-b75e-ca6bfbaa75e7","resolution":{"observed_at":"2026-05-15T07:19:50.891003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.04833","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"When ai settles down: Late-stage stability as a signature of ai-generated text detection","venue":null,"work_id":"52713dce-3762-426b-ad53-5f246cee19dc","year":2026},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:225742445a0cea5e01f6d5df548e35e4b846591a69c909ba48f3cfefb73b26e0","observation_id":"72c6487e-0e81-4878-866b-c413535d7809","resolution":{"observed_at":"2026-05-15T07:19:49.926110Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.01240","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Minimizing mismatch risk: A prototype-based routing framework for zero-shot llm-generated text detection","venue":null,"work_id":"200c776d-222b-4dfb-86c4-ead8829d0f46","year":2026},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:d4ac1b546b60f6f3c8c40d67ac1188d2b2edc847f3e59b3b11bafde0f6a49160","observation_id":"b11154f8-418f-4adc-b4f8-493eee73e682","resolution":{"observed_at":"2026-05-15T07:19:49.830833Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15106","last_updated":"2024-12-19T17:51:49Z","snapshot_observed_at":"2026-07-06T20:10:19.704368Z","submitted_at":"2024-12-19T17:51:49Z","title":"Knowing Where to Focus: Attention-Guided Alignment for Text-based Person Search","version":1},"cited_work":{"arxiv_id":"2412.15106","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.15106","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Knowing where to focus: Attention- guided alignment for text-based person search","venue":null,"work_id":"24e30eba-f65b-4ec2-b27a-53cb66356752","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2412.15106","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:7b6f4390d8e8f2224555ca51600f8eb5250d277fd100f1ea3158d219d1b12219","observation_id":"ebff62f9-0c04-4fb8-93fa-d0b166fccf48","resolution":{"observed_at":"2026-05-15T07:19:49.931364Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13211","last_updated":"2025-05-19T14:58:50Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-19T14:58:50Z","title":"MAGI-1: Autoregressive Video Generation at Scale","version":1},"cited_work":{"arxiv_id":"2505.13211","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.13211","snapshot_observed_at":"2026-07-10T01:46:41.063877Z","title":"MAGI-1: Autoregressive Video Generation at Scale","venue":"cs.CV","work_id":"25e8bd3d-e51c-43ae-8126-4ea6ecdb3321","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2505.13211","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:0e792f0714e62c3e665e6a791bc71b5fac2cf271c7f2d1229f9d253a90979155","observation_id":"f1ec5648-4f20-4e3f-9341-f3eefa6ac2c6","resolution":{"observed_at":"2026-05-15T07:19:49.915489Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":"2503.20314","doi":"10.1109/19.492748","metadata_source":"pith","pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","venue":"cs.CV","work_id":"ad3ebc3b-4224-46c9-b61d-bcf135da0a7c","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:130bb7c01128d225bf7e66d5331f89be96ae17bfeb67010e49e80d8ad1df9664","observation_id":"11f5bd98-231c-4a25-942a-3a4907993e42","resolution":{"observed_at":"2026-05-15T07:19:49.841117Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-kernel neural network sliding mode control for permanent magnet linear synchronous motors.IEEE Access, 9:57385–57392","venue":null,"work_id":"1b937cc9-2b14-4b45-9f15-e4105549dfd9","year":2021},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:9a029f8c581ef9c4bc08f589b1e5393bd6e3d254fa65a88ead002bb42f145431","observation_id":"615db9b9-6684-426f-a23d-28273863232f","resolution":{"observed_at":"2026-05-15T07:19:50.865494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dlf: Disentangled-language-focused multimodal sentiment analysis","venue":null,"work_id":"3687da57-c5f4-4333-adf8-4bbed7c0e1b7","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:274c0bfe587252293203ff94f22e06fd648d54b3d202f158f5a7f2f0f27aa43f","observation_id":"9d31e02a-c09c-4c69-aa2e-b6a106a50e12","resolution":{"observed_at":"2026-05-15T07:19:50.861689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"From models to systems: A comprehensive survey of efficient multimodal learning","venue":null,"work_id":"d0266303-3853-4dcd-b4a1-e6a11c935a47","year":2026},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:3d49de5280840ddb01586d72205945ee1288dc74f20d4062f405998b6eeb6c37","observation_id":"66d1325d-e8ab-41a3-9169-f8b067018d50","resolution":{"observed_at":"2026-05-15T07:19:50.869455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A theoretical analysis of ndcg type ranking measures","venue":null,"work_id":"0fa9c14a-6a3a-4d6e-931f-9f56e43d8dd1","year":2013},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:96c05a43fba13d4b3e9ef7b81a7aa617df0df51b4435d6564d739621bf650178","observation_id":"07e066dc-9160-4ff8-b9ac-f107f7adc2ce","resolution":{"observed_at":"2026-05-15T07:19:50.872234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T17:57:26.576391Z","title":"Image quality assessment: from error visibility to structural similarity.IEEE transactions on image processing, 13(4):600–612","venue":null,"work_id":"9cbaa8a9-c031-41b2-bf97-f8b7a2b7cfff","year":2004},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:cad42a9292fd6f8b603d507588240338672938f195323764e283f95ed38962ab","observation_id":"ddac4294-b064-45ec-a069-17f8e4393fd7","resolution":{"observed_at":"2026-05-15T07:19:50.875385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Panacea: Panoramic and controllable video generation for autonomous driving","venue":null,"work_id":"0a0ee305-766b-4f26-bf39-5b11bac3eccc","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:6a4795694449c8cf7b4f53e8d306293c549a474ede7de050b12a7b124ab6b63e","observation_id":"76fc8e1d-58a8-490a-bdc7-07b4fc7f01f9","resolution":{"observed_at":"2026-05-15T07:19:50.881223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Motioncanvas: Cinematic shot design with controllable image-to-video generation","venue":null,"work_id":"ccd52649-6f09-42b5-aa67-0cf84923508e","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:53ec4147d92f7966b36b62a8ee7bee6c8c88608acfde1b242819e858d5aa2a0a","observation_id":"dc10b010-93ae-4a76-ac12-35a31c70e6fa","resolution":{"observed_at":"2026-05-15T07:19:50.858266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An enhanced differential evolution algorithm with a new oppositional-mutual learning strategy.Neurocomputing, 435:162–175","venue":null,"work_id":"29927abf-0b2a-429a-a9d4-43ce382a73ab","year":2021},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:d709f182eba7a15b46e3244b1c577b8306cb7eb4b6ca34aafec186be813514b4","observation_id":"c49ed621-35ca-47c0-b706-40d225f65f5e","resolution":{"observed_at":"2026-05-15T07:19:50.854948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Veta-dit: Variance-equalized and temporally adaptive quantization for efficient 4-bit diffusion transformers","venue":null,"work_id":"98a0cac9-071e-4216-978d-6a3f23af1944","year":null},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:034d060fa632e5853391a9a91fa6d06234e676bda1e7185d942c94e6a2179de2","observation_id":"f471ac1a-d944-4f9c-9b07-9550474a8879","resolution":{"observed_at":"2026-05-15T07:19:50.848399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.22622","last_updated":"2025-10-13T22:41:26Z","snapshot_observed_at":"2026-07-06T22:30:55.313733Z","submitted_at":"2025-09-26T17:48:24Z","title":"LongLive: Real-time Interactive Long Video Generation","version":2},"cited_work":{"arxiv_id":"2509.22622","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.22622","snapshot_observed_at":"2026-07-09T07:56:04.670863Z","title":"LongLive: Real-time Interactive Long Video Generation","venue":"cs.CV","work_id":"29ec6550-6ac1-4cc6-8aae-b4206f1d5b38","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2509.22622","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:882cc28abfb2177d259c9bf742f201cd40919f67b7ccc34209edcdf2ec079867","observation_id":"b4e3eb74-0b54-48ea-a94e-d01ad14382b7","resolution":{"observed_at":"2026-05-15T07:19:49.815186Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":"2408.06072","doi":"10.48550/arxiv.2408.06072","metadata_source":"pith","pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","venue":"cs.CV","work_id":"f38fc088-12aa-4bf4-9ecd-08d3e797ccb7","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:31053bb96976fbbb09f4fe1c9406c1bdd5f92a7d2e8422432598491a724e26cd","observation_id":"dbd3fdbe-6ba4-4db5-93cb-4158ccc7194d","resolution":{"observed_at":"2026-05-15T07:19:49.854714Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"From slow bidirectional to fast autoregressive video diffusion models","venue":null,"work_id":"6d9af638-c387-4e0c-8af7-99f9320e2f7e","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:256a8fae0b6593f8f26ef84e06533d3824deedb897f2daee62876f3800cb8beb","observation_id":"8d744cff-7f74-4b00-898c-f66105b08146","resolution":{"observed_at":"2026-05-15T07:19:50.851677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ab-cache: Training-free acceleration of diffusion models via adams-bashforth cached feature reuse","venue":null,"work_id":"889e7a44-f3eb-4aeb-82be-8276bf940b23","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:409764bbcd4f6ab3d24310ca2e6d67fcbe2b132529491109532b2810b3c0bff6","observation_id":"a11e21c6-df34-477d-85e4-f8fd8eead64a","resolution":{"observed_at":"2026-05-15T07:19:50.844511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T17:57:26.568638Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":"ffd7b63b-f3e1-48da-bdd1-24909a005ca5","year":2018},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:eb6b1bd7f99f1169f4dbe1cd20969dd530c479272542d420a4157f9ba2e0f57d","observation_id":"b9995ed7-6bec-45c7-90c1-cf09f14b1fbd","resolution":{"observed_at":"2026-05-15T07:19:50.835985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03321","last_updated":"2026-08-05T01:39:10Z","snapshot_observed_at":"2026-08-06T02:37:02.388868Z","submitted_at":"2026-01-06T14:17:44Z","title":"HERO: Hierarchical Evidential Reasoning Optimization for Radiology Report Generation via Reason-then-Summarize","version":4},"cited_work":{"arxiv_id":"2601.03321","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2601.03321","snapshot_observed_at":"2026-08-05T01:34:17.852905Z","title":"Aligning findings with diagnosis: A self-consistent reinforcement learning framework for trustworthy radiology reporting","venue":null,"work_id":"919386ce-6956-45b4-9b1a-8e9895c18bf0","year":2026},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2601.03321","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:0abed9dc4fd0f5cb95a0d45ad30b1d6547e52dc85b8cf6a969ffa4f0bdac0e3c","observation_id":"97e9efbb-e1b2-4173-a1f3-6df3ad47d142","resolution":{"observed_at":"2026-08-05T01:34:17.852905Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02540","last_updated":"2025-02-22T16:29:03Z","snapshot_observed_at":"2026-07-06T18:25:22.852874Z","submitted_at":"2024-06-04T17:57:10Z","title":"ViDiT-Q: Efficient and Accurate Quantization of Diffusion Transformers for Image and Video Generation","version":3},"cited_work":{"arxiv_id":"2406.02540","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.02540","snapshot_observed_at":"2026-07-03T20:48:55.686449Z","title":"Vidit-q: Efficient and accurate quantization of diffusion transformers for image and video genera- tion","venue":null,"work_id":"e48c18fd-8b2d-4817-8981-60bdc8141677","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2406.02540","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:79da2e0fee45eec02d7c1bb6fd12e062017d1d106bea34ae58516d96937cd800","observation_id":"0d2b3cef-452a-46a7-9186-d894336ea830","resolution":{"observed_at":"2026-05-15T07:19:49.890022Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":"2408.12588","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-07-04T08:49:41.578583Z","title":"Real-time video generation with pyramid attention broad- cast","venue":null,"work_id":"2db87de3-d572-4e25-a809-1dc376dfed60","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:8cf6c92382e3dfc9e63d0b5f2d7cb0b5a1c7b33f0f1d8caa823b072ef57dff79","observation_id":"4e019637-7fa0-41b1-8de5-06c55e604d95","resolution":{"observed_at":"2026-05-15T07:19:49.942745Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.08532","last_updated":"2025-05-21T12:34:56Z","snapshot_observed_at":"2026-08-06T03:13:08.180611Z","submitted_at":"2021-08-19T07:03:22Z","title":"An Information Theory-inspired Strategy for Automatic Network Pruning","version":4},"cited_work":{"arxiv_id":"2108.08532","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2108.08532","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An information theory-inspired strategy for automatic network pruning","venue":null,"work_id":"dc14161f-8ce5-473d-b495-d207b6fb0926","year":2021},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2108.08532","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:3e90cf6015eb6b479e096f8ffdc7d43360994bd0b19b4c5efe1c616c6d7e2d0e","observation_id":"f06a69c2-3c26-4748-ba8c-5bac23da13de","resolution":{"observed_at":"2026-05-15T07:19:49.737741Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":"2412.20404","doi":"10.48550/arxiv.2412.20404","metadata_source":"pith","pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open-Sora: Democratizing Efficient Video Production for All","venue":"cs.CV","work_id":"8b29ba7b-3d84-4281-85b7-9eaf905afd7f","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:40ca3a514b8bce7a7ba764feb6421dd57f192d2d45cd5ddc1126b11a2d1d51e9","observation_id":"a8ca8bb5-64c5-4750-9d5c-dab5ed3b5062","resolution":{"observed_at":"2026-05-15T07:19:49.840814Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Compute only 16 tokens in one timestep: Accelerating diffusion transformers with cluster-driven feature caching","venue":null,"work_id":"916c357e-9cd5-42a5-b2f8-c77acb3761bd","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:d0d53afbc107093fa113996d7f4e1cff5f8769325b7b69204e6004cb8e220282","observation_id":"9273b2cf-0343-479c-a65f-9aa3386c5671","resolution":{"observed_at":"2026-05-15T07:19:50.847065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2311.10126","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T08:09:41.098765Z","title":"I&s-vit: An inclusive & stable method for pushing the limit of post-training vits quantization","venue":null,"work_id":"ae2ce5e1-c043-424a-a66b-19563e834c22","year":2023},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:9ec5b362ada97a5c34c836d427e74455d4fb87563f4611eb90f52bd4a5b46df1","observation_id":"30f458b9-78bc-4ebe-84f4-03fff994b02b","resolution":{"observed_at":"2026-05-15T07:19:49.824605Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Erq: Error reduction for post-training quantization of vision transformers","venue":null,"work_id":"baa9e48d-d575-49ea-8c77-ee1ef605ad08","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:f0f1412ccd73e5acad7cb3280838e41ccce8d100f9a151050d26a97319746fb9","observation_id":"a1698a37-f4e5-48de-9f87-0ee276d9ea64","resolution":{"observed_at":"2026-05-15T07:19:50.832564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards accurate post-training quantization of vision transformers via error reduction.IEEE Transactions on Pattern Analysis and Machine Intelligence, 47(4):2676–2692","venue":null,"work_id":"7af4fe5f-c172-44c2-8b8b-bebb74f5f0a4","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:a8c0be83fd76cb329d3ec1c9313b96e1679211580517534d5128c9dd6e91e2ba","observation_id":"6496700a-463e-4e35-aa8b-accc70b61c3c","resolution":{"observed_at":"2026-05-15T07:19:50.815482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.06250","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Test-time iterative error correction for efficient diffusion models","venue":null,"work_id":"dca77d5a-ae8d-4c87-8413-3fae10a19530","year":2025},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:57f442fd5f56a43ede614ee6a8c93f504ea650f2891168f57a5056f15ed0f4c9","observation_id":"bf14914a-06fc-4b58-9ffe-7e372814964c","resolution":{"observed_at":"2026-05-15T07:19:49.792348Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ec-darts: inducing equalized and consistent optimization into darts","venue":null,"work_id":"ab766a66-2ca7-443d-9d2d-143c114c744c","year":2021},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:216ad9f64b61f4175f24ff1963c9a4e468a5ac63f63e503e22c067b96c16d013","observation_id":"216a46f5-5ffb-4531-85b5-57f9de549eb8","resolution":{"observed_at":"2026-05-15T07:19:50.819659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Training- free transformer architecture search","venue":null,"work_id":"e23d721e-0d96-4f2f-ac8c-47fd067910aa","year":2022},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:dc439e64dd3d8860f2e2cd3c76f2a2ea02c298e8239ec2a5403a19db4403548a","observation_id":"37aa3a07-a6a1-45c4-99d8-00921818f720","resolution":{"observed_at":"2026-05-15T07:19:50.824432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Training-free transformer architecture search with zero-cost proxy guided evolution.IEEE Transactions on Pattern Analysis and Machine Intelligence, 46(10):6525–6541","venue":null,"work_id":"c98fdc92-71d8-49a2-a674-ca1e396cfc82","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:125860536222bd49c8a77e1dde6750a725c088626f6d239549eb615e3c87f753","observation_id":"5ee992ff-47af-48a4-9eaf-8bec97733616","resolution":{"observed_at":"2026-05-15T07:19:50.810849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05317","last_updated":"2025-02-19T10:39:58Z","snapshot_observed_at":"2026-07-06T19:29:14.335016Z","submitted_at":"2024-10-05T03:47:06Z","title":"Accelerating Diffusion Transformers with Token-wise Feature Caching","version":4},"cited_work":{"arxiv_id":"2410.05317","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.05317","snapshot_observed_at":"2026-07-04T13:39:50.680105Z","title":"Accelerating diffusion transformers with token-wise feature caching","venue":null,"work_id":"08432422-a8f5-4710-9e6e-27ca624f31eb","year":2024},"citing_paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-15T07:16:05.225105Z"},"links":{"cited_paper":"/paper/2410.05317","citing_paper":"/paper/2605.01725"},"observation_digest":"sha256:b97da848df1835ad9e9039d8c9ffee958512f103ba5fd2ee3e16591f46a5abc3","observation_id":"67e0cda4-9b18-41f4-a08b-eb2378fc6562","resolution":{"observed_at":"2026-05-15T07:19:49.847116Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.01725","last_updated":"2026-05-14T10:16:56Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T05:49:27Z","title":"Motion-Aware Caching for Efficient Autoregressive Video Generation"},"reference_resolution":{"displayed":89,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":38,"verified_fuzzy":50},"total_outbound_references":89},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 89 of 89 outbound references and 0 inbound Pith citation observations for arXiv:2605.01725."}