{"as_of":"2026-08-20T15:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ad55c1d817b100210299b09ced1e44c53a4ec165c3b4b4833b157e3607952d79","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T22:45:29.345624Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.15650/citation-record","integrity":"/paper/2607.15650/integrity","json":"/paper/2607.15650/citation-record.json","paper":"/paper/2607.15650"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:45:25.252723Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:25.252723Z"},"links":{"citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:b632568228400a5038e0795af5632b20735e2b3b3ccbe7f962cd2075b78bf642","observation_id":"0785c1fc-e7a5-48c1-b2e0-82f591982cf1","resolution":{"observed_at":"2026-08-01T22:45:25.252723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01125","last_updated":"2024-06-03T09:10:44Z","snapshot_observed_at":"2026-08-16T13:46:50.271264Z","submitted_at":"2024-06-03T09:10:44Z","title":"$\\Delta$-DiT: A Training-Free Acceleration Method Tailored for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01125","snapshot_observed_at":"2026-08-01T22:45:25.317086Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:25.317086Z"},"links":{"cited_paper":"/paper/2406.01125","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:4e2695c22e062092c0bcb9144ede2426e277fd2d6ad424235cae42afe2edb5dd","observation_id":"5b77b0f2-a4f8-4831-ba01-cead1045f4cc","resolution":{"observed_at":"2026-08-01T22:45:25.317086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:45:25.403139Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:25.403139Z"},"links":{"citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:12b5bcd5bc9f50ca2538f4ca4d7f405c6a1c0dd503584d84d2d163c8471a6919","observation_id":"41dc6617-397b-4161-bee6-091be9d98645","resolution":{"observed_at":"2026-08-01T22:45:25.403139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:45:25.493412Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:25.493412Z"},"links":{"citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:19e004393a4949f0d2199890cbd401994742a6b5e0daee35095e315e69490c03","observation_id":"6650e77c-3412-4d40-b0e7-98a427856fe7","resolution":{"observed_at":"2026-08-01T22:45:25.493412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:45:25.549468Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:25.549468Z"},"links":{"citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:d4cc5a5f6d3cb561d12070f57e22c1dc43941b92ff32c93932c68acf30c5bcf4","observation_id":"924b22e3-d343-4e3e-b69f-4dbfa0eb1369","resolution":{"observed_at":"2026-08-01T22:45:25.549468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:45:25.629983Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:25.629983Z"},"links":{"citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:3881e3fe945caac44409f0283a7ae7b075257f733117eede5c4a99f6d47248e4","observation_id":"bd95a0f4-267f-40a8-aa4d-7bf3fd4fb891","resolution":{"observed_at":"2026-08-01T22:45:25.629983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01738","last_updated":"2024-11-04T01:40:38Z","snapshot_observed_at":"2026-08-20T02:41:26.684657Z","submitted_at":"2024-11-04T01:40:38Z","title":"xDiT: an Inference Engine for Diffusion Transformers (DiTs) with Massive Parallelism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.01738","snapshot_observed_at":"2026-08-01T22:45:25.749375Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:25.749375Z"},"links":{"cited_paper":"/paper/2411.01738","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:1c941dbda3a0ba13a026c5039ffb54fdcec0fee89f4433e2bb9cd440e831c21d","observation_id":"eb51fa9a-23e3-4dec-9c0e-c2db2c355413","resolution":{"observed_at":"2026-08-01T22:45:25.749375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07719","last_updated":"2024-07-02T09:03:26Z","snapshot_observed_at":"2026-08-16T13:53:11.380164Z","submitted_at":"2024-05-13T13:08:02Z","title":"USP: A Unified Sequence Parallelism Approach for Long Context Generative AI","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07719","snapshot_observed_at":"2026-08-01T22:45:25.808153Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:25.808153Z"},"links":{"cited_paper":"/paper/2405.07719","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:678a02f8f8cd7d03cd40a05ffad69bfbfd10b2b6cebaa845f5302cc13d36dca6","observation_id":"0d4c530a-dd79-45c6-a0f3-14a7acad574b","resolution":{"observed_at":"2026-08-01T22:45:25.808153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-01T22:45:25.938056Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:25.938056Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:df523134c0d7d616b322a6f7c0c828f0f2f2c1ed542fb40338fdf0162f0d07ab","observation_id":"2ea0e8ef-55d6-427a-9f61-ce1736aaf4e4","resolution":{"observed_at":"2026-08-01T22:45:25.938056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:45:26.029274Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:26.029274Z"},"links":{"citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:fa602751dbd09bdf1338c153a41e04ef0a0bdce1185394038528c774daa328c6","observation_id":"f1acd64b-2edf-402e-9aa1-10c311778b1f","resolution":{"observed_at":"2026-08-01T22:45:26.029274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14509","last_updated":"2023-10-04T16:51:13Z","snapshot_observed_at":"2026-08-20T06:29:44.483696Z","submitted_at":"2023-09-25T20:15:57Z","title":"DeepSpeed Ulysses: System Optimizations for Enabling Training of Extreme Long Sequence Transformer Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14509","snapshot_observed_at":"2026-08-01T22:45:26.151258Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:26.151258Z"},"links":{"cited_paper":"/paper/2309.14509","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:0c0a6f45c58b18e74001aae188d5fae2581d9701b0016e3fa79eb7ae991ec7d2","observation_id":"823fe407-83d4-408b-9867-35590549321e","resolution":{"observed_at":"2026-08-01T22:45:26.151258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-17T07:44:10.213698Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-01T22:45:26.247410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:26.247410Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:3b615017fd3f91ecf3b2e15283f7fb8ee3bc607d7ebf8f270e92410dd5f4ccd0","observation_id":"522be9f6-7eb7-4ae9-8721-97b4821178fd","resolution":{"observed_at":"2026-08-01T22:45:26.247410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:45:26.334984Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:26.334984Z"},"links":{"citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:b2d862f61f142b61c9c22e52768c98b0dea4d125d47b3382fd31058b34238914","observation_id":"2daaa9a3-34e2-418f-90dc-9a828ed67add","resolution":{"observed_at":"2026-08-01T22:45:26.334984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:45:26.393600Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:26.393600Z"},"links":{"citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:091f7568b7c38cd7b7ff1bcdd8d5258d65d38492900fb67f58f7acac73db1415","observation_id":"f4ef2632-5e87-46bc-bc7f-c84146a0ae1b","resolution":{"observed_at":"2026-08-01T22:45:26.393600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19108","last_updated":"2025-03-18T04:49:23Z","snapshot_observed_at":"2026-08-20T02:52:16.678339Z","submitted_at":"2024-11-28T12:50:05Z","title":"Timestep Embedding Tells: It's Time to Cache for Video Diffusion Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19108","snapshot_observed_at":"2026-08-01T22:45:26.485433Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:26.485433Z"},"links":{"cited_paper":"/paper/2411.19108","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:4862cc373a21447059aefe0bb44be8cf6814f55172b76cfa5fa8e3f02196474f","observation_id":"65fd817b-e886-4c5e-947a-82f23374cf2c","resolution":{"observed_at":"2026-08-01T22:45:26.485433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:45:26.623924Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:26.623924Z"},"links":{"citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:b13f62d74d14521f91f7724a9248d814727c21af8dbf83bac4d1cadc06132178","observation_id":"a35f0e22-eaf8-47c9-865c-2e8d216bcb01","resolution":{"observed_at":"2026-08-01T22:45:26.623924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01889","last_updated":"2023-11-27T06:38:47Z","snapshot_observed_at":"2026-08-14T10:14:18.862721Z","submitted_at":"2023-10-03T08:44:50Z","title":"Ring Attention with Blockwise Transformers for Near-Infinite Context","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01889","snapshot_observed_at":"2026-08-01T22:45:26.707814Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:26.707814Z"},"links":{"cited_paper":"/paper/2310.01889","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:fdf313a27a6d14dadabf9835b46c31530134dbf77adb54815b6ee730ab84f2f4","observation_id":"24baaa29-e874-4d57-9223-ca2b568df412","resolution":{"observed_at":"2026-08-01T22:45:26.707814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06923","last_updated":"2025-08-11T14:15:27Z","snapshot_observed_at":"2026-08-16T12:51:40.344654Z","submitted_at":"2025-03-10T05:09:42Z","title":"From Reusing to Forecasting: Accelerating Diffusion Models with TaylorSeers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06923","snapshot_observed_at":"2026-08-01T22:45:26.772478Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:26.772478Z"},"links":{"cited_paper":"/paper/2503.06923","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:63464f4f6619ec7ac24155f484f4201cd5f0a986c1f9bff408eb3d0b75fc33c5","observation_id":"3b84851b-9f73-4e9d-a4ba-60fbd5dac9a0","resolution":{"observed_at":"2026-08-01T22:45:26.772478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14577","last_updated":"2022-09-29T06:37:26Z","snapshot_observed_at":"2026-08-14T20:34:51.960761Z","submitted_at":"2022-09-29T06:37:26Z","title":"Rectified Flow: A Marginal Preserving Approach to Optimal Transport","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14577","snapshot_observed_at":"2026-08-01T22:45:26.945866Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:26.945866Z"},"links":{"cited_paper":"/paper/2209.14577","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:4bd92f6466637eaa2c6c912b01a9bdd19e1821bf385a044a800d8ef20c831d35","observation_id":"9ac6811c-c5f4-4bbe-b6ad-e3bc289802e9","resolution":{"observed_at":"2026-08-01T22:45:26.945866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10248","last_updated":"2025-02-24T10:12:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-14T15:58:10Z","title":"Step-Video-T2V Technical Report: The Practice, Challenges, and Future of Video Foundation Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10248","snapshot_observed_at":"2026-08-01T22:45:27.121517Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:27.121517Z"},"links":{"cited_paper":"/paper/2502.10248","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:726aba8890c35b452b4ac6f870ff0f539502f4d6fa2230b8a3f1c8d9b2c248a4","observation_id":"4199c132-968a-48cf-9678-9358b7234195","resolution":{"observed_at":"2026-08-01T22:45:27.121517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01733","last_updated":"2024-11-16T07:43:28Z","snapshot_observed_at":"2026-08-16T14:54:16.987293Z","submitted_at":"2024-06-03T18:49:57Z","title":"Learning-to-Cache: Accelerating Diffusion Transformer via Layer Caching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01733","snapshot_observed_at":"2026-08-01T22:45:27.256030Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:27.256030Z"},"links":{"cited_paper":"/paper/2406.01733","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:8d6c8ebe349fb4feb7d574ff4c23ae68dfa8c84b9ca5d28e580a5f564aeb0438","observation_id":"17d2dd36-afec-4d65-9b70-5e6a87ecde36","resolution":{"observed_at":"2026-08-01T22:45:27.256030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03142","last_updated":"2023-04-12T21:23:35Z","snapshot_observed_at":"2026-08-16T16:26:19.768895Z","submitted_at":"2022-10-06T18:03:56Z","title":"On Distillation of Guided Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03142","snapshot_observed_at":"2026-08-01T22:45:27.373202Z","title":"Kingma, Stefano Ermon, Jonathan Ho, and Tim Salimans","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:27.373202Z"},"links":{"cited_paper":"/paper/2210.03142","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:35d5ac6f8cd31eec9d273d336de3cc8645a5d7256c8d8dbef0b65e05631f7075","observation_id":"0727de2e-b146-47cc-bd53-6021b9c43f9e","resolution":{"observed_at":"2026-08-01T22:45:27.373202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:45:27.490719Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:27.490719Z"},"links":{"citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:8e0e923a28e8e1dd6030cf3f31293e3a813aedebbfd0934295a2c429d602613c","observation_id":"84ffb4cd-1019-4db1-a9c9-7a748eb638fd","resolution":{"observed_at":"2026-08-01T22:45:27.490719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17042","last_updated":"2023-11-28T18:53:24Z","snapshot_observed_at":"2026-08-20T04:22:54.116747Z","submitted_at":"2023-11-28T18:53:24Z","title":"Adversarial Diffusion Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17042","snapshot_observed_at":"2026-08-01T22:45:27.609289Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:27.609289Z"},"links":{"cited_paper":"/paper/2311.17042","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:57d2d76c3fd18efbd7b6752dccbdebaec6b5c456485c9cb7ee27fcbedfccafb4","observation_id":"88e68ee6-9952-4054-aae9-6f0c6d258ffa","resolution":{"observed_at":"2026-08-01T22:45:27.609289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08053","last_updated":"2020-03-13T23:45:18Z","snapshot_observed_at":"2026-08-12T10:50:46.357243Z","submitted_at":"2019-09-17T19:42:54Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08053","snapshot_observed_at":"2026-08-01T22:45:27.759104Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:27.759104Z"},"links":{"cited_paper":"/paper/1909.08053","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:750196146fa6379a61c36586c89d5134cdb5086a837fc9f35b54add089300e32","observation_id":"1c22f3dd-7284-4db1-9069-3a3da6a46509","resolution":{"observed_at":"2026-08-01T22:45:27.759104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:45:27.885554Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:27.885554Z"},"links":{"citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:0fb38569cdbce06ad5e8254962a0a6cdf8dc9a4622009c42a9c33e69e4c8660d","observation_id":"73764ea4-555e-4c5a-815a-98660f1ea44a","resolution":{"observed_at":"2026-08-01T22:45:27.885554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:45:28.032092Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:28.032092Z"},"links":{"citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:283bf41414df3a898544d68475bca7f358c1369549a8bcaca7e9babfcea77e6b","observation_id":"26bdcf4f-a8e3-473d-9d9e-67213e030f15","resolution":{"observed_at":"2026-08-01T22:45:28.032092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-01T22:45:28.196829Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:28.196829Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:46c2450fc1c260757c430feb2da54064445f4e596f305bb839b603e94412c90f","observation_id":"86f2a7f1-74c0-4112-a00d-e08afd72eabf","resolution":{"observed_at":"2026-08-01T22:45:28.196829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14430","last_updated":"2025-12-03T10:59:23Z","snapshot_observed_at":"2026-08-16T19:24:02.063445Z","submitted_at":"2024-05-23T11:00:07Z","title":"PipeFusion: Patch-level Pipeline Parallelism for Diffusion Transformers Inference","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14430","snapshot_observed_at":"2026-08-01T22:45:28.303227Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:28.303227Z"},"links":{"cited_paper":"/paper/2405.14430","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:1d2b26cbc8ed282d11c3652dcb5a6096b05c9d6800e0a49328d33731955e1c6b","observation_id":"25bafc31-e923-4e2b-90d5-2299483e9d8e","resolution":{"observed_at":"2026-08-01T22:45:28.303227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-16T05:47:34.106216Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-01T22:45:28.423325Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:28.423325Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:c05f1e1c877fb91cfed6b0258d5a961a3bc46a14dfe2e83ad94c294a47261e8b","observation_id":"96c6444f-561d-4539-8dc0-c48ba40df209","resolution":{"observed_at":"2026-08-01T22:45:28.423325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18875","last_updated":"2026-05-06T23:08:29Z","snapshot_observed_at":"2026-08-02T05:41:40.015287Z","submitted_at":"2025-05-24T21:30:29Z","title":"Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18875","snapshot_observed_at":"2026-08-01T22:45:28.569375Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:28.569375Z"},"links":{"cited_paper":"/paper/2505.18875","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:943e5ec48c752cc33376ff3a40c33c8de7e93487530ff6acf197808681fdfa6e","observation_id":"6096c1b9-6c77-4aea-8d38-1054b820ae48","resolution":{"observed_at":"2026-08-01T22:45:28.569375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-08-15T19:52:28.153954Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-01T22:45:28.734096Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:28.734096Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:c14056160c82624dd02177443879ae2c1031e469d1053a1c3b9568dedef6b176","observation_id":"d48df929-37f8-46fb-abf9-411ddcafd6f1","resolution":{"observed_at":"2026-08-01T22:45:28.734096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01005","last_updated":"2025-04-21T20:10:11Z","snapshot_observed_at":"2026-07-06T20:15:36.280948Z","submitted_at":"2025-01-02T02:02:20Z","title":"FlashInfer: Efficient and Customizable Attention Engine for LLM Inference Serving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01005","snapshot_observed_at":"2026-08-01T22:45:28.798334Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:28.798334Z"},"links":{"cited_paper":"/paper/2501.01005","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:8158226fc97b01be0a8c5c84a437fe64fff2843c17253353113744d642c87e41","observation_id":"6d9e994d-8ca0-434c-9b33-0c659e0457cf","resolution":{"observed_at":"2026-08-01T22:45:28.798334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:45:28.862029Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:28.862029Z"},"links":{"citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:338f66c39c47aa7952995b7b87be9f5d582b7a2bda1ad5786382dd5b343aeda3","observation_id":"24f41269-918d-4045-96d7-6fe800a4b166","resolution":{"observed_at":"2026-08-01T22:45:28.862029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:45:28.927399Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:28.927399Z"},"links":{"citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:ba9f19effd4c10203a74b2771cc96d5c5a42bd1e7a6c0af2e46d02bce14b38c5","observation_id":"8834e000-ce11-4c19-bfa2-b33c909a3594","resolution":{"observed_at":"2026-08-01T22:45:28.927399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:45:29.119025Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:29.119025Z"},"links":{"citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:433274bc2159d002a6cbb27fee0346fb262af8760bb1b129b5a77e1610fcdf08","observation_id":"0892b896-4e8a-49c0-9b72-4599f850e8f5","resolution":{"observed_at":"2026-08-01T22:45:29.119025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10266","last_updated":"2025-05-11T09:53:27Z","snapshot_observed_at":"2026-08-16T18:16:12.363815Z","submitted_at":"2024-03-15T12:53:50Z","title":"DSP: Dynamic Sequence Parallelism for Multi-Dimensional Transformers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.10266","snapshot_observed_at":"2026-08-01T22:45:29.193762Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:29.193762Z"},"links":{"cited_paper":"/paper/2403.10266","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:4a94655f936043ce29ea098aaf0f8b63055f971236503131f9df854ca123e6b8","observation_id":"3c52120e-7eac-466c-b8d0-9e8c63940eba","resolution":{"observed_at":"2026-08-01T22:45:29.193762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-01T22:45:29.268782Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:29.268782Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:1be5b5d7173a66d8345d7ef7edcee1441c687393384e69cf607ed5f0b5d7435a","observation_id":"2dafe89c-a4cc-4487-9aa1-3e3919d928b3","resolution":{"observed_at":"2026-08-01T22:45:29.268782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07104","last_updated":"2024-06-06T00:10:06Z","snapshot_observed_at":"2026-08-18T16:18:58.765617Z","submitted_at":"2023-12-12T09:34:27Z","title":"SGLang: Efficient Execution of Structured Language Model Programs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07104","snapshot_observed_at":"2026-08-01T22:45:29.345624Z","title":"Gonzalez, Clark Barrett, and Ying Sheng","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:29.345624Z"},"links":{"cited_paper":"/paper/2312.07104","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:1d2d4752b62946bd12b45ac36797eab17432f0f7cc16c7d23198ada66afa98aa","observation_id":"13335d1f-be6c-499b-876e-630139f65520","resolution":{"observed_at":"2026-08-01T22:45:29.345624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:45:29.020251Z","title":"InInternational Conference on Machine Learning (ICML)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:29.020251Z"},"links":{"citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:befc16387d39406bc9428f6389120de62eb4ccc2ccaf92762316e4859bdb1404","observation_id":"907a84bd-3dab-4a24-b786-11e9ce0ad3d2","resolution":{"observed_at":"2026-08-01T22:45:29.020251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T18:03:14.014923Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":40,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2607.15650."}