{"as_of":"2026-08-06T23:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a1211f27cbf37c760a88fa1ab11f1d5558c59c6be35e6e40e3e78e0e4877b64e","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T21:23:43.299853Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":1,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.01733","last_updated":"2024-11-16T07:43:28Z","snapshot_observed_at":"2026-07-06T18:24:43.282366Z","submitted_at":"2024-06-03T18:49:57Z","title":"Learning-to-Cache: Accelerating Diffusion Transformer via Layer Caching","version":2},"cited_work":{"arxiv_id":"2406.01733","doi":"10.48550/arxiv.2406.01733","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.01733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning-to-cache: Accelerating diffusion transformer via layer caching","venue":"arXiv (Cornell University)","work_id":"021f466c-82f4-4e92-a12f-d122c2c55ef4","year":2024},"citing_paper":{"arxiv_id":"2405.14430","last_updated":"2025-12-03T10:59:23Z","snapshot_observed_at":"2026-08-04T10:57:26.733885Z","submitted_at":"2024-05-23T11:00:07Z","title":"PipeFusion: Patch-level Pipeline Parallelism for Diffusion Transformers Inference","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-24T01:17:11.261301Z"},"links":{"cited_paper":"/paper/2406.01733","citing_paper":"/paper/2405.14430"},"observation_digest":"sha256:5a412da5705ed88addb9b39c752771ff3180966510f8b30660cfc85e5bc970e2","observation_id":"68593e84-379b-40e8-b2fd-bbb5509dca58","resolution":{"observed_at":"2026-05-24T01:18:42.398669Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01733","last_updated":"2024-11-16T07:43:28Z","snapshot_observed_at":"2026-07-06T18:24:43.282366Z","submitted_at":"2024-06-03T18:49:57Z","title":"Learning-to-Cache: Accelerating Diffusion Transformer via Layer Caching","version":2},"cited_work":{"arxiv_id":"2406.01733","doi":"10.48550/arxiv.2406.01733","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.01733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning-to-cache: Accelerating diffusion transformer via layer caching","venue":"arXiv (Cornell University)","work_id":"021f466c-82f4-4e92-a12f-d122c2c55ef4","year":2024},"citing_paper":{"arxiv_id":"2602.05449","last_updated":"2026-04-20T12:18:51Z","snapshot_observed_at":"2026-07-06T22:44:37.993093Z","submitted_at":"2026-02-05T08:45:08Z","title":"DisCa: Accelerating Video Diffusion Transformers with Distillation-Compatible Learnable Feature Caching","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-16T07:28:08.873654Z"},"links":{"cited_paper":"/paper/2406.01733","citing_paper":"/paper/2602.05449"},"observation_digest":"sha256:1f70a02849eefdfb6f8583ab74bcd1b9cdc5acbd844af7238edca41c438b67ac","observation_id":"d02a5606-e915-4bf8-892a-ba68de491c37","resolution":{"observed_at":"2026-05-16T07:30:44.403100Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01733","last_updated":"2024-11-16T07:43:28Z","snapshot_observed_at":"2026-07-06T18:24:43.282366Z","submitted_at":"2024-06-03T18:49:57Z","title":"Learning-to-Cache: Accelerating Diffusion Transformer via Layer Caching","version":2},"cited_work":{"arxiv_id":"2406.01733","doi":"10.48550/arxiv.2406.01733","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.01733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning-to-cache: Accelerating diffusion transformer via layer caching","venue":"arXiv (Cornell University)","work_id":"021f466c-82f4-4e92-a12f-d122c2c55ef4","year":2024},"citing_paper":{"arxiv_id":"2602.13357","last_updated":"2026-08-05T03:37:20Z","snapshot_observed_at":"2026-08-06T23:50:43.102241Z","submitted_at":"2026-02-13T08:11:54Z","title":"AdaCorrection: Adaptive Offset Cache Correction for Accurate Diffusion Transformers","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-15T22:55:15.572867Z"},"links":{"cited_paper":"/paper/2406.01733","citing_paper":"/paper/2602.13357"},"observation_digest":"sha256:867366c9f3fdbbdbe9cb13eea40c939a0acb95b842b4c804d3f275c2523bd191","observation_id":"4625368b-bcb5-4845-8a89-9cebe998ecd0","resolution":{"observed_at":"2026-05-15T22:56:50.255035Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01733","last_updated":"2024-11-16T07:43:28Z","snapshot_observed_at":"2026-07-06T18:24:43.282366Z","submitted_at":"2024-06-03T18:49:57Z","title":"Learning-to-Cache: Accelerating Diffusion Transformer via Layer Caching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01733","snapshot_observed_at":"2026-08-02T21:23:43.299853Z","title":"Learning-to-cache: Accelerating diffusion transformer via layer caching.arXiv preprint arXiv:2406.01733, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.20497","last_updated":"2026-05-27T03:02:36Z","snapshot_observed_at":"2026-08-05T00:43:25.153636Z","submitted_at":"2026-02-24T02:53:28Z","title":"LESA: Learnable Stage-Aware Predictors for Diffusion Model Acceleration","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T21:23:43.299853Z"},"links":{"cited_paper":"/paper/2406.01733","citing_paper":"/paper/2602.20497"},"observation_digest":"sha256:b95d161cc80873ee3bde8f7a845b220073ec7e7467751cd389fcdbf27f092186","observation_id":"e1433d7d-a275-4bc1-968f-53b6163b80d6","resolution":{"observed_at":"2026-08-02T21:23:43.299853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01733","last_updated":"2024-11-16T07:43:28Z","snapshot_observed_at":"2026-07-06T18:24:43.282366Z","submitted_at":"2024-06-03T18:49:57Z","title":"Learning-to-Cache: Accelerating Diffusion Transformer via Layer Caching","version":2},"cited_work":{"arxiv_id":"2406.01733","doi":"10.48550/arxiv.2406.01733","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.01733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning-to-cache: Accelerating diffusion transformer via layer caching","venue":"arXiv (Cornell University)","work_id":"021f466c-82f4-4e92-a12f-d122c2c55ef4","year":2024},"citing_paper":{"arxiv_id":"2602.22575","last_updated":"2026-05-05T13:29:50Z","snapshot_observed_at":"2026-07-06T22:47:06.893212Z","submitted_at":"2026-02-26T03:30:28Z","title":"S2O: Early Stopping for Sparse Attention via Online Permutation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-15T19:32:52.948154Z"},"links":{"cited_paper":"/paper/2406.01733","citing_paper":"/paper/2602.22575"},"observation_digest":"sha256:282a008bb76218a3cba844361d2bf38258b448c6e9f0a0ddb5f3f08692823033","observation_id":"e4195a67-9b26-4346-8864-d8dc672cffc6","resolution":{"observed_at":"2026-05-15T19:36:32.944227Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01733","last_updated":"2024-11-16T07:43:28Z","snapshot_observed_at":"2026-07-06T18:24:43.282366Z","submitted_at":"2024-06-03T18:49:57Z","title":"Learning-to-Cache: Accelerating Diffusion Transformer via Layer Caching","version":2},"cited_work":{"arxiv_id":"2406.01733","doi":"10.48550/arxiv.2406.01733","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.01733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning-to-cache: Accelerating diffusion transformer via layer caching","venue":"arXiv (Cornell University)","work_id":"021f466c-82f4-4e92-a12f-d122c2c55ef4","year":2024},"citing_paper":{"arxiv_id":"2604.02340","last_updated":"2026-04-11T10:21:32Z","snapshot_observed_at":"2026-07-06T22:51:44.663367Z","submitted_at":"2026-02-04T13:04:58Z","title":"Not All Denoising Steps Are Equal: Model Scheduling for Faster Masked Diffusion Language Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-16T07:43:45.415485Z"},"links":{"cited_paper":"/paper/2406.01733","citing_paper":"/paper/2604.02340"},"observation_digest":"sha256:19c8bbb576d8e8a086b2bc4d6319ee51e96f68831098c96f931e4704f8a73181","observation_id":"4923d8da-09eb-4f6b-a655-f3c9fadb43cc","resolution":{"observed_at":"2026-05-16T07:47:33.002955Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01733","last_updated":"2024-11-16T07:43:28Z","snapshot_observed_at":"2026-07-06T18:24:43.282366Z","submitted_at":"2024-06-03T18:49:57Z","title":"Learning-to-Cache: Accelerating Diffusion Transformer via Layer Caching","version":2},"cited_work":{"arxiv_id":"2406.01733","doi":"10.48550/arxiv.2406.01733","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.01733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning-to-cache: Accelerating diffusion transformer via layer caching","venue":"arXiv (Cornell University)","work_id":"021f466c-82f4-4e92-a12f-d122c2c55ef4","year":2024},"citing_paper":{"arxiv_id":"2604.14561","last_updated":"2026-04-21T03:27:38Z","snapshot_observed_at":"2026-08-01T16:25:53.172850Z","submitted_at":"2026-04-16T02:43:06Z","title":"CoCoDiff: Optimizing Collective Communications for Distributed Diffusion Transformer Inference Under Ulysses Sequence Parallelism","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T10:23:19.236803Z"},"links":{"cited_paper":"/paper/2406.01733","citing_paper":"/paper/2604.14561"},"observation_digest":"sha256:15400f67567d9ec3970512ba414b068134acf2ff16306386c3c6fb2639ab3525","observation_id":"e3c1db61-0a81-487f-bf8c-4f61f74457fd","resolution":{"observed_at":"2026-05-10T10:24:20.640324Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01733","last_updated":"2024-11-16T07:43:28Z","snapshot_observed_at":"2026-07-06T18:24:43.282366Z","submitted_at":"2024-06-03T18:49:57Z","title":"Learning-to-Cache: Accelerating Diffusion Transformer via Layer Caching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01733","snapshot_observed_at":"2026-08-01T22:45:27.256030Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15650","last_updated":"2026-07-17T05:56:42Z","snapshot_observed_at":"2026-08-01T22:45:24.072338Z","submitted_at":"2026-07-17T05:56:42Z","title":"DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T22:45:27.256030Z"},"links":{"cited_paper":"/paper/2406.01733","citing_paper":"/paper/2607.15650"},"observation_digest":"sha256:7195ad521b1e97173ddbd4fdd818c87f2ea36f1080b72a05da805601fc24c742","observation_id":"17d2dd36-afec-4d65-9b70-5e6a87ecde36","resolution":{"observed_at":"2026-08-01T22:45:27.256030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.01733/citation-record","integrity":"/paper/2406.01733/integrity","json":"/paper/2406.01733/citation-record.json","paper":"/paper/2406.01733"},"outbound":[],"paper":{"arxiv_id":"2406.01733","last_updated":"2024-11-16T07:43:28Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T18:24:43.282366Z","submitted_at":"2024-06-03T18:49:57Z","title":"Learning-to-Cache: Accelerating Diffusion Transformer via Layer Caching"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2406.01733."}