{"as_of":"2026-08-09T18:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9f1ea5119fc9b67112f7f3785acf6ff62f9006313cc3476d735eba1d7bf2355d","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T16:47:13.012400Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-25T04:50:21.390973Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.09535","last_updated":"2023-10-11T17:46:21Z","snapshot_observed_at":"2026-07-06T15:04:23.117620Z","submitted_at":"2023-03-16T17:51:13Z","title":"FateZero: Fusing Attentions for Zero-shot Text-based Video Editing","version":3},"cited_work":{"arxiv_id":"2303.09535","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.09535","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"FateZero: Fusing Attentions for Zero- shot Text-based Video Editing","venue":null,"work_id":"622a06c5-1bc5-4cd2-a4d5-26204e97b70b","year":2023},"citing_paper":{"arxiv_id":"2307.10373","last_updated":"2023-11-20T10:54:09Z","snapshot_observed_at":"2026-08-06T08:12:35.134201Z","submitted_at":"2023-07-19T18:00:03Z","title":"TokenFlow: Consistent Diffusion Features for Consistent Video Editing","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-17T20:17:47.001786Z"},"links":{"cited_paper":"/paper/2303.09535","citing_paper":"/paper/2307.10373"},"observation_digest":"sha256:15aea83f9e4f31b346f2b1861c48f40dc8c8b47993323aa8b95c08ef0eb0da2b","observation_id":"ea48ccd7-49b7-4dde-ba30-26717af64abe","resolution":{"observed_at":"2026-05-17T20:17:47.080627Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09535","last_updated":"2023-10-11T17:46:21Z","snapshot_observed_at":"2026-07-06T15:04:23.117620Z","submitted_at":"2023-03-16T17:51:13Z","title":"FateZero: Fusing Attentions for Zero-shot Text-based Video Editing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09535","snapshot_observed_at":"2026-08-09T16:47:13.012400Z","title":"Fatezero: Fusing attentions for zero-shot text-based video editing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01061","last_updated":"2025-06-30T08:26:56Z","snapshot_observed_at":"2026-08-09T16:40:37.792241Z","submitted_at":"2025-02-03T05:17:32Z","title":"OmniHuman-1: Rethinking the Scaling-Up of One-Stage Conditioned Human Animation Models","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T16:47:13.012400Z"},"links":{"cited_paper":"/paper/2303.09535","citing_paper":"/paper/2502.01061"},"observation_digest":"sha256:b0051857f3ce8d10dfbe3ce72a3d6fde43924ffa7c38705287bd4402cd7402a6","observation_id":"198dbd5c-f558-49ff-a2db-b9103e972f48","resolution":{"observed_at":"2026-08-09T16:47:13.012400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09535","last_updated":"2023-10-11T17:46:21Z","snapshot_observed_at":"2026-07-06T15:04:23.117620Z","submitted_at":"2023-03-16T17:51:13Z","title":"FateZero: Fusing Attentions for Zero-shot Text-based Video Editing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09535","snapshot_observed_at":"2026-08-08T14:34:02.054247Z","title":"Fatezero: Fusing attentions for zero-shot text- based video editing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06734","last_updated":"2025-03-12T07:47:48Z","snapshot_observed_at":"2026-08-08T14:27:58.710673Z","submitted_at":"2025-02-10T17:58:22Z","title":"Se\\~norita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T14:34:02.054247Z"},"links":{"cited_paper":"/paper/2303.09535","citing_paper":"/paper/2502.06734"},"observation_digest":"sha256:7ff09e315c7cba738041a4f3b6883d6451059c7bf4420593dc783d6f4fb7fa1b","observation_id":"bb7bec9a-b80e-4707-93b8-610c8f73af7e","resolution":{"observed_at":"2026-08-08T14:34:02.054247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09535","last_updated":"2023-10-11T17:46:21Z","snapshot_observed_at":"2026-07-06T15:04:23.117620Z","submitted_at":"2023-03-16T17:51:13Z","title":"FateZero: Fusing Attentions for Zero-shot Text-based Video Editing","version":3},"cited_work":{"arxiv_id":"2303.09535","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.09535","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"FateZero: Fusing Attentions for Zero- shot Text-based Video Editing","venue":null,"work_id":"622a06c5-1bc5-4cd2-a4d5-26204e97b70b","year":2023},"citing_paper":{"arxiv_id":"2503.21755","last_updated":"2025-08-20T15:49:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-27T17:57:01Z","title":"VBench-2.0: Advancing Video Generation Benchmark Suite for Intrinsic Faithfulness","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-14T18:42:02.940250Z"},"links":{"cited_paper":"/paper/2303.09535","citing_paper":"/paper/2503.21755"},"observation_digest":"sha256:37634637ecf265e5dd06e36b67b425bee064e50f3d5e1adb6f834e99fa8905d0","observation_id":"d813f99a-6758-46c2-ac02-cc2dd0f7cb0d","resolution":{"observed_at":"2026-05-14T18:42:03.167787Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09535","last_updated":"2023-10-11T17:46:21Z","snapshot_observed_at":"2026-07-06T15:04:23.117620Z","submitted_at":"2023-03-16T17:51:13Z","title":"FateZero: Fusing Attentions for Zero-shot Text-based Video Editing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09535","snapshot_observed_at":"2026-08-07T13:15:54.904141Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22305","last_updated":"2025-05-28T12:41:08Z","snapshot_observed_at":"2026-08-09T06:00:55.248849Z","submitted_at":"2025-05-28T12:41:08Z","title":"IKIWISI: An Interactive Visual Pattern Generator for Evaluating the Reliability of Vision-Language Models Without Ground Truth","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T13:15:54.904141Z"},"links":{"cited_paper":"/paper/2303.09535","citing_paper":"/paper/2505.22305"},"observation_digest":"sha256:2139017eb9f54dcb7b76600a00897ebea66ea9b37320c493e148a1a4dc60f344","observation_id":"a6ba314f-6a73-4e2e-a3b6-ab2736aaed4d","resolution":{"observed_at":"2026-08-07T13:15:54.904141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09535","last_updated":"2023-10-11T17:46:21Z","snapshot_observed_at":"2026-07-06T15:04:23.117620Z","submitted_at":"2023-03-16T17:51:13Z","title":"FateZero: Fusing Attentions for Zero-shot Text-based Video Editing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09535","snapshot_observed_at":"2026-08-07T12:43:41.198597Z","title":"org/abs/2303.09535","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04244","last_updated":"2025-05-29T20:37:04Z","snapshot_observed_at":"2026-08-09T14:51:02.187231Z","submitted_at":"2025-05-29T20:37:04Z","title":"Zero-Shot Adaptation of Parameter-Efficient Fine-Tuning in Diffusion Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:43:41.198597Z"},"links":{"cited_paper":"/paper/2303.09535","citing_paper":"/paper/2506.04244"},"observation_digest":"sha256:241b737c3bcaa9d4b116335cdabce638da2a86d083eb941e1f688d59a56e7047","observation_id":"312b2a7b-5a73-4941-8368-5232872cadbd","resolution":{"observed_at":"2026-08-07T12:43:41.198597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09535","last_updated":"2023-10-11T17:46:21Z","snapshot_observed_at":"2026-07-06T15:04:23.117620Z","submitted_at":"2023-03-16T17:51:13Z","title":"FateZero: Fusing Attentions for Zero-shot Text-based Video Editing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09535","snapshot_observed_at":"2026-08-06T12:21:30.646712Z","title":"Fatezero: Fusing attentions for zero-shot text-based video editing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-07T08:25:25.968013Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.646712Z"},"links":{"cited_paper":"/paper/2303.09535","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:a3ee9644696841629e22de4441a87b709878e5e87176415371c72e6fe1a7a457","observation_id":"c2d9fafd-878e-44f7-bb50-5b5c4d2efc27","resolution":{"observed_at":"2026-08-06T12:21:30.646712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09535","last_updated":"2023-10-11T17:46:21Z","snapshot_observed_at":"2026-07-06T15:04:23.117620Z","submitted_at":"2023-03-16T17:51:13Z","title":"FateZero: Fusing Attentions for Zero-shot Text-based Video Editing","version":3},"cited_work":{"arxiv_id":"2303.09535","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.09535","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"FateZero: Fusing Attentions for Zero- shot Text-based Video Editing","venue":null,"work_id":"622a06c5-1bc5-4cd2-a4d5-26204e97b70b","year":2023},"citing_paper":{"arxiv_id":"2509.05342","last_updated":"2026-04-12T20:41:39Z","snapshot_observed_at":"2026-07-06T22:24:42.849960Z","submitted_at":"2025-09-01T21:51:24Z","title":"Delta Rectified Flow Sampling for Text-to-Image Editing","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-18T19:02:18.176561Z"},"links":{"cited_paper":"/paper/2303.09535","citing_paper":"/paper/2509.05342"},"observation_digest":"sha256:559de72df590c3e6829f88f115dfcae66fce6148f1c3ca458dc61033e50b6bdd","observation_id":"3d77d0e6-fa28-41db-89e8-f15afa4ee008","resolution":{"observed_at":"2026-05-18T19:02:48.592962Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09535","last_updated":"2023-10-11T17:46:21Z","snapshot_observed_at":"2026-07-06T15:04:23.117620Z","submitted_at":"2023-03-16T17:51:13Z","title":"FateZero: Fusing Attentions for Zero-shot Text-based Video Editing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09535","snapshot_observed_at":"2026-08-03T02:31:02.343422Z","title":"arXiv:2303.09535 (2023) 4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.01207","last_updated":"2026-07-31T06:47:55Z","snapshot_observed_at":"2026-08-08T14:14:42.520398Z","submitted_at":"2026-04-01T17:51:00Z","title":"TRACE: High-Fidelity 3D Scene Editing via Tangible Reconstruction and Geometry-Aligned Contextual Video Masking","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-03T02:31:02.343422Z"},"links":{"cited_paper":"/paper/2303.09535","citing_paper":"/paper/2604.01207"},"observation_digest":"sha256:0a2ce39a318baa797b2370bfb52cb19d73a550a2d6edb1ea07153e2c9ff468eb","observation_id":"a6c6c9c6-1ff8-4b29-9b8c-82c3f6aa491a","resolution":{"observed_at":"2026-08-03T02:31:02.343422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09535","last_updated":"2023-10-11T17:46:21Z","snapshot_observed_at":"2026-07-06T15:04:23.117620Z","submitted_at":"2023-03-16T17:51:13Z","title":"FateZero: Fusing Attentions for Zero-shot Text-based Video Editing","version":3},"cited_work":{"arxiv_id":"2303.09535","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.09535","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"FateZero: Fusing Attentions for Zero- shot Text-based Video Editing","venue":null,"work_id":"622a06c5-1bc5-4cd2-a4d5-26204e97b70b","year":2023},"citing_paper":{"arxiv_id":"2605.23245","last_updated":"2026-05-22T05:28:56Z","snapshot_observed_at":"2026-07-06T23:33:29.550551Z","submitted_at":"2026-05-22T05:28:56Z","title":"SimInsert: Seamless Video Object Insertion via Regional Sparse Attention Fusion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-25T04:46:50.749223Z"},"links":{"cited_paper":"/paper/2303.09535","citing_paper":"/paper/2605.23245"},"observation_digest":"sha256:3ec1ea385581b7f8577e615c69bdbe05de733692d0c0ea9800c928232e744571","observation_id":"e0c95284-99fa-450d-a31f-ffa880c05ca6","resolution":{"observed_at":"2026-05-25T04:50:21.394185Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2303.09535/citation-record","integrity":"/paper/2303.09535/integrity","json":"/paper/2303.09535/citation-record.json","paper":"/paper/2303.09535"},"outbound":[],"paper":{"arxiv_id":"2303.09535","last_updated":"2023-10-11T17:46:21Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T15:04:23.117620Z","submitted_at":"2023-03-16T17:51:13Z","title":"FateZero: Fusing Attentions for Zero-shot Text-based Video Editing"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 10 inbound Pith citation observations for arXiv:2303.09535."}