{"as_of":"2026-08-14T22:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f7e90d09f2dbc45a40506f32c978839ba94ff5064e9a9518452f8837a1014b11","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T12:21:30.777549Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T01:56:58.065979Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.21858","snapshot_observed_at":"2026-08-01T07:15:33.625508Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21529","last_updated":"2026-07-31T09:23:37Z","snapshot_observed_at":"2026-08-08T03:21:15.162809Z","submitted_at":"2026-07-23T17:15:30Z","title":"ElasticTTT: Prior-Preserving Test-Time Tuning for Video Editing","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-01T07:15:33.625508Z"},"links":{"cited_paper":"/paper/2507.21858","citing_paper":"/paper/2607.21529"},"observation_digest":"sha256:0fa5356d709541b1a50351b74fbf0ac6140adc96f36a282b4ae91fee4d074e13","observation_id":"9c00a2d0-9acb-4813-8500-619f2604ab79","resolution":{"observed_at":"2026-08-01T07:15:33.625508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.21858","snapshot_observed_at":"2026-08-03T01:56:58.065979Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21529","last_updated":"2026-07-31T09:23:37Z","snapshot_observed_at":"2026-08-08T03:21:15.162809Z","submitted_at":"2026-07-23T17:15:30Z","title":"ElasticTTT: Prior-Preserving Test-Time Tuning for Video Editing","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-03T01:56:58.065979Z"},"links":{"cited_paper":"/paper/2507.21858","citing_paper":"/paper/2607.21529"},"observation_digest":"sha256:7616a828aec85f79cf9d8608300c9a94f320452024af6a6c31ca7ecf9f472b2d","observation_id":"2138f191-999c-419e-a40a-5f6031d142e7","resolution":{"observed_at":"2026-08-03T01:56:58.065979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.21858/citation-record","integrity":"/paper/2507.21858/integrity","json":"/paper/2507.21858/citation-record.json","paper":"/paper/2507.21858"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.417551Z","title":"Semantic self- adaptation: Enhancing generalization with a single sample,","venue":null,"work_id":"eeb38ca5-0b6f-4774-86b9-91d6040873f9","year":null},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.574023Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:2bd09e054033688bbb82200f61665ce8baccbacefefe0e57c8ca621f64babbbc","observation_id":"6fedf50a-146d-4f93-865d-d4f10cd65d88","resolution":{"observed_at":"2026-08-06T12:21:31.421124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.406715Z","title":"Pix2video: Video editing using image diffusion","venue":null,"work_id":"e874a198-4ecb-42f8-b8d0-6a782eba5a27","year":2023},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.577778Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:574245828c03a11117fb3bc3cc5eb32853ef74481f290c052f7e0e77e7dfdcad","observation_id":"02c5201d-9714-4276-b379-48262e54cb5e","resolution":{"observed_at":"2026-08-06T12:21:31.410751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.396404Z","title":"FLATTEN: optical FLow-guided ATTENtion for consistent text-to-video edit- ing","venue":null,"work_id":"18ef7fd6-5ebd-4536-afcb-248522fe7a55","year":2024},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.581546Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:9d66b963b809d93d0e13bfd4c7621a6e8c5a64ec278a3758c5999bc8d74a3082","observation_id":"05ae6293-ace6-49b3-a432-180c42769af7","resolution":{"observed_at":"2026-08-06T12:21:31.400180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.386450Z","title":"NextLevelBERT: Masked language mod- eling with higher-level representations for long documents","venue":null,"work_id":"a0867db1-c6e2-4692-b503-9eaab6dbc47a","year":2024},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.585240Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:19e9ab95299af0fbbfd7766240f75a364fa207ef6e3b906012bf79f0b6f59cdd","observation_id":"30d3d4c0-993f-40be-b378-6f0ea83fa2da","resolution":{"observed_at":"2026-08-06T12:21:31.389961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.376109Z","title":"Bert: Pre-training of deep bidirectional trans- formers for language understanding","venue":null,"work_id":"d295139e-399c-4749-af42-01af1609dccd","year":null},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.588960Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:9ea4e6bfd15e04ea011db43909e0a1edf7350abc5133a573ccdc7cbd64cb6f07","observation_id":"4a6b0d72-722f-4779-be66-5e2c1d7caa41","resolution":{"observed_at":"2026-08-06T12:21:31.379712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:30.592480Z","title":"Test-time training with masked autoencoders.Advances in Neural Information Processing Systems, 35:29374–29385,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.592480Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:762e45e555399afb6a03976a150bfd464647d6b1bebb99ab2589ad9246e1073a","observation_id":"0353f248-e33c-4f67-baf7-d186f9955bc8","resolution":{"observed_at":"2026-08-06T12:21:30.592480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10373","last_updated":"2023-11-20T10:54:09Z","snapshot_observed_at":"2026-08-13T17:55:49.664545Z","submitted_at":"2023-07-19T18:00:03Z","title":"TokenFlow: Consistent Diffusion Features for Consistent Video Editing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10373","snapshot_observed_at":"2026-08-06T12:21:30.596011Z","title":"Tokenflow: Consistent diffusion features for consistent video editing.arXiv preprint arXiv:2307.10373, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.596011Z"},"links":{"cited_paper":"/paper/2307.10373","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:aabcb1e9ad1d15ec54bb5cd0ca7f41d7c6df2be81b6ccb7e6d412f01f193ebe8","observation_id":"7aa177a9-560a-4964-9c74-61c04001c60d","resolution":{"observed_at":"2026-08-06T12:21:30.596011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:30.599965Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.599965Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:10b06d477804b0848314cf9fe499b1e3633204005735c167eb21d0cc07e54d4a","observation_id":"04b55c14-2e68-4281-9d6a-2539149dccc4","resolution":{"observed_at":"2026-08-06T12:21:30.599965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.354178Z","title":"Ddpm-moco: Advancing industrial surface defect generation and detec- 7 tion with generative and contrastive learning","venue":null,"work_id":"2e7413b3-697d-4e0e-a8f4-ac5dd21df76e","year":null},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.603893Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:72235efab0630083634d408906d2169bb7d020e89067a180d01c2255b2627712","observation_id":"0d9823e5-02f9-4f0e-bd57-b8ecb14a26fe","resolution":{"observed_at":"2026-08-06T12:21:31.357909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04606","last_updated":"2025-06-11T04:23:47Z","snapshot_observed_at":"2026-08-10T23:53:17.654639Z","submitted_at":"2025-01-08T16:41:31Z","title":"Enhancing Low-Cost Video Editing with Lightweight Adaptors and Temporal-Aware Inversion","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04606","snapshot_observed_at":"2026-08-06T12:21:30.607506Z","title":"Enhancing low-cost video editing with lightweight adaptors and temporal-aware inversion.arXiv preprint arXiv:2501.04606, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.607506Z"},"links":{"cited_paper":"/paper/2501.04606","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:6a9928de0fc317db2f2c71c07ebde642f750d50a46c362ecbe9a59a7b78a6147","observation_id":"4f008a0c-cd4d-4404-bfdd-22b30ccaba8e","resolution":{"observed_at":"2026-08-06T12:21:30.607506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.343387Z","title":"Diffusionbert: Improving generative masked language models with diffusion models","venue":null,"work_id":"368eb041-f3d8-4090-84ba-05237ffc252e","year":null},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.611410Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:df55226913d52c678513eb397784f02ccace57d448ffc2b3dbb1fb7fccc4a9a9","observation_id":"62757d6e-9c6b-4c24-9a82-efa6bc8079f1","resolution":{"observed_at":"2026-08-06T12:21:31.347060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-06T12:21:30.614749Z","title":"Imagen video: High definition video generation with diffusion mod- els.arXiv preprint arXiv:2210.02303, 2022","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.614749Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:8a9c2ec503e0e930d4335ec6337925d45b71aa4f29b385cc6aaa9289af3a6a12","observation_id":"bb7ac731-5b6c-4d60-ba8d-5ce4501c821c","resolution":{"observed_at":"2026-08-06T12:21:30.614749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.15868","last_updated":"2022-05-29T19:02:15Z","snapshot_observed_at":"2026-08-12T19:21:15.526321Z","submitted_at":"2022-05-29T19:02:15Z","title":"CogVideo: Large-scale Pretraining for Text-to-Video Generation via Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.15868","snapshot_observed_at":"2026-08-06T12:21:30.618816Z","title":"Cogvideo: Large-scale pretraining for text-to-video generation via transformers.arXiv preprint arXiv:2205.15868, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.618816Z"},"links":{"cited_paper":"/paper/2205.15868","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:50daf3ab4e1be2d37405f2e27757ca20f487ce802b91b635535eed1ca5d6d352","observation_id":"8f64ece9-7b5c-42ce-adb4-d06ad5491978","resolution":{"observed_at":"2026-08-06T12:21:30.618816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.331509Z","title":"Ground-a-video: Zero- shot grounded video editing using text-to-image diffusion models","venue":null,"work_id":"1d7a5be9-465d-46b9-8a9a-0a31d1867008","year":2024},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.622433Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:a21f1172941239b2db2940da373024da8a86e4326387889d9c5abff1a25c0e89","observation_id":"003e1ca1-a587-4227-aca6-8f37394f3ecc","resolution":{"observed_at":"2026-08-06T12:21:31.335837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13439","last_updated":"2023-03-23T17:01:59Z","snapshot_observed_at":"2026-08-13T12:18:15.824424Z","submitted_at":"2023-03-23T17:01:59Z","title":"Text2Video-Zero: Text-to-Image Diffusion Models are Zero-Shot Video Generators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13439","snapshot_observed_at":"2026-08-06T12:21:30.625613Z","title":"Text2video-zero: Text-to- image diffusion models are zero-shot video generators.arXiv preprint arXiv:2303.13439, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.625613Z"},"links":{"cited_paper":"/paper/2303.13439","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:81b417a9f9a327fcc4f112cb374ec079405fa5cd10fe8e9585c8524a838bf837","observation_id":"4eae43ce-1ac0-4c10-be9c-8bd7e944d005","resolution":{"observed_at":"2026-08-06T12:21:30.625613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.320305Z","title":"Masked vision and language modeling for multi-modal representation learn- ing","venue":null,"work_id":"032ecceb-a2e5-4c1c-93d2-7965163da4d4","year":2023},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.629137Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:349d4c35a278fbcfd03faa2f9037bd0c2051ca81c2d622d68584a4286034447c","observation_id":"b1b40b51-939a-4e3f-a62e-1321fcfee645","resolution":{"observed_at":"2026-08-06T12:21:31.324696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.310324Z","title":"Vidtome: Video token merging for zero-shot video editing","venue":null,"work_id":"125ce1c4-040d-4cf9-a1fc-e1c0d73afc43","year":2024},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.633114Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:d1baace0d1e2fe4302808157c65cf5db1371ccb9d6035dd196fb66cb099fa7e2","observation_id":"537fc88f-dc7e-4df1-a450-04542264b519","resolution":{"observed_at":"2026-08-06T12:21:31.313932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.298844Z","title":"Video test-time adaptation for action recognition","venue":null,"work_id":"db98ef5d-e9e4-4c00-be41-03be91cb7c72","year":2023},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.636424Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:63dbf37640c677a2c8bd7508ff48913647cdbfce2ddd32055baee6f5226816a4","observation_id":"d01e2755-4aa3-403b-af83-c244893c08b9","resolution":{"observed_at":"2026-08-06T12:21:31.303031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17177","last_updated":"2024-04-17T18:41:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-27T03:30:58Z","title":"Sora: A Review on Background, Technology, Limitations, and Opportunities of Large Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17177","snapshot_observed_at":"2026-08-06T12:21:30.639637Z","title":"Sora: A review on background, technology, limitations, and opportunities of large vision models.arXiv preprint arXiv:2402.17177, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.639637Z"},"links":{"cited_paper":"/paper/2402.17177","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:6f4570726be2a8d90eeccc066b0713d7f1152df4bde6a9c3b0fbb4c003b96827","observation_id":"59233cbf-5e7b-43d5-88c4-76392862f18e","resolution":{"observed_at":"2026-08-06T12:21:30.639637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.288039Z","title":"Fatezero: Fus- ing attentions for zero-shot text-based video editing","venue":null,"work_id":"ba8790fc-8125-47af-8e90-ffccc9c7552b","year":2023},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.643101Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:00ba091606242fb6c0b0d40af931ba84631b537203c5dac379b9d859011b9bcd","observation_id":"904a789e-55a7-4d16-914b-508ea7038a8a","resolution":{"observed_at":"2026-08-06T12:21:31.291998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09535","last_updated":"2023-10-11T17:46:21Z","snapshot_observed_at":"2026-08-14T18:34:51.315021Z","submitted_at":"2023-03-16T17:51:13Z","title":"FateZero: Fusing Attentions for Zero-shot Text-based Video Editing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09535","snapshot_observed_at":"2026-08-06T12:21:30.646712Z","title":"Fatezero: Fusing attentions for zero-shot text-based video editing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.646712Z"},"links":{"cited_paper":"/paper/2303.09535","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:f0efebdb48a0991bbc890348444e3e8c8dbba4ae08645b3170337e19979a131e","observation_id":"c2d9fafd-878e-44f7-bb50-5b5c4d2efc27","resolution":{"observed_at":"2026-08-06T12:21:30.646712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:30.650077Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.650077Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:db7227c46017c875239c47059642f986ec7aaecbabd7a081827427dd91e2d982","observation_id":"fa40273c-2d39-4aed-b921-4250660117c9","resolution":{"observed_at":"2026-08-06T12:21:30.650077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.270806Z","title":"You only look once: Unified, real-time object de- tection, 2016","venue":null,"work_id":"377f4466-3205-466a-9f0b-025630ce8e32","year":2016},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.653326Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:e1882c26cf235c8536749668e305dd849b898f98fc85b69947ea81e529fa0182","observation_id":"e1cb4bd4-f191-4ed3-a923-36d978c66fc9","resolution":{"observed_at":"2026-08-06T12:21:31.274474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.260311Z","title":"U-net: Convolutional networks for biomedical image segmentation","venue":null,"work_id":"04d97430-9343-420e-8e9d-af2c2e6521d8","year":2015},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.656758Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:898479373a938769adafe71619612a58bfc1ec31353397ef1f71f1851322a906","observation_id":"c09080ef-7129-4e91-a4ba-d994d9e50676","resolution":{"observed_at":"2026-08-06T12:21:31.263986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.248593Z","title":"Cloudfixer: Test-time adaptation for 3d point clouds via diffusion-guided geometric transformation","venue":null,"work_id":"2aa74625-c233-428e-ad01-96fc75ee6976","year":2024},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.660001Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:effc0114834e3b834ecccc6bc0209e74281d1c8cfc9d1e6013ba924790ee1de4","observation_id":"4b873bd5-ba16-4023-a1d9-c5d2254e9962","resolution":{"observed_at":"2026-08-06T12:21:31.253181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.235981Z","title":"Mm-tta: Multi-modal test-time adaptation for 3d se- mantic segmentation","venue":null,"work_id":"5b26dffc-2633-435f-bdb3-a72abef83738","year":2022},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.663180Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:603cce4a2b8f1ebf2047aa9d637781518cb7c379062678b7af7cdb79fe4c8e6a","observation_id":"685df8c3-56e6-4d66-af1f-7be27d89b682","resolution":{"observed_at":"2026-08-06T12:21:31.240134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14792","last_updated":"2022-09-29T13:59:46Z","snapshot_observed_at":"2026-07-06T13:57:47.051387Z","submitted_at":"2022-09-29T13:59:46Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14792","snapshot_observed_at":"2026-08-06T12:21:30.666253Z","title":"Make-a-video: Text-to-video generation without text-video data.arXiv preprint arXiv:2209.14792,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.666253Z"},"links":{"cited_paper":"/paper/2209.14792","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:04af81ec984a437ee6225117ea00b345517177d39e1c7ecca9d46e716cb75a29","observation_id":"dac4bf0b-476b-45f8-8dce-3e9440568813","resolution":{"observed_at":"2026-08-06T12:21:30.666253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.222680Z","title":"Efros, and Moritz Hardt","venue":null,"work_id":"885d0aab-bbe3-4d1c-91c2-f4d5da534975","year":2020},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.670744Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:8e1e1927643375af1897bc181279002cba3719c74bfea2396600e17193dedc6e","observation_id":"5a0da13f-1a09-4799-a446-be1fb2fab64b","resolution":{"observed_at":"2026-08-06T12:21:31.226905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.208233Z","title":"VideoMAE: Masked autoencoders are data-efficient learners for self-supervised video pre-training","venue":null,"work_id":"87ca9253-8d97-4776-9d3b-eb53a4437a14","year":2022},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.674005Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:657131307115b8b621bf2ff0f7beb3450506665dec9f4740fc9d2b707660f680","observation_id":"dee5c66f-96bf-48a3-8aa3-cec629383101","resolution":{"observed_at":"2026-08-06T12:21:31.212775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.15126","last_updated":"2023-10-10T11:57:26Z","snapshot_observed_at":"2026-08-13T10:25:10.289920Z","submitted_at":"2023-08-29T08:51:24Z","title":"Evaluation and Analysis of Hallucination in Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.15126","snapshot_observed_at":"2026-08-06T12:21:30.677316Z","title":"Evaluation and analysis of hal- lucination in large vision-language models.arXiv preprint arXiv:2308.15126, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.677316Z"},"links":{"cited_paper":"/paper/2308.15126","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:d72ed4f280c9d61c992f98f5131f610f35ec4a2af80bd5e883afcdd211ba568d","observation_id":"fae2b7ab-3970-4252-ba0c-dfa607838ff3","resolution":{"observed_at":"2026-08-06T12:21:30.677316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20367","last_updated":"2025-08-07T08:34:03Z","snapshot_observed_at":"2026-08-10T23:21:29.606520Z","submitted_at":"2024-12-29T06:15:41Z","title":"Enhancing Code LLMs with Reinforcement Learning in Code Generation: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20367","snapshot_observed_at":"2026-08-06T12:21:30.680985Z","title":"Enhancing code llms with reinforce- ment learning in code generation: A survey.arXiv preprint arXiv:2412.20367, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.680985Z"},"links":{"cited_paper":"/paper/2412.20367","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:f672e03d8c05246f97880ea1239add7656466daf8eb9b73507cfa449ed0db374","observation_id":"8d3c9b8d-454e-4306-b1b7-bba3a2303ef0","resolution":{"observed_at":"2026-08-06T12:21:30.680985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:30.684555Z","title":"Videomae v2: Scaling video masked autoencoders with dual masking","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.684555Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:8d40aa8362368342bc16367e2e463921ae76f5112a9ba29efe5692f86a0a805e","observation_id":"c804e5d0-60b2-4912-9c53-76c08db9991f","resolution":{"observed_at":"2026-08-06T12:21:30.684555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.185243Z","title":"Videomae v2: Scaling video masked autoencoders with dual masking","venue":null,"work_id":"f08f0acd-0ace-42eb-955d-97b6cbf20bb5","year":null},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.688590Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:d5ec0c52e56596860c2cc52537f4e31f6a80ecbcfe3479f9f110c8c4fa429abb","observation_id":"23b81034-ccd7-4456-a815-3a1ef37e6f02","resolution":{"observed_at":"2026-08-06T12:21:31.189588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.171898Z","title":"Unitmge: Uniform text-motion generation and 8 editing model via diffusion","venue":null,"work_id":"154743e6-2c8f-4ea4-8446-3dc89fbf73a2","year":2025},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.691788Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:422df8744cbbdacb5a562e5f0ca641a99f12a7074f39613c10c2e32a18fc150f","observation_id":"37478069-65a4-4afb-a921-062d88a64ce3","resolution":{"observed_at":"2026-08-06T12:21:31.176259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17599","last_updated":"2024-01-04T01:30:50Z","snapshot_observed_at":"2026-08-14T18:34:50.250668Z","submitted_at":"2023-03-30T17:59:25Z","title":"Zero-Shot Video Editing Using Off-The-Shelf Image Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17599","snapshot_observed_at":"2026-08-06T12:21:30.698763Z","title":"Zero-shot video editing using off-the-shelf image diffusion models.arXiv preprint arXiv:2303.17599, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.698763Z"},"links":{"cited_paper":"/paper/2303.17599","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:8d544535d31a3d7b8dcff623633991011ec5c51b726e23246fa14735565fc916","observation_id":"e323dd14-df4b-4ca1-8a89-3aff1f40ced4","resolution":{"observed_at":"2026-08-06T12:21:30.698763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.159191Z","title":"Backpropagation- free test-time adaptation for 3d point cloud segmentation","venue":null,"work_id":"a8be7f55-7ab9-47bc-ba69-8e6202d4012f","year":2024},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.702394Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:e9ac971797c27d5604a25a391e68a981eb4a10256a48b926f4a4edab5e906bcf","observation_id":"386d86ec-58c5-4738-9cb6-041f389361d0","resolution":{"observed_at":"2026-08-06T12:21:31.163693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.146543Z","title":"Tune-a-video: One-shot tuning of image diffusion models for text-to-video generation","venue":null,"work_id":"389e829e-d905-4e2e-b970-f6d34722476e","year":2023},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.705736Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:8fdc1ba1436936ea0f7c65e9feae9b24ad72d5ac2613620951316e44e3a25f1e","observation_id":"eef71662-8d63-4fa1-81a1-6bb8556918bf","resolution":{"observed_at":"2026-08-06T12:21:31.151371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.132502Z","title":null,"venue":null,"work_id":"5211e23d-1655-4398-bc3c-09c238a5fd09","year":2024},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.708891Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:3083da4a2bc62298d3acd44ca98cab7bfeca624122e3c9ab661ae9e3d5d77caa","observation_id":"972fa06f-135f-4f6e-bb4d-37641fe24cc6","resolution":{"observed_at":"2026-08-06T12:21:31.137045Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07347","last_updated":"2024-02-12T00:36:34Z","snapshot_observed_at":"2026-08-13T04:20:58.263445Z","submitted_at":"2024-02-12T00:36:34Z","title":"Accuracy of TextFooler black box adversarial attacks on 01 loss sign activation neural network ensemble","version":1},"cited_work":{"arxiv_id":"2402.07347","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.07347","snapshot_observed_at":"2026-08-06T12:21:30.915472Z","title":"Accuracy of TextFooler black box adversarial attacks on 01 loss sign activation neural network ensemble","venue":"cs.LG","work_id":"675a70fc-7b5c-4a2a-9c46-ed5a1b3859fc","year":2024},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.711726Z"},"links":{"cited_paper":"/paper/2402.07347","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:1e7ce04470c73aa3b098775344b7fd4ab72551560dacd07a4eabc6fbd6b8d7be","observation_id":"f8f2a0af-7945-4e5e-81bf-d0bb89a54c59","resolution":{"observed_at":"2026-08-06T12:21:30.921400Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17801","last_updated":"2025-07-23T17:42:13Z","snapshot_observed_at":"2026-08-10T10:44:47.927227Z","submitted_at":"2025-07-23T17:42:13Z","title":"Lumina-mGPT 2.0: Stand-Alone AutoRegressive Image Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.17801","snapshot_observed_at":"2026-08-06T12:21:30.715303Z","title":"Lumina-mgpt 2.0: Stand- alone autoregressive image modeling.arXiv preprint arXiv:2507.17801, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.715303Z"},"links":{"cited_paper":"/paper/2507.17801","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:836dae81dc05456a91f99c41d18fe2aa1f1dacf6260b789343bb4f330837b57c","observation_id":"05249317-56a7-4802-93f6-70c625fbc391","resolution":{"observed_at":"2026-08-06T12:21:30.715303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.13032","last_updated":"2025-07-17T12:02:38Z","snapshot_observed_at":"2026-08-12T09:22:27.064744Z","submitted_at":"2025-07-17T12:02:38Z","title":"Resurrect Mask AutoRegressive Modeling for Efficient and Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.13032","snapshot_observed_at":"2026-08-06T12:21:30.718582Z","title":"Resurrect mask autoregressive modeling for efficient and scalable image generation.arXiv preprint arXiv:2507.13032, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.718582Z"},"links":{"cited_paper":"/paper/2507.13032","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:edd4ebf744c74dd9ed8345f574c26dc36fd3eaf57ac04b6d804af28609b1ddc5","observation_id":"cd7e58ad-be0b-4b27-b9f0-d6a2e5eb7c6b","resolution":{"observed_at":"2026-08-06T12:21:30.718582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.119747Z","title":"Modality-collaborative test- time adaptation for action recognition","venue":null,"work_id":"a5eefd30-66dd-433a-a03f-8e1a763a0f89","year":2024},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.722158Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:d615b19ac4325a7b500691f5a877fcb9fa56c13eab404259a1b49816cebeb5fb","observation_id":"263bee61-4a89-447e-95f4-85a21ef4a574","resolution":{"observed_at":"2026-08-06T12:21:31.124237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:30.725353Z","title":"Gmflow: Learning optical flow via global matching","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.725353Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:f704945ae31aa9676e0885b189ecfdd7e5f8c33dbedeef5cec38a254c37daa3d","observation_id":"5415fabd-46f1-4748-92f7-255466837f55","resolution":{"observed_at":"2026-08-06T12:21:30.725353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10157","last_updated":"2021-09-14T21:20:06Z","snapshot_observed_at":"2026-08-13T14:30:50.605700Z","submitted_at":"2021-04-20T17:58:03Z","title":"VideoGPT: Video Generation using VQ-VAE and Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10157","snapshot_observed_at":"2026-08-06T12:21:30.728952Z","title":"Videogpt: Video generation using vq-vae and trans- formers.arXiv preprint arXiv:2104.10157, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.728952Z"},"links":{"cited_paper":"/paper/2104.10157","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:b2dd844e6a300fcd0978645275c05da856af2d43eb8ea3afe4644c396175ce4c","observation_id":"da11e552-64a8-410f-b0d1-dd04ec6ea4b9","resolution":{"observed_at":"2026-08-06T12:21:30.728952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02082","last_updated":"2025-03-10T02:32:41Z","snapshot_observed_at":"2026-08-14T18:34:50.626799Z","submitted_at":"2024-04-02T16:28:41Z","title":"WcDT: World-centric Diffusion Transformer for Traffic Scene Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02082","snapshot_observed_at":"2026-08-06T12:21:30.733163Z","title":"Wcdt: World-centric diffusion transformer for traffic scene generation.arXiv preprint arXiv:2404.02082, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.733163Z"},"links":{"cited_paper":"/paper/2404.02082","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:02ca6bc505e42b7422ccfd13ab405e01480c352940e82b4ece7e970c024551d3","observation_id":"d1023e2f-b9be-4e7d-ae40-1a664fd4c01d","resolution":{"observed_at":"2026-08-06T12:21:30.733163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.097917Z","title":"Rerender a video: Zero-shot text-guided video-to-video translation","venue":null,"work_id":"9fe1e22e-a2ce-456d-a141-6470c6dacefe","year":2023},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.736518Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:444ca7febf733fb1502308d3b8598f8aa1621402d6746d4e37cc29422b3f85e9","observation_id":"dfa972e6-7aff-4993-b440-28255490b8be","resolution":{"observed_at":"2026-08-06T12:21:31.102356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17258","last_updated":"2025-02-24T15:39:14Z","snapshot_observed_at":"2026-08-14T18:34:49.327429Z","submitted_at":"2025-02-24T15:39:14Z","title":"VideoGrain: Modulating Space-Time Attention for Multi-grained Video Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17258","snapshot_observed_at":"2026-08-06T12:21:30.739631Z","title":"Videograin: Modulating space-time attention for multi- grained video editing.arXiv preprint arXiv:2502.17258,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.739631Z"},"links":{"cited_paper":"/paper/2502.17258","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:eb29e5641609e4d3a1c7e19f6e20b65cd7ab842f44750c88214cd9897833bc4a","observation_id":"cd89f382-50fe-4f1a-aeeb-196bf148ba24","resolution":{"observed_at":"2026-08-06T12:21:30.739631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-06T12:21:30.743218Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer.arXiv preprint arXiv:2408.06072, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.743218Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:b08266c09a278930d25122d0a5c89ad8c2667e37b7ca460aee4c51b3fa82f962","observation_id":"5f2cd2b3-27aa-4633-8916-1e226622d241","resolution":{"observed_at":"2026-08-06T12:21:30.743218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17009","last_updated":"2023-12-03T12:30:05Z","snapshot_observed_at":"2026-08-14T18:35:06.807061Z","submitted_at":"2023-11-28T18:03:27Z","title":"Space-Time Diffusion Features for Zero-Shot Text-Driven Motion Transfer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17009","snapshot_observed_at":"2026-08-06T12:21:30.746964Z","title":"Space-time diffusion features for zero-shot text-driven motion transfer.arXiv preprint arxiv:2311.17009, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.746964Z"},"links":{"cited_paper":"/paper/2311.17009","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:19d1804920a0b952bfbd89e881d75fd72a4fd5ae9a7c41890337a0aa71090764","observation_id":"34867255-1290-497a-a27b-6c2e6b18bacc","resolution":{"observed_at":"2026-08-06T12:21:30.746964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14178","last_updated":"2024-03-29T08:13:38Z","snapshot_observed_at":"2026-08-13T08:24:19.015641Z","submitted_at":"2023-04-27T13:27:01Z","title":"mPLUG-Owl: Modularization Empowers Large Language Models with Multimodality","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14178","snapshot_observed_at":"2026-08-06T12:21:30.750358Z","title":"mplug-owl: Modularization empowers large language models with multimodality.arXiv preprint arXiv:2304.14178, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.750358Z"},"links":{"cited_paper":"/paper/2304.14178","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:874be9c4d8fa61ad9fff3e00391760b6951f609477b4e3c6c62e0ae3bae45abd","observation_id":"2cf64bf5-de01-407e-8815-526f234fbeb5","resolution":{"observed_at":"2026-08-06T12:21:30.750358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.083631Z","title":"Rapid network adaptation: Learning to adapt neural networks using test-time feedback, 2023","venue":null,"work_id":"def69aa1-b272-4140-b8d6-ba1ff1de3e6d","year":2023},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.753665Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:de4afabc32356691a57f0117142fd982178dc9ffd90833b1ee5e0a7f2215ab4c","observation_id":"361d6370-d842-4618-8184-0677bd930831","resolution":{"observed_at":"2026-08-06T12:21:31.088347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.068952Z","title":"Temporal coherent test time opti- mization for robust video classification","venue":null,"work_id":"17ad8f44-884f-422f-b787-ff8ec5ddf256","year":2023},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.757108Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:eebfb3c144d2ade99f31e228e478ecf36dd24db7b3f950ffdc1f4dea31aff249","observation_id":"715cdb16-ea26-46aa-abf2-619e85e80106","resolution":{"observed_at":"2026-08-06T12:21:31.074365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.056136Z","title":"Controlvideo: Training-free controllable text-to-video generation","venue":null,"work_id":"4eff1201-c1a0-4713-afdc-42606dac3289","year":2024},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.760327Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:1dbc4b8703f7a6cbcdb2393001d8157eafa8b996a1e593cf526ce8473b9f6492","observation_id":"6e5dc0c2-4e69-400b-82fe-0fc11cefb697","resolution":{"observed_at":"2026-08-06T12:21:31.060491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-13T00:44:34.883184Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-08-06T12:21:30.764100Z","title":"Analyzing and mitigating object hallucination in large vision-language models.arXiv preprint arXiv:2310.00754,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.764100Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:9cb91cd75a8a2711b246c8ca5f52252f1fd12583125b28d2b1c0c31533c39a7f","observation_id":"80044b78-7379-40f2-998f-246a42c6813a","resolution":{"observed_at":"2026-08-06T12:21:30.764100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:21:31.042230Z","title":"Calibrated self-rewarding vision language models.Advances in Neural Information Process- ing Systems, 37:51503–51531, 2024","venue":null,"work_id":"5a7cd870-65c8-4425-a047-2ec0aaf585fa","year":2024},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.767454Z"},"links":{"citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:32b4a8873af4df249d2fc84693b6338f1ff15daffeefd741ae925fbc7ec84450","observation_id":"f19b5406-c2e1-45f2-bc57-6b24a054bc18","resolution":{"observed_at":"2026-08-06T12:21:31.047483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01300","last_updated":"2025-06-02T04:23:21Z","snapshot_observed_at":"2026-08-10T13:34:27.916880Z","submitted_at":"2025-06-02T04:23:21Z","title":"ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01300","snapshot_observed_at":"2026-08-06T12:21:30.770642Z","title":"Reagent-v: A reward-driven multi-agent framework for video understanding.arXiv preprint arXiv:2506.01300,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.770642Z"},"links":{"cited_paper":"/paper/2506.01300","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:df35cdd2e8aae55d5ac2c0980799b0799206aff4fe5e94e0eb5d0777e1d2717e","observation_id":"ea46245c-9613-4a23-86d7-d7331fac33fa","resolution":{"observed_at":"2026-08-06T12:21:30.770642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.09491","last_updated":"2025-07-13T04:44:57Z","snapshot_observed_at":"2026-08-13T19:33:23.185466Z","submitted_at":"2025-07-13T04:44:57Z","title":"GLIMPSE: Do Large Vision-Language Models Truly Think With Videos or Just Glimpse at Them?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.09491","snapshot_observed_at":"2026-08-06T12:21:30.774303Z","title":"Glimpse: Do large vision-language models truly think with videos or just glimpse at them?arXiv preprint arXiv:2507.09491, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.774303Z"},"links":{"cited_paper":"/paper/2507.09491","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:5c59c51260e5e07667c39bfa012a96c760207d2620e6e03c6707261f6b761cbf","observation_id":"237a465b-3f7e-41f7-992a-de9b69301f24","resolution":{"observed_at":"2026-08-06T12:21:30.774303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19276","last_updated":"2025-04-27T15:21:59Z","snapshot_observed_at":"2026-08-14T02:51:29.934490Z","submitted_at":"2025-04-27T15:21:59Z","title":"Anyprefer: An Agentic Framework for Preference Data Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19276","snapshot_observed_at":"2026-08-06T12:21:30.777549Z","title":"Anyprefer: An agentic framework for preference data synthesis.arXiv preprint arXiv:2504.19276, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T12:21:30.777549Z"},"links":{"cited_paper":"/paper/2504.19276","citing_paper":"/paper/2507.21858"},"observation_digest":"sha256:a0c2b12637b46426332789f41955a8d7f4a8c36093844f6607dd74c038222bdb","observation_id":"6d221192-1a0c-4527-b31c-815484dbdd53","resolution":{"observed_at":"2026-08-06T12:21:30.777549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.21858","last_updated":"2025-07-29T14:31:17Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T18:36:50.154747Z","submitted_at":"2025-07-29T14:31:17Z","title":"Low-Cost Test-Time Adaptation for Robust Video Editing"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":29,"verified_exact":0,"verified_fuzzy":28},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 2 inbound Pith citation observations for arXiv:2507.21858."}