{"as_of":"2026-08-13T06:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:215d8d680c76e1a4167835a4b59732a1a111a83bf6f25c76f1f1759de6c834ce","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T12:48:32.778043Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.16926/citation-record","integrity":"/paper/2411.16926/integrity","json":"/paper/2411.16926/citation-record.json","paper":"/paper/2411.16926"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:48:33.525508Z","title":"Deep video inpainting","venue":null,"work_id":"9c2f9c0e-0d6c-41dc-967a-8376bd22b819","year":2019},"citing_paper":{"arxiv_id":"2411.16926","last_updated":"2025-05-05T15:42:56Z","snapshot_observed_at":"2026-08-12T12:42:05.585261Z","submitted_at":"2024-11-25T20:50:21Z","title":"Context-Aware Input Orchestration for Video Inpainting","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T12:48:32.621274Z"},"links":{"citing_paper":"/paper/2411.16926"},"observation_digest":"sha256:666ce7dc5a8c0d829262210eaad6051d0a32b3def4ff5a4e7d381b2a6be10bcd","observation_id":"ab32de5f-09a9-4979-9c18-d0e629729280","resolution":{"observed_at":"2026-08-12T12:48:33.556779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:48:32.652908Z","title":"Flow-edge guided video completion","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.16926","last_updated":"2025-05-05T15:42:56Z","snapshot_observed_at":"2026-08-12T12:42:05.585261Z","submitted_at":"2024-11-25T20:50:21Z","title":"Context-Aware Input Orchestration for Video Inpainting","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T12:48:32.652908Z"},"links":{"citing_paper":"/paper/2411.16926"},"observation_digest":"sha256:57acfe25efc97438ef6c27b8bb1c85952e1962dde3b13684f10b85511216b796","observation_id":"5eb09f01-1574-4e8c-9f27-ae49a4cfb259","resolution":{"observed_at":"2026-08-12T12:48:32.652908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:48:33.487139Z","title":"Learning joint spatial-temporal transformations for video inpainting","venue":null,"work_id":"5ccbb6be-63a8-495d-bb8f-aaeedab0f9d0","year":2020},"citing_paper":{"arxiv_id":"2411.16926","last_updated":"2025-05-05T15:42:56Z","snapshot_observed_at":"2026-08-12T12:42:05.585261Z","submitted_at":"2024-11-25T20:50:21Z","title":"Context-Aware Input Orchestration for Video Inpainting","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T12:48:32.663494Z"},"links":{"citing_paper":"/paper/2411.16926"},"observation_digest":"sha256:d86fc95366149872bf148db2fb08d38a8d1f37c8e1dc5b9b38c11bfd1d86b880","observation_id":"e0120822-3288-4597-be13-7255ab0709f7","resolution":{"observed_at":"2026-08-12T12:48:33.508742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:48:33.405184Z","title":"Fuseformer: Fusing fine-grained information in transformers for video inpainting","venue":null,"work_id":"816c34fa-956e-48d4-8bfe-6d8be587c9d1","year":2021},"citing_paper":{"arxiv_id":"2411.16926","last_updated":"2025-05-05T15:42:56Z","snapshot_observed_at":"2026-08-12T12:42:05.585261Z","submitted_at":"2024-11-25T20:50:21Z","title":"Context-Aware Input Orchestration for Video Inpainting","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T12:48:32.677725Z"},"links":{"citing_paper":"/paper/2411.16926"},"observation_digest":"sha256:8766890b513eaa65a7b94034db24b68c13f54aedc8dc6d353f9caba83d041a62","observation_id":"a6ff1982-c4da-4abd-9649-64c32bb1226e","resolution":{"observed_at":"2026-08-12T12:48:33.440750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:48:33.338796Z","title":"Towards an end-to-end framework for flow-guided video inpainting","venue":null,"work_id":"ca2bc9ad-2af5-4158-b484-812a2eb26d67","year":2022},"citing_paper":{"arxiv_id":"2411.16926","last_updated":"2025-05-05T15:42:56Z","snapshot_observed_at":"2026-08-12T12:42:05.585261Z","submitted_at":"2024-11-25T20:50:21Z","title":"Context-Aware Input Orchestration for Video Inpainting","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T12:48:32.694062Z"},"links":{"citing_paper":"/paper/2411.16926"},"observation_digest":"sha256:41e0884a2c5b8d2b2a96b082ad58240d8b20606477f3e444fb594177d4cd6691","observation_id":"2dec4a94-9dd6-4ce6-84f4-cebd4f6f1ffd","resolution":{"observed_at":"2026-08-12T12:48:33.350047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:48:33.314408Z","title":"ProPainter: Improving propagation and transformer for video inpainting","venue":null,"work_id":"cc4bc709-9555-44b1-8469-2ec930ed0e4e","year":2023},"citing_paper":{"arxiv_id":"2411.16926","last_updated":"2025-05-05T15:42:56Z","snapshot_observed_at":"2026-08-12T12:42:05.585261Z","submitted_at":"2024-11-25T20:50:21Z","title":"Context-Aware Input Orchestration for Video Inpainting","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T12:48:32.709100Z"},"links":{"citing_paper":"/paper/2411.16926"},"observation_digest":"sha256:f515dc54ad19e5bd65275f9babd962fd04d62e97c7d9c1faa97ae6f3cefe7294","observation_id":"4ed16b6e-f18e-4788-a0b8-f52ddb1f858b","resolution":{"observed_at":"2026-08-12T12:48:33.322035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.00675","last_updated":"2018-03-01T17:50:08Z","snapshot_observed_at":"2026-08-02T10:51:13.194643Z","submitted_at":"2017-04-03T16:44:46Z","title":"The 2017 DAVIS Challenge on Video Object Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.00675","snapshot_observed_at":"2026-08-12T12:48:32.721612Z","title":"The 2017 davis challenge on video object segmentation","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.16926","last_updated":"2025-05-05T15:42:56Z","snapshot_observed_at":"2026-08-12T12:42:05.585261Z","submitted_at":"2024-11-25T20:50:21Z","title":"Context-Aware Input Orchestration for Video Inpainting","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T12:48:32.721612Z"},"links":{"cited_paper":"/paper/1704.00675","citing_paper":"/paper/2411.16926"},"observation_digest":"sha256:355066772f2c133d0cdd3a7a7eea0ea0a5c0424dc93b6ebb97a543acb8e76024","observation_id":"2066b2ac-b901-4d1e-8301-989058754891","resolution":{"observed_at":"2026-08-12T12:48:32.721612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:48:33.302242Z","title":"Image quality metrics: Psnr vs","venue":null,"work_id":"186f03ff-1aeb-4663-8767-3503435172f8","year":2010},"citing_paper":{"arxiv_id":"2411.16926","last_updated":"2025-05-05T15:42:56Z","snapshot_observed_at":"2026-08-12T12:42:05.585261Z","submitted_at":"2024-11-25T20:50:21Z","title":"Context-Aware Input Orchestration for Video Inpainting","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T12:48:32.729620Z"},"links":{"citing_paper":"/paper/2411.16926"},"observation_digest":"sha256:bcc418c951654f2d63dc8018189d1b21a0e8c0fcdbce54c6f8fc0baf2f2e987c","observation_id":"c25a957a-ef7a-4255-b839-829f88de1c89","resolution":{"observed_at":"2026-08-12T12:48:33.305820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:48:33.260440Z","title":"Least squares methods","venue":null,"work_id":"19f9b226-406e-4efb-85b0-ba214fb58da8","year":1990},"citing_paper":{"arxiv_id":"2411.16926","last_updated":"2025-05-05T15:42:56Z","snapshot_observed_at":"2026-08-12T12:42:05.585261Z","submitted_at":"2024-11-25T20:50:21Z","title":"Context-Aware Input Orchestration for Video Inpainting","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T12:48:32.733723Z"},"links":{"citing_paper":"/paper/2411.16926"},"observation_digest":"sha256:d959074ca8224c93a9d4d239e9031a4518674ab57074fbf2aed30fc63d725326","observation_id":"d2ce2f3d-9dc1-46cf-8bcf-4ef73c3cf294","resolution":{"observed_at":"2026-08-12T12:48:33.285323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:48:33.203057Z","title":"Raft: Recurrent all-pairs field transforms for optical flow","venue":null,"work_id":"51028927-db2d-45b4-807f-d9c354a046a1","year":2020},"citing_paper":{"arxiv_id":"2411.16926","last_updated":"2025-05-05T15:42:56Z","snapshot_observed_at":"2026-08-12T12:42:05.585261Z","submitted_at":"2024-11-25T20:50:21Z","title":"Context-Aware Input Orchestration for Video Inpainting","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T12:48:32.739617Z"},"links":{"citing_paper":"/paper/2411.16926"},"observation_digest":"sha256:eacd2b1b9c6eb7ab0fccaecc4ee7c37b3c3d10ba0b355a357ea010c3b8d113b0","observation_id":"bc2a6d1e-7f29-4c75-a939-c642cbce4a5b","resolution":{"observed_at":"2026-08-12T12:48:33.238642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:48:33.105226Z","title":"Chan, Shangchen Zhou, Xiangyu Xu, and Chen Change Loy","venue":null,"work_id":"a0a25c10-c8c7-4de1-9450-9abb19518342","year":2022},"citing_paper":{"arxiv_id":"2411.16926","last_updated":"2025-05-05T15:42:56Z","snapshot_observed_at":"2026-08-12T12:42:05.585261Z","submitted_at":"2024-11-25T20:50:21Z","title":"Context-Aware Input Orchestration for Video Inpainting","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T12:48:32.748710Z"},"links":{"citing_paper":"/paper/2411.16926"},"observation_digest":"sha256:785aee2fb0691636043af005e984bedad8f9afd33f5058547064c980b38da6c9","observation_id":"dd245656-7ddd-4e0a-a77e-7cb98efb506f","resolution":{"observed_at":"2026-08-12T12:48:33.135747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:48:32.753312Z","title":"MOSE: A new dataset for video object segmentation in complex scenes","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16926","last_updated":"2025-05-05T15:42:56Z","snapshot_observed_at":"2026-08-12T12:42:05.585261Z","submitted_at":"2024-11-25T20:50:21Z","title":"Context-Aware Input Orchestration for Video Inpainting","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T12:48:32.753312Z"},"links":{"citing_paper":"/paper/2411.16926"},"observation_digest":"sha256:132ad511900d8f429a6915c0cb84bc07c8ce18bcc739a2d6732ad74bee00be64","observation_id":"ff76649b-6f41-4c9b-b459-95d3b22554c2","resolution":{"observed_at":"2026-08-12T12:48:32.753312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:48:32.999691Z","title":"Cesar-Jr., Xiangyang Ji, and Xu-Cheng Yin","venue":null,"work_id":"03c2ccb2-5676-4834-b2b9-2fcdb33a1495","year":2024},"citing_paper":{"arxiv_id":"2411.16926","last_updated":"2025-05-05T15:42:56Z","snapshot_observed_at":"2026-08-12T12:42:05.585261Z","submitted_at":"2024-11-25T20:50:21Z","title":"Context-Aware Input Orchestration for Video Inpainting","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T12:48:32.756805Z"},"links":{"citing_paper":"/paper/2411.16926"},"observation_digest":"sha256:e84b443cf7bc9ca7a946feaec3e1b7282218c3f0a3a728869724682a24e20986","observation_id":"f76ae9d9-aab4-432e-bef3-c9dfe5686372","resolution":{"observed_at":"2026-08-12T12:48:33.052374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00833","last_updated":"2024-01-01T18:23:39Z","snapshot_observed_at":"2026-08-13T04:50:24.278474Z","submitted_at":"2024-01-01T18:23:39Z","title":"Rethinking RAFT for Efficient Optical Flow","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00833","snapshot_observed_at":"2026-08-12T12:48:32.760000Z","title":"Rethinking raft for efficient optical flow","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16926","last_updated":"2025-05-05T15:42:56Z","snapshot_observed_at":"2026-08-12T12:42:05.585261Z","submitted_at":"2024-11-25T20:50:21Z","title":"Context-Aware Input Orchestration for Video Inpainting","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T12:48:32.760000Z"},"links":{"cited_paper":"/paper/2401.00833","citing_paper":"/paper/2411.16926"},"observation_digest":"sha256:be54250f97e63ad25104cc9528d8f7e85840eeee199f7357eabe2c9cbfc56a65","observation_id":"7b6464b1-fb86-400b-9fc7-b766a96a6f59","resolution":{"observed_at":"2026-08-12T12:48:32.760000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:48:32.909036Z","title":"On the sliding-window representation in digital signal processing","venue":null,"work_id":"18c333bb-1d8a-43a1-b585-ceebed4d0d6b","year":1985},"citing_paper":{"arxiv_id":"2411.16926","last_updated":"2025-05-05T15:42:56Z","snapshot_observed_at":"2026-08-12T12:42:05.585261Z","submitted_at":"2024-11-25T20:50:21Z","title":"Context-Aware Input Orchestration for Video Inpainting","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T12:48:32.764573Z"},"links":{"citing_paper":"/paper/2411.16926"},"observation_digest":"sha256:37244ff83157c49b7f437a39fa568356c34b828ce84f23a825bcb5d3df603a20","observation_id":"22501895-f6a8-49cf-9b94-c25c3665647a","resolution":{"observed_at":"2026-08-12T12:48:32.946344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:48:32.855380Z","title":"Streamlining digital signal processing","venue":null,"work_id":"43d5aae6-980d-43a5-b6a8-f1133eb24ee6","year":2012},"citing_paper":{"arxiv_id":"2411.16926","last_updated":"2025-05-05T15:42:56Z","snapshot_observed_at":"2026-08-12T12:42:05.585261Z","submitted_at":"2024-11-25T20:50:21Z","title":"Context-Aware Input Orchestration for Video Inpainting","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T12:48:32.769217Z"},"links":{"citing_paper":"/paper/2411.16926"},"observation_digest":"sha256:f3f695d7bcbfa7eb30dd3ca8a87f45c4f334905b09e309dc2165b08a78054122","observation_id":"1a215c06-0132-42f0-a84f-576ddb8e2278","resolution":{"observed_at":"2026-08-12T12:48:32.882388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:48:32.773046Z","title":"Lumiere: A space-time diffusion model for video generation, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16926","last_updated":"2025-05-05T15:42:56Z","snapshot_observed_at":"2026-08-12T12:42:05.585261Z","submitted_at":"2024-11-25T20:50:21Z","title":"Context-Aware Input Orchestration for Video Inpainting","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T12:48:32.773046Z"},"links":{"citing_paper":"/paper/2411.16926"},"observation_digest":"sha256:99aaee36699f3ceb1894f8b4396db00b9f29a0302cf0ab080742c6413fcec8d8","observation_id":"b32349e1-8806-48e8-a289-5464022a3a2e","resolution":{"observed_at":"2026-08-12T12:48:32.773046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19918","last_updated":"2024-07-29T11:52:07Z","snapshot_observed_at":"2026-08-12T23:12:56.763608Z","submitted_at":"2024-07-29T11:52:07Z","title":"FreeLong: Training-Free Long Video Generation with SpectralBlend Temporal Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19918","snapshot_observed_at":"2026-08-12T12:48:32.778043Z","title":"Freelong: Training-free long video generation with spectralblend temporal attention","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16926","last_updated":"2025-05-05T15:42:56Z","snapshot_observed_at":"2026-08-12T12:42:05.585261Z","submitted_at":"2024-11-25T20:50:21Z","title":"Context-Aware Input Orchestration for Video Inpainting","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T12:48:32.778043Z"},"links":{"cited_paper":"/paper/2407.19918","citing_paper":"/paper/2411.16926"},"observation_digest":"sha256:a764c6647c21a901840ad0a32c1cde138c75fd96c7e29a0b3accb622495c4f07","observation_id":"7671f577-6abd-4612-bd8d-b8bbad9738f2","resolution":{"observed_at":"2026-08-12T12:48:32.778043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:48:32.744422Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16926","last_updated":"2025-05-05T15:42:56Z","snapshot_observed_at":"2026-08-12T12:42:05.585261Z","submitted_at":"2024-11-25T20:50:21Z","title":"Context-Aware Input Orchestration for Video Inpainting","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-12T12:48:32.744422Z"},"links":{"citing_paper":"/paper/2411.16926"},"observation_digest":"sha256:1d33290be8215909fa64571c6d0287fea30605e5fa8f69830fa0ca471316fc48","observation_id":"08379167-7bc6-4276-b69a-6502df61848e","resolution":{"observed_at":"2026-08-12T12:48:32.744422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.16926","last_updated":"2025-05-05T15:42:56Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T12:42:05.585261Z","submitted_at":"2024-11-25T20:50:21Z","title":"Context-Aware Input Orchestration for Video Inpainting"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":12},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:2411.16926."}