{"as_of":"2026-08-13T02:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:03f2b66b62ec08820711defca79c4847d7f2f8166da64ac6fa9555a436c93925","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:09:28.952009Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.16468/citation-record","integrity":"/paper/2411.16468/integrity","json":"/paper/2411.16468/citation-record.json","paper":"/paper/2411.16468"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1910.05453","last_updated":"2020-02-16T18:35:27Z","snapshot_observed_at":"2026-08-11T05:38:01.369830Z","submitted_at":"2019-10-12T00:55:06Z","title":"vq-wav2vec: Self-Supervised Learning of Discrete Speech Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.05453","snapshot_observed_at":"2026-08-12T13:09:28.731472Z","title":"vq- wav2vec: Self-supervised learning of discrete speech repre- sentations","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.731472Z"},"links":{"cited_paper":"/paper/1910.05453","citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:8297b28e3fcbfe5bc9e6f6c1d50cdc04b99b901806ea548614914e8bfe1b27f4","observation_id":"c9d80b7b-e771-4944-bb35-9a1a7226f957","resolution":{"observed_at":"2026-08-12T13:09:28.731472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.567227Z","title":"Blind video temporal consistency","venue":null,"work_id":"43f5daf9-7b03-4c50-859c-7255d385e56d","year":2015},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.737300Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:8bce81c4f3f5c457963f92b7cd177905377dfc3466804f3f2cd119e77892147c","observation_id":"3b2d9d35-3b22-4b49-8522-4deebd200df0","resolution":{"observed_at":"2026-08-12T13:09:29.571212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.556457Z","title":"Glean: Generative latent bank for large-factor image super-resolution","venue":null,"work_id":"129b0632-2a86-4bb8-9853-19f7c89d3daf","year":2021},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.741026Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:22c7d766e54f9810eef7e7c618007c3f4f02a83ad058236dfe81c3840f9553f0","observation_id":"35b93c87-4960-4e3b-b6bc-8f9afdab0939","resolution":{"observed_at":"2026-08-12T13:09:29.560089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.545248Z","title":"Basicvsr++: Improving video super- resolution with enhanced propagation and alignment","venue":null,"work_id":"0bf644ae-43f6-42d6-8009-d829ce71e940","year":2022},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.744940Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:d5f60c246540d1a2bd4e03b45ea27523b153acfefaeb82b7ebf9a058188a8759","observation_id":"77eeb86e-23d8-4a54-b2e6-601c7d491626","resolution":{"observed_at":"2026-08-12T13:09:29.549254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.534146Z","title":"Investigating tradeoffs in real-world video super-resolution","venue":null,"work_id":"210d0ff2-f810-4381-a21e-c4ef0b558a9e","year":2022},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.748715Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:053214e9da9e289c06adc32e68b05f35554494cb705ab40ff00478f99468a6ad","observation_id":"a97b87c4-ccde-45c1-8a47-669653a152d7","resolution":{"observed_at":"2026-08-12T13:09:29.538114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.523530Z","title":"Progressive semantic- aware style transformation for blind face restoration","venue":null,"work_id":"186067cb-6b8f-4c7a-9d0c-bca65fa57c43","year":2021},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.752330Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:f29f9c27bfd10802979d7a7a59d38c96bb0daee25590d64d09d18c73b313a7b1","observation_id":"3c4f623e-cd7f-45d0-8827-1469d2d93c10","resolution":{"observed_at":"2026-08-12T13:09:29.527231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.512749Z","title":"Fsrnet: End-to-end learning face super-resolution with facial priors","venue":null,"work_id":"31d1fd25-03ee-4cc8-93c3-a22188b63175","year":null},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.756388Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:d0080065863d8b71250bf6f897916b3a10cb246ef8bb5ad7462f1a56f6f97416","observation_id":"cb9bc4ee-59a4-439b-b738-ac74a6065983","resolution":{"observed_at":"2026-08-12T13:09:29.516611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.501057Z","title":"Stabilization of flicker- like effects in image sequences through local contrast cor- rection","venue":null,"work_id":"e93c78bf-e1a4-4686-9bee-48ee741e8f3a","year":null},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.759806Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:16873c3173b562f2e3c73aac8db000e4b09710358816d50c106702a85783a520","observation_id":"a4f1d00d-e524-4b21-b3b6-2a670cbe2806","resolution":{"observed_at":"2026-08-12T13:09:29.505853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09265","last_updated":"2023-11-15T08:28:28Z","snapshot_observed_at":"2026-08-10T22:04:50.196136Z","submitted_at":"2023-11-15T08:28:28Z","title":"FastBlend: a Powerful Model-Free Toolkit Making Video Stylization Easier","version":1},"cited_work":{"arxiv_id":"2311.09265","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.09265","snapshot_observed_at":"2026-08-12T13:09:29.071826Z","title":"FastBlend: a Powerful Model-Free Toolkit Making Video Stylization Easier","venue":"cs.CV","work_id":"0e93c154-7f5b-47ed-99bd-54d217677b41","year":2023},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.763647Z"},"links":{"cited_paper":"/paper/2311.09265","citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:02af631fd45da57a30fb03d131c6863dd369980a5d6b88a01284a2d98104338e","observation_id":"138959d2-ea9a-4624-8808-c48fae68b133","resolution":{"observed_at":"2026-08-12T13:09:29.077134Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16224","last_updated":"2024-01-29T15:21:37Z","snapshot_observed_at":"2026-08-11T19:34:29.645571Z","submitted_at":"2024-01-29T15:21:37Z","title":"Diffutoon: High-Resolution Editable Toon Shading via Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16224","snapshot_observed_at":"2026-08-12T13:09:28.767107Z","title":"Diffutoon: High-resolution ed- itable toon shading via diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.767107Z"},"links":{"cited_paper":"/paper/2401.16224","citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:ebc2303a7365be8aa6a928204932e3a9f0f704f00c41dbd0afb8bbee84519e62","observation_id":"2ab62ae9-cd17-460a-8810-ca64821618da","resolution":{"observed_at":"2026-08-12T13:09:28.767107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:28.770783Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.770783Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:1de2870a8bc0d25fd2bdc1191974778fe55d6221c51339bab4d0ffe85e5b92fb","observation_id":"d6569939-5b92-4138-8737-c4b11f117157","resolution":{"observed_at":"2026-08-12T13:09:28.770783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05205","last_updated":"2024-08-09T17:57:12Z","snapshot_observed_at":"2026-08-12T23:05:52.676254Z","submitted_at":"2024-08-09T17:57:12Z","title":"Kalman-Inspired Feature Propagation for Video Face Super-Resolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05205","snapshot_observed_at":"2026-08-12T13:09:28.774660Z","title":"Kalman-inspired feature propagation for video face super- resolution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.774660Z"},"links":{"cited_paper":"/paper/2408.05205","citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:b13f6fd895d11569f5915e209259b4fc4eea6f4b1c1c456fd7915021ae90b4d7","observation_id":"7eabb545-37e6-430c-884c-e99d72d1888c","resolution":{"observed_at":"2026-08-12T13:09:28.774660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.483583Z","title":"Unsuper- vised model-based learning for simultaneous video deflicker- ing and deblotching","venue":null,"work_id":"d64c42e9-ca6c-47ce-9b98-2e0e7a34e495","year":2024},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.779415Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:3573c6d10e91adc680fa1a858db13958609b2d7cd5ee39b75403a335a12c34db","observation_id":"6cace7fe-722b-4b75-901a-5907c5f30bd0","resolution":{"observed_at":"2026-08-12T13:09:29.487370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.472201Z","title":"Vqfr: Blind face restoration with vector-quantized dictionary and parallel de- coder","venue":null,"work_id":"2c12c1a3-8509-421b-bcc2-3b8487ffdb33","year":2022},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.783050Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:8d7edef4133e54a1f470387f2dccd83ae95bdb966453e599e8dbf3ec5ad38444","observation_id":"f48ddd19-1c79-4e60-b76b-1fbcedad96fd","resolution":{"observed_at":"2026-08-12T13:09:29.476621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.461453Z","title":"Face super-resolution guided by 3d facial priors","venue":null,"work_id":"cde773da-d830-4c00-9e00-4d02c4b2cf7f","year":2020},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.786375Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:b6f539569086d32489ef6ffe09ff4a7e1127234730021a6c0c8e18506c6ee09b","observation_id":"ea85165b-3dea-4698-84e1-83b3749e310c","resolution":{"observed_at":"2026-08-12T13:09:29.465509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.450202Z","title":"Straightening out the straight-through estimator: Over- coming optimization challenges in vector quantized net- works","venue":null,"work_id":"15cbde4b-429a-4ec7-b186-6f3c183288df","year":2023},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.790221Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:d3114b397a6ae31aea2d5844c72632f2198907aea3923f5fdc85d784cb9ce5c0","observation_id":"eeb7c5ef-e37d-478e-a2ac-0363ebd220b7","resolution":{"observed_at":"2026-08-12T13:09:29.454907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:28.793320Z","title":"Percep- tual losses for real-time style transfer and super-resolution","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.793320Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:6c180c456dbca588c83893cbb71f525fbc8d4ccddd130775ef8ee3ddfbb77931","observation_id":"f5520ce8-e59b-4caa-b54a-3fb2afdadcad","resolution":{"observed_at":"2026-08-12T13:09:28.793320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.433026Z","title":"Flicker removal and superpixel-based motion tracking for high speed videos","venue":null,"work_id":"7494aa2e-cda3-4634-a379-01945e9e38a9","year":2017},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.796625Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:e86a40a77539cc345692eec3608910e8c1f5a875ae7acb4d572b05e13abb34cc","observation_id":"e71c729a-8462-4bc5-9837-51af9ecc8c8b","resolution":{"observed_at":"2026-08-12T13:09:29.437343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.420631Z","title":"Video super-resolution with convolutional neu- ral networks","venue":null,"work_id":"a51d5cd0-2dd7-48b1-8c93-bcbdc81d8100","year":2016},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.799672Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:d968ab6bdb4243a067d44242128ee1fc8346cd3fe448431b3c86119a1d1375ab","observation_id":"16bf8b3d-946a-4254-82d5-b25ff10ab538","resolution":{"observed_at":"2026-08-12T13:09:29.424686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:28.803766Z","title":"A style-based generator architecture for generative adversarial networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.803766Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:be37ad09f45012d615bc545fc42bc270e072579832fdf06f367dc0fb48e7f98e","observation_id":"1f2c1bc1-8634-4d41-aac3-c2a5366fa09c","resolution":{"observed_at":"2026-08-12T13:09:28.803766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.403421Z","title":"Analyzing and improv- ing the image quality of stylegan","venue":null,"work_id":"60db6fb9-4b58-4c9e-a422-26787db405eb","year":2020},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.806762Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:216df38e62aa7437dd95f0261751fd5418e82a907183941411db419d31b7be5e","observation_id":"494dec22-0271-459f-825c-ec0a39246940","resolution":{"observed_at":"2026-08-12T13:09:29.407366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-12T13:09:28.809831Z","title":"Adam: A method for stochastic opti- mization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.809831Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:c5b1c86a23c9d378b56d36d9fa23b004ca970c9e610c845106b8bbec9c52e72c","observation_id":"cd9d69c6-ee76-4585-a783-a0fc8ad9ffd5","resolution":{"observed_at":"2026-08-12T13:09:28.809831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:28.813545Z","title":"Open-sora-plan, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.813545Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:ef26dd2d157f2891f919c6cc996ecb061e98e8f89a9bcb891d442480b460c31e","observation_id":"305b1afb-4c08-4ad2-a52e-2e54be7fc367","resolution":{"observed_at":"2026-08-12T13:09:28.813545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.387295Z","title":"Robust training of vector quantized bottleneck models","venue":null,"work_id":"5646b164-ee2d-4037-aefd-60fc09830d78","year":2020},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.817356Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:fcace859a02eeb05d619f81da45e383b98bad75b522d59ebbc349e0d7fc998a0","observation_id":"1ba523f2-6723-4dc7-ae64-46e84c9d137d","resolution":{"observed_at":"2026-08-12T13:09:29.390920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:28.820439Z","title":"Blind video temporal consistency via deep video prior.Advances in Neu- ral Information Processing Systems, 33:1083–1093, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.820439Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:b026de1f4a87cb46e63f78ec51be2b9edf79b392dd731f7a01254ec585b2fe64","observation_id":"d84019ea-c3fe-4e75-8190-62b88636d2b1","resolution":{"observed_at":"2026-08-12T13:09:28.820439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.371201Z","title":"Blind video deflickering by neural filtering with a flawed atlas","venue":null,"work_id":"54520b40-a606-4a27-a496-718f0589fee2","year":2023},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.823722Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:d87efdb134b89f42e34450e4f8236394f23bbe92cc3f0faf6e3370a81d0839ae","observation_id":"3d725c4a-55b0-4223-9ab0-ac8e419e6f20","resolution":{"observed_at":"2026-08-12T13:09:29.374772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.360373Z","title":"Learning warped guidance for blind face restoration","venue":null,"work_id":"4f16587c-959e-49dc-a66c-179fcb7fce72","year":2018},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.826816Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:fb4b36decae1a80e09302babe670619ca1d3111ae46ba639abe38d1b4993c701","observation_id":"5188bb45-0685-4d78-9807-3ed74a3e83c0","resolution":{"observed_at":"2026-08-12T13:09:29.364322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.350694Z","title":"Vrt: A video restoration transformer","venue":null,"work_id":"ad48d2a0-7fc4-4d9d-a01e-b66c657989fd","year":2024},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.829762Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:31b8188621d4ae3f36d6ce88555b08379a6249ed5427215ecb3a390cac9a3552","observation_id":"6d8cf08a-b110-482d-ba08-a14b3bde5f14","resolution":{"observed_at":"2026-08-12T13:09:29.353961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.15070","last_updated":"2024-04-12T05:26:59Z","snapshot_observed_at":"2026-08-12T20:32:42.417622Z","submitted_at":"2023-08-29T07:11:52Z","title":"DiffBIR: Towards Blind Image Restoration with Generative Diffusion Prior","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.15070","snapshot_observed_at":"2026-08-12T13:09:28.832868Z","title":"Diff- bir: Towards blind image restoration with generative diffu- sion prior","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.832868Z"},"links":{"cited_paper":"/paper/2308.15070","citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:866896b56221b1777dc5a3390a54ee082b0114f874405fb96be247e885ff14da","observation_id":"a236aae1-27fa-4f32-b3db-89024abab065","resolution":{"observed_at":"2026-08-12T13:09:28.832868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.339961Z","title":"Evalcrafter: Benchmarking and eval- uating large video generation models","venue":null,"work_id":"d80c3e86-e959-4742-a98a-f4f00e73c039","year":2024},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.836429Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:f564f1c5b854fccb42ee0080bcf1f6324f39bbf2b70b3072b09f39a78f8943ab","observation_id":"51677467-4d33-4e4e-b6cb-ca2468e00634","resolution":{"observed_at":"2026-08-12T13:09:29.343545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19918","last_updated":"2024-07-29T11:52:07Z","snapshot_observed_at":"2026-08-12T23:12:56.763608Z","submitted_at":"2024-07-29T11:52:07Z","title":"FreeLong: Training-Free Long Video Generation with SpectralBlend Temporal Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19918","snapshot_observed_at":"2026-08-12T13:09:28.839638Z","title":"Freelong: Training-free long video generation with spectralblend tem- poral attention","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.839638Z"},"links":{"cited_paper":"/paper/2407.19918","citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:bcddb5ad70cecfc322b16090894f11c2198f4cbde36bc851d3f6ee553afc5640","observation_id":"e73b5318-78f7-4c53-9e17-acb2be44268c","resolution":{"observed_at":"2026-08-12T13:09:28.839638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.330463Z","title":"Sora: Creating video from text., 2024","venue":null,"work_id":"b1234d61-e75c-42bc-bc70-2431041874ad","year":2024},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.842985Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:5cbc3b36d0dea26e609e226741ed737aa01891a071d68ea69278253ddee2d6cf","observation_id":"eb87e8e6-f5f0-459d-83dd-59263e06ae8f","resolution":{"observed_at":"2026-08-12T13:09:29.333729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-11T10:12:11.384939Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-12T13:09:28.846847Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.846847Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:8ac07e5c829ce24b4f6afa47c3e17c019f5312bb38b92078958d2965acdf59cc","observation_id":"998e0073-fbd9-4344-b6ee-2fd86ed1e501","resolution":{"observed_at":"2026-08-12T13:09:28.846847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:28.850977Z","title":"Gener- ating diverse high-fidelity images with vq-vae-2","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.850977Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:a364a997f6bda1c52d8213031fe1721af5ce6fd25913b2eada47fd4701e87e10","observation_id":"1087b035-dca8-45ee-bc6b-b70a90a8b96e","resolution":{"observed_at":"2026-08-12T13:09:28.850977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:28.854019Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.854019Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:95894d8c39784fbc233748fabe384a80c2dbd928434e0a45245a20b084d88890","observation_id":"de27e747-742d-4865-b8b9-e8d84d60260a","resolution":{"observed_at":"2026-08-12T13:09:28.854019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17042","last_updated":"2023-11-28T18:53:24Z","snapshot_observed_at":"2026-08-11T01:14:10.111824Z","submitted_at":"2023-11-28T18:53:24Z","title":"Adversarial Diffusion Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17042","snapshot_observed_at":"2026-08-12T13:09:28.858576Z","title":"Adversarial diffusion distillation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.858576Z"},"links":{"cited_paper":"/paper/2311.17042","citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:b1dd3dfc86770a1bf1ffe210ae418aa3c5b263ae75ef80e77c3434b44a94bb1d","observation_id":"890e18b6-5119-46c7-b147-05f6c187ad27","resolution":{"observed_at":"2026-08-12T13:09:28.858576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12015","last_updated":"2024-03-18T17:51:43Z","snapshot_observed_at":"2026-08-13T00:51:01.462454Z","submitted_at":"2024-03-18T17:51:43Z","title":"Fast High-Resolution Image Synthesis with Latent Adversarial Diffusion Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12015","snapshot_observed_at":"2026-08-12T13:09:28.862877Z","title":"Fast high- resolution image synthesis with latent adversarial diffusion distillation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.862877Z"},"links":{"cited_paper":"/paper/2403.12015","citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:11ec6190c0ab08df585f904ed9e5c26f053481a075ec226c755c9762334fd608","observation_id":"a5842f27-e9b7-402e-9174-be2f67c30eb9","resolution":{"observed_at":"2026-08-12T13:09:28.862877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.308670Z","title":"Real-time single image and video super-resolution using an efficient sub-pixel convolutional neural network","venue":null,"work_id":"5b753c27-5b4b-4d31-8214-c5026de92059","year":2016},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.866377Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:b65d56416cc4438d2620a66be7dd5638693d52318a97a5791675b35e57435210","observation_id":"ccc973cf-7607-44e7-8723-4718f57389e5","resolution":{"observed_at":"2026-08-12T13:09:29.312348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.298368Z","title":"Very deep convolutional networks for large-scale image recognition","venue":null,"work_id":"fb2d2981-e0e6-460f-b874-ccb42a093633","year":2015},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.869137Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:36ed60f6f397e476b4d5f5e7d3bfc95c02f16291ee0a46ea7b7eb671dd76d9e7","observation_id":"1c66be5a-969c-48fa-87af-5dd40b564a1f","resolution":{"observed_at":"2026-08-12T13:09:29.302182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.07547","last_updated":"2022-06-09T12:46:05Z","snapshot_observed_at":"2026-07-06T13:10:16.795009Z","submitted_at":"2022-05-16T09:49:37Z","title":"SQ-VAE: Variational Bayes on Discrete Representation with Self-annealed Stochastic Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.07547","snapshot_observed_at":"2026-08-12T13:09:28.872406Z","title":"Sq-vae: Variational bayes on discrete representation with self-annealed stochastic quantization","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.872406Z"},"links":{"cited_paper":"/paper/2205.07547","citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:696dde2cc381f36df1429de9f8c20e37280fc6172e6078262d8c35a53a4757df","observation_id":"f8a4bf40-e9c7-47e6-b1e8-4bcddb854c9b","resolution":{"observed_at":"2026-08-12T13:09:28.872406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.287644Z","title":"Blind face video restoration with temporal consis- tent generative prior and degradation-aware prompt","venue":null,"work_id":"9f7dcf71-1e1e-41ed-8317-8df1f7df9cec","year":2024},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.875762Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:671f1431461e510f04c77298ee6bf7b4242abbd149f39bf0af6fd0d792a4ff0b","observation_id":"dd2dcbac-2d80-4808-82a7-2abfd569b2d3","resolution":{"observed_at":"2026-08-12T13:09:29.291091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:28.878833Z","title":"Raft: Recurrent all-pairs field transforms for optical flow","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.878833Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:c470f8a53b1b17363f354dd14d8b26fe85fa035cf4e7633296174f3d03ae7c5a","observation_id":"87c34add-850e-46a6-a945-4fc98d33a13a","resolution":{"observed_at":"2026-08-12T13:09:28.878833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.270923Z","title":"Neural discrete representation learning","venue":null,"work_id":"e3c51ba7-b5ef-45fd-bb95-b35aa5d0e8af","year":2017},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.881720Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:4410d00b7c28bdb1b4f131bbb6bf40aa4d1dd8c003e420034cab3d4d515c6d74","observation_id":"0e3b5984-c591-4e9e-bc32-ae22179c3bc3","resolution":{"observed_at":"2026-08-12T13:09:29.274361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.260056Z","title":"Edvr: Video restoration with enhanced deformable convolutional networks","venue":null,"work_id":"b6848d5f-9f6b-43e7-b2c7-49721f72e997","year":2019},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.886075Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:7073ebf117966ba6c62f7ebedc1e2019b7f092cad4528bf6e8e87bb1330e04dc","observation_id":"9dbf1d50-743f-4e28-a50a-4ab1f6fb8b24","resolution":{"observed_at":"2026-08-12T13:09:29.264266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:28.889544Z","title":"To- wards real-world blind face restoration with generative fa- cial prior","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.889544Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:5d35baa1edabcbdb5f79d8c7089523cf5b34d2c726f9d959167ca7301ea02646","observation_id":"1d685d21-4bec-458d-8d8f-d8494a1202bc","resolution":{"observed_at":"2026-08-12T13:09:28.889544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:28.892784Z","title":"Real-esrgan: Training real-world blind super-resolution with pure synthetic data","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.892784Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:63b60aa393b035b717bc42281b550a954825046fa2c9977adbfe02168f09dd10","observation_id":"64041ecf-8465-4527-8ab9-15d22e8c4cd3","resolution":{"observed_at":"2026-08-12T13:09:28.892784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.238143Z","title":"Restoreformer: High-quality blind face restoration from undegraded key-value pairs","venue":null,"work_id":"9dbaac3b-3249-49c3-ae79-e4d977a55e1b","year":2022},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.896798Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:c6853bcec78eeebaad418dfaa025664757ac4537eebe3ccf51b8a6c662c54217","observation_id":"cf95822a-1deb-4747-a12d-50a1cab9f80e","resolution":{"observed_at":"2026-08-12T13:09:29.241642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.228155Z","title":"Vfhq: A high-quality dataset and bench- mark for video face super-resolution","venue":null,"work_id":"dee1920c-cbb7-43d7-b6c4-51497af91ad7","year":2022},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.900273Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:b16e9af10758bec4e7ff21cfd34b77e7f2cd5d9d2e761cf9e95ba48a228aa1c5","observation_id":"1fc13a94-da42-4d6d-b59c-4b0244c8bb00","resolution":{"observed_at":"2026-08-12T13:09:29.231630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13640","last_updated":"2024-04-21T12:33:07Z","snapshot_observed_at":"2026-08-13T00:25:16.596755Z","submitted_at":"2024-04-21T12:33:07Z","title":"Beyond Alignment: Blind Video Face Restoration via Parsing-Guided Temporal-Coherent Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13640","snapshot_observed_at":"2026-08-12T13:09:28.903953Z","title":"Beyond alignment: Blind video face restoration via parsing-guided temporal-coherent transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.903953Z"},"links":{"cited_paper":"/paper/2404.13640","citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:a8eb3ea4e7644f3a9dd8a2bf176da08c6d1154029be3b4bc40cdf1a428f88789","observation_id":"9c72ab94-2570-456d-ab5b-743723133e7e","resolution":{"observed_at":"2026-08-12T13:09:28.903953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.218169Z","title":"Gan prior embedded network for blind face restoration in the wild","venue":null,"work_id":"bb620796-d867-4bf7-9ccc-7fe36526ee14","year":2021},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.907143Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:a4dca9c691e95e4f60d6aff8bf7eeb84fe0422f3e0e4598b4e9412534bc40ed1","observation_id":"28e98862-346b-49c9-9f5a-d3aa10f94f81","resolution":{"observed_at":"2026-08-12T13:09:29.221458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.208024Z","title":"Fast image and video colorization using chrominance blending","venue":null,"work_id":"562a432a-2677-47c0-a1a6-6cbf2d360ebc","year":2006},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.910381Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:bc00341204fac05abf8115722facab18dbf9b589758e092d14871a2bc4f70b75","observation_id":"e2de2031-15fc-4df3-b3b8-e317620af669","resolution":{"observed_at":"2026-08-12T13:09:29.211542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:28.914234Z","title":"Soundstream: An end- to-end neural audio codec","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.914234Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:00d4edc89dfac1eaf453dff745ae270a778febfb3643077c076e0fd03ff9cf62","observation_id":"fc393b0c-8b44-4c5a-8501-0bde3871affb","resolution":{"observed_at":"2026-08-12T13:09:28.914234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.192324Z","title":"Regularized vector quantization for tokenized im- age synthesis","venue":null,"work_id":"34cfb69c-4089-455b-906b-3b85a9da0b1e","year":2023},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.917589Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:f7f5874c72451f3a2b284e37a8d68d2fdf0af5fa621edeb8d37e8b723416509e","observation_id":"d5288ee3-abea-4d6f-8b9b-ab8819d85051","resolution":{"observed_at":"2026-08-12T13:09:29.195982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.181988Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":"17fcf559-f0d3-49a5-b67c-42bb2f5c6f6e","year":2018},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.920541Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:008aa4fd86bbf0d4015739ffe42455cc2e02d63ca5f1db5059b7e0b2dac56e2b","observation_id":"c76d3287-6804-41fc-8067-0b2980a6edb7","resolution":{"observed_at":"2026-08-12T13:09:29.185839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.172170Z","title":"Svcnet: Scribble-based video colorization network with temporal aggregation","venue":null,"work_id":"b4d545f2-4675-473d-91d4-5f8c31e11009","year":2023},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.923810Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:4a6f23aed6997c144158228e06878e1d9b65af2ff778cf1403b6dfd808dfc4a8","observation_id":"dae1e7a8-e1ac-4f16-896a-7fc7d535356c","resolution":{"observed_at":"2026-08-12T13:09:29.175747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.161053Z","title":"Online clustered code- book","venue":null,"work_id":"63ffa55e-a3e7-48d2-aa35-0365a380dd83","year":2023},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.927623Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:7fa33fb991bcc480272df298388d1ac3175a513581ae007b66867e6ce9ab0a7e","observation_id":"cdce90cf-771c-4c6e-a803-930c08809fd0","resolution":{"observed_at":"2026-08-12T13:09:29.164907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:28.931001Z","title":"Movq: Modulating quantized vectors for high- fidelity image generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.931001Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:cf4b689bc6a5d9b9bbb99baa1f6aa99559c3dab77a141db24e5a68512deba81b","observation_id":"d03456e6-f7ae-41ea-9e20-383a1c9e4a70","resolution":{"observed_at":"2026-08-12T13:09:28.931001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.145105Z","title":"Towards robust blind face restora- tion with codebook lookup transformer","venue":null,"work_id":"73be2a71-c36a-40a0-98d2-497cf7045146","year":2022},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.933992Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:025d62a25667e089b22b413ef9062aae4e388906340f3ca1b2e2c7640401af4a","observation_id":"410926a5-4849-4430-a54a-82411b823ab5","resolution":{"observed_at":"2026-08-12T13:09:29.148890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.134784Z","title":"In step A (second row in Figure 6), we crop the raw videos to increase the face proportion","venue":null,"work_id":"6c81c8bc-33de-4f7d-8b85-074e05f071e3","year":null},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.936878Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:98cdc090371a4a2b11fd0d0b96d410210e42d33f489e5ef88b9ee1383bf01f62","observation_id":"b79c3b17-eb2f-4d91-9e74-6f3cb8455074","resolution":{"observed_at":"2026-08-12T13:09:29.138006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.124897Z","title":"Degradation: Consistent v.s","venue":null,"work_id":"c23fbfd5-d1bb-4996-9220-a06581325631","year":null},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.940520Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:76c23089942de87423ccc473db2b1410e9448cba59cf7160da9cc79eadd4e052","observation_id":"b916af50-0548-430f-8da3-61a6eb6c5385","resolution":{"observed_at":"2026-08-12T13:09:29.128791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.104074Z","title":null,"venue":null,"work_id":"ab786807-3f5b-48c8-aa60-8d44297026d3","year":null},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.948850Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:e845d838503fec49e80be070216da0d685d77894783da84d747d4eaa40900b10","observation_id":"80e08792-52d1-4a8a-838e-15d9c7d58774","resolution":{"observed_at":"2026-08-12T13:09:29.108314Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.093258Z","title":"This occurs when the character’s HQOurs Figure 13","venue":null,"work_id":"e59931f8-f3bc-4617-9ca1-f07428cd31fe","year":null},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.952009Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:cfa2b56152bb74a30e5db35158c78dd7c2e670ac62fc7e582c424ce5995f0b02","observation_id":"746a7768-edfc-4437-afa3-01fa8a379c32","resolution":{"observed_at":"2026-08-12T13:09:29.097013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:09:29.114783Z","title":"Although using a lower reso- lution enhances training efficiency, it adversely affects the quality and granularity of the input, and limits the expres- siveness of the output","venue":null,"work_id":"e8bf2943-390f-4765-965a-a7fbf1a4ddcc","year":null},"citing_paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency","version":1},"reference_index":2562,"source":"pdf_text","source_observed_at":"2026-08-12T13:09:28.943725Z"},"links":{"citing_paper":"/paper/2411.16468"},"observation_digest":"sha256:8412ced1daef63cf2844c5c8e5c3797afb7b1da02221e77443df18770f136f95","observation_id":"1f6ade0a-0d04-4fa2-b27f-2a381d5b8fae","resolution":{"observed_at":"2026-08-12T13:09:29.118537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.16468","last_updated":"2024-11-25T15:14:36Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T15:49:14.798211Z","submitted_at":"2024-11-25T15:14:36Z","title":"Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":1,"verified_fuzzy":38},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 0 inbound Pith citation observations for arXiv:2411.16468."}