{"as_of":"2026-08-18T14:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c56522d224488fdc7bf68217b69bb2060d0a87fb60f591f1c2427429740a14be","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:07:45.906935Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T03:06:29.711882Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2207.11094","last_updated":"2022-07-22T14:07:46Z","snapshot_observed_at":"2026-08-18T11:38:51.011937Z","submitted_at":"2022-07-22T14:07:46Z","title":"Visual Speech-Aware Perceptual 3D Facial Expression Reconstruction from Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.11094","snapshot_observed_at":"2026-08-11T21:53:11.761550Z","title":"Filntisis, George Retsinas, Foivos Paraperas- Papantoniou, Athanasios Katsamanis, Anastasios Roussos, and Petros Maragos","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04037","last_updated":"2024-12-05T10:20:34Z","snapshot_observed_at":"2026-08-18T10:23:25.989962Z","submitted_at":"2024-12-05T10:20:34Z","title":"INFP: Audio-Driven Interactive Head Generation in Dyadic Conversations","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T21:53:11.761550Z"},"links":{"cited_paper":"/paper/2207.11094","citing_paper":"/paper/2412.04037"},"observation_digest":"sha256:0384810741f31711616251fc57dedcb1dfed1cc91bec4bd4f19bc68ff8b191c0","observation_id":"e4c6fd79-5ff4-4c1e-80f9-c40506c89119","resolution":{"observed_at":"2026-08-11T21:53:11.761550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.11094","last_updated":"2022-07-22T14:07:46Z","snapshot_observed_at":"2026-08-18T11:38:51.011937Z","submitted_at":"2022-07-22T14:07:46Z","title":"Visual Speech-Aware Perceptual 3D Facial Expression Reconstruction from Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.11094","snapshot_observed_at":"2026-08-07T15:24:38.213279Z","title":"Visual speech-aware percep- tual 3d facial expression reconstruction from videos.arXiv preprint arXiv:2207.11094, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15313","last_updated":"2025-08-23T02:20:34Z","snapshot_observed_at":"2026-08-16T06:19:16.579373Z","submitted_at":"2025-05-21T09:43:21Z","title":"FaceCrafter: Identity-Conditional Diffusion with Disentangled Control over Facial Pose, Expression, and Emotion","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:38.213279Z"},"links":{"cited_paper":"/paper/2207.11094","citing_paper":"/paper/2505.15313"},"observation_digest":"sha256:61fa9c8149493be6f5b279e85c900b3b06415ffea320a0ce9e2dfed78b80d113","observation_id":"1925ae6c-b09d-4ce4-b0c2-ec033005cf56","resolution":{"observed_at":"2026-08-07T15:24:38.213279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.11094","last_updated":"2022-07-22T14:07:46Z","snapshot_observed_at":"2026-08-18T11:38:51.011937Z","submitted_at":"2022-07-22T14:07:46Z","title":"Visual Speech-Aware Perceptual 3D Facial Expression Reconstruction from Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.11094","snapshot_observed_at":"2026-08-05T11:47:51.041119Z","title":"Visual speech-aware perceptual 3d facial expression reconstruction from videos,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-18T10:30:19.561695Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.041119Z"},"links":{"cited_paper":"/paper/2207.11094","citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:ab9bd723fd42b36423b9a44a3f5ea63ee43ef089c81c70aeca4b3be300d4ca74","observation_id":"3bb0b6b6-f777-46df-92da-1279ade4ce8e","resolution":{"observed_at":"2026-08-05T11:47:51.041119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.11094","last_updated":"2022-07-22T14:07:46Z","snapshot_observed_at":"2026-08-18T11:38:51.011937Z","submitted_at":"2022-07-22T14:07:46Z","title":"Visual Speech-Aware Perceptual 3D Facial Expression Reconstruction from Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.11094","snapshot_observed_at":"2026-08-03T16:30:33.250107Z","title":"Visual speech-aware perceptual 3d fa- cial expression reconstruction from videos.arXiv preprint arXiv:2207.11094, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.13247","last_updated":"2026-07-17T19:41:30Z","snapshot_observed_at":"2026-08-18T11:12:51.481768Z","submitted_at":"2025-12-15T11:59:01Z","title":"STARCaster: Spatio-Temporal AutoRegressive Video Diffusion for Identity- and View-Aware Talking Portraits","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T16:30:33.250107Z"},"links":{"cited_paper":"/paper/2207.11094","citing_paper":"/paper/2512.13247"},"observation_digest":"sha256:d490be5e5ccb4ce26012f759b8766d9991aadaab2cae9a96082d63c6e7369570","observation_id":"fbb8817e-46d6-43cb-b651-a0698d69fe13","resolution":{"observed_at":"2026-08-03T16:30:33.250107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.11094","last_updated":"2022-07-22T14:07:46Z","snapshot_observed_at":"2026-08-18T11:38:51.011937Z","submitted_at":"2022-07-22T14:07:46Z","title":"Visual Speech-Aware Perceptual 3D Facial Expression Reconstruction from Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.11094","snapshot_observed_at":"2026-08-03T13:04:37.466828Z","title":"Visual speech-aware perceptual 3d fa- cial expression reconstruction from videos.arXiv preprint arXiv:2207.11094, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.00664","last_updated":"2026-05-30T08:41:30Z","snapshot_observed_at":"2026-08-16T11:13:21.639093Z","submitted_at":"2026-01-02T11:58:48Z","title":"Avatar Forcing: Real-Time Interactive Head Avatar Generation for Natural Conversation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T13:04:37.466828Z"},"links":{"cited_paper":"/paper/2207.11094","citing_paper":"/paper/2601.00664"},"observation_digest":"sha256:508fa19fc400fd91a19711a1b8a8b4921f4ef909d3532d5afa529ea0e92c2996","observation_id":"1236a7f1-9679-4caa-b1b9-a009204a28dc","resolution":{"observed_at":"2026-08-03T13:04:37.466828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.11094","last_updated":"2022-07-22T14:07:46Z","snapshot_observed_at":"2026-08-18T11:38:51.011937Z","submitted_at":"2022-07-22T14:07:46Z","title":"Visual Speech-Aware Perceptual 3D Facial Expression Reconstruction from Videos","version":1},"cited_work":{"arxiv_id":"2207.11094","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2207.11094","snapshot_observed_at":"2026-07-02T03:06:29.711882Z","title":"arXiv:2207.11094 (2022)","venue":null,"work_id":"53a020ef-1d4c-4e58-822f-934e380c9537","year":2022},"citing_paper":{"arxiv_id":"2601.04376","last_updated":"2026-05-03T16:52:10Z","snapshot_observed_at":"2026-08-15T11:09:28.909307Z","submitted_at":"2026-01-07T20:32:34Z","title":"Combining Facial Videos and Biosignals for Stress Estimation During Driving","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T16:20:17.523755Z"},"links":{"cited_paper":"/paper/2207.11094","citing_paper":"/paper/2601.04376"},"observation_digest":"sha256:4afd8154ac3ccd9c4558f535ff0b19fafb2ff7ce7d76c826621b514273a2d91f","observation_id":"27ffe9b7-410e-474b-927c-410694ca86e4","resolution":{"observed_at":"2026-05-16T16:21:05.688870Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.11094","last_updated":"2022-07-22T14:07:46Z","snapshot_observed_at":"2026-08-18T11:38:51.011937Z","submitted_at":"2022-07-22T14:07:46Z","title":"Visual Speech-Aware Perceptual 3D Facial Expression Reconstruction from Videos","version":1},"cited_work":{"arxiv_id":"2207.11094","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2207.11094","snapshot_observed_at":"2026-07-02T03:06:29.711882Z","title":"arXiv:2207.11094 (2022)","venue":null,"work_id":"53a020ef-1d4c-4e58-822f-934e380c9537","year":2022},"citing_paper":{"arxiv_id":"2605.01450","last_updated":"2026-05-02T13:59:29Z","snapshot_observed_at":"2026-08-17T20:53:37.501469Z","submitted_at":"2026-05-02T13:59:29Z","title":"Registration-Free Learnable Multi-View Capture of Faces in Dense Semantic Correspondence","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-09T15:08:20.845753Z"},"links":{"cited_paper":"/paper/2207.11094","citing_paper":"/paper/2605.01450"},"observation_digest":"sha256:688b109920a0291db11fff3c55e7f42ebf46cb296b7e946ed0cafb2ff2884496","observation_id":"8c8c1c62-7552-4a72-9928-a9ff55aa81f5","resolution":{"observed_at":"2026-05-11T16:46:07.071247Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.11094","last_updated":"2022-07-22T14:07:46Z","snapshot_observed_at":"2026-08-18T11:38:51.011937Z","submitted_at":"2022-07-22T14:07:46Z","title":"Visual Speech-Aware Perceptual 3D Facial Expression Reconstruction from Videos","version":1},"cited_work":{"arxiv_id":"2207.11094","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2207.11094","snapshot_observed_at":"2026-07-02T03:06:29.711882Z","title":"arXiv:2207.11094 (2022)","venue":null,"work_id":"53a020ef-1d4c-4e58-822f-934e380c9537","year":2022},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-17T04:04:30.320733Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"cited_paper":"/paper/2207.11094","citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:f45149092ec27c1059a60f89fb2ad17d7b4b16737647bd5a651538acc41d0d04","observation_id":"0fbcb927-5585-4cf7-979f-60690a381644","resolution":{"observed_at":"2026-07-02T03:06:29.714335Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.11094","last_updated":"2022-07-22T14:07:46Z","snapshot_observed_at":"2026-08-18T11:38:51.011937Z","submitted_at":"2022-07-22T14:07:46Z","title":"Visual Speech-Aware Perceptual 3D Facial Expression Reconstruction from Videos","version":1},"cited_work":{"arxiv_id":"2207.11094","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2207.11094","snapshot_observed_at":"2026-07-02T03:06:29.711882Z","title":"arXiv:2207.11094 (2022)","venue":null,"work_id":"53a020ef-1d4c-4e58-822f-934e380c9537","year":2022},"citing_paper":{"arxiv_id":"2606.30347","last_updated":"2026-07-14T12:36:54Z","snapshot_observed_at":"2026-08-08T07:51:14.168800Z","submitted_at":"2026-06-29T14:21:33Z","title":"FFAvatar: Feed-Forward 4D Head Avatar Reconstruction from Sparse Portrait Images","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T06:29:52.152957Z"},"links":{"cited_paper":"/paper/2207.11094","citing_paper":"/paper/2606.30347"},"observation_digest":"sha256:8760e8da6522ab5c8546bdc246d033a212488101b1617402a5649ed2a41b03a2","observation_id":"9d8610a2-2b87-49e6-bd36-1e9b320e8714","resolution":{"observed_at":"2026-06-30T06:34:19.019577Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.11094","last_updated":"2022-07-22T14:07:46Z","snapshot_observed_at":"2026-08-18T11:38:51.011937Z","submitted_at":"2022-07-22T14:07:46Z","title":"Visual Speech-Aware Perceptual 3D Facial Expression Reconstruction from Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.11094","snapshot_observed_at":"2026-07-15T10:23:19.970515Z","title":"arXiv preprint arXiv:2207.11094 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.30347","last_updated":"2026-07-14T12:36:54Z","snapshot_observed_at":"2026-08-08T07:51:14.168800Z","submitted_at":"2026-06-29T14:21:33Z","title":"FFAvatar: Feed-Forward 4D Head Avatar Reconstruction from Sparse Portrait Images","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-15T10:23:19.970515Z"},"links":{"cited_paper":"/paper/2207.11094","citing_paper":"/paper/2606.30347"},"observation_digest":"sha256:5d467919d5018ee53a488dbe46d2db92a4337d35ccc0d9ccdaf09a79e348bdbc","observation_id":"8c98b51d-7689-4a78-a0cd-ffa721c54df1","resolution":{"observed_at":"2026-07-15T10:23:19.970515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.11094","last_updated":"2022-07-22T14:07:46Z","snapshot_observed_at":"2026-08-18T11:38:51.011937Z","submitted_at":"2022-07-22T14:07:46Z","title":"Visual Speech-Aware Perceptual 3D Facial Expression Reconstruction from Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.11094","snapshot_observed_at":"2026-08-15T15:07:45.906935Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.06408","last_updated":"2026-08-03T11:28:19Z","snapshot_observed_at":"2026-08-16T13:51:22.937337Z","submitted_at":"2026-08-03T11:28:19Z","title":"SubtleTalk: Generating Controllable Weakly-correlated Facial Dynamics for 3D Talking Heads via Residual Flow Matching","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T15:07:45.906935Z"},"links":{"cited_paper":"/paper/2207.11094","citing_paper":"/paper/2608.06408"},"observation_digest":"sha256:376de31afe76a0bd78f1ba12feec7c28343e9e0619e770560f465e9a4e0c10f9","observation_id":"b6dfdf5a-bcc0-40b0-9cb9-4ff07108c121","resolution":{"observed_at":"2026-08-15T15:07:45.906935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2207.11094/citation-record","integrity":"/paper/2207.11094/integrity","json":"/paper/2207.11094/citation-record.json","paper":"/paper/2207.11094"},"outbound":[],"paper":{"arxiv_id":"2207.11094","last_updated":"2022-07-22T14:07:46Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T11:38:51.011937Z","submitted_at":"2022-07-22T14:07:46Z","title":"Visual Speech-Aware Perceptual 3D Facial Expression Reconstruction from Videos"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2207.11094."}