{"as_of":"2026-08-08T14:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:430f9c73fb80f61adec15f8fe5924853b9e1279444ecf1bca98f74bdaabae7c5","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:01:09.337775Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T21:46:15.591950Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.04448","last_updated":"2024-12-05T18:57:26Z","snapshot_observed_at":"2026-07-06T20:02:21.509050Z","submitted_at":"2024-12-05T18:57:26Z","title":"MEMO: Memory-Guided Diffusion for Expressive Talking Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04448","snapshot_observed_at":"2026-08-07T12:01:09.337775Z","title":"Memo: Memory-guided diffusion for expressive talking video generation.arXiv preprint arXiv:2412.04448, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00830","last_updated":"2025-06-01T04:27:13Z","snapshot_observed_at":"2026-08-07T20:51:49.766697Z","submitted_at":"2025-06-01T04:27:13Z","title":"SkyReels-Audio: Omni Audio-Conditioned Talking Portraits in Video Diffusion Transformers","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.337775Z"},"links":{"cited_paper":"/paper/2412.04448","citing_paper":"/paper/2506.00830"},"observation_digest":"sha256:1771875715d83d4ce0bc437ba9b7bf87fc706581cacda058d2f4efd9be8c9468","observation_id":"9c612247-a0e5-44b8-83f3-b9743f5235ed","resolution":{"observed_at":"2026-08-07T12:01:09.337775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04448","last_updated":"2024-12-05T18:57:26Z","snapshot_observed_at":"2026-07-06T20:02:21.509050Z","submitted_at":"2024-12-05T18:57:26Z","title":"MEMO: Memory-Guided Diffusion for Expressive Talking Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04448","snapshot_observed_at":"2026-08-06T23:20:06.569315Z","title":"Memo: Memory-guided diffusion for expressive talking video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18701","last_updated":"2025-06-23T14:40:49Z","snapshot_observed_at":"2026-08-07T02:31:55.435917Z","submitted_at":"2025-06-23T14:40:49Z","title":"Matrix-Game: Interactive World Foundation Model","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:06.569315Z"},"links":{"cited_paper":"/paper/2412.04448","citing_paper":"/paper/2506.18701"},"observation_digest":"sha256:67329c5d43d72d3ac5a1d44f5ba5b338b8d6e134268c262a3debc9c07998048b","observation_id":"f71cc2fb-e320-4ff1-a8f2-2d05762be2a6","resolution":{"observed_at":"2026-08-06T23:20:06.569315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04448","last_updated":"2024-12-05T18:57:26Z","snapshot_observed_at":"2026-07-06T20:02:21.509050Z","submitted_at":"2024-12-05T18:57:26Z","title":"MEMO: Memory-Guided Diffusion for Expressive Talking Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04448","snapshot_observed_at":"2026-08-06T21:19:16.594733Z","title":"Memo: Memory-guided diffusion for expressive talking video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00472","last_updated":"2025-07-01T06:38:14Z","snapshot_observed_at":"2026-08-08T07:34:52.616820Z","submitted_at":"2025-07-01T06:38:14Z","title":"ARIG: Autoregressive Interactive Head Generation for Real-time Conversations","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:16.594733Z"},"links":{"cited_paper":"/paper/2412.04448","citing_paper":"/paper/2507.00472"},"observation_digest":"sha256:74b8bdc1c9730ee376f60b5ab9057feb432ae43982c2925e647b5ee0262a02df","observation_id":"89a84305-e389-4a01-ac52-dcbd048b28dc","resolution":{"observed_at":"2026-08-06T21:19:16.594733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04448","last_updated":"2024-12-05T18:57:26Z","snapshot_observed_at":"2026-07-06T20:02:21.509050Z","submitted_at":"2024-12-05T18:57:26Z","title":"MEMO: Memory-Guided Diffusion for Expressive Talking Video Generation","version":1},"cited_work":{"arxiv_id":"2412.04448","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.04448","snapshot_observed_at":"2026-07-01T21:46:15.591950Z","title":"Memo: Memory-guided diffusion for expressive talking video generation","venue":null,"work_id":"a5e8d7ea-12a7-451d-8b59-ab73787ac68e","year":2024},"citing_paper":{"arxiv_id":"2508.13009","last_updated":"2026-04-07T11:37:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-18T15:28:53Z","title":"Matrix-game 2.0: An open-source real-time and streaming interactive world model","version":4},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-18T22:36:31.044743Z"},"links":{"cited_paper":"/paper/2412.04448","citing_paper":"/paper/2508.13009"},"observation_digest":"sha256:134cbb3e167d58a77fd83e38974b112825a26e3e9ffc9e55c162130265d9acc1","observation_id":"66991f99-c5c2-47fa-9d0c-73fd72587ee1","resolution":{"observed_at":"2026-05-18T22:36:53.266622Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04448","last_updated":"2024-12-05T18:57:26Z","snapshot_observed_at":"2026-07-06T20:02:21.509050Z","submitted_at":"2024-12-05T18:57:26Z","title":"MEMO: Memory-Guided Diffusion for Expressive Talking Video Generation","version":1},"cited_work":{"arxiv_id":"2412.04448","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.04448","snapshot_observed_at":"2026-07-01T21:46:15.591950Z","title":"Memo: Memory-guided diffusion for expressive talking video generation","venue":null,"work_id":"a5e8d7ea-12a7-451d-8b59-ab73787ac68e","year":2024},"citing_paper":{"arxiv_id":"2602.09534","last_updated":"2026-05-10T13:50:44Z","snapshot_observed_at":"2026-07-06T22:45:15.978102Z","submitted_at":"2026-02-10T08:45:51Z","title":"AUHead: Realistic Emotional Talking Head Generation via Action Units Control","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-16T05:49:15.734418Z"},"links":{"cited_paper":"/paper/2412.04448","citing_paper":"/paper/2602.09534"},"observation_digest":"sha256:3f29ec8cf3059a8d73f210aca87d06df9c3fd7986d600f7f70828764cbb24a16","observation_id":"84318428-bcbf-40f2-a174-1309374dbf18","resolution":{"observed_at":"2026-05-16T05:50:40.203938Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04448","last_updated":"2024-12-05T18:57:26Z","snapshot_observed_at":"2026-07-06T20:02:21.509050Z","submitted_at":"2024-12-05T18:57:26Z","title":"MEMO: Memory-Guided Diffusion for Expressive Talking Video Generation","version":1},"cited_work":{"arxiv_id":"2412.04448","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.04448","snapshot_observed_at":"2026-07-01T21:46:15.591950Z","title":"Memo: Memory-guided diffusion for expressive talking video generation","venue":null,"work_id":"a5e8d7ea-12a7-451d-8b59-ab73787ac68e","year":2024},"citing_paper":{"arxiv_id":"2605.10334","last_updated":"2026-05-11T10:35:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T10:35:39Z","title":"The Alpha Blending Hypothesis: Compositing Shortcut in Deepfake Detection","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-12T05:09:25.765885Z"},"links":{"cited_paper":"/paper/2412.04448","citing_paper":"/paper/2605.10334"},"observation_digest":"sha256:5b94bddf8f8511ffacafcd62c8d219a77adcb2613f924d82027c1409e81db2f7","observation_id":"c4bb1bf7-3990-47e4-a802-f6a516b9765c","resolution":{"observed_at":"2026-05-12T05:31:26.065046Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04448","last_updated":"2024-12-05T18:57:26Z","snapshot_observed_at":"2026-07-06T20:02:21.509050Z","submitted_at":"2024-12-05T18:57:26Z","title":"MEMO: Memory-Guided Diffusion for Expressive Talking Video Generation","version":1},"cited_work":{"arxiv_id":"2412.04448","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.04448","snapshot_observed_at":"2026-07-01T21:46:15.591950Z","title":"Memo: Memory-guided diffusion for expressive talking video generation","venue":null,"work_id":"a5e8d7ea-12a7-451d-8b59-ab73787ac68e","year":2024},"citing_paper":{"arxiv_id":"2606.01031","last_updated":"2026-05-31T05:44:42Z","snapshot_observed_at":"2026-07-06T23:41:39.172310Z","submitted_at":"2026-05-31T05:44:42Z","title":"Temporally-Aligned Evaluation for Audio-Driven Talking Head Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-28T16:19:55.048831Z"},"links":{"cited_paper":"/paper/2412.04448","citing_paper":"/paper/2606.01031"},"observation_digest":"sha256:436f051c8aedd49382b022c6c096d590bb60d949389220a8ed2d28a81008f5ff","observation_id":"bf91fb31-1655-4eb5-836b-064286b27d0b","resolution":{"observed_at":"2026-07-01T21:46:15.593264Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04448","last_updated":"2024-12-05T18:57:26Z","snapshot_observed_at":"2026-07-06T20:02:21.509050Z","submitted_at":"2024-12-05T18:57:26Z","title":"MEMO: Memory-Guided Diffusion for Expressive Talking Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04448","snapshot_observed_at":"2026-08-04T01:32:12.832905Z","title":"arXiv preprint arXiv:2412.04448 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00079","last_updated":"2026-07-29T14:44:57Z","snapshot_observed_at":"2026-08-07T16:05:36.413106Z","submitted_at":"2026-07-29T14:44:57Z","title":"LeapTalk: Breaking the Latency-Quality Trade-off in Talking Head Generation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T01:32:12.832905Z"},"links":{"cited_paper":"/paper/2412.04448","citing_paper":"/paper/2608.00079"},"observation_digest":"sha256:596516140eeed14bb3bea3aeec9e9b4a18bdb3ea44ea3f9aa80672afa56eae3c","observation_id":"2bf1d23a-cfd6-4c13-b926-aaef2bf46702","resolution":{"observed_at":"2026-08-04T01:32:12.832905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04448","last_updated":"2024-12-05T18:57:26Z","snapshot_observed_at":"2026-07-06T20:02:21.509050Z","submitted_at":"2024-12-05T18:57:26Z","title":"MEMO: Memory-Guided Diffusion for Expressive Talking Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04448","snapshot_observed_at":"2026-08-04T01:03:13.616129Z","title":"Happy\" vs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00663","last_updated":"2026-08-01T13:33:38Z","snapshot_observed_at":"2026-08-06T23:17:35.817309Z","submitted_at":"2026-08-01T13:33:38Z","title":"Geometry-guided Emotion Modulation for Controllable and Photorealistic Emotional Talking Face Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-04T01:03:13.616129Z"},"links":{"cited_paper":"/paper/2412.04448","citing_paper":"/paper/2608.00663"},"observation_digest":"sha256:ab195e1b378f1ec6cb1668e6d4cbf9b207c1c5fe1b6f231ba452fafbcc4894fd","observation_id":"0b6ac397-87b1-4b79-b0b5-96e66c3e565e","resolution":{"observed_at":"2026-08-04T01:03:13.616129Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.04448/citation-record","integrity":"/paper/2412.04448/integrity","json":"/paper/2412.04448/citation-record.json","paper":"/paper/2412.04448"},"outbound":[],"paper":{"arxiv_id":"2412.04448","last_updated":"2024-12-05T18:57:26Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T20:02:21.509050Z","submitted_at":"2024-12-05T18:57:26Z","title":"MEMO: Memory-Guided Diffusion for Expressive Talking Video Generation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2412.04448."}