Pith. sign in

Paper Citation Record · LEDGER

Populate-A-Scene: Affordance-Aware Human Video Generation

As of 7 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2507.00334.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2507.00334 v1

Coverage vector

measured 26 of 26 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T21:23:12.762375Z

measured 26 of 26 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

26 of 26 outbound references displayed

  • verified exact1
  • verified fuzzy2
  • unresolved21
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch1

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation d2c00502-cd33-45ef-9bfe-2ffe5bd25e96 · outbound

This paper cites Fouhey, Ivan Laptev, Josef Sivic, Abhinav Gupta, and Alexei A.

Populate-A-Scene: Affordance-Aware Human Video Generation Fouhey, Ivan Laptev, Josef Sivic, Abhinav Gupta, and Alexei A

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T21:23:13.063341Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T21:23:12.687060Z digest=sha256:97892827855e43a6e8913f1a0ce934e8baf103220d38568c5e9e35c8ce320051

Observation 49c61981-868b-4297-82cc-18e96dff7a58 · outbound

This paper cites Preserve Your Own Correlation: A Noise Prior for Video Diffusion Models.

Populate-A-Scene: Affordance-Aware Human Video Generation Preserve Your Own Correlation: A Noise Prior for Video Diffusion Models

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-06T21:23:12.697903Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T21:23:12.697903Z digest=sha256:e7962997bd050ae635196b63210e788c4eabc97d373a468ed5e6ed000a86003c

Observation c25ede42-3767-4ac1-8629-05fa90181633 · outbound

This paper cites Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance.

Populate-A-Scene: Affordance-Aware Human Video Generation Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-06T21:23:12.708601Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T21:23:12.708601Z digest=sha256:e7f555820d3c84e8d283e7024870bfd013b389e337d5e22c4ed71d87ec96fcee

Observation f64611c1-989b-4065-a6af-33dbb54fbe1c · outbound

This paper cites DAViD: Modeling Dynamic Affordance of 3D Objects Using Pre-trained Video Diffusion Models.

Populate-A-Scene: Affordance-Aware Human Video Generation DAViD: Modeling Dynamic Affordance of 3D Objects Using Pre-trained Video Diffusion Models

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-06T21:23:12.712364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T21:23:12.712364Z digest=sha256:16840f5d51bef86c3f91c0bea0769a0cd0eaf4fe0fd8e7efe078b61a2c182bf6

Observation 62a50608-7b31-4e50-a1fd-98ee4c5747bd · outbound

This paper cites Flow Matching for Generative Modeling.

Populate-A-Scene: Affordance-Aware Human Video Generation Flow Matching for Generative Modeling

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-06T21:23:12.721211Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T21:23:12.721211Z digest=sha256:f139af2784a928ab3174c3bd47406bf935c7a39acdb4c7b961361f6f1dc00c57

Observation 257b1446-f133-4fbe-9d3a-a6d3b4b6b768 · outbound

This paper cites Synthesizing Environment-Specific People in Photographs.

Populate-A-Scene: Affordance-Aware Human Video Generation Synthesizing Environment-Specific People in Photographs

Reference 16

Resolution
metadata mismatch
local_arxiv, observed 2026-08-06T21:23:12.941665Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T21:23:12.728400Z digest=sha256:4148d7cea6c30bd95b09d4e4627edda345bb60d4d3eb9080a673ec91f213e2ed

Observation 93484021-023b-4bf8-b5db-e9eec2f6ad75 · outbound

This paper cites Movie Gen: A Cast of Media Foundation Models.

Populate-A-Scene: Affordance-Aware Human Video Generation Movie Gen: A Cast of Media Foundation Models

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-06T21:23:12.731808Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T21:23:12.731808Z digest=sha256:6bc34ce72c595ad979f0f974d9f01f1200a374763aaa26c61806c53e574269a1

Observation a2aed091-cead-4adc-91d6-3e620802ca67 · outbound

This paper cites ConsistI2V: Enhancing Visual Consistency for Image-to-Video Generation.

Populate-A-Scene: Affordance-Aware Human Video Generation ConsistI2V: Enhancing Visual Consistency for Image-to-Video Generation

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-06T21:23:12.735107Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T21:23:12.735107Z digest=sha256:cce13c6fc1715a9dee0072e4aa3f50d2ac517fbe6a0c4ff3ee9ef5949fd376b3

Observation 94434dd0-0ad6-458c-94ec-7aad763aed84 · outbound

This paper cites InVi: Object Insertion In Videos Using Off-the-Shelf Diffusion Models.

Populate-A-Scene: Affordance-Aware Human Video Generation InVi: Object Insertion In Videos Using Off-the-Shelf Diffusion Models

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-06T21:23:12.738455Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T21:23:12.738455Z digest=sha256:53397cb290ca25cc53ae3498e92e40fd5186b47c640bfbfd5ea5233244a9f3f8

Observation 75d06842-c7b2-4987-8b31-20e8e90525cf · outbound

This paper cites Uriel Singer, Adam Polyak, Thomas Hayes, Xi Yin, Jie An, Songyang Zhang, Qiyuan Hu, Harry Yang, Oron Ashual, Oran Gafni, Devi Parikh, Sonal Gupta, and Yaniv Taigman.

Populate-A-Scene: Affordance-Aware Human Video Generation Uriel Singer, Adam Polyak, Thomas Hayes, Xi Yin, Jie An, Songyang Zhang, Qiyuan Hu, Harry Yang, Oron Ashual, Oran Gafni, Devi Parikh, Sonal Gupta, and Yaniv Taigman

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-06T21:23:12.741893Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T21:23:12.741893Z digest=sha256:5d9786dbb33054d9bd61089d8a4040c2ab342336fa4a5095114e7faaea3dd14c

Observation 4d6b4ed2-1c92-4488-b1ec-a1dd95fee2c0 · outbound

This paper cites UL2: Unifying Language Learning Paradigms.

Populate-A-Scene: Affordance-Aware Human Video Generation UL2: Unifying Language Learning Paradigms

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-06T21:23:12.745181Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T21:23:12.745181Z digest=sha256:d5187aea65ccd1d3716f58014f4f8e29faec78ea0a8053bd869bdfbbdb17183b

Observation 0ab42c9e-6dae-4de6-bf30-21f072092da2 · outbound

This paper cites DAT++: Spatially Dynamic Vision Transformer with Deformable Attention.

Populate-A-Scene: Affordance-Aware Human Video Generation DAT++: Spatially Dynamic Vision Transformer with Deformable Attention

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-06T21:23:12.752065Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T21:23:12.752065Z digest=sha256:c0c341138a603d27d500fc218f5ecc55741ab9db2211bc0465d71dfac3f41c27

Observation 9cea3e29-550c-4d6b-8a8e-b62f6ee3c1b6 · outbound

This paper cites AMG: Avatar Motion Guided Video Generation.

Populate-A-Scene: Affordance-Aware Human Video Generation AMG: Avatar Motion Guided Video Generation

Reference 24

Resolution
malformed identifier
local_arxiv, observed 2026-08-06T21:23:12.814830Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T21:23:12.756044Z digest=sha256:8b943b5cd47040680272b76e001df9ee7951acb7c4c9d8ed2d87971bd6849bab

Observation afc3823d-ff8f-4963-a9ce-6039fa11997e · outbound

This paper cites Make Pixels Dance: High-Dynamic Video Generation.

Populate-A-Scene: Affordance-Aware Human Video Generation Make Pixels Dance: High-Dynamic Video Generation

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-06T21:23:12.759230Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T21:23:12.759230Z digest=sha256:bf7b7e5f74c3d09c06495aeaac1596fe28834b3b53ca9426a8364a04ea02ccab

Observation ceb6a3c0-c822-45b2-a3fc-e5bdec43865e · outbound

This paper cites Shenhao Zhu, Junming Leo Chen, Zuozhuo Dai, Yinghui Xu, Xun Cao, Yao Yao, Hao Zhu, and Siyu Zhu.

Populate-A-Scene: Affordance-Aware Human Video Generation Shenhao Zhu, Junming Leo Chen, Zuozhuo Dai, Yinghui Xu, Xun Cao, Yao Yao, Hao Zhu, and Siyu Zhu

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T21:23:13.054043Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T21:23:12.762375Z digest=sha256:7d7b84aaef9277201ff8ca5c26d915dd9898e573b1222d64815907128e0fd7c9

Observation e35b201a-a990-4add-a86a-7cc744d679ba · outbound

This paper cites AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks.

Populate-A-Scene: Affordance-Aware Human Video Generation AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks

Reference 1999

Resolution
unresolved
no resolver link, observed 2026-08-06T21:23:12.716870Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T21:23:12.716870Z digest=sha256:308d2277c4a176f4fc1c3b6a40385a0c1db349e8ffe9262788f2393c59a205f9

Observation 1909a206-97fe-472a-ac8f-167bc2ca06ff · outbound

This paper cites Photorealistic Video Generation with Diffusion Models.

Populate-A-Scene: Affordance-Aware Human Video Generation Photorealistic Video Generation with Diffusion Models

Reference 2011

Resolution
unresolved
no resolver link, observed 2026-08-06T21:23:12.701371Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T21:23:12.701371Z digest=sha256:1c2d70d44222659f2ca94ac33db88e6a1fc9c9ab4feb2a903c9c7e997f284701

Observation 620ed033-fd70-4614-88da-2ba92398777f · outbound

This paper cites An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale.

Populate-A-Scene: Affordance-Aware Human Video Generation An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale

Reference 2012

Resolution
unresolved
no resolver link, observed 2026-08-06T21:23:12.690412Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T21:23:12.690412Z digest=sha256:67fe4810ad0f854c3c2515bbca204ddc717a4c00c49613a5f233e7d4abe012ac

Observation b7dd9eae-fa44-4463-9bda-7f23d84e4b93 · outbound

This paper cites ModelScope Text-to-Video Technical Report.

Populate-A-Scene: Affordance-Aware Human Video Generation ModelScope Text-to-Video Technical Report

Reference 2017

Resolution
unresolved
no resolver link, observed 2026-08-06T21:23:12.748660Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T21:23:12.748660Z digest=sha256:bc9806e7130faaba2f74def2d9eea8be88249510ae917cfbe1ea2fe5d34638e1

Observation 74a42b92-080c-404c-a25d-ed8b1516d290 · outbound

This paper cites Emu: Enhancing Image Generation Models Using Photogenic Needles in a Haystack.

Populate-A-Scene: Affordance-Aware Human Video Generation Emu: Enhancing Image Generation Models Using Photogenic Needles in a Haystack

Reference 2018

Resolution
unresolved
no resolver link, observed 2026-08-06T21:23:12.682484Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T21:23:12.682484Z digest=sha256:7377ec3d3200e46b2ba83197a13d99f66bf525a8dd51cdbc5c666db39deba9af

Observation 980abd31-064a-4b46-bc7d-3dfcd4079937 · outbound

This paper cites The Llama 3 Herd of Models.

Populate-A-Scene: Affordance-Aware Human Video Generation The Llama 3 Herd of Models

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-06T21:23:12.693914Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T21:23:12.693914Z digest=sha256:7108ba35232cb180c58c5447727fbc165d6b0a22f33154a2e05530e1dda3f8af

Observation 8d11e3cc-a032-4197-bf32-4e8ae0c94b9a · outbound

This paper cites Latte: Latent Diffusion Transformer for Video Generation.

Populate-A-Scene: Affordance-Aware Human Video Generation Latte: Latent Diffusion Transformer for Video Generation

Reference 2021

Resolution
unresolved
no resolver link, observed 2026-08-06T21:23:12.725035Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T21:23:12.725035Z digest=sha256:bf145892792b66544e83ac615b57d464ab21b4f484627745546ce1c05196a863

Observation 3dbc78da-5f3a-41b8-b3be-4d77d77789c1 · outbound

This paper cites Imagen Video: High Definition Video Generation with Diffusion Models.

Populate-A-Scene: Affordance-Aware Human Video Generation Imagen Video: High Definition Video Generation with Diffusion Models

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-06T21:23:12.705127Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T21:23:12.705127Z digest=sha256:663f8466be992d5660e500eda7bb57c18231b951f025cd63e97f893ced578b7a

Observation ffc8f9e7-cb9e-492a-af0e-0bccb47cd800 · outbound

This paper cites Flow map matching with stochastic interpolants: A mathematical framework for consistency models.

Populate-A-Scene: Affordance-Aware Human Video Generation Flow map matching with stochastic interpolants: A mathematical framework for consistency models

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-06T21:23:12.674110Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T21:23:12.674110Z digest=sha256:f9453e7a4287ea8c66671043323f92179fe05281dfe98b8fd0a21f9e445d506a

Observation 38463b39-f0da-4dd0-bc6e-d479b6d341fd · outbound

This paper cites an unresolved cited work.

Populate-A-Scene: Affordance-Aware Human Video Generation Unresolved cited work

Reference 2024

Resolution
unresolved
raw_fallback, observed 2026-08-06T21:23:13.072739Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T21:23:12.669420Z digest=sha256:8a43c6c4ed30a13b4d985fb6baf78a178628eb470ab1ee4e5c43083143058cba

Observation c9db72b1-ff8b-4e03-9fa0-216c54c3cc74 · outbound

This paper cites doi: 10.1145/3715140.https://doi.org/10.1145/3715140.

Populate-A-Scene: Affordance-Aware Human Video Generation doi: 10.1145/3715140.https://doi.org/10.1145/3715140

Reference 2025

Resolution
verified exact
doi, observed 2026-08-06T21:23:12.791955Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T21:23:12.678507Z digest=sha256:3f66e2d8e8c8b93cef7cd3bce006612e5762545106756b56a8c4427ac81b0402

Pith citing papers

No inbound Pith citation observations are available.