{"as_of":"2026-08-08T23:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ad4075574a2f8792a2015058f19992c2a813823565264e52754b8f14d15b268e","coverage":[{"denominator":113,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T11:39:18.653009Z","state":"measured"},{"denominator":102,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":102,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T14:17:55.627411Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T10:38:17.806373Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07785","snapshot_observed_at":"2026-08-08T14:17:55.627411Z","title":"Pippo: High-resolution multi-view humans from a single image","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.06957","last_updated":"2025-08-03T14:14:09Z","snapshot_observed_at":"2026-08-08T23:17:10.153437Z","submitted_at":"2025-02-10T19:00:39Z","title":"GAS: Generative Avatar Synthesis from a Single Image","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T14:17:55.627411Z"},"links":{"cited_paper":"/paper/2502.07785","citing_paper":"/paper/2502.06957"},"observation_digest":"sha256:27179350b24d5688a64701487d3c0c1ccd78fdd6bc16f00fc06abf6f148a67aa","observation_id":"09e4368c-8dba-499f-869d-fbb49080acfb","resolution":{"observed_at":"2026-08-08T14:17:55.627411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"cited_work":{"arxiv_id":"2502.07785","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.07785","snapshot_observed_at":"2026-08-06T10:38:17.806373Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","venue":"cs.CV","work_id":"a78ce70b-e1de-4799-87a5-5b1327941538","year":2025},"citing_paper":{"arxiv_id":"2507.23597","last_updated":"2025-08-09T13:29:22Z","snapshot_observed_at":"2026-08-08T23:23:55.348763Z","submitted_at":"2025-07-31T14:36:24Z","title":"MoGA: 3D Generative Avatar Prior for Monocular Gaussian Avatar Reconstruction","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T10:38:14.578378Z"},"links":{"cited_paper":"/paper/2502.07785","citing_paper":"/paper/2507.23597"},"observation_digest":"sha256:86cca1a4ca483f2113475b3cf472ad0c170547bdc3ff58dc462cd9d2fff87756","observation_id":"ed919425-6f99-4f04-94ce-8230d2f3e75d","resolution":{"observed_at":"2026-08-06T10:38:17.811181Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.07785/citation-record","integrity":"/paper/2502.07785/integrity","json":"/paper/2502.07785/citation-record.json","paper":"/paper/2502.07785"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.174870Z","title":"Ogras, and Linjie Luo","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.174870Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:d1913ecd3c5cbeb34bddef22aeb7755a2c27cbb2d23b0c574b7783537a023c51","observation_id":"f4cdd103-6ded-46cd-a773-221e622c4ba2","resolution":{"observed_at":"2026-08-08T11:39:18.174870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.09192","last_updated":"2022-03-17T09:29:50Z","snapshot_observed_at":"2026-08-07T23:55:35.716165Z","submitted_at":"2022-03-17T09:29:50Z","title":"Entropy-based Attention Regularization Frees Unintended Bias Mitigation from Lists","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.09192","snapshot_observed_at":"2026-08-08T11:39:18.179814Z","title":"Entropy-based attention regularization frees unintended bias mitigation from lists, 2022.https://arxiv.org/abs/2203.09192","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.179814Z"},"links":{"cited_paper":"/paper/2203.09192","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:f4ba97d7098f81eeddf80cb49298d10839f649c2429a04eafa1956e634ab36a2","observation_id":"d6ca83d7-41ea-4099-b207-742d1dd77522","resolution":{"observed_at":"2026-08-08T11:39:18.179814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.184842Z","title":"Driving-signal aware full-body avatars.ACM Transactions on Graphics (TOG), 40(4):1–17, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.184842Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:64c230d52638af89bce04e6b3965f6d15c2ef3dad8b58848d7e61f0eec6129fe","observation_id":"376a8f53-eb9d-4670-91f7-bce6f8de17d8","resolution":{"observed_at":"2026-08-08T11:39:18.184842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-08T11:39:18.189540Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control.arXiv preprint arXiv:2407.12781, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.189540Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:9eca3f9215a9c57063fbb5f8652086428d51b152b025eb164b485739ead61a63","observation_id":"c36baef5-1b36-4f6a-9d79-db0f9ccc87b6","resolution":{"observed_at":"2026-08-08T11:39:18.189540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-08T11:39:18.194547Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets.arXiv preprint arXiv:2311.15127, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.194547Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:d3d894ceebd9d5a9ff24458d1a2276f5fd7b0b051964dfc354f9d64509222a83","observation_id":"8632d3a9-ec6f-4632-bdff-5372e6f37e31","resolution":{"observed_at":"2026-08-08T11:39:18.194547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.199839Z","title":"Parkhi, and Andrew Zisserman","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.199839Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:99699e8a527ab66d23d3c7f3d8f99341bac845e9236fd67bb66cf3b9389af73d","observation_id":"c75a6613-44c4-4f0e-9b36-659b77574fb8","resolution":{"observed_at":"2026-08-08T11:39:18.199839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.205937Z","title":"Chan, Connor Z","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.205937Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:d5d7a5ca7a236e66deaaca614907b413c73dc1299839a1108734cb6f3be41d12","observation_id":"d0e7c27e-34c2-4df1-b8d6-8f99d7ffc7ea","resolution":{"observed_at":"2026-08-08T11:39:18.205937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13681","last_updated":"2023-09-04T23:02:18Z","snapshot_observed_at":"2026-07-06T15:20:25.388057Z","submitted_at":"2023-04-26T16:54:10Z","title":"Ray Conditioning: Trading Photo-consistency for Photo-realism in Multi-view Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13681","snapshot_observed_at":"2026-08-08T11:39:18.210477Z","title":"Ray conditioning: Trading photo-consistency for photo-realism in multi-view image generation.arXiv preprint arXiv:2304.13681, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.210477Z"},"links":{"cited_paper":"/paper/2304.13681","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:d10823d8858912f859b4f8e9949dc1592449c61d5f87f29b288f75b0a1db567b","observation_id":"5742db56-c1f0-40f9-99c3-98cc7433d955","resolution":{"observed_at":"2026-08-08T11:39:18.210477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.215785Z","title":"Fantasia3d: Disentangling geometry and appearance for high-quality text-to-3d content creation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.215785Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:aa044283163a5ce33a6bca11583a72728610b8805a167ca01b516ec92925c6aa","observation_id":"30ff2afe-d8fb-4ea1-848e-1d8026f48bc8","resolution":{"observed_at":"2026-08-08T11:39:18.215785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.10972","last_updated":"2023-05-21T07:07:55Z","snapshot_observed_at":"2026-08-08T02:32:31.177380Z","submitted_at":"2023-01-26T07:37:22Z","title":"On the Importance of Noise Scheduling for Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.10972","snapshot_observed_at":"2026-08-08T11:39:18.220531Z","title":"On the importance of noise scheduling for diffusion models.arXiv preprint arXiv:2301.10972, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.220531Z"},"links":{"cited_paper":"/paper/2301.10972","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:ce7f87f8ff85b2cf191104249386e9ae1b427976a2b9c0254b66398460b98b31","observation_id":"06277f73-2f67-452b-ab90-b4ee42161db0","resolution":{"observed_at":"2026-08-08T11:39:18.220531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10173","last_updated":"2023-09-30T06:24:23Z","snapshot_observed_at":"2026-08-03T20:15:36.452177Z","submitted_at":"2023-07-19T17:58:03Z","title":"DNA-Rendering: A Diverse Neural Actor Repository for High-Fidelity Human-centric Rendering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10173","snapshot_observed_at":"2026-08-08T11:39:18.225568Z","title":"Dna-rendering: A diverse neural actor repository for high-fidelity human-centric rendering.arXiv preprint, arXiv:2307.10173, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.225568Z"},"links":{"cited_paper":"/paper/2307.10173","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:d1a7e8c5ca7da4630a2261eaab980b621d1a91c30d4979524d3b4c56da59028e","observation_id":"19bcf228-97ed-4f10-9fb7-eb43921214cf","resolution":{"observed_at":"2026-08-08T11:39:18.225568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.230780Z","title":"Vision transformers need registers, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.230780Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:c183de96764bb9783e43be33f83b97af23f413a70a136d74d0adc2648ffd3543","observation_id":"74315524-3282-4acf-b25d-388b8a329ead","resolution":{"observed_at":"2026-08-08T11:39:18.230780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.235047Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.235047Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:c126ec7a316c668fddc328ff823bce937942ef6b1a643f3d7a9b1e77f6f8342b","observation_id":"8fde4733-334d-4716-984b-e01defda62e1","resolution":{"observed_at":"2026-08-08T11:39:18.235047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.240221Z","title":"Nerdi: Single-view nerf synthesis with language-guided diffusion as general image priors","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.240221Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:8e919bd614ac5cb17e4ad5df047f9c6b8862006ab2a68ac166ac9a6ece5de4ef","observation_id":"12c316eb-3758-4b40-b72a-6de6932bad62","resolution":{"observed_at":"2026-08-08T11:39:18.240221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.244743Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.244743Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:92264aaeec347b1531f01cdf55ea0374d05fb51ef0e8e84fbf95fee6c94ecc62","observation_id":"ac6e0fd4-ea18-488c-bfd7-4c55e199bb1a","resolution":{"observed_at":"2026-08-08T11:39:18.244743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.249718Z","title":"Superpoint: Self-supervised interest point detection and description","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.249718Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:69c2b995cc644ff4710e95e0376cfd4e42509331914cd2383de861d78c33a4f5","observation_id":"be8d9f1a-6506-4afb-b127-e57b2781e405","resolution":{"observed_at":"2026-08-08T11:39:18.249718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.255257Z","title":"Megaportraits: One-shot megapixel neural head avatars","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.255257Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:8b58079f64dc2292787f33473762b50eae0e0885419c0a69966b21e64ca66d2d","observation_id":"54c95c8f-7279-48f8-85f7-62ef0c5c01c6","resolution":{"observed_at":"2026-08-08T11:39:18.255257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.260967Z","title":"Emoportraits: Emotion-enhanced multimodal one-shot head avatars","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.260967Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:b5bf639f568f04b4150c734a3c461e69f20e50666fdb3243135bed90c79fcdfd","observation_id":"10279f2e-8101-481d-96d2-fe4beb65267f","resolution":{"observed_at":"2026-08-08T11:39:18.260967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.266453Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.266453Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:2e48a9717ab114dd7cdf1711a0abd3133284f195a154e9302b995e05f55ca36d","observation_id":"8964a9e0-0227-4011-ac67-2d33a33436ce","resolution":{"observed_at":"2026-08-08T11:39:18.266453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.271216Z","title":"Scenescape: Text-driven consistent scene generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.271216Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:1974a05354befb93d5cd6df1c63a4a2555ce7c0d499690a455b13dca2ce13499","observation_id":"6fac8c2e-7899-41e1-bedb-d7cb8577415a","resolution":{"observed_at":"2026-08-08T11:39:18.271216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.275609Z","title":"Multiresolution tree networks for 3d point cloud processing","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.275609Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:84248bd147d6715551452e2c68d2e6ef547bff6772b6cee65d6adcbfcee8cfec","observation_id":"ff200a16-dc16-4b66-86d4-2ec702f93c10","resolution":{"observed_at":"2026-08-08T11:39:18.275609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10314","last_updated":"2024-05-16T17:59:05Z","snapshot_observed_at":"2026-07-06T18:15:24.541427Z","submitted_at":"2024-05-16T17:59:05Z","title":"CAT3D: Create Anything in 3D with Multi-View Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10314","snapshot_observed_at":"2026-08-08T11:39:18.280139Z","title":"Cat3d: Create anything in 3d with multi-view diffusion models.arXiv preprint arXiv:2405.10314, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.280139Z"},"links":{"cited_paper":"/paper/2405.10314","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:35f3ac08862c85f92070ab1e5ab0991029204044fb251426f6e7c214fb524f74","observation_id":"58f3285a-06ef-403c-8e75-b417e5996354","resolution":{"observed_at":"2026-08-08T11:39:18.280139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.03348","last_updated":"2017-10-09T23:21:34Z","snapshot_observed_at":"2026-07-06T06:03:25.270202Z","submitted_at":"2017-10-09T23:21:34Z","title":"What does Attention in Neural Machine Translation Pay Attention to?","version":1},"cited_work":{"arxiv_id":"1710.03348","doi":null,"metadata_source":"pith","pith_arxiv_id":"1710.03348","snapshot_observed_at":"2026-08-08T11:39:19.047214Z","title":"What does Attention in Neural Machine Translation Pay Attention to?","venue":"cs.CL","work_id":"566b250b-3681-4bd5-a876-86eee9666554","year":2017},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.284784Z"},"links":{"cited_paper":"/paper/1710.03348","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:5aa5f196302b3a83e132a2f4d25581e90e34960bc4143aa8f8acf36191ce101c","observation_id":"bc51b82f-1002-454c-af67-0a15d6db45a1","resolution":{"observed_at":"2026-08-08T11:39:19.052262Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.289668Z","title":"Diffportrait3d: Controllable diffusion for zero-shot portrait view synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.289668Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:944c0df8ca192494595500d7bb9122e9d85fab8a7e7b095485b374caa7635948","observation_id":"3aa4e4f1-6aa0-45b4-adf8-8a0b7e9ab1e2","resolution":{"observed_at":"2026-08-08T11:39:18.289668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.294318Z","title":"Animatediff: Animate your personalized text-to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.294318Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:85f5f312c6f4bb547fe1a2e6b8fbd2441cbbbe3497e17a7d9e63139048021b2f","observation_id":"f7b44ba6-1f45-4f05-be25-bef5b8382a6f","resolution":{"observed_at":"2026-08-08T11:39:18.294318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.298783Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.298783Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:080790e8c7e0d72f0b9089e3fc6472e8f63a1c47edecfcc9803c1500f7d1bb12","observation_id":"ebe9e3df-928a-40e4-9ad4-2c97f52e4bd6","resolution":{"observed_at":"2026-08-08T11:39:18.298783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02101","last_updated":"2025-03-13T18:35:06Z","snapshot_observed_at":"2026-07-06T17:54:39.685251Z","submitted_at":"2024-04-02T16:52:41Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02101","snapshot_observed_at":"2026-08-08T11:39:18.303668Z","title":"Cameractrl: Enabling camera control for text-to-video generation.arXiv preprint arXiv:2404.02101, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.303668Z"},"links":{"cited_paper":"/paper/2404.02101","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:2546163b6c4e12a890174dd1084f5f3cc3eb2da9ca560f82aa87d34e26bd3178","observation_id":"732142c2-1b9b-4bef-9a98-13e6f6f6a3ca","resolution":{"observed_at":"2026-08-08T11:39:18.303668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.308509Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.308509Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:a6aff727ff49e94068a93e547db1cd0c114dacf7266198f4a3005b33da467f1c","observation_id":"0eebcf66-7500-4eb5-82cb-6fe2493365e0","resolution":{"observed_at":"2026-08-08T11:39:18.308509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.313247Z","title":"Sith: Single-view textured human reconstruction with image-conditioned diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.313247Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:0a16ec7f85e72aecbc00303fb0c18639aea7b22f9c3a2a1594a9e94c6a189186","observation_id":"c2ea5505-dbcb-4980-b74c-c4d2a33cadf2","resolution":{"observed_at":"2026-08-08T11:39:18.313247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.317575Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.317575Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:f73bd5262a042e6fb30318df3a970ce1fb3c1abce4ccbfa104c93c2722aa2081","observation_id":"d40a0e3f-a4af-4c54-94ea-dc6c8ae84644","resolution":{"observed_at":"2026-08-08T11:39:18.317575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.322017Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.322017Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:638ba24b2b4fead638d2e11dfa201a1dc4ba0b67820377479acb709c7f1d8400","observation_id":"2702712a-19bc-4396-bf06-ea07d3307201","resolution":{"observed_at":"2026-08-08T11:39:18.322017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03632","last_updated":"2024-12-04T18:48:20Z","snapshot_observed_at":"2026-08-08T15:31:21.670732Z","submitted_at":"2024-12-04T18:48:20Z","title":"MV-Adapter: Multi-view Consistent Image Generation Made Easy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03632","snapshot_observed_at":"2026-08-08T11:39:18.327077Z","title":"Mv-adapter: Multi-view consistent image generation made easy.arXiv preprint arXiv:2412.03632, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.327077Z"},"links":{"cited_paper":"/paper/2412.03632","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:3c5aa007fbe8e8ea9ffe2350887c86d994ac97b5952c1fc2ca0ff24ba488b35d","observation_id":"ddf70acc-cbc0-40fa-87c3-19b00b792ff6","resolution":{"observed_at":"2026-08-08T11:39:18.327077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.331574Z","title":"Epidiff: Enhancing multi-view synthesis via localized epipolar-constrained diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.331574Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:e0b5fffeb179cecdb3ff987f749f17c543873fa41c9427587c3e5e0c7cd5278a","observation_id":"b2ce8559-60a2-4d61-a410-3b99aac409b8","resolution":{"observed_at":"2026-08-08T11:39:18.331574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3592415.https://doi.org/10.1145/3592415","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.749661Z","title":"Humanrf: High-fidelity neural radiance fields for humans in motion.ACM Transactions on Graphics (TOG), 42(4):1–12, 2023","venue":null,"work_id":"7ee4d59b-df4b-43fa-8827-25c75189e026","year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.337306Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:513b8dffa23e228327f939405585079b1ce4c5c1c897ba1dfd460e7623ae00b5","observation_id":"34904e17-c84c-48c1-b8ef-bb804731cee3","resolution":{"observed_at":"2026-08-08T11:39:18.757197Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08645","last_updated":"2023-10-26T09:16:25Z","snapshot_observed_at":"2026-08-03T22:51:10.296465Z","submitted_at":"2023-06-14T17:23:07Z","title":"Training-free Diffusion Model Adaptation for Variable-Sized Text-to-Image Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08645","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.08645","snapshot_observed_at":"2026-08-08T11:39:18.991106Z","title":"Training-free Diffusion Model Adaptation for Variable-Sized Text-to-Image Synthesis","venue":"cs.CV","work_id":"8fb1de6f-91ab-4cad-8fc4-0944692f6e61","year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.342411Z"},"links":{"cited_paper":"/paper/2306.08645","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:addfdc939e70a7dcb902c1740bcb2e6375c13c2506eadd7a1d1f8edb0adbb0c9","observation_id":"f229cded-d37d-4ef7-912c-7835d4ce877b","resolution":{"observed_at":"2026-08-08T11:39:18.996655Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.347330Z","title":"invs: Repurposing diffusion inpainters for novel view synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.347330Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:be24c388dcf5bfa0d6a218f9cc21ab3211e87a5c31565cb0381daee300eb558d","observation_id":"e7cba2ce-2f42-4878-b4d8-ce65098ee2f0","resolution":{"observed_at":"2026-08-08T11:39:18.347330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.352082Z","title":"Spad: Spatially aware multi-view diffusers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.352082Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:5c94b98aa51ab06799623bf55312a3b4c8463af08fc5557a33960fda585c54ee","observation_id":"1f11f78e-e4d3-4075-80e8-433668c055bb","resolution":{"observed_at":"2026-08-08T11:39:18.352082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.356487Z","title":"A style-based generator architecture for generative adversarial networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.356487Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:21e6e9bb515210a40365a0fa878751e73e54c62830f171a9a435bc93d6b8840f","observation_id":"f155ec3e-5f8b-48cd-9a80-332d54872e88","resolution":{"observed_at":"2026-08-08T11:39:18.356487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.361270Z","title":"Sapiens: Foundation for human vision models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.361270Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:c5f958f08a4fc1abbcd03259a636a551d94f6b0975af7006cf6859d00fd72eec","observation_id":"753fbaaf-8b3a-497f-8d82-8f0192c9bcdc","resolution":{"observed_at":"2026-08-08T11:39:18.361270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.366006Z","title":"Nersemble: Multi-view radiance field reconstruction of human heads.ACM Transactions on Graphics (TOG), 42(4):1–14, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.366006Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:a7f7e161ce6504d44725df17a3da9754ca26e6b63f7f012fba3e26ae0e2820c4","observation_id":"7fb75d56-920a-4d03-88a3-19e5cb5ee929","resolution":{"observed_at":"2026-08-08T11:39:18.366006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.370581Z","title":"Flux model, 2024.https://github.com/black-forest-labs/flux","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.370581Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:31750a9b737c4ac571e0be78d2fa0c512fc78d86e0c3491481adacbe10f8521a","observation_id":"bc2226cb-aea5-4af2-83ed-cbfe03b3d17c","resolution":{"observed_at":"2026-08-08T11:39:18.370581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.375146Z","title":"Grounding image matching in 3d with mast3r, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.375146Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:3146f65186db5191d0685b500453c2a7f55c61b64093108b627413c2d11b857e","observation_id":"9d903ab2-ada5-4e62-bfc8-4ca8ed324db7","resolution":{"observed_at":"2026-08-08T11:39:18.375146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.379867Z","title":"Spherehead: Stable 3d full-head synthesis with spherical tri-plane representation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.379867Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:54c289dc86e9229d9907a118749ac42a4c7863b47a876b68364fc237e4ce3231","observation_id":"65eb1f75-1792-42e1-8159-24a1cd180c9f","resolution":{"observed_at":"2026-08-08T11:39:18.379867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11616","last_updated":"2024-11-27T15:01:08Z","snapshot_observed_at":"2026-07-06T18:16:24.847459Z","submitted_at":"2024-05-19T17:13:16Z","title":"Era3D: High-Resolution Multiview Diffusion using Efficient Row-wise Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11616","snapshot_observed_at":"2026-08-08T11:39:18.384576Z","title":"Era3d: High-resolution multiview diffusion using efficient row-wise attention, 2024.https://arxiv.org/abs/2405.11616","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.384576Z"},"links":{"cited_paper":"/paper/2405.11616","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:fbfbb15a7aa7d74de15a7efa2cd5eb020d144d635177e74f913fd64ee71e870f","observation_id":"69818b8f-949d-4462-9ef9-022eacafbcbb","resolution":{"observed_at":"2026-08-08T11:39:18.384576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.389534Z","title":"Magic3d: High-resolution text-to-3d content creation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.389534Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:8383fa4e8995635ea1e0e5589e08fe0db9885cef29ce65f1e7f91c7a4a689ba1","observation_id":"7f15eaaa-1270-437f-9da0-d0e21b3ba814","resolution":{"observed_at":"2026-08-08T11:39:18.389534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.393937Z","title":"Coco-gan: Generation by parts via conditional coordinating","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.393937Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:c3faa24b47cf6151b8759b0eaeedd15d3846cf1076b6ad4b3caf0d1782ea3ec6","observation_id":"4e426518-4b7c-4b91-9194-4387cc0a17ed","resolution":{"observed_at":"2026-08-08T11:39:18.393937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.904417Z","title":"Zero-1-to-3: Zero-shot one image to 3d object","venue":null,"work_id":"030c6895-3a55-4ddb-921a-0bb47452ac14","year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.398900Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:9a1388ac6db972b307d1eb996e1bd46442f9cd47a9d5709123f6a26767fa37dd","observation_id":"7e3b217f-b58b-4ab5-bd69-3478ec13de2a","resolution":{"observed_at":"2026-08-08T11:39:19.910443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15008","last_updated":"2023-11-08T16:50:08Z","snapshot_observed_at":"2026-07-06T16:37:16.106127Z","submitted_at":"2023-10-23T15:02:23Z","title":"Wonder3D: Single Image to 3D using Cross-Domain Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15008","snapshot_observed_at":"2026-08-08T11:39:18.403302Z","title":"Wonder3d: Single image to 3d using cross-domain diffusion, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.403302Z"},"links":{"cited_paper":"/paper/2310.15008","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:54f67bf85b9315ce38969c7af9f2c00aec743ed9dced5840588dbf6b579cceac","observation_id":"4d622ab0-bc69-4bb8-8e33-cc79196e74fd","resolution":{"observed_at":"2026-08-08T11:39:18.403302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.408296Z","title":"Jewett, Simon Venshtain, Christopher Heilman, Yueh-Tung Chen, Sidi Fu, Mohamed Ezzeldin A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.408296Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:5aeccd55cd4f826d207b370eb83879c320689b2e3121667ad337bb4353f969dc","observation_id":"6f900abd-98dc-4ebf-8d76-73eddf0a16cb","resolution":{"observed_at":"2026-08-08T11:39:18.408296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.880470Z","title":"Diffrf: Rendering-guided 3d radiance field diffusion","venue":null,"work_id":"99405b1f-8f0d-49f5-8881-65e9479d7bd7","year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.412984Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:406175bc01f7df9cdef67a387cddb797a9d33c547b86f8c8e101d3a94b82dba0","observation_id":"7cac0cfa-98c9-4287-a360-7b84cb5470e5","resolution":{"observed_at":"2026-08-08T11:39:19.885383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.417762Z","title":"Multidiff: Consistent novel view synthesis from a single image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.417762Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:ac86aa1673f3f9e536a9e49a213b54bd6621dc0192c9062c5ebf0a579216cd2c","observation_id":"e6dd232d-6931-435f-ad22-c14584e5ce17","resolution":{"observed_at":"2026-08-08T11:39:18.417762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-08T11:39:18.422541Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.422541Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:961b33599a6607e0b8f145664bb3b9f4451d5565d77c621b50eae1e71de64b1d","observation_id":"7c1328be-89bb-49c3-97d1-18d32bfc1635","resolution":{"observed_at":"2026-08-08T11:39:18.422541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.855554Z","title":"RenderMe-360: Large digital asset library and benchmark towards high-fidelity head avatars","venue":null,"work_id":"007b622f-140c-4a24-8546-4f79ad868208","year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.427321Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:41b03d63dc96816ccae94853cc2e6d210b0ed0c821d6fa1d65a815ee9cc3c4ae","observation_id":"5ca8406c-512a-4f50-9e7e-82a894699813","resolution":{"observed_at":"2026-08-08T11:39:19.860431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.835401Z","title":"Nerfies: Deformable neural radiance fields","venue":null,"work_id":"0af2632f-dcc6-420a-9124-808f7df3b95c","year":2021},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.431832Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:bf6dc449ef7742a620e427cfa6b69006ea3d495427200d96d66bf397cb507bc1","observation_id":"035c7c01-ba46-434e-af22-b9c59d6f215a","resolution":{"observed_at":"2026-08-08T11:39:19.845050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.436448Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.436448Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:0e01d95ff9a4cd4250540a7a75ee1231fdb73c6749e110b21260bb860ca8ec29","observation_id":"5c1f36ea-0cb9-45fd-a412-65aa7a43f0bd","resolution":{"observed_at":"2026-08-08T11:39:18.436448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00071","last_updated":"2026-02-06T19:40:50Z","snapshot_observed_at":"2026-08-01T02:15:47.181936Z","submitted_at":"2023-08-31T18:18:07Z","title":"YaRN: Efficient Context Window Extension of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00071","snapshot_observed_at":"2026-08-08T11:39:18.440888Z","title":"Yarn: Efficient context window extension of large language models.arXiv preprint arXiv:2309.00071, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.440888Z"},"links":{"cited_paper":"/paper/2309.00071","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:90cd31a939a1bb892cabc49641e1aa6ea7cfedfe7d7ef58cc53ba6d013cbc029","observation_id":"4b79be7d-0f2b-4628-9816-729d3b32d1a4","resolution":{"observed_at":"2026-08-08T11:39:18.440888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.445888Z","title":"Barron, and Ben Mildenhall","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.445888Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:e9bf83f80f39b577f3bd410d873bb8b2497e5a66df590e10fdb725dfa56b804e","observation_id":"b0b4ae09-25c8-4177-8845-fe47e18575ff","resolution":{"observed_at":"2026-08-08T11:39:18.445888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.450777Z","title":"3dgs-avatar: Animatable avatars via deformable 3d gaussian splatting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.450777Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:231d1b1609fdb374797a96dfe48916238ff53e2dfac06a904f0021eca388de60","observation_id":"d8a096dc-1eee-4706-a156-72aff7cb010a","resolution":{"observed_at":"2026-08-08T11:39:18.450777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.792484Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"fdb968c7-ca21-49a3-9819-5eb28af777f0","year":2021},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.455786Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:e753e19664d7a02ea50317eab4c0a2100a77daffb65b8d453210aaea5c8fc51c","observation_id":"5cab5ac9-127c-431b-9eca-448cba30f65e","resolution":{"observed_at":"2026-08-08T11:39:19.797530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13508","last_updated":"2023-03-27T15:34:19Z","snapshot_observed_at":"2026-07-06T15:07:18.636040Z","submitted_at":"2023-03-23T17:59:00Z","title":"DreamBooth3D: Subject-Driven Text-to-3D Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13508","snapshot_observed_at":"2026-08-08T11:39:18.460422Z","title":"Dreambooth3d: Subject-driven text-to-3d generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.460422Z"},"links":{"cited_paper":"/paper/2303.13508","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:e8eaabc4202a9e498967f970d6c8a63d73d96bd201286869d7ff8a24606c2b3a","observation_id":"a1df5468-7783-4a83-bc3b-c229849b5104","resolution":{"observed_at":"2026-08-08T11:39:18.460422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-08T11:39:18.465327Z","title":"Hierarchical text-conditional image generation with clip latents.arXiv preprint arXiv:2204.06125, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.465327Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:51f313f26857a2bd40174caded11b369400525e3cdfbb675efd24531baa73c53","observation_id":"a5fc3fa3-f30d-4af4-a000-bed94dd0a9bb","resolution":{"observed_at":"2026-08-08T11:39:18.465327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.470280Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.470280Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:8358d590c1bd572eb3680f852685c16b1a65fed5da23574b23356ad099e910ae","observation_id":"8591cadf-f05c-4f62-a737-627e1d6865e1","resolution":{"observed_at":"2026-08-08T11:39:18.470280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.766385Z","title":"Pifu: Pixel-aligned implicit function for high-resolution clothed human digitization","venue":null,"work_id":"c324f1b2-fb9d-4900-b8ce-1ee64e886c1c","year":2019},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.475386Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:80ee0841d25a59615eb7cc3c4a52eb34cc04f4d0bb57aa77e26604f08ec987c7","observation_id":"15bf7494-5f1b-4dab-915e-6ba07e4093e5","resolution":{"observed_at":"2026-08-08T11:39:19.771336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.752255Z","title":"Pifuhd: Multi-level pixel-aligned implicit function for high-resolution 3d human digitization","venue":null,"work_id":"4efdf47c-11b4-4527-bc87-fd0aacf9c519","year":2020},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.479993Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:2bba43f0c5ccc05b9998db7348b830472a4b4d37253d4d753a34a897b7f856ee","observation_id":"54156dae-d133-436f-88a9-92377aa4792b","resolution":{"observed_at":"2026-08-08T11:39:19.756766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17994","last_updated":"2024-04-24T01:08:12Z","snapshot_observed_at":"2026-07-06T16:39:24.839340Z","submitted_at":"2023-10-27T09:06:43Z","title":"ZeroNVS: Zero-Shot 360-Degree View Synthesis from a Single Image","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.17994","snapshot_observed_at":"2026-08-08T11:39:18.484501Z","title":"Zeronvs: Zero-shot 360-degree view synthesis from a single real image","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.484501Z"},"links":{"cited_paper":"/paper/2310.17994","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:788f5ad5d3c7c5559e5b086cfd8531aa44b14fe1b6a5152f41b2673e7e6a2b04","observation_id":"2af1dc38-5f13-4c8c-b7b9-80efb7b9266b","resolution":{"observed_at":"2026-08-08T11:39:18.484501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.490667Z","title":"Superglue: Learning feature matching with graph neural networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.490667Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:db4d54eedcd79385aa9baf665c957bdca7409ee9c9b5df2a41fbbd35f8c38c55","observation_id":"088e543a-395a-422e-8805-88ec5d7ed78b","resolution":{"observed_at":"2026-08-08T11:39:18.490667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.494984Z","title":"Structure-from-motion revisited","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.494984Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:856f3dd1e572f6bf28a9c37d79fe0f2f17713cd5e310b745ba18bd64dfcf069e","observation_id":"b1b85dcf-fe5a-47c2-ae88-78c6e2a09057","resolution":{"observed_at":"2026-08-08T11:39:18.494984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.499395Z","title":"Facenet: A unified embedding for face recognition and clustering","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.499395Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:5a4de61389fa4e7242dd0de82c1a98f2714072324073fc21f31608e174f2b50e","observation_id":"e481f45b-1c09-40bd-a105-3d94652cbd31","resolution":{"observed_at":"2026-08-08T11:39:18.499395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.711815Z","title":"Laion-5b: An open large-scale dataset for training next generation image-text models","venue":null,"work_id":"01ef9bf7-80fd-49c7-b101-809973afe21a","year":2022},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.504329Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:0582cef14bacfb050c369df384fae5d30cb771b42658f385eed65bedd34fbeca","observation_id":"0307ba8b-44e9-4856-8351-23718a21acfa","resolution":{"observed_at":"2026-08-08T11:39:19.716439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.697028Z","title":"Diffhuman: Probabilistic photorealistic 3d reconstruction of humans","venue":null,"work_id":"8e2ab0dc-75e7-425d-b7b1-8bdc3f0c9092","year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.508841Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:fa0372cd8dee5a2f9226038433e27d8c9a3fcf9c0defc20756303462f3f2740f","observation_id":"41a62492-cddb-436b-91f6-a8195a0be1ee","resolution":{"observed_at":"2026-08-08T11:39:19.701609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17251","last_updated":"2024-09-26T08:22:52Z","snapshot_observed_at":"2026-08-01T14:52:11.938084Z","submitted_at":"2024-05-27T15:07:04Z","title":"GenWarp: Single Image to Novel Views with Semantic-Preserving Generative Warping","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17251","snapshot_observed_at":"2026-08-08T11:39:18.513592Z","title":"Genwarp: Single image to novel views with semantic-preserving generative warping","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.513592Z"},"links":{"cited_paper":"/paper/2405.17251","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:0bac01e6128bef322da3cac271ca2a25e7595e411853e96da9bcb9ebfdf5ac8d","observation_id":"dd150066-fedf-4c4d-a46a-3f96b657ca85","resolution":{"observed_at":"2026-08-08T11:39:18.513592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10261","last_updated":"2023-04-19T16:39:51Z","snapshot_observed_at":"2026-08-04T21:24:21.644542Z","submitted_at":"2023-04-19T16:39:51Z","title":"Anything-3D: Towards Single-view Anything Reconstruction in the Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10261","snapshot_observed_at":"2026-08-08T11:39:18.518581Z","title":"Anything-3d: Towards single-view anything reconstruction in the wild","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.518581Z"},"links":{"cited_paper":"/paper/2304.10261","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:04ed08e6e1ca14a68b4e0292b392dcc9ecc35ca587668881b112763668893a9a","observation_id":"3ee13e06-32d6-4c88-a20a-a808eb4a71f8","resolution":{"observed_at":"2026-08-08T11:39:18.518581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16512","last_updated":"2024-04-18T04:12:32Z","snapshot_observed_at":"2026-07-06T16:12:38.269310Z","submitted_at":"2023-08-31T07:49:06Z","title":"MVDream: Multi-view Diffusion for 3D Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16512","snapshot_observed_at":"2026-08-08T11:39:18.523357Z","title":"Mvdream: Multi-view diffusion for 3d generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.523357Z"},"links":{"cited_paper":"/paper/2308.16512","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:b0831503896a61d76d451f5f98ed26bc96f247410929f529e667960c3e763974","observation_id":"4bffbc15-bd33-4b0b-b40f-c758d46bbd2d","resolution":{"observed_at":"2026-08-08T11:39:18.523357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.682096Z","title":"Implicit neural representations with periodic activation functions","venue":null,"work_id":"8a17a6fc-da7f-4293-815d-ac16eb6907b1","year":2020},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.528267Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:b399fd287e4a5b0a2f4d13dfad541ee1c912ffe7c84e50b06b78e5487ad00b28","observation_id":"f69ee5a2-b544-4184-882a-5fc61eb8491d","resolution":{"observed_at":"2026-08-08T11:39:19.687128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.667404Z","title":"Light field networks: Neural scene representations with single-evaluation rendering","venue":null,"work_id":"f6719204-b401-4041-883d-2cbe9658830b","year":2021},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.532855Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:eb8cf72fba9f27474e916184ca40e4fbadad1be412f76aeb609867f83cba6109","observation_id":"0229cd42-24fb-4f2f-aa24-176f031ac940","resolution":{"observed_at":"2026-08-08T11:39:19.672167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.537430Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.537430Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:4435565e8f44cc0494cedebbf750d263eedc6d045d9bad0258e7446c3872ff9e","observation_id":"c1cfa288-4280-4b01-95a6-c267d02bd425","resolution":{"observed_at":"2026-08-08T11:39:18.537430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.642652Z","title":"Danbo: Disentangled articulated neural body repre- sentations via graph neural networks","venue":null,"work_id":"b4591faa-d6be-4544-85c8-c11392d76f61","year":2022},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.542183Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:c198eb8aac30df3576cfef641307b1facacc24460532e6df6e244066d3eaa599","observation_id":"8dcf4e79-0733-4845-92e4-e9b4d702c17b","resolution":{"observed_at":"2026-08-08T11:39:19.647253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.627629Z","title":"Npc: Neural point characters from video","venue":null,"work_id":"45eb4fe1-4ce1-451c-98fc-5a32d9c8c822","year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.546812Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:04afcba871959bebdfd142b5888b31c44d83159db47d3fda692716bba9aed91f","observation_id":"3e9a3dd5-e711-46ed-9006-0f15c7bf582a","resolution":{"observed_at":"2026-08-08T11:39:19.632389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.612407Z","title":"Variational autoencoders for deforming 3d mesh models","venue":null,"work_id":"07db4094-aad9-4b04-9963-5178c8a7ec54","year":2018},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.551622Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:f5e9106ea2cb0e3d4a66359e6468abc1f7c6e6eb858766d9af899429c7dba052","observation_id":"c627244c-2fc7-4fad-8763-afc95ac571d4","resolution":{"observed_at":"2026-08-08T11:39:19.617425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.597022Z","title":"Make-it-3d: High-fidelity 3d creation from a single image with diffusion prior","venue":null,"work_id":"30aea24b-fbe9-4fdd-a286-d8dc9bae09f4","year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.556086Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:168103a5b8507e6d876142d5ce3ca4c5869bea03ff6a18eae345c1e9b7c353f0","observation_id":"4268681c-2dc0-4068-a527-4d2c37f240e9","resolution":{"observed_at":"2026-08-08T11:39:19.601797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.581747Z","title":"Textmesh: Generation of realistic 3d meshes from text prompts","venue":null,"work_id":"da581a74-ea45-4c8f-aca8-95b3493661e2","year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.561574Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:acf7a8e98cb305698232e80773dc87b526c66110d355d34c52e1744b1ff2d86d","observation_id":"0dfbb4cc-b95b-456d-ae1a-bebb554d3067","resolution":{"observed_at":"2026-08-08T11:39:19.586542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.566987Z","title":"Attention is all you need.Advances in Neural Information Processing Systems, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.566987Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:63794b307c8669014144f4f91ccc9c4339503144f1314fa80a75a031a7d94ad9","observation_id":"b614a880-b355-42ed-87dd-9ba86a39a0b7","resolution":{"observed_at":"2026-08-08T11:39:18.566987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01104","last_updated":"2025-05-30T23:46:05Z","snapshot_observed_at":"2026-08-04T01:13:18.607682Z","submitted_at":"2024-10-01T22:22:35Z","title":"Softmax is not Enough (for Sharp Size Generalisation)","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01104","snapshot_observed_at":"2026-08-08T11:39:18.571084Z","title":"softmax is not enough (for sharp out-of-distribution), 2024.https://arxiv.org/abs/2410.01104","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.571084Z"},"links":{"cited_paper":"/paper/2410.01104","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:5b5298ec02e67ddfb12bf40936aac9feb01c34c8e4965b7449802907cf9eb5d3","observation_id":"05002aa6-067a-43e3-9750-2248515a8f9a","resolution":{"observed_at":"2026-08-08T11:39:18.571084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.575739Z","title":"Dust3r: Geometric 3d vision made easy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.575739Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:7e8012e4ee8d550e22a917bf519f382f5a096f37c4c29f5f6da2d935fd176f13","observation_id":"eddb96e2-3eea-4bd7-8d7a-647448cd3b74","resolution":{"observed_at":"2026-08-08T11:39:18.575739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.547751Z","title":"Rodin: A generative model for sculpting 3d digital avatars using diffusion","venue":null,"work_id":"d7a91624-40e6-4374-aecb-6bd8be4fa8fe","year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.580187Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:2b77d381c5f876a6ed69b84f5eaa4d6601d67c93919de8de27df5cd9ce34e1b6","observation_id":"18030b82-d37d-4c5f-970b-d784c8f0451a","resolution":{"observed_at":"2026-08-08T11:39:19.553004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.532233Z","title":"4d-dress: A 4d dataset of real-world human clothing with semantic annotations","venue":null,"work_id":"f4f433a3-77be-4369-929d-9aefe26ad8e3","year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.584760Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:a2aeddaeb7d2c1cfc5140a03a6ebf1e0c2eeccaf4da52d20d09f9ad1c2f3dd33","observation_id":"768fb691-4d10-407d-a92f-9fa4cb1f6819","resolution":{"observed_at":"2026-08-08T11:39:19.537303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.516564Z","title":"Prolificdreamer: High-fidelity and diverse text-to-3d generation with variational score distillation","venue":null,"work_id":"64962de8-7de4-4f1f-a581-e33c81222645","year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.589527Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:5b3918d5e453ea09820e6aa35c9658d8339845f3f6db5d8018b31f2249c82733","observation_id":"ecd17e55-e792-48c9-9275-b4d268bd4225","resolution":{"observed_at":"2026-08-08T11:39:19.522067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.501817Z","title":"Motionctrl: A unified and flexible motion controller for video generation","venue":null,"work_id":"d06a90f1-18e2-4125-8c6d-24682bc393d1","year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.595035Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:63e2474886b875fd1644d1b5ecb5325ba05e6d10b0001ab76cdb628da1c8c9f6","observation_id":"c6bcdb64-8b99-4223-bf53-fa976d57b587","resolution":{"observed_at":"2026-08-08T11:39:19.507007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.487412Z","title":"Gomavatar: Efficient animatable human modeling from monocular video using gaussians-on-mesh","venue":null,"work_id":"5f941830-3cc7-4400-b934-5ebbd5e94e69","year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.599682Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:d9191f90492a0efc1834a346ca98bdf1e20728bd270a91a80cfacef43d09512c","observation_id":"f3d3f707-0500-45a1-922d-08dc752f5cf6","resolution":{"observed_at":"2026-08-08T11:39:19.491874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.472499Z","title":"Humannerf: Free-viewpoint rendering of moving people from monocular video","venue":null,"work_id":"f674efe0-ca2a-45e1-9228-46e05d5dba29","year":2022},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.604589Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:89f6f6d70c817122c8908852e0808c5ad2cf7a7fe63585e5f69ca0d4b625b78f","observation_id":"f2f3f64f-4a53-4381-be6b-d1fbb64f0ec4","resolution":{"observed_at":"2026-08-08T11:39:19.477263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.457900Z","title":"Learning a probabilistic latent space of object shapes via 3d generative-adversarial modeling","venue":null,"work_id":"4d670955-c85c-49a0-9abf-f7cb68e7412d","year":2016},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.609116Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:3ce90bd6e69cd758c190aa07472f76154773cdca1d0ed46538aaf89b7b896ec4","observation_id":"1f32912f-0973-48cc-b66b-4c7d7ae8d5cd","resolution":{"observed_at":"2026-08-08T11:39:19.462705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.613742Z","title":"Detectron2.https://github","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.613742Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:1dd7f11ac202117d1643f15844f2dc79d2cec6709ef7d1b572e6400a1fa73393","observation_id":"0a4774a4-9a0e-49fc-b73c-2e3cc0ab82d1","resolution":{"observed_at":"2026-08-08T11:39:18.613742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.433480Z","title":"Learning descriptor networks for 3d shape synthesis and analysis","venue":null,"work_id":"bebee637-eeb8-4147-ae40-f8f7df4f76e9","year":2018},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.618036Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:99d02ba4f53c2e7f16b325b3479f2ad25058665dde4b1e1eb3e9bde3d14b3666","observation_id":"58f77260-6e15-4682-afd9-dc6430a11178","resolution":{"observed_at":"2026-08-08T11:39:19.438168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.416519Z","title":"Mvhumannet: A large-scale dataset of multi-view daily dressing human captures","venue":null,"work_id":"9c557fa2-4263-4af7-836d-36996a7ae26e","year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.622937Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:71babc4c0f445e5ed3d990207012691619ad1731bad3fa32f31749ac04f9fef1","observation_id":"ec71ad8f-366e-4376-b369-07725acb584e","resolution":{"observed_at":"2026-08-08T11:39:19.422881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.399674Z","title":"Neurallift-360: Lifting an in-the-wild 2d photo to a 3d object with 360deg views","venue":null,"work_id":"1bc4c35c-6cd1-40f9-8edd-24c58f94ced3","year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.627798Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:da3fd437cd359d696b8bd6a008850a2f0c451c888a3cebb07dd4578528190c10","observation_id":"bdbffe71-c654-49ba-b23a-ff7d15029fbf","resolution":{"observed_at":"2026-08-08T11:39:19.404922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10667","last_updated":"2024-10-31T07:43:14Z","snapshot_observed_at":"2026-07-06T18:01:01.206270Z","submitted_at":"2024-04-16T15:43:22Z","title":"VASA-1: Lifelike Audio-Driven Talking Faces Generated in Real Time","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10667","snapshot_observed_at":"2026-08-08T11:39:18.632356Z","title":"Vasa-1: Lifelike audio-driven talking faces generated in real time.arXiv preprint arXiv:2404.10667, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.632356Z"},"links":{"cited_paper":"/paper/2404.10667","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:64450378246b9215b778f4725e5ac3aeb782cee5044ce576c94661fa689506bc","observation_id":"98f327b9-02a7-4d79-8321-f3bd1d7fc56d","resolution":{"observed_at":"2026-08-08T11:39:18.632356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.384397Z","title":"FaceScape: A large-scale high quality 3D face dataset and detailed riggable 3D face prediction","venue":null,"work_id":"d7fc147a-1fd8-4138-baf7-5cceb207c175","year":2020},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.637564Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:d070eec03c1f34a7c361b8a6a36732733fe5078aff53c19f6935fcfb7fa11a14","observation_id":"45834acb-a8cd-440e-8b83-dc99ef799636","resolution":{"observed_at":"2026-08-08T11:39:19.389616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.369111Z","title":"i3DMM: Deep implicit 3D morphable model of human heads","venue":null,"work_id":"501a9f85-9fb2-427a-bd04-ee9361d61b20","year":2021},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.642751Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:db58d91a08eb7e67122af519361d5bbd9d24a3cb667a0315e9ccd43e38a4d1dd","observation_id":"3efa08f5-5754-4fe0-b4a4-6cbc1b0ec130","resolution":{"observed_at":"2026-08-08T11:39:19.374510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.354476Z","title":"Long-term photometric consistent novel view synthesis with diffusion models","venue":null,"work_id":"639d28b2-57ee-4807-949c-4877e38f5bba","year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.648374Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:e2585fd4924c235260b621f661163d4ef3e69c00117ebf0d88a9da192b541f55","observation_id":"c793d92e-b981-44fc-b8be-cce33f31527d","resolution":{"observed_at":"2026-08-08T11:39:19.359697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.339886Z","title":"HUMBI: A large multiview dataset of human body expressions","venue":null,"work_id":"d901f7f4-8aaa-4353-944e-da8337f416d9","year":2020},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.653009Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:d99eed2f96544cc7d6ada721617288cf023234d38db484ab249b0f880b921a55","observation_id":"95f153b7-b5c2-4487-bb9c-c8a8785d4d8f","resolution":{"observed_at":"2026-08-08T11:39:19.344852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T13:57:11.835777Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":67,"verified_exact":3,"verified_fuzzy":30},"total_outbound_references":113},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 100 of 113 outbound references and 2 inbound Pith citation observations for arXiv:2502.07785."}