{"as_of":"2026-08-22T18:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6dd0b532c9d9bc8074ccbb7cc6e9f66de2ca2fa91bcfb7a4071e1cbd8691f362","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T22:31:37.646411Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.01589/citation-record","integrity":"/paper/2501.01589/integrity","json":"/paper/2501.01589/citation-record.json","paper":"/paper/2501.01589"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.487638Z","title":"Accessed: 2024-11","venue":null,"work_id":"dc62e508-b710-4fc7-a1ac-90e1ac71f52c","year":2024},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.398984Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:4a0e82becdbf2120ebde6736789047af81924a90bc216284065e9202ea4e4365","observation_id":"af42ad01-a082-47ab-857a-31a017bf60a8","resolution":{"observed_at":"2026-08-10T22:31:38.492010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.473948Z","title":"Video based reconstruc- tion of 3d people models","venue":null,"work_id":"4f1b8c7e-b889-40a7-902a-36f2ad05d213","year":2018},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.404273Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:1b689c3e86d9bf34f75fdc6349053b8477648d45de8c434609328d666c3adf09","observation_id":"58ac0681-0aca-429c-bc84-8e328cc029c1","resolution":{"observed_at":"2026-08-10T22:31:38.478452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.460152Z","title":"Tex2shape: Detailed full human body geometry from a single image","venue":null,"work_id":"30ab31e0-54b6-419d-8140-c934b93e01de","year":2019},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.408823Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:0f2d1306c355d120183b84bb2d9b347194ee79a30aeb597cd78f9636625f43b7","observation_id":"a4d84d34-e751-4b95-9a86-0a78fbade582","resolution":{"observed_at":"2026-08-10T22:31:38.464528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.446535Z","title":"Scape: shape completion and animation of people","venue":null,"work_id":"2ec0ec01-45a2-4ced-afc5-d065797320f5","year":2005},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.413348Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:988c626074738567b38dc8f9ab576ba90a6d0cb4bf268d870d2af62b8a1d16c0","observation_id":"f658f5d1-7963-4ea9-b0ac-a09e5ad91653","resolution":{"observed_at":"2026-08-10T22:31:38.450872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.432712Z","title":"Neural-abc: Neural parametric models for articulated body with clothes","venue":null,"work_id":"42eec93d-a366-4d6b-9ab7-6473eb29ab84","year":null},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.418217Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:f2b95f413278c2906d4e389af4d432678c764aabe1eeff027504fdf95821db99","observation_id":"3ab9d2ec-3270-4c7a-bc9a-5ba845ac5579","resolution":{"observed_at":"2026-08-10T22:31:38.437320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.419164Z","title":"gdna: Towards generative detailed neural avatars","venue":null,"work_id":"f686117b-f192-4512-9200-87c0d43b7940","year":2022},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.423608Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:bfd62cadbf7b6a4221e708d067a53a5566cf685b0a623c9ee7a3aa5e0d9c26ab","observation_id":"d029056d-cfeb-438e-a400-94bf6d95844b","resolution":{"observed_at":"2026-08-10T22:31:38.423784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.405986Z","title":"SMPLicit: Topology-aware generative model for clothed people","venue":null,"work_id":"1b23745a-3648-45a5-880f-2c93f87a0329","year":2021},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.428070Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:69c9b6204bf8125680ba757b6a3aba74c76497bd2b700a024c7f6968a0a91bc7","observation_id":"d0271b59-62d0-443c-9b12-18b75f46508f","resolution":{"observed_at":"2026-08-10T22:31:38.410467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.392250Z","title":"DrapeNet: Garment Generation and Self- Supervised Draping","venue":null,"work_id":"2d28685e-2c2d-4caf-89db-e72d7a3bfc8d","year":2023},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.432775Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:967dac19194ad948a0937b541cf4006a96d4934c23863fc3b36f07cf14139567","observation_id":"e1eda98e-2fe3-4520-9212-3cf6438a6911","resolution":{"observed_at":"2026-08-10T22:31:38.397015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.377012Z","title":"Black, and Timo Bolkart","venue":null,"work_id":"3c914cbf-32c0-4f12-993a-55fa88c21c39","year":2022},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.437048Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:6c6b392c0dd181845a6a51031eec609d78a30cafb4a4e323f6efa18aa88b77f6","observation_id":"76e76bdb-0817-446a-9859-a4ada7ec82af","resolution":{"observed_at":"2026-08-10T22:31:38.382333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.362693Z","title":null,"venue":null,"work_id":"ad8601d4-e7fb-4eed-b77f-f91c7dffc506","year":2023},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.441466Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:491e3b371bf231bd564222bfcbc611d596fea1ac673b866c8db6781a9b4969e3","observation_id":"63a25b64-5483-400b-97ae-23320eeb906a","resolution":{"observed_at":"2026-08-10T22:31:38.367102Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.348695Z","title":"Black, and Otmar Hilliges","venue":null,"work_id":"d1c92a31-ebef-411f-a575-fb06528f4b10","year":2023},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.446848Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:e98b35ede06944653803383373d614d16d897ab5dbb18748b987c563bcca8ace","observation_id":"c2e03453-dbc2-409a-bb68-244c42a2fa85","resolution":{"observed_at":"2026-08-10T22:31:38.353253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.334446Z","title":"Implicit geometric regularization for learning shapes","venue":null,"work_id":"3da0bc2a-9586-4e93-a34e-8eb6f7a17bb3","year":2020},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.451928Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:c732918048a460c1f4bb6ded11bec6375db984c30008ca3e1a1c9d5193d3885b","observation_id":"78a6b931-76f6-4f07-ae6f-d4238ef0c14c","resolution":{"observed_at":"2026-08-10T22:31:38.339246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.320183Z","title":"Meshudf: Fast and differentiable meshing of unsigned distance field networks","venue":null,"work_id":"de9dc785-4802-45da-a0b6-bbdb9d7dc127","year":null},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.456386Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:25c9cc32e5333403287d74c0d8c1e313ac2c2113e65a4e150062dd3e7e8384e4","observation_id":"60a22e82-d65f-4578-8c23-23488fd2a09c","resolution":{"observed_at":"2026-08-10T22:31:38.324914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.306141Z","title":"Vid2avatar: 3d avatar reconstruction from videos in the wild via self-supervised scene decomposition","venue":null,"work_id":"87b9553b-5099-4f14-bb7c-c1cb4f0ee0b2","year":2023},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.460472Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:4ce45b179450b281d3bc3f7d7a1466473e26cd16664299090279f971a52d28dd","observation_id":"dbfa282a-39bd-4b56-90fb-972501e31515","resolution":{"observed_at":"2026-08-10T22:31:38.311071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.291595Z","title":"Livecap: Real-time hu- man performance capture from monocular video","venue":null,"work_id":"6af68812-af25-4e6b-acbe-d885530c7eb7","year":2019},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.464880Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:d2f255288e32c98ac38b1e6d1abcd1474aa0666b3ebcfa31649b36bb17c7ee6a","observation_id":"be7e9ae8-9aee-4ea9-b628-7c74b5e9a8ef","resolution":{"observed_at":"2026-08-10T22:31:38.296332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.277100Z","title":"Deepcap: Monoc- ular human performance capture using weak supervision","venue":null,"work_id":"01c167d3-1dc1-4966-931d-7ee0c0915cab","year":2020},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.469016Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:d4296fc1f0e3a35353bab9d84811052921a54124938c75a76826fbc4c0cb5c92","observation_id":"81bab789-a785-4a59-b8ca-190427e641f2","resolution":{"observed_at":"2026-08-10T22:31:38.281825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.03380","last_updated":"2022-10-04T09:15:36Z","snapshot_observed_at":"2026-08-20T20:23:46.720327Z","submitted_at":"2022-06-07T15:19:18Z","title":"Shape, Light, and Material Decomposition from Images using Monte Carlo Rendering and Denoising","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.03380","snapshot_observed_at":"2026-08-10T22:31:37.473254Z","title":"Shape, Light, and Material Decomposition from Im- ages using Monte Carlo Rendering and Denoising","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.473254Z"},"links":{"cited_paper":"/paper/2206.03380","citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:d24a8f2a2585b1809456920802d5d1dbf9d4d7e2166661341e02871b2bfed0f1","observation_id":"a9fc5ad0-8782-4820-9698-786da664efd9","resolution":{"observed_at":"2026-08-10T22:31:37.473254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.262769Z","title":"Headnerf: A real-time nerf-based parametric head model","venue":null,"work_id":"65850770-a961-47fb-a032-6107881a30e5","year":2022},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.477749Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:cff713a81824045e14472bc28e64d1861992b11f561d7a285ffbdd09d0333ac3","observation_id":"daf23303-0ac3-4284-8a67-71b7456fbe3d","resolution":{"observed_at":"2026-08-10T22:31:38.267385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.248799Z","title":"Bcnet: Learning body and cloth shape from a single image","venue":null,"work_id":"f4d82836-e758-4e82-8bd6-7faace89820d","year":2020},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.481969Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:416a6aad4e6d85ee2c13fe87704dce2530ac83e088270749bf7e7e9ebc4ea76b","observation_id":"550953be-c993-4975-92eb-812ae88c4154","resolution":{"observed_at":"2026-08-10T22:31:38.253330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.234361Z","title":"Sel- frecon: Self reconstruction your digital avatar from monocu- lar video","venue":null,"work_id":"3415e940-9b81-4267-b01a-aa7e082e9cef","year":2022},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.486026Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:bc2dcf3336f4a4df6c1071a2b2450bae361fd0ac7d9262c39f66ada5dfa6623d","observation_id":"5874af40-a7bf-4854-9a44-6a2a18770d66","resolution":{"observed_at":"2026-08-10T22:31:38.239087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.219375Z","title":"In- stantavatar: Learning avatars from monocular video in 60 seconds","venue":null,"work_id":"d1ed21c0-06f9-4e11-b520-5a8ab0ff7706","year":2023},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.490406Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:0227f8980b0ccc1bcf1cf352e162c43a684d42fc3651fcdf2f7839052541e891","observation_id":"c3a695b5-3986-4d90-ac0e-c2ca65431bf5","resolution":{"observed_at":"2026-08-10T22:31:38.224276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.204152Z","title":"Neuman: Neural human radiance field from a single video","venue":null,"work_id":"e623c2fa-5bcc-4154-bc58-ff06467b7804","year":2022},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.494804Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:a4f1dfac10758e4d00bfe5774801e8b09d33e9e9103ba502974c1a33d5314acf","observation_id":"f2aba92a-702e-401b-a062-c76fd5c9f58c","resolution":{"observed_at":"2026-08-10T22:31:38.209330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.188527Z","title":"Percep- tual losses for real-time style transfer and super-resolution","venue":null,"work_id":"a0a558e7-2078-490d-b6d4-61bacf256a97","year":2016},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.498904Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:1bc3914537d8cadd3f445feebc9a4af08d12f5fc70ed7f972afd8a573a098b98","observation_id":"34c7484d-fed9-4d8b-a845-e8ef47bbafb2","resolution":{"observed_at":"2026-08-10T22:31:38.193584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.172620Z","title":"End-to-end recovery of human shape and pose","venue":null,"work_id":"3c4e779c-301c-416f-a47e-16a36732d7d9","year":2018},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.503090Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:2066acdc6792225b518e745fb135a3601eebc7b062fe2c27749df1df2a18ba6e","observation_id":"a4c379d1-144f-4cb5-a281-e6364df06b23","resolution":{"observed_at":"2026-08-10T22:31:38.177402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.158176Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":"b3118e09-d986-42be-8c57-b2b4245009ae","year":2023},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.507389Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:e58a9d0f277dd7fc900bf3d06921acab3db809ec73c93f176a5f380829d90251","observation_id":"50e4d847-7ca9-4ef1-a648-69fd4a0599ea","resolution":{"observed_at":"2026-08-10T22:31:38.162906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-18T14:59:58.697879Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-10T22:31:37.511508Z","title":"Sapiens: Foundation for human vision mod- els","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.511508Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:4b550beeaeb08f506d4a78f418197f2558bc9f2644d25196642b254d6e8173a0","observation_id":"58d3c03d-7053-468a-89de-56f21e740989","resolution":{"observed_at":"2026-08-10T22:31:37.511508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.143230Z","title":"Gala: Generating animatable layered assets from a sin- gle scan, 2024","venue":null,"work_id":"8a63c77e-26f3-4c2e-9765-d63f18d08ec7","year":2024},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.515926Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:54906edad18c421ab0386251e426e7b13b0a77232d8154aeb0bf762927de9e21","observation_id":"8dbdef02-14bf-4a90-9e5e-2ef2ca74f704","resolution":{"observed_at":"2026-08-10T22:31:38.147970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.127833Z","title":"High-quality animatable dynamic garment re- construction from monocular videos","venue":null,"work_id":"f86e3513-63fe-4af6-a090-c909d5891fe6","year":2023},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.520103Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:16b03611f9e1301be4f63d64e59d56a52132794a6d1a78cc64304d3b4a6b43f1","observation_id":"f55c5233-5df3-4c4f-95cd-2f9e570d4515","resolution":{"observed_at":"2026-08-10T22:31:38.132879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.112703Z","title":"Cliff: Carrying location information in full frames into human pose and shape estimation","venue":null,"work_id":"8555243f-67f3-4f5f-85fe-e98a1e5415aa","year":null},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.524408Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:f6106c69621d6071ac8130e3894588e393875275a355e3a2356d86385ab725d8","observation_id":"21a4b354-ab6b-44d9-95a1-b97a3b857482","resolution":{"observed_at":"2026-08-10T22:31:38.117711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:37.528824Z","title":"End-to-end hu- man pose and mesh reconstruction with transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.528824Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:f3d4a10d4e79dc242d0db21c1b688be9f79ecc3d50571ba889c7c7aa081805a1","observation_id":"d187d194-3647-4e64-922b-b7a6917ef75d","resolution":{"observed_at":"2026-08-10T22:31:37.528824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.088500Z","title":"Neudf: Leaning neural unsigned distance fields with volume rendering","venue":null,"work_id":"1aa914b9-3282-44ae-ab96-4bfe19774773","year":2023},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.532962Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:a966eb34d3da709e0db3868ee253a32812c7c0a5f761f3537781bcda7a0c5d51","observation_id":"ded5f1a5-0572-448c-93f3-d0c834ba8242","resolution":{"observed_at":"2026-08-10T22:31:38.093124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.074427Z","title":"Black, and Bernhard Sch ¨olkopf","venue":null,"work_id":"6a84bc63-bda9-4505-a766-76e898c2602b","year":null},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.536972Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:b5a22f23262ccec68125155143e968d760e4857b30a1f1ca61f8a42601559fce","observation_id":"1335543d-fa1d-458e-b481-ced8a52c0f89","resolution":{"observed_at":"2026-08-10T22:31:38.079095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.14173","last_updated":"2022-11-25T15:21:45Z","snapshot_observed_at":"2026-08-18T23:59:51.755161Z","submitted_at":"2022-11-25T15:21:45Z","title":"NeuralUDF: Learning Unsigned Distance Fields for Multi-view Reconstruction of Surfaces with Arbitrary Topologies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.14173","snapshot_observed_at":"2026-08-10T22:31:37.542398Z","title":"Neuraludf: Learning unsigned distance fields for multi-view reconstruction of surfaces with arbitrary topolo- gies","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.542398Z"},"links":{"cited_paper":"/paper/2211.14173","citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:dbe9753bc8180305f7dbcdf88d86b65e8e8243e79ee49c21b46995566192eea2","observation_id":"7e1f9cd3-451d-4605-a55e-a7123b8546dd","resolution":{"observed_at":"2026-08-10T22:31:37.542398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.060716Z","title":"Smpl: A skinned multi- person linear model","venue":null,"work_id":"121ada88-e259-4ed7-98eb-2fcfe0c8c74b","year":2015},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.546831Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:49f1afd909479d6ecec7461f4076b6212b3ac5769a97e97b741d704ca4b402c4","observation_id":"fe0773f8-f4f3-43bc-815a-d574d6112afa","resolution":{"observed_at":"2026-08-10T22:31:38.065093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.046708Z","title":"Marching cubes: A high resolution 3d surface construction algorithm","venue":null,"work_id":"a2a85cd1-71d4-49d7-a52d-86610790a71a","year":1987},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.551011Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:1982e0fe4cb5c63cd27cd8e8f4b2e26f4cb1ea37b0344b1ef52ea824ed7809a0","observation_id":"10e64163-7817-4fdb-9bff-b53dffdec107","resolution":{"observed_at":"2026-08-10T22:31:38.051312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.032489Z","title":null,"venue":null,"work_id":"6360bb6f-312c-414e-8f19-e52b34e267e1","year":2021},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.554935Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:e0d7543163778590641ec6056ce28d5acc3da934fcb71f184b26f9669062f716","observation_id":"b89ce3ea-53f7-414e-b5e7-2f0b48a95e74","resolution":{"observed_at":"2026-08-10T22:31:38.036705Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.017472Z","title":"Nerf: Representing scenes as neural radiance fields for view syn- thesis","venue":null,"work_id":"0def2d39-5e69-45c9-b47a-6ae720c3c1c0","year":2020},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.559351Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:fc5f0bbb22d42e211f2018b5e00d53327af7b9a36eee2bb2395d3adc70ea50e9","observation_id":"804b6969-587a-4213-9657-983e7e0a015f","resolution":{"observed_at":"2026-08-10T22:31:38.022576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:38.002147Z","title":"Extracting Triangular 3D Models, Materials, and Light- ing From Images","venue":null,"work_id":"bbe0b7c3-ad7a-447e-b939-315eadc6ea9f","year":2022},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.563404Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:16fc0c5212d9c3ff690ed77a05bc755ca2a20bc612db23929fba8e360a60308b","observation_id":"f9497f4a-ab4a-4911-89e6-927d1ac47fbe","resolution":{"observed_at":"2026-08-10T22:31:38.006950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:37.987702Z","title":"Npms: Neural parametric models for 3d deformable shapes","venue":null,"work_id":"1af39e42-c824-4ef7-98d1-a89eb0353c8f","year":2021},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.567608Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:7c049d1f4e3d2c93ea678d5a0a6b527f5720f11eb9df4422b797cbac968f9ea8","observation_id":"34a500ce-ee65-4977-95fe-18abab6a6244","resolution":{"observed_at":"2026-08-10T22:31:37.992368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:37.973343Z","title":"Deepsdf: Learning con- tinuous signed distance functions for shape representation","venue":null,"work_id":"3d607849-b19c-4b08-a49c-61efd86bae2e","year":2019},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.571593Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:52b9689d93a6a71c05e58f5d8cbd9a6ac7dfd9bf2883306cb75d578236c48c71","observation_id":"b3cb8350-dd1c-428a-ada0-5c9c571ab895","resolution":{"observed_at":"2026-08-10T22:31:37.978056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:37.958497Z","title":"ihuman: Instant animatable digital humans from monocular videos","venue":null,"work_id":"f551cb32-4aa8-483b-9301-3165c3d711b8","year":2024},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.575817Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:01e524ddd431bcb0942dc466d418821d781622f5226e4c4c4a82fa1438032932","observation_id":"06f61ace-e8f4-4db4-bb6c-cbbe8e15260b","resolution":{"observed_at":"2026-08-10T22:31:37.963380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:37.944332Z","title":"Intrinsicngp: Intrinsic coordinate based hash encod- ing for human nerf","venue":null,"work_id":"dffddf54-25d4-4a9e-ad0c-ef28647e2e03","year":2023},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.580283Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:9d6474c74ea7a1381936e653f9100877fcaad50a40ad4c44e43d6e86cf212556","observation_id":"6f305a0f-d0e3-4cd4-9e80-63533d2afded","resolution":{"observed_at":"2026-08-10T22:31:37.948947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:37.584566Z","title":"Neural body: Implicit neural representations with structured latent codes for novel view synthesis of dynamic humans","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.584566Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:fa4c4b1941911b348412baea2fc50e78c10005562c4e152c7c6cd120dd817c49","observation_id":"5a79bf25-b702-48ed-9714-9c688cf007a0","resolution":{"observed_at":"2026-08-10T22:31:37.584566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:37.919732Z","title":"Clothcap: Seamless 4d clothing capture and retarget- ing","venue":null,"work_id":"d1c69f71-eb93-43ca-b70e-e52a9441b847","year":2017},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.589223Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:fbe9dcbb059e71d3f840c842672caa859626ef10a0d248bd1b42222970b6ba41","observation_id":"b77e90a2-ee95-4def-b8c1-23a86ea234a8","resolution":{"observed_at":"2026-08-10T22:31:37.924429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:37.905931Z","title":"Recmv: Reconstructing 3d dynamic cloth from monocular videos","venue":null,"work_id":"2b7080b9-502d-44e9-940f-d29bc91c0a59","year":2023},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.593557Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:f507d2e53cbb4d07d0cc9ae7021951e838b575240f02ca92b9d9d506f528b381","observation_id":"fdf5fecc-5a4c-4f8f-bc2a-f0d2c38d9414","resolution":{"observed_at":"2026-08-10T22:31:37.910437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-10T22:31:37.597663Z","title":"Sam 2: Segment anything in images and videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.597663Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:1e342b75cb60ee203e071bf90476afea7fe816a8b389b9c2525858d02715d8b4","observation_id":"aadf2fa9-2d2d-474c-bbd5-372bdee31303","resolution":{"observed_at":"2026-08-10T22:31:37.597663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:37.891880Z","title":"Isp: Multi-layered garment draping with implicit sewing patterns","venue":null,"work_id":"02e4bef3-e7e3-44d2-a08e-1a561a8d3d27","year":2023},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.601879Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:3e17aab285acb4c894fe216451c3755e1d757951e66cf1c8f959a119aad27b48","observation_id":"c5740e68-ac8e-4909-a046-8640630d400b","resolution":{"observed_at":"2026-08-10T22:31:37.896639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:37.877704Z","title":"Pifu: Pixel-aligned implicit function for high-resolution clothed human digitiza- tion","venue":null,"work_id":"21da2847-10d2-4a49-b33d-0f190bf53ddb","year":2019},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.605918Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:8d65095618bfef0c25d17e8875ebac3059cd2b5ecbd51593068a0612c2d286f2","observation_id":"3ff599eb-7e8b-418b-b3f1-7b51cb52fa43","resolution":{"observed_at":"2026-08-10T22:31:37.882360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:37.863541Z","title":"Pifuhd: Multi-level pixel-aligned implicit function for high-resolution 3d human digitization","venue":null,"work_id":"0826b579-4197-494b-8865-29c13fd383cb","year":2020},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.609906Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:53c6d398e46ce6886dbe8b03fd0b6897cd1da9f0b38a6a09d36bd275c38879fc","observation_id":"28fed265-74f2-4013-a3ff-c1b4169854a6","resolution":{"observed_at":"2026-08-10T22:31:37.868202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:37.613891Z","title":"Mobilenetv2: Inverted residuals and linear bottlenecks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.613891Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:bed9b37e31ad8947cafade526f81a7df55af947528a81ba33a5e26309f2e4f72","observation_id":"023c6ddb-a299-4a30-9f47-4adaf595bd7b","resolution":{"observed_at":"2026-08-10T22:31:37.613891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:37.839669Z","title":"Snug: Self-supervised neural dynamic garments","venue":null,"work_id":"4e854a5a-3055-40df-9d8b-b9f7fb5bead0","year":2022},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.617852Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:7ec211021afe02813b886ba26d234107dc078611c4fbad26b0b35896727f8bad","observation_id":"70ba61e4-4ee1-4051-9e59-2d436c231c77","resolution":{"observed_at":"2026-08-10T22:31:37.844391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:37.825201Z","title":"Deep marching tetrahedra: a hybrid represen- tation for high-resolution 3d shape synthesis","venue":null,"work_id":"f09e67eb-0bdb-417e-9a78-c6351190c063","year":2021},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.621878Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:e88f1d1b1ddae8a7414152d16d574360ea9f9874e0740e3972d1432cc1bc1060","observation_id":"eaff9cec-d7b6-4568-8e3f-848d8deaadbe","resolution":{"observed_at":"2026-08-10T22:31:37.830409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:37.810028Z","title":"Dressrecon: Freeform 4d human recon- struction from monocular video, 2024","venue":null,"work_id":"c591e34d-01c5-4e36-bdaf-8db3d530b892","year":2024},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.625976Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:f089a1b04f88d4c632b1a290d9dbf4e835edc322dbdff74df32bdf705e5ddf43","observation_id":"16251220-4912-4997-9f91-d906201c4b30","resolution":{"observed_at":"2026-08-10T22:31:37.814896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:37.794724Z","title":"GoMAvatar: Efficient Animatable Hu- man Modeling from Monocular Video Using Gaussians-on- Mesh","venue":null,"work_id":"63769c66-3fec-40ad-b2c3-4ff4b657cb76","year":2024},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.630007Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:22b08e234a904b8ee217586e4e353acbff0a2fe9c1c1140e41ef6494df4f8933","observation_id":"c833d55d-a3d0-45a8-8ac0-5fd75898a535","resolution":{"observed_at":"2026-08-10T22:31:37.799449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:37.780152Z","title":"Multi-view mesh recon- struction with neural deferred shading","venue":null,"work_id":"b996280b-c3dd-44e8-a0f5-956de7e05a7d","year":2022},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.634204Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:40c6a7df0ca0223c4b142f24f73a58cb028d03f364f3996e79524fbdbadc2889","observation_id":"53a0f124-a23e-4573-b928-03ba0be8faa7","resolution":{"observed_at":"2026-08-10T22:31:37.784917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:37.765648Z","title":"Monoperfcap: Human performance capture from monocular video","venue":null,"work_id":"66b238c5-39c7-485f-9d3f-78be1034fda3","year":null},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.638223Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:9e741118fbe0842a1382a736a579df5dff7989eea578fc3f5abf89d8ca4ee19f","observation_id":"e9dd85a2-256b-49da-a0d0-70e9014053de","resolution":{"observed_at":"2026-08-10T22:31:37.770230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:37.750865Z","title":"Closet: Modeling clothed humans on continuous surface with explicit template decomposition","venue":null,"work_id":"b6311b79-2e96-47b3-94b7-9565044159d4","year":2023},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.642213Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:b7188f861861a843d4a62cb008d167fe28847b8366758aef6394c2ee0fac75f6","observation_id":"496d3951-abcb-4bc9-9180-8346ac5b1bf4","resolution":{"observed_at":"2026-08-10T22:31:37.755813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:31:37.733291Z","title":"Registering explicit to implicit: Towards high-fidelity gar- ment mesh reconstruction from single images","venue":null,"work_id":"f4c35ac7-68d0-43ce-aa48-36452f88b4ac","year":2022},"citing_paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-10T22:31:37.646411Z"},"links":{"citing_paper":"/paper/2501.01589"},"observation_digest":"sha256:70d1ea0c4c2f6f8a5c2decaa39435c82ea7746127b46e721929604d304a834ee","observation_id":"2a46971f-b30b-45ec-a586-267ada99583c","resolution":{"observed_at":"2026-08-10T22:31:37.740012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.01589","last_updated":"2025-01-03T00:58:35Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T15:00:34.349409Z","submitted_at":"2025-01-03T00:58:35Z","title":"D$^3$-Human: Dynamic Disentangled Digital Human from Monocular Video"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":49},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 0 inbound Pith citation observations for arXiv:2501.01589."}